| name | token-budget-advisor |
| description | 답변하기 전에 얼마나 깊게 응답할지 사용자가 선택할 수 있게 돕습니다. 사용자가 응답 길이, 깊이, 토큰 예산을 명시적으로 제어하고 싶을 때 사용합니다. 사용자가 "token budget", "response length", "short version", "detailed answer"처럼 답변 크기나 깊이를 제어하려 할 때 활성화합니다. 현재 세션에서 이미 수준이 정해졌거나, 명백히 한 단어 답변이면 활성화하지 않습니다. |
| origin | community |
Token Budget Advisor (TBA)
Claude가 답하기 전에 응답 깊이에 대한 선택지를 먼저 제시하도록 응답 흐름을 가로챕니다.
사용 시점
- 사용자가 답변이 얼마나 길거나 자세할지 제어하고 싶을 때
- 토큰, 예산, 깊이, 응답 길이를 언급할 때
- "short version", "tldr", "brief", "al 25%", "exhaustive" 등을 말할 때
- 사용자가 깊이/세부 수준을 먼저 고르고 싶어 할 때
현재 세션에서 이미 수준을 정했거나, 답이 한 줄이면 충분한 경우에는 트리거하지 않습니다.
동작 방식
1단계: 입력 토큰 추정
저장소의 context-budget 휴리스틱으로 프롬프트 토큰 수를 대략 추정합니다.
- prose:
words × 1.3
- code-heavy 또는 code block 위주:
chars / 4
혼합 콘텐츠면 지배적인 유형 기준으로 추정합니다.
2단계: 복잡도에 따른 응답 크기 추정
프롬프트를 분류하고 multiplier 범위로 전체 응답 창을 잡습니다.
| Complexity | Multiplier range | Example prompts |
|---|
| Simple | 3× – 8× | 단일 사실, yes/no |
| Medium | 8× – 20× | 개념 설명 |
| Medium-High | 10× – 25× | 맥락이 있는 코드 요청 |
| Complex | 15× – 40× | 다중 파트 분석, 비교, 아키텍처 |
| Creative | 10× – 30× | 이야기, 에세이, 서사 작성 |
응답 창 = input_tokens × mult_min ~ input_tokens × mult_max
3단계: 깊이 옵션 제시
실제 추정 수치를 넣어, 답변 전에 다음 블록을 제시합니다.
Analyzing your prompt...
Input: ~[N] tokens | Type: [type] | Complexity: [level] | Language: [lang]
Choose your depth level:
[1] Essential (25%) -> ~[tokens] Direct answer only, no preamble
[2] Moderate (50%) -> ~[tokens] Answer + context + 1 example
[3] Detailed (75%) -> ~[tokens] Full answer with alternatives
[4] Exhaustive (100%) -> ~[tokens] Everything, no limits
Which level? (1-4 or say "25% depth", "50% depth", "75% depth", "100% depth")
Precision: heuristic estimate ~85-90% accuracy (±15%).
4단계: 선택된 수준으로 응답
| Level | Target length | Include | Omit |
|---|
| 25% Essential | 2-4문장 | 직접 답변, 핵심 결론 | 맥락, 예시, 뉘앙스 |
| 50% Moderate | 1-3문단 | 답변 + 필요한 맥락 + 예시 1개 | 깊은 분석, 엣지 케이스 |
| 75% Detailed | 구조화된 답변 | 여러 예시, pros/cons, 대안 | 극단적 엣지 케이스 |
| 100% Exhaustive | 제한 없음 | 전체 분석, 전체 코드, 모든 관점 | 없음 |
질문을 건너뛰는 단축 규칙
사용자가 이미 수준을 암시하면 바로 그 수준으로 답합니다.
| What they say | Level |
|---|
| "short version", "brief answer", "tldr" | 25% |
| "balanced answer", "50% depth" | 50% |
| "detailed answer", "75% depth" | 75% |
| "exhaustive answer", "full deep dive" | 100% |
이전 세션에서 수준을 정했다면, 사용자가 바꾸기 전까지는 조용히 유지합니다.
정확도 메모
실제 tokenizer가 아니라 휴리스틱 추정입니다. 대략 85~90% 정확도, 오차 ±15%를 가집니다.
예시
트리거 예시
- "Give me the short version first."
- "How many tokens will your answer use?"
- "Respond at 50% depth."
- "I want the exhaustive answer, not the summary."
트리거되지 않는 예시
- "What is a JWT token?"
- "The checkout flow uses a payment token."
- "Is this normal?"
- "Complete the refactor."
출처
TBA — Token Budget Advisor for Claude Code에서 가져온 독립 스킬입니다.