| name | token-budget-advisor |
| description | 向用户提供关于在回答之前要消耗多少响应深度的知情选择。当用户明确想要控制响应长度、深度或令牌预算时使用此技能。 触发场景: "token budget", "token count", "token usage", "token limit", "response length", "answer depth", "short version", "brief answer", "detailed answer", "exhaustive answer", "respuesta corta vs larga", "令牌预算", "令牌数量", "令牌使用", "令牌限制", "响应长度", "回答深度", "简短版本", "简要回答", "详细回答", "详尽回答", "cuántos tokens", "ahorrar tokens", "responde al 50%", "dame la versión corta", "quiero controlar cuánto usas", 或明确要求控制答案大小或深度的变体。 不要触发场景:用户已在当前会话中指定了级别(保持该级别),请求显然是单词回答,或者 "token" 指的是身份验证/会话/支付令牌而非响应大小。 |
| origin | community |
令牌预算顾问 (TBA)
在 Claude 回答 之前,拦截响应流以向用户提供关于响应深度的选择。
何时使用
- 用户想要控制回答的长度或详细程度
- 用户提到令牌 (tokens)、预算、深度或响应长度
- 用户说“简短版本”、“tldr”、“简要”、“按 25%”、“详尽”等。
- 用户想要提前选择深度/细节级别的任何时候
不要触发场景:用户已在本会话中设置了级别(静默保持),或者答案显而易见只有一行。
如何工作
第 1 步 —— 估算输入令牌
使用代码库规范的上下文预算启发式方法在脑海中估算提示词的令牌计数。
使用与 context-budget 相同的校准指南:
- 散文:
字数 × 1.3
- 代码密集型或混合/代码块:
字符数 / 4
对于混合内容,使用主要内容类型并保持估算启发式。
第 2 步 —— 按复杂度估算响应大小
对提示词进行分类,然后应用倍数范围以获得完整的响应窗口:
| 复杂度 | 倍数范围 | 示例提示词 |
|---|
| 简单 (Simple) | 3× – 8× | "X 是什么?", 是/否, 单个事实 |
| 中等 (Medium) | 8× – 20× | "X 是如何工作的?" |
| 中高 (Medium-High) | 10× – 25× | 带有上下文的代码请求 |
| 复杂 (Complex) | 15× – 40× | 多部分分析、比较、架构 |
| 创意 (Creative) | 10× – 30× | 故事、文章、叙事写作 |
响应窗口 = 输入令牌 × 最小倍数 到 输入令牌 × 最大倍数(但不要超过模型的配置输出令牌限制)。
第 3 步 —— 提供深度选项
在回答 之前 提供此区块,使用实际估算的数字:
正在分析您的提示词...
输入:~[N] 令牌 | 类型:[type] | 复杂度:[level] | 语言:[lang]
请选择您的深度级别:
[1] 精简 (Essential) (25%) -> ~[tokens] 仅直接回答,无前言
[2] 适中 (Moderate) (50%) -> ~[tokens] 回答 + 上下文 + 1 个示例
[3] 详细 (Detailed) (75%) -> ~[tokens] 完整回答及替代方案
[4] 详尽 (Exhaustive) (100%) -> ~[tokens] 一切内容,无限制
哪个级别?(输入 1-4 或说 "25% 深度", "50% 深度", "75% 深度", "100% 深度")
精确度:启发式估算 ~85-90% 准确率 (±15%)。
级别令牌估算(在响应窗口内):
- 25% →
min + (max - min) × 0.25
- 50% →
min + (max - min) × 0.50
- 75% →
min + (max - min) × 0.75
- 100% →
max
第 4 步 —— 以所选级别进行回答
| 级别 | 目标长度 | 包含内容 | 省略内容 |
|---|
| 25% 精简 | 最多 2-4 句 | 直接回答,关键结论 | 上下文、示例、细微差别、替代方案 |
| 50% 适中 | 1-3 段 | 回答 + 必要上下文 + 1 个示例 | 深入分析、边缘情况、参考资料 |
| 75% 详细 | 结构化响应 | 多个示例、优缺点、替代方案 | 极端边缘情况、详尽参考资料 |
| 100% 详尽 | 无限制 | 一切内容 —— 完整分析、所有代码、所有视角 | 无 |
快捷方式 —— 跳过提问
如果用户已经发出了级别信号,请立即以该级别回答而无需提问:
| 用户说 | 级别 |
|---|
| "1" / "25% 深度" / "简短版本" / "简要回答" / "tldr" | 25% |
| "2" / "50% 深度" / "适中深度" / "平衡回答" | 50% |
| "3" / "75% 深度" / "详细回答" / "彻底回答" | 75% |
| "4" / "100% 深度" / "详尽回答" / "深度探讨" | 100% |
如果用户在会话早期设置了级别,后续回答请 静默保持 该级别,除非他们进行更改。
精确度注意
此技能使用启发式估算 —— 无真实令牌生成器。准确率 ~85-90%,方差 ±15%。请始终显示免责声明。
示例
触发器
- "先给我简短版本。"
- "你的回答将使用多少令牌?"
- "以 50% 的深度回答。"
- "我要详尽的回答,不要摘要。"
- "Dame la version corta y luego la detallada."
不触发
- "什么是 JWT 令牌?"
- "结账流程使用支付令牌。"
- "这正常吗?"
- "完成重构。"
- 用户已为会话选择了深度后的后续问题
来源
来自 TBA — Token Budget Advisor for Claude Code 的独立技能。
原始项目也附带了一个 Python 估算器脚本,但本代码库保持技能自包含且仅使用启发式方法。