
Token Budget Advisor
- 1.4k installs
- 238k repo stars
- Updated August 5, 2026
- affaan-m/ecc
This is a copy of token-budget-advisor by affaan-m - installs and ranking accrue to the original listing.
token-budget-advisor is a Claude Code skill that lets developers choose response depth and token usage before an agent generates a full answer when controlling answer length or spend.
About
token-budget-advisor, abbreviated TBA, intercepts the response flow before Claude answers so users pick how much depth to consume. Trigger phrases include token budget, token count, response length, answer depth, short version, detailed answer, exhaustive answer, and explicit percentage requests such as respond at 50%. The skill does not fire when the user already set a level for the session, wants a one-word reply, or refers to auth or payment tokens instead of LLM tokens. Use token-budget-advisor when answer size should be negotiated up front to save tokens on large explanations or reserve depth for complex tasks.
- Intercepts response flow to offer depth choice before Claude answers
- Triggers on explicit mentions of token budget, response length, or depth control
- Prevents unnecessary long outputs when user wants brief or TLDR version
- Maintains chosen depth level silently within the same session
- Supports multilingual triggers including Spanish variants like "respuesta corta"
Token Budget Advisor by the numbers
- 1,398 all-time installs (skills.sh)
- +86 installs in the week ending Aug 5, 2026 (Skillselion tracking)
- Data as of Aug 5, 2026 (Skillselion catalog sync)
npx skills add https://github.com/affaan-m/ecc --skill token-budget-advisorAdd your badge
Show developers this skill is listed on Skillselion. Paste this into your README.
| Installs | 1.4k |
|---|---|
| repo stars | ★ 238k |
| Last updated | August 5, 2026 |
| Repository | affaan-m/ecc ↗ |
How do you limit Claude response length before answering?
Let users choose response depth and control token usage before an agent generates a full answer.
Who is it for?
Developers who want explicit control over answer depth and token spend before Claude generates long responses.
Skip if: Sessions where depth level is already set, one-word answers are requested, or token refers to auth or payment credentials.
When should I use this skill?
User mentions token budget, response length, answer depth, short versus detailed versions, or percentage-based response sizing.
What you get
User-selected depth tier, token-conscious response plan, and appropriately scoped agent output.
- Depth tier selection
- Token-scoped response plan
Files
トークンバジェットアドバイザー(TBA)
Claudeが回答する前にレスポンスフローをインターセプトし、ユーザーが回答の深さを選択できるようにする。
使用場面
- ユーザーが回答の長さや詳細度を制御したい場合
- ユーザーがトークン、バジェット、深さ、または回答の長さに言及する場合
- ユーザーが「短いバージョン」「TL;DR」「簡潔に」「25%」「詳細に」などと言う場合
- ユーザーが事前に深さ/詳細度を選択したい場合
トリガーしない場合:ユーザーが本セッションですでにレベルを設定している(静かに維持)、または回答が本質的に一行。
動作原理
ステップ 1 — 入力トークンを推定する
リポジトリの標準コンテキストバジェットのヒューリスティックスを使用して、プロンプトのトークン数を頭の中で推定する。
context-budget と同じキャリブレーションガイドラインを使用する:
- 散文:
words × 1.3 - コード集約またはコード混在/コードブロック:
chars / 4
混在コンテンツの場合、支配的なコンテンツタイプを使用し、推定ヒューリスティックスを保持する。
ステップ 2 — 複雑度に応じてレスポンスサイズを推定する
プロンプトを分類し、乗数範囲を適用して完全なレスポンスウィンドウを得る:
| 複雑度 | 乗数範囲 | プロンプト例 |
|---|---|---|
| シンプル | 3× – 8× | 「Xとは何ですか?」、はい/いいえの質問、単一の事実 |
| 中程度 | 8× – 20× | 「Xはどのように機能しますか?」 |
| 中〜高 | 10× – 25× | コンテキスト付きのコードリクエスト |
| 複雑 | 15× – 40× | マルチパート分析、比較、アーキテクチャ |
| クリエイティブ | 10× – 30× | ストーリー、散文、ナラティブライティング |
レスポンスウィンドウ = input_tokens × mult_min から input_tokens × mult_max(ただしモデルの設定済み出力トークン制限を超えない)。
ステップ 3 — 深さのオプションを提示する
回答する前に、実際に推定した数値を使用してこのブロックを提示する:
プロンプトを分析中...
入力:~[N] トークン | タイプ:[タイプ] | 複雑度:[レベル] | 言語:[言語]
深さレベルを選択してください:
[1] ベーシック (25%) -> ~[トークン数] 直接回答、前置きなし
[2] 適度 (50%) -> ~[トークン数] 回答 + 背景 + 1つの例
[3] 詳細 (75%) -> ~[トークン数] 代替案を含む完全な回答
[4] 徹底的 (100%) -> ~[トークン数] すべて、制限なし
どのレベルを選択しますか?(1-4 または「25%の深さ」「50%の深さ」「75%の深さ」「100%の深さ」)
精度:ヒューリスティック推定、約85〜90%の精度(±15%)。各レベルのトークン推定(レスポンスウィンドウ内):
- 25% →
min + (max - min) × 0.25 - 50% →
min + (max - min) × 0.50 - 75% →
min + (max - min) × 0.75 - 100% →
max
ステップ 4 — 選択されたレベルで回答する
| レベル | 目標の長さ | 含む内容 | 省略する内容 |
|---|---|---|---|
| 25% コア | 最大2〜4文 | 直接回答、重要な結論 | コンテキスト、例、ニュアンス、代替案 |
| 50% 適度 | 1〜3段落 | 回答 + 必要なコンテキスト + 1つの例 | 深い分析、エッジケース、参考文献 |
| 75% 詳細 | 構造化された回答 | 複数の例、長所/短所、代替案 | 極端なエッジケース、網羅的な参考文献 |
| 100% 徹底的 | 制限なし | すべて——完全な分析、すべてのコード、すべての視点 | なし |
ショートカット——質問をスキップ
ユーザーがすでにレベルを示している場合、質問せずにそのレベルで即座に回答する:
| ユーザーの発言 | レベル |
|---|---|
| 「1」/「25%の深さ」/「短いバージョン」/「簡潔に」/「TL;DR」 | 25% |
| 「2」/「50%の深さ」/「適度の深さ」/「バランスの取れた回答」 | 50% |
| 「3」/「75%の深さ」/「詳細な回答」/「包括的な回答」 | 75% |
| 「4」/「100%の深さ」/「徹底的な回答」/「完全で詳細な分析」 | 100% |
ユーザーが本セッションですでにレベルを設定している場合、ユーザーが変更しない限り後続の回答も静かにそのレベルを維持する。
精度について
このスキルはヒューリスティック推定を使用する——実際のトークナイザーではない。精度は約85〜90%で偏差は±15%。常に免責事項を表示する。
例
トリガーシナリオ
- 「まず短いバージョンをください。」
- 「あなたの回答は何トークン使いますか?」
- 「50%の深さで回答してください。」
- 「徹底的な回答が欲しい、サマリーはいらない。」
- 「まず短いバージョン、次に詳細なバージョンをください。」
トリガーしないシナリオ
- 「JWTトークンとは何ですか?」
- 「チェックアウトフローは支払いトークンを使用しています。」
- 「これは正常ですか?」
- 「リファクタリングを完了してください。」
- ユーザーが本セッションの深さを選択した後の後続の質問
出典
TBA — Claude CodeのToken Budget Advisorから引用した独立スキル。 元のプロジェクトにはPython推定スクリプトも付属しているが、本リポジトリではスキルを自己完結型に保ち、ヒューリスティックスのみを使用する。
Related skills
How it compares
Use token-budget-advisor for proactive depth choice before replies; use cost-tracking to analyze spend after sessions complete.
FAQ
When does token-budget-advisor activate?
token-budget-advisor activates when users mention token budget, token usage, response length, answer depth, or explicit short versus detailed answer requests before Claude responds.
When should token-budget-advisor not run?
token-budget-advisor should not run when the session depth is already set, the user wants a one-word answer, or token refers to authentication or payment tokens instead of LLM usage.