AIToday
大規模言語モデルAIコーディングAIビジネス・産業ITmedia AI+掲載日時: 2026年9月17日 10:01

AnthropicがClaude Codeのトークン消費を解説

LINEで送る
AnthropicがClaude Codeのトークン消費を解説

3つのポイント

  1. 何が起きたか

    Anthropicは、Claude Codeの出力トークンは入力トークンの約5倍のコストがかかり、1回の長いセッションは同じ作業を短いセッションに分けるより高くつくと指摘した。

  2. なぜ重要か

    エージェント型コーディングツールはタスク単位で課金され、セッションの進め方が支払額を左右する。キャッシュ読み込みは0.1倍だが復元は最大2倍。

  3. 注目点

    キャッシュは最終使用から1時間、APIキー最終使用から5分で失効する。/modelと/effortを設定するAnthropicの助言が注目だ。

誰に効くかトークン単位で支払うClaude Code利用の開発者やエンジニアリングチームにとって、この指針は月々の支出に関わる話だ。タスク間でのコンテキストのクリアやセッション開始時のモデル設定など、Anthropicが勧める対策はプラットフォーム設定ではなく、個々のエンジニアが行う行動である。

わからないところ、AIに聞けます

こういう要約が、毎朝あなたのメールに届きます。

背景と解説

Anthropicの投稿は、トークン単位で支払うすべての人にとって重要な区別を打ち出している。サブスク型のコーディングツールはリクエストのコストを隠すが、Claude Codeのようなエージェント型ツールはタスクごとに課金される。投稿はトークンがどこへ消えるかを、プリフィル段階とデコード段階に分けて説明する。プリフィルでは、モデルがリクエスト、コンテキスト、システムプロンプト、CLAUDE.md、メッセージ、そして前回のメッセージ以降に会話へ追加されたすべて——Claudeが読んだファイルやコマンド出力を含む——を読み込む。デコードでは、思考・ツール呼び出し・テキストといった出力トークンが1つずつ生成される。

助言の多くはプロンプトキャッシュに帰着する。Anthropicはこれをコストを抑える仕組みだと説明する。キャッシュ読み込みは入力価格の0.1倍、キャッシュへの書き込みは最大で入力価格の2倍だが、トークンごとに1回しか発生しない。Anthropicは、ユーザーの操作でキャッシュが無効になり得ると警告する。キャッシュはリクエスト先頭での一致が必要なため、セッション途中でのモデルやエフォートレベルの切り替え、権限モードの変更、/compactの実行、あるいは単に時間が経過するだけで、会話全体が正規料金で読み直される。最終使用から1時間、APIキーの最終使用から5分での失効が主な原因だ。

Anthropicのまとめは、コストに最も大きく影響する4つの要因を挙げる。長いセッション、コンテキストの抱えすぎ、タスクに必要ない大きいモデルや高いエフォートレベルの使用、そして壊れたプロンプトキャッシュだ。実践的な提案——無関係なタスク間での/clear実行、開始前の/modelと/effort設定、Claudeに読ませるのではなくファイルを添付する、早めに/contextを確認する、キャッシュ失効前に/compactを実行する——はいずれも同じ方向を向いている。実際に請求額が下がるかは、各エンジニアがセッション開始時の助言をどれだけ忠実に守るかにかかりそうだ。Anthropicが示す最も安い道(入力の0.1倍のキャッシュ読み込み)は、セッション途中の変更で最も失われやすいからだ。

よくある質問
Claude Codeの出力トークンは入力トークンよりどれくらい高いのか?
Anthropicによると、出力トークンのコストは入力トークンの約5倍。デコード段階がプリフィル段階よりはるかに長くGPUを占有するためだ。
1回の長いセッションが複数の短いセッションより高くつくのはなぜか?
Anthropicによると、各ターンで会話全体が再送されるため、40ターン目あたりではモデルがそれ以前の39ターンをすべて読み直すことになり、1回の長いセッションは複数の短いセッションより高くつく。
簡単なセッションで思考トークンをオフにするには?
Anthropicによると、MAX_THINKING_TOKENS=0で起動するとそのセッションの思考が無効になる。これは/effortをlowに設定するのに近いとしている。
ITmedia AI+元記事を読む
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • SnapのSpecs Intelligence、iOSプレビュー開始The Verge AI · 2時間前
  • Intel、MLPerf v6.1でXeon推論2.4倍Top Companies AI · 5時間前
  • AI基盤3社で価格分化Top Companies AI · 5時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へBenioff、AI企業に自己規制か責任問われると警告