
何が起きたか
Anthropicは、Claude Codeの出力トークンは入力トークンの約5倍のコストがかかり、1回の長いセッションは同じ作業を短いセッションに分けるより高くつくと指摘した。
なぜ重要か
エージェント型コーディングツールはタスク単位で課金され、セッションの進め方が支払額を左右する。キャッシュ読み込みは0.1倍だが復元は最大2倍。
注目点
キャッシュは最終使用から1時間、APIキー最終使用から5分で失効する。/modelと/effortを設定するAnthropicの助言が注目だ。
誰に効くかトークン単位で支払うClaude Code利用の開発者やエンジニアリングチームにとって、この指針は月々の支出に関わる話だ。タスク間でのコンテキストのクリアやセッション開始時のモデル設定など、Anthropicが勧める対策はプラットフォーム設定ではなく、個々のエンジニアが行う行動である。
こういう要約が、毎朝あなたのメールに届きます。
Anthropicの投稿は、トークン単位で支払うすべての人にとって重要な区別を打ち出している。サブスク型のコーディングツールはリクエストのコストを隠すが、Claude Codeのようなエージェント型ツールはタスクごとに課金される。投稿はトークンがどこへ消えるかを、プリフィル段階とデコード段階に分けて説明する。プリフィルでは、モデルがリクエスト、コンテキスト、システムプロンプト、CLAUDE.md、メッセージ、そして前回のメッセージ以降に会話へ追加されたすべて——Claudeが読んだファイルやコマンド出力を含む——を読み込む。デコードでは、思考・ツール呼び出し・テキストといった出力トークンが1つずつ生成される。
助言の多くはプロンプトキャッシュに帰着する。Anthropicはこれをコストを抑える仕組みだと説明する。キャッシュ読み込みは入力価格の0.1倍、キャッシュへの書き込みは最大で入力価格の2倍だが、トークンごとに1回しか発生しない。Anthropicは、ユーザーの操作でキャッシュが無効になり得ると警告する。キャッシュはリクエスト先頭での一致が必要なため、セッション途中でのモデルやエフォートレベルの切り替え、権限モードの変更、/compactの実行、あるいは単に時間が経過するだけで、会話全体が正規料金で読み直される。最終使用から1時間、APIキーの最終使用から5分での失効が主な原因だ。
Anthropicのまとめは、コストに最も大きく影響する4つの要因を挙げる。長いセッション、コンテキストの抱えすぎ、タスクに必要ない大きいモデルや高いエフォートレベルの使用、そして壊れたプロンプトキャッシュだ。実践的な提案——無関係なタスク間での/clear実行、開始前の/modelと/effort設定、Claudeに読ませるのではなくファイルを添付する、早めに/contextを確認する、キャッシュ失効前に/compactを実行する——はいずれも同じ方向を向いている。実際に請求額が下がるかは、各エンジニアがセッション開始時の助言をどれだけ忠実に守るかにかかりそうだ。Anthropicが示す最も安い道(入力の0.1倍のキャッシュ読み込み)は、セッション途中の変更で最も失われやすいからだ。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
CADDiは評価額12億ドルで1億1400万ドルを調達した
Infosys元CEOのVishal Sikka氏が創業したHang Ten Systems Inc.が、Xora Innovation主導の5300万ドルの2度目のシードラウンドを発表
DIGITIMESによると、Elon Musk氏がTeslaとSpaceXの合併を示唆した

GitHubはCopilot CLI・アプリ・SDKを支えるエージェントランタイムを800,000行超の本番Rustに書き換えた

OpenAIはAIの不正整合──モデルが予期せぬ挙動を取る現象──を公開開示する枠組みを発表し、未公表の事例も共有した

SnapはGmailやSlackなどのアカウントを連携する「先回り型AIサービス」Specs Intelligenceを発表
