
何が起きたか
開発者がlossless-compactionを公開した。Claude Code向けプラグインで、大きなデータをローカルストレージへ移す。
なぜ重要か
組み込みの方式は、モデルに会話を要約へ書き換えさせるのに時間とトークンを使うため、要約が落とした情報はコンテキストから消える。プラグインは元データへのポインタを残すので、誤っても情報は失われない。
注目点
プラグインは組み込みの要約より大きなコンテキストを保持するため、その経済性はプロンプトキャッシュの挙動と過去の情報の再利用にかかっている。開発者は圧縮率を未解決の課題として挙げている。
誰に効くか大規模リポジトリで長いClaude Codeセッションを動かす開発者やチームが直接の対象だ。彼らは現在、圧縮に数十秒待ち、自動圧縮のタイミングを気にしている。ただしコストの計算は、各自のワークフローでプロンプトキャッシュがどれだけ持つかにかかっている。
こういう要約が、毎朝あなたのメールに届きます。
このプラグインの設計は、組み込みの圧縮の仕組みへの直接的な反応だ。組み込みの圧縮は会話全体をモデルに渡して要約を作らせるため、その書き換えに時間とトークンがかかり、要約が省いた細部は次のコンテキストにもう残らない。開発者は以前、自動圧縮が来る前に都合の良い区切りで手動で/compactを実行して回避していたが、それではタイミングが変わるだけで、要約して再開する仕組み自体は手つかずのままだった。
検討した末に断念した別の方法は、どの情報が後で重要になるかをモデルに予測させるものだった。開発者はJevを使い、ある情報が必要になるかを判断させてみたが、期待した性能は出ず、投稿ではその理由を、現在のコンテキストだけから30ターン後に何が必要になるかを予測する難しさに帰している。代わりにlossless-compactionは、大きな項目を削除せずにコンテキストから外し、ID付きのチケットを残して、必要になったときにモデルが元の内容を呼び戻せるようにする。内容はSHA-256で識別し、削除前にディスクから読み戻して書き込みを確認する。
コストの話になると、比較は単純ではなくなる。組み込みの方式は圧縮時にコストを払い、その後は小さなコンテキストを保つが、捨てた情報が再び必要になれば、そのトークンはセッション記録からコンテキストに再び入る。プラグインは圧縮時にほとんどコストを払わないが、後のリクエストにはより大きなコンテキストを持ち込むため、プロンプトキャッシュが切れるとその大きな分を書き直さなければならない。開発者自身の整理では、問いは圧縮コストをなくす方法ではなく、どこでどの形で払うかだという。そのトレードオフがチームにとってどう働くかは、セッションがキャッシュを壊すほど長く止まる頻度と、後の作業が以前のコンテキストを実際にどれだけ再利用するかにかかっていそうだ。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
NASAとIBM Researchは約200万のタイルバンドルで学習したNASA-IBM Lunar Foundation Modelを公開し、氷堆積物予測誤差をSwinV2-B比で最大22パーセント削減した

RRSIは自己改善エージェントの編集数を上限設定し段階的に削減、批評器がベンチマーク固有の小細工を排除

Nvidia CEOのJensen Huang氏はSam Altman氏とDario Amodei氏の「終末論」を「無責任」と批判し、月曜にNvidiaはOpen Agent Safety Platformを投入した

QiitaのレビューがLooped Transformerの系譜を2018年のUniversal Transformers、Giannou et al.の2023年のprogrammable-computer論文、Byt…

AIが構成づくりや言い換えを代行し作業は速くなったが、しばらくすると何を作りたいのかわからなくなり、着手までの時間が延びた

設計ガイドは、通話を信頼できない入力として扱い、処方更新のスタッフタスク作成などの許可操作をワークフローサービスが決めるべきだとする
