AIToday
Latent Space掲載日時: 2026年5月5日 10:001分で読める

AIニュースレターが、モデルの品質よりもコンテキストパイプラインと「ハーネス」(エージェントを調整するミドルウェア層)がAI製品の差別化要因になりつつあると報告

LINEで送る
AIニュースレターが、モデルの品質よりもコンテキストパイプラインと「ハーネス」(エージェントを調整するミドルウェア層)がAI製品の差別化要因になりつつあると報告

3つのポイント

  1. Mason Drxyが報告したところによると、gpt-5.2-codexのプロンプトとミドルウェアの調整により、Terminal-Bench 2.0での性能が52.8%から66.5%に向上し、gpt-5.3-codexはtau2-benchで20%改善した。

  2. Hermes、deepagents、LangGraphなどのオープンソースハーネスが成熟しており、モデルに依存しない設計が進んでいる。複数のツイートでは、チームが良いハーネス内でオープンモデルをチューニングすることで、エージェントのコストを20倍以上削減できると指摘されている。

  3. コーディングエージェントの利用が開発者の行動を変えており、@theoは単一のCopilotメッセージで60M+トークンを消費し、$40のサブスクリプションに対して約$221のトークンコストを計上した例を報告。従来のチャットベースの定額課金モデルが長時間実行ジョブに対応していない課題が顕在化している。

この記事についてAIに質問する →

Latent Space元記事を読む
LINEで送る

こうしたAIニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • 半導体展2026、AI投資熱の試金石にDIGITIMES Asia · 1時間前
  • ソニー提訴で歌詞禁止条項追加Simon Willison's Weblog · 1時間前
  • 米国防総省にChatGPTとGrok追加THE DECODER · 1時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

次の記事へAIエージェントをbashループまで削ぎ落とした実装