
何が起きたか
Sakana AI は Fugu Ultra v1.1 をリリースした。これはクエリを一流の AI モデルのプールに振り分けるルーターである。同社は v1.0 比で最大 7.9 ポイントのパフォーマンス向上を主張しており、ProgramBench と TerminalBench 2.1 で最大の改善が見られたという。Sakana は v1.1 が Fable 5 をルーターの選択プールに含めていないにもかかわらず、ほとんどのベンチマークで Anthropic の Fable 5 を上回ると報告している。
なぜ重要か
Fugu Ultra は単一の大規模モデルを構築するのではなく、既存モデル間でインテリジェントにリクエストをルーティングすることで優れたパフォーマンスを得る方法として位置付けられている。価格は入力トークン 100 万個あたり 5 ドル、出力トークン 100 万個あたり 30 ドルのままである。ただし、すべての主張は Sakana 自身からのものであり、まだ独立した第三者による検証は存在しない。これは重要な制限である。なぜなら Fugu の初期バージョンはトークン使用量が多く、速度が遅く、結果が不十分であることで批判されたからである。
注目点
Sakana は新しい一流モデルがプールに追加される前に、約 2 週間のトレーニングと評価を行うと述べている。このアップデートは端末での使用のために Claude Code 互換のエンドポイントを追加する。Fugu は OpenRouter と Vercel で利用可能だが、Sakana は GDPR と EU 固有の規制を理由に EU と EEA に提供していない。
こういう要約が、毎朝あなたのメールに届きます。
Fugu Ultra v1.1 は、複数のモデル間でクエリをインテリジェントに振り分けることの AI ルーティングを、単一の大規模モデルを構築または微調整するための競争力のある代替手段として位置付ける Sakana の試みを表しています。v1.0 比での 7.9 ポイントのパフォーマンス向上の主張、特に ProgramBench と TerminalBench 2.1 での向上は、最適化が行われていることを示唆しています。ただし、独立した検証の欠如は重大な注釈です。Sakana が Fable 5 をプールに含めずに v1.1 が Fable 5 を上回ると主張している事実は、本物のアーキテクチャ効率を示すか、ベンチマーク自体が実世界の使用を代表していない可能性があることを示しています。
Fugu の初期バージョンはトークン使用量が多く、応答時間が遅く、結果が失望的であることで懐疑的な見方を受けました。7.9 ポイントの向上がこれらの問題に対処する可能性がありますが、外部で検証された場合のみです。Claude Code 互換のエンドポイントの追加は、Sakana が開発者ワークフローとより深く統合しようという意図を示しています。プールに新しいモデルを追加するための 2 週間の評価期間は、Sakana が新しいモデルが出現したときに Fugu を最新に保つプロセスを持っていることを示唆していますが、これはプールが静的ではなく、v1.1 のパフォーマンスについての主張はモデルが追加または削除されるときに変わる可能性があることも意味します。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
2026年7月、GoogleはNotebookLMをGemini Notebookに改名

ServiceNow AIの年間契約価値が第2四半期に10億ドルを突破

習近平氏はニューデリーのBRICS首脳会議で、中国がオープンソースAIのBRICS「共同体」を主導し、大規模言語モデルやAIセミナー・訓練での協力を支援すると述べた

韓国の会社員がコミュニティ「リメンバー」に、胸の圧迫感と呼吸の異常をChatGPTに相談したところ心臓や肺の問題を否定できず、検査のため病院に行ったものの異常はなかったと書き込んだ

Palo Alto NetworksがAIコーディングエージェントのセキュリティ確保に関する指針を公表し、これらのツールへの企業支出が今年130億ドルを超え、年60%超で複利拡大すると指摘した

WSJの9月13日付What's Newsによると、AnthropicのAmodei氏がAIの減速を提唱した
