
何が起きたか
PrismMLは木曜日、Bonsai 2 27Bをリリースした。AlibabaのQwen3.8 27Bを5.9 GBに圧縮し、元モデル比でメモリを9~10倍削減。
なぜ重要か
Hassibi氏によれば、PrismMLの圧縮は元モデルと比べて性能がほとんど落ちないという。賭けだ。
注目点
PrismMLがベンチマークで100%の同等性に到達できるかは未知数だ。Hassibi氏は、圧縮には常にある程度の影響が残るだろうと話す。
誰に効くかAIをローカルで動かすすべての人、つまり借りたクラウドサーバーではなくすでに所有するマシンで推論モデルを動かしたい開発者やITチームが、最終的に恩恵を受ける可能性がある。ただし5.9 GBというサイズは、依然として高性能なスマートフォンを必要とするかもしれない。
こういう要約が、毎朝あなたのメールに届きます。
PrismMLはCaltechの研究者グループが設立し、Caltechの教授で圧縮の専門家であるBabak Hassibi氏が率いている。Khosla Ventures、Cerberus Capital、Caltechから2225万ドルのシードラウンドを調達し、Databricksの共同創業者でバークレーSky Computing Labのディレクターを務めるIon Stoica氏がアドバイザーに名を連ねる。
LLM圧縮に取り組むのは同社だけではない。スペインのDonostia International Physics Centerの教授が設立したMultiverse Computingもこの分野に取り組み、多額の資金を調達している。Hassibi氏は、PrismMLの技術が際立つのは、モデルの性能が元モデルと比べてほとんど落ちていない点だと主張する。ベンチマークの一致率は2回のリリースで95%から98%に向上した。同社によれば、初代Bonsaiはすでに1100万回以上ダウンロードされ、さらに小型のモデル群も260万回ダウンロードされている。
次の試練は規模だ。Hassibi氏は数カ月以内に数千億パラメータ規模のモデルをリリースする予定で、モデルが大きくなるほど知能を保つのは容易になると予測する。その規模で圧縮が持ちこたえるか、そして日々のデバイス利用につながるかが、未解決の問いだ。
たとえば、いま届くならこの3本です
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
OpenAIがGPT-6 Astraを法律調査向けに調整したAstra for Lawを発表した
AnthropicはAI主導の研究開発、自律型AIエージェントの監督、計算資源配分の3指標を詳述し、約3万体の自律エージェント稼働とAI安全性に計算能力の約6%を充てていると明かした
Anthropicは2026年9月8日、Claudeのトークンを浪費する6つのプロンプトのアンチパターンを示すブログ記事を公開し、/claude-api prompt-auditコマンドをテストした

NvidiaのJensen Huang CEOは安全性と速度のどちらかを選ぶ考えを否定し「両方を同時に実現することは間違いなくできる」と述べた

Thomas Ptacek氏がLLMを使った執筆に関する助言を公開し、「ルールその1:LLMが提案した言葉を一つたりとも使ってはならない」と述べ、「知的な防護具」と呼んで読者に厳守を促した

JPMorganがClaude Codeを使う一部エンジニアに月2,000ドルの支出上限を設定
