AIToday
大規模言語モデルAIビジネス・産業オープンソースAITHE DECODER掲載日時: 2026年8月27日 1:013分で読める

阿里巴巴、1/9の学習コストで高性能を謳う新モデルを発表

LINEで送る
阿里巴巴、1/9の学習コストで高性能を謳う新モデルを発表

要点

  • AlibabaのQwenチームは、新モデル「Qwen3.8-Flash-Next」を発表した。

  • 従来モデル比で約9分の1の学習コストで性能が向上したという。

  • 価格は入力100万トークンあたり0.16ドルと、競合他社より大幅に安い。

3つのポイント

  1. 何が起きたか

    AlibabaのQwenチームが、Qwen4のアーキテクチャプレビューとなるマルチモーダルMoEモデル「Qwen3.8-Flash-Next」を発表した。総パラメータは125Bだが、トークンあたりの活性化は6Bのみ。

  2. なぜ重要か

    Qwenチームによると、従来のQwen3.7-Plus(総パラメータ397B)と比較し、約9分の1の学習コストでより良い結果を達成した。コーディングとオフィスタスクで最大の改善が見られた。国内のAI開発企業は、より少ない学習コストで高性能なモデルを実現する新手法に注目する可能性がある。

  3. 注目点

    このモデルは、より大規模で高価なDeepSeek-V4-FlashやAnthropicのClaude Opus 4.6(Max)と比較して、テストしたタスクの大半でリードした。オフィス関連の性能差は顕著で、CoWorkBenchでは73.9に対し、DeepSeek-V4-Flashは45.1だった。

この記事についてAIに質問する →

背景と解説

今回の発表は、AlibabaがQwen4に向けたアーキテクチャ革新を先行して示す戦略とみられる。特に、フレーズ辞書として機能するN-gram埋め込み層をGPUではなく通常のシステムRAMに置く設計は、推論コストの構造を変える可能性がある。

このモデルの登場は、OpenAIやAnthropicに対する価格競争圧力を高めるだろう。Alibabaは8月上旬にハイエンドモデルQwen3.8-Maxを発表したばかりだが、Flash-Nextはその約12分の1のコストで、ほぼ同等の性能を提供する。実際、OpenAIはこれに対抗して新モデルの大幅な値下げを最近実施しており、価格競争が激化している。

これはユーザーにとっては歓迎すべき動きである一方、AIプロバイダーにとっては、投資家の成長期待に応えるための収益成長を難しくする要因とみられる。

よくある質問

新しいモデルはいつ使えるようになりますか?
Qwenによると、APIはまもなく利用可能になる予定です。プロダクション版は「Qwen3.8-Flash」としてQwenCloudから提供され、価格は入力100万トークンあたり0.16ドル、出力100万トークンあたり0.47ドルです。
Qwen3.8-Flash-Nextは何がすごいのですか?
総パラメータ125Bのうち、実際にトークンごとに活性化するのは6Bだけの高効率設計です。また、51Bのパラメータを持つ新しいN-gram埋め込み層が特徴で、これはGPUではなく通常のシステムRAM上で動作します。
競合モデルと比べて性能はどうですか?
Alibabaが公開したベンチマークでは、より大規模なDeepSeek-V4-FlashやClaude Opus 4.6(Max)を、テストしたタスクの大半で上回っています。特にコーディングやオフィスタスクで強い一方、GPQA Diamondなどの科学的推論や競技プログラミングではほぼ互角です。
LINEで送る

「大規模言語モデル」の最新ニュースを、毎朝7時にお届けします

たとえば、いま届くならこの3本です

  • 企業にエージェント統治の欠落SiliconANGLE AI · 1時間前
  • AIエージェントに「社員証」と「委任状」必須にITmedia AI+ · 1時間前
  • OpenAIがAIのROI新指標を提唱ITmedia AI+ · 1時間前

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できますAITodayについて →

AIに質問

この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。

関連記事

次の記事へ無人重機、テキサスとネバダで稼働開始