
何が起きたか
MistralがMistral Large 4を発表。ネイティブのマルチモーダルモデルで、総パラメータ数1.05兆、活性パラメータ490億、Coding Agent Indexで49.8%を記録。
なぜ重要か
MistralはLe Chonkがコーディングとエージェントタスクで競合のオープンウェイトモデルを上回ると主張し、中国以外で最高のオープンウェイトモデルと位置付ける。
注目点
重みはまだ公開されていない。Mistralはパートナーや政府との安全テストを経て、2026年10月末までに公開する計画。アーキテクチャの詳細とベンチマークに注目。
誰に効くかコーディング、エージェント、セキュリティ業務向けにオープンウェイトモデルを検討する開発者やITチームは、欧州でホストされる選択肢を得られる可能性がある。ただし重みは公開前に安全審査を経る。
こういう要約が、毎朝あなたのメールに届きます。
2026年10月6日にリリースされたMistral Large 4は、欧州発としては異例のオープンウェイト路線だ。総パラメータ1.05兆はMixture-of-Expertsアーキテクチャに分散され、1回の回答で動くのは490億のみ。この設計により、巨大さにもかかわらず導入可能なモデルに仕上がっている。モデルはMistral自社のインフラで学習・提供され、Mistralはこれを、外部のAIプロバイダーに依存したくない企業や政府にとっての「AI主権」の問題だと位置付ける。
Mistralはこのモデルを中国のオープンウェイト競合に明確に対抗させる構えで、Coding Agent Indexの49.8%と、同指標でのDeepSeekやQwenモデルへの勝利を挙げる。Surge AIによる別のブラインド採点テストでは、5モデル中2位。Claude Opus 5に次ぎ、GLM-5.3、Kimi K3、GLM-5.2を上回った。Mistralはさらに、サイバー防御、金融、法務のワークロードで最先端の結果を主張し、視覚グラウンディングではGPT-6 Astraをわずかに上回ったとしている。
短期的な試金石は、約束された10月末の重み公開だ。Mistralはその際にアーキテクチャの詳細と追加ベンチマークを公表するとしている。それまではAPI経由のPublic Previewにすぎず、根拠の多くはMistral自身の評価に依存する。Le Chonkへの賭けが実るかどうかは、外部の開発者が実際に動かせるようになった後、どう反応するかにかかっている。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
Zennの筆者がClaude Docsの「タスク管理帳」1枚を紹介

投稿者がdots・Claude Code・Codexをつなぐ仕組みを試験運用し、2026-10-06から1日ほどで21件を処理した

9月25日17時44分、Claude Codeに起動させたCeleryのワーカーとbeatが会話を閉じると同時に終了し、翌朝に定期実行が止まっていたことが判明した

Google DeepMindのgoogle/embeddinggemma-2をGoogle Colab無料版で動かし、日本語「猫の写真」で猫画像が2位(0.7149)、「宇宙へ飛んでいくロケット」でrocket画像が2…

ユーザーはNew Yorker風の漫画をChatGPTに頼んだだけだが、Brendan Loperの「BLoper」署名が自動で追加された

ガートナーは、ベンダーのFDEが開発したAIエージェントの70%が2028年までに企業に使われず放棄されると予測
