
何が起きたか
Ollama 0.35は意思決定モデル対応リリースの第1弾で、Nimble、Tev1、Tev1:0.8bをローカルで実行できる。
なぜ重要か
意思決定モデルはチケットの振り分け、モデルルーティング、コンテンツモデレーションなどを担える。クラウドだけでなく手元のマシンでも動く。
注目点
今後の更新で、Macでの性能を高めるMLX対応や対応モデルの拡充という公表済みの計画が実現するかが試される。今後の更新を注視したい。
誰に効くかOllamaのようなローカルAIツールを使う開発者やITチームは、Jev系の意思決定モデルを自前のハードウェアで取得・実行できるようになった。チケットの振り分け、モデルルーティング、コンテンツモデレーションといったタスクをクラウドサービスに頼らずこなせる可能性がある。
こういう要約が、毎朝あなたのメールに届きます。
Ollamaはバージョン0.35を、一度きりの追加ではなく、意思決定モデルに対応する一連のリリースの第1弾と位置づけている。現在実行できるNimble、Tev1、Tev1:0.8bはJevと同じアイデアに基づいて作られており、同社はチケットの振り分け、モデルルーティング、コンテンツモデレーションといった実務的なタスクでの利用を想定している。
今回のリリースには公表済みのロードマップも伴う。今後の更新で、Macでの動作を高速化するMLX対応の追加と、対応モデルの拡充が計画されている。これは、Ollamaが最初の一連のモデルで止まらず、意思決定モデルのラインを時間をかけて育てる意向を示唆している。
すでにOllamaでAIをローカル実行している人にとって重要性を左右するのは、こうした計画された更新がどれだけ早く届くか、そしてさらに多くの意思決定モデルが続くかどうかだ。結果は、ロードマップが発表されるだけでなく実行されるか、そしてこれらのモデルが同社の挙げる振り分け、ルーティング、モデレーションのタスクで有用だと示せるかにかかっている。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
Google DeepMindがコーディングや企業向けナレッジワーク、サイバー防御向けにGemini 4 Argonを投入

VRAM 32GB環境で4ビット量子化のQwen3.8 27Bを試し、Q4_K_Sに切り替えるとVRAM使用量26GBで推論が高速化、記事要約をトラブルなく完了した

AWSは2026年8月25日、AIコーディングエージェント「Kiro」のシステムプロンプト評価の仕組みを明らかにした

GeneLabが314.6Mパラメータで学習した日本語専用の判断モデルsokudanを公開
