
Zhipu AIのCEO・Jie Tang氏がパラメータ数中心のAIスケーリング戦略は過去だと宣言した。
GLM 5.3の性能向上はパラメータ増加ではなく強化学習による質的改善が源だ。
今後の競争は長期推論能力と実環境訓練環境の品質に移る。
何が起きたか
Zhipu AIのCEO・Jie Tang氏がスケーリング法則の新時代を宣言。GLM 5.3の大幅な性能向上はパラメータ増加ではなく、長期環境でのRL(強化学習)から生まれた。同じベースモデル・アーキテクチャのGLM 5.2から約1ヶ月の追加RL で実現したという。
なぜ重要か
従来のAI産業はパラメータ数で競争していたが、Jie Tang氏は「パラメータはデータ量、計算配分、実行環境と並べて初めて意味を持つ」と指摘。推論型タスク(ソフトウェア脆弱性発見など)は20段以上の長い因果チェーン追跡を求め、パラメータ数だけでは不足するとみられる。日本の企業がAIモデルの性能向上を目指す際、パラメータ数の増加だけでなく強化学習の環境設計が重要な競争要因になる可能性がある。
注目点
GLM 5.3はTerminal Benchで#2、Legal Benchで#3、Skills Benchでオープンウェイト中#6の成績を収めた。RL環境はエンジニアが実際に行う業務を反映し、合成パイプラインで大規模生成される。進化したタスク環境こそが次の競争軸である。
Zhipu AIが打ち出す「死のパラメータ」論は、AIモデル開発の競争軸が根本的に移行したことを象徴している。従来のChinchilla法則は固定的なトークン/パラメータ比(200~900)を想定していたが、タスク依存性が高く、暗記型と推論型で最適点が大きく異なることが明かされた。GLM 5.3は同じベースモデルから1ヶ月のRL投資で実現した跳躍であり、これはパラメータ数競争の終焉を示す。代わりに浮上するのは、合成パイプラインで生成された実務環境での長期RLの質、検証器の自動化、RL報酬信号の信頼性である。オープンウェイトでもOrnith-1.5やGLM 5.3がTerminal BenchやSWE-Benchで高位に名を連ねるのは、パラメータ数よりもRL訓練レシピの品質がより決定的になったことを示唆している。
AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。
登録無料・30秒で完了・いつでも解除できます
この記事についてわからないことをAIに質問できます。Q&Aはこのページに公開され、他の読者も読めます。
経営者がChatGPTの魅力的な出力に説得され、AI専門知識のないコンサルタントによる高級なスライドを信頼して、エージェントAI(自分で判断して作業するAI)の導入を進めている

MIT ライセンスのオープンソースプロジェクト AI.DIY が tryaidiy.com で公開開始

OpenAIはGPT-Image-2の透明背景対応をAPIで試験運用開始

OpenAIが7月9日に投入した新モデル「GPT-5.6 Sol」により、四半期売上が35%増加し、法人向け売上は50%以上増えた

HP Koreaは大規模言語モデル(LLM)スタートアップのUpstageと提携し、ローカライズされたAI戦略を推進する

研究者が3人のコメント者から方法論に異議を唱えられた後、LLM履歴書スクリーニングのバイアスに関する先行研究を再実施した
