
何が起きたか
評価額250億ドルのニューヨークのAI企業Reflectionが、初のオープンモデルBeamを公開。ベンチマークでGLM-5.2に匹敵し、西側の競合オープンモデルより3〜4倍効率的だと主張。
なぜ重要か
Beamは、低コスト・短時間で高性能とメーカーが主張する西側オープンモデルである。ベンチマーク主張はReflection自身によるもので外部確認はない。
注目点
Beamの効率性とベンチマーク同等性の主張が独立したテストで裏付けられるかどうか。Reflection自身がベンチマークテストを実施したためだ。同社はより大規模な次期モデルをすでに学習中だとしている。
誰に効くかコーディングやエージェントタスク向けにオープンモデルを評価する企業のAIチームや開発者は、より安価な選択肢を得る可能性がある。ただし効率性とベンチマークの主張はReflection自身のテストによるもので、独立した検証はまだされていない。
こういう要約が、毎朝あなたのメールに届きます。
ReflectionのBeamは、MoonshotのKimi K3やDeepSeekのV4など中国のオープンモデルが最も広く使われてきた市場に登場する。Z.aiのGLM-5.2とのベンチマーク同等性を主張することで、同社はBeamを性能で競争できる西側のオープンな代替手段として位置づけている。Reflectionによると、Beamは高性能コンピューティングによる強化学習を通じて効率化を実現し、コーディングやエージェントタスクで競争力のある結果を、はるかに少ないトークンコストと推論時間で提供する。
同社はモデルを支えるインフラの確保を迅速に進めている。6月にはNvidia GB300チップへのアクセスに向けてSpaceXと63億ドルのコンピュート契約を結び、7月にはクラウドプロバイダーNebius経由で10億ドルの契約を追加した。また5月には米国エネルギー省と米国国防総省にモデルを提供する提携を結び、公共部門の顧客を早期から重視する姿勢を示している。
Beamがオープンモデル市場の状況をどこまで変えるかは、Reflection自身がベンチマークを実施したため、独立したテストがベンチマークと効率性の主張を裏付けるかどうかにかかっている。もし裏付けられれば、OpenAI、Anthropic、Google DeepMindの独自モデルが性能でリードし続ける中でも、データ管理とコストの理由からオープンモデルを求める企業にとって、Beamは有力な選択肢になり得る。
業界と使っているAIツールを選ぶと、仕事に関係するニュースが毎朝届きます。
登録無料・Googleアカウントなら30秒・いつでも解除できますAITodayについて →
この記事についてわからないことをAIに質問できます。AIはこの記事・AIToday の過去記事・Wikipedia を読み、出典を付けて答えます。Q&Aはこのページに公開され、他の読者も読めます。
Ghost AIはAndreessen Horowitzがリードし、Abstract、Audacious Ventures、Nova、SV Angelが参加した1100万ドルの調達を実施
Moonshot AIは最終私募ラウンドを約500億ドルの評価額で完了し、早ければ今月中にも初期面談を開始、来年第1四半期の香港IPOを目指す

OpenAIはFortuneに対し、一部チームの候補者を対象に「ミッション面接」を試行中で、まずマーケティングと人事から始めると明かした

ReactorはNvidiaのベンチャー部門とSapphire Venturesを株主に迎え、調達総額が7400万ドルに達したと発表

OpenAIは数週間以内にEUの全ChatGPT・Codex有料プランユーザーへ不可視のテキスト透かしを展開し、検出ツールtextGrainの報告書を公開

Reflectionがパラメーター数5010億・アクティブ230億のオープンモデルBeamを発表
