AIToday

Nvidia、Vera Rubinチップで CPU強化

WIRED AI5時間前
Nvidia、Vera Rubinチップで CPU強化

要点

Nvidia が Vera Rubin チップシステムを発表。CPU と GPU をバンドルして AI データセンターを駆動し、前世代比で1ワット当たり10倍のトークン処理を実現する。AI ワークロードの複雑化と自律システム化に伴い、GPU だけでなく CPU 需要も急増する業界全体の傾向を反映している。OpenAI、Microsoft、Oracle など初期導入企業が既にハードウェアをテスト中で、Nvidia は2025年下半期の出荷を予定している。

こういう要約が、毎朝あなたのメールに届きます。

無料で登録 →

3つのポイント

  • 何が起きたか

    Nvidia は Vera Rubin チップシステムの性能ベンチマークを公開した。36個の Vera CPU と72個の Rubin GPU を単一の NVL72 スーパーチップに統合した CPU・GPU ハイブリッド構成で、前世代の Grace Blackwell 比で1ワット当たり10倍のトークン処理能力を実現。OpenAI は既に Vera Rubin ラック1台を本運用中。

  • なぜ重要か

    Nvidia は GPU サプライヤーの地位から脱却し、AI インフラストラクチャ全体のプロバイダーへと転換している。AI ワークロードが複雑で自律的なシステムへシフトするなか、データと通信ネットワーク調整用の CPU 需要が急増した。Vera Rubin の単一チップ設計は Blackwell 比でメモリ帯域幅が約3倍となり、AI 導入を制約していた高帯域幅メモリ不足の解決につながる。

  • 注目点

    Nvidia は Vera Rubin を2025年下半期に出荷予定で、初期顧客に Microsoft、OpenAI、Oracle を数えている。「ケーブルフリーコンピュート」とホットスワップ対応設計により、インストール時間は数時間から数分へと大幅短縮。AMD は今週 Helios AI チップラックの対抗製品を披露予定で、AI ハイパースケーラーや研究機関との複数年契約争奪戦が激化する。

詳細

Nvidia は先週サンタクララ本社の技術ワークショップで、次世代 AI データセンター駆動用のハイブリッド CPU・GPU スーパーチップ Vera Rubin を展示した。Nvidia の加速計算部門副社長で CUDA ソフトウェアの設計者 Ian Buck がブリーフィングを主導した。「我々は新しいアーキテクチャ、GPU だけではなく CPU も生み出すロードマップ上にいる」と Buck 記者団に述べた。「革新し続けなければならない、そうしなければシリコンバレーで死ぬ。」

Vera Rubin は Nvidia の Grace Blackwell ハイブリッドシステムの後継で、AI 向けてだけではなく、インフラストラクチャスタック全体を供給する同社の戦略を表している。単一の Vera Rubin NVL72 スーパーチップ内に、36個の Vera CPU が72個の Rubin GPU と組になり、益々複雑化する AI エージェントが必要とする統合、ネットワーク、データフロー管理を処理する設計となっている。Nvidia はまた Vera CPU をスタンドアロン製品として販売しており、中国顧客向けには8月にも準備完了可能と伝えている。

性能向上は著しい。Nvidia は Vera Rubin NVL72 システムが Grace Blackwell 比で1ワット当たり10倍のトークンを処理するとしている。これは AI ワークロード効率の指標である。新しい Vera CPU は AMD やインテルのライバル CPU よりも自律 AI タスク処理で高速だが、Nvidia 独自のテストは競合他社のやや旧型世代を使用している。局所メモリサブシステムは Blackwell 比でメモリ帯域幅が約3倍となり、AI 導入を制約している高帯域幅メモリ不足という重大な問題に対応する機能である。

Nvidia は運用上の改善も強調している。Vera Rubin NVL72 ラック(単一の液冷プラットフォーム内のチップスタック)は「ケーブルフリーコンピュート」「ホットスワップ」と謳われ、顧客は各ラックを数時間ではなく数分でインストール可能。全液冷により、エアクーリング比でチップ冷却に必要なエネルギーが削減され、別の効率面を加える。

アナウンスのタイミングは戦略的である。Nvidia は2025年春に Vera Rubin を披露し、詳細をゆっくり公開する傍ら予定通り出荷すると主張している。CEO Jensen Huang は Vera Rubin が「本格的な」生産へ移行し2025年下半期に出荷されると繰り返し述べており、初期顧客に Microsoft、OpenAI、Oracle を数えている。シリコンバレーの Nvidia データセンターラボのツアー中に、幹部は OpenAI が既に Vera Rubin ラック1台を本運用中と確認した。

Nvidia は遅延の見た目に特に敏感である。前世代の Blackwell チップは Nvidia カスタマイズサーバーラックに接続すると過熱し、設計変更と出荷延期を強いられ、信頼性を求める業界では信用上の傷になった。従って Vera Rubin ロールアウトは綿密に設計され検証済みものとして呈示されている。

この推進は直接競合の AMD 年次会議の直前に起きている。同社はそこで次世代 AI・データセンターチップを披露する予定である。日曜日に AMD は Nvidia の製品と競争する Helios AI チップラックについてさらに詳細を明かした。両社は Meta、Amazon のような大規模 AI ハイパースケーラーおよび OpenAI、Anthropic、SpaceX のような AI ラボとの大規模で複数年の契約争奪を目指している。AMD はデータセンター CPU マーケットでのシェアを過去2年間で大きく成長させ、依然データセンター CPU 収入を支配する x86 プロセッサのチップレット建築の認知された専門知識を活かしている。対照的に Nvidia はデータセンター CPU を ARM に基づいており、電力効率で知られた代替建築である。Nvidia 幹部の Buck と Nvidia DGX Cloud のプロダクトマーケティング責任者 Hannah Coutand は Vera Rubin の単石チップ設計がチップレット方式を放棄し、複数チップレットをステッチする際に課せられる「メモリ帯域幅とデータ移動への重い税」を排除し、データが単一統合回路を通してより迅速に移動可能と主張している。

背景と解説

Nvidia の Vera Rubin 推進は、同社が数ヶ月前から示唆してきた戦略的な転換を示すものである。AI ワークロードが純粋な学習から推論と自律システムへ発展し、AI モデルが複数のタスク、ツール、データフローを統合・管理するようになると、ボトルネックは変わった。GPU は依然として生計算で支配的だが、CPU はいま調整、ネットワーク、その他の統合業務を担当する。Nvidia は単一で最適化されたスーパーチップに両者を統合し、統一メモリアクセスを実現することで、顧客を自社スタック全体にロックインし、仕入先の混在を防ごうとしている。

タイミングは意図的で競争的である。AMD は過去2年間、x86 チップレット設計の業界標準としての長年の専門知識を活かし、データセンター CPU での着地を進めている。Nvidia は ARM ベースの単石設計が AI の特定ニーズ(高メモリ帯域幅、データ移動時の低遅延)に優れていると賭けている。Nvidia が開示したベンチマークはこの建築的選択が勝者だと同社が確信していることを示唆している。単一統合回路により、ステッチされたチップレットが課す「メモリ帯域幅への重い税」を回避できるというのが Nvidia 幹部がジャーナリストに直接述べた主張である。

Nvidia のマーケティング快進撃は機微な時期に起きている。同社の Blackwell チップは Nvidia カスタムサーバーラックに密に配置すると過熱問題に直面し、設計変更を余儀なくされ出荷が遅延した。これは信頼性を重視する業界の傷である。Vera Rubin ベンチマークを事前告知し、OpenAI、Microsoft、Oracle が既にハードウェアをパイロット運用中であることを明かすことで、Nvidia は Vera Rubin が予定通り出荷され約束された効率向上を実現するという確信を再構築しようとしている。

よくある質問

Vera Rubin とは何か、また Nvidia の既存チップとどう異なるか
Vera Rubin は Nvidia の Grace Blackwell の後継で、CPU と GPU を単一の液冷スーパーチップシステムに統合している。NVL72 構成では36個の Vera CPU が72個の Rubin GPU と対になる。競合の AMD が採用するチップレット設計ではなく、単一統合回路の単石設計により、チップ内でのデータ移動が高速化される。
Vera Rubin はいつ利用可能になるか
Nvidia は Vera Rubin を2025年下半期に出荷予定。同社は中国顧客向けに、スタンドアロン製品として販売される Vera CPU は8月にも準備完了可能と伝えている。既にハードウェアを使用中の初期顧客に OpenAI、Microsoft、Oracle が含まれる。
Vera Rubin は Grace Blackwell からどう改善されたか
Vera Rubin は Grace Blackwell 比で1ワット当たり10倍のトークン処理を実現し、メモリ帯域幅は約3倍に増加。「ケーブルフリーコンピュート」とホットスワップ設計により、インストール時間は数時間から数分へと短縮。100% 液冷システムにより冷却エネルギーが削減される。

「AIコーディング」の最新ニュースを、毎朝7時にお届けします

AIが要約して、あなたの選んだトピックだけを1日1通。LINE・Email・Slackで届きます。

登録無料・30秒で完了・いつでも解除できます

ディスカッション

まだコメントがありません。最初のコメントを投稿しましょう!

ログインして議論に参加

関連記事

AIニュースを毎日お届け

200以上のソースから厳選したAIニュースを毎日無料でお届けします。

無料で始める

登録無料・30秒で完了・いつでも解除できます

毎朝1分、AIの要点だけ。

200媒体以上・Email/LINE/Slack 対応

無料で受け取る →