30秒サマリー
- NVIDIAはVera Rubin NVL72に統合するGroq 3 LPXが量産フェーズに入ったと発表した
- ベンチマークでは長文コンテキスト処理において最近似代替比4倍の速度を記録
- CoreWeave・Nebius・SpaceXAIがVera Rubinプラットフォームの採用を表明
何が起きたか
NVIDIAは、ラックスケール推論システム「Vera Rubin NVL72」の拡張コンポーネントである「NVIDIA Groq 3 LPX」が量産体制(フルプロダクション)に入ったと公式ブログで発表した。発表の具体的な年については原文に明記がなく、カリフォルニア州パロアルトで開催中のHot Chips Conferenceに合わせた情報公開と説明されている。
Artificial Analysisが実施したベンチマーク(オープンソースのエージェント向けモデルGemma 4 31B使用)では、100,000トークンの長文コンテキスト処理において毎秒3,400出力トークンを記録し、最も近い代替プラットフォームと比べて4倍高速だったとされる。Groq 3 LPXはRubin GPUと協調動作し、GPUが大規模なコンテキスト処理を担う一方、LPXが遅延に敏感なデコード処理を高速化する役割分担を持つ設計となっている。ラックスケール構成では256基のLP30アクセラレーターを直接チップ間リンクで接続する。
業界パートナーの採用状況として、AIクラウドのNebius がGroq 3 LPXを初採用し「Nebius Token Factory」に組み込むと発表。CoreWeaveはVera Rubinラック間を複数の並列スイッチで接続する「Spectrum-X Multiplane」を本番環境に展開済みと報告された。SpaceXAIは地上データセンターから軌道上衛星までの次世代AIアーキテクチャをVera Rubin上で構築する計画を表明し、エージェントAIのオーケストレーションやコード実行等のCPU負荷処理にVera CPUを活用する方針を示した。
また、NVIDIAは「Scale-In」をAIネットワーキングの第5の柱として導入すると発表した。BlueField-4プロセッサとDOCAソフトウェアプラットフォームを基盤とし、マルチテナントネットワーク、高性能ストレージアクセス、シリコン内セキュリティ機能などをAIファクトリーインフラに統合するものと説明されている。
原典ハイライト
公式ブログは「次のAI推論時代はチップ単体の突破口ではなく、AIファクトリーの全層がいかに連携して動くかで決まる」と主張。Spectrum-X Multiplanについては512,000 GPUまでスケール可能な2層フラットネットワーク構成を実現し、1プレーン障害時でも総帯域幅の約90%を維持、ソフトウェアベースの負荷分散比11倍高速なハードウェアリカバリが可能と説明。スタック全体の「極限的な協調設計(Extreme Codesign)」をNVIDIAプラットフォームの基本原則として強調している。
出典: NVIDIA Blog(公式ブログ)
So What?(なぜ重要か)
AIの主戦場がモデル学習から推論・エージェント処理へ移行するにつれ、インフラに求められる要件が「学習スループット」から「低遅延・高スループットの同時達成」へと変質している。NVIDIAはGPU・LPU・ネットワーク・DPUを一体設計することで、この新要件をシステムレベルで解決しようとしており、単品コンポーネントで対抗する競合との差別化をエコシステム丸ごとの垂直統合で図る戦略を鮮明にした。CoreWeave・Nebius・SpaceXAIという多様なプレーヤーが相次いで採用を表明したことは、エージェントAI向けインフラ市場でVera Rubinが標準的な選択肢に近づきつつあることを示唆している。
日本企業への示唆
日本企業・クラウド事業者がエージェントAIの本格活用を検討する際、推論インフラの選定基準を「学習向けGPUの延長」ではなく「長文コンテキスト処理の低遅延・経済性」に置き直す必要がある。NVIDIAがラックスケールの一体設計を推進したことで、ベンダー選定は個別チップ比較よりもエコシステム全体(計算・ネットワーク・ソフトウェア)の評価が重要になる。Nebius・CoreWeaveのようなAIクラウド事業者を通じてVera Rubin基盤へのアクセスが広がる可能性があり、AIエージェント基盤の調達戦略・コスト試算を早期に見直すことが望ましい。
背景・経緯
AIワークロードはモデル学習中心から推論・エージェント処理中心へシフトしており、NVIDIAは「AIファクトリー」という概念でデータセンター全体を推論エンジンとして再定義しようとしている。Vera Rubin NVL72はその中核プラットフォームと位置づけられており、今回のGroq 3 LPX量産化発表はそのエコシステム拡充の一環。Spectrum-X Ethernet・BlueField DPUとの統合戦略は継続して発信されており、Hot Chips Conferenceはその技術詳細を業界向けに披露する場として活用されている。





