ツール利用やコード実行などを支えるエージェント型AI向けCPUが出荷段階に入った。NVIDIAのVera CPUは、GPUや推論アクセラレーター、接続・ネットワーク部品と組み合わせる7チップ構成の一部となる。
エージェント向けCPUが製品供給の段階へ
エージェント型AI向けに設計されたNVIDIA初のCPU「NVIDIA Vera CPU」の出荷が始まった。NVIDIAが示した段階は、設計の公表や採用予定にとどまらず、CPUを製品として供給する段階への移行である。
エージェント型AIでは、モデルの推論演算に加え、外部ツールの利用やコード実行を取りまとめるCPU側の処理が生じる。Vera CPUは、この処理経路をエージェント向け基盤へ組み込むプロセッサとして位置付けられている。
ツール利用とコード実行をCPUへ割り当てる
SpaceXAIは、将来のAIアーキテクチャにVera CPUを採用し、オーケストレーション、ツール利用、コード実行、データ処理、シミュレーションを高速化する計画を示した。これは稼働済みの導入事例ではなく、CPU集約処理をVera CPUへ割り当てる採用計画である。
NVIDIAは、Vera CPUが高いコア当たり性能とメモリ帯域を備え、負荷がかかった状態でも予測可能な性能を提供すると説明している。こうした設計によってエージェントの処理時間を短縮し、GPU基盤の稼働率維持を支えるとしている。
CPUを含む7種類のチップで推論基盤を構成
エージェント向けプラットフォームのNVIDIA Vera Rubinは、用途の異なる7種類のチップを組み合わせる。構成要素はVera CPU、Rubin GPU、Groq 3 LPU、NVLink 6 Switch、BlueField-4 DPU、Spectrum-6 SPX、ConnectX-9 SuperNICである。
この構成には、CPUとGPUだけでなく、推論アクセラレーター、チップ間接続、データ処理、ネットワークを担う部品も含まれる。Vera CPUの出荷開始により、エージェント向けCPUは、この異種チップ構成を形作る供給段階の製品となった。
最大30倍の測定値からCPUの寄与を切り分ける
NVIDIAは、ラックスケール推論システム「NVIDIA Vera Rubin NVL72」の評価にSemiAnalysis AgentXワークロードを用いた。このワークロードには、実際のエージェント型コーディングセッションで生じたコンテキストの増加、ツール呼び出し、サブエージェント生成が保存されている。
NVIDIAの初期測定では、DeepSeek V4 Proを動かしたVera Rubin NVL72が、GB300 NVL72に対して1メガワット当たり最大30倍のスループットを示した。ただし、この結果はSemiAnalysisの確認待ちであり、Vera CPUによるツール呼び出しの性能を含まないため、CPU単体の高速化を示す数値ではない。