PLAY AI 筆記回 PLAY AI
AI 時事新聞發布 · 6 分鐘 · 約 2,689 字

NVIDIA 於 AI Infra Summit 揭曉 Vera Rubin 與 DSX 平台,AI 工廠效能提升達 30 倍

NVIDIA 在 2026 年 9 月 15 日的 AI Infra Summit 中發布 Vera Rubin 平台與 DSX 設計,透過 Hugging Face AgentX 基準測試證明其 NVL72 系統在 agentic 工作負載上的每兆瓦 throughput 高達 GB300 的 30 倍,並將於 2026 年 3 月提供 Omniverse DSX Blueprint 供業界建構實體級 AI 工廠數位孿生。

NEWS
PLAY AI 觀察追蹤模型、產品與平台更新,優先整理官方來源與對一般使用者真正有影響的變化。
本篇內容
NVIDIA 於 AI Infra Summit 揭曉 Vera Rubin 與 DSX 平台,AI 工廠效能提升達 30 倍
NVIDIA 於 AI Infra Summit 揭曉 Vera Rubin 與 DSX 平台,AI 工廠效能提升達 30 倍

NVIDIA 於 AI Infra Summit 揭曉 Vera Rubin 平台與 DSX 設計

NVIDIA 在 2026 年 9 月 15 日於聖克拉拉會議中心舉辦的 AI Infra Summit 中發表演說,由 hyperscale 與高效能運算副總裁 Ian Buck 主導說明 AI 工廠效能提升策略。此次峰會吸引超過 8,000 人參與,較前一年成長近 130%。[1][3]

Vera Rubin NVL72 在 agentic 工作負載上達到 30 倍每兆瓦效率提升

根據 SemiAnalysis 的 AgentX 基準測試,NVIDIA Vera Rubin NVL72 系統在 agentic AI 工作負載(如編碼代理)上的每兆瓦 throughput 高達 NVIDIA GB300 NVL72 的 30 倍。此優勢隨互動性提升而擴大:在每使用者 110 輸出 token/秒時約為 2 倍,130 token/秒時達到 10 倍,而在 160 token/秒時才發揮完整的 30 倍優勢。[5]

Vera Rubin NVL72 效能提升
在 agentic 工作負載上的每兆瓦 throughput 優勢

DSX MaxLPS 軟體定義電力分配提升 GPU 密度

NVIDIA 的 DSX MaxLPS 技術透過工廠級電力優化,可在同一兆瓦功率預算下啟用多達 40% 更多的 GPU 數量。Lambda 在 Blackwell 伺服器上實測結果顯示,DSX MaxLPS 讓 19 個節點在原本只供 16 個全功率節點使用的功率預算內運行,使 cluster-wide token throughput 提升 24%(從約 400 千增至 500 千 token/秒),並改善 performance per watt 達 23%。[1][5]

DSX MaxLPS 提升 GPU 密度
在相同功率預算下啟用更多 GPU 數量

Vera Rubin 平台架構:結合自研 CPU、GPU 與 Groq LPU

Vera Rubin 平台由 NVIDIA 自行開發的 Arm 架構 Vera CPU 與 Rubin GPU 組成,後者具備 288GB HBM4 記憶體、最高 50 PFLOPS 的 FP4 推論效能,以及約 336 億個電晶體。平台採用分離式設計:Rubin GPU 負責 prefill 階段,而來自 Groq 的 LPX 加速器則專責快速 token decode,藉此實現分離式 prefill/decode 推論以優化延遲與吞吐。[2]

Omniverse DSX Blueprint 提供 AI 工廠實體級數位孿生

NVIDIA 在 2026 年 3 月 16 日的 GTC 大會上宣布 Vera Rubin DSX AI Factory 參考設計正式發布,並讓 Omniverse DSX Blueprint 成為一般公開版。該藍圖讓開發者能夠建構實體精準的 AI 工廠數位孿生,模擬電力、冷卻、網路與運作狀態,實時優化效能,以減少實體建置前的風險並加速上市時間。[6]

產業合作夥伴參與 DSX 參考設計與實體實作

  • Dassault Systèmes 將參考設計整合至其 CATIA 驅動的 Model Based Systems Engineering 平台,以建構 AI 工廠的虛擬雙胞胎。
  • Cadence 使用 SimReady 模型擬真 GB300 NVL72 系統,模擬熱流與流體數據以支援 AI 工廠設計。
  • Jacobs 基於 Omniverse DSX Blueprint 開發其資料中心數位孿生方案,提供從規劃到運營的完整優化流程。
  • Vertiv 利用該藍圖打造 Vertiv OneCore Rubin DSX,提供預製化、融合式資料中心基礎設施,以加速 AI 工廠佈署並提升每瓦特 AI 產出。
  • Nscale 與 Caterpillar 在西維吉尼亞州落地多吉瓦規模的 AI 工廠,採用 Vera Rubin DSX 參考設計。
  • CoreWeave 使用 NVIDIA DSX Air 在雲端建構數位孿生,透過實體交付前的操作演練縮短驗證時間。

NVIDIA 展望:打造全球最高產出的 AI 工廠

NVIDIA 表示,透過 Vera Rubin DSX AI Factory 參考設計與 Omniverse DSX Blueprint,公司正在提供構建全球最具生產力 AI 工廠的基礎,以加速首筆收入時間並最大化規模與能源效益。

資料來源與延伸閱讀

以下來源用於核對本文的技術背景與關鍵事實;正文中的編號可直接跳到對應來源。產品規格與時效性資訊仍以原始官方頁面最新版本為準。

查看 12 個來源
  1. AI Infra Summit: NVIDIA Vera Rubin and DSX Platform Advances ...
  2. Nvidia Vera Rubin Platform Official March 2026
  3. Pankaj Pramanik - AI Infra Summit: NVIDIA Vera Rubin and...
  4. Next in AI: Issue #261 - LinkedIn
  5. AgentX Benchmark: Vera Rubin NVL72 Achieves 30x Efficiency Gain Over GB300 for AI Agents
  6. NVIDIA Releases Vera Rubin DSX AI Factory Reference ...
  7. NVIDIA Announces Financial Results for Second Quarter ...
  8. NVIDIA Pushes DSX Deeper Into Data Center Infrastructure
  9. Nvidia Boosts Tokens per Watt by Up to 35x as AI Factory Competition Intensifies — BigGo Finance
  10. NVIDIA Reports Record Second-Quarter Fiscal 2027 Revenue of $96.2 Billion, Up 106% Year Over Year | Quiver Quantitative
  11. NVDA Press Release: NVIDIA Releases Vera Rubin DSX AI Factory Ref...
  12. NVIDIA Reports Early Production Results for DSX AI Factory Platform – Unite.AI