星期三, 26 8 月, 2026

NVIDIA Groq 3 LPX全面量產!攜手Vera Rubin打造次世代代理型AI運算工廠

NVIDIA 2026-01.jpg

下一個人工智慧(AI)推論時代,不會由單一突破性的晶片、網路或系統所定義,而是取決於AI工廠的每一層架構如何協同運作。正因如此,NVIDIA正擴展Vera Rubin NVL72,為代理型系統提供高速詞元生成能力。

NVIDIA Groq 3 LPX實現破紀錄的詞元生成速度

NVIDIA宣布,NVIDIA Vera Rubin機架級系統配備的NVIDIA Groq 3 LPX,現已全面進入量產。在執行開源代理型模型Gemma 4 31B的Artificial Analysis基準測試中,NVIDIA Groq 3 LPX針對代理型系統至關重要的10萬詞元長情境使用案例,每秒可輸出3,400個詞元,速度較最接近的替代平台快4倍。

全球產業合作夥伴積極導入Vera Rubin平台

全球產業合作夥伴正陸續採用Vera Rubin平台解決方案。SpaceXAI宣布將採用NVIDIA Vera CPU,驅動其下一代代理型AI。CoreWeave已在生產環境部署Spectrum-X Multiplane,透過多組平行交換器連接NVIDIA Vera Rubin機架,打造高頻寬、扁平化且無損的AI網路。Nebius則成為首家採用NVIDIA Groq 3 LPX的AI雲端服務供應商。

極致協同設計優化效能與降低詞元成本

極致協同設計是NVIDIA平台背後的核心設計原則。Vera Rubin專為加速推論而打造,讓代理能針對日益增長的長序列進行推理。NVIDIA Spectrum-X Ethernet可在AI工廠間高效傳輸龐大的資料流,而NVIDIA Groq 3 LPX則專為超高速詞元生成而打造,兩者共同展現NVIDIA如何在單一、整合的AI工廠架構中,最佳化AI流程的每個階段。

  • 支援每秒輸出3,400個詞元,速度較替代平台快4倍
  • 提供極致的長情境處理能力與低延遲推論架構
  • 透過Spectrum-X Multiplane實現高頻寬且無損的AI網路擴展
  • 整合Vera CPU支援大規模代理型AI工作負載

打造具備彈性與高效能的全新AI基礎設施

隨著AI從訓練階段轉向推理與代理型應用,推論已成為新的技術前沿。NVIDIA Groq 3 LPX與Vera Rubin NVL72平台協同設計,協助企業與雲端服務供應商提供代理型應用所需的低延遲、極高輸送量與可擴展的經濟效益,引領全球步入智慧化與自動化的全新時代。

玩家總結

本次NVIDIA推出全面量產的Groq 3 LPX與Vera Rubin NVL72平台,透過極致協同設計與突破性的詞元生成速度(每秒3,400個詞元),徹底解決了代理型AI在長情境與解遲延遲上的痛點。結合SpaceAI、CoreWeave與Nebius等大廠的實際導入,這套全新的硬體與網路基礎設施將大幅提升即時互動體驗,引領AI工廠迎向下一個高速發展的黃金時代。

延伸閱讀:
台北凱撒迎中秋推限定住房專案!入住送「龍鳳堂」聯名月餅、再享「老井極上燒肉」專屬禮遇
把日常祝福穿上腳!adidas推出全新ADIZERO EVO SL TAIPEI台北城市限定款
Q Burger世界風味賞十週年「港澳站」人氣回歸!帶骨豬扒、咖哩魚蛋、冰火菠蘿油一次吃遍
Hyundai深化智慧售後服務、全國服務技能競賽導入AI!9月起五大據點推數位點餐

Dustin
Dustin
汽車、3C編輯出身,提供平面雜誌、網站平台、數位媒體的整合性內容,曾任Stuff國際中文版主編,《汽車小百科2》書籍作者,目前自創數位媒體公司,創立ZEEK玩家誌並擔任總編一職,供稿於MSN汽車頻道、Yahoo!奇摩汽機車、FHM男人幫...等媒體,提供汽車試駕、產品測試、專題訪問、特別企劃...等文章。歡迎廠商來信合作!
- Advertisement -spot_img

最新文章