【緯來新聞網】輝達(NVIDIA)宣佈,主打低延遲的 Groq 3 LPX 機櫃全面進入量產階段。此舉象徵輝達先前取得 Groq 技術授權與團隊後,推論硬體迅速邁向商業化里程碑。AI 雲端服務業者 Nebius 亦同步成為全球首家導入業者,將 Groq 3 LPX 整合至旗下 Token Factory 平台,為對回應速度敏感的客戶提供更高品質的生成式 AI 計算服務。

隨著人工智慧應用從訓練轉向實務普及,長上下文處理與即時反應成為系統效能關鍵。Groq 3 LPX 機櫃單一配置 256 顆 LPU 加速器,採用全液冷架構與大容量晶片上 SRAM 記憶體,專門克服傳統記憶體傳輸瓶頸。根據第三方機構實測,該系統在執行複雜程式編寫與高負載 AI 代理任務時,具備每秒輸出數千個 Token 的極速表現。
在運算分工上,Groq 3 LPX 並非取代既有 GPU,而是與 Vera Rubin 平台深度協同。Vera Rubin 負責處理前段龐大的上下文資料與 Prefill 階段,Groq 3 LPX 則接手對延遲高度敏感的後續 Token 生成。這種分離式架構能大幅降低 AI 代理多輪交談累積的等待時間,顯著提升整體系統的運算效率與使用者體驗。
面對業界強敵環伺,輝達透過整合創始自 Google TPU 團隊的 Groq 技術,精準補強了生成式 AI 推論市場的產品布局。輝達高層預期,結合 Blackwell 與 Vera Rubin 等新世代架構,將可帶來龐大的營收成長動能,進一步鞏固輝達在全球 AI 基礎設施領域的技術領先地位與商業版圖。

文章語音朗讀