OpenAI首款客製化晶片Jalapeno交付樣品,在部分測試中優於輝達現有產品

來源 Tradingkey

Tradingkey - OpenAI 週三表示,與博通(AVGO)聯合開發的首款客製化晶片 Jalapeno 已交付工程樣品,目前正在實驗室測試。博通執行長 Hock Tan 表示,早期結果顯示,在典型 AI 工作負載下,Jalapeno 的運作成本較常見 AI GPU 可能降低約 50%。

Jalapeno 主要面向大語言模型推論,即模型完成訓練後,負責回應使用者請求和執行任務的階段。OpenAI 硬體負責人 Richard Ho 表示,該晶片在吞吐量和回應速度之間實現了平衡,既能以較低成本服務更多使用者,也能縮短對即時回應要求較高任務的等待時間。晶片額定功耗約為 700 瓦,有望降低資料中心的電力支出。

OpenAI 表示,Jalapeno 在內部測試中表現出較高的每瓦效能,並在部分測試中優於輝達現有產品。不過,相關結果仍屬於公司早期測試披露,尚未經過大規模商業部署驗證。該晶片沒有針對輝達最新一代 Vera Rubin 進行測試,也不用於 AI 模型訓練,因此短期內不會取代輝達在訓練領域的產品。

消息公布後,博通股價盤初一度漲超 1%,隨後漲幅收窄至 0.66%,報 361.13 美元。

7-2b99e01f3a5c43e2a254749a0c24fe48

博通股價圖,來源:TradingView

按照計劃,最終版本的 Jalapeno 將從今年晚些時候開始部署到微軟及其他合作夥伴的資料中心。博通先前預計,明年將部署約 1.3 吉瓦規模的相關晶片,Tan 表示,隨著需求持續增長,實際規模可能高於這一目標。兩家公司還制定了多代晶片路線圖,下一代產品預計於 2028 年推出,此後將持續迭代。

此次合作是 OpenAI 擴大晶片供應來源、降低基礎設施成本的重要一步。除了繼續大量採購輝達產品外,OpenAI 還與 AMD、Cerebras 等晶片廠商達成合作,並計劃在晶片、記憶體、網路和資料中心系統等環節加強控制。公司今年早些時候已籌集約 1220 億美元,用於投入晶片、資料中心和人才。不過,OpenAI 如何支付大規模晶片訂單,仍有待後續融資安排確定。

免責聲明:僅供參考。 過去的表現並不預示未來的結果。
goTop
quote