OpenAI 首款客製化 AI 推論晶片 Jalapeño 亮相,效能與速度創業界新高

OpenAI 自研推論晶片 Jalapeño 的技術發布,提供更快推理速度與更高能源效率。

• OpenAI 近日公佈首款客製化 AI 推論晶片 Jalapeño 的初步測試結果,在業界權威基準測試中展現出突破性的運算速度與能源效率。 • 該晶片採用全端整合架構,打破傳統硬體必須在高吞吐量與低延遲之間二選一的限制,為互動式 AI 代理提供更即時的反應。 • 測試顯示,Jalapeño 在執行 GPT-OSS 120B、DeepSeek R1 與 Kimi K2.5 等多款大型模型時,其每瓦產出的 AI 工作量達現有系統的 1.5 至 1.9 倍,端對端延遲更降低達 1.7 至 3.6 倍。 • 晶片開發過程高度依賴 AI 技術輔助,不僅利用早期模型加速設計與驗證,更透過 Codex 快速生成高效能核心,大幅縮短開發週期。 • 透過最小化資料移動與記憶體瓶頸,Jalapeño 能完美應對預填充(Prefill)與解碼(Decode)等不同階段的運算需求。

「Jalapeño 的設計初衷,是為了打造一台專門針對現代及未來語言模型、尤其是互動式代理(Agents)所量身定制的硬體系統。」 • OpenAI 預計於今年底將 Jalapeño 正式部署至其運算基礎設施中,這也是其多世代晶片藍圖中的首個重要里程碑。


來源:OpenAI Blog

閱讀原文 ↗

另見:TechCrunch AI、The Verge AI、Hacker News

← 回首頁