研究與評測
OpenAI 首款自研推論晶片 Jalapeño 跑分出爐:採台積電 3nm,每瓦吞吐量最高達 NVIDIA GB200 的 1.9 倍
OpenAI News綜合 8 家報導一手來源
尚未逐項核實
來源為發布方或研究資料;不代表所有主張已獲獨立核實。
OpenAI 於 Hot Chips 大會公布首款自研 AI 推論晶片 Jalapeño 的首批基準測試結果,展現超越 NVIDIA、AMD 與 Google 現有頂尖晶片的效能。Jalapeño 是一顆專為大語言模型推論設計的 ASIC,採用脈動陣列(systolic array)架構與 HBM 記憶體,由 OpenAI 與 Broadcom 合作開發、台積電 3nm 製程代工。該專案由前 Google Cloud TPU 核心工程師 Richard Ho 領軍;關於開發時程,SemiAnalysis 指出從團隊招募到完成流片(tape-out)約耗時 16 個月,而另有報導稱從架構設計到流片僅花費 9 個月,創下先進 ASIC 最快開發紀錄。
官方使用 SemiAnalysis 的 InferenceX 平台,針對 GPT-OSS 120B、DeepSeek R1 670B 及 Kimi K2.5 1T 三款模型進行測試。數據顯示,Jalapeño 打破了傳統系統在吞吐量與延遲間的權衡限制;與 NVIDIA GB200 和 GB300 系統相比,其每瓦 AI 吞吐量達 1.5 至 1.9 倍,端到端延遲則大幅降至對手系統的 28% 至 59%。
具體而言,運行 GPT-OSS 120B 時,每千瓦峰值吞吐量比 GB200 高 1.9 倍;運行 DeepSeek R1 與 Kimi K2.5 時,每瓦效能分別比 GB300 高出 1.7 倍與 1.5 倍。晶片額定功率為 700 瓦,但測試期間持續功耗維持在 550 瓦以下。該晶片與配套伺服器僅供 OpenAI 內部部署以降低算力營運成本,不會對外銷售。
讀原始報導背景
Jalapeño 是 OpenAI 推出的首款自研推論晶片,專為現代模型提供更高吞吐量與更低延遲的運算能力。根據官方發布的測試結果,該晶片及其周邊系統在執行任務時,展現了領先業界的速度與能源效率。
來源
- Hacker Newsnewsletter.semianalysis.com
- TechCrunch AItechcrunch.com
- iThome 中國ithome.com
- Reddit r/singularityreddit.com
- Reddit r/singularityreddit.com
- Techmemetechmeme.com
- The Verge AItheverge.com
- X @OpenAIx.com
- openai.com
- theverge.com