開發生態
Hot Chips 2026:OpenAI 發表首款推論晶片 Jalapeño,Google 第八代 TPU 分拆訓練與推論版本
TechNews 科技新報單一來源
核實資料不足
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。
查證回合用盡,未形成有依據結論

據報導,在 Hot Chips 2026 會議上,大型科技公司紛紛展示自研 AI 晶片。其中,OpenAI 與博通於 2026 年 6 月 24 日正式發表的首款推論晶片 Jalapeño 成為焦點;該晶片由 OpenAI 設計架構,博通負責晶片執行與聯網,專為大型語言模型推論最佳化。OpenAI 宣稱在 GPT-OSS 120B、DeepSeek R1 與 Kimi K2.5 等模型測試中,Jalapeño 峰值吞吐量下的每瓦處理力達對照系統的 1.5 至 1.9 倍,端對端延遲降低 1.7 至 3.6 倍。
同場揭露的 Google 第八代 TPU 則走向專用化,分為專攻訓練的 TPU 8t 與針對推論的 TPU 8i,以因應混合專家模型(MoE)、推理與大量代理並行後,訓練與即時服務硬體需求分歧的趨勢。此外,微軟與 Meta 也分別在會中介紹了 Maia 200 及自家的自研 AI 晶片。
讀原始報導背景
混合專家模型(MoE)是一種機器學習技術,透過門控模型將單一任務劃分為多個子任務,並交由不同的專家網路分別處理。相較於傳統的稠密模型,MoE 能以較少的運算資源進行有效的預訓練,並更快達到相同的模型品質。