OpenAI 推出 Ultrafast 模式預覽,GPT-5.6 Sol 提速 14 倍
這項全新 API 服務層級由 Cerebras 晶片驅動,可讓 GPT-5.6 Sol 模型的生成速度達到每秒 750 個輸出 tokens。
67 則值得知道的變化
這項全新 API 服務層級由 Cerebras 晶片驅動,可讓 GPT-5.6 Sol 模型的生成速度達到每秒 750 個輸出 tokens。
該純文字模型啟動參數達 95B,原生支援 26 萬 tokens,程式與科研跑分逼近 Opus 4.8;Flag OS 透過 INT8 量化解決龐大參數的記憶體瓶頸。
基於 Cordis 框架打造,將模型、工具、沙盒與 UI 等所有元件實作為可自由替換與擴充的外掛,現已推出開發者預覽版。
新閘道器支援路由 OpenAI、Anthropic 與 AWS 等模型,現於美東 2 等地免費預覽,但不提供 SLA 且未公布定價與遷移指南。
支援 BF16 與 MXFP8,透過融合運算避免中間張量具現化以節省記憶體流量,在 4k 至 128k token 區間達成 2.3 倍加速。
高通將藉此加速跨資料中心與邊緣基礎設施的 AI 部署,MAX 與 Modular Cloud 等品牌將維持營運並獲得高通投資。
支援跨平臺免寫程式微調模型,最高節省 70% 記憶體,具備網頁搜尋與隔離環境程式碼執行能力,工具呼叫準確率最高提升 50%。
為吸引黑石與高盛等機構,若借款方違約導致晶片清算,Nvidia 將吸收部分價差,藉此推動二手硬體生態系,將 AI 伺服器轉為長期基礎設施。
騰訊公布 2026 年第二季財報,營收達 303 億美元,但大幅增加 AI 基礎設施支出,導致算力成本上升並影響近期獲利表現。
該架構專為高密度 AI 工廠打造,整合第六代 EPYC 處理器與液冷技術,最高帶走 84% 系統熱量,全負載 PUE 最低達 1.12。