OpenAI 發布 GPT-6 Astra:支援百萬上下文與電腦操作,ARC-AGI 3 跑分達 99.9%
新模型首度達到內部「關鍵」資安等級,API 費率對標 Claude Fable 5,將優先向 Daybreak 客戶開放,隨後登陸 ChatGPT 付費版與 AWS。
30 則值得知道的變化
新模型首度達到內部「關鍵」資安等級,API 費率對標 Claude Fable 5,將優先向 Daybreak 客戶開放,隨後登陸 ChatGPT 付費版與 AWS。
Hugging Face 去年曾拒絕 NVIDIA 以 70 億美元估值的投資。收購後將保留原品牌,並持續支援多雲與多加速器部署,維持開放生態。
該模型直接讀取即時衛星與測站資料,擺脫傳統數值預報的 6 小時延遲,並針對再生能源提供 100 公尺風速與日照預測。
新模型主打長跨度程式撰寫與代理任務,資安版在 CWE-Bench 修補測試達 47.2%,並透過 Fairwind 計畫向逾 650 家夥伴限量提供自動修補引擎。
該 6B 模型採用 Muon 最佳化器進行純圖像預訓練,Turbo 變體僅需 2-4 步推論,並支援中英文文字渲染與指令引導編輯。
該模型由北大唐浩團隊與智源研究院共同研發,已上架 Hugging Face,需透過自訂 Transformers 程式碼載入。
該模型參數達 44 億,基於 Qwen3-VL-4B 微調,採 Apache-2.0 授權,可提升度量距離與相對位置等空間關係的視覺推理能力。
全系列採 Apache 2.0 授權,公開代理後訓練的完整開發過程與中間權重,0.9B 模型在 AIME 2026 取得 48 分以上。
官方文件強調,其公共端點皆提供未經剪枝的原始模型,僅在儲存時採用選擇性權重量化,運算與 KV 快取均維持全精度。
據報導,GPT-5.6 僅耗時一天便在數學領域取得重大突破,成功打破由「雙菲」五人團隊保持長達 8 年的歷史紀錄。
研究指出長思維鏈具備高度冗餘,只要完整保留提示詞,隨機丟棄推理軌跡即可免去評分計算,追平現有最佳壓縮方法。
單一 query 即可達 71.5% 狀態覆蓋率,顯示 OPD 面臨「資料過剩但演算法匱乏」瓶頸,學生模型吸收監督訊號的速度過慢。
該研究發表於《Cell》期刊,結合 AI 重建技術首度涵蓋中樞神經系統,可與雌性地圖比對以研究神經機制差異,資料已透過 Neuroglancer 開放。
測試涵蓋 75 個專案與上千種提示詞,發現不同背景使用者與 AI 代理常得出相同結論,如皆推薦 Neon 資料庫。
週四上午 Claude 5 系列、ChatGPT 與 Grok 陸續出現錯誤率升高與效能下降,多數服務已於數小時內部署修復。
作為 3.7 版本的最新迭代,該模型在複雜終端機任務表現強勁。功能將逐步推送給各級付費用戶,預設為自動啟用。
Anthropic 在發布 Fable 5.1 僅 24 小時後,宣布全面升級 Claude 的「電腦使用」能力,新功能支援在背景接管電腦,實現人機平行操作。
2026 會計年度第三季營收年增 33.7% 達 122.1 億美元,但記憶體等零組件供應吃緊,且存貨金額因提前備貨大幅攀升至 118.2 億美元。
這項邀請制服務支援 Cloudflare Workers 與代理應用,透過 AI 代理掃描授權程式碼,並自動生成修補程式與自訂 WAF 規則供客戶審查。
全年產品營收預估上修至 60.7 億美元,旗下 AI 編碼代理 CoCo 單季新增逾兩千帳戶,推升經調整每股盈餘達 62 美分。
企業可將程式碼執行環境留在內部,但模型推論與檔案內容仍交由 Cursor 雲端處理,新版並擴充 Linux 環境的瀏覽器操作能力。
據報導,Meta 結束內部狂刷 AI 運算量的風氣,員工已試用能自動操作網頁與應用程式的 Hatch 數週,為公開發表做準備。