OpenAI 推出前沿模型 GPT-5.6 Sol:支援百萬上下文與六段推理,輸入降價 20% 至 4 美元
新模型具備 105 萬 token 上下文與 12.8 萬輸出上限,知識庫更新至 2026 年 2 月,並支援 MCP 與電腦操作等進階工具。
29 則值得知道的變化
新模型具備 105 萬 token 上下文與 12.8 萬輸出上限,知識庫更新至 2026 年 2 月,並支援 MCP 與電腦操作等進階工具。
Amir Salek 曾主導前七代 TPU 開發。Anthropic 已開出 48.5 萬美元年薪招募硬體工程師,並傳將獲 Broadcom 800 億美元晶片資金支持。
在 Workers Tracing 基礎上新增 Agent 級別追蹤與 Session Replay,但長消息可能被截斷,且不同開發框架的 Payload 預設記錄策略存在差異。
對比 Eon Systems 的簡化模型,該平台將真實場景重建為 4D 數位世界,並支援將腦模型映射至機械臂或人形機器人等實體。
該代理底層僅採用 Qwen 3.6 模型,透過強化學習培養評估與設計實驗的直覺,並直接呼叫 GPT-5.5 Codex 處理程式碼撰寫任務。
唐杰指出評估 AI 模型的重點應從計算參數量轉向計算算力,強調參數量僅是知識的倉庫,真正決定智能的核心指標是 FLOPs。
分析將演進分為七階段,指出從 2022 年的 Constitutional AI 到 2026 年 Karpathy 的自動研究迴圈與 Z.ai GLM-5.3,AI 研發已全面走向模型驅動。
代工廠已向微軟、Google 等資料中心業者發出漲價通知,實際調漲幅度將依據輝達晶片世代與記憶體配置而有所不同。
新版導入重疊權重載入,使 Qwen3-32B 啟動加速 2.38 倍;並預設啟用 FlashInfer MNNVL,提升 DeepSeek 系列推論效能。
隨著 2026 年 Claude Opus 4.5 等模型帶動 token 消耗急升,該系統已路由逾千名開發者的 AI 請求,在不限制工具選擇下套用內部額度。
該唯讀鏡像庫每晚與 Anthropic 內部審核系統同步,收錄通過自動化安全掃描的外掛,供使用者透過 CLI 或網頁安裝。
隨著大眾對 AI 的不滿情緒蔓延,資料中心建設已成為政治包袱。曾大力支持該設施的德州與賓州州長等政治人物,現正放緩相關開發案。
官方規劃五大優先領域,將引入伺服器發起事件與漸進式工具發現機制以降低模型負擔,並推動基於 DPoP 的代理身分驗證標準。
據報導,該晶片單卡 FP4 算力達 4P,原生支援 FP4 與 FP8 低精度推理;其集群方案單機櫃支援 64 卡互聯,橫向最高可擴展至萬卡規模。
McKinsey 指出僅 30% 企業 AI 治理達標。為通過法務審查,企業已放棄追求完全自主,轉而為系統設定明確的職責與合規界線。
Llama.cpp 官方 GitHub 發布 0.2.0 版本更新,同步提供更新日誌、原始碼與 b10566 預先編譯版本供開發者下載部署。
分析指出,過去 AutoGPT 賦予的自主性遠超模型能力,直到 o1 推理模型與 Claude Code 終端機代理出現,模型才真正具備駕馭完整代理迴圈的能力。
採 MIT 授權,可包裝現有 CLI 工具在本機建立數位分身,分身間能以端到端加密通訊交接工作,另設有月費 39 美元的 24/7 雲端沙盒方案。
由 DST Global 領投,其採用結合 GPT-5、Sora 2 與 Kling 的多模型策略,並透過 GMI Cloud 降本 45%。
優必選具身大腦 Thinker-VLA 經端側最佳化後,GPU 記憶體需求降至 32GB;模型訓練數據有七成來自真實機台,主打無干預連續作業。
機器人身高約 1.75 公尺,搭載雙目視覺系統與 LATENT 規控演算法,能在 0.1 秒內鎖定時速逾 50 公里的來球,並穩定完成 20 輪以上連續對拉。
系統結合 16 通道表面肌電訊號與視覺資訊,透過 PULSE 模型重建手部姿態與接觸力,解決具身智慧跨本體遷移的資料瓶頸。
報告指特斯拉看好 Cybercab 快速規模化,FSD V15 已有四成技術於車隊測試,Optimus 最快 2027 年商業銷售。
社群消息指出,Anthropic 疑似在開發工具 Claude Code 進行 A/B 測試,部分使用者可能遇到模型投入程度降低的情況,官方尚未證實此項變更。