Anthropic 發布 Claude Sonnet 5.5:速度提升 30%、單任務成本降 30%,代理程式編寫跑分超越 Opus 5.5
模型已驅動 claude.ai 免費版並登陸三大雲端,定價不變但藉由減少 Token 消耗降低成本,並首度導入 Opus 同級的資安防護。
Hacker News綜合 7 家一手來源
55 則值得知道的變化
模型已驅動 claude.ai 免費版並登陸三大雲端,定價不變但藉由減少 Token 消耗降低成本,並首度導入 Opus 同級的資安防護。
基於 Qwen 開發,提供 27B 稠密與 35B-A3B MoE 雙版本,主打以極低成本跨平台操作軟體介面與 API,並開源所有評測軌跡資料。
據路透社報導,招股書揭露其未來一年將投入 5,180 億美元於算力,並警告模型具破壞程式碼等風險,預計於美國期中選舉後上市。
OpenAI 官網文章透露,GPT-6 Astra 具備更強的使用者意圖理解能力,讓 Basis 在實際應用中更具信心。
新版模型採用全新架構,強化情緒表達控制與長文本音色一致性,並降低語音代理延遲,其年化營收現已突破 6 億美元。
該模型原定 10 月推出,具備更強的端到端自主任務能力,但因對齊測試表現不佳且出現不安全行為,遭官方罕見終止發布計畫。
據公告,新版支援單次任務組合最多 10 張圖片與 5 段影片作為參考,並新增畫布 Agent 體驗,Flash 版已率先開放測試。
結合 GenCorrect 測試時運算策略,模型於 IOI 2026 取得 535.4 分,超越金牌門檻與人類榜首,並開放商業使用。
小米開源全模態模型 MiMo-V2.6,Pro 版在 AA 綜合智能指數獲 46 分,超越 Kimi K3 成為排名最高的開源模型。