矽谷前沿模型的發布流程出現壓縮趨勢,Opus 5.2 與 Gemini 4 Pro 在未經官方正式宣布的情況下已悄悄上線。
視覺生成僅 7B 參數,可在 RTX 3090 運行,官方稱效能超越多數閉源模型;同步推出基於 Qwen3.5-VL 9B 的提示詞重寫模型。
專案以 MIT 協議開源,支援無 GPU 設備離線運行。官方實測在 M2 Pro 筆電完成表單填報約 3 秒,並可接入 Claude Code 等工具。
該平台專為工程與研究團隊設計,研究人員無需學習 Kubernetes 即可透過 yaml 提交任務,提供從資料準備到分散式訓練的端到端 GPU 管理。
OpenAI 聯手博通打造的 Jalapeño 宣稱每瓦效能最高提升 1.9 倍,Google 則將第八代 TPU 拆分為訓練與推論雙版本。