據報 Opus 5.2 與 Gemini 4 Pro 未經官方宣布已悄悄上線
矽谷前沿模型的發布流程出現壓縮趨勢,Opus 5.2 與 Gemini 4 Pro 在未經官方正式宣布的情況下已悄悄上線。
20 則值得知道的變化
矽谷前沿模型的發布流程出現壓縮趨勢,Opus 5.2 與 Gemini 4 Pro 在未經官方正式宣布的情況下已悄悄上線。
視覺生成僅 7B 參數,可在 RTX 3090 運行,官方稱效能超越多數閉源模型;同步推出基於 Qwen3.5-VL 9B 的提示詞重寫模型。
專案以 MIT 協議開源,支援無 GPU 設備離線運行。官方實測在 M2 Pro 筆電完成表單填報約 3 秒,並可接入 Claude Code 等工具。
清華大學針對肉眼難以察覺的影像問題提出「視覺源幻覺」新方法,宣稱僅需使用 0.9% 的資料量即可達到 SOTA 表現。
系統基於 Agent OS 開發,具備記憶圖譜與零幻覺審核機制,可自主迭代程式碼,目前 GitHub 專案獲 60 顆星,並已導入抗體與大飛機研發流程。
該技術讓模型學習糾正自身輸出偏差以解決幀錯誤累積問題,預期能降低 GPU 成本並應用於機器人訓練,官方尚未公布上線時間。
AI 代理多依賴模型進行工具呼叫與安全檢查等選擇任務,Jev 因能大幅降低 AI 工具選擇的時間與成本,迅速獲大廠採用。
透過 Claude 將 CADO-NFS 移植至 GPU,累積 30 個 GPU 年算力,證實 RSA-1024 面臨資料中心級別的算力威脅。
該平台專為工程與研究團隊設計,研究人員無需學習 Kubernetes 即可透過 yaml 提交任務,提供從資料準備到分散式訓練的端到端 GPU 管理。
OpenAI 聯手博通打造的 Jalapeño 宣稱每瓦效能最高提升 1.9 倍,Google 則將第八代 TPU 拆分為訓練與推論雙版本。
AI 資料中心搶地引發水電排擠,維吉尼亞州農地創每英畝 440 萬美元天價。全美 9 州暫緩新建案,摩根士丹利等機構示警投資風險。
透過 OpenTelemetry 服務地圖與統一異常模型,將指標、日誌與追蹤數據對齊,輸出排序後的故障假設,加速雲原生事故響應。
AI 代理打破跨平台開發的成本優勢,Shopify 藉此將應用轉為 Swift 與 Kotlin,並計畫 2026 年完成商家端重寫。
這家 AI 基礎設施企業平台註冊用戶逾千萬,適配輝達與華為等十餘款晶片,新資金將用於擴大推理技術研發與全球市場拓展。
顧問稱延期是為展現強勁的第三季財報。據悉其 2026 年第二季營收達 115 億美元,但仍面臨高昂算力成本與競爭壓力。
配備雙 16 核 NPU 與 12GB 記憶體,實測可流暢運行 1 位元量化 Bonsai-27B 模型,但受限於容量仍無法完整載入 2 位元量化版本。
供應鏈消息指出,三星用於晶圓減薄製程的玻璃載板需求將增至每月五萬片,預期高階 12 層堆疊產品出貨佔比將拉升至八成。