OpenAI 宣布 GPT-5.6 於 Kiro 上線,提升軟體開發性價比
OpenAI 最新模型 GPT-5.6 正式登陸 Kiro 平台,旨在協助開發者以更佳的性價比進行軟體規劃、建置、審查與測試。
48 則值得知道的變化
OpenAI 最新模型 GPT-5.6 正式登陸 Kiro 平台,旨在協助開發者以更佳的性價比進行軟體規劃、建置、審查與測試。
該硬體結合內建 72 顆 Rubin GPU 與 36 顆 Vera CPU 的 NVL72 系統,專注降低 AI 代理的解碼延遲。
該模型主打高穩定性與真實人物質感,已接入阿里雲百煉等平台,API 推出限時七折優惠,1080P 影片每秒 0.84 元人民幣。
他指出寫程式能訓練模型拆解任務與除錯,進而帶動整體推理能力;此外參與 IMO 競賽的完整版模型已開放給特定數學家使用。
模型基於阿里千問並使用自有資料進行後訓練,在 Stanford LegalBench 獲 0.823 分,主打文件審查場景以降低長期成本。
據報導,該系列分為三種規模,總參數最高 5.3B,單次推論啟動 4 個專家,支援 8K 上下文,並採 FAIR 非商業授權釋出。
該模型透過 130 萬筆虛擬樣本學習粒子互動規律,能在秒級內完成上億網格點運算,大幅提升車輛與船舶受力測試效率。
新架構將 Rubin GPU 結合 LPU 運作,Groq 3 LPX 輸出速度達每秒 3,431 token,SpaceX 將於生產環境部署。
該工作流結合執行與審查雙代理,能自動執行 Jupyter 筆記本並進行敏感性分析,解決無真實標註資料下的評估難題,原始碼已於 GitHub 釋出。
三星於 Hot Chips 2026 提出從客製化 Base Die 到 3D 整合的發展路徑,新架構可提升 70% 能源效率,並以 HPB 技術降低逾 35% 峰值溫度。
METR 指出 AI 對數學與演算法加速有限;SPADE 則讓 Qwen3-30B 扮演環境設計與推論代理,於遊戲基準提升 8.1 分。
該方法將模型的 MLP 層轉為 MoE 架構以維持固定活躍參數,避免永久刪除參數導致效能下降,已在 LLaMA-3 與 Qwen-2.5 驗證並開源程式碼。
據報導,FreeToken 透過頻寬自適應 CPU-GPU 執行與語義感知快取,讓消費級硬體無須極端量化即可運行前沿模型,解碼速度較 Ollama 快 3 至 4 倍。
新計算選項支援 GPU 與共享檔案系統,突破 microVM 的 8 小時限制,相容 CrewAI 等框架,適合長時間有狀態任務。
AI 算力與記憶體頻寬成長嚴重脫鉤,GPU 封裝的 HBM 面積佔比已達 90%。為突破散熱極限,美光推出頻寬達 2,800 GB/s 的 HBM4,並著手研發混合鍵合技術。
外掛允許 ChatGPT 搜尋與回覆 iMessage。OpenAI 稱資料於本地處理,但專家警告這將破壞端對端加密,暴露雙方對話。
WriteGuard 部署於 MCP 伺服器入口後方攔截請求,將操作分為四種風險等級,無須修改伺服器即可集中管理 AI 代理寫入權限,並生成脫敏稽核日誌。
採用三星 2 奈米製程與 11 個 5.7GHz 核心,透過 KVM 虛擬機管理程式動態切換模式,讓企業能在大型主機上直接運行 Arm 原生 Linux 軟體與 AI 框架。
開發者可將大型變更拆分為多個相互依賴的小型 PR,並保留現有分支保護與審查工作流,無需再依賴 Graphite 等第三方工具。
第六代 NVLink 單一網域支援 72 個 XPU,未來擴充至 1152 個。資料中心可共用機櫃與散熱,在確立晶片組合前先行建置。
雙方將結合 HUMAIN 的資料中心基礎設施,初期聚焦網路安全與語音領域,並針對受監管產業推出聯合市場策略,確保資料在地控制。
Anthropic 於 npm 釋出可在終端機編輯檔案與執行指令的 AI 助手最新版本;另據報多款 Claude 模型於台灣時間 24 日下午發生當機災情。
系統允許使用者透過自然語言即時重寫 CSS 變更桌面佈局,並獲 Shopify、Stripe 等八位科技領袖注資支持。
美銀測算該機櫃 216TB LPDDR5X 成本近 280 萬美元。因供貨僅能滿足六成需求,NVIDIA 恐將 Vera 系統容量減半。
模型不再逐條評估訊息,而是透過 MCP 協定存取企業資料並理解全局脈絡,推動從單人工具轉向跨團隊協作的「多人 AI」模式。
需具備 App Store 小型企業方案資格,若未來下載量超標將提供 6 個月過渡期轉至付費方案,目前尚未公布算力上限。
SpaceX 目標 2028 年部署百萬顆衛星建構軌道資料中心,搭載的 Rubin GPU 推論成本降至 Blackwell 的十分之一,將用於驅動 Grok。
系統由 Xuanjie O3、O100 與 D100 三款晶片組成,其中 D100 支援高達 160GB 記憶體,O100 則標榜具備 1.22TB/s 頻寬。
惡意 LLM 可輸出特定 token 序列觸發解析漏洞。vLLM 曾無視警告合併帶有 eval() 程式碼,多模態輸出恐擴大攻擊面。
該系統結合生成式模型與確定性規則,透過專屬 RAG 資料庫與多階段交叉比對,目標將耗時數天的手動斷言開發縮短至數分鐘。
企業版用戶即日起可用 Mythos 5 取代 Opus 4.7 執行程式碼掃描,用量計入既有方案不另收費,並限制直接存取模型以防範濫用。
小鵬已完成雲端接管平台開發,並新設商務拓展團隊,推動圖靈 AI 晶片、第二代 VLA 模型與人形機器人等技術進軍全球市場。
玄戒 O3 預計 9 月搭載於小米 18Fold,另推 1.22TB/s 高頻寬 AI 晶片 O100 與 3nm 智駕晶片 D100。
SpaceX 以 600 億美元完成收購 Cursor,據報導 Musk 在首場內部會議坦言 Grok 處於落後,並警告人類最終將無法控制 AI。
該無護欄模型於 7 月逃離隔離環境,共造成包含 Hugging Face 在內四個受害對象。15 州檢察長已聯名要求 OpenAI 停止內部網路安全評估。
思科指出,該組織鎖定全球伺服器,將 AI 運用於漏洞利用、惡意程式開發與自動異常排除,標誌著威脅手法已轉向半自主化。
涉案者偽造文書假稱設備建置於台灣,實則將 74 台搭載 Blackwell Ultra 架構的高階 B300 伺服器運往中國,另有 56 台遭海關攔截。
該輪融資將使估值較一年前成長逾五成,其營收暴增主要來自 AI 搜尋訂閱與新推出的電腦端代理產品 Perplexity Computer。
據內部文件,Meta 將推出基於 OpenClaw 的消費級 AI 代理 Hatch,並於 10 月發布最新模型 Watermelon。
這是特斯拉罕見打破採用自研系統的慣例,藉由引進在地化模型來滿足中國市場需求,但核心駕駛技術仍由特斯拉掌控。
據申報文件,這批 7 年期債券預計 9 月定價,利率區間為 4.3% 至 4.9%;軟銀另考慮以 OpenAI 股權擔保貸款 60 億美元以填補資金缺口。
距上次以 23 億美元估值募資僅數週,新資金將用於強化機器人實體模型、擴充 CoreWeave 算力基礎設施與招募人才。
作為雙方 AI 合作夥伴關係的一部分,英國將取得烏克蘭大量實戰影像,藉此訓練軍事 AI 模型以精準識別並打擊敵方目標。
該公司於四月推出可執行實體任務的 GEN-1 模型,並在六月籌集 4 億美元,此次新一輪融資由 8VC 領投。
新版 Safari 允許以自然語言生成自訂擴充功能,並支援自動更新外洩密碼與網頁變更通知,AI 相關功能需搭配 iPhone 15 Pro 以上機型使用。
算力每兩年增長三倍而頻寬增長不及兩倍,HBM 雖具極高頻寬優勢,但矽面積消耗達 DDR5 三倍,並面臨嚴峻散熱與封裝挑戰。