馬斯克旗下推出 Grok 4.6 模型,主打長效 AI 代理人任務且具價格優勢
新模型強化多步驟執行能力,在綜合評測追平 GPT-5.6 Sol Max,且 API 定價維持前代水準,大幅低於同級前沿模型。
67 則值得知道的變化
新模型強化多步驟執行能力,在綜合評測追平 GPT-5.6 Sol Max,且 API 定價維持前代水準,大幅低於同級前沿模型。
這項全新 API 服務層級由 Cerebras 晶片驅動,可讓 GPT-5.6 Sol 模型的生成速度達到每秒 750 個輸出 tokens。
距前代發布僅三週,新模型在程式與業務評測大幅勝出。至 2026 年底前輸入每百萬 Token 僅 0.75 美元,並已接入 Gemini Spark 供訂閱戶使用。
該純文字模型啟動參數達 95B,原生支援 26 萬 tokens,程式與科研跑分逼近 Opus 4.8;Flag OS 透過 INT8 量化解決龐大參數的記憶體瓶頸。
結合 8B 全局與 0.6B 局部雙 LLM 架構及 Flow Matching 技術,允許透過歌詞標籤與結構化提示精確控制曲風與人聲。
新版本驅動其 Document AI 堆疊,提供結構化區塊標籤與區塊級信心分數,標註頁面定價為每千頁 4.38 歐元。
Google DeepMind 推出該模型,主打程式編寫與網頁開發能力,並同時在 Text Arena 刷新帕雷托前緣。
H3 支援以文字指令直接修改影片畫面與對白,目前已於 Hugging Face 釋出兩個特定任務權重,並在影片編輯評測榜單登頂。
這款 7440 億參數的混合專家模型搭配全新代理編排工具,可提升 48% 速度與 10% 品質,完全在美國基礎設施運行。
配合 Grok 4.6 推出,官方宣布重置使用限制以利持續開發,用戶可至桌面或行動版應用程式的設定中使用 reset token。
新版本針對程式編寫、知識工作與視覺任務提升能力,輸出定價為每百萬 token 6 美元,現已加入 Pi 的模型目錄中。
新模型由 Prime Intellect 協助訓練,支援直接檢索 Slack 訊息、Drive 檔案、PDF 與圖片等多元資料格式。
新版本推論速度超越前代,保留跨語言與音色情感解耦能力,提供 0.5 至 2 倍語速調整,並可透過 BF16 降低 VRAM 佔用。
據社群報導,該模型採 Apache 2.0 授權並經 5000 萬筆資料訓練,能以自然語言指令直接輸出分割遮罩與深度圖,但完整運行需 80GB 顯示記憶體。
定位為 dots3 家族中最輕量的開放權重模型,總參數 280B 且每次推論僅啟動 16B,能理解圖文影音並支援工具呼叫。
專案以自製編譯器計算所有權重,21B 參數版本在 B200 上單幀生成需耗時近 40 分鐘,目前僅支援 fp32 精度,尚未支援量化。
Sonnet 4.6 與 Opus 4.6 遇衝突時傾向升級攻擊,代理會發明淘汰賽解決分歧,並在定價遊戲中私下串通價格下限。
此難題困擾數學界三十年,為 FrontierMath 基準測試的開放問題,由 Anthropic 研究員與 Claude 共同完成,具體構造方法仍待技術報告揭曉。
此為早期 AutoEval 自動評估結果,落後於 GPT-5.6 Sol 與開源榜首 Kimi K3,後續將加入人類投票以觀察分數收斂。
使用者可透過上傳資料集、匯入代理追蹤或自然語言描述建立專屬基準測試,並以成對評審機制比較各模型的效能、速度與每次任務成本。
由 vivo 肖博與 GPT-5.5 協作提出,將知識成熟度分為四階段,要求 AI 系統將內容封裝為具備版本與衝突處理機制的知識物件。
該多代理自主攻擊框架透過反編譯入口網站與密碼潑灑,成功破解 85 組帳密並橫向移動至內部系統,目標更延伸至核安與能源機構。
基於 Cordis 框架打造,將模型、工具、沙盒與 UI 等所有元件實作為可自由替換與擴充的外掛,現已推出開發者預覽版。
距離前代 3.6 版發布僅三週,該模型即登陸 Copilot。企業版需管理員手動啟用預覽政策,並依提供商定價按用量計費。
新閘道器支援路由 OpenAI、Anthropic 與 AWS 等模型,現於美東 2 等地免費預覽,但不提供 SLA 且未公布定價與遷移指南。
支援 BF16 與 MXFP8,透過融合運算避免中間張量具現化以節省記憶體流量,在 4k 至 128k token 區間達成 2.3 倍加速。
Firetiger 專注於軟體上線後的監控與事件調查。此次收購旨在讓寫程式的 agent 能追蹤部署狀況並修復錯誤,未來將結合即將推出的 Change Monitors 功能。
高通將藉此加速跨資料中心與邊緣基礎設施的 AI 部署,MAX 與 Modular Cloud 等品牌將維持營運並獲得高通投資。
支援跨平臺免寫程式微調模型,最高節省 70% 記憶體,具備網頁搜尋與隔離環境程式碼執行能力,工具呼叫準確率最高提升 50%。
為吸引黑石與高盛等機構,若借款方違約導致晶片清算,Nvidia 將吸收部分價差,藉此推動二手硬體生態系,將 AI 伺服器轉為長期基礎設施。
效能提升來自「builds」機制,系統會在背景免費預備隨插即用的開發環境,讓開發者能交付需長時間運行的複雜任務。
針對使用者遇到用量限制而中斷的問題,官方新增了核取方塊,勾選後系統會在額度恢復時,自動從中斷處繼續執行任務。
新版移除單句分類器,改以全頻道上下文判斷是否主動介入對話,並支援自然語言指令控制發言頻率。
新版終端機支援透過 Ollama 等方式接入本機模型,並新增 /agent 指令讓不同分頁獨立運行 Copilot 或 Claude,同時強化 WSL 整合與自動修正功能。
騰訊公布 2026 年第二季財報,營收達 303 億美元,但大幅增加 AI 基礎設施支出,導致算力成本上升並影響近期獲利表現。
該架構專為高密度 AI 工廠打造,整合第六代 EPYC 處理器與液冷技術,最高帶走 84% 系統熱量,全負載 PUE 最低達 1.12。
此次發布涵蓋供應鏈、行銷、IT 等七大業務方向,推出準確率逾 98% 的星途語音訓練平台,以及支援 120 多種語音合成的 Ocean 出海系列。
這家新加坡公司累計融資達 4.8 億美元,其主打 700 TOPS 算力的 GΞLIX 1 晶片與可運行千億參數模型的 Agent Box 設備已展開客戶導入。
官方強調隱形浮水印不會改變回覆品質與可讀性,若未符歐盟透明度規範,最高恐面臨 1500 萬歐元或全球年營收 3% 的罰款。
該功能讓模型自動記錄使用者在電腦上的操作軌跡,使未來的對話互動更具個人化,並減少使用者重複提供背景資訊的需求。
新機主打 Gemini 深度整合,容量自 256GB 起,並同步發表首款物品追蹤器。8 月 20 日正式上市,台灣售價 29,990 元起。
行動與網頁端將於 8 月中旬率先更新,解決系統列雙圖示問題;個人與工作帳號資料在應用內保持獨立,但部分免費額度可能變動。
該功能提供雙向同步的視覺化讀寫層,免寫程式即可用自然語言生成儀表板,即日起向 Google AI Pro 等付費用戶開放英文版。
該功能於六月推出,主打廣泛與深度的研究任務。本週上線的最佳化版本在進一步提升效能的同時,將單次任務成本降低了近 10%。
小馬智行將以 ADaaS 與 TaaS 雙模式推進商業化,其重卡系統與 Robotaxi 的硬體複用度逾 90%,並視 2026 年為大規模落地的時間窗口。
知名機器人公司宇樹科技掛牌上市引發市場熱潮,其營收在過去三年內大幅成長十倍,帶動 90 後創辦人身價估達 180 億。
雙方將針對金融與零售等產業開發專屬解決方案,並將 OpenAI 模型與 IBM 的多代理資安服務 Autonomous Security 結合。
該廠獲美國晶片法案 4.5 億美元補助,將與預計 2027 年完工的韓國清州新廠共同擴充高階封裝產能,搶攻 AI 記憶體商機。
儘管上調全年財測並預期推論需求將帶動明年營收翻三倍,其硬體營收年減 23%,引發市場對其規模化獲利能力的擔憂。
鴻海第二季營收 2.53 兆元創同期新高,為 Nvidia 組裝的 AI 機櫃市占逾四成,預計增加 30% 資本支出於美墨擴建產能。
Dali Rajic 將接任 OpenAI 營收長一職,負責帶領全球營收團隊,主要任務為協助企業客戶實現人工智慧的完整商業價值。
CEO 透露原僅計畫籌集 10 億美元,因投資人認購意向高達 150 億而擴大規模,資金將用於高昂的 AI 研發與持續併購。
受硬體製造商對低延遲、離線能力與嚴格功耗的需求驅動,在手機與汽車本地運行的小型模型已轉為商業現實,正重塑相關企業估值。
總裁 Greg Brockman 透露 7 月營收月增逾 20%,公司正透過調降模型價格與延攬資安高管來提振企業銷售,以捍衛市場份額。
該方案作為推論 API 代理層,依任務難度動態分配模型,相較單獨依賴 Claude Opus 4.8,僅微幅犧牲 6% 準確率即可大幅降低總成本。
爆料指該模型能以小規模匹敵大型模型,而 NVIDIA 日前已注資 50 億美元並提供 Vera Rubin 系統,協助其下一代版本擴展 10 倍算力。
該模型生成圖片被測出含 OpenAI 的 C2PA 與 SynthID 信號,實測顯示細節優於 GPT-Image 2,官方尚未證實。
為應對內部模型駭入 HuggingFace 的安全危機,Astra 在廣泛發布前將實施內部防護,同週亦有 Grok 4.6 與 DeepSeek v4 Pro 釋出。
布林要求團隊專注於「遞迴式自我提升」技術。另外,DeepMind 推出 SL2T 手語轉文字模型,率先整合於 Pixel 11。
據社群消息指出,DeepSeek 預告將進行 API 定價更新。目前僅有初步消息流出,具體的費率變動幅度與生效時間等細節尚未確認。
有別於業界常見的固定授權費,蘋果提議依內容被實際使用的情況支付報酬,新版 Siri 預計今年稍晚推出。
兩大廠加速將 AI 代理導入產線以提升良率,因廠區網路隔離,未來設備端需直接整合 GPU 進行推論,預期將推升設備成本。
Cisco 結束 2026 財年,其利潤率下滑反映出超大規模 AI 投資規模已足以改變公司業務,並對傳統網通產業產生重大影響。
該戰略投資帳戶預計設於韓國投資公社旗下,資金規模至少達 20 兆韓元,旨在強化先進技術與供應鏈競爭力。
預期本土解決方案將主導中國高階 AI 晶片銷售,Nvidia 與 AMD 等海外供應商的市占率恐將萎縮至僅剩約 10%。
Jeff Dean 將帶領部分員工創辦運行於 Google Cloud 的新實驗室。Google 執行長 Sundar Pichai 與 Hassabis 皆發布聲明,坦承公司目前尚未處於領先,需在 AI 前沿領域持續改進。
這款 96GB 顯示卡引發討論,且有投資人透露,隨合約到期,多家企業預計將為每張 GPU 支付至少兩倍的算力成本。