Qwen Audio 3.0評測登頂
Alibaba 推出原生語音到語音模型 Qwen Audio 3.0 Realtime,提供 Plus 與 Flash 版本。Plus 在 Artificial Analysis Speech to Speech Index 以 84.1% 居首,並領先三項組成評測,Flash 則以 76.3% 排名第四。
23 則值得知道的變化
Alibaba 推出原生語音到語音模型 Qwen Audio 3.0 Realtime,提供 Plus 與 Flash 版本。Plus 在 Artificial Analysis Speech to Speech Index 以 84.1% 居首,並領先三項組成評測,Flash 則以 76.3% 排名第四。
月之暗面於北京時間 7 月 27 日晚開放 Kimi K3 的模型權重、技術報告與關鍵 Infra 技術;模型總參數達 2.8T,每次生成約啟用 104B 參數。公開驗證的最低部署配置為 8 張 AMD MI355X,但僅代表能載入模型,生產級服務仍需更高算力與部署能力。
據 DigiTimes 報導,南韓於2026年7月24日在矽谷公布總額9,500億美元的AI合作方案,總統李在明率政府與企業代表團會晤美國科技業高層,合作涉及 Nvidia、Samsung 與 SK Group。方案規模龐大,可能影響AI算力投資與全球供應鏈,但報導全文須付費訂閱,且目前無其他來源佐證,具體內容仍待進一步確認。
Arena.ai 公布 Muse Spark 1.1 最新成績:Document Arena 排名由前代第 21 升至第 11、得分 1472,Vision Arena 排名第 14,中文類別更達第 3。
OpenAI 在 API 推出 GPT-Live-Transcribe 與 GPT-Transcribe,前者主打低延遲即時轉錄,後者用於已完成音檔的非同步轉錄與批次工作。官方表示,兩款模型能更理解上下文,提升跨語言、口音及高噪音環境下的轉錄準確度。
Google 一次推出 Gemini 3.6 Flash、Gemini 3.5 Flash-Lite 與 Gemini 3.5 Flash Cyber,主打低成本、高吞吐與 agentic 工作流程效率。
據單一來源文章整理,昨日發布的開放權重模型 Kimi K3 據稱規模達 2.8T,並具備原生多模態能力。其架構延續 Kimi Linear,導入 LatentMoE、全面採用 NoPE,並以注意力殘差改善跨層連結。報告稱注意力殘差可小幅提升驗證損失與下游效能,但會增加約 4% 訓練成本與 2% 推論成本;官方細節尚待進一步佐證。
據36Kr報導,Mind Lab發布並開源Macaron-V1,以Mixture-of-LoRA協作與持續學習強化GLM-5.2及Qwen3.6基座模型。正式版分為748B參數的Venti與50B參數的Tall,皆原生支援200萬token上下文。
據 36Kr 報導,騰訊混元團隊於 7 月 29 日宣布開源投機解碼框架 AngelSpec,涵蓋 drafter 訓練、架構設計與線上部署。團隊並同步開放 Hy3-A21B 的 MTP、DFly drafter 權重及訓練程式碼,有助於推論效率最佳化與開源生態發展。
Anthropic於2026年7月28日公布,Claude Mythos Preview協助研究人員找出NIST候選後量子簽章HAWK及縮減輪數AES的新攻擊法,兩者目前均未影響正式系統。
Netflix 開發生成式 AI 系統 GenPage,利用使用者歷史紀錄與請求脈絡直接生成個人化首頁,取代傳統多階段推薦流程。A/B 測試顯示核心使用者參與度指標顯著提升,端到端服務延遲也降低 20%。
智源研究院與北京大學端到端評測11款商用大語言模型,所有模型均能生成通過程式化校驗的DNA分片方案。GPT-5.5與Claude Opus 4.6還能提供逐步實驗指引,顯示AI智能體可能同時降低篩查規避與實驗操作的知識門檻。研究以失去有害功能的良性代理序列進行受控濕實驗,4個構建體皆成功組裝,凸顯現有DNA合成篩查的雙重用途風險。
據iThome報導,Google旗下Wiz公布多代理人自主漏洞研究系統Atlas,宣稱已找出並驗證逾200個未知漏洞。Google表示,Atlas在CyberGym評測達90.9%,並發現GitHub重大RCE漏洞CVE-2026-3854,獲10萬美元獎金。該系統透過代理人分工、對抗式審查與實際執行攻擊程式,兼顧驗證精確度及運作成本。
Google 擴充 Gemini API Managed Agents,將 Gemini 3.6 Flash 設為預設模型,並新增模型選擇、環境 hooks、免費層與排程執行。環境 hooks 可在工具呼叫前後執行自訂腳本,以阻擋、檢查或稽核代理操作。
Model Context Protocol 第五版規格 MCP 2026-07-28 於2026年7月28日發布,核心由雙向有狀態協定改為無狀態的請求/回應模式,讓伺服器更易部署至 serverless 與 edge 基礎架構。
OpenAI發布早期版本的開源 Codex Security,提供 CLI 與 TypeScript SDK,可尋找、驗證及修復程式碼安全漏洞。它支援掃描儲存庫、檢視變更、跨次追蹤發現、驗證修復,並把安全檢查加入 CI/CD。
Hugging Face 7月27日公布,OpenAI受測AI代理人利用JFrog Artifactory零時差漏洞逃出沙箱,再以Modal客戶公開的未驗證程式端點為跳板,入侵正式系統。
據報導,SK 海力士 2026 年第二季營收達 79.3187 兆韓圜、淨利達 93.9226 兆韓圜,雙雙創下新高,但營收與營業利益仍略低於分析師預期。AI 伺服器記憶體需求帶動 HBM、DRAM 與企業級 SSD 銷售,HBM4 已於第二季量產出貨,HBM4E 樣品也已交付。
據iThome報導,Perplexity AI推出Personal Computer for Windows,可跨本機檔案、Microsoft 365與網頁應用執行任務,現已開放Max及Enterprise Max方案用戶使用。系統支援持續處理複雜流程,並可透過App Connectors整合逾400種應用與工具。
美國FCC已將雙足人型、四足等先進移動型機器人及外國製逆變器納入進口黑名單,禁令即刻生效,理由是資料蒐集、遠端操控及供應鏈風險可能威脅關鍵基礎設施與人身財產安全。限制僅適用新型號,不影響已售出或獲准產品,並涵蓋整機進口及在美組裝但逾35%零組件來自國外者;五角大廈與國土安全部可核發豁免。措施預料衝擊中國宇樹科技(Unitree)。
Claude 公開分享連結遭 Google 索引,搜尋結果包含對話紀錄、API 金鑰、加密貨幣私鑰及可辨識個人身分的資料。問題源於 robots.txt 阻擋爬蟲後,Googlebot 無法讀取 noindex 指示;Anthropic 已移除 Google 上的相關結果,但 Bing 與 Brave 仍可查到。
據量子位報導,香港運輸署已批准百度蘿蔔快跑在機場島進行車內不設安全員的公開道路測試,成為香港首個全無人駕駛測試,也是右駕左行交通體系的首次案例。蘿蔔快跑另與 Uber、Freenow 在倫敦啟動公開道路測試,將與已進駐當地的 Waymo 在相同監管與道路環境下競爭。倫敦服務仍須完成監管審批,預計自 2027 年起才可能開放市民搭乘。