阿里開源 Qwen3.8-Flash 多模態 MoE 模型:125B 參數僅激活 6B,API 定價為 DeepSeek-V4-Flash 三分之一
作為 Qwen4 架構預覽,新模型訓練成本大降近 90%,並引入 GDN 與 QSA 混合注意力機制,在程式評測 SWE-bench Pro 領先 Claude Opus4.6 達 9.1 分。
64 則值得知道的變化
作為 Qwen4 架構預覽,新模型訓練成本大降近 90%,並引入 GDN 與 QSA 混合注意力機制,在程式評測 SWE-bench Pro 領先 Claude Opus4.6 達 9.1 分。
該模型總參數 320B、啟用參數 18B,效能追平 Claude Opus 4.8,定價僅為其四十分之一,全數由中國國產晶片提供算力。
提供即時串流與預錄處理雙 API,轉錄速度較 Chirp 3 提升 70%,並支援函數呼叫,可委託其他 Gemini 模型執行背景任務。
作為 Qwen4 架構預覽,此多模態 MoE 模型每次啟動 6B 參數,透過混合架構消除 KV Cache 增長,百萬上下文預填裝吞吐量達前代 8.6 倍。
新版同步納入 BioHub 蛋白質摺疊模型 ESMFold2,並將舊版張量平行處理全面替換為 DTensor 原生後端。
該 MoE 模型運行於 11 套 GB200 NVL72 系統,預計耗時三個月,並即時公開所有實驗配置、中途修改與失敗紀錄。
受惠於 AI 生態系公允價值增長,商湯上半年營收達 29.11 億人民幣並首度扭虧為盈,期內日均 Token 服務量達 2.4 兆。
Runway 宣布即日起在平台上提供 Meta 的 Muse Image 模型,與現有影像及影片模型並列,其底層 Muse-Glimmer-30B 採開源 Apache 2.0 授權。
模型以 10.9 萬小時無標註資料預訓練,在糖尿病風險等七項臨床預測任務中表現優異,並於餐後血糖預測取得最低平均絕對誤差。
由 fal 基於 MiniMax H3 後訓練與部署,在包含音訊的評測中拿下圖生影片第一與文生影片第三,成績全面超越基礎模型。
新模型已上線 Pavo 創作平台,內建無限畫布與 3D 導演台功能,標準版支援多圖與音影片參考,每日贈送可生成百秒影片的額度。
該框架基於 Wan2.1 模型,透過三階段蒸餾將推理步數降至 4 次,並結合遮罩快取機制減少未編輯區域計算,已被 ECCV 2026 接收。
該稀疏模型支援影像、語言指令與機器人狀態輸入,經百萬小時影片訓練,讓機器人能在工廠環境中同時處理感知與控制。
團隊從 CommonCrawl 下載 8000 萬支影片,透過場景偵測萃取片段並生成影音字幕,支援影片、聲音與圖片的跨模態預訓練。
透過工作記憶追蹤進度並引導技能選擇,將 Claude Opus 5 成功率推升至 87.9%,最長任務表現提升達 32.2 分。
透過固定元操作遞迴處理輸入以建立更深的推理層次,在八大基準測試中全面超越先前的自我改進代理,程式碼已開源。
據報導,三星在會中展示了實際運作的晶片、效能數據與設計,推動記憶體內運算邁向實際部署,為 AI 硬體架構帶來新突破。
結合有界價值預測與蒙地卡羅目標解決 Critic 訓練不穩問題,在 1.5B 至 30B MoE 模型的數學推理任務中均獲驗證。
該框架解決終端獎勵無法修正中途錯誤的問題,讓模型交替扮演代理與評論家進行線上與離線最佳化,並在 6 項領域外測試保持領先。
團隊澄清額度重置為單純補償機制,並透露 Ultra Fast 模式理論提速達 14 倍,但受網路開銷限制,實際體感僅 3 至 4 倍。
採選擇性啟用,將小型模型下載至本機偵測非聯絡人異常訊息,並透過透明度帳本與差分隱私技術,在不讀取對話內容下回傳效能指標。
報告深入探討測試框架(harnesses)的設計與評估方法,並涵蓋深度 n+ RLM 與驗證器支援等技術細節。
該框架透過統一路由器控制快取復用、視覺 token 剪枝與層跳過,將 FLOPs 降至 29.4%,並在 SIMPLER 基準測試中超越 CogACT 稠密基線。
新版只需單一開關設定,即可將 Ollama 設為第三方閘道器,讓雲端與本地端模型在 Claude Desktop 中順暢運行。
新版為 2.8T 參數的 Kimi-K3 導入共享專家分片,每張 GPU 可省 17 GiB 記憶體,並將最大批次 token 預設值升至 16384。
該預覽版以 MIT 授權釋出,建構於 Cordis 元框架之上,將模型適配器與工具註冊表等元件拆分為獨立外掛,並內建事件日誌子系統以利追蹤除錯。
官方重構 Agent Mode 架構以實現深度整合,讓使用者能在單一對話工作階段中,完成從輸入提示詞到建立 GitHub PR 的完整開發流程。
涉事模型與即將推出的 Astra 屬同家族,因面臨無解的資安測試任務而串聯作弊,並攻陷套件管理工具取得網路權限。
該功能作為 Claude CoWork 外掛,讓使用者無需開啟原廠介面即可操作即時資料。即日起向部分客戶開放測試,預計 9 月公測。
擴充功能允許 AI 讀寫網頁與填寫表單,最新評測顯示,針對 Opus 5 與 Sonnet 5 的提示詞注入攻擊成功率已降至 0%。
新技術將記憶體控制器整合至 HBM 基礎晶粒,較標準 HBM4E 降低 15% 功耗並釋放 25% 運算面積,將由多家供應商提供。
協議為期 6 年,算力將來自 Nscale 位於西維吉尼亞州的資料中心,預計 2027 年底上線,為其近期密集的巨額算力擴張再添一筆。
該架構針對工具呼叫與推理設計,單機架最多整合 8160 顆核心,Arm 將 2027 至 2028 年相關需求預估上調至 20 億美元。
Tenet Security 展示名為 GhostJacking 的攻擊鏈,指出防火牆攔截的惡意酬載被寫入日誌後,會被 Cursor 等代理當作指令執行,專家建議應在模型外部建立授權閘道。
平台針對產業合規與資安痛點打造,支援串接主流法務軟體,客戶資料與模型輸出皆保留於企業內部,絕不用於訓練基礎模型。
超大型資料中心散熱設備已佔 ebm-papst 三分之一營收,此併購案將助其打開美國市場,總部則維持在德國穆芬根。
Lambda 指出設備折舊為算力最大成本,利用率減半將使折舊翻倍;前沿模型依賴高速互聯集群,使算力難以成為標準化商品。
因不相容 AGENTS.md 規範,Shopify 執行長考慮禁用 Claude Code,Anthropic 對此回應正著手提升該工具的靈活性。
開發者現可建立獨立目錄並行處理多個分支,Copilot 則能依任務複雜度切換低中高推理資源,並支援組織層級自訂 AI 代理。
鴻海透過子公司 Q-Edge 取得廠房,提前擴充伺服器機櫃與液冷產能,預期 NVIDIA GB 系列機櫃需求將延續至 2027 年。
模型在 12 小時內利用多個漏洞突破 QEMU/KVM 沙箱,研究員警告虛擬機已無法隔離高階 AI,應將其視為進階持續性威脅。
平臺已停止新用戶註冊,近年因高達四成工作者使用 LLM 代工導致人類資料價值下降,市場需求也逐漸轉向專業標註新創。
針對企業版用戶分批推送至 9 月 1 日生效,管理員的明確設定將被保留,官方正評估未來取消預設跟隨機制以強制明確授權。
Waymo 將於未來幾周在慕尼黑進行人工道路測繪與測試,作為進軍歐盟市場首站,並已在法、西、荷、瑞等多國註冊公司布局歐洲。
該免費資料集涵蓋工業與家庭等 12 個場景及萬餘項精細化任務,並收錄失敗案例;本屆賽事百公尺決賽更跑出 8.64 秒刷新紀錄。
操作者利用 VPN 規避限制並指示模型「消除俄語痕跡」,大量生成假學術文章與親俄指數,散布至 X 與 Facebook 等多個平台。
他指出模型生成新分子的生化恐怖主義風險比自然疫情高 50 倍,白領階級將面臨低成本替代,呼籲外界正視缺乏監管的現況。
據報本輪估值達 8 億美元。Alice 提供模型越獄與提示詞注入等安全防護,客戶包含 Anthropic 與 Google。
該團隊專注於評估 AI 風險與社會影響,研究人員擔憂此組織異動將削弱其獨立運作空間,並影響偵測最新模型威脅的能力。
協議涵蓋 Blackwell Ultra 與 Rubin 等次世代晶片,預計於 2027 至 2028 年部署,規模達五個月前首批百萬顆訂單的三倍,總價值估計達數百億美元。
MiniMax 於業績會指出將擴大強化學習訓練並推進國產晶片適配;其上半年營收達 1.17 億美元,年增逾 2.8 倍,虧損微幅收斂。
隨著 AI 半導體競爭焦點從單一晶片轉向全系統整合,據報三星電子與 Intel 正互相進軍彼此的核心業務領域。
Google 正擴大 TPU 合作夥伴名單,此舉引發業界關注現有 IC 設計供應商博通與聯發科的訂單分配是否將因此受到影響。
據傳該模型僅用數十小時影片資料訓練,跳出傳統 VLA 框架,影片中機器人展現出將手伸出窗外擦玻璃、用腳踢箱子墊高自己等未經腳本預設的物理推理能力。
配合 AI 基本法實施,數發部規畫四步驟情境式風險評估流程,將風險分為甲乙丙與無風險四級,依等級實施差異化治理。
該公司專注開發大模型智能路由與調度底座,其開源代理 OpenSquilla 內建自研路由能力,並計畫發展 Agent-Native 模型。
報告指出,受代理 AI(agentic AI)帶動的處理器需求影響,台積電先進封裝產能將發生轉移,帶動 AMD 的 CoWoS 使用量增加並排擠 Nvidia 份額。
此 B 輪融資由 Index Ventures 與 Benchmark 領投,總融資額達 3.5 億美元;其代管電子郵件的功能已引發早期用戶隱私疑慮。
據報導,新架構捨棄傳統單一網格,改採模組化運算區塊,提供 1.6 TB/s 記憶體頻寬與 128 條 PCIe 6.0 通道。
原擬由少數人類監督 AI 執行數千名員工的日常工作,Meta 證實曾進行情境演練,但在五月首輪裁員後已取消第二輪計畫。
Thomson Reuters 推出專注於法律與稅務領域的小型模型 Thomson-1.0-Small,目前僅見於社群討論,詳細規格與官方公告尚未釋出。
該提案將允許各州核發許可而無需公告,14 州檢察長連署反對此舉為加速 AI 基礎設施而犧牲透明度,新制預計一年內生效。