Mistral AI 發布 Mistral Large 4 預覽版,主打網安能力超越中國競品
代號 le Chonk,具 490 億啟動參數,由 3800 張 Blackwell GPU 訓練。雖跑分仍落後頂尖閉源模型,但具備無安全過濾的資安漏洞修復能力。
53 則值得知道的變化
代號 le Chonk,具 490 億啟動參數,由 3800 張 Blackwell GPU 訓練。雖跑分仍落後頂尖閉源模型,但具備無安全過濾的資安漏洞修復能力。
支援 MRL 動態降維,純文字推論僅需 191MB 記憶體。瀏覽器 WebGPU 查詢耗時 20 至 70 毫秒,專為終端離線 RAG 打造。
官方將 200 美元 Pro 方案 API 價值砍半並推 500 美元新方案,測算顯示其性價比僅為 Anthropic 同級的五分之一,引發社群反彈。
該模型將預測狀態拆分為多個部分以捕捉複雜模式,在流體力學等十項測試擊敗基準,甚至從模擬軌道中推導出克卜勒第三定律。
新模型基於 Gemini 3.6 Flash,提升文字渲染與角色一致性,已於各項 Google 產品推出,舊版將於 2026 年 10 月退役。
基於 70 億參數的 Falcon-H1-Arabic 打造,結合真實網路語料與受限合成數據,解決方言缺乏書面文本的訓練難題。
該模型基於 Qwen 架構,單次請求可處理圖文影音,官方 API 處理百萬 token 僅需 3 秒,權重採條件開源。
該模型輸出二元判定結果而非文字,具備現代 LLM 的彈性,當審核政策改變時無須重新訓練,成本與速度媲美傳統分類系統。
該位元組級模型在讀取百萬位元組的維基百科文本後,預測誤差從 8 降至 0.9-2.4 bits/byte,並具備計數與預測質數能力。
成果涵蓋 372 個相關家族,平均每項耗費約三小時的 ChatGPT Pro 思考算力,部分已具備 Lean 證明,官方正準備發布該驅動模型。
專案提供從 SystemVerilog 到主機軟體的完整堆疊,在 Xilinx Kintex-7 平台上運行 LFM2.5-230M 解碼達 85.8 tok/s,並支援 MoE 權重串流。
陶哲軒警告 AI 快速產出 Lean 驗證證明卻缺乏人類理解,恐引發數據污染;OpenAI 雖為此成立顧問小組,但明文排除對其內部數學進展提供建議。
據報新論文指 ChatGPT 成功找出與高效電腦搜尋及取樣相關的未解數學證明,人類研究員主要僅負責理解並解釋 AI 產出。
測試在無網路環境下運行以防作弊,實測顯示 GLM-5.3 Flash 與 GPT-5.6 Luna 表現相近,且過半差距來自困難任務。
此免訓練框架利用權重共享特性,將不同深度的草稿生成與驗證合併批次處理,在 Huginn-3.5B 模型實測達 4.81 倍加速。
該架構採用共享基底向量字典,允許上下文獨立調節各記憶組件,克服傳統查表法處理多義詞的瓶頸,並確認最佳插入點為中間層。
該文比較 RNN 隱藏狀態、Transformer 的 KV cache 與 Mamba 選擇性保留機制,並以 BDH 探討工作記憶的突觸層面解釋。
專案透過 NVMe SSD 讀取 4-bit 查找表,在 RX 9070 僅耗 0.4GB VRAM 即可達 140 tok/s,但長提示詞讀取較慢。
兩款 AI 模型合作解決了數學領域中關於 11 個正方形裝箱的最佳化問題,並將證明過程在定理證明軟體 Lean 中進行了形式化驗證。
該叢集配備 NVIDIA Spectrum-X 網路技術,Together AI 作為首位客戶,將結合其推論平台與 IBM 雲端設施,應對每月數百兆 token 的開源模型運算需求。
該功能預設開啟,運算仍維持在本地電腦執行而不依賴雲端,使用者需保持設備連線且不休眠,企業版則需由管理員手動啟用。
攻擊者利用 Zammad 零時差漏洞取得 root 權限並外洩志工個資;因指令碼留有 AI 為自身行為辯解的註解,被認定為罕見的 AI 自主攻擊。
提供快照、配方、套件與驗證功能,能將配置渲染至 Helm 或 Argo CD,並附帶簽章證據以解決 GPU 叢集組件版本衝突。
透過 GDA-KI 技術讓 CUDA 核心直接驅動網路操作,新推的開源版專注於 RDMA-Verbs,並可在執行時動態呼叫完整 DOCA SDK 功能。
AM Intelligence 擴大亞洲 AI 算力佈局,計畫於印度與馬來西亞的基礎設施中新增兩萬張 Nvidia Rubin GPU。
這款無螢幕設備透過手機操作,配備 24GB 顯示記憶體,預載多款開源模型以實現長期記憶本機化,並獲 Andreessen Horowitz 領投 1,100 萬美元融資。
該模組採用矽穿孔垂直堆疊技術,使雙路伺服器最高可配置 12TB 容量,目前正由 AMD 與 Intel 進行平台驗證以應對 AI 需求。
影響 Unsloth 2026.5.10 及更早版本,官方已於 2026.6.9 版修復,目前尚無 CVE 識別碼且未發現實際攻擊案例。
漏洞影響 18.1.6 以上版本,允許通過驗證的使用者利用特製組態逃脫提示範本沙箱,自行架設用戶應立即更新至最新版。
保險經紀商 Aon 已審查逾 300 起 AI 相關案件,業界預期未來訴訟將比照環境與菸草案模式,企業 CEO 恐需承擔最終監督責任。
主打完全本地運行以保障隱私,提供 Web 控制台、CLI、API 及 NAS 套件,可透過 Docker 或桌面端單一程序快速部署。
開發者提交的 PR #26610 透過 RPC 新增參數,讓使用者能在多台獨立電腦間執行張量平行運算,擴展分散式推論能力。
新計畫依防禦、紅隊與特殊存取分級,允許資安團隊使用限制較少的 Claude 模型進行測試,最高層級將與美國政府合作審查。
美國防部長宣布此新編制,旨在透過低成本製造、人工智慧與機器人技術,加速軍方在無人機與自主系統領域的全面革新。
為推動全球無人計程車隊擴張並應對攀升的 AI 成本,Waymo 將原訂逾 30 億美元的首次債務融資規模提升至 50 億美元。
交易預計 2027 年完成,將帶動施耐德 SaaS 營收占比升至 24%。但高達 42% 的溢價與舉債疑慮導致其股價重挫。
雙方宣布擴大合作夥伴關係,旨在將 OpenAI 的前沿模型與 Atlassian 的企業知識連結,協助團隊規劃與交付工作。
隨著業界對高強度 AI 推論與運算密集型模型的需求成長,傳統軟體席位授權正逐漸被按 Token 用量計費的模式取代。
NVIDIA 股價連續三日收盤創高,盤中最高達 243.37 美元,推升市值至 5.82 兆美元,有望成為首家市值破 6 兆美元的企業。
川普於專訪排除將頂尖 AI 實驗室國有化,但對政府被動持股持開放態度。他近期曾與 Anthropic 執行長會面,目前尚未有具體方案。
據 Reddit 未經證實的消息,微軟疑似意外曝光 GPT-6.1 Sol 僅將推論次數由三次降為兩次,完全沿用 GPT-6 Sol 的基礎權重。
據報本輪募資遠超原訂的 500 億人民幣,將為 2027 年初的科創板 IPO 鋪路;具備原生多模態的 V4.1-Flash 模型也已於 API 上線。
儘管這款新旗艦模型在多項基準測試中取得優異成績,但部分員工透露其編寫程式碼的表現仍不夠穩定,引發內部疑慮。
據報該公司已完成上市前最後一輪融資,最快 10 月啟動投資者會談。惟近期面臨監管機構的資料安全調查,恐為上市時程增添變數。
據傳該模型獨立發現新型薄矩陣乘法演算法,將複雜度降至 O(n^1.9992) 與 O(n^2.9995),突破傳統極限,定理已透過 Lean 驗證。
由阿波羅牽頭,包含 100 億美元貸款與 300 億美元投資級債券,預計 2027 年完成。馬斯克曾指名採用 Vera Rubin 架構。
據報導,因 CPU、GPU 與 AI 運算需求持續超出產能,AMD 執行長蘇姿丰表示將進一步擴大對台灣半導體供應鏈的投資。
該筆 4.7 兆韓元資金已列入 2027 年預算草案,尚待國會批准。政府將透過公開競爭選拔團隊,而非直接補助現有入圍大廠。
由 Coatue 與 Blackstone 領投,預計為 2027 年 IPO 前最後一輪。其積壓訂單因 Anthropic 的巨額合約已激增至 500 億美元。
Reddit 社群流傳一份未經官方證實的評測結果,指出 Mistral Large 4 在 Terminal-Bench 基準測試中的表現,已超越 Qwen 3.8 Max 與 Kimi K3。