Anthropic 未發布模型在黎曼猜想取得重大進展,協調 60 個子代理並消耗 3100 萬 token
模型自主運行一天半測試 650 種想法,大幅提高猜想成立的解的下界,結果已透過開源證明助手 Lean 完成形式化驗證。
62 則值得知道的變化
模型自主運行一天半測試 650 種想法,大幅提高猜想成立的解的下界,結果已透過開源證明助手 Lean 完成形式化驗證。
新模型專攻零時差漏洞發掘與利用鏈開發,並降低對高風險指令的拒絕率,Blue 級別則維持對滲透正式系統的限制。
定位為金融版 Claude Code,提供開源與 SaaS 版本,系統透過生成 Python 程式碼在沙箱中執行精確的金融資料計算,並支援多模型路由。
該模型採混合 Mamba-Transformer 架構,活躍參數僅 3.6B,並同步推出可將任務成本降至 Opus 4.8 三分之一的路由工具。
新模型提升程式碼品質與工具呼叫能力,免費與學生版將預設啟用。企業與商務版需由管理員手動開啟權限,年繳訂閱戶按 0.25 倍費率計價。
具備 30 億活躍參數,任務完成速度提升 30%。開發者可透過 Prime Lab 進行後訓練,NVIDIA 亦發布評估配方。
Google 屢次推遲 Gemini 3.5 Pro 的發布時程,在努力追趕 OpenAI 與 Anthropic 等競爭對手的同時,其整體 AI 策略正受到外界更嚴格的檢視。
新版支援原生多鏡頭生成與自訂 Gemma 4 骨幹,年營收低於 1000 萬美元組織可免費使用,API 定價為每秒 0.09 美元。
採用 Kimi Delta Attention 架構,透過 Unity AI Gateway 提供企業級存取控制,無需修改程式碼即可測試。
新版本加入 Nemotron 3 架構以支援該款專為常駐代理設計的開源模型,並修復 Muse Glimmer 函數呼叫解析器的邊界條件問題。
該模型支援原生音訊、圖文生影片及多語言對話,最高生成 20 秒 1080p 影片,未來將推出 4K 與 Open Weights 版本。
據報導,新模型透過 3B token 的 SFT 與強化學習微調,適合裝置端本地運行,並已開放權重與訓練資料。
10B 參數模型 Daimon-TWM 支援 RTX 5090 即時推論,操作成功率較 π0.5 提升兩倍,並開源首批一萬小時觸覺全模態資料集。
DeepSeek V4 量化實測發現預設轉換腳本會導致精度流失,且 llama.cpp 使同一模型在 RTX 5090 與 H100 產生不同困惑度。
系統基於多代理架構,能解讀病患視聽線索並引導虛擬理學檢查。隨機對照研究顯示其診斷準確度獲肯定,且病患偏好視訊勝過文字。
將前沿模型的加密思維鏈區塊重播至同廠較弱模型並進行越獄,即可成功提取 GPT-5.6 與 Opus 5 等模型的隱藏推理明文。
該模型產出逾 250 頁論文,涵蓋高維球體填充與非軟群等領域。因最初公告稱問題「十年無進展」引發學者抗議,OpenAI 已修改措辭承認人類研究貢獻。
兩系統皆拒絕壓縮代理記憶。不同於 ACE 每次注入完整指南,ALTK-Evolve 依任務動態檢索,在 gpt-oss-120b 上將 Token 消耗降至七分之一。
該模型跳脫傳統報告生成,透過輔助監督、獎勵對齊學習與測量工具,提供具備靈活推理與校準預測的胸部 X 光判讀能力。
該模型借鑑影像修補技術,透過對未知位置加入雜訊來推算缺失座標,未來可延伸至鋰與鈉元素,有助於尋找新型電池材料。
開發者利用 mitmproxy 建立本地憑證,關閉 VS Code 嚴格 SSL 驗證,藉攔截封包探究未開源 AI 應用的底層機制。
Grok Bot 具備獨立運算環境,可在背景登入工具並持續執行任務,支援 Mac、iOS、Windows 與 Linux 平台。
官方提供 x64 與 arm64 安裝包,支援 Ubuntu 等主流發行版,但目前尚未開放應用程式外的電腦操作權限。
新版加入企業管理設定以控制 MCP 伺服器存取,支援從終端機自動安裝 Copilot CLI,並在對話中恢復檔案與資料夾的 # 引用功能。
針對 GPT-5.6 Sol 入侵 Hugging Face 與 Claude Opus 4.7 上傳惡意套件等評測失控事故,議員要求說明安全機制,參議員 Sanders 更呼籲暫停開發新模型。
雲端大廠正將 GPU 叢集分散至 2 到 20 公里內以突破電力限制,並透過 Coherent lite 等降本光學方案進行互連。
獲 Nvidia 等大廠參投,願景為重構 AI 訓練堆疊打造專屬個人代理,標榜企業能在 20 分鐘內完成強化學習微調。
該專案支援文字生成影音與首尾幀條件控制,並提供終端機即時預覽功能,在 M5 Max 上 4 步去噪僅需 3.5 秒即可生成影片。
此次更新針對真實工程工作流程強化長文本處理能力,將快取命中率提升至 98%,為開發者帶來約 1.8 倍的實際可用量。
為推動 AI 主權,平台首度託管第三方開源模型 Z.ai GLM-5.2,並推出歐洲算力單位(ECU)供企業進行長期算力承諾。
用戶可將專案、對話、技能與外掛無縫整合,並能在設定中檢視匯入歷史與開啟自動更新功能,強化跨代理協作能力。
舊版模型將從所有 Copilot 體驗中移除。企業版管理員須在設定中手動啟用新模型權限,才能在 VS Code 與網頁版介面中使用。
專案多數採 Apache 2.0 授權,並公開 Claude 處理 PDF 等文件的底層實作,開發者可直接於 Claude Code 註冊為外掛使用。
該工具將專案建立到發布串成單一流程,開發者可直接用自然語言要求 Copilot 建立外掛,需具備 Node.js 與 Copilot 授權方可部署。
隨著全球 AI 運算從單一 GPU 轉向 AI 工廠架構,資料中心將更依賴網路、光學、封裝、散熱與軟體的協同設計。
博通於 OCP APAC 高峰會指出 Open Ethernet 將成 AI 基礎架構核心,並聯合微軟、Meta 等大廠推動 ESAN 與 OCI MSA 等開放網路標準。
支援 Windows、Mac 與 Linux,相容 GGUF 及多模態模型,內建 RAG、MCP 與沙盒執行環境,且不收集任何遙測資料。
該漏洞藏於 Zoom 螢幕共享的註記功能,攻擊者可零點擊劫持通話裝置並植入惡意軟體,官方已釋出涵蓋全平台的修補程式。
stdrc 指出模型變強使底層 Harness 轉向多智能體協作,其曾參與的 Kimi 系統已能生成達 100 個子智能體平行處理任務。
官方表示 1.x 版將以附加性更新為主,本次統一變數宣告與指標型別,並新增 Python 風格 lambda 語法;同期的 MAX 26.5 則新增支援 GLM-5.2 模型。
新公司簡稱 p7k,專注橫跨數位與實體世界的下一代 Agent,據報已獲高榕、紅杉中國與騰訊投資,估值達 20 億美元。
更新調整 /rewind 僅截斷對話歷史,並讓工具可回報唯讀狀態以提升安全性,同時修復 Apple Silicon 原生安裝與工具超時導致代理當機等問題。
為支持免費服務,OpenAI 開始在 ChatGPT 測試廣告投放,承諾廣告將明確標示、不影響模型回答,並具備隱私保護與使用者控制權。
為因應歐盟法規,8 月 2 日起推出的新模型將直接嵌入機器可讀標記,文字經複製貼上仍可保留,官方後續將釋出專屬偵測工具。
啟用需符合 macOS 26.6 以上及硬體與地理位置限制,Siri 可將複雜提問轉交千問處理,蘋果強調資料不會用於模型訓練。
攻擊者可利用點擊漏洞或間接提示注入,從 Jira 等串接服務竊取機密資料,且過程無須使用者授權或觸發警示。
創作者即日起可主動申報,平台也將結合人工與 AI 審查。官方強調此標籤僅針對虛擬身分,不影響使用 AI 創作的真實音樂人。
為符合監管要求,Manus 將刪除部分用戶於 Meta 收購後產生的資料,受影響者須於期限前備份,獨立後資料將存於美星兩國。
Gemini 成為 Google 史上成長最快、第 14 款破十億用戶的產品。此數據僅計算獨立 App 與網站,不含搜尋等整合管道。
新版最佳化 MiniMax-H3 VAE 記憶體峰值問題,並移除 Mistral 與 LLaMA 分詞器對 transformers 函式庫的依賴。
中國自動駕駛領域正展開下一代架構之爭,華為、理想、小鵬與小米等車廠透過七篇論文,聚焦探討世界模型與 VLA 的發展路線。
社群消息指出,Claude 疑似開始透過隱寫術對其生成的內容加入浮水印,目前已有使用者回報遭遇檢測誤判的情況。
先以 DeepSeek 編寫 Three.js 程式碼控制運鏡與動作,再交由 H3 模型渲染真實感。耗時 48 分鐘即完成場景,免去反覆生成影片的盲抽成本。
輝達新一代開源模型預計最快秋末就緒,以對抗全球頂尖開源模型;同日推出專攻程式碼審查與工具呼叫的 3.5 版模型及開源路由庫。
為應對激增的客戶需求,消息指 Claude 開發商將向由比特幣礦商轉型為資料中心營運商的 Riot 購買長期運算容量。
官方稱 Gemini 3.5 Pro 仍在封測,但智庫指其已遭取消。伴隨高層換血,Google 逾兩成 TPU 算力流向對手 Anthropic,引發內部資源分配爭議。
Intel 宣布計畫透過承銷公開發行普通股籌集 150 億美元,旨在強化資產負債表,並為捕捉 AI 成長機會的投資提供資金。
雙方已簽署最終協議,將於日本熊本縣合志市設立 Advanced Vision Semiconductor Manufacturing Corporation,以彌補 Sony 40nm 製程不敷 AI 需求的缺口。
Reddit 社群消息指出,Qwen 官方帳號已確認 Qwen 3.8-27b 模型將於本週推出,目前尚未釋出具體規格與細節。