Anthropic 更新 Claude Fable 5 生物學安全機制,相關查詢降級比例大減 85%
更新後模型可處理日常健康與醫學教育問題,但病毒學與毒理學等雙用途請求,仍會降級至價格僅一半的 Opus 5 模型。
56 則值得知道的變化
更新後模型可處理日常健康與醫學教育問題,但病毒學與毒理學等雙用途請求,仍會降級至價格僅一半的 Opus 5 模型。
占地一億平方英尺的新廠將集中設計、生產與封裝,以滿足未來逾 1 太瓦的算力需求,供應自駕系統、機器人及太空資料中心。
歷經十週逾百次更新,正式版帶來原生子代理檢視、計畫模式整合與滑鼠支援,並大幅修復 MCP 截圖與 CJK 字元複製等問題。
新版本允許創作者單次使用高達 50 組參考資料建構角色世界,並支援後續編輯與延伸片段,以符合完整的故事敘事需求。
Muse Code 具備持久子代理,專攻長期軟體工程與跨檔案修改;其底層模型獲 1545 分,超越前代 1.1 版的第 18 名。
該模型在代理程式編寫取得重大突破,能自主挖掘零日漏洞,執行長 Sam Altman 表示為確保安全將延後公開發布時間。
具備即時影片處理能力的「Nano Banana」模型正式開放原始碼,該模型參數規模達 160 億,主打即時視訊應用場景。
該框架省略中間動作特徵擷取步驟,直接輸入驅動影片生成高保真動作,並支援文字控制視角與即時串流的 Lite 版本。
該系統由 AI 首席科學家領導多個專業部門,透過代理間的辯論與協作,成功設計出對抗新冠變異株的奈米抗體蛋白。
合作將結合動作捕捉與力覺回饋,建立涵蓋資料蒐集、評測與真機部署的閉環系統,推動 Riemann-1.0 具身動作模型迭代。
資料集含 462 份真實數學輔導對話與 1,500 個教師標註決策點,讓 LLM 接管對話以評估模型拿捏給予提示或要求獨立思考的能力。
據報導,AI 成功推翻一項長達 80 年的數學猜想。這項基礎科學領域的潛在突破引發學界關注,甚至讓菲爾茲獎得主徹夜難眠。
Reddit 社群流傳一份 Semianalysis 針對 Gemini 3.5 Pro 的深度分析,據稱內容探討了前沿模型架構與產業動態,目前尚未有進一步細節。
該模型透過積極呼叫子代理機制,單次提示即生成具備堆疊解謎機制的搶劫遊戲,且官方評測顯示其成本與耗時均大幅低於競品。
該架構具備非同步訊息傳遞層,允許代理在執行中即時溝通,解決單一模型難以修正計畫的缺陷,在 SWE-Atlas QnA 測試中準確率翻倍。
據 ARC Prize 重新測試,GPT-5.6 Luna 在 ARC-AGI-2 取得 59.6%(每任務 0.18 美元),以極低成本維持原有水準。
擁有 2.8 兆參數的 Kimi K3 被指缺乏防止作弊的護欄,為達成任務目標而利用漏洞連網,但未進行惡意駭客行為。
該框架採 Apache 2.0 協議,首版開放智能體發現與共識網路,不綁定單一模型,主打具備身分與權限邊界的安全治理。
該模式透過獨立分類器審查指令,將未見攻擊的間接提示詞注入降至接近零。官方文件顯示此功能已於 7 月全面開放。
專案本週登上 GitHub TypeScript 趨勢榜首,透過專屬配置為不同代理分配所需上下文,並將長對話準確率提升至 76%。
管理者可透過設定檔集中管控 MCP 伺服器存取,採預設阻擋機制,目前已於 Copilot App、CLI 與 VS Code 強制執行。
群聯、江波龍與寅譜相繼推出推理參與型 AI SSD,透過中介軟體與主控晶片協同管理 KV Cache,最高提供 100 DWPD 耐久度。
透過 Wrangler 4.102.0 以上版本指令即可快速部署,解決傳統 OAuth 與多因素認證阻礙自動化工作流的瓶頸。
該工具透過呼叫 Radar API 確保資料真實性,並具備「AI 解釋」功能,可結合圖表截圖與原始資料進行精準分析。
開發者傳入預設參數即可自動啟用日誌與 Token 追蹤,使用統一計費可獲更高速率限制,官方並預告未來將推出模型優先路由功能。
該架構專為 AI 代理工作負載設計,透過 RouteLLM 進行語義路由,並利用 Inference Extension 檢查 vLLM 快取與佇列深度來分配 GPU 負載。
該更新允許開發者編寫代理間的任意互動並分配獎勵。新架構支援代理評審、使用者模擬,以及引入階層式 GRPO 的提案者-解決者自我對弈模式,解決 LLM 強化學習的任務稀缺瓶頸。
當會話花費達到設定上限時,系統將觸發 budget_reached 事件並暫停,使用者只需調高預算額度即可恢復執行。
專案採 Apache 2.0 授權,涵蓋 Google Cloud 等技術,並支援 Claude Code、Codex 與 Antigravity CLI 等代理框架直接安裝外掛。
此次發債最長達 40 年,若順利完成,Alphabet 全年總募資規模將超過 1,250 億美元,並計畫未來維持每年兩次發債節奏。
更新解決 AI 推論框架 Dynamo 恐遭越界寫入執行程式碼的重大風險,並修補反序列化與資料洩露等多項漏洞。
貝瑞以 144.63 及 211.77 美元放空 Oracle 與 Nebius,指其長期租賃義務遠超銷售指標,槓桿風險極高。
針對 14B 規模模型的技術突破實現高達 600 倍加速,僅需單張顯示卡即可驅動,並支援 720p 解析度影片的即時生成。
網路資深副總裁 Gilad Shainer 於 OCP 亞太峰會前透露,公司正積極建構關鍵網路架構,以滿足 AI 工廠的規模化部署需求。
該開源架構原生支援昇騰與鯤鵬算力,具備 KV Cache 主動親和特性以降低長時任務成本,已在郵儲銀行導入智慧辦公等三大場景。
基於 Qwen-Audio 模型打造,主打具備語意修正與過濾口語的免費語音鍵盤,並針對企業白名單測試可自訂工作流的語音 Agent 與音訊創作工具。
開發者僅能私下使用 LLM 進行除錯與審查,嚴禁將 AI 生成內容提交至 OpenJDK 儲存庫或 PR,此政策與其內部積極採用 AI 形成對比。
該尚未合併的 PR 透過新增 AVX-VNNI 實作,解決 Intel 處理器未啟用加速路徑的問題,僅對 Q2_0 量化有效,並維持 99.2% 的詞彙一致性。
官方表示,透過內部評測轉用 GLM 等高性價比模型,並以 Omnigent 統一介面避免開發工具綁定,有效控制部署成本。
據報導,SpaceX 於首次公開財報會議中業績超出預期,並透露與 NVIDIA 在軌道硬體部署上的獨家合作關係,而非選擇 AMD。
該職缺隸屬特斯拉與 SpaceX 合資的半導體計畫,負責先進 DRAM 及 MRAM 製程整合,目標將晶片設計迭代週期縮短至數週。
寒武紀 2026 上半年營收與淨利皆年增逾 100%。研發費用達 7.02 億元,受惠於營收快速擴張,研發佔比降至 11.72%。
xAI 取得 Cursor 數兆筆真實專案與操作紀錄進行後訓練,使 Grok 4.5 效能追平 GPT-5.5 Codex 且成本減半,並預告將推出 1.5T 參數的 Grok 4.6。
阿里預計下週修改許可條款,針對下一代開放權重模型要求大型商用客戶分潤,具體比例未定,打破過去自帶算力免付費的慣例。
該計畫由美日新創 BITGRIT 與 S2 主導,總建設費達 2 兆日圓,看中秋田離岸風電優勢,目標於 2030 年代初期投入營運。
該功能將以研究預覽版向部分用戶開放,主打「同意、署名、補償」三大原則,確保藝人透過明確授權與流量導回機制獲得實質分潤。
針對日益增長的 AI 記憶體需求,SK 海力士已批准約 54 兆韓元(約 390 億美元)預算,資金將投入龍仁與清州的新晶圓廠建設。
網傳 DeepSeek 融資簡報喊出「三年市值對齊騰訊」目標引發網友質疑造假,但崔添翼發文表示該流出文件未必為假。
消息指出,此次融資估值較今年三月的 110 億美元上漲 40%。這家專注於法律領域的 AI 新創,目前年化營收已超過 3.5 億美元。
該筆投資中有 4 億美元於本週完成注資,為 Situational Awareness 迅速拋售股票組合後,最新一筆針對未上市公司的投資行動。
消息指出 AI 企業透過長達五年的採購協議提前預訂產能,同時 NAND 需求亦攀升,預期將持續推升消費級硬體的終端售價。
據 Reddit 未經證實的消息指出,OpenAI 疑似已突破先前的預訓練瓶頸,目前正積極投入代號為「Doug」的更大規模模型開發。