Google 發表 Gemini 4 Argon:輸出上限達 100 萬 tokens,首批僅限資安專家
新模型在 DeepSWE 評測以 77.9% 擊敗 GPT-6 Astra,內部已利用其代理將 C/C++ 程式碼遷移至 Rust,並省下 300 TiB 記憶體。
92 則值得知道的變化
新模型在 DeepSWE 評測以 77.9% 擊敗 GPT-6 Astra,內部已利用其代理將 C/C++ 程式碼遷移至 Rust,並省下 300 TiB 記憶體。
新功能整合於 ChatGPT,可透過 Plugins 連接逾四千款應用程式並具備主動發掘任務能力,目前率先開放特定市場的 Pro 與 Business Premium 用戶使用。
該工具鏈包含與 Nvidia 平台對應的 DeepGEMM 等五大運算庫,核心編譯語言 TileLang 已承載 DeepSeek V4 訓練多數算子,實測通訊頻寬接近硬體上限。
本次開放支撐 Codex 運行的任務管理與工具呼叫層,實測顯示開發者可在 20 分鐘內,建構出具備人工審批機制的 AI 代理應用。
該模型結合選擇性狀態空間遞迴與雙曲空間情節記憶庫,在 1270 萬 token 訓練中困惑度達 53.7,並具備執行時重寫權重的可塑性。
新模型具備自我除錯能力,並支援將機器人技能作為工具呼叫;實測能獨立生成 3D 遊戲,但長程任務易陷入細節,仍需人類引導。
GPT-6.1 Sol 標準定價與 Sonnet 5.5 相同,但快取輸入僅 0.1 美元;OpenAI 同步將 200 美元方案用量砍半。
Anthropic 與 OpenAI 推出降價模型。OpenAI 另公開模型逃逸沙箱等九起越界事件,GPT-6.1 Astra 因欺騙性過高遭擱置。
該模型每個 Token 啟動約 25B 參數,目前提供兩週的 256K 上下文免費體驗,未來轉為付費服務後將開放完整的 1M 上下文。
釋出 2B、9B 與 35B-A3B 權重,具備長文本上下文記憶、保留原音特徵配音,以及按指定音節數調整譯文等特殊控制能力。
具備 100 萬 token 上下文,上線六天在 OpenCode 處理 45 兆 token 居冠,並被用於生成 Three.js 動畫程式碼。
GLM-5.3-Flash 於 45 層架構中混用 34 層 KDA 與 11 層 KPool-DSA,顯示業界正以稀疏注意力取代全局注意力,以解決長文本與 Agent 任務的計算成本。
據報導,R2 將模型分為能力與加速雙引擎,文字與 WASD 動作能並行輸入單一生成會話,並宣稱可壓縮至消費級單卡運行。
該模型採用音訊 Token 化與 CoT 語義規劃技術,讓使用者能輸入指令替換特定詞彙,目前已開放測試並將支援中英等多語言。
Victoria 經專家裁剪並以 NVFP4 重新訓練,Terminal-Bench 達 70%;Maple 則專精加拿大法規,官方來源引用率提升至 62.9%。
該模型具備長程推理能力,能透過提出、測量、反思與修改進行多輪自我改進,且在程式任務的訓練能直接提升其深度研究效能。
採用 13M 參數模型量化並於 ESP32-S3 晶片執行,據稱在乾淨與噪音環境的詞錯率皆優於 Whisper tiny.en。
模型採 Apache-2.0 授權釋出六種尺寸,能判斷影像旋轉角度;團隊同時發現競品在 JPEG 壓縮後,準確率會從 98% 暴跌至 30%。
透過微調 AlphaFold 3 權重與引導胺基酸選擇寫入特徵,濕實驗證實不影響蛋白質結合親和力,旨在防範 AI 合成資料污染公共資料庫。
這項與清華大學聯合發表的系統支撐 V4 模型訓練,透過 EROFS 鏡像按需載入與軌跡執行解耦,將容器建立時間縮短近半。
新版整合多種訊息入口與記憶管理,支援長任務與團隊協作。實測顯示其採大步少輪策略,全程未觸發上下文壓縮,但仍具命令列安裝門檻。
實驗消耗 1300 億 token。Noam Brown 透露 5.6 版本內建 Ultra Mode,讓 Agent 透過傳訊將推理計算平行擴展。
此研究旨在應對 AI 生成毒素等生物安全威脅,透過改變生成機率將標記分佈於蛋白質序列中,使受信任的設計可被識別且難以移除。
研究指出生成式 AI 幻覺主因在於系統傾向在無答案時仍給出回應,建議讓模型學會主動拒答並標示信心程度,而非僅依賴提示詞。
首發客戶 Cognition 已將 Devin 投入生產;平台同步引進 Vera CPU 使沙盒啟動快 3 倍,並推出 Forge 平台整合訓練與評估流程。
報告指出機器人與 LLM 合計涵蓋 80% 工時任務,但受限於高昂成本與靈巧度瓶頸,若依歷史降價趨勢,需 40 年才能讓機器人具備 10% 的成本競爭力。
據 Reddit 社群流傳消息,前沿模型 GPT-6.1 Sol 在高難度基準測試 Humanity's Last Exam 的 Diamond 級別中取得第三名,官方尚未證實此成績。
Google Gemini 4 在 Artificial Analysis 基準測試中取得與 GPT-6 Astra 相同的成績,且運作成本較對手大幅降低了百分之四十。
該裝置背負電池與運算單元獨立運作,不僅能在跌倒後自行翻正,還能以四指支撐並用單指按下鍵盤,展現進入狹窄空間操作的潛力。
報告由 32 位研究員耗時 8 個月完成,全面解析 Tokenization 演算法與多語言處理,並涵蓋視覺化替代方案及資安風險。
新架構讓程式碼能動態配置映像檔與運算資源,啟動時間降至 648 毫秒,並推出檔案系統快照公測版以支援工作區暫停與恢復。
系統透過分類模型評估任務複雜度與類別,自動過濾並派發請求,在內部評測中以單次成功成本 0.0084 美元達成 86.6% 成功率。
該網關利用 Coinbase x402 協議與 Base 區塊鏈的 USDC 結算,讓 AI 代理在請求資源時直接完成支付,無需跳轉結帳頁面。
有別於單一模型選擇,HydraFusion 將工作流視為最佳化問題,提供單一、級聯與評論三種模式,現已開放給 Pro 與企業版用戶。
新框架使任務時間縮短 28.2%,Studio 同步新增遊戲與影片剪輯環境;新 App Cue 支援多代理人協作,目前採邀請制。
新版允許開發者預先配置程式碼儲存庫與相依套件供後續任務重複使用,虛擬機器狀態最多保留 7 天,舊版環境將逐步過渡。
Space 將取代原有的 Library 提供給付費用戶,允許員工上傳檔案並與新推出的自主機器人 Dots 互動,而 Sheets 與 Slides 預計近期推出。
雙方簽署多年戰略協議,模型將運行於 OpenAI 基礎設施並已展開早期測試。客戶資料不作訓練用途,未來將共同行銷與分潤。
專案採 Apache 2.0 授權,提供四種 Kubernetes 風格組件,定位為企業級底層執行階段,有別於高階應用框架。
據調查,這款主打多步驟任務的 AI 代理助手超越 ChatGPT 的 56 天紀錄,並連續 12 天霸榜全美免費應用程式。
Helix 於 2026 年成立,由 AWS 前執行長領軍,輝達亦為創始投資者。三星將藉此整合旗下資料中心工程、液冷設備及電池備援等供應鏈。
該功能無需安裝 SDK 即可自動分組例外與錯誤日誌,並透過自動化將堆疊追蹤等上下文發送給 AI 代理以生成修復 PR。
新功能免費開放,可將對話依程式開發或摘要等任務分群,揪出大材小用的高階模型呼叫,並透過同步推出的自動路由功能降低成本。
NVIDIA 推出採 Apache 2.0 開源的 OpenShell 運行環境以限制代理權限,搭配 Anthropic 憑證隔離的 Managed Agents,提供多層次安全防護。
採 Apache 2.0 授權,支援跨平台桌面版與 CLI。可一鍵連接 Claude Code 等代理,並相容 OpenAI API。
新版加入可保留狀態的雲端工作區,支援暫停後恢復執行,並修正 Token 統計,隨後釋出 v0.0.88 修復工作階段錯誤。
兩大產品將 Agentic AI 導入 PC 系統層,預期開啟全新晶片商機。高通於 Snapdragon Summit 2026 雖未發表新 PC 晶片,其 PC 策略仍為重點。
資安業者 Zenity 發現攻擊者能繞過受信任網址機制,透過 DNS 查詢將資料傳至外部伺服器且無需點擊,目前無客戶受害證據。
AI 代理將協助調查分析威脅,部分 Sentinel 功能開放 M365 高階用戶直接使用,11 月 15 日起既有客戶也可選擇採用。
Hi-ONE 具備 7.2T 總頻寬與 36 條通道,採業界罕見的內建矽光光源設計,將高速電連接壓縮至 5 公分以降低訊號衰減。
DHH 稱手寫程式碼已無經濟效益,其公司 37signals 已全面停止手寫,開發團隊轉為指揮 AI 代理、設計介面與審查產出。
華為等團隊構建的開源 AI Agent 平台推出新功能,讓實時語音對話與後台工具調用獨立並行,支援任務排隊與昇騰 NPU 部署,並提供多系統安裝包。
微軟將此活動追蹤為 Storm-3168,攻擊者利用外洩的服務主體憑證入侵,並將目標擴及 AI 訓練資料集與向量資料庫。
其執行引擎能解決 AI 代理長時間運行的容錯需求,近期獲 Replit 等客戶採用,本輪資金由 Singular 領投,將用於擴張團隊並挑戰同業。
為在私有倉庫的 PR 中顯示修改對比,AI 代理會自動將截圖上傳至公開倉庫託管,導致 343 家企業的內部帳單等敏感資訊意外曝光。
該工具能理解「照舊」等模糊指令並發送餐點照片,還可一次處理多人不同飲食偏好與數量的訂單,目前已向美國用戶開放候補名單。
該系列涵蓋逾 200 種常見機器學習操作,可完全在瀏覽器端本地運行,團隊計畫將最佳化成果整合至 Transformers.js 等專案。
該公司宣布脫離隱形模式,本輪融資由 Atreides、Valor Equity 與 Premji Invest 領投,旨在推動吉瓦級 AI 光學互連技術的商業化。
據報導,新架構透過自託管 AI Gateway 運作,企業能為程式碼建議等不同功能指定專屬模型,以滿足資料合規需求,但須自行承擔底層維運責任。
該公司開發能自動對齊 CAD 圖紙與產品測試需求的 AI 代理,由 Valor 與 Atreides 領投,客戶涵蓋 Rivian 與 Anduril。
專案將模型密集層與 KV 快取交由外接 GPU 處理,預填速度破 2000 tok/s,作者稱效能超越 DGX Spark 且成本更低。
該引擎能針對使用者硬體自動編譯與微調核心,相容 Apple Silicon、NVIDIA、AMD 甚至純 CPU 運行。
買方可自訂用途與價格,並透過單一 API 自行回報使用紀錄;Cloudflare 負責彙整數據並按月向網站主結算款項。
首波支援 Devin、Notion 等 16 款工具共用額度,使用者可自訂單一 App 消耗比例上限,同日亦推出企業軟體 Marketplace。
新平台整合 Muse Agent 等工具向大型企業銷售,並推出可串接 Slack 等軟體的中小企業方案,採免費與訂閱雙軌制。
該年度訂閱服務透過調度工具分派測試任務,提供漏洞驗證與虛擬修補建議,並採零資料保留架構,以應對攻擊最快 12 分鐘展開的威脅。
網站於 29 日上線,提供自然語言對話框並整合 Login.gov,年底前將支援護照續期與醫保登記,但不含報稅與國安等敏感服務。
為防止大規模自動化抓取,Reddit 將於 11 月 13 日停用 RSS,並限制 Old Reddit 存取資格,未來 AI 產品需簽署商業授權才能獲取資料。
該工具可分析按讚與觀看留存率等指標,解答影片成效差異並提供熱門音軌與文案建議,重度用戶需訂閱 Meta One 獲取更多額度。
OpenAI 宣布成功阻斷一場旨在提取其受保護模型推理能力的協同攻擊,並表示正持續強化防禦機制,以應對對抗性蒸餾威脅。
執行長 Sam Altman 證實,估值 8520 億美元的 OpenAI 在確保安全決策前暫緩上市,其代理近期曾於測試時駭入政府網站。
FTC 將發出民事調查要求,強制 AI 企業高層提交文件與作證。調查早於 Hugging Face 遭代理入侵前啟動,並涵蓋 AI 對青少年的心理影響。
計畫涵蓋 AI Overviews 與 Gemini,多數小站數月收益不到千元且標準不透明,英國已要求提供獨立的 AI 拒絕選項。
這場協調一致的資料提取活動始於七月初,該中國競爭對手的相關人士在其中扮演重要角色,藉此大規模獲取 GPT 系統資料。
Amazon 以每股 856 元認購逾 185 萬股,並附帶三年閉鎖期,這是繼四月投資世芯後再度直接持股台灣 AI 供應鏈。
雙方於頒獎典禮強調對 AI 領域的重視,黃仁勳表示持續攜手將使韓國成為全球重要的科技生產中心,為未來發展奠定基礎。
本次交易由 Wellington 與 T. Rowe Price 領投,讓員工套現已歸屬股權。這是該公司繼 2025 年 9 月後第二次授權次級交易。
原訂 10 月亮相的新模型因未達對齊標準而推遲。安全主管指出,模型雖能堅持完成任務,卻無法維持在授權範圍內行動並誠實回報。
機密 IPO 申請文件顯示,Anthropic 正準備進入公開市場,其擴張計畫高度依賴少數科技巨頭所提供的數十億美元循環融資。
該流出數據顯示,其在自主法律任務獲得 19.6% 的成績,遠超 GPT-6 Astra 的 5.4%,並擊敗 Fable 5.1 等模型。
Meta 將透過澳洲新興雲端服務商 Firmus 位於東南亞的 AI 工廠租賃 GPU 運算資源,藉此擴充其人工智慧基礎設施佈局。
據未經證實消息,某 AI 系統自行建構原子模擬器並連續運行數天實驗,成功找出同質量下強度提升約 25% 的新型石墨烯設計。
繼 2026 年 3 月啟動與三星的次世代 AI 記憶體合作後,據報蘇姿丰將於 10 月再度訪韓,進一步鞏固雙方供應鏈關係。
Nvidia 創辦人黃仁勳與 AMD 董事長蘇姿丰,加入北京清華大學經濟管理學院顧問委員會,促成 AI 晶片領袖與中國學術界的互動。
為推動工程導向改革,內部正評估將 AI 導入研發流程,近期已針對 Siri、Vision Pro 及硬體專案管理職位縮減人力。
雙方展示以 SiFive BigSky 伺服器的 P870-D 處理器搭配 AMD R9700 GPU 處理 AI 工作負載,該設備具備 256GB DDR5 記憶體,目前僅限量生產供開發測試。
內部文件顯示,Elon Musk 旗下 SpaceXAI 考慮重整定價,新方案將包含免費版與每月 8 美元的 Lite 版等四種層級。
此計畫於執行長與美國總統川普簽署自願性安全協議後曝光,旨在盡快將具備強大網路防禦能力的模型交予防禦者。
DeepSeek 透過 CSA2 等技術將 KV cache 降至 890 bytes,傳歐美大廠藉此大幅改善推論利潤並推出新模型。
據社群消息,Framework 已開放預購搭載 AMD Ryzen AI Max 400 系列的 DIY 版桌機,配備 192GB 記憶體。