Meta 發布 30B 本地代理模型 Muse Glimmer:採 Apache 2.0 授權,4-bit 量化可於 24GB 單卡運行
該模型由閉源的 Muse Spark 蒸餾而來,具備多模態與推測解碼能力,捨棄了過去 Llama 的用戶數限制條款,效能對標 Gemma4-31B 與 Qwen3.6-27B。
57 則值得知道的變化
該模型由閉源的 Muse Spark 蒸餾而來,具備多模態與推測解碼能力,捨棄了過去 Llama 的用戶數限制條款,效能對標 Gemma4-31B 與 Qwen3.6-27B。
該平台導入私募與信貸資金承銷資料中心建設,讓客戶無須耗費自身資產負債表即可採購硬體,具體融資條件與投入時間表尚未公布。
外掛採技能搭配 MCP 伺服器架構,為 Claude Code 等開發工具擴充動態解析度視覺、Blender 建模與長影片記憶等七大模組。
該模型基於 GPT-5.6 Sol 微調,專供獲准的防禦者尋找零日漏洞與開發利用鏈。Daybreak 服務同步劃分為 Blue 與 Red 雙層級。
新版加入對 Meta 專為 AI 代理設計的 Muse Glimmer 等模型支援,並針對線性注意力核心、快取裁剪 API 及 T5 模型的 SDPA 支援引入破壞性變更。
WebDev 榜單差距從 150 分收斂,Frontend 差距降至 40 分;支援 1M 上下文的 Muse Spark 1.2 將開源。
該模型採 2-bit 壓縮,完整運行僅需 28MB 記憶體,專為物聯網與平價手機設計,捨棄世界知識以換取極低的 70 MFLOPs 運算量。
該 30B 多模態模型專為本地代理任務打造,Ollama 透過 MLX 引擎支援影像輸入,可直接驅動 Claude Code 等開發工具。
該模型採本能反射與肌肉記憶雙層架構,透過自研視觸覺感測器實現零樣本泛化,已於工業柔性生產線完成抓取、裝配等 POC 驗證。
該模型具備約 3.6 億參數,透過幀堆疊架構將解碼迭代次數減半以提升吞吐量,並已於 Hugging Face 上架開放權重。
該模型採流式多模態架構處理連續影片輸入,在無人機視角與通用檢測任務跑分超越 NVIDIA LocateAnything-3B,並大幅降低目標幻覺誤報率。
該模型採 314B 總參數與 13B 啟動參數架構,參與韓國 AI 基礎模型計畫,並在金融與 IT 領域評測擊敗多款主流大模型。
相關論文已上線 arXiv,社群正積極開發 llama.cpp 支援,預期未來可在 8GB 記憶體設備上實現更快的推論速度。
雖然第三方平台標價便宜 36%,但 DeepSeek 官方憑藉 V4 架構將 KV Cache 大幅壓縮,實現近乎 100% 的快取命中率,使長會話成本僅為第三方的四分之一至十分之一。
透過快取教師模型前 100 大 logit 並分塊計算損失,新方法避免生成完整詞表矩陣,使單張 H200 即可執行長文本蒸餾。
該實驗室於今年 5 月內部成立,旨在解決物理 AI 在資料、認知與行動間的斷裂,將聚焦大模型演算法、仿真與 AI Infra 三大方向。
分析推測 Opus 4.7 後續模型共用 2025 年底預訓練基準點,且測試顯示各實驗室皆大量使用舊版模型輸出訓練新模型。
亞馬遜自 5 月起要求工程師節約運算資源,內部申請伺服器需苦候數天,且外部客戶的競價執行個體也越來越難取得。
Harness 預設內建函數呼叫與 OpenTelemetry 等功能,並提供 GitHub Copilot 與 Claude Agent SDK 連接器,統一納入 Foundry 儀表板進行治理。
新版升級 PyTorch 2.13.0,新增 JIT 預熱消除首次請求停頓,並初步支援 NVIDIA Rubin 架構與 SM100。
新模式改用受管 EC2 執行個體,支援多個代理共享環境與檔案以利接力協作,開發者需支付 EC2 費用與 AgentCore 管理費。
據報導,第三方開發者可透過該平台創建 AI 智能體,並以獨立對話空間形態在千問 APP 上提供從諮詢到履約的完整服務。
攻擊者可利用工具權限與沙箱隔離落差,導致遠端程式碼執行;Google 將相關漏洞評為 CVSS 10.0,目前三家廠商皆已修補。
該代理支援 12 種語言,能自動檢視專案架構產生測試,在模糊指令與特定修改任務上的表現大幅超越原生工具,目前可透過 VS Code 外掛與 CLI 使用。
該組織透過 GPT4All、Cursor 等工具在本地端處理竊取資料,並生成金融主題的釣魚誘餌,顯示其已將 AI 深度整合至攻擊流程。
這款 15MB 的 Rust 代理工具處於 Alpha 階段,核心暫未開源。它支援 12 家以上模型供應商與 MCP,在 Terminal-Bench 2.1 取得 82.7% 成績。
Cloudflare 發表涵蓋開發、部署與安全的完整 AI 代理基礎設施,包含支援生產環境審批的 Cloudflare Agents、代理專用錢包,並開源內部作業系統 Cloudflare OS。
資安公司揭露該平臺存在三個重大漏洞,包含 DNS 重新綁定與 API 授權問題,官方已於 2026.416.0 版釋出修補。
科技巨頭今年發行約 2,000 億美元公司債,博通、Meta 與輝達的信用違約保費皆攀升,凸顯 AI 基礎建設帶來的融資壓力。
新興架構將生成結果存入獨立記憶系統,由輕量模型判斷是否沿用歷史解答,僅在必要時呼叫昂貴模型並存回新解答,降低長期成本。
該工具預設 AI 代理已遭入侵,改以監控容器對外網路請求取代程式碼限制,並結合靜態規則過濾日常操作,確保模型能安全部署。
新架構將推理與物理運算分離,結合 Nemotron 3 Ultra 模型與 ACE-RTL 代理,獲 Cadence 等大廠導入,最高達 20 倍模擬加速。
該座位於印度安得拉邦的 AI 基礎設施計畫首度面臨重大反對聲浪,環保團體主要針對水資源分配與野生動物保護提出抗議。
無需 Docker Desktop 即可運行,開箱支援 Claude Code 等主流代理,允許在沙盒內啟動容器,並提供企業級集中治理方案。
Corma 透過強化學習與自我對弈訓練專屬防禦模型,處理日誌與遙測數據,曾於上線首小時內揪出企業網路中潛伏 52 天的攻擊。
除硬體外也推出數據手套與採集工具鏈,該公司由中科慧靈與藍思科技合資成立,並將建設專屬訓練場以累積操作數據。
新功能現已向 iOS、Android 與網頁版的所有使用者開放,無須額外設定即可使用,並支援建立每日簡報的自動化流程。
新功能內建四種品質模式,讓使用者可依據實際任務需求,在極致的生成速度與高解析度影像細節之間自由切換與取得平衡。
該公司集結軟銀與本田等 44 家巨頭,將搭配獲 1,500 億日圓新融資的 Rapidus 國產晶片,以軟硬整合解決高齡化缺工危機。
新架構結合真實與合成數據,使系統響應延遲下降 20%,並透過 VLM 模型即時識別交通標誌,支援窄路動態掉頭與主動避讓救護車。
系統可依劇本自動匹配角色與場景,並支援拆解參考影片風格及局部片段重拍,現提供 720P 生成每秒 0.4 元人民幣的限時優惠。
用戶無需跳轉至其他應用程式,即可透過對話完成人數、時間選擇與特殊需求填寫,後續亦可於 Yelp 修改預訂資訊。
據資安研究員披露,該平台資料庫缺乏租戶隔離,導致全球政府與企業的會議連結曝光,且通報六個月後官方仍未修復。
該模型透過 Claude Code 協調 60 個子代理並消耗 3100 萬輸出 token,最終產出通過 Lean 驗證的正式數學證明。
為降低對輝達的依賴,微軟計畫秋季推出新一代自研晶片,並尋求大幅提升產量,以說服 Anthropic 等雲端大客戶採用。
蘋果正測試將長鑫存儲晶片用於 iPhone,中國版 Apple Intelligence 則由千問提供生成能力、百度負責視覺搜尋。
三星電子第六代高頻寬記憶體自量產以來大幅改善,目前生產良率已逼近 80%,與 SK Hynix 的競爭重心正轉向實際產能。
新版介面提供由 Nano Banana 驅動的圖片生成、文件問答與頭腦風暴功能,經典「好手氣」按鈕仍保留,傳統網頁搜尋則需改按 Enter 鍵執行。
彭博社引述消息人士指出,此項收購要約旨在協助現任與前任員工,於公司可能進行的華爾街首次公開募股前出售持股變現。
中國 AI GPU 開發商 Moore Threads 受惠於業務擴張,上半年營收達 17.4 億人民幣,較去年同期成長 147.42%,目前正準備在香港掛牌上市。
據 DigiTimes 報導,美國聯邦通訊委員會的管制焦點不再侷限於品牌或最終組裝,將進一步深入通訊硬體供應鏈的源頭。
智譜 MaaS 平台用戶單月增長 200 萬,開發者產品 ZCode 上線首月破百萬用戶;今年 ARR 成長 15 倍,官方暗示實際營收高於外傳的 20 億美元。
成立僅一年的 Applied Compute 專注於協助企業使用自有資料執行並客製化開源模型,目前正進行由 Elad Gil 領投的大額融資。
系統會將照片傳至雲端安全環境分配唯一 ID,讓接收端設備可於本機驗證是否為 iPhone 真實拍攝,防範 AI 偽造圖像。