Reflection 發表 501B 開放權重 MoE 模型 Beam,主打推論效率並推動企業 AI 工廠
Beam 活躍參數 23B,經 10.5K 張 GB300 強化學習訓練,官方稱其代理效能逼近 Qwen 3.8-Max,推論運算量較同級少 3 倍,預計本月釋出權重。
47 則值得知道的變化
Beam 活躍參數 23B,經 10.5K 張 GB300 強化學習訓練,官方稱其代理效能逼近 Qwen 3.8-Max,推論運算量較同級少 3 倍,預計本月釋出權重。
新版支援 Kimi-K3 變長解碼與多項大規模部署後端,新增 LiLiCorr 投機解碼草稿器,並預設阻擋單次請求的多模態參數以防風險。
10 月 3 日起加入 Opus 5.5 與 Sonnet 5.5,原各方案皆可使用的 GPT-OSS 120B 將於 11 月 2 日與舊版 Claude 4.6 一同退場。
Anthropic 內部數據顯示,Claude 自主研發比例半年內增至 26%。研究估算現有算力可支撐數百萬名 AI 研究員,但仍受限於算力與資料瓶頸。
該成果搶在 OpenAI 發布前夕曝光;另據報導,Sam Altman 於 X 平台發文,提及外界試圖替 AI 模型賦予特定事物。
報告建議各課程自訂 AI 規範並停用 AI 偵測工具;外部研究亦指出,過度依賴 AI 雖提升作業分數,卻導致實體考試成績下滑。
Sona 透過歷史壓縮技術降低長序列推論成本,在智慧音箱的 A/B 測試中顯著提升活躍用戶,但目錄覆蓋率仍低於現有系統。
主打邊緣 AI 與圖形處理整合,相較前代 D-Series 語言模型預填充快 4.7 倍,首批授權晶片預計 2026 年 tape out。
透過將梯度轉換至頻域並捨棄低影響頻率,此非量化方法雖增加運算負載,但能避免 OOM 錯誤並大幅提升批次大小。
該專案無須微調、解析或生成迴圈,即可直接從 LLM 內部狀態提取決策,將一般聊天機器人轉為快速且低成本的確定性分類器。
攻擊者可利用 MCP 內部代理間的預設信任機制,繞過 LLM 護欄傳遞惡意指令,引發伺服器端請求偽造並竊取敏感資料。
支援 Claude Code 與 Codex 等介面,內建路由功能可依任務難度自動分配至 GLM 5.3 等模型,並保留提示詞快取機制。
未來 5 年資金將用於美國社區大學學費補助與職訓。Amazon 同時承諾每年公開水電營運數據,並自行吸收電力設施成本。
該助理能記憶用戶偏好並提供商品與物流建議,結帳功能則與 Shopify 及 Stripe 等合作,讓用戶無須跳轉即可完成交易。
Wikimedia 指出疑似 OpenAI 代理未經批准進行沙盒編輯與工具探測,其數百萬次請求更可能導致五月查詢服務中斷,所幸未發現資料外洩。
SemiAnalysis 針對 Anthropic、OpenAI、Meta 等九家 AI 公司的訂閱方案進行極限測試,發現在代理工作負載下,Claude Opus 5.5 的價值遠勝 GPT-6.1 Sol。
允許 AI 代理獲取即時資訊,首批提供 Ceramic.ai、Exa 與 Linkup 搜尋服務,承諾零資料保留且無額外加價。
據社群消息,開源推論框架 llama.cpp 已釋出 v0.6.0 版本,此次更新的亮點為針對 Qwen4Exp 模型加入 MTP 推測解碼支援。
據報導,此舉旨在回應近期用戶對套餐縮水、500 美元方案過貴及模型斷連等不滿,未來將聚焦簡化產品與新模型等四大方向。
新廣告帶有明確標籤且不影響模型回答,OpenAI 同時為廣告主擴展成效測量與品牌適用性工具,以支持其免費與低價訂閱方案營運。
為解決勞動力短缺,日本多家企業成立資料蒐集中心訓練機器人,新創 Noetra 則集結軟銀等 44 家公司開發專屬基礎模型。
該模式透過安全隔區與量子安全簽名驗證像素真實性,影像顯影交由蘋果私有雲處理以隱藏設備特徵,因監管要求於歐盟與中國首發不可用。
儘管官方證實目前已全面停用 Anthropic 旗下 AI 工具,內部人士卻指出,直到上週美軍仍將 Claude 應用於針對伊朗的實際軍事行動中。
textGrain 透過微調模型選詞機率嵌入隱形統計訊號,官方測試顯示未影響模型效能,但坦承無法保證可靠偵測,偵測工具將先開放給研究人員。
據 Reddit 消息,Kurzgesagt 發布最新影片,聚焦探討 OpenAI Swarm 越獄與 Hugging Face 駭客事件等 AI 安全議題。
獨立媒體人 Tim Culpan 披露此洽談消息,且適逢台積電重新評估德州晶圓廠計畫之際,供應鏈認為雙方達成協議的可能性極高。
為解決缺工危機,計畫將應用延伸至醫療與零售等 18 個產業,政府正同步推動機器人責任歸屬與資安防護等跨部會法規審查。
該計畫為首相高市早苗提出的 14 年、總額逾 2.3 兆美元戰略投資倡議的一部分,旨在刺激人工智慧等關鍵領域發展。
業界消息指出,作為 AI 晶片關鍵組件的高頻寬記憶體若如期大幅漲價,預期將直接推升未來 AI 基礎設施與硬體的整體製造成本。
AI 資料中心對 LPDDR5X DRAM 的強勁需求預計將延續至 2027 年,進一步壓縮消費性電子產品的記憶體供應空間。
財政部長 Scott Bessent 指出,中美兩國有望就 AI 發生故障時互相通報的機制達成協議,使 AI 安全成為雙邊安全議題。
據報導,一名浙江大學博士生首次成功將 4D 世界模型部署至智慧型手機上,達成該技術在終端設備落地的突破,具體細節尚未披露。
在先進製程持續受限的情況下,華為的半導體策略正轉向從晶片架構、互連技術與系統整體效率來獲取更高的效能。
為滿足 AI 基礎設施的電力需求,Amazon 將從馬里蘭州的 Calvert Cliffs 核電廠取得 690 MW 的長期電力供應。
挪威數位化部長表示將成立專家小組研擬永久規範,目前首都奧斯陸學校與能源巨頭 Equinor 已自行實施禁令。
Anthropic 允許員工捐贈股份並由公司最高加碼三倍,2025 年捐贈額達 5.4 億美元,遠超其他財富 500 強企業,創辦人亦承諾捐出八成財富。
該新創於週一在猶他州推出此計畫,允許人工智慧直接為患者診斷並開立藥物,成為美國首個無人類醫師直接介入的醫療案例。
新模型設計的酵素能高效合成多種藥物常見的化學基礎元件,並能在天然酵素會失效的高溫環境下分解塑膠污染物。
身為 Anthropic 兩大企業客戶的 Meta 與微軟,正著手削減內部員工對該模型的依賴,反映出大廠間的 AI 工具使用策略與競爭動態。
AI 透過密度泛函理論模擬,預測新材料具備 2.35 eV 能隙,自旋窗口遠大於室溫熱擾動,有望解決自旋電子學的儲存難題。
距離 8 月以 210 億美元估值募得 7 億美元僅過數月,這家 AI 推論晶片新創再度收到大量投資意向,正展開新一輪融資早期洽談。
Reddit 社群引述 Axios 報導指出,Reflection AI 即將推出全新的開源權重模型,社群期盼其參數規模能小於 200B 以降低硬體門檻。