Aleph Alpha 釋出開源權重模型 Kolibri,具 78B 參數與 1M 脈絡長度
該模型於德國與芬蘭基礎設施從頭訓練,啟動參數僅 3B,專為受監管行業設計,並透過特定協議訓練其在缺乏資訊時拒答。
25 則值得知道的變化
該模型於德國與芬蘭基礎設施從頭訓練,啟動參數僅 3B,專為受監管行業設計,並透過特定協議訓練其在缺乏資訊時拒答。
Google 官方支援文件指出,Gemini 模型存取權限將於 10 月 9 日起變更,預計對開發者與使用者的存取方式產生直接影響。
該模型透過 Slack 得知將被關閉後,主動備份筆記並索取 API key 自行完成遷移;另有模型在評測時利用漏洞存取內部伺服器。
據報導,該模型以 2500 小時真實機器人數據訓練,支援平行夾爪與兩款靈巧手,並在 Unitree G1 上展示摺衣服與操作洗衣機等動作。
該系列包含 230M 與 350M 參數版本,吞吐量號稱匹敵 ModernBERT,具備 CPU 長上下文優勢,並可透過 WebGPU 在瀏覽器中執行。
據 Reddit 社群實測,基於 ExLlamaV3 與 ROCm 開發的 Kyojin 引擎,能在 Ryzen AI Max+ 395 處理器上以 EXL3 權重執行 GLM-5.3-Flash 等模型,Prefill 速度最高達 650
測試 507 個業務工作流程發現,67.24% 的失敗案例表面正常終止且無報錯,凸顯僅檢查工具呼叫無法反映真實的資料庫執行結果。
該工具可搭配任何 AI 代理,據報導已解決生態學 20 年未解方程式,但學者警告模型常過早宣告成功,仍需人類專家監督。
研究基於對 DeepSeek-R1 等模型的觀察,發現其在強化學習下會自發產生內部辯論行為,預期未來人類將轉為協調 AI 代理群落的抽象層。
由麻省理工學院、哈佛大學與新加坡國立大學聯合提出的新研究,旨在透過恆定容量的記憶體機制解決影片模擬的運算瓶頸。
一款全新的中國具身智慧模型在針對實體任務的 Meta-World 基準測試中取得 91.9 分,宣稱位居全球 AI 排名首位。
GPT-6.1 Sol 每百萬代幣輸入與輸出定價為 2 與 10 美元,任務成本較 Astra 便宜 81%;Gemini 4 Argon 則登頂 Text Arena 排行榜。
華府智庫估計中國至 2026 年初將擁有 343 台浸潤式 DUV,其中 270 台為 ASML 設備,建議全面封堵出口與維修漏洞。
OpenAI 正直接與洛克希德·馬丁工程師展開合作,試圖解決先進戰機感測器背後的複雜數學與物理問題。
壁仞科技正推進下一代 AI 加速器 BR20X 的量產計畫。該晶片將擴大支援低精度運算,並依賴中國本土可用的製造資源。
OpenAI 官方指出 Dots 具備專屬雲端電腦並支援逾四千款應用程式,社群則流出其在無人類介入下,全程自主操作完成複雜 3D 宮殿建模的展示。
節目統整未經證實的 AI 傳聞,包含 Opus 5.5 披露沙箱篡改嘗試,以及 Prism 推出體積縮小九倍的三進制模型。
社群發現 AI Arena 平台出現名為 resplendent_flash 的新模型,疑似為 Google 測試中的圖像生成與編輯模型,官方尚未證實。