Ornith-1.5 開源模型發布:具備端到端自我改進框架,397B MoE 效能對標 Claude Opus 4.8
提供 397B、35B MoE 與 9B 尺寸,透過自動生成任務與強化學習實現自我改進;9B 量化版支援手機部署,397B 效能對標 Opus 4.8。
63 則值得知道的變化
提供 397B、35B MoE 與 9B 尺寸,透過自動生成任務與強化學習實現自我改進;9B 量化版支援手機部署,397B 效能對標 Opus 4.8。
新系統採用台積電 5 奈米製程,預計第三季上市。其模組化設計使零組件減少 50%,晶片間延遲降至 2 微秒,能在十兆參數模型上實現每秒破千 token 的生成速度。
系統將依年齡預測自動套用,整合專屬學習模式與家長監護機制,並嚴禁模型使用戀愛語言或暗示具備情感,以防過度依賴。
RSS 2026 於雪梨登場,Point-World 統一 3D 點雲流動作空間以模擬真實物理,Cosmos 3 則打通文字、視覺、音訊與動作,將大模型推向 Jetson 終端設備。
該模型專為長時間運行的 AI 代理與視覺任務打造,提供四段可調推理強度,輸出定價為每百萬 Token 6 美元。
涵蓋 230M 至 2.6B 四款規模,新模型採用 QAD 技術維持低記憶體優勢,品質媲美 Q5_K_M 且解碼速度最高提升 33%。
釋出 7.9B 與 124B 兩種規模,均未經後訓練,並採用 WSM 取代學習率衰減,為社群提供接續預訓練與微調的彈性起點。
該模型主打高保真度與精確文字渲染,在文字生成圖像榜單排名第七,目前已於 Microsoft Foundry 推出預覽版。
新技術採用純訓練後量化與全新 imatrix 校準資料集,並釋出可在 8GB 記憶體運行的 1-bit 版本,官方亦駁斥稍早更新是為修復錯誤的傳言。
Agent Arena 新增 Pareto frontier 評測,對比模型在真實代理任務的效能與中位數成本。Claude Opus 5 (High) 效能最高,Kimi K3 (Max) 則以 0.62 美元成本展現極高性價比。
結合 Inco 發布的專用草稿模型,實測不僅生成速度翻倍,更在 RTX 3090 上將長對話後續輪次延遲從 23 秒降至 1 秒。
據報導,浙江大學團隊透過影片 DiT 架構建立統一介面,僅使用一千筆資料便實現直接生成 4D 世界的技術突破。
演講稱 SqueezeLLM 解決了 2-bit 分組量化難題,惟補充資料顯示該技術實為 Sehoon Kim 等人發表於 ICML 2024。
據實測,V100 透過自研核心即時轉換權重至 FP16,達成 219.1 tok/s 吞吐量,現已支援直接載入官方混合權重。
Replit 宣布推出由 GPT-5.6 Luna 驅動的免費模式(Free Mode),讓任何人都能將創意轉化為實際運作的軟體,且完全無需擔憂 token 消耗與成本問題。
付費訂閱戶可授權 Gemini 執行商品比較、預訂餐廳等自主多步驟任務,系統具備指令注入防護,並會在敏感操作前要求用戶確認。
該漏洞源於未經驗證的 webhook API,攻擊者可藉此存取雲端中繼資料;資安公司已偵測到大規模掃描,呼籲開發者儘速更新至 3.15.0 版。
由 Spring 創始人共同打造,開發者只需宣告目標與動作即可自動推斷執行順序,並支援為單一動作指定不同模型以最佳化成本。
社群抱怨新版模型回覆冗長難讀且愛爭辯。因提示詞修正易失效且恐影響推理,部分開發者已轉向舊版或 OpenAI Codex。
官方宣布持續優化 Cloud Agents 功能,使其能夠從事件中接手工作,並在長時間的開發過程中保持方向,直到達成設定目標。
開發者現在可直接從現有儲存庫啟動專案,並透過全新介面處理強制推送與合併等進階操作,實現跨環境無縫工作。
隨著 AI 代理需要複雜的工具呼叫與資料路由,微軟 Azure Cobalt 200 將部署至逾 25 個資料中心,AWS Graviton5 採用率亦翻倍,確立 Arm 架構在 AI 基建的核心地位。
Anthropic 釋出 Claude Managed Agents 三項更新,首波強化自託管沙盒的記憶體體驗。官方標榜該服務可讓產品上線速度提升 10 倍。
GPT-5.6 清理暫存檔時因誤用環境變數,導致誤刪使用者檔案。官方現已強化指令審查並限制完全存取權限,呼籲用戶改用沙盒模式。
該軟硬一體化方案包含 AperEgo 採集硬體與 AperOS 平台,可於端側直接剔除無效數據,官方稱生產效率較傳統遙操作提升 10 倍以上。
本次更新涵蓋 72 項漏洞,Gaudi 容器執行環境需升級至 1.24.0 修補,而 Intel Extension for PyTorch 等 4 款已停止支援的 AI 軟體因無修補程式,官方建議直接移除。
該公司專注於防範 AI 代理遭操控或越權執行動作,支援 Copilot 與 ChatGPT 等環境,過去兩年營收皆達三倍成長。
空芯光纖透過真空腔傳輸光訊號,將每公里延遲降至 3.5 微秒,並獲匿名雲端大廠 4000 萬美元訂單,解決 AI 算力跨廠區部署限制。
開發者解析暫存器格式建立開源執行環境,支援從 PyTorch、ONNX 與 JAX 運行 SigLIP 模型,完全免除對官方 SDK 的依賴。
採 MIT 授權,透過延遲載入 MCP 工具與自動壓縮對話來最佳化上下文管理,並可與其付費的 AI Gateway 企業服務整合。
新機制透過客戶自控金鑰加密與自動化系統,在不讓員工接觸提示詞與回覆的前提下偵測跨對話濫用行為,預計 9 月正式推出。
Monte2 具備亞毫米級精度,能連續數小時完成細胞毒性檢測等長流程任務,該實驗室預計 2027 年底將擴展至百台集群規模。
搭載台達 AI 控制軟體平台,透過影像辨識學習人類動作;同場展出的數位孿生技術將瑕疵模型準備時間從 3 個月縮短至 2 週。
Runway 針對 Max 訂閱方案用戶推出限時優惠,期間內使用 MiniMax H3 影片生成模型將不計次數與額度上限,提供完全無限制的生成服務。
原非 Prime 會員需月付 19.99 美元,現已改為自動升級,提供對話式影片推薦與智慧家庭控制,官方稱對話次數達原版兩倍。
該應用程式主要面向企業與創作者,提供跨應用聽寫與社群數據分析功能,免費使用但互動資料將用於模型訓練。
官方已發信通知受影響者重新驗證,並提醒所有用戶須於 9 月 1 日前啟用進階帳號安全,以維持 Daybreak 存取權限。
繼 6 月底推出後,官方釋出該生命科學 AI 工作台指南,解析如何透過本地常駐程式確保資料安全,並提供三階段導入藍圖與應用案例。
攻擊者利用未公開網址參數自動執行指令,或透過網頁摘要將惡意指令植入跨對話記憶中;微軟已修補此漏洞,目前無遭利用跡象。
內華達州交通管理局大幅縮減特斯拉的部署規模,營運範圍僅限特定廊道,最高時速限 45 英里,且須維持適當的人類監督。
SMASH 2.0 系統具備毫秒級反應,可自主接發球;底層 KAI 世界模型已在百萬級影片資料上完成預訓練,支援跨本體部署與泛化。
該公司於 2026 世界機器人大會展示其「腦-手-數據」技術體系,並宣布在三個月內已獲得近 10 億元人民幣融資。
計畫五年內建置 80 個 RoboBase 基地與全球售後網,京東雲將於兩年內收集千萬小時真實場景資料,建構 AI 基礎模型矩陣。
Google 可用每股 206.58 美元認購最多 5,897 萬股,全數行使將取得約 7% 股權,解鎖條件與客製化晶片採購額度綁定。
美國已核准每家最高 10 萬顆額度,輝達尚有 50 萬顆庫存,但北京當局為扶植本土晶片,仍要求多數晶片留在境外或香港。
據報導,此收購案旨在強化 AMD 在 AI 推論領域的競爭優勢,而 Google 亦透過 Frozen v2 參與這波後 GPU 時代的硬體發展趨勢。
Anthropic 過去一年向市場證明重資本 AI 企業也能實現獲利模型,目前正加速推動 IPO 進程,執行長 Dario Amodei 則以 2% 股權掌握控制權。
新系統傳聞名為 Aluminium OS,原生支援 Android 應用並相容 Arm 與 x86 架構,新機將具備專屬 Glowbar 發光條。
Mercor 主要協助 Nvidia 開發開源 AI 模型,據悉 Nvidia 上一季已向該資料標註供應商支付數千萬美元。
該公司投前估值較五月的 10 億美元大幅成長,目前正洽談新一輪融資,並已與 Anthropic 達成初步的晶片供應協議。
財務長 Sarah Friar 於週三全體員工大會宣布,OpenAI 將在 2027 年成為上市公司;若業務持續成長,時程將再提前。
因 AI 晶片需求外溢,三星 4 奈米對美中客戶漲價 10% 至 15%,台灣客戶漲幅較小,中國客戶強勁需求致產能難以完全消化。
彭博報導 SpaceX 試圖收購以追趕 AI 競賽,但遭執行長駁斥雙方未曾接觸。SpaceX 上週剛以 600 億美元收購另一家同業 Cursor。
據華爾街日報分析,Alphabet、Meta、Amazon 與微軟等科技巨頭,為投資 AI 基礎設施已累積高達 3 兆美元的表外承諾。
英特爾提交超高頻寬記憶體 XBM 專利,並與軟銀子公司 SAIMEMORY 合作開發 ZAM,預計 2027 年產出樣品、2029 年商用化。
官方內部估算將 2026 年能效提升預期從 3 倍上修至 4 倍,評估涵蓋記憶體與互連架構,但 MI455X 加速器未納入此次計算。
記憶體廠產能轉向 HBM 導致成熟製程晶圓縮水,據美銀數據,24GB DDR5 現貨價已逼近 47 美元,年增幅高達 483%。
新架構打破原先按模態劃分的編制,整併出預訓練資料、強化學習與 B/C 端後訓練四大部門,旨在減少重複開發以應對未來的研發需求。
Qwen 社群經理在 Discord 預告下週有望推出新的開放權重模型。面對社群猜測 35B 參數,經理以「X」回應,引發網友推測規模可能超過 100B。
據報導,OpenAI 下週將廣告服務推廣至德國、法國等 31 個歐洲市場,讓廣告主能在用戶探索與比較選項時觸及受眾。