xAI 開源 314B 參數 Grok-1 MoE 模型,採 Apache 2.0 授權並登上 GitHub Trending
該模型採 8 專家混合架構,每次啟用 2 個專家,支援 8K 上下文,可透過 Torrent 或 Hugging Face 下載,需極大 GPU 記憶體。
24 則值得知道的變化
該模型採 8 專家混合架構,每次啟用 2 個專家,支援 8K 上下文,可透過 Torrent 或 Hugging Face 下載,需極大 GPU 記憶體。
新規範移除握手與會話標頭,改以多輪往返處理伺服器請求,並收緊授權機制,Anthropic 稱其 SDK 月下載量已突破 4 億次。
在 113 個長週期工程任務測試中,其每任務成本僅 0.61 美元,成績亦領先 Gemini 3.7 Flash Medium 1.7 分且成本低 70%。
Composio 測試顯示模型在複雜工作流程的表現高度依賴代理框架,同時官方導入離峰半價機制,快取命中費率最高暴增 1100%。
實驗顯示代理群集能自行打造工具並分工,與獨立代理僅 12 處漏洞重疊;但在具高度依賴性的軟體開發任務中,協調難度仍大幅增加。
該無監督神經網路具備物理感測能力,不需預先人工標註即可從數據學習,應用於掃描式 X 光奈米繞射顯微術,為自動化材料研究鋪路。
據報導該工作台主打零科研幻覺。其取得 SOTA 的 BiomniBench-DA 基準測試共包含 50 個任務,並搭配 78GB 真實數據進行評估。
針對循環模型在推理過程中出現「越想越錯」的現象進行技術探討,分析模型為何無法有效學習,並提出「多想,少說」的觀點。
報告指出生成式 AI 採用率三年內達 53%,且 2025 年產業界貢獻逾九成前沿模型,在 SWE-bench 測試已接近 100%。
該研究指出強化學習對推理模型的影響僅在少數 token,並釋出包含 9.2 萬筆數學與程式碼等領域的 Guru 可驗證資料集。
GLM-5.2 等模型憑較少活躍參數在推理取得高分,但無工具事實問答準確率低迷,顯示開發者正將知識儲存轉嫁給外部檢索工具。
該團隊原負責評估模型失控等重大風險,現已按生物與網路安全等領域拆分;近期多位安全主管離職,引發忽視安全問題的批評。
針對投資人指控其欲成為「唯一私營公司」及黃仁勳等人的批評,Dario Amodei 辯護其政策,並表態支持模型發布前審查。
該漏洞發生於 2025 年 5 月至 2026 年 4 月,導致外部承包商的人工回饋請求繞過 CBRN 安全分類器,官方調查稱未發現遭惡意濫用的證據,並已提高審查要求。
波克夏終結 14 季淨賣出,將 Alphabet 買成第三大持股;軟銀套現 2.69 億美元大砍台積電,科技七雄面臨籌碼洗牌。
Airtable 年營收達 4.8 億美元,收購定價倍數僅 2.7 倍。買方為義大利 App 收購集團,交易預計年內完成。
該公司正開發名為 Post-Transformer BDH 架構的 AI 模型,近期獲額外注資後,種子輪融資總額已達 3000 萬美元。
據估計該市場流通額度達數千萬美元,仲介透過代理伺服器隱藏原始金鑰,並以「大量採購」名義提供高達 40% 的推論折扣。