傳哈佛物理學家使用 Claude Fable 5:20 分鐘重現數週工作,解決 15 項未解物理計算
據 Reddit 未經證實的消息指出,該學者在三個月的研究期間,利用該模型跨足 18 個領域,並對 36 篇論文做出貢獻。
58 則值得知道的變化
據 Reddit 未經證實的消息指出,該學者在三個月的研究期間,利用該模型跨足 18 個領域,並對 36 篇論文做出貢獻。
該工具透過分析目標模型的失敗與教師模型的成功案例,提煉出能力規格卡,藉此生成具備可行性與真實性的新任務來強化模型。
新系統將運算移至伺服器端以提升準確度,結合開源 Federated Language,並將存取策略發布至公開日誌 Rekor 供外部稽核。
該測試平台由 Planet Labs 打造,受限於 1 kW 供電,TPU 將以每次 15 分鐘頻率啟動,以驗證晶片在太空輻射與極端溫度下的運作能力。
旨在提供數學與程式編寫以外的長程強化學習任務,內部整合 RDKit、ADMET-AI 與 Boltz-2 等工具,挑戰超越單純化學領域的長程規劃能力。
因 AI 論文數量兩年翻倍且低品質內容暴增,導致志願審核員不堪負荷,arXiv 自 2026 年 10 月起實施臨時限速,限制提交者每月最多投稿兩次。
論文證明七維空間中 28 種球面皆能配上嚴格為正的截面曲率度量,解決其 1982 年列入清單的難題,AI 協助了策略探索與計算。
作者指出當前語言模型的思維鏈僅是預測 token 的延伸,缺乏明確認知狀態與獨立搜尋機制,並為此離職尋求基於 AlphaGo 架構的新方法。
據作者發布,該演算法將高熵狀態視為分支點並存入向量資料庫,在 Llama 3.2 3B 測試中大幅降低獎勵最大化任務的搜尋成本。
該測試要求 AI 代理在無提示下掃描完整程式碼庫並修復隱藏的真實漏洞,目前模型得分遠低於預期,專案採 MIT 授權開源。
據 Reddit 流傳的未經證實消息,GPT-6 Astra 模型僅耗時 6 小時,便成功解讀一封塵封 217 年的拿破崙軍事信件。