Anthropic 未發布模型在黎曼猜想取得重大進展,協調 60 個子代理並消耗 3100 萬 token
模型自主運行一天半測試 650 種想法,大幅提高猜想成立的解的下界,結果已透過開源證明助手 Lean 完成形式化驗證。
TechCrunch AI單一來源
62 則值得知道的變化
模型自主運行一天半測試 650 種想法,大幅提高猜想成立的解的下界,結果已透過開源證明助手 Lean 完成形式化驗證。
系統基於多代理架構,能解讀病患視聽線索並引導虛擬理學檢查。隨機對照研究顯示其診斷準確度獲肯定,且病患偏好視訊勝過文字。
將前沿模型的加密思維鏈區塊重播至同廠較弱模型並進行越獄,即可成功提取 GPT-5.6 與 Opus 5 等模型的隱藏推理明文。
該模型產出逾 250 頁論文,涵蓋高維球體填充與非軟群等領域。因最初公告稱問題「十年無進展」引發學者抗議,OpenAI 已修改措辭承認人類研究貢獻。
兩系統皆拒絕壓縮代理記憶。不同於 ACE 每次注入完整指南,ALTK-Evolve 依任務動態檢索,在 gpt-oss-120b 上將 Token 消耗降至七分之一。
該模型跳脫傳統報告生成,透過輔助監督、獎勵對齊學習與測量工具,提供具備靈活推理與校準預測的胸部 X 光判讀能力。
該模型借鑑影像修補技術,透過對未知位置加入雜訊來推算缺失座標,未來可延伸至鋰與鈉元素,有助於尋找新型電池材料。
開發者利用 mitmproxy 建立本地憑證,關閉 VS Code 嚴格 SSL 驗證,藉攔截封包探究未開源 AI 應用的底層機制。