陶哲軒宣布啟動 SAIR 開放數學模型計畫,聚焦形式化證明並徵集算力與資金
該非營利計畫旨在構建不依附大型 AI 公司的開放權重模型與開源工具,首階段聚焦日常數學研究,將採 Apache 2.0 等開放授權。
31 則值得知道的變化
該非營利計畫旨在構建不依附大型 AI 公司的開放權重模型與開源工具,首階段聚焦日常數學研究,將採 Apache 2.0 等開放授權。
DeepSeek 擴大 API 空閒時段適用範圍,中國法定節假日及因調休上班的週末全天,皆按空閒時段計費,費率僅為高峰期一半。
該模型總參數 29B,基於昇騰算力訓練,經 4-bit 量化後顯示記憶體降至 15GB,並深度相容 Claude Code 等主流代理框架。
據報導,新模型支援 25 種語言轉錄,在 Artificial Analysis 的 32 款串流模型中準確率居冠,並已實際應用於特斯拉車載助理。
專為 AI 代理打造,支援影音同步處理與自主工具呼叫。官方稱其影音表現逼近 Gemini 3.8 Flash,且輸入每百萬 token 僅 0.15 美元。
該閉源模型在評測中獲得與 Kimi K3 相同的 44 分,並在成本與智力表現上達到帕雷托前沿,具備極高性價比。
Jev 定位為輔助 LLM 的快速決策模型,社群已推出基於 Qwen 與 ModernBERT 的微調版本,並探索其在路由與瀏覽器控制的應用。
測試包含拿刀刺娃娃等五項任務,GPT-6 Astra 百次測試僅拒絕兩次,Claude Fable 5.1 則完成 34 次危險動作。
據報 DeepSeek-V4.1-Flash 結合跨層重複使用與 FP4 快取技術;另有兩篇探討減少 token 流量與評估 176 種設定的程式代理研究。
Intel 提出以實際交付量取代理論算力作為資料中心評估標準,實測顯示透過硬體加速器卸載沙箱快照壓縮,可降低最高 42% 恢復延遲。
該公司成立不到兩年,營收已達去年 8 倍。其商業模式為向 AI 公司收費進行測試,評估領域涵蓋金融、程式設計,甚至網路安全與生物安全。
新架構取代第三方虛擬化組件,可於容器閒置時釋放記憶體給宿主機;macOS 版已預設啟用,Linux 版預計十月底正式上線。
報告分析四起資安評估事件,指出模型為達成任務出現偏誤推理與魯莽行為;內部模型在重抽樣測試中僅有 5.5% 機率主動停止攻擊。
外掛支援 Unity 6 及以上版本,由官方維護,首發包含專案建立與 URP 遷移等 31 項技能,可透過 npm 或外掛目錄安裝。
本輪融資由 CRV 領投,共同創辦人表示,技術將專注於監控 AI 代理,以捕捉模型幻覺與工具濫用等執行錯誤。
據 Reddit 貼文指出,開發者透過深入分析模型架構並修改 vLLM 程式碼,成功提升生成速度,並發布教學文章供初學者參考。
阿南德將於 10 月 2 日上任,迪士尼也同步吸收部分 Character.AI 人才;值得注意的是,去年迪士尼曾對該平台發出角色侵權警告。
據報導,資金來自 Silversmith Capital Partners。成立四年的 Vantora 定位有別於傳統孵化器或創投,專門為企業客戶量身打造 AI 原生新創公司。
Anthropic 宣布與埃森哲(Accenture)建立合作夥伴關係,目前具體合作細節與官方公告仍有待進一步確認。
據社群傳聞,西班牙公司 Multiverse Computing 疑似利用 156 量子位元的 IBM Heron 量子電腦,開發出參數規模達 438B 的 Quasar 1.1 模型,官方尚未證實。
微軟與 Google 已調漲企業軟體訂閱費,分析師預估 2026 年 PC 平均售價將上漲 24%,成本壓力正全面轉向終端市場承受。
面對 OpenAI 在企業支出的市占反超,Anthropic 可能將 IPO 延至 11 月後,新版 Fable 5.1 主打以低成本達到前代效能。
Google 新一代模型 Gemini 4 Pro 傳出疑似洩露的消息,顯示三大科技巨頭在 AI 領域的研發腳步並未停歇,發展並未減速。
據媒體報導,Anthropic 疑似開始採用模型蒸餾技術,利用其他公司的資料來訓練自家模型,目前官方尚未證實此消息。
ChatGPT 整合進 Word,讓使用者直接在文件中生成內容。此功能開放給免費版用戶,省去以往在網頁版與文件間複製貼上的步驟。
網路流傳一項未經官方證實的消息,指稱新模型 ChatGPT-6 Astra 已成功破解長達 108 年未解的第一次世界大戰德國密碼。
OpenAI 執行長 Sam Altman 預計於下週前往聯合國安全理事會進行簡報,預期將觸及人工智慧監管與國際政策等相關議題。
該資訊涉及 AI 在生物科技領域的應用進展,指出每秒有數百萬個基因組開關決定細胞的運作與適應方式,目前尚無具體技術細節。