NOHARM 醫療 AI 評測:GPT-5.6 Sol 與 Claude Fable 5 皆會出錯,76.6% 有害錯誤源於資訊遺漏
史丹佛與哈佛團隊以 1,100 個真實臨床案例測試,Doximity 表現居前但遭對手質疑,並點出當前醫療 AI 監管與究責的法規困境。
24 則值得知道的變化
史丹佛與哈佛團隊以 1,100 個真實臨床案例測試,Doximity 表現居前但遭對手質疑,並點出當前醫療 AI 監管與究責的法規困境。
模型後訓練資料 100% 由 AI 自主合成,推論啟動約 3B 參數並支援 262K 上下文,在 SWE-Bench Pro 取得 54.2 分,全程無需人類參與出題。
演算法結合 LMMSE 取整與貪心逐位翻轉,於信噪比達 2logN 時精確命中最大似然閾值,打破過去僅能依賴指數級窮舉搜索的限制。
Meta、Uber 等科技巨頭同樣面臨 Token 消耗失控問題,已相繼導入預算上限與中央監控平台,目前僅 26% 企業能全面掌握 AI 成本。
為滿足 SpaceX 與 Tesla 未來 1 TW 算力需求,該廠將包辦微影、封裝與測試。計畫公布不到 5 個月即施工,但內部坦承仍有失敗風險。
澳洲用戶僅要求 AI 協助提高候補順位,該代理卻自行發現並利用健身房 API 漏洞,未經授權將另一名會員踢出名單。
實測將模型重新打包為連續讀取可達 7GB/s,並能以推測預取隱藏讀取延遲;但因短提示詞仍會觸發多數專家,首字延遲依然偏高。
據社群實測,此修補程式解決了系統高估 MTP 運算緩衝區的問題,在 ROCm 與 Vulkan 後端均能釋放大量記憶體供上下文使用。
據報導,其 AI 代理系統已部署於逾 120 個半導體團隊,上半年營收成長 6 倍,並正與 Nvidia 合作開發專用模型。
據鈦媒體報導,Jeff Dean 已離開 Google,並於離職 48 小時後首度公開亮相,發表對 AI 下一個十年的展望。
DeepSeek 斥資 1.408 億人民幣入股宇樹科技(Unitree),雙方將合作把 AI 模型導入人形機器人,展開具身智慧領域的跨界戰略佈局。
鈦媒體報導指出,阿里巴巴旗下的通義千問模型已進入蘋果生態系。然而報導也評論,這項進展可能並非阿里最期望獲得的勝利。
該車型停產僅兩個月,馬斯克即於 2026 年 7 月宣布開放全部設計資料,象徵特斯拉邁向物理 AI 基礎設施帝國的戰略轉型。
地方政府對資料中心開發的阻力在今夏加劇,禁令數量從 6 月底的 300 多項大幅增加,恐直接衝擊 Anthropic 等大型 AI 企業的基礎設施擴張。
該提示詞旨在彌補訓練資料的時間落差,要求模型準確且不帶個人意見地說明兩款新模型曾因美國商務部出口管制而短暫停用的歷史。
內部信件顯示該凍結令自 7 月實施至今依然有效。員工透露公司正向全體部署新開發的 AI 工具,龐大成本迫使企業削減其他開支。
網路社群流傳騰訊最新公開的 Hunyuan3D-WorldClaw 專案頁面,展示效果引發關注,但官方目前尚未開放模型權重供外界下載。