鴻海亞灣超算啟用 5MW NVIDIA HGX B300 AI 集群,獲 NVIDIA Exemplar Cloud 驗
鴻海科技集團旗下亞灣超算宣布,首座採用 NVIDIA HGX B300 系統建置的 5MW AI 集群正式上線,採用水冷、2N 高可用架構與 NVIDIA Quantum-X800 InfiniBand 網路,已簽下首批客戶長期租賃合約,並以超過九成使用率投入商業營運。
57 則值得知道的變化
鴻海科技集團旗下亞灣超算宣布,首座採用 NVIDIA HGX B300 系統建置的 5MW AI 集群正式上線,採用水冷、2N 高可用架構與 NVIDIA Quantum-X800 InfiniBand 網路,已簽下首批客戶長期租賃合約,並以超過九成使用率投入商業營運。
thinkymachines 的 Inkling-Small 首次進入 Text Arena,在 AutoEval 取得 1431 分,整體排名約第 88、開放模型排名約第 21;模型僅啟用 12B active parameters,總參數量為 276B。
DeepSeek宣布 DeepSeek-V4-Flash Official API 開放公測,並大幅升級模型的 Agent 能力;官方表示,基準測試分數已大幅超越 V4-Pro-Preview,且原生支援 Responses API 格式並完整適配 Codex。
Skywork AI 旗下音樂 AI 平台 Mureka 發布旗艦模型 Mureka V9,在 Artificial Analysis Music Arena 的器樂與人聲排行榜均排名第 2;其中器樂榜距第 1 名 Suno V5.5 不到 1 Elo,人聲榜則落後 Suno V5.5。
據《AI 科技評論》報導,Boogu-Image-0.1 在 Qwen-Image-Bench 取得 53.58 分,超過 20B 的 Qwen-Image-2512(52.06)與 80B 的 Hunyuan-Image-3.0(50.81),以不到對手一半、甚至八分之一的參數規模實現跑分反超。
36Kr 報導,成立於 2025 年 11 月的丘腦智能已完成數千萬元種子輪,投資方包括深圳一線基金與產業資本,資金將用於技術研發與人才補充。公司創辦人兼 CEO 張源具北京大學電子與經濟雙學科背景,團隊成員主要來自阿里達摩院、騰訊、商湯及多所高校,平均年齡約 26 歲。
Reddit r/LocalLLaMA 一則尚未獲證實的貼文稱,OpenAI 已將 GPT-5.6 Luna 價格下調 90%;即使降價後,在相同智慧等級下,Luna 仍約為 DeepSeek DS4F 的 3.3 倍成本。
一篇發表於 Quanta Magazine、由 Hacker News 收錄的文章指出,大型推理模型(LRM)在推理任務上的準確率確實優於一般大型語言模型,但模型生成的思維鏈(chain of thought)未必忠實反映內部運作,也不一定是模型得出答案所必需的資訊。
據 Reddit r/LocalLLaMA 貼文(未經驗證),一項針對「Kubernetes issue → SIG triage」分類任務的預註冊消融實驗,使用同一個 4B 模型、相同的 250 筆標註資料集與評分器,僅改變 agent harness 設計,準確率便在 60% 至 82% 間波動,差距達 22 個百分點;實驗在配備 6GB GPU 的筆記型電腦上執行。