MiniMax H3 登陸 Magnific:即將開放權重,支援最多 9 張圖片、3 段影片與 2K 輸出
MiniMax 表示,影片生成模型 H3 已由 Hailuo AI 登陸 Magnific,使用者可提供最多 9 張圖片控制角色與風格、3 段影片控制動態與攝影機,生成 5 至 15 秒、最高 2K 解析度的影片。MiniMax 另宣布 H3 權重即將開放,社群將可研究模型、進行微調,並在其上建立新的創作工作流程。
57 則值得知道的變化
MiniMax 表示,影片生成模型 H3 已由 Hailuo AI 登陸 Magnific,使用者可提供最多 9 張圖片控制角色與風格、3 段影片控制動態與攝影機,生成 5 至 15 秒、最高 2K 解析度的影片。MiniMax 另宣布 H3 權重即將開放,社群將可研究模型、進行微調,並在其上建立新的創作工作流程。
Google AI 在 X 貼文中回顧近期產品更新,包括 Google DeepMind 的 Gemini Robotics 2,主打將全身智慧帶進機器人;Gemini 3.5 Flash-Lite,定位為最快且最具成本效益、適合高速 AI 代理工作流程的模型;以及 Gemini 3.6 Flash,宣稱能以更少的 token,在各項任務中提供更快且更準確的效能。
thinkymachines 的 Inkling-Small 首次進入 Text Arena,在 AutoEval 取得 1431 分,整體排名約第 88、開放模型排名約第 21;模型僅啟用 12B active parameters,總參數量為 276B。
DeepSeek宣布 DeepSeek-V4-Flash Official API 開放公測,並大幅升級模型的 Agent 能力;官方表示,基準測試分數已大幅超越 V4-Pro-Preview,且原生支援 Responses API 格式並完整適配 Codex。
Imagine Video 1.5 在上月發布後,新增文字生成影片、影像參考與聲音參考功能,並支援原生 1080p 輸出;官方稱其動態與聲音表現更逼真。該模型已正式開放於 xAI API,模型識別名稱為「grok-imagine-video-1.5」。
據《The Information》引述消息人士報導,OpenAI 本週向美國政策制定者與監管機構展示一系列暫名為「Astra」的新模型,強調其完成長時間任務的能力有所提升。消息人士稱,OpenAI 正準備發布這個新模型家族,但正式名稱與發布時間尚未公開。
Skywork AI 旗下音樂 AI 平台 Mureka 發布旗艦模型 Mureka V9,在 Artificial Analysis Music Arena 的器樂與人聲排行榜均排名第 2;其中器樂榜距第 1 名 Suno V5.5 不到 1 Elo,人聲榜則落後 Suno V5.5。
Reddit r/LocalLLaMA 一則未經證實的貼文稱,Meituan 推出了 LongCat-Flash-Lite-Sparse。該模型採用 MoE 架構,約有 3B active parameters,另配備約 30B 的 n-gram 查找表,並將查找表卸載至 RAM,以在 24GB GPU 上支援 256K context。
據報導,美國部分大型企業開始採用中國大模型以降低 AI 成本。加密貨幣交易所 Coinbase 表示,正轉向使用中國人工智慧模型;Airbnb 則已採用阿里巴巴的 Qwen 模型,並稱其「快速且便宜」。
Reddit r/LocalLLaMA 貼文稱,audio.cpp 0.5 已發布,新增 DramaBox、Confucius4-TTS、RVC、BS-RoFormer、GLM-TTS、Kroko ASR、Parakeet-TDT、Inflect Micro v2 與 Fun-ASR-Nano 等模型或功能;官方目前尚未證實這項發布。