MiniMax H3 登陸 Magnific:即將開放權重,支援最多 9 張圖片、3 段影片與 2K 輸出
MiniMax 表示,影片生成模型 H3 已由 Hailuo AI 登陸 Magnific,使用者可提供最多 9 張圖片控制角色與風格、3 段影片控制動態與攝影機,生成 5 至 15 秒、最高 2K 解析度的影片。MiniMax 另宣布 H3 權重即將開放,社群將可研究模型、進行微調,並在其上建立新的創作工作流程。
57 則值得知道的變化
MiniMax 表示,影片生成模型 H3 已由 Hailuo AI 登陸 Magnific,使用者可提供最多 9 張圖片控制角色與風格、3 段影片控制動態與攝影機,生成 5 至 15 秒、最高 2K 解析度的影片。MiniMax 另宣布 H3 權重即將開放,社群將可研究模型、進行微調,並在其上建立新的創作工作流程。
Google AI 在 X 貼文中回顧近期產品更新,包括 Google DeepMind 的 Gemini Robotics 2,主打將全身智慧帶進機器人;Gemini 3.5 Flash-Lite,定位為最快且最具成本效益、適合高速 AI 代理工作流程的模型;以及 Gemini 3.6 Flash,宣稱能以更少的 token,在各項任務中提供更快且更準確的效能。
Google 撤回前一天在 Google Earth 推出的 AI 影像生成功能。該功能由 Nano Banana 2 驅動,使用者輸入文字提示後,就能以 Google Earth 的衛星、空拍與 3D 影像為基礎,在真實地理位置上生成擬真場景。
Imagine Video 1.5 在上月發布後,新增文字生成影片、影像參考與聲音參考功能,並支援原生 1080p 輸出;官方稱其動態與聲音表現更逼真。該模型已正式開放於 xAI API,模型識別名稱為「grok-imagine-video-1.5」。
據《AI 科技評論》報導,Boogu-Image-0.1 在 Qwen-Image-Bench 取得 53.58 分,超過 20B 的 Qwen-Image-2512(52.06)與 80B 的 Hunyuan-Image-3.0(50.81),以不到對手一半、甚至八分之一的參數規模實現跑分反超。
Reddit r/LocalLLaMA 貼文稱,audio.cpp 0.5 已發布,新增 DramaBox、Confucius4-TTS、RVC、BS-RoFormer、GLM-TTS、Kroko ASR、Parakeet-TDT、Inflect Micro v2 與 Fun-ASR-Nano 等模型或功能;官方目前尚未證實這項發布。
36Kr 報導,曾愛玲已加入哔哩哔哩(B站),擔任 AI 視頻生成業務負責人,直接向 CEO 陳睿匯報;B站未回應 36Kr 的求證。B站此前公開表示,AI 投入主要聚焦視頻理解、視頻推薦與輔助視頻創作,曾愛玲加入後可能參與相關業務。
據報導,Meta 近期在蘋果 App Store 低調上架 iPhone 應用程式「StoryKit: personalized stories」,目前僅限墨西哥 App Store 下載,尚未進入美國等主要市場。StoryKit 可利用 AI 生成客製化兒童故事,並同步產生插圖、語音旁白與原創音樂。