模型發布
MiniMax H3主打開源影片剪輯
量子位
據量子位報導,MiniMax 發布首個開源影片模型 MiniMax H3,主打文字、圖片、音訊與影片的全模態理解,以及端到端剪輯、特效、字幕與音畫協同。文章稱,H3 可生成最高 2K 影片,並具備可商用文字生成與較低推論價格,底層採用 H3-Omni Transformer。相關能力、評測排名與商用表現目前僅有單一來源描述,仍待更多佐證。
讀原始報導背景
MiniMax Group 是一家位於中國上海的人工智慧公司,開發多模態 AI 模型與消費者應用,旗下包括影片生成服務 Hailuo AI。MiniMax H3 支援圖片、影片與音訊輸入,定位為多模態 AI 影片生成器,讓不同媒體素材都能成為生成影片時的上下文。
來源
- X @MiniMax_AInitter.net
- X @MiniMax_AInitter.net
- 中央社 科技cna.com.tw
- en.wikipedia.org
- minimaxh3.ai