跳到主要內容
2026-09-23 日報
模型發布

阿里發布 Qwen-Image-3.1 與 Happy Shrimp 1.1,並推出 Agentic PE 影片創作引擎

AI 前線單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據報導,阿里巴巴於雲棲大會發布多款多模態生成模型,包含圖像模型 Qwen-Image-3.1、音樂模型 Happy Shrimp 1.1,以及面向長影片創作的 Agentic PE(智能體式創作引擎),並預告將於今年 11 月發布新一代影片生成模型。 Qwen-Image-3.1 針對科研圖示、行銷與電影分鏡等場景,提供「點、線、面、體、場」五個維度的編輯能力,分別對應像素錨定、結構勾勒、版面建構、角色塑造與世界營造,並可同時處理中文標題、圖示與段落排版。 Happy Shrimp 1.1 引入音樂審美建模與強化學習,覆蓋百餘種曲風與十餘種主流語言。該模型支援多模態參考、局部編輯與多輪創作,允許使用者在保留特定旋律時替換編曲風格與音色,或僅針對副歌鼓組進行局部修改。 針對長影片創作,阿里提出 Agentic PE 輔助生成體系。該引擎可呼叫工具建構空間佈局、運動軌跡、人物姿態、深度資訊與相機幾何等多模態條件,並在生成過程中持續更新條件與重複使用素材,以支援長影片與即時串流生成。 此外,阿里淘天集團首席科學家鄭波預估,三年內將出現原生全模態統一模型。大會亦揭露,導演陸川使用阿里多模態模型,將過去需數月製作的歷史短片縮短至 5 天完成;而 Wan 2.6 已支援智慧分鏡調度與多角色一致性,今年 4 月推出的 Happy Horse 1.0 則採用單流 Transformer 原生聯合生成音訊與影片。
讀原始報導