FLUX 3跨足影音與機器人
Black Forest Labs表示,相較於生成圖片的FLUX 1與FLUX 2,FLUX 3是從一開始便以圖片、影片及音訊聯合訓練的多模態基礎模型,可共同生成影音內容。mimic robotics取得早期版本使用權後,雙方開發出影片—動作模型FLUX-mimic,並已在Audi測試及部署的機器人上運行。
Hacker News綜合 2 家
22 則值得知道的變化
Black Forest Labs表示,相較於生成圖片的FLUX 1與FLUX 2,FLUX 3是從一開始便以圖片、影片及音訊聯合訓練的多模態基礎模型,可共同生成影音內容。mimic robotics取得早期版本使用權後,雙方開發出影片—動作模型FLUX-mimic,並已在Audi測試及部署的機器人上運行。
據報導,OpenAI 與 Anthropic 同日更新語音功能:ChatGPT Voice 登上 macOS、Windows 桌面端,Claude Voice 則升級模型支援並加入工具呼叫能力。GPT-Live 可透過語音控制電腦及協調多個 AI 代理;Claude 能在語音對話中存取行事曆、電子郵件等已連接工具。