inclusionAI 發布 9B 視聽互動模型 Realtime-Venus,支援全雙工對話與主動互動該系統基於 MiniCPM-o 4.5 改編,具備免訓練長影片記憶與非同步工具委派功能,能在共享時間線上同時處理視聽輸入並生成文字與語音。Reddit r/LocalLLaMA單一來源
傳 Figure AI 發布 Helix 2.5 視覺語言模型,展示機器人於未見過家庭環境的泛化能力該模型以數百萬筆家務工作範例進行訓練,並附帶長達四小時的實測影片,展示機器人在各種家庭環境中執行任務的表現。Reddit r/singularity單一來源
據報 GPT-6 Astra 可自主操作 Blender 製作 3D 影片,Fable 5.1 透過影像與目錄重建數千本實體藏書作者實測指出,模型能以極低 token 消耗完成耗時數週的任務,包含將文字遊戲 Zork 轉為 3D 動作遊戲,並透過瀏覽器操作影片生成工具。One Useful Thing單一來源