Google 推出 Gemini Omni 1.1 Flash 影片生成模型:支援 4K 輸出、最長可擴展至 40 秒
新模型支援指定首尾影格與 3 秒影片參考以維持一致性,並提供 360p 快速預覽模式,4K 影片生成定價為每秒 0.3 美元。
68 則值得知道的變化
新模型支援指定首尾影格與 3 秒影片參考以維持一致性,並提供 360p 快速預覽模式,4K 影片生成定價為每秒 0.3 美元。
Antigravity 付費方案已開放預覽,系統能讓多個 AI 代理在數天內自主提案與審查,並成功打造出從零啟動作業系統的 RISC-V CPU 模擬器。
該模型完全運行於中國晶片,每百萬 token 輸入定價 0.15 美元;在評測中僅以兩分之差落後 GPT-5.6 Sol,任務成本卻大幅降低 7.4 倍。
新版模型可分析 10 秒前置上下文,提供 360p 草稿模式使生成速度提升 60% 且成本降至三分之一,現已開放 API 呼叫。
模型權重已開源,測試期間由數萬顆中國自研晶片驅動。此次身分揭露也凸顯了匿名模型在資料用途條款上的矛盾與隱私疑慮。
該千億參數模型效能號稱超越 Claude Opus 4.6,並針對辦公場景最佳化,未來千問辦公 95% 任務將由其標準模式處理。
Reddit 論壇 r/LocalLLaMA 預告 GLM-5.3 模型權重將於明日釋出,發文者表示「承諾已兌現」,目前尚無官方公告。
該模型定位為通用基模與具身技能間的「中間層」,內建 100 項工業共性能力,旨在降低二次開發者的後訓練成本與本體適配難度。
該模型透過尺度壓縮記憶與夢境強迫機制解決長任務漂移問題,在桌面雙臂任務評測中以 69.1 分超越 π 0.5 等對手。
新版模型參數擴大 3.5 倍,並導入流式自回歸推理使決策速度提升 300%,單圖靈晶片車型亦將同步獲得 Lite 蒸餾版。
採 Apache-2.0 授權,僅需 5 到 20 秒音訊即可複製聲音,支援英法德及歐洲葡萄牙語,評測表現超越 F5-TTS 等大模型。
該模型具備 5.1B 活躍參數,專為金融檢索、估值建模與財報準備設計,並在多項金融與試算表基準測試中表現優異。