xAI 發布 Grok 4.7:定價 2 美元主打長時編碼,第三方評測指代理能力落後 GPT-6
採用更大基礎模型與更長強化學習訓練,官方稱性價比與安全性領先,但獨立評測顯示其代理編碼能力遠不及前沿競品。
Hacker News綜合 3 家一手來源
58 則值得知道的變化
採用更大基礎模型與更長強化學習訓練,官方稱性價比與安全性領先,但獨立評測顯示其代理編碼能力遠不及前沿競品。
該系列主打擴展強化學習算力與 100 萬上下文,支援 3D 空間推理,其中 Flash-RL 版本已上架 Hugging Face。
該模型採依用量計費,逐步開放給 Copilot Pro 至 Enterprise 等方案用戶,可在 VS Code、JetBrains、Xcode 等多種介面切換使用。
該模型支援在單一請求中處理是非、多選與評分問題,4B 與 9B 版本可在 32GB Mac 上運行,9B 版本在新資料來源測試集準確率達 0.852。
該模型以十萬筆鴻蒙數據訓練,號稱千行程式碼錯誤率降低 80%。智能體涵蓋開發全流程,並提供免配置的雲端實踐中心。
該模型具備圖文交錯思維鏈能力,可生成文字精準的視覺內容,目前已上線商湯小浣熊與日日新 API 服務。
該模型已由 Altworld 於 Hugging Face 上架,號稱能產生如真人般的寫作風格,具體細節與實測數據尚未公開。
這款 DiT 架構模型可生成 256x256 解析度影像,官方稱 CPU 推論約需 20 秒,GPU 僅需 2 秒,權重已於 Hugging Face 開放。
社群發現 Hugging Face 出現基於 Qwen 9B 架構蒸餾的 MiMo-V2.6 模型,目前小米官方尚未證實此發布。