DeepSeek 發布 552B 多模態模型 V4.1-Flash:輸入僅啟動 8B 參數,KV Cache 縮減至前代四分之一並下調 API 定價
新模型支援百萬 Token 上下文,程式能力追平 OpenAI,但科學與影像分析較弱;API 已上線並計畫淘汰 V4 Pro。
HF Trending綜合 4 家一手來源
69 則值得知道的變化
新模型支援百萬 Token 上下文,程式能力追平 OpenAI,但科學與影像分析較弱;API 已上線並計畫淘汰 V4 Pro。
該模型已應用於 ChatGPT,開發者可依需求搭配不同後端模型,定價為每分鐘 0.05 美元,Yelp 已將其用於電話訂位服務。
除晶片合作取得進展,OpenAI 亦呼籲美國建立強制性安全規範,並於 10 月起提供 GPT-6 Astra 等模型供政府半價使用。
GPT-6 Astra 帶來空前系統負載,OpenAI 宣布暫停 Pro 方案新註冊,既有用戶、其他方案與 API 存取皆不受影響。
該功能目前在 Kubernetes 叢集開放公開預覽,採次小時計費,適合微調與批次推論等可中斷任務,未來將支援 Slurm。
AI 晶片新創 d-Matrix 指出,Token 跌價正對 GPU 推論經濟造成壓力,恐促使資料中心重新評估運算與記憶體資源的負載分配。