OpenAI 推出 Agents API 公測版:基於 Codex 框架,支援跨日長時任務與多代理協作
該服務提供專屬託管沙盒,具備自動壓縮上下文功能以維持長時運行,並與 Cloudflare 等 9 家服務商合作提供多元硬體配置。
69 則值得知道的變化
該服務提供專屬託管沙盒,具備自動壓縮上下文功能以維持長時運行,並與 Cloudflare 等 9 家服務商合作提供多元硬體配置。
GPT-6 Astra 帶來空前系統負載,OpenAI 宣布暫停 Pro 方案新註冊,既有用戶、其他方案與 API 存取皆不受影響。
配合新模型發布,曾與馬斯克共事七年的 OpenAI 工程師趙迪釋出封存三個月的對談,探討基礎設施、世界模型與智能平權。
該功能目前在 Kubernetes 叢集開放公開預覽,採次小時計費,適合微調與批次推論等可中斷任務,未來將支援 Slurm。
預計 2027 至 2028 年在哈米納等四地擴建,並部署 94 MW 儲能系統與 629 MW 併網風電,為其歐洲最大單筆投資。
Mistral 模型將整合至 Cloudera 平台,讓企業能在地端或完全實體隔離環境中,利用專有資料訓練並部署客製化模型,實現主權 AI。
系統將整合 Vera CPU 與 Spectrum-X 網路,採用模組化無線纜托盤,讓 d-Matrix 快速部署液冷低延遲推論節點。
建立在預覽版基礎上,開發者部署應用程式時無需手動設定,並新增自動預覽部署功能,將測試環境與正式商業資料隔離以確保安全。
AI 晶片新創 d-Matrix 指出,Token 跌價正對 GPU 推論經濟造成壓力,恐促使資料中心重新評估運算與記憶體資源的負載分配。
新模型已具備完善推論能力,添加「盡可能詳盡」等提示詞反會導致重複執行任務與不必要的搜尋,建議移除微調指令僅留硬性限制。
該引擎透過預測性專家串流技術,在 M4 MacBook Air 達到 8-22 tokens/s 速度;若 SSD 讀取不及,可動態降級載入 Q3/Q2 量化版本。