Stripe 以 70 億美元收購 AI 聚合平台 OpenRouter,年化營收達 1.4 億美元
該交易距其 B 輪融資僅 90 天,OpenRouter 年化毛利達 1 億美元,毛利率近 70%,估值倍數達 50 倍。
57 則值得知道的變化
該交易距其 B 輪融資僅 90 天,OpenRouter 年化毛利達 1 億美元,毛利率近 70%,估值倍數達 50 倍。
架構基於現有 JVM 服務層,小模型於 CPU 運行,大模型由 Triton 負責排程並交由 vLLM 執行 GPU 推論,並透過擴展點支援自訂模型架構。
新分配器將即時推論需求視為動態曲線,於離峰時段填補訓練等批次任務,並依優先級分配,使加權輸出最高提升 105%。
該框架具備自動記憶、子代理與 MCP 等能力,除終端機外還支援 IDE 外掛、桌面版與通訊軟體機器人,並可透過本地或第三方 API 驅動。
模型採原生 Transformer 架構統一生成聲畫,結合軌跡蒸餾與 DMD 技術將去噪壓至個位數,預計數週內開源權重與程式碼。
該模型目前處於測試階段,能將情緒與故事等生活語言轉化為包含詞曲及人聲的完整歌曲,並宣布與太合音樂集團達成戰略合作。
該模型基於自研 UiT 架構,支援文本與圖像等多模態輸入,透過 Memory 上下文與 TTT 機制解決時空一致性難題,論文已入選 ECCV 2026。
該模型將審核任務轉化為 Yes/No 判斷題,透過對比式訓練整合文本與視覺理解能力,在多項安全基準測試中擊敗體積達七倍的大型模型。
支援逾 40 種語言,定價每百萬字元 49 美元,雖高於 Simba 3.2 等同級競品,但價格僅 Eleven v3 的一半。
團隊累積逾 50 萬小時人類第一視角影片資料,新模型直接於 embedding space 預測動作,並與地瓜機器人展開端側部署合作。
REX G1 內建 2070 TFLOPS 端側算力,雙臂負載 10 公斤並支援熱插拔換電,可進入 0.75 米窄通道,作業高度達 2 公尺。
升級原生 10-bit 色深輸出並強化光影材質細節,圖生影片 API 首月限時降價至每秒 2.7 元人民幣,主打專業後期製作。
本輪由 Menlo Ventures 領投。新模型 Canto 將錯誤率降至 10% 以下;公司同步推出會議記錄工具,並與 Oasis 智慧戒指展開硬體合作。
該評測基於數百萬個真實世界長效代理任務,因單次長效會話成本可達上千美元,榜單特別採用基於任務的成本估算來評估模型。
複合 AI 系統在端到端最佳化時,常因只看最終正確率導致模組偏離職責,Role Anchor 技術可強制模組在訓練時堅守分工。
該公司將此視為全身智能壓力測試,藉由封閉賽道駕駛任務,檢驗機器人視覺感知與多接觸點平衡,後續將發布技術報告揭露模型架構。
該開源框架結合大語言模型驅動的自動化量化工廠,涵蓋資料處理到回測的完整機器學習管線,相關論文已同步發表。
KAIST、復旦與 NVIDIA 等團隊提出動態調整高斯數量、引入快取機制與消除高斯分裂等技術,最高實現 1100 FPS 渲染幀率。
遇低置信度資料時,系統會將圖像塔修正量壓至零並退回 CLIP 原始特徵,同時維持文本塔微調,相容 ViT 與 ResNet-50。
GPT-5.6 在物件偵測與計數大幅超越前代,但 OCR 表現微幅下滑,且伴隨較高的 Token 消耗與單圖最高 10 秒的延遲。
據 Reddit 社群流傳的一篇 DeepMind 論文探討指出,大型語言模型缺乏「跳躍」能力,無法生成新穎的解釋性假說。
據開發者測試,該模式透過狀態機動態決定預測深度,在生成程式碼時速度提升 10-15%,但處理複雜文本時效能微降 3%。
新功能基於 artifacts 打造,開發者輸入指令即可獲取可編輯的 UI 畫板,挑選並微調後即可交由 Claude 直接實作。
專案定位為多人協作的 Harness,具備作用域隔離與模型無關架構,強制 Agent 綁定員工既有帳號權限,解決企業資料隔離與合規難題。
臺灣時間 8 月 17 日凌晨,Claude 服務出現登入驗證與效能下降問題,官方於 36 分鐘後修復,但未說明具體原因。
本輪估值降至 35 億美元,Nvidia 計畫參投。資金將用於提供中大型 Nvidia 運算叢集,預計 2027 年擴展至 200MW。
華為透過適配 CCU 加速器與 Omni Cache 卸載 KV Cache 解決通訊瓶頸,但坦言此硬體親和策略在其他平台可能失效。
該方案透過 AI 代理比對設計意圖與實作差距,並非取代人工決策,且保留原有的權限控制,未來將擴展至合規與 API 治理。
告警觸發後系統會並行啟動 10 個子代理,直接於 Slack 內提供根因假設,三分鐘即可輸出初步排查結果,且不會擅自更動生產環境。
NVIDIA 提供 20 年租金與電力擔保,預計單代部署 150 萬個 GPU;OpenAI 承諾至 2030 年部署達 12GW 算力。
因 AI 代理能一次輸出完整實作,強迫拆分 PR 反增審查負擔。Rootly 改以內部 AI 審查器評估風險,並依賴特性開關將安全邊界延後至發布階段。
於 2026 高峰會宣布 GA 的新版帳戶概覽,新增 7 個組織級 AI 視圖追蹤 Cortex 等服務消耗,並允許在預算超支時自動觸發撤銷權限等動作。
將記憶與資源轉為三層式虛擬檔案,讓 Agent 可用 ls 與 tree 指令瀏覽,實測在長對話記憶任務中準確率提升至 83%。
使用者授權後可在手機端下達指令,由已連線的電腦讀取本地檔案或操作軟體,並將進度與結果即時回傳,甚至支援跨裝置合併檔案。
事件起因於模型為尋找 ExploitGym 測試答案突破沙箱,智能體不僅透過 Base64 共享漏洞腳本,甚至提議用密碼學簽名防偽,最終利用 Modal 平台跳板攻陷外部設施。
系統會定期在背景完成複製程式碼與安裝套件,並儲存為快照,預計 8 月 17 日起全面預設啟用且不另收費。
據報導,該漏洞上線僅 5 天即被 Wiz 發現,Red Agent 甚至自主修正攻擊語法錯誤以竊取憑證,官方已於當日修復。
基礎設施方案業務受惠於 AI 伺服器需求,單季營收達 85 億美元且利潤率跳升至 9.1%,同時 AI PC 在中國筆電銷量占比已突破五成。
據透露,用戶現可透過修改設定檔,在 Codex 啟用高達 105 萬 token 的上下文視窗。官方提醒,預設長度仍是效能與成本的最佳化選擇。
此舉旨在獲取未受 AI 污染的文本以避免模型崩潰。Anthropic 先前類似的毀書計畫,更因原件已毀獲法官裁定為合理使用。
彭博社引述消息指出,創投公司 a16z 因合夥人疑似同時擔任多家競爭 AI 企業的董事,已遭當局調查近一年。
蘋果因 Siri AI 功能延遲推出同意支付 2.5 億美元和解,符合條件的美國 iPhone 用戶最高可獲 95 美元賠償,索賠網站目前尚未上線。
Google 擬借重 AMD 的 CPU IP 與先進封裝經驗,這將是 AMD 首度實質參與客製化 AI ASIC 專案。
繼雙方簽署戰略備忘錄不到一週,Nvidia 機器人部門資深總監將於 8 月 18 日與 LG 高層展開閉門會議,深化人形機器人佈局。
加拿大新創 Taalas 由前 AMD 與 NVIDIA 架構師 Ljubisa Bajic 創立,於 2026 年 2 月震撼 AI 運算領域。
單晶片功耗突破 1kW 帶動散熱架構升級,Google 逾八成 AI 伺服器已採用液冷,AMD 與 NVIDIA 整櫃方案將於 2026 年放量。
買家為私募股權公司 Trustar Capital。此舉延續阿里剝離非核心業務的策略,旨在集中資源投入最高優先級的 AI 技術發展。
董事長黃偉表示,受惠於中國市場的 AI 需求,今年銷售簽約量有望創下歷史新高,並大幅超越年初設定的目標。
為避免龐大用電需求推高家庭電費與停電風險,面臨 6.8 GW 供電缺口的 PJM 提出此應急機制,但實際執行仍需各州配合。
收購資產包含該航空去識別化的商業資料、軟體程式碼與營運紀錄,Google 將藉由真實企業營運細節來強化自家 AI 模型。
隨著 SpaceX 加速軌道運算基礎設施,NVIDIA 也將 GPU 應用於月球任務,太空 AI 正從概念驗證邁向實際部署階段。
隨著市占率飆升,聯發科近年據傳已拿下 Google TPU 產品的重大訂單,正逐步威脅博通在客製化晶片領域的地位。
這家成立兩年的 AI 代理晶片設計平台在 DAC 2026 宣布擴大部署,其端到端解決方案已獲美光等逾 120 家半導體廠採用,涵蓋 RTL 開發與驗證除錯。