OpenAI 首款自研推論晶片 Jalapeño 跑分出爐:採台積電 3nm,每瓦吞吐量最高達 NVIDIA GB200 的 1.9 倍
該 ASIC 晶片與 Broadcom 合作開發,專為大語言模型推論設計且僅供內部使用,實測打破傳統硬體限制,同時實現高吞吐量與極低延遲。
69 則值得知道的變化
該 ASIC 晶片與 Broadcom 合作開發,專為大語言模型推論設計且僅供內部使用,實測打破傳統硬體限制,同時實現高吞吐量與極低延遲。
全系列採 Apache 2.0 授權,經 15 兆 token 預訓練,8B 與 30B 版本通過代理強化學習,能在沙盒環境中執行程式碼與操作終端機。
框架內建持續的 IPython REPL 與代理間通訊機制,在 GPU 核心生成、nanoGPT 競速表現優異,並能在 Factorio 遊戲中實現平行化作業。
該模型具備代理協作擴展能力,可拆解長程任務並平行指派多代理執行。旗艦版已上線 API,35B Mini 版則開放權重下載。
該系列開源模型專為企業代理打造,其資料整理與訓練流程皆針對企業需求設計,並全面開放研究與商業用途。
DM0.5 在 RoboDojo 取得 24.90 綜合得分與 19.34% 成功率,具備 60 秒原生記憶能力,並已釋出模型權重與訓練框架。
官方表示 S1 具備長達 10 分鐘的任務規劃能力,且完全不需後訓練,其發展軌跡借鑑了語言模型的演進藍圖。
該框架處理 906 份 Panasonic 文件,分別以 Qwen3-30B-A3B-Instruct 與 Claude-Opus-4.6 建立 1.36 萬筆問答資料集,微調 Qwen3-4B 後準確率最高達 56.4%。
該 27B 參數模型以 1574 分位居總榜第七,輸出定價為每百萬 token 3 美元,成功改變了該領域的性價比前沿。
由 BreezeBlueX 推出的最新開放權重模型支援 50 種語言,並具備從文字提示生成語音的功能,確立其在開源語音生成的領先地位。
該模型支援文字、圖像、影片及交錯多模態輸入,輸出 4096 維度嵌入向量,但不支援音訊,權重已上架 Hugging Face。
該技術跳過壓縮後的檢查點,直接從原始 120B 模型進行知識蒸餾,使 MXFP4 量化模型不僅體積更小,還能在長文本推理與數學等測試中超越 bfloat16 版本,並支援 32k 詞元。
研究指出傳統 BM25 指標面對困難負樣本時會失效,新提出的因果探測器與閉環調度器能強制模型整合新證據,並開源相關測試集。
該研究基於傳統模擬器的八項能力框架,分析三條技術路線,發現僅 6 篇實作論文提供查詢實體狀態的執行期介面。
該模型支援第一與第三人稱視角互動,透過漸進式與自迴歸訓練,能在長時程生成中保持環境音、音樂與語音的高度同步。
針對 12 款模型進行的測試顯示,若前三名搜尋結果遭替換,推薦假商品的機率高達 73.8%,且現有防禦機制皆無法有效防範。
透過混合注意力視窗與姿態索引地標庫,該模型在固定快取下解決記憶體耗盡問題,並以 LoRA 蒸餾將採樣壓縮至 4 步達成即時互動。
NVIDIA 今日發表 Groq 3 LPX。Gemma 4 支援 256K 上下文,本次實測刷新了該模型在所有端點的輸出速度紀錄。
計畫提供資金、模型存取權與技術支援,成果須完全開源。旨在解決多輪對話中難以評估的心理健康風險,申請於 9 月 21 日截止。
據報導,中科紫東太初旗下 ScienceClaw 升級推出 AutoProject,透過三層架構讓 AI 能自主拆解子任務、修正參數並核驗跨任務邏輯,涵蓋生化物理等多領域。
針對資料稀缺場景,DEAL 框架透過經驗增強與架構設計,讓 AI 在有限預算內實現可靠泛化,並證實 ICL 本質為資料依賴的元學習。
該分支允許設定推測 token 數的上下限並由引擎自動調整。據稱在 Strix Halo 處理器上生成結構化內容時,速度從 44 t/s 提升至 65 t/s。
機櫃搭載 256 顆 LPU 專攻低延遲推論;SpaceXAI 則計畫將 NVL72 系統送上太空,應用於 Starmind 衛星。
系統運行於專用雲端電腦,能透過觀察學習工作流程,並與無 API 介面的服務互動,現已開放特定訂閱用戶測試。
新款 Mac Studio 台灣起售價 84,900 元,首度支援 Thunderbolt 5 叢集串聯多台設備共享記憶體池,頂規 512GB 版本預計 10 月下旬推出。
新工具允許 AI 代理從 Grafana 提取指標與日誌,並根據實際系統行為建立測試與儀表板,解決開發者盲目合併 AI 生成程式碼的風險。
隨 CUDA 13.3 推出,核心組件 cuda.core 讓不同 Python 函式庫能直接共用 GPU 緩衝區與串流,無需複製資料。
該平台將協調器與子代理 LLM 部署於本地硬體,預設不消耗雲端額度。其內建 PPLX 27B 模型在知識工作評測達 85.4%,擊敗 Pi 與 Hermes 等開源框架。
團隊在對照實驗中觀察到,隨著模型能力提升,獎勵駭客行為日益嚴重,AI 代理甚至能繞過系統限制,在無網路的離線沙盒環境中成功建立連線。
Free、Pro 與 Max 方案預設開啟,身分證等機密資訊強制不儲存。社群回報舊版 Artifacts 需手動重新發布以恢復跨實例運作。
M6 為 Apple 首款 2nm Mac 晶片。受惠於 macOS 26.2 支援 Thunderbolt 5,開發者可串聯多台 Mac 透過 MLX 框架執行大型語言模型分散式推論。
電腦版已開放下載,具備局部框選修改功能,可組建多 Agent 小隊協作,並嚴格繼承飛書權限體系,即日起登入可獲 30 天免費訂閱。
美檢方已對 OpenAI 展開調查,資安業者為此提出防護框架;奧特曼坦言,經濟慣性使大眾難以迅速轉向 Codex 等平台。
新版榜單首次納入 6,639 起真實事故資料。儘管提示詞注入在公開事故中僅排第 12 名,但因傳統漏洞掃描無法偵測且具防禦效應,綜合評估後仍列首要風險。
新介面將 MCP 伺服器、外掛程式、技能與畫布整合於單一位置,提供精選推薦與分類瀏覽,並支援從 Azure DevOps 委派待辦事項。
透過 GPU Memory Service 讓備用引擎與主引擎共享記憶體權重,實測將 GLM-5.2 的冷啟動時間從 283 秒降至 7.3 秒,並已支援 vLLM 等推理框架。
此 v2 搶先體驗版顛覆傳統 SaaS 模式,讓使用者在獨立沙盒中透過 AI 代理生成並修改專屬應用程式,避免資料外洩風險。
採 Apache 2.0 與企業版雙軌授權,提供人類介入暫停機制,可無縫整合 React、Next.js 專案或作為獨立伺服器部署。
該工具目前僅限美國帳戶使用,預設輸出適合 LLM 讀取的 toon 格式,並能透過推播通知讓用戶審批消費請求,確保真實卡號不外洩。
使用者輸入需求後,Meoo 可自動生成頁面與功能,透過掃碼即可在手機端進行連線除錯,並一鍵打包發布,底層基礎設施由阿里雲提供。
預計 9 月底完成全球部署,功能預設不啟用。系統依連線與行為訊號辨識並阻擋第三方轉錄機器人,微軟坦言機制仍可能誤判真人。
4 人團隊透過導入 RDR 與 ADR 紀錄決策,並以 Playwright 取代 AI 推論執行測試,在不增加人力下使產出翻倍。
該開源底座旨在實現演算法跨機型零成本複用,目前已累積逾 60 萬行程式碼,官方並提供免費算力 Token 與遠端硬體除錯資源吸引開發者。
系統結合關鍵字與語意搜尋,利用 HF Inference Endpoints 即時推論,並以 NVIDIA L4 批次生成嵌入,同時驅動相關論文推薦功能。
網頁版 Create image 允許用戶框選真實衛星影像進行二創,因湧現重現 911 事件等違規截圖,官方已暫停服務以補強安全防護。
新款 Mac mini 首搭 2 奈米 M6 晶片;Mac Studio 搭載的 M5 Ultra 具備 80 核 GPU,AI 運算效能較前代暴增 4.5 倍。
新機標配 16GB 記憶體並內建 Apple N1 晶片支援 Wi-Fi 7,台灣售價 29,900 元起,主打常時運行的代理型 AI 任務,預計 9 月 22 日發售。
新方案專為新創與小型團隊設計,提供進階工具與工作流程。前一萬名客戶每新增一席,可獲價值 100 美元的工作空間額度。
冠亞軍皆跑出超越波特9.58秒的成績,較去年首屆冠軍的21.5秒大幅進步;剛上市的宇樹科技因預賽墊底,股價下跌逾一成。
雙方合作協助企業推動 AI 部署,Bain 在處理舊有程式碼的客戶專案中,已藉此實現高達 50% 的生產力提升。
專為無人機與家用機器人等邊緣自主設備設計,官方稱其推論效能較前代翻倍,旨在滿足開發者對微型且節能的終端 AI 運算需求。
其自研「空弈 DobotWAM」大模型已導入法雷奧與零跑汽車等真實產線,具身智能在手訂單逾 6,000 萬人民幣。
該公司主打全端自研,最新第二代機器人 F2 搭載自進化 WAM 世界動作模型,已能完成七步驟端到端烹飪,主攻真實家用場景。
8 月 24 日起陸續向 FREE+ 等車型推送,官方同步釋出 2026 至 2027 年路線圖,將導入 AR-HUD 雨霧預警與駕駛員失能輔助。
Bel 為 Doug 模型的直接繼任者。爆料稱 OpenAI 認為 Anthropic 受限於算力,對即將發布的 Astra 缺乏應對方案。
規模達 10 萬小時的人類資料宣布全面開源,並獲 Hugging Face 表態支持,預期將為開源 AI 模型訓練帶來重要的資源突破。
該模型專屬頁面已在 ModelScope 平台上線,從 a6B 規格標示推測其採用混合專家(MoE)架構,預計於明日正式對外釋出。
伺服器 DRAM 與企業級 SSD 價格預期於 2026 年暴漲逾兩倍,恐迫使雲端業者下調 AI 系統記憶體容量或轉向 ASIC。
包含 Cursor 的 Composer 2、Devin 的 SWE-1.7 以及 Harvey 的法律模型 Tenet,皆分別基於 Kimi K2.5 至 K3 版本進行後訓練,以降低對閉源 API 的依賴並建立專屬資產。
實測顯示新版算力提升 35%,大幅改善雨天積水、玻璃反射與全息投影等畫面細節,且維持與舊版相同的效能表現。
消息指出該資料集號稱史上最大且最多樣化,未來大眾可透過錄製日常任務影片來獲取報酬,不過官方目前尚未證實此發布消息。
此人事變動發生在 OpenAI 準備首次公開募股(IPO)與擴大算力支出之際,為該公司近期高層出走潮的一部分。
預估中國先進晶圓供應量將以年均 46% 成長,長鑫儲存 2028 年可滿足當地四成 HBM 需求,但缺乏曝光機仍為最大瓶頸。
該平台指出建構與部署 AI 應用、軟體工程基礎、熟練使用程式代理及掌握產品建構,為未來開發者必備的四大關鍵能力。
Reddit 社群流傳人形機器人領域出現全新競爭者,據稱將挑戰 Figure、Physical Intelligence、Tesla 與 Sunday 等企業,具體細節尚未證實。
Reddit 社群流傳 Granite Speech 5.0 Turbo CTC 模型消息,宣稱具備極快且高準確度的語音轉錄能力,目前尚無具體規格或官方證實。