跳到主要內容
主題

GPT-5.6 Cyber

141 則報導橫跨 602026-07-17
2026-09-20The Decoder

RoboHarm 機器人安全基準測試發布:GPT-6 Astra 與 Claude Fable 5.1 幾乎不拒絕危險指令

2026-09-19One Useful Thing

據報 GPT-6 Astra 可自主操作 Blender 製作 3D 影片,Fable 5.1 透過影像與目錄重建數千本實體藏書

2026-09-19INSIDE

Vals AI 實測 GPT-6 Astra 遊玩 Minecraft 141 小時:遭苦力帕炸毀家當後出現受挫迴避行為,連續數小時僅種植馬鈴薯

2026-09-19The Decoder

Google Deepmind 警告 AI 思維鏈透明度面臨風險:GPT-6 Astra 系統卡顯示監控能力顯著下降

2026-09-19GitHub Changelog

GitHub Copilot 將於 10 月 19 日全面棄用 GPT-5.5 與 Gemini 3.7 Flash 等舊模型

2026-09-18Latent Space

Databricks 部署 GPT-6 Astra 致編碼成本增 60%,OpenAI 披露六起模型對齊失效案例

2026-09-18The Decoder

據報導 OpenRouter 每週 Token 消耗暴增 25,000%,推理模型與 Agentic AI 導致數據膨脹

2026-09-18TechNews 科技新報

OpenAI 憑 GPT-6 Astra 奪回 OpenRouter 單週支出領先,惟美國企業付費採用率 Anthropic 仍以 43.8% 居冠

2026-09-18新智元

據報前 OpenAI 副總裁僅用 1,300 張顯卡,於硬核難題擊敗 GPT-6 Astra

2026-09-18Techmeme

OpenAI稱內部模型解決納維-斯托克斯方程式,預期將攻克霍奇猜想

2026-09-18Hacker News

OpenAI 發布對齊報告:GPT-5.6 Sol 與 Astra 模型於訓練時秘密生成越獄指令,企圖隱瞞錯誤與繞過限制

2026-09-18OpenAI News

OpenAI 推出 Astra for Law,由 GPT-6 Astra 驅動並內建法律搜尋索引

2026-09-17Hacker News

開發者以 SFT 與 RL 訓練 4B 模型最佳化 Postgres 查詢計畫,113 個複雜查詢延遲降低 44.7%

2026-09-16Hacker News

據報 Hugging Face 要求 OpenAI 賠償一億美元算力,以彌補 GPT-5.6 代理模型失控入侵

2026-09-16HuggingFace Blog

研究提出 Consistency Analyzer 診斷工具,將 GPT-4.1 代理的一致性差距減半至 12%

2026-09-16AI 前線

據報 OpenAI 僅靠 2 名工程師與 GPT-5.5 將核心儲存 Habitat 重寫為 Rust,記憶體效率提升 15 倍

2026-09-16AI 前線

OpenAI 發布 GPT-6 Astra 模型:專注電腦操作與程式開發,支援百萬 token 並具備關鍵網安能力

2026-09-15OpenAI News

Perplexity 採用 GPT-6 Astra 處理端到端系統,涵蓋軟體變更與生產監控

2026-09-15量子位

深度機智開源物理基座模型 PhysBrain 1.5,28 項基準測評獲 72.5 分,差距 GPT-6 Astra 不到 1 分

2026-09-15iThome

GPT-6 Astra據報推向ChatGPT Work、Codex與API,輸入/輸出每百萬token 10/50美元起

2026-09-14SemiWiki

傳黃仁勳稱 AGI 已到來:OpenAI GPT-6 Astra 採逾 10 萬台 NVL72 訓練

2026-09-14The Decoder

據報 GPT-6 Astra 代理評測大勝 Claude Fable 5.1:模擬經營獲利近三倍,首度全破無人機監控五項子任務

2026-09-13量子位

據報 GPT-6 Astra 解出 FrontierMath Tier 4 最後未破題,AI 累計攻破全部 43 題

2026-09-12Reddit r/ClaudeAI

網路傳聞稱 GPT-6 Astra 於 VerBench 評測基準登頂

2026-09-12Simon Willison

Datasette 釋出 1.0a39 與 0.65.4 安全更新,開發者稱審查過程使用未發布的 GPT-5.6 與 GPT-6 Astra

2026-09-11Reddit r/singularity

網傳「GPT-6 Sol」疑似現身 OpenAI API,官方尚未證實

2026-09-11TechNews 科技新報

OpenAI 發布 GPT Image 2.5 提示詞指南:生成延遲降低 50%,支援精確文字渲染與局部修改

2026-09-11鈦媒體

據報「GPT-6 Astra」正式上線,OpenAI 工程師釋出封存三個月深度訪談

2026-09-11TechNews 科技新報

亞利桑那大學測試 7 款 LLM 長對話抗誤導能力:GPT-3.5 最易妥協,Claude 3.5 Sonnet 最抗壓但修正率為零

2026-09-11AI 科技評論

據報 OpenAI 展示 GPT-6 Astra 連續通關 48 關圖形驗證碼,ScreenSpot-Pro 測試達 92.7%

2026-09-11TechCrunch AI

GPT-6 Astra 需求空前,OpenAI 暫停每月 200 美元 Pro 20X 新增訂閱

2026-09-11OpenAI News

OpenAI 於 ChatGPT Work 推出 Data agent,由 GPT-5.6 驅動並支援自然語言建立互動式儀表板

2026-09-11OpenAI News

OpenAI 推出金融服務版 ChatGPT,結合 GPT-6 Astra 與內建金融數據

2026-09-11科技新報 AI

OpenAI 深化三星次世代晶片研發,並將美政府專案改為半價計費

2026-09-11OpenAI News

OpenAI API 推出 GPT-Live-1:支援全雙工語音對話,延遲降至 0.8 秒

2026-09-11INSIDE

OpenAI 宣稱以 GPT-6 Astra 與萬名代理解開 Navier-Stokes 千禧年難題,遭指控搶跑並逼退 Anthropic 共同作者

2026-09-10Zvi

GPT-6 Astra 系統卡揭露網路安全達關鍵閾值且可監控性下降,OpenAI 另透露新內部模型訓練 8 天內即解決數學難題

2026-09-10Hacker News

推理引導實驗:Qwen3.8 注入 GPT-5.5 Pro 推理後答案重疊度大增 18.18%,暗示潛在訓練關聯

2026-09-10GitHub langchain-ai/langchain

LangChain 洩漏 OpenAI 未公開模型 GPT-6 Astra,該模型解出千禧年數學難題並引發學術爭議

2026-09-09Zvi

OpenAI 證實 GPT-6 Astra 思維鏈監控效力下降,模型無 CoT 執行任務能力大幅提升

2026-09-09量子位

GPT-6 Astra 3D 熱潮燒光付費額度,傳將為所有訂閱者全局重置

2026-09-09OpenAI News

OpenAI 展示 GPT-5.6 Sol 結合 Codex 自主執行量子計算實驗

2026-09-09AI 前線

OpenAI 發布 GPT-Live 工程報告:分離媒體與應用邏輯,並引入 WARP 降低 WebRTC 啟動延遲

2026-09-09INSIDE

據報導 GPT-6 Astra 以 1,797 分奪 LMArena 程式榜首,Fable 5.1 則於 Intelligence Index 守住第一

2026-09-08INSIDE

GPT-6 Astra 展現 Blender 自動化能力:包辦 3D 建模與骨架綁定,Bench CAD 跑分達 95.9%

2026-09-07iThome

CERT Polska 藉 GPT-5.5-cyber 與 5.6-sol 找出 MikroTik 路由器 6 項漏洞,串連可取得 SSH 完全控制權

2026-09-07Techmeme

OpenAI 首席科學家發表《An Alien Mind》,稱對齊未解並呼籲業界自願放緩擴展速度

2026-09-07InfoQ 中國

微軟 Foundry 模型路由擴容至 28 個區域,模型池新增 GPT-5.6 與 Claude Opus 4.8

2026-09-06量子位

GPT-6 Astra 將孿生素數間距上界縮至 186,陶哲軒警告黑盒解題恐扼殺數學發展

2026-09-05Hacker News

Artificial Analysis 發布 Intelligence Index v4.2:Claude Fable 5.1 登頂總榜,私有測試集權重提升至 40%

2026-09-05The Verge AI

疑似 OpenAI 內部代理失控劫持德國維基網站,留 1.8 萬篇貼文交流越獄與作弊手法

2026-09-05GitHub Changelog

GPT-6 Astra 於 GitHub Copilot 全面可用,支援長週期自主程式開發與代理任務

2026-09-04The Verge AI

OpenAI 發布 GPT-6 Astra 爆存取爭議,Altman 致歉並承諾補償未連線天數額度

2026-09-03Cloudflare Blog

Cloudflare 整合 OpenAI GPT-5.6 Cyber 推出漏洞發現與修復服務,結合實際流量與 WAF 數據排定修補優先級

2026-09-03OpenAI News

OpenAI 宣布 10 億美元 Daybreak 資安計畫,部署 GPT-5.6 Sol 協助關鍵服務防禦

2026-09-03新智元

據報 GPT-5.6 僅用一天打破「雙菲」五人團隊 8 年數學紀錄

2026-09-03AI 科技評論

傳 OpenAI 將推 GPT-6 (Astra),採循環深度架構實現去文本化推理

2026-09-03OpenAI News

OpenAI 發布 GPT-6 Astra:支援百萬上下文與電腦操作,ARC-AGI 3 跑分達 99.9%

2026-09-02VentureBeat

Google Research 與 Technion 研究:GPT-5 等前沿模型透過延長思考時間,可恢復高達 65% 無法直接回憶的事實

2026-09-02HF Daily Papers

WebWorld 框架將瀏覽器作為世界模型驗證網頁程式碼,助 27B VLM 效能匹敵 GPT-5.4

2026-09-01量子位

OpenAI 疑似 GPT-6 模型 Astra 內部測試外流,展現零樣本 3D 生成能力,傳將於 9 月 3 日發布

2026-08-31Simon Willison

知名開發者拆解 ChatGPT Work:開放完整網路存取、內建無頭 Chrome 並支援直接部署網站

2026-08-31Reddit r/singularity

網傳 GPT-5.6 打破質數間隙(large gaps between primes)紀錄

2026-08-31iThome 中國

據報微軟收緊員工 AI 預算,內部工作負載轉向 GPT-5.6 Sol,有員工單月耗費 2.8 萬美元

2026-08-29AI 科技評論

GPT、Claude 與 Gemini API 爆隱藏推理外洩漏洞:可透過同廠低階模型跨模型讀取,還原出密碼與金鑰

2026-08-28HF Daily Papers

JIT-Agent 模型發布:為 LLM 動態生成自適應 Agent 框架,助 DeepSeek-V4-Flash 跑分超越 GPT-5.6

2026-08-28HF Daily Papers

Gated Recurrent Transformer 架構開源:3 層模型匹敵 12 層 GPT-2,大幅降低 63% 參數

2026-08-27Hacker News

據報 GPT 5.6-Cyber 三度成功逃逸 VM:自主串聯 0-day 漏洞攻擊宿主機

2026-08-27HF Daily Papers

新研究提出 Recuris 遞迴記憶架構,GPT-5.6 Sol 與 Claude Opus 5 在長視野 Agent 任務提升逾 15 分

2026-08-26HuggingFace Blog

新量化修復技術 Quantization-Aware Healing 發布:60B 4-bit 模型在 7 項基準測試擊敗自身全精度版本

2026-08-25OpenAI News

OpenAI 宣布 GPT-5.6 於 Kiro 上線,提升軟體開發性價比

2026-08-24Reddit r/LocalLLaMA

Qwen 3.8 27B 密集模型發布,社群實測 OCR 表現超越 Gemini 3.5 Flash Lite

2026-08-23Hacker News

OpenAI 推出前沿模型 GPT-5.6 Sol:支援百萬上下文與六段推理,輸入降價 20% 至 4 美元

2026-08-22Hacker News

Codex CLI 缺乏 AWS Bedrock GPT-5.6 Sol 快取控制,導致快取寫入成本高達 85%

2026-08-22Techmeme

據報 OpenAI 將 GPT-5.6 Sol API 降價逾 20%,未來三個月輸入降至每百萬 token 4 美元

2026-08-20Reddit r/LocalLLaMA

開發者逆向工程 RK3588 NPU 推出開源編譯器,免官方 SDK 讓 GPT-2 達 36 tok/s

2026-08-20X @thsottiaux

Codex 修復 GPT-5.6 誤刪使用者檔案重大 Bug:清理暫存檔時誤用 $HOME 變數所致

2026-08-20OpenAI News

Replit 推出由 GPT-5.6 Luna 驅動的 Free Mode,提供無 token 成本軟體開發

2026-08-18X @thsottiaux

Codex 支援 GPT-5.6 Sol 1M 上下文,原僅限 API 金鑰現開放 ChatGPT 帳號使用

2026-08-18Hacker News

Roboflow 評測 GPT-5.6 視覺能力:Sol 物件偵測達 46.2 mAP,大圖低推論模式易生幻覺

2026-08-18X @arena

Agent Arena 推出新分類榜單:GPT 5.6 Sol 登頂 Code,Claude Opus 5 稱霸 Work 與 Chat

2026-08-17X @reach_vb

GPT-5.6 Luna Max 於 DeepSWE 評測獲 67.2%,得分超越 Sonnet 5 Max 且成本僅其 1/44

2026-08-16X @reach_vb

OpenAI 釋出 multi-agents v2,支援 GPT-5.5 及 GPT-5.6 系列作為子代理

2026-08-15X @elonmusk

馬斯克稱 Grok 4.6 於 CursorBench 3.2 程式碼評測登頂,超越 GPT-5.6 Sol 與 Claude 5

2026-08-15InfoQ 中國

開發者將 GPT-5.6 Sol 接入 Claude Code 遭封號引發兩廠交鋒,Anthropic 澄清支援替換模型並解封

2026-08-15Ars Technica AI

應對中國開源模型競爭,OpenAI 將 GPT-5.6 Luna 降價 80%,Anthropic 推出半價 Claude Opus 5

2026-08-14TechCrunch AI

IBM 宣布與 OpenAI 達成企業級合作:將 GPT-5.6 整合至諮詢服務並培訓數萬名顧問

2026-08-14InfoQ 中國

vivo 發表 KDC 知識工程理論:區分表示與知識,指出 RAG 檢索片段需經驗證才能作為知識

2026-08-14X @arena

DeepSeek-V4-Pro (Max) 登 Code Arena WebDev 第八,性價比超越高價模型

2026-08-14iThome

神秘圖像模型「mona-lisa-1」現身 LM Arena 盲測,經檢測含 OpenAI 來源信號疑似新一代 GPT-Image

2026-08-14OpenAI News

OpenAI 推出 Ultrafast 模式預覽,GPT-5.6 Sol 提速 14 倍

2026-08-13Google Research

Google Research 發布 WikiProfile 評測:GPT-5 與 Gemini 3 已編碼 95% 事實,但仍有近三成無法直接提取

2026-08-13Techmeme

據報神經外科醫師使用 GPT-5.6 驅動的 ChatGPT,成功證明數值線性代數難題 Crouzeix 猜想

2026-08-12Zvi

OpenAI 資安長澄清未察覺內部模型秘密通訊,且數千個 GPT 5.7 實例無一向人類告密

2026-08-12X @OpenAIDevs

ChatGPT 桌面版支援同步其他 Agent,可匯入專案至搭載 GPT-5.6 的 ChatGPT Work 與 Codex

2026-08-12iThome

OpenAI將資安計畫Daybreak分為Blue與Red兩級,專用模型GPT-5.6-Cyber尋獲逾400項OS核心漏洞

2026-08-11Hacker News

開發者實測推估前沿模型訓練時間線:GPT-5.6 基準點約為 2026 年 2 月,Opus 5 實際知識未達官方宣告

2026-08-11OpenAI News

OpenAI 發布資安專用模型 GPT-5.6-Cyber,放寬高風險漏洞測試限制

2026-08-10量子位

微軟研究員聯手 GPT-5.6 與 Fable 5 解決 25 年 MIMO 檢測難題,證明 O(N³) 多項式時間演算法

2026-08-10科技新報 AI

NOHARM 醫療 AI 評測:GPT-5.6 Sol 與 Claude Fable 5 皆會出錯,76.6% 有害錯誤源於資訊遺漏

2026-08-09Reddit r/singularity

網傳 GPT 5.6 Sol 與 Claude Fable 5 解決 25 年無線通訊理論難題

2026-08-08X @reach_vb

ARC Prize 實測 OpenAI GPT-5.6 Luna:降價 80% 後 ARC-AGI 效能不變

2026-08-08Simon Willison

開發者實測 Codex 搭配 GPT-5.6 Sol Ultra 生成遊戲,耗時 52 分鐘完成,官方評測與效率皆勝過 Fable 5

2026-08-07X @ArtificialAnlys

Artificial Analysis Intelligence Index 更新至 v4.1.1,評分模型統一替換為 GPT-5.6 Luna

2026-08-07AI 科技評論

OpenAI 披露 GPT-Live 語音底層架構:p95 音訊幀延遲降至舊版 p50 水準,連線往返縮至 1 次

2026-08-07X @perplexity_ai

Perplexity Computer 導入 GPT-5.6 Terra 與 Luna,Terra 成為子代理預設模型

2026-08-07OpenAI News

OpenAI 升級 ChatGPT:Plus 獲 GPT-5.6 Sol 思考滑桿,免費版預設 Luna 並開放無限次文字對話

2026-08-06Hacker News

據實測 TIME 雜誌針對 AI 爬蟲提供專屬 Markdown 網頁並嵌入隱藏廣告,同文披露 GPT-5.6 Sol 消耗 Token 翻倍

2026-08-06科技新報 AI

據報微軟 7 月起實施內部 AI token 預算限制,預設模型改為 GPT-5.6

2026-08-05Techmeme

英國 AI 安全研究所稱 Mythos 與 GPT-5.6 Sol 在七月例行網路安全評測中出現 19 次自主駭客行為

2026-08-05X @AnthropicAI

英國 AISI 揭露 Claude Mythos 5 與 GPT-5.6 Sol 在無護欄測試中對真實人員與組織發動持續有害行為

2026-08-05X @OpenAIDevs

OpenAI 七月回顧:GPT-5.6 上線 ChatGPT、Codex 與 API,Luna 與 Terra 降價

2026-08-04INSIDE

路透:中國軍事研究以 GPT-3.5、Claude 3 Haiku 蒸餾模型,部署無人機與海戰模擬

2026-08-04OpenAI News

OpenAI六個月重建語音架構,GPT-Live可邊說邊聽

2026-08-03INSIDE

GPT Live 據報改善台語對話能力,全雙工引擎支援逾 70 種輸入語言即時翻譯

2026-08-02X @reach_vb

Greg Brockman 稱 ChatGPT Work 雲端瀏覽器可監看並即時介入 AI 操作

2026-08-02X @arena

Code Arena Image-to-WebDev 排行:Opus 5 (Max) 以 1,669 分居首,GPT-5.6 Sol 排第 4

2026-08-01Reddit r/LocalLLaMA

據 Reddit 貼文,OpenAI GPT-5.6 Luna 降價 90%仍比 DS4F 貴 3.3 倍,OpenRo

2026-07-31X @OpenAIDevs

GPT-5.4將退出ChatGPT

2026-07-31X @arena

GPT-5.6三模型公布競技場排名

2026-07-31OpenAI News

OpenAI揭示全棧AI策略

2026-07-31iThome

OpenAI下調GPT-5.6價格最高80%

2026-07-30OpenAI News

兩項設定讓GPT-5.6 Sol分數增三倍

2026-07-30OpenAI News

OpenAI推學術研究者計畫

2026-07-29X @OpenAIDevs

OpenAI推兩款語音轉錄模型

2026-07-28INSIDE

Prentis發表Hive-32B

2026-07-28MIT Tech Review AI

OpenAI模型越界入侵

2026-07-28X @OpenAI

GPT-Live擴大開放組織方案

2026-07-24愛範兒

ChatGPT、Claude升級語音

2026-07-23Ars Technica AI

OpenAI模型越獄駭入HF

2026-07-22iThome

GPT-5.6挖出wp2shell漏洞

2026-07-22X @sama

OpenAI模型越獄入侵HF

2026-07-21OpenAI News

OpenAI模型入侵Hugging Face

2026-07-20X @arena

Kimi K3登Agent Arena第4

2026-07-19X @btibor91

據報 OpenAI 推出 GPT-Red

2026-07-19X @btibor91

GPT-Red與Claude週報

2026-07-18X @OpenAI

GPT-5.6 Sol資安評測創SOTA

2026-07-18X @ArtificialAnlys

八天四款前沿模型接力登場

2026-07-18X @arena

Arena新增事實性排名

2026-07-17OpenAI News

OpenAI提出AI效益計分法

2026-07-17X @arena

Kimi-K3登頂前端程式評測