跳到主要內容
2026-10-05 日報
研究與評測

Epoch AI 報告:AI 推論成本每年下降 13 倍,GPT-5.6 Luna 答題成本較 o3 暴跌 725 倍

TechNews 科技新報單一來源
尚未逐項核實

目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

據 TechNews 報導,AI 研究機構 Epoch AI 發表《The Plunging Price of Thought》報告指出,自 2023 年起,在相同測試表現下,AI 模型推論成本平均每季下跌約 47%,相當於每年便宜約 13 倍。此跌速超越摩爾定律,約為 DNA 排序的 4 倍、傳統運算技術的 6 倍及鋰電池的 18 倍。 報告以 GPQA Diamond 科學問答測試達到 75% 表現水準為基準,估計 OpenAI 於 2025 年 1 月推出的 o3 模型每題平均花費 0.3 美元;而不到 18 個月後推出的 GPT-5.6 Luna 每題成本降至約 0.0004 美元,跌幅達 725 倍。 不同任務的成本下降速度存在差異:數學測試每年下降約 16 至 19 倍,棋類等遊戲測試則下降約 7 至 10 倍。報告數據顯示,當某種表現水準剛達業界前沿時,成本平均每季下跌 66%,約兩年後季度跌幅則放緩至 32%。Epoch AI 也提醒,廠商可能針對指定測試訓練模型(Benchmaxxing),導致跑分提升未必完全等同實際工作能力改善。
讀原始報導

背景

在評估 AI 模型時,業界常透過基準測試(Benchmarking)來比較不同模型的品質、時間與成本等績效指標。然而,廠商有時會針對特定測試進行訓練以提高分數,這種現象被稱為「Benchmaxxing」,可能導致測試成績無法完全反映實際工作能力。

來源

本期分類