OpenAI 與 Anthropic 於 9 月 22 日推出新模型,但兩家產品線更新的速度不同。GPT-6 Sol 與 Luna 加入 Astra 系列,Terra 則仍屬 GPT-5.6。Claude Opus 更新至 5.5,另有 Fable 5.1、Sonnet 5,以及推出將近一年的 Haiku 4.5。

最值得比較的是 Astra 與 Fable、Sol 與 Opus、Terra 與 Sonnet,以及 Luna 與 Haiku。檢視四組對照,比單看任一新版本更能看出競爭態勢:Opus 正挑戰旗艦級別,Luna 對 Anthropic 的低價產品形成壓力,而兩家產品線的中階仍未更新。

重大變化

  • 改變了什麼:現在,買方能在同一家供應商的產品線中,以差異很大的價格選擇較新的模型。OpenAI 更新了低價級別;Anthropic 此次則集中推出 Opus,Haiku 在發布時程上已落後近一年。
  • 為何重要:產品團隊有更多空間降低日常 AI 使用成本,並在錯誤代價高時付費取得更好的結果。難處在於依實測表現做選擇:模型在產品線中的位置,無法可靠預測其基準測試排名。
  • 值得觀察:Anthropic 表示 Sonnet 5.5 與 Haiku 5.5 將於未來幾週推出。其價格與結果將決定 OpenAI 目前取得的市場空間能保留多少,特別是在大量發出低價請求的產品中。

逐級比較價格

下列數字均為標準直接 API 費率,以美元/百萬 token 計,查核日期為 9 月 22 日。快取輸入指命中快取。OpenAI 公布的費率適用於最多 272,000 個輸入 token;超出後,整個請求的輸入費率加倍,輸出費率提高 50%。快取寫入、批次處理與工具另有計費條件。來源:OpenAI與Anthropic。

模型

輸入

快取輸入

輸出

GPT-6 Astra

$10

$1

$50

Claude Fable 5.1

$10

$0.25

$50

GPT-6 Sol

$2

$0.20

$10

Claude Opus 5.5

$4

$0.20

$20

GPT-5.6 Terra

$2

$0.20

$12

Claude Sonnet 5

$2

$0.20

$10

GPT-6 Luna

$0.10

$0.01

$0.50

Claude Haiku 4.5

$1

$0.10

$5

智慧指數與實測花費

Artificial Analysis Intelligence Index v4.3.2,查核日期為 9 月 22 日。成本為該平台每項指數任務的加權平均支出。

模型

測試設定

智慧指數

每項指數任務成本

GPT-6 Astra

Max

52.7

$3.26

Claude Fable 5.1

Max,含回退

53.4

$7.63

GPT-6 Sol

Max

47.5

未列出

Claude Opus 5.5

Max,含回退

57.6

$5.98

GPT-5.6 Terra

Max

42.1

$1.40

Claude Sonnet 5

Max

38.2

$5.09

GPT-6 Luna

Max

37.3

未列出

Claude Haiku 4.5

啟用推理

16.9

$0.21

來源:Artificial Analysis;各模型個別結果連結於下方比較中。

Astra 對 Fable:旗艦級對照

兩者的標準輸入與輸出價格相同。Fable 的快取命中費率是 Astra 的四分之一;若應用程式反覆重用符合條件的提示內容,這項差異便很重要。

在 Artificial Analysis 目前的智慧指數中,Astra 使用 max 設定得到 52.7 分;Fable 5.1 使用含回退的 max 設定得到 53.4 分,兩者相當接近。Artificial Analysis 回報,Astra 每項指數任務的加權支出為 $3.26,Fable 則為 $7.63。儘管兩者輸入/輸出費率相同,Astra 仍以約低 57% 的實測支出取得接近的分數。 Astra 結果、Fable 結果。

Sol 對 Opus:低價對上較高分數

Sol 的一般輸入與輸出費率是 Opus 的一半;兩者快取命中費率相同。OpenAI 也將 Sol 的輸入與輸出價格相較 GPT-5.6 Sol 上市時減半。Anthropic 則將 Opus 的相應費率較 Opus 5 降低 20%。 OpenAI 發布資訊、Opus 發布資訊。

Artificial Analysis 測得 Sol 使用 max 設定的分數為 47.5,低於 57.6 分的 Opus 5.5(max,含回退)。Opus 領先 Sol 10.1 分,但一般輸入與輸出費用是其兩倍。Opus 分數也高於 Astra 與 Fable,而輸入/輸出費率低 60%。實際測試支出會改變這幅圖像:Opus 每項指數任務平均花費 $5.98,約比 Astra 高 84%。查核時,Artificial Analysis 尚未公布 Sol 的成本數據。 Sol 結果、Opus 結果。

Terra 對 Sonnet:尚無 GPT-6 Terra

OpenAI 目前的發布資訊與模型目錄中都沒有 GPT-6 Terra。可供比較的是 GPT-5.6 Terra;其目前的 API 文件確認了上方費率。OpenAI 的 Work 與 Codex 指南也指出,在 GPT-6 Sol 與 Luna 推出期間,較舊的 5.6 模型仍可使用。

使用 max 力度時,Terra 在 Artificial Analysis 指數得分為 42.1;Sonnet 5 得分為 38.2。此外,Terra 每項指數任務平均花費 $1.40,Sonnet 則為 $5.09:分數較高,實測支出約低 73%。Terra 的輸出 token 費率高 20%,顯示 token 用量與快取可能比標價更能左右成本。 Terra 結果、Sonnet 結果。

Sonnet 5 於 6 月 30 日推出。Anthropic 現已宣布 Sonnet 5.5 將於未來幾週上市。在新版本可供測試並公布價格前,已宣布的後繼款不會改變目前 Sonnet 5 的比較。

Luna 對 Haiku:發布時間差距最大

Luna 在每一項列出的 token 類別中,價格都只有 Haiku 的十分之一。Haiku 4.5 於 2025 年 10 月 15 日推出,比 Luna 早了 342 天。它仍是 Anthropic 目前最新的已發布 Haiku,而 5.5 已承諾將於未來幾週推出。

獨立測試也顯示兩者表現有落差。Artificial Analysis 測得 Luna 使用 max 設定的分數為 37.3,Haiku 4.5 啟用推理時則為 16.9。兩者在同一套現行測試中的指數分數相差甚大,Luna 的 token 價格也低 90%。Haiku 每項指數任務的推理成本平均為 $0.21;查核時,該平台公布的圖表尚未列出 Luna 的相應成本。 Luna 結果、Haiku 推理結果。

對 Anthropic 而言,產品線的這一部分受到直接挑戰:目前最便宜的模型正面對一款新推出的競爭產品,後者 token 費率更低,在這項評估中的表現也明顯較佳。因此,已宣布的 Haiku 更新,將是大量採購模型的開發者接下來值得關注的重要發布。

上述 Artificial Analysis 數據採用 Intelligence Index v4.3.2,這是一項由十種評估組成的綜合指數,查核日期為 9 月 22 日。各分數旁都列出測試設定;Fable 與 Opus 的結果包含平台的回退設定。 指數與方法。

代理程式必須完成工作時,結果如何?

Zapier 的 AutomationBench v1.0.6 在模擬商業應用程式中測試端到端工作。所有評分結果都正確才算通過。其 9 月 22 日排行榜如下:

模型

測試設定

通過率

每項任務成本

GPT-6 Astra

Max

41.4%

$1.73

Claude Fable 5.1

Max,獨立執行

22.37%

$2.45

GPT-6 Sol

Xhigh

33.2%

$0.27

GPT-6 Sol

Max

32.0%

$0.34

Claude Opus 5.5

Max

40.0%

$1.28

GPT-5.6 Terra

Max

23.59%

$0.51

Claude Sonnet 5

Max

10.65%

$0.88

GPT-6 Luna

Max

20.7%

$0.04

Claude Haiku 4.5

未註明

0.46%

$0.07

另一項 Fable 加 Opus 5 的設定得分為 31.4%。Opus 處理其中約 40% 的任務;表中 2.45 美元未計入這些回退 token。

Sol 使用 xhigh 時,每次嘗試的花費約比 Opus 使用 max 低 79%,通過率則低 6.8 個百分點。Luna 的任務成本比 Haiku 低 43%。Astra 在這組模型中領先;所有通過率都不到一半。 Zapier 的結果與評分方式。

發布日程密集,更新步調不一

兩家公司的 API 發布紀錄提供以下兩組選定系列。OpenAI 系列依序列出編號 GPT 版本,直到 GPT-6 Astra;不包括 Instant 與 Codex 等專用分支,以及後續級別擴充,例如 3 月 17 日推出的 GPT-5.4 mini 和 nano,及 9 月 22 日推出的 GPT-6 Sol 與 Luna。Anthropic 系列則追蹤公開的 Opus API 版本。「間隔」是該公司所選系列中,與前一筆記錄相隔的日曆天數。

  • GPT-5 系列—2025 年 8 月 7 日: 推出系列首款模型;第一筆記錄不適用間隔。
  • GPT-5.1—2025 年 11 月 13 日: 版本更新;相隔 98 天。
  • GPT-5.2—2025 年 12 月 11 日: 版本更新;相隔 28 天。
  • GPT-5.4—2026 年 3 月 5 日: 版本更新;相隔 84 天。
  • GPT-5.5—2026 年 4 月 24 日: 版本更新;相隔 50 天。
  • GPT-5.6—2026 年 7 月 9 日: 系列更新並推出多個級別;相隔 76 天。
  • GPT-6 Astra—2026 年 9 月 3 日: 新系列發布;相隔 56 天。

來源:OpenAI API 更新紀錄。另方面,GPT-6 Sol 與 Luna 於 9 月 22 日推出,距 Astra 發布 19 天。這段期間代表同系列的級別擴充,不納入上方編號版本序列。

  • Opus 4—2025 年 5 月 22 日: 主要版本;第一筆記錄不適用間隔。
  • Opus 4.1—2025 年 8 月 5 日: 小版本更新;相隔 75 天。
  • Opus 4.5—2025 年 11 月 24 日: 版本更新;相隔 111 天。
  • Opus 4.6—2026 年 2 月 5 日: 版本更新;相隔 73 天。
  • Opus 4.7—2026 年 4 月 16 日: 版本更新;相隔 70 天。
  • Opus 4.8—2026 年 5 月 28 日: 版本更新;相隔 42 天。
  • Opus 5—2026 年 7 月 24 日: 主要版本;相隔 57 天。
  • Opus 5.5—2026 年 9 月 22 日: 版本更新並降價;相隔 60 天。

來源:Anthropic API 發布說明。Fable 與受限發布的 Mythos 屬於不同分支,因此不納入 Opus 系列。

OpenAI 編號版本之間的間隔從 28 天到 98 天不等;Anthropic Opus 系列的間隔則介於 42 至 111 天。若將「重大發布」定義為系列編號改變,GPT-5 到 GPT-6 相隔 392 天,Opus 4 到 Opus 5 相隔 428 天。較短的間隔屬於小版本更新與級別擴充。兩個系列的間隔都會波動,較短間隔之後也可能出現較長間隔。

實務上的壓力在於有選擇地升級

新模型持續推出,讓團隊不斷重新考慮模型選擇。今天這四組對照說明,為全體供應商下單一結論會忽略有用差異:Anthropic 推出強勢的新 Opus,OpenAI 推出競爭力更強的新低價級別,而兩家公司產品線仍有部分級別由較舊模型支撐。

切換版本也需要工程工作。Anthropic 的 Opus 5.5 遷移指南指出 thinking 一律啟用、強制選擇工具會回傳錯誤,而舊版電腦操作工具類型在 Claude API 與 Google Cloud 上會遭拒絕。使用這些選項的既有整合都需要修改。

接下來已宣布的更新是 Anthropic 的 Sonnet 與 Haiku 系列。對買方而言,這提供了近期重新評估低價級別的具體理由。目前的價目表與獨立測試已顯示競爭態勢轉變之處,也指出仍值得考慮的舊模型。