世界從未停止變化。RSS
BIG CHANGE.

Markdown 版本

AI-translated from English; not yet reviewed by a fluent editor.

# GPT-6 與 Claude:四個級別的價格與基準測試比較

> 八款模型、四個級別:比較 OpenAI 與 Claude 最新版本的智慧指數分數、API 價格及實測任務成本。

By BIG CHANGE Editorial

Published: 2026-09-22T19:53:39.563Z
Updated: 2026-09-22T22:39:13.693Z
Canonical: https://bigchange.ai/blog/gpt-6-luna-opus-5-5-price-release-race

![Orange token discs flow from a hopper toward a central switch, with a separate charcoal-and-ivory cartridge aligned to an orange-edged adapter.](https://bigchange.ai/api/media/file/gpt6-luna-opus-routing-hero-v1.png)
AI-generated conceptual illustration by BIG CHANGE. Cheap token volume and a premium model route are separate choices; a new model can also bring a compatibility connection to check. This conceptual illustration does not compare model quality or performance.

OpenAI 與 Anthropic 於 9 月 22 日推出新模型,但兩家產品線更新的速度不同。GPT-6 Sol 與 Luna 加入 Astra 系列,Terra 則仍屬 GPT-5.6。Claude Opus 更新至 5.5,另有 Fable 5.1、Sonnet 5,以及推出將近一年的 Haiku 4.5。

最值得比較的是 Astra 與 Fable、Sol 與 Opus、Terra 與 Sonnet,以及 Luna 與 Haiku。檢視四組對照,比單看任一新版本更能看出競爭態勢:Opus 正挑戰旗艦級別,Luna 對 Anthropic 的低價產品形成壓力,而兩家產品線的中階仍未更新。

## 重大變化

- **改變了什麼:**現在,買方能在同一家供應商的產品線中,以差異很大的價格選擇較新的模型。OpenAI 更新了低價級別;Anthropic 此次則集中推出 Opus,Haiku 在發布時程上已落後近一年。
- **為何重要:**產品團隊有更多空間降低日常 AI 使用成本,並在錯誤代價高時付費取得更好的結果。難處在於依實測表現做選擇:模型在產品線中的位置,無法可靠預測其基準測試排名。
- **值得觀察:**Anthropic 表示 Sonnet 5.5 與 Haiku 5.5 將於未來幾週推出。其價格與結果將決定 OpenAI 目前取得的市場空間能保留多少,特別是在大量發出低價請求的產品中。

## 逐級比較價格

下列數字均為標準直接 API 費率,以美元/百萬 token 計,查核日期為 9 月 22 日。快取輸入指命中快取。OpenAI 公布的費率適用於最多 272,000 個輸入 token;超出後,整個請求的輸入費率加倍,輸出費率提高 50%。快取寫入、批次處理與工具另有計費條件。來源:[OpenAI](https://developers.openai.com/api/docs/pricing)與[Anthropic](https://platform.claude.com/docs/en/about-claude/pricing)。

| 模型 | 輸入 | 快取輸入 | 輸出 |
| --- | --- | --- | --- |
| GPT-6 Astra | $10 | $1 | $50 |
| Claude Fable 5.1 | $10 | $0.25 | $50 |
| GPT-6 Sol | $2 | $0.20 | $10 |
| Claude Opus 5.5 | $4 | $0.20 | $20 |
| GPT-5.6 Terra | $2 | $0.20 | $12 |
| Claude Sonnet 5 | $2 | $0.20 | $10 |
| GPT-6 Luna | $0.10 | $0.01 | $0.50 |
| Claude Haiku 4.5 | $1 | $0.10 | $5 |

### 智慧指數與實測花費

Artificial Analysis Intelligence Index v4.3.2,查核日期為 9 月 22 日。成本為該平台每項指數任務的加權平均支出。

| 模型 | 測試設定 | 智慧指數 | 每項指數任務成本 |
| --- | --- | --- | --- |
| GPT-6 Astra | Max | 52.7 | $3.26 |
| Claude Fable 5.1 | Max,含回退 | 53.4 | $7.63 |
| GPT-6 Sol | Max | 47.5 | 未列出 |
| Claude Opus 5.5 | Max,含回退 | 57.6 | $5.98 |
| GPT-5.6 Terra | Max | 42.1 | $1.40 |
| Claude Sonnet 5 | Max | 38.2 | $5.09 |
| GPT-6 Luna | Max | 37.3 | 未列出 |
| Claude Haiku 4.5 | 啟用推理 | 16.9 | $0.21 |

來源:[Artificial Analysis](https://artificialanalysis.ai/models);各模型個別結果連結於下方比較中。

### Astra 對 Fable:旗艦級對照

兩者的標準輸入與輸出價格相同。Fable 的快取命中費率是 Astra 的四分之一;若應用程式反覆重用符合條件的提示內容,這項差異便很重要。

在 Artificial Analysis 目前的智慧指數中,Astra 使用 max 設定得到 **52.7** 分;Fable 5.1 使用含回退的 max 設定得到 **53.4** 分,兩者相當接近。Artificial Analysis 回報,Astra 每項指數任務的加權支出為 **$3.26**,Fable 則為 **$7.63**。儘管兩者輸入/輸出費率相同,Astra 仍以約低 57% 的實測支出取得接近的分數。 [Astra 結果](https://artificialanalysis.ai/models/gpt-6-astra)、[Fable 結果](https://artificialanalysis.ai/models/claude-fable-5-1)。

### Sol 對 Opus:低價對上較高分數

Sol 的一般輸入與輸出費率是 Opus 的一半;兩者快取命中費率相同。OpenAI 也將 Sol 的輸入與輸出價格相較 GPT-5.6 Sol 上市時減半。Anthropic 則將 Opus 的相應費率較 Opus 5 降低 20%。 [OpenAI 發布資訊](https://openai.com/index/introducing-gpt-6-sol-and-luna/)、[Opus 發布資訊](https://www.anthropic.com/claude-opus-5-5)。

Artificial Analysis 測得 Sol 使用 max 設定的分數為 **47.5**,低於 **57.6** 分的 Opus 5.5(max,含回退)。Opus 領先 Sol 10.1 分,但一般輸入與輸出費用是其兩倍。Opus 分數也高於 Astra 與 Fable,而輸入/輸出費率低 60%。實際測試支出會改變這幅圖像:Opus 每項指數任務平均花費 **$5.98**,約比 Astra 高 84%。查核時,Artificial Analysis 尚未公布 Sol 的成本數據。 [Sol 結果](https://artificialanalysis.ai/models/gpt-6-sol)、[Opus 結果](https://artificialanalysis.ai/models/claude-opus-5-5)。

### Terra 對 Sonnet:尚無 GPT-6 Terra

OpenAI 目前的發布資訊與模型目錄中都沒有 GPT-6 Terra。可供比較的是 **GPT-5.6 Terra**;其目前的 [API 文件](https://developers.openai.com/api/docs/models/gpt-5.6-terra)確認了上方費率。OpenAI 的 [Work 與 Codex 指南](https://learn.chatgpt.com/docs/models)也指出,在 GPT-6 Sol 與 Luna 推出期間,較舊的 5.6 模型仍可使用。

使用 max 力度時,Terra 在 Artificial Analysis 指數得分為 **42.1**;Sonnet 5 得分為 **38.2**。此外,Terra 每項指數任務平均花費 **$1.40**,Sonnet 則為 **$5.09**:分數較高,實測支出約低 73%。Terra 的輸出 token 費率高 20%,顯示 token 用量與快取可能比標價更能左右成本。 [Terra 結果](https://artificialanalysis.ai/models/gpt-5-6-terra)、[Sonnet 結果](https://artificialanalysis.ai/models/claude-sonnet-5)。

Sonnet 5 於 6 月 30 日推出。Anthropic 現已宣布 Sonnet 5.5 將於未來幾週上市。在新版本可供測試並公布價格前,已宣布的後繼款不會改變目前 Sonnet 5 的比較。

### Luna 對 Haiku:發布時間差距最大

Luna 在每一項列出的 token 類別中,價格都只有 Haiku 的十分之一。Haiku 4.5 於 2025 年 10 月 15 日推出,比 Luna 早了 **342 天**。它仍是 Anthropic 目前最新的已發布 Haiku,而 5.5 已承諾將於未來幾週推出。

獨立測試也顯示兩者表現有落差。Artificial Analysis 測得 Luna 使用 max 設定的分數為 **37.3**,Haiku 4.5 啟用推理時則為 **16.9**。兩者在同一套現行測試中的指數分數相差甚大,Luna 的 token 價格也低 90%。Haiku 每項指數任務的推理成本平均為 **$0.21**;查核時,該平台公布的圖表尚未列出 Luna 的相應成本。 [Luna 結果](https://artificialanalysis.ai/models/gpt-6-luna)、[Haiku 推理結果](https://artificialanalysis.ai/models/claude-4-5-haiku-reasoning)。

對 Anthropic 而言,產品線的這一部分受到直接挑戰:目前最便宜的模型正面對一款新推出的競爭產品,後者 token 費率更低,在這項評估中的表現也明顯較佳。因此,已宣布的 Haiku 更新,將是大量採購模型的開發者接下來值得關注的重要發布。

上述 Artificial Analysis 數據採用 **Intelligence Index v4.3.2**,這是一項由十種評估組成的綜合指數,查核日期為 9 月 22 日。各分數旁都列出測試設定;Fable 與 Opus 的結果包含平台的回退設定。 [指數與方法](https://artificialanalysis.ai/models)。

## 代理程式必須完成工作時,結果如何?

Zapier 的 **AutomationBench v1.0.6** 在模擬商業應用程式中測試端到端工作。所有評分結果都正確才算通過。其 9 月 22 日排行榜如下:

| 模型 | 測試設定 | 通過率 | 每項任務成本 |
| --- | --- | --- | --- |
| GPT-6 Astra | Max | 41.4% | $1.73 |
| Claude Fable 5.1 | Max,獨立執行 | 22.37% | $2.45 |
| GPT-6 Sol | Xhigh | 33.2% | $0.27 |
| GPT-6 Sol | Max | 32.0% | $0.34 |
| Claude Opus 5.5 | Max | 40.0% | $1.28 |
| GPT-5.6 Terra | Max | 23.59% | $0.51 |
| Claude Sonnet 5 | Max | 10.65% | $0.88 |
| GPT-6 Luna | Max | 20.7% | $0.04 |
| Claude Haiku 4.5 | 未註明 | 0.46% | $0.07 |

另一項 Fable 加 Opus 5 的設定得分為 31.4%。Opus 處理其中約 40% 的任務;表中 2.45 美元未計入這些回退 token。

Sol 使用 xhigh 時,每次嘗試的花費約比 Opus 使用 max 低 **79%**,通過率則低 6.8 個百分點。Luna 的任務成本比 Haiku 低 **43%**。Astra 在這組模型中領先;所有通過率都不到一半。 [Zapier 的結果與評分方式](https://zapier.com/benchmarks)。

## 發布日程密集,更新步調不一

兩家公司的 API 發布紀錄提供以下兩組選定系列。OpenAI 系列依序列出編號 GPT 版本,直到 GPT-6 Astra;不包括 Instant 與 Codex 等專用分支,以及後續級別擴充,例如 3 月 17 日推出的 GPT-5.4 mini 和 nano,及 9 月 22 日推出的 GPT-6 Sol 與 Luna。Anthropic 系列則追蹤公開的 Opus API 版本。「間隔」是該公司所選系列中,與前一筆記錄相隔的日曆天數。

- **GPT-5 系列—2025 年 8 月 7 日:** 推出系列首款模型;第一筆記錄不適用間隔。
- **GPT-5.1—2025 年 11 月 13 日:** 版本更新;相隔 98 天。
- **GPT-5.2—2025 年 12 月 11 日:** 版本更新;相隔 28 天。
- **GPT-5.4—2026 年 3 月 5 日:** 版本更新;相隔 84 天。
- **GPT-5.5—2026 年 4 月 24 日:** 版本更新;相隔 50 天。
- **GPT-5.6—2026 年 7 月 9 日:** 系列更新並推出多個級別;相隔 76 天。
- **GPT-6 Astra—2026 年 9 月 3 日:** 新系列發布;相隔 56 天。

來源:[OpenAI API 更新紀錄](https://developers.openai.com/api/docs/changelog)。另方面,GPT-6 Sol 與 Luna 於 9 月 22 日推出,距 Astra 發布 19 天。這段期間代表同系列的級別擴充,不納入上方編號版本序列。

- **Opus 4—2025 年 5 月 22 日:** 主要版本;第一筆記錄不適用間隔。
- **Opus 4.1—2025 年 8 月 5 日:** 小版本更新;相隔 75 天。
- **Opus 4.5—2025 年 11 月 24 日:** 版本更新;相隔 111 天。
- **Opus 4.6—2026 年 2 月 5 日:** 版本更新;相隔 73 天。
- **Opus 4.7—2026 年 4 月 16 日:** 版本更新;相隔 70 天。
- **Opus 4.8—2026 年 5 月 28 日:** 版本更新;相隔 42 天。
- **Opus 5—2026 年 7 月 24 日:** 主要版本;相隔 57 天。
- **Opus 5.5—2026 年 9 月 22 日:** 版本更新並降價;相隔 60 天。

來源:[Anthropic API 發布說明](https://platform.claude.com/docs/en/release-notes/overview)。Fable 與受限發布的 Mythos 屬於不同分支,因此不納入 Opus 系列。

OpenAI 編號版本之間的間隔從 28 天到 98 天不等;Anthropic Opus 系列的間隔則介於 42 至 111 天。若將「重大發布」定義為系列編號改變,GPT-5 到 GPT-6 相隔 392 天,Opus 4 到 Opus 5 相隔 428 天。較短的間隔屬於小版本更新與級別擴充。兩個系列的間隔都會波動,較短間隔之後也可能出現較長間隔。

## 實務上的壓力在於有選擇地升級

新模型持續推出,讓團隊不斷重新考慮模型選擇。今天這四組對照說明,為全體供應商下單一結論會忽略有用差異:Anthropic 推出強勢的新 Opus,OpenAI 推出競爭力更強的新低價級別,而兩家公司產品線仍有部分級別由較舊模型支撐。

切換版本也需要工程工作。Anthropic 的 [Opus 5.5 遷移指南](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5)指出 thinking 一律啟用、強制選擇工具會回傳錯誤,而舊版電腦操作工具類型在 Claude API 與 Google Cloud 上會遭拒絕。使用這些選項的既有整合都需要修改。

接下來已宣布的更新是 Anthropic 的 Sonnet 與 Haiku 系列。對買方而言,這提供了近期重新評估低價級別的具體理由。目前的價目表與獨立測試已顯示競爭態勢轉變之處,也指出仍值得考慮的舊模型。

## Sources

- [OpenAI API 價格](https://developers.openai.com/api/docs/pricing) — 四級比較中採用的標準輸入、快取命中與輸出費率,以及長上下文級距。API 費率與訂閱費分開。
- [OpenAI API 更新紀錄](https://developers.openai.com/api/docs/changelog) — 日期明確的 API 項目佐證 OpenAI 發布系列。GPT-6 Astra 視為新系列發布;9 月 22 日推出的 Sol 與 Luna 則另列為級別擴充,而非新世代。
- [OpenAI GPT-6 Luna 模型文件](https://developers.openai.com/api/docs/models/gpt-6-luna) — 文件列出的 Luna 預定用途、上下文視窗及長提示價格條件,是本文比較的依據。
- [Anthropic API 價格](https://platform.claude.com/docs/en/about-claude/pricing) — 目前 Fable、Opus、Sonnet 與 Haiku 的 API 價格,包含快取命中費率;佐證 Opus 系列內的降價幅度。
- [Anthropic API 發布說明](https://platform.claude.com/docs/en/release-notes/overview) — 日期明確的發布項目佐證 Opus 版本序列。Fable 與受限版 Mythos 屬不同分支,並非普遍可用的 Opus 後繼模型,因此不納入。
- [Anthropic:Claude Opus 5.5 更新內容](https://platform.claude.com/docs/en/models/opus-5-5/whats-new-opus-5-5) — 遷移文件列出破壞性 API 變更,包括 thinking 一律啟用、強制選擇工具會出錯,以及 Claude API 與 Google Cloud 不再接受舊版電腦操作工具類型。這些是有文件佐證的相容性成本,不是假設性的整合情境。
- [Big Change:Claude Opus 5.5 降低長時間 AI 任務成本,但仍有處理限制](https://bigchange.ai/blog/claude-opus-5-5-cost-performance-access) — 我們另有 Opus 發布分析,詳述存取與成本。本比較則加入四級價格、獨立測試結果與發布時間軸。
- [Anthropic:Claude Haiku 4.5](https://platform.claude.com/docs/en/models/haiku-4-5/overview) — Haiku 以速度為主的定位、價格及 200,000 token 上下文視窗,可支持本次比較的範圍及其限制。
- [OpenAI:Work 與 Codex 模型](https://learn.chatgpt.com/docs/models) — 列出 GPT-5.6 Terra,並指出在 GPT-6 Sol 與 Luna 推出期間,Work 與 Codex 仍提供 5.6 模型;實際可用性依帳戶權限而定。
- [OpenAI API 模型目錄](https://developers.openai.com/api/docs/models) — 列出 Astra、Sol 與 Luna 的預定用途及其在目前 API 產品線中的定位。
- [OpenAI:推出 GPT-6 Sol 與 Luna](https://openai.com/index/introducing-gpt-6-sol-and-luna/) — 9 月 22 日的發布資訊及 Sol 降價。發布圖表使用較早期 Claude 版本,因此本文跨供應商的現行分數採用基準測試平台資料。
- [Anthropic:Claude Opus 5.5](https://www.anthropic.com/claude-opus-5-5) — 9 月 22 日推出 Opus、降價,並宣布 Sonnet 5.5 與 Haiku 5.5 將於接下來幾週推出。
- [OpenAI:GPT-5.6 Terra](https://developers.openai.com/api/docs/models/gpt-5.6-terra) — 目前 Terra API 費率佐證可用的 5.6 模型;此來源並未推出 GPT-6 Terra。
- [Artificial Analysis:智慧指數](https://artificialanalysis.ai/models) — 9 月 22 日查核的獨立 v4.3.2 指數。模型頁提供分數、設定與每項指數任務的加權成本;當時尚無 Sol 與 Luna 的成本資料。Fable 與 Opus 數據包含回退。
- [Zapier:AutomationBench](https://zapier.com/benchmarks) — 1.0.6 版結果、任務成本與嚴格評分方式。Fable 獨立執行與回退結果分開列出;顯示的組合價格未包含回退成本。
- [Anthropic:Claude Haiku](https://www.anthropic.com/claude/haiku) — 官方 Haiku 4.5 發布日期為 2025 年 10 月 15 日,本文用此日期計算截至 9 月 22 日比較時的模型年齡。