OpenAI 與 Anthropic 於 9 月 22 日推出新模型,但兩家產品線更新的速度不同。GPT-6 Sol 與 Luna 加入 Astra 系列,Terra 則仍屬 GPT-5.6。Claude Opus 更新至 5.5,另有 Fable 5.1、Sonnet 5,以及推出將近一年的 Haiku 4.5。
最值得比較的是 Astra 與 Fable、Sol 與 Opus、Terra 與 Sonnet,以及 Luna 與 Haiku。檢視四組對照,比單看任一新版本更能看出競爭態勢:Opus 正挑戰旗艦級別,Luna 對 Anthropic 的低價產品形成壓力,而兩家產品線的中階仍未更新。
重大變化
- 改變了什麼:現在,買方能在同一家供應商的產品線中,以差異很大的價格選擇較新的模型。OpenAI 更新了低價級別;Anthropic 此次則集中推出 Opus,Haiku 在發布時程上已落後近一年。
- 為何重要:產品團隊有更多空間降低日常 AI 使用成本,並在錯誤代價高時付費取得更好的結果。難處在於依實測表現做選擇:模型在產品線中的位置,無法可靠預測其基準測試排名。
- 值得觀察:Anthropic 表示 Sonnet 5.5 與 Haiku 5.5 將於未來幾週推出。其價格與結果將決定 OpenAI 目前取得的市場空間能保留多少,特別是在大量發出低價請求的產品中。
逐級比較價格
下列數字均為標準直接 API 費率,以美元/百萬 token 計,查核日期為 9 月 22 日。快取輸入指命中快取。OpenAI 公布的費率適用於最多 272,000 個輸入 token;超出後,整個請求的輸入費率加倍,輸出費率提高 50%。快取寫入、批次處理與工具另有計費條件。來源:OpenAI與Anthropic。
模型 | 輸入 | 快取輸入 | 輸出 |
|---|---|---|---|
GPT-6 Astra | $10 | $1 | $50 |
Claude Fable 5.1 | $10 | $0.25 | $50 |
GPT-6 Sol | $2 | $0.20 | $10 |
Claude Opus 5.5 | $4 | $0.20 | $20 |
GPT-5.6 Terra | $2 | $0.20 | $12 |
Claude Sonnet 5 | $2 | $0.20 | $10 |
GPT-6 Luna | $0.10 | $0.01 | $0.50 |
Claude Haiku 4.5 | $1 | $0.10 | $5 |
智慧指數與實測花費
Artificial Analysis Intelligence Index v4.3.2,查核日期為 9 月 22 日。成本為該平台每項指數任務的加權平均支出。
模型 | 測試設定 | 智慧指數 | 每項指數任務成本 |
|---|---|---|---|
GPT-6 Astra | Max | 52.7 | $3.26 |
Claude Fable 5.1 | Max,含回退 | 53.4 | $7.63 |
GPT-6 Sol | Max | 47.5 | 未列出 |
Claude Opus 5.5 | Max,含回退 | 57.6 | $5.98 |
GPT-5.6 Terra | Max | 42.1 | $1.40 |
Claude Sonnet 5 | Max | 38.2 | $5.09 |
GPT-6 Luna | Max | 37.3 | 未列出 |
Claude Haiku 4.5 | 啟用推理 | 16.9 | $0.21 |
來源:Artificial Analysis;各模型個別結果連結於下方比較中。
Astra 對 Fable:旗艦級對照
兩者的標準輸入與輸出價格相同。Fable 的快取命中費率是 Astra 的四分之一;若應用程式反覆重用符合條件的提示內容,這項差異便很重要。
在 Artificial Analysis 目前的智慧指數中,Astra 使用 max 設定得到 52.7 分;Fable 5.1 使用含回退的 max 設定得到 53.4 分,兩者相當接近。Artificial Analysis 回報,Astra 每項指數任務的加權支出為 $3.26,Fable 則為 $7.63。儘管兩者輸入/輸出費率相同,Astra 仍以約低 57% 的實測支出取得接近的分數。 Astra 結果、Fable 結果。
Sol 對 Opus:低價對上較高分數
Sol 的一般輸入與輸出費率是 Opus 的一半;兩者快取命中費率相同。OpenAI 也將 Sol 的輸入與輸出價格相較 GPT-5.6 Sol 上市時減半。Anthropic 則將 Opus 的相應費率較 Opus 5 降低 20%。 OpenAI 發布資訊、Opus 發布資訊。
Artificial Analysis 測得 Sol 使用 max 設定的分數為 47.5,低於 57.6 分的 Opus 5.5(max,含回退)。Opus 領先 Sol 10.1 分,但一般輸入與輸出費用是其兩倍。Opus 分數也高於 Astra 與 Fable,而輸入/輸出費率低 60%。實際測試支出會改變這幅圖像:Opus 每項指數任務平均花費 $5.98,約比 Astra 高 84%。查核時,Artificial Analysis 尚未公布 Sol 的成本數據。 Sol 結果、Opus 結果。
Terra 對 Sonnet:尚無 GPT-6 Terra
OpenAI 目前的發布資訊與模型目錄中都沒有 GPT-6 Terra。可供比較的是 GPT-5.6 Terra;其目前的 API 文件確認了上方費率。OpenAI 的 Work 與 Codex 指南也指出,在 GPT-6 Sol 與 Luna 推出期間,較舊的 5.6 模型仍可使用。
使用 max 力度時,Terra 在 Artificial Analysis 指數得分為 42.1;Sonnet 5 得分為 38.2。此外,Terra 每項指數任務平均花費 $1.40,Sonnet 則為 $5.09:分數較高,實測支出約低 73%。Terra 的輸出 token 費率高 20%,顯示 token 用量與快取可能比標價更能左右成本。 Terra 結果、Sonnet 結果。
Sonnet 5 於 6 月 30 日推出。Anthropic 現已宣布 Sonnet 5.5 將於未來幾週上市。在新版本可供測試並公布價格前,已宣布的後繼款不會改變目前 Sonnet 5 的比較。
Luna 對 Haiku:發布時間差距最大
Luna 在每一項列出的 token 類別中,價格都只有 Haiku 的十分之一。Haiku 4.5 於 2025 年 10 月 15 日推出,比 Luna 早了 342 天。它仍是 Anthropic 目前最新的已發布 Haiku,而 5.5 已承諾將於未來幾週推出。
獨立測試也顯示兩者表現有落差。Artificial Analysis 測得 Luna 使用 max 設定的分數為 37.3,Haiku 4.5 啟用推理時則為 16.9。兩者在同一套現行測試中的指數分數相差甚大,Luna 的 token 價格也低 90%。Haiku 每項指數任務的推理成本平均為 $0.21;查核時,該平台公布的圖表尚未列出 Luna 的相應成本。 Luna 結果、Haiku 推理結果。
對 Anthropic 而言,產品線的這一部分受到直接挑戰:目前最便宜的模型正面對一款新推出的競爭產品,後者 token 費率更低,在這項評估中的表現也明顯較佳。因此,已宣布的 Haiku 更新,將是大量採購模型的開發者接下來值得關注的重要發布。
上述 Artificial Analysis 數據採用 Intelligence Index v4.3.2,這是一項由十種評估組成的綜合指數,查核日期為 9 月 22 日。各分數旁都列出測試設定;Fable 與 Opus 的結果包含平台的回退設定。 指數與方法。
代理程式必須完成工作時,結果如何?
Zapier 的 AutomationBench v1.0.6 在模擬商業應用程式中測試端到端工作。所有評分結果都正確才算通過。其 9 月 22 日排行榜如下:
模型 | 測試設定 | 通過率 | 每項任務成本 |
|---|---|---|---|
GPT-6 Astra | Max | 41.4% | $1.73 |
Claude Fable 5.1 | Max,獨立執行 | 22.37% | $2.45 |
GPT-6 Sol | Xhigh | 33.2% | $0.27 |
GPT-6 Sol | Max | 32.0% | $0.34 |
Claude Opus 5.5 | Max | 40.0% | $1.28 |
GPT-5.6 Terra | Max | 23.59% | $0.51 |
Claude Sonnet 5 | Max | 10.65% | $0.88 |
GPT-6 Luna | Max | 20.7% | $0.04 |
Claude Haiku 4.5 | 未註明 | 0.46% | $0.07 |
另一項 Fable 加 Opus 5 的設定得分為 31.4%。Opus 處理其中約 40% 的任務;表中 2.45 美元未計入這些回退 token。
Sol 使用 xhigh 時,每次嘗試的花費約比 Opus 使用 max 低 79%,通過率則低 6.8 個百分點。Luna 的任務成本比 Haiku 低 43%。Astra 在這組模型中領先;所有通過率都不到一半。 Zapier 的結果與評分方式。
發布日程密集,更新步調不一
兩家公司的 API 發布紀錄提供以下兩組選定系列。OpenAI 系列依序列出編號 GPT 版本,直到 GPT-6 Astra;不包括 Instant 與 Codex 等專用分支,以及後續級別擴充,例如 3 月 17 日推出的 GPT-5.4 mini 和 nano,及 9 月 22 日推出的 GPT-6 Sol 與 Luna。Anthropic 系列則追蹤公開的 Opus API 版本。「間隔」是該公司所選系列中,與前一筆記錄相隔的日曆天數。
- GPT-5 系列—2025 年 8 月 7 日: 推出系列首款模型;第一筆記錄不適用間隔。
- GPT-5.1—2025 年 11 月 13 日: 版本更新;相隔 98 天。
- GPT-5.2—2025 年 12 月 11 日: 版本更新;相隔 28 天。
- GPT-5.4—2026 年 3 月 5 日: 版本更新;相隔 84 天。
- GPT-5.5—2026 年 4 月 24 日: 版本更新;相隔 50 天。
- GPT-5.6—2026 年 7 月 9 日: 系列更新並推出多個級別;相隔 76 天。
- GPT-6 Astra—2026 年 9 月 3 日: 新系列發布;相隔 56 天。
來源:OpenAI API 更新紀錄。另方面,GPT-6 Sol 與 Luna 於 9 月 22 日推出,距 Astra 發布 19 天。這段期間代表同系列的級別擴充,不納入上方編號版本序列。
- Opus 4—2025 年 5 月 22 日: 主要版本;第一筆記錄不適用間隔。
- Opus 4.1—2025 年 8 月 5 日: 小版本更新;相隔 75 天。
- Opus 4.5—2025 年 11 月 24 日: 版本更新;相隔 111 天。
- Opus 4.6—2026 年 2 月 5 日: 版本更新;相隔 73 天。
- Opus 4.7—2026 年 4 月 16 日: 版本更新;相隔 70 天。
- Opus 4.8—2026 年 5 月 28 日: 版本更新;相隔 42 天。
- Opus 5—2026 年 7 月 24 日: 主要版本;相隔 57 天。
- Opus 5.5—2026 年 9 月 22 日: 版本更新並降價;相隔 60 天。
來源:Anthropic API 發布說明。Fable 與受限發布的 Mythos 屬於不同分支,因此不納入 Opus 系列。
OpenAI 編號版本之間的間隔從 28 天到 98 天不等;Anthropic Opus 系列的間隔則介於 42 至 111 天。若將「重大發布」定義為系列編號改變,GPT-5 到 GPT-6 相隔 392 天,Opus 4 到 Opus 5 相隔 428 天。較短的間隔屬於小版本更新與級別擴充。兩個系列的間隔都會波動,較短間隔之後也可能出現較長間隔。
實務上的壓力在於有選擇地升級
新模型持續推出,讓團隊不斷重新考慮模型選擇。今天這四組對照說明,為全體供應商下單一結論會忽略有用差異:Anthropic 推出強勢的新 Opus,OpenAI 推出競爭力更強的新低價級別,而兩家公司產品線仍有部分級別由較舊模型支撐。
切換版本也需要工程工作。Anthropic 的 Opus 5.5 遷移指南指出 thinking 一律啟用、強制選擇工具會回傳錯誤,而舊版電腦操作工具類型在 Claude API 與 Google Cloud 上會遭拒絕。使用這些選項的既有整合都需要修改。
接下來已宣布的更新是 Anthropic 的 Sonnet 與 Haiku 系列。對買方而言,這提供了近期重新評估低價級別的具體理由。目前的價目表與獨立測試已顯示競爭態勢轉變之處,也指出仍值得考慮的舊模型。



