あるRedditへの投稿では、GPT-6 Solの登場後にCodex Proの契約価値が半減したと主張している。投稿者の表では、週次利用枠1ポイント当たりのAPI換算使用額は、GPT-5.6 Solの約25ドルから約13ドルに低下したと推計されている。

投稿者は値下げを認めつつ、利用量はほぼ変わらないと述べている。同じトークン枠でも料金が半減すれば、API換算額は半分になり得る。契約者が受け取るトークン数や完了タスク数が減ったかを確かめるには、別の測定が必要だ。投稿の数字だけでは結論は出ない。

大きな変化

  • 何が変わったか:ローカルのCodexログからトークン数は分かる。サードパーティ製ツールはそれをAPI料金に換算する一方、OpenAIのサブスクリプションメーターは別の利用枠を計測している。
  • なぜ重要か:サブスクリプションを購入する人は、月額料金でどれだけの作業を完了できるかを比較したい。API換算額の低下は見かけ上の割安感を変えるが、月額料金で得られる作業量が減ったことを示すわけではない。
  • 今後の注目点:モデル、速度、トークン構成、キャッシュ使用量と利用枠の消費を結び付ける記録が提供されるかどうかだ。そうした記録があれば、リリース間の契約価値を比較し、利用枠の減り方に関する異議を調べやすくなる。

利用枠を仮定する前に、すでに「50%減」は計算できる

OpenAIの現在のStandard・短文脈API料金は、GPT-5.6 Solが入力100万トークン当たり4ドル、出力100万トークン当たり20ドル。GPT-6 Solはそれぞれ2ドル、10ドルだ。これらは公表済みのAPI料金である。GPT-6 Solのモデルページでは、入力が272,000トークンを超える長文脈の料金が別途設定されている。

未キャッシュ入力100万トークンと出力100万トークンから成る固定の処理を、各リクエストが短文脈の料金帯に収まるよう分けた場合:

モデル

入力の計算

出力の計算

API換算合計

GPT-5.6 Sol

100万 × 4ドル

100万 × 20ドル

24ドル

GPT-6 Sol

100万 × 2ドル

100万 × 10ドル

12ドル

Standard速度では、OpenAIのCodexクレジット表は同じ未キャッシュ入力・出力トークン数に対し、600対300クレジットとしている。同ページによれば、クレジット単価だけではサブスクリプションに含まれる使用量は決まらない。

値下げだけでも、このパターンは生じる。投稿者の結果を再現するには、投稿にないトークン構成と設定を、変更前後でそろえたデータが必要だ。

ccusageが測定するもの

ccusageのCodex対応に関するドキュメントでは、Codex対応は実験的とされている。このツールはtoken_countイベントをローカルのセッションファイルから読み取り、モデルごとに分類するためturn_contextを参照し、料金データセットのモデル価格を適用する。レポートはAPI換算の推定値であり、ChatGPTのクレジット残高とは異なるとドキュメントに明記されている。

コスト計算では通常の入力、キャッシュ済み入力、出力を分ける。推論トークンは出力課金に含まれる。記録されたStandardまたはFastのサービスタイアも推定額を変え得る。したがって、利用枠1ポイント当たりのドル換算額の低下は、ローカルで価格を付けたトークン記録と、OpenAIの利用上限の変動という異なる二つの記録を組み合わせたものだ。

キャッシュヒットとコンテキスト長がトークンコストを変える理由は、BIG CHANGEのGPT-6プロンプトキャッシュ解説を参照。さらに、当社のGPT-6とClaudeの価格比較では、API料金の変更をモデル市場全体の中で位置付けている。いずれの記事もサブスクリプションの利用枠に関する証拠を示すものではない。

OpenAIが公表している契約内の利用量

OpenAIはPro 20xについて、ローカルでのGPT-6 Solメッセージ数を5時間当たり300~3,000件、GPT-5.6 Solでは200~2,000件と推定している。週次上限が適用される場合があるが、ページに週次トークン上限は示されていない。これらの幅のある推定は、モデル、コンテキスト、推論、ツール、検索取得、キャッシュに左右される。Reddit投稿者のアカウントにおける変更前後の利用枠を証明するものではない。

9月22日のCodex変更履歴は、トークン料金を引き下げてGPT-6 SolとLunaを発表している。契約に含まれる利用量の削減は発表していない。

主張の決着に必要な証拠

三つの測定は、それぞれ別の問いに答える。

問い

最低限必要な記録

API換算額は下がったか?

同じトークン数に各モデルの公表価格を掛ける。答えはすでに「はい」だ。

GPT-6 Solでは利用メーターの減り方が異なるか?

同じアカウントとプランで、タスクをそろえ、推論設定と速度を固定する。入力・キャッシュ済み入力・出力のトークン数、実行前後のダッシュボード表示率を、複数回の試行で記録する。

プランの利用枠そのものが削減されたか?

疑われている変更の前後で、同じモデル、設定、作業負荷を、比較可能なリセット期間にわたって測定する。

ツール呼び出し、検索取得、コンテキストの増加、キャッシュ状態は使用量を変えるため、記録しなければならない。エージェントによる二つの実行は同じタスクでも異なる経路をたどることがあるので、繰り返し測定も重要だ。

報告されたAPI換算額の低下は、値下げと整合する。サブスクリプションで完了できる作業が減ったかは、まだ分からない。トークン数、タスクの成果、メーターの動きを結び付けた条件一致の記録があれば答えに近づけるが、この計算だけでは利用枠の削減を確認できず、メーターの問題の可能性も排除できない。