একটি Reddit পোস্টে দাবি করা হয়েছে, GPT-6 Sol আসার পর OpenAI Codex Pro subscription-এর মূল্য অর্ধেক করেছে। লেখকের সারণিতে প্রতি সপ্তাহের quota-র এক percentage point-এ API-সমতুল্য ব্যবহার প্রায় $25 থেকে কমে আনুমানিক $13 দেখানো হয়েছে।

লেখক দাম কমার বিষয়টি স্বীকার করেছেন এবং ব্যবহার প্রায় অপরিবর্তিত থাকার কথা বলেছেন। token-এর অনুমোদিত পরিমাণ একই রেখে rate অর্ধেক হলে API-সমতুল্য মূল্যও অর্ধেক হতে পারে। subscriber কম token বা সম্পন্ন কাজ পাচ্ছেন কি না, তা জানতে অন্য মাপ দরকার। পোস্টের অঙ্কে সেই প্রশ্নের উত্তর নেই।

বড় পরিবর্তন

  • কী বদলেছে: স্থানীয় Codex log-এ token-এর তথ্য দেখা যায়। তৃতীয় পক্ষের tool সেগুলোকে API-র ডলারে হিসাব করে, আর OpenAI subscription meter-এ আলাদা allowance ব্যবহার করে।
  • কেন গুরুত্বপূর্ণ: subscription কেনা পাঠকের দেখা উচিত মাসিক ফির বিনিময়ে কত কাজ সম্পন্ন হয়। API-ডলারের হিসাব কমে গেলে আপাত সাশ্রয়ের তুলনা বদলাতে পারে, কিন্তু মাসিক ফিতে কম কাজ মিলছে কি না তা বোঝায় না।
  • কী লক্ষ করবেন: provider-রা model, গতি, token-এর ধরন ও cache ব্যবহারের সঙ্গে allowance থেকে কাটা পরিমাণ মেলানো record প্রকাশ করে কি না। তেমন record থাকলে release ভেদে subscription-এর মূল্য তুলনা করা এবং quota থেকে বিতর্কিতভাবে কেটে নেওয়া পরিমাণ খতিয়ে দেখা সহজ হবে।

quota নিয়ে কোনো অনুমান করার আগেই ৫০% ফলটি মেলে

OpenAI-এর বর্তমান Standard, short-context API rate অনুযায়ী GPT-5.6 Sol-এ প্রতি ১ মিলিয়ন input token-এর দাম $4 এবং output token-এর $20। GPT-6 Sol-এ যথাক্রমে $2 ও $10। এগুলো হলো প্রকাশিত API rate; GPT-6 Sol-এর model page-এ ২৭২,০০০ input token পেরোলে long-context-এর বেশি rate দেখানো হয়েছে।

short-context সীমার মধ্যে থাকা একাধিক request-এ ভাগ করে, cache না-হওয়া মোট ১ মিলিয়ন input token ও ১ মিলিয়ন output token-এর নির্দিষ্ট কাজের জন্য হিসাবটি হলো:

মডেল

input-এর হিসাব

output-এর হিসাব

API-সমতুল্য মোট

GPT-5.6 Sol

১M × $4

১M × $20

$24

GPT-6 Sol

১M × $2

১M × $10

$12

Standard গতিতে OpenAI-এর Codex credit table-এ একই cache-বিহীন input/output পরিমাণের জন্য ৬০০ বনাম ৩০০ credit দেখানো হয়েছে। পৃষ্ঠাটিতে বলা আছে, credit-এর দাম একা subscription-এ অন্তর্ভুক্ত ব্যবহার নির্ধারণ করে না।

শুধু নতুন দাম প্রয়োগ করলেও এমন ফল আসতে পারে। ওই account-এর হিসাব পুনরায় মেলাতে token-এর ধরন ও settings দরকার, যা পোস্টে আগে-পরে মেলানো তথ্য হিসেবে দেওয়া হয়নি।

ccusage কী মাপে

এই ccusage Codex নথিতে বলা হয়েছে, Codex support-কে পরীক্ষামূলক ধরা হয়। tool-টি স্থানীয় session file থেকে token_count event-গুলো পড়ে, সেগুলোকে turn_context-এ থাকা model অনুযায়ী ভাগ করে, তারপর pricing dataset থেকে model-এর দাম প্রয়োগ করে। এর প্রতিবেদন API-সমতুল্য হিসাব; ChatGPT credit balance থেকে যে এটি আলাদা, নথিতে স্পষ্টভাবে তা বলা হয়েছে।

ব্যয়ের সূত্রে সাধারণ input, cached input ও output আলাদা করে হিসাব করা হয়। reasoning token output billing-এর মধ্যে পড়ে। নথিতে থাকা Standard বা Fast service tier-ও হিসাব পাল্টাতে পারে। তাই প্রতি quota percentage point-এ ডলারের অঙ্ক কমা মানে দুটি আলাদা record একত্র করা: স্থানীয় log-এর token-এর দাম এবং OpenAI-এর subscription limit-এর পরিবর্তন।

cache hit ও context-এর দৈর্ঘ্যে token-এর খরচ কেন বদলায়, আরও জানতে BIG CHANGE-এর GPT-6 prompt caching নির্দেশিকা দেখুন। আমাদের GPT-6 ও Claude-এর দামের তুলনা বাজারে API rate-এর পরিবর্তনটি দেখায়। কোনো নিবন্ধই subscription quota-র প্রমাণ দেয় না।

অন্তর্ভুক্ত ব্যবহার সম্পর্কে OpenAI কী জানায়

OpenAI-এর হিসাবে Pro 20x-এ স্থানীয় Codex-এ GPT-6 Sol-এর ৩০০ থেকে ৩,০০০টি message প্রতি পাঁচ ঘণ্টায় চালানো যায়; GPT-5.6 Sol-এ সেই অনুমান ২০০ থেকে ২,০০০। সাপ্তাহিক সীমা প্রযোজ্য হতে পারে, তবে পৃষ্ঠাটিতে সাপ্তাহিক token cap দেওয়া নেই। model, context, reasoning, tool, retrieval ও caching অনুযায়ী এই পরিবর্তনশীল অনুমান বদলায়। Reddit পোস্টের account-এ আগে ও পরে কত allowance ছিল, তা এগুলো প্রতিষ্ঠা করে না।

২২ সেপ্টেম্বরের Codex changelog কম token মূল্যে GPT-6 Sol ও Luna চালুর কথা জানায়। অন্তর্ভুক্ত subscription usage কমানোর কথা এতে নেই।

দাবিটির নিষ্পত্তিতে যে প্রমাণ দরকার

তিনটি মাপ তিনটি আলাদা প্রশ্নের উত্তর দেয়:

প্রশ্ন

ন্যূনতম কার্যকর record

API-সমতুল্য মূল্য কমেছে কি?

একই token-এর সংখ্যা প্রতিটি model-এর প্রকাশিত দাম দিয়ে গুণ করুন। উত্তর ইতিমধ্যেই হ্যাঁ।

GPT-6 Sol কি meter-এ ভিন্ন হারে খরচ করে?

একই account ও plan-এ মিলিয়ে নেওয়া task, reasoning ও গতির স্থির setting, নথিবদ্ধ input/cached/output token এবং একাধিকবার চালিয়ে dashboard-এর আগের ও পরের percentage।

plan-এর quota-ই কি কমানো হয়েছে?

অভিযোগ করা পরিবর্তনের আগে ও পরে, তুলনীয় reset window জুড়ে একই model, setting ও workload-এর মাপ।

ব্যবহার বদলায় বলে tool call, retrieval, context বৃদ্ধি ও cache-এর অবস্থা নথিবদ্ধ করতে হবে। একই task-এ agent-এর দুই run ভিন্ন পথে এগোতে পারে, তাই পুনরাবৃত্তি জরুরি।

API-সমতুল্য মূল্য কমার প্রতিবেদনটি নতুন দামের সঙ্গে মেলে। subscription-এ কম কাজ পাওয়া যাচ্ছে কি না, তা এখনও অমীমাংসিত। token, task-এর ফল ও meter-এর পরিবর্তনকে যুক্ত করা মেলানো record প্রশ্নটির উত্তর দিতে পারে; শুধু এই হিসাব quota কমানো নিশ্চিত করতে পারে না, আবার meter-এর সমস্যার সম্ভাবনাও নাকচ করে না।