OpenAI ৩০ জুলাই, ২০২৬ তারিখে ঘোষণা করেছে যে GPT-5.6 API-এর খরচ এর পূর্বসূরীর তুলনায় নাটকীয়ভাবে কম হবে। তারা তিনটি স্তরীভূত মডেল—Sol, Terra এবং Luna—র পাশাপাশি ক্যাশড রিড (cached reads)-এর জন্য বড় ধরনের ছাড় দিচ্ছে।
কেন এই নতুন মূল্য নির্ধারণ গুরুত্বপূর্ণ
GPT-5 লঞ্চ হওয়ার পর থেকে, কনভারসেশনাল এজেন্ট, রিট্রিভাল-অগমেন্টেড জেনারেশন (RAG) পাইপলাইন বা বড় আকারের ডেটা-এক্সট্রাকশন টুল তৈরির ক্ষেত্রে API খরচ একটি বড় বিষয় হয়ে দাঁড়িয়েছে। Sol, Terra এবং Luna-এর জন্য ইনপুট ফি যথাক্রমে প্রতি মিলিয়ন টোকেনে $5, $2 এবং $0.20 এ কমিয়ে দিয়ে, OpenAI ডেভেলপারদের তাদের পুরো স্ট্যাক পুনরায় ডিজাইন না করেই প্রয়োজনীয় রিজনিং লেভেল বেছে নেওয়ার একটি সাশ্রয়ী উপায় দিচ্ছে। সবচেয়ে বেশি সাশ্রয় হচ্ছে Terra-এর ক্ষেত্রে, যা এখন পুরনো ফ্ল্যাগশিপ মূল্যের মাত্র ৪০% এ চলছে, এবং Luna-এর ক্ষেত্রে, যা সেই বেঞ্চমার্কের মাত্র ৪% এ রয়েছে।
তিনটি মডেলের বিস্তারিত বিবরণ
| মডেল | ইনপুট মূল্য (প্রতি ১ মিলিয়ন টোকেন) | আউটপুট মূল্য (প্রতি ১ মিলিয়ন টোকেন) | সাধারণ ব্যবহার |
|---|---|---|---|
| Sol | $5 | $30 | গভীর রিজনিং, চেইন-অফ-থট টাস্ক |
| Terra | $2 | $12 | প্রোডাকশন ওয়ার্কলোড, ভারসাম্যপূর্ণ পারফরম্যান্স |
| Luna | $0.20 | $1.20 | উচ্চ-ভলিউম, সাধারণ এক্সট্রাকশন বা ক্লাসিফিকেশন |
Sol এখনও সবচেয়ে ব্যয়বহুল তবে এটি সবচেয়ে সমৃদ্ধ রিজনিং ডেপথ প্রদান করে। Terra-কে বেশিরভাগ অ্যাপ্লিকেশনের জন্য ডিফল্ট হিসেবে রাখা হয়েছে, আর Luna হলো একটি “high-scale” বিকল্প যেখানে খরচের কথা মাথায় রেখে রিজনিং ডেপথ কিছুটা কমিয়ে দেওয়া যায়।
ক্যাশিং বিল আরও কমিয়ে আনে
OpenAI একটি ক্যাশিং লেয়ার চালু করেছে যা রিড অপারেশনগুলোতে ৯০% ছাড় দেয়। ক্যাশড ইনপুটের রেটগুলো হলো:
- Sol: $0.50 / M tokens
- Terra: $0.20 / M tokens
- Luna: $0.02 / M tokens
ক্যাশে রাইট করার খরচ সংশ্লিষ্ট ইনপুট রেটের ১.২৫ গুণ, এবং একটি ক্যাশ এন্ট্রি মুছে ফেলার (evict) আগে অন্তত ৩০ মিনিট থাকতে হবে।
কনটেক্সট-লেংথ সারচার্জ আপনাকে সঠিক ব্যবহারে বাধ্য করবে
এখন একটি রিকোয়েস্ট যদি ২৭২ K টোকেনের বেশি ইনপুট গ্রহণ করে, তবে API একটি সারচার্জ আরোপ করে। ইনপুটের ক্ষেত্রে বেস প্রাইস দ্বিগুণ হয়ে যায় এবং আউটপুটের ক্ষেত্রে ১.৫ গুণ বৃদ্ধি পায়। Sol-এর ওভারেজ রেট প্রতি মিলিয়ন টোকেনে $10 ইনপুট এবং $45 আউটপুট হিসেবে তালিকাভুক্ত করা হয়েছে, যা অস্বাভাবিক দীর্ঘ কনটেক্সটের জন্য পেনাল্টি বা অতিরিক্ত খরচ গণনা করা সহজ করে তোলে।
ডেভেলপারদের জন্য কী কী সীমাবদ্ধতা রয়েছে
এই মূল্য হ্রাসের সাথে দুটি উল্লেখযোগ্য বিষয় বাদ পড়েছে। প্রথমত, এখানে কোনো স্থায়ী ফ্রি টায়ার (free tier) নেই, যার অর্থ হলো প্রতিটি রিকোয়েস্টের জন্য চার্জ দিতে হবে, তা যত ছোটই হোক না কেন। দ্বিতীয়ত, OpenAI এখনও GPT-5.6-এর জন্য ব্যাচ-এন্ডপয়েন্ট ডিসকাউন্ট চালু করেনি, যা আগের ভার্সনগুলোতে বড় আকারের ব্যবহারকারীদের প্রতি-কল খরচ কমাতে সাহায্য করেছিল।
কীভাবে খরচ কমিয়ে রাখা যায়
- সঠিক মডেল বেছে নিন: শুধুমাত্র সেই কাজগুলোর জন্য Sol ব্যবহার করুন যেগুলোর জন্য সত্যিই গভীর রিজনিং প্রয়োজন; বেশিরভাগ প্রোডাকশন কাজের জন্য Terra ব্যবহার করুন; এবং উচ্চ-থ্রুপুট ও কম জটিলতার কাজের জন্য Luna সংরক্ষণ করুন।
- ক্যাশিং ব্যবহার করুন: প্রম্পট এবং মধ্যবর্তী ফলাফলগুলো সংরক্ষণ করুন যা বারবার ব্যবহার করা হয়; ৯০% রিড ডিসকাউন্ট মূল্যের বিশাল সাশ্রয় করতে পারে।
- কনটেক্সট দৈর্ঘ্যের দিকে খেয়াল রাখুন: ২ গুণ ইনপুট সারচার্জ এড়াতে খুব দীর্ঘ ইনপুটগুলোকে ছোট ছোট ভাগে ভাগ করুন অথবা অপ্রয়োজনীয় অংশগুলো বাদ দিন।
- ক্যাশ লাইফটাইম লক্ষ্য করুন: ক্যাশের সর্বনিম্ন মেয়াদ হলো ৩০ মিনিট।
এরপর কী
ডেভেলপারদের যেকোনো পরিবর্তনের জন্য অফিসিয়াল প্রাইসিং পেজের দিকে নজর রাখা উচিত, বিশেষ করে ক্যাশ-রাইট ফি বা কনটেক্সট-লেংথ থ্রেশহোল্ডের ক্ষেত্রে।
সারকথা: GPT-5.6-এর স্তরীভূত মূল্য নির্ধারণ এবং ব্যাপক ক্যাশিং ডিসকাউন্ট এটিকে একটি সাশ্রয়ী OpenAI মডেল করে তুলেছে, তবে ফ্রি টায়ার এবং ব্যাচ ডিসকাউন্টের অভাবের কারণে যেকোনো বড় আকারের ব্যবহারের জন্য দক্ষ খরচ ব্যবস্থাপনা (cost-management) অপরিহার্য হয়ে থাকবে।
