أعلنت OpenAI في 30 يوليو 2026 أن واجهة برمجة تطبيقات GPT-5.6 ستكون تكلفتها أقل بكثير من سابقتها، حيث طرحت ثلاثة نماذج متدرجة — Sol وTerra وLuna — بالإضافة إلى خصومات كبيرة لعمليات القراءة المخبأة (cached reads).

لماذا تهم التسعيرة الجديدة

منذ إطلاق GPT-5، كانت تكاليف واجهة برمجة التطبيقات (API) بنداً رئيسياً في ميزانية أي شخص يقوم ببناء وكلاء محادثة، أو مسارات التوليد المعزز بالاسترجاع (RAG)، أو أدوات استخراج البيانات واسعة النطاق. ومن خلال خفض رسوم الإدخال إلى 5 دولارات و2 دولار و0.20 دولار لكل مليون رمز (token) لنماذج Sol وTerra وLuna على التوالي، تمنح OpenAI المطورين طريقة أرخص لاختيار مستوى الاستدلال الذي يحتاجون إليه دون الحاجة إلى إعادة تصميم بنيتهم التقنية بالكامل. وتظهر الوفورات بشكل أوضح في نموذج Terra، الذي يعمل الآن بنسبة 40% من سعر النموذج الرائد السابق، ونموذج Luna، الذي يمثل 4% فقط من ذلك المعيار.

تفصيل النماذج الثلاثة

النموذج سعر الإدخال (لكل 1 مليون رمز) سعر الإخراج (لكل 1 مليون رمز) الاستخدام النموذجي
Sol $5 $30 الاستدلال العميق، مهام تسلسل الأفكار (chain-of-thought)
Terra $2 $12 أعباء عمل الإنتاج، أداء متوازن
Luna $0.20 $1.20 حجم كبير، استخراج أو تصنيف بسيط

يظل Sol هو الأغلى ثمناً ولكنه يوفر أعمق مستويات الاستدلال. ويُعد Terra الخيار الافتراضي لمعظم التطبيقات، بينما يمثل Luna خياراً "عالي النطاق" حيث يمكن التضحية بالعمق مقابل التكلفة.

التخزين المؤقت (Caching) يقلل الفاتورة بشكل أكبر

قدمت OpenAI طبقة تخزين مؤقت (caching layer) تمنح خصماً بنسبة 90% على عمليات القراءة. وتكون أسعار الإدخال المخبأة كما يلي:

  • Sol: 0.50 دولار / مليون رمز
  • Terra: 0.20 دولار / مليون رمز
  • Luna: 0.02 دولار / مليون رمز

تبلغ تكلفة الكتابة في التخزين المؤقت 1.25 ضعف سعر الإدخال المقابل، ويجب أن يبقى إدخال التخزين المؤقت لمدة 30 دقيقة على الأقل قبل إمكانية إزالته.

رسوم إضافية لطول السياق لضمان الدقة

تفرض واجهة برمجة التطبيقات الآن رسوماً إضافية عندما يتجاوز الطلب 272 ألف رمز من الإدخال. يتضاعف السعر الأساسي للإدخال ويرتفع بمقدار 1.5 ضعف للإخراج. وقد حُددت أسعار التجاوز لنموذج Sol بـ 10 دولارات للإدخال و45 دولاراً للإخراج لكل مليون رمز، مما يسهل حساب الغرامة للسياقات الطويلة بشكل غير معتاد.

ما الذي سيفقده المطورون

تأتي تخفيضات الأسعار مع استثناءين ملحوظين. أولاً، لا توجد فئة مجانية دائمة، مما يعني أن كل طلب سيتكبد رسوماً مهما كانت صغيرة. ثانياً، لم تقدم OpenAI بعد خصومات لنقاط نهاية الدفعات (batch-endpoint) لنموذج GPT-5.6، وهي ميزة ساعدت المستخدمين واسعي النطاق على خفض تكلفة كل مكالمة في الإصدارات السابقة.

كيف تحافظ على خفض التكاليف

  • اختر النموذج المناسب: استخدم Sol فقط للمهام التي تحتاج حقاً إلى استدلال عميق؛ واعتمد Terra كخيار افتراضي لمعظم أعمال الإنتاج؛ وخصص Luna للوظائف ذات الإنتاجية العالية والتعقيد المنخفض.
  • استخدم التخزين المؤقت (Caching): قم بتخزين المطالبات (prompts) والنتائج الوسيطة التي يُعاد استخدامها عبر المكالمات؛ حيث يمكن للخصم بنسبة 90% على القراءة أن يفوق بكثير خفض السعر الأساسي.
  • انتبه لطول السياق: قم بتقسيم المدخلات الطويلة جداً إلى أجزاء أصغر أو اقتطع الأجزاء غير الضرورية لتجنب رسوم الإدخال المضاعفة (2×).
  • راقب مدة صلاحية التخزين المؤقت: الحد الأدنى لمدة التخزين المؤقت هو 30 دقيقة.

ما الخطوة التالية

يجب على المطورين مراقبة صفحة التسعير الرسمية لأي تعديلات، خاصة فيما يتعلق برسوم الكتابة في التخزين المؤقت أو عتبات طول السياق.

الخلاصة: تجعل التسعيرة المتدرجة لـ GPT-5.6 وخصومات التخزين المؤقت القوية منه نموذجاً اقتصادياً من OpenAI، ولكن غياب الفئة المجانية وخصومات الدفعات يعني أن الإدارة الذكية للتكاليف ستظل ضرورية لأي عملية نشر واسعة النطاق.