يقلص أحدث نموذج من Anthropic، وهو Fable 5.1، تكلفة قراءة التخزين المؤقت (cache reads) بنسبة 75%، مما يؤدي إلى خفض التكاليف الإجمالية لوكلاء الذكاء الاصطناعي (AI agents) الذين يعملون لفترات طويلة بنسبة تصل إلى 45% مقارنة بالجيل السابق. تجعل هذه الخطوة من الممكن ماليًا ترك الوكلاء المستقلين يعملون لساعات — أو حتى أيام — دون إشراف بشري مستمر، وهو تحول قد يعيد تشكيل كيفية دمج المطورين للذكاء الاصطناعي في سير عمل الإنتاج.
لماذا يهم تغيير التسعير
يبدو Fable 5.1 بالفعل أرخص بنسبة 25% من سلفه في مهام الاستعلام التقليدية. ومع ذلك، فإن الخبر الأبرز هو الخصم الأكبر لمهام العمل "الوكيلية" (agentic workloads) — وهي المهام التي يحافظ فيها النموذج على السياق، ويتخذ القرارات، ويتكرر بمرور الوقت. من خلال خفض تكلفة القراءة من التخزين المؤقت للنموذج، تتيح Anthropic للوكيل إعادة استخدام المعلومات المخزنة مسبقًا دون دفع سعر الحوسبة الكامل في كل مرة. والنتيجة هي انخفاض هائل في الفاتورة لكل ساعة للوكلاء الذين يحتاجون إلى تذكر الخطوات السابقة والبناء عليها.
من روبوتات الدردشة إلى أدوات التحمل
يختلف الوكلاء عن أنظمة السؤال والجواب البسيطة، حيث يمكنهم:
- تشغيل تجربة تعلم آلي بشكل مستمر لمدة 38 ساعة (كما أظهر فريق علوم بيانات).
- تجميع نموذج أولي على مدار ثلاثة أيام (كما أفادت منصة قواعد بيانات).
- إصلاح خلل برمجِي عمره خمس سنوات من خلال اختبار الفرضيات بشكل متكرر.
تفرض كل حالة من هذه الحالات على النموذج الاحتفاظ بجسم متزايد من السياق، ومراجعة الاستنتاجات السابقة، وتعديل نهجه. يحول تسعير قراءة التخزين المؤقت الجديد هذا "التحمل" من تجربة متخصصة إلى خيار فعال من حيث التكلفة لخطوط تطوير البرمجيات اليومية.
مشهد المخاطر الجديد
تجلب الاستقلالية الأكبر مقايضة؛ فعندما يعمل الوكيل لمدة عشر ساعات، يمكن للخطأ الذي حدث في وقت مبكر أن يتفاقم، مما يهدر الوقت والموارد بناءً على فرضية خاطئة. ينتقل التحدي الأساسي من "هل النموذج ذكي بما يكفي؟" إلى "هل يمكنني الوثوق بالنموذج للتصرف بمسؤولية دون إشراف؟"
يتعين على المطورين الآن التساؤل:
- كيف سيتحقق الوكيل من خطواته الخاصة؟
- ما هي الضمانات التي تمنعه من تعزيز افتراض غير صحيح؟
- أي سجلات أو مسارات تدقيق ستكشف عما فعله الوكيل أثناء عدم وجود رقابة؟
الإجابة ليست تقنية بحتة؛ بل تتضمن أيضًا قرارات سياسية بشأن المستويات المقبولة لاتخاذ القرار الآلي.
ما يمكن للمطورين جني ثمارُه
- ميزانيات تشغيل أقل: المشاريع التي ترددت في استخدام الوكلاء المستقلين بسبب التكلفة يمكنها الآن التجربة بحرية أكبر.
- آفاق استدلال أطول: يمكن للوكلاء استكشاف مساحات حلول أكبر، مما يحسن فرص العثور على إصلاحات أو تحسينات مبتكرة.
- تقليل زمن انتقال التكرار: من خلال إعادة استخدام السياق المخزن مؤقتًا، يتجنب النموذج إعادة معالجة نفس البيانات، مما يسرع الدورات المتكررة.
وجهات النظر المعارضة والمخاوف المستمرة
لا يلغي خفض الأسعار جميع العوائق. فقد تشجع سهولة تشغيل الوكلاء لفترات طويلة المطورين على تفويض اتخاذ القرارات الحاسمة دون تحقق كافٍ، مما يزيد من خطر الأخطاء غير المكتشفة.
قد تكتشف بعض الفرق أيضًا أن أدوات المراقبة الحالية ليست مصممة للطبيعة المستمرة والقائمة على الحالة (stateful) لهؤلاء الوكلاء. وبدون إمكانية مراقبة (observability) مناسبة، قد يتم تعويض توفير التكاليف من خلال أعباء تصحيح الأخطاء لاحقًا.
ما يجب مراقبته لاحقًا
- أدوات لسجلات الوكلاء الشفافة: توقع موجة من المنصات التي تلتقط الاستدلال خطوة بخطوة، مما يسهل تدقيق الجلسات طويلة الأمد.
الخلاصة: يحول Fable 5.1 من Anthropic الوكلاء من مساعدين عرضيين إلى متعاونين دائمين وبأسعار معقولة. العقبة التالية ليست السعر، بل القدرة على الحفاظ على نزاهة هؤلاء المتعاونين أثناء عملهم دون رقابة.
