Anthropic نے باضابطہ طور پر اپنے انتہائی منتظر Claude Fable 5.1 اور Mythos 5.1 ماڈلز لانچ کر دیے ہیں، جن کا مقصد موثر اور اعلیٰ کارکردگی والے AI ایجنٹس کی بڑھتی ہوئی طلب کو پورا کرنا ہے۔ یہ اپ ڈیٹ آپریشنل اخراجات کو کم کرنے، حفاظتی حدود (safety guardrails) کو بہتر بنانے، اور پیچیدہ، کثیر مرحلہ وار ورک فلو کے لیے استدلال (reasoning) کی صلاحیتوں کو بڑھانے پر مرکوز ہے۔

ایجنٹک ورک فلو کے لیے اخراجات میں نمایاں کمی

اس ریلیز میں سب سے اہم تبدیلی "ایجنٹک" (agentic) کاموں کے لیے ڈیزائن کیا گیا جارحانہ نیا پرائسنگ ڈھانچہ ہے—ایسے ورک فلو جہاں ایک AI کو مقصد مکمل کرنے کے لیے متعدد تکراری مراحل سے گزرنا پڑتا ہے۔ Anthropic کا دعویٰ ہے کہ Claude Fable 5.1 عام طور پر اپنے پچھلے ماڈل Fable 5 کے مقابلے میں 25% سستا ہے، لیکن پیچیدہ ایجنٹک آپریشنز کے لیے 45% تک کی بچت فراہم کر سکتا ہے۔

اخراجات میں یہ بڑی کمی کیش شدہ ڈیٹا (cached data) پر بہتر پرائسنگ کے ذریعے حاصل کی گئی ہے۔ پہلے سے پروسیس شدہ اور محفوظ شدہ ڈیٹا کی لاگت کم کر کے، Anthropic ڈویلپرز کے لیے ایسے طویل مدتی اور میموری پر زیادہ انحصار کرنے والے AI ایجنٹس بنانا معاشی طور پر قابل عمل بنا رہا ہے جو بار بار سیاق و سباق (context) کے حصول پر انحصار کرتے ہیں۔

کوڈنگ اور استدلال کی اعلیٰ صلاحیتیں

صنعت کے ابتدائی صارفین پہلے ہی کارکردگی میں نمایاں بہتری کی رپورٹ کر رہے ہیں۔ Every کے CEO، Dan Shipper نے Fable 5.1 کو فی الحال دستیاب مضبوط ترین کوڈنگ ماڈل قرار دیا ہے، اور نوٹ کیا ہے کہ یہ ماڈل نہ صرف تیز رفتار اور زیادہ ٹوکن-کفایت شعار (token-efficient) ہے بلکہ اس کا بات چیت کا انداز بھی زیادہ قدرتی اور انسانی ہے۔

یہ بہتری محض سادہ متن کی تخلیق تک محدود نہیں بلکہ ڈیٹا کی باریک بینی سے تشریح تک پھیلی ہوئی ہے۔ Box کے CEO Aaron Levie نے نوٹ کیا کہ ان کی کمپنی کے ایجنٹس، جو Fable 5.1 استعمال کر رہے تھے، ڈیٹا سیٹس میں ایسی باریکیاں اور ابہام (ambiguities) پکڑنے میں کامیاب رہے جنہیں پچھلا Fable 5 ماڈل مکمل طور پر نظر انداز کر گیا تھا۔ مزید برآں، Mythos 5.1 ماڈل نے غیر معمولی کارکردگی دکھائی ہے؛ بینچ مارک ڈیٹا سے پتہ چلتا ہے کہ Mythos 5.1 "low reasoning" موڈ میں پچھلی نسل کی "Max reasoning" سیٹنگز کے برابر کارکردگی دکھاتا ہے، جو کہ آرکیٹیکچرل کارکردگی میں ایک بہت بڑی چھلانگ ہے۔

بہتر حفاظتی اقدامات اور انٹرپرائز پرائیویسی

Anthropic "حد سے زیادہ سخت" حفاظتی فلٹرز کے حوالے سے طویل عرصے سے ہونے والے اعتراضات کو بھی دور کر رہا ہے۔ Fable 5.1 میں زیادہ درست حفاظتی اقدامات شامل ہیں، جس سے عام سوالات (جیسے بیالوجی کے بنیادی سوالات) پر غلط طور پر حفاظتی الرٹ (false positives) پیدا ہونے کا امکان کم ہو گیا ہے۔ اگرچہ Mythos 5.1 حیاتیاتی پابندیوں کو زیادہ سختی سے برقرار رکھتا ہے، لیکن مجموعی مقصد صارف کے تجربے کو زیادہ مفید بنانا ہے۔

انٹرپرائز سیکیورٹی کے لیے ایک بڑی کامیابی کے طور پر، Anthropic نے اپنے "Enterprise Frontier Safeguards" کا اعلان کیا ہے۔ اس موسمِ خزاں کے آخر میں متعارف ہونے والا یہ فیچر صارفین کو Anthropic کے انفراسٹرکچر کے بجائے اپنے خود کے کلاؤڈ سرورز پر ڈیٹا محفوظ کرنے کی اجازت دے کر "مکمل پرائیویسی" فراہم کرے گا۔ مزید یہ کہ، اگرچہ Fable 5.1 کو اب سافٹ ویئر کی کمزوریوں (vulnerabilities) کی نشاندہی کے لیے استعمال کرنے کی اجازت ہے، لیکن Anthropic زیادہ خطرے والے کاموں—جیسے ایکسپلائٹ جنریشن اور پینیٹریشن ٹیسٹنگ—کو اپنے زیادہ طاقتور Opus ماڈلز کی طرف موڑ کر ایک سخت حد برقرار رکھتا ہے۔

اہم نکات

  • معاشی کارکردگی: Claude Fable 5.1 کیش شدہ ڈیٹا کی بہتر قیمتوں کے ذریعے ایجنٹک کاموں کے لیے 45% تک کم اخراجات فراہم کرتا ہے۔
  • کارکردگی میں اضافہ: ابتدائی فیڈ بیک سے اعلیٰ کوڈنگ صلاحیتوں، ڈیٹا کے ابہام کو بہتر طریقے سے سنبھالنے اور استدلال کی بہتر کارکردگی کا پتہ چلتا ہے۔
  • بہتر پرائیویسی: نئے Enterprise Frontier Safeguards کاروباری اداروں کو مکمل پرائیویسی کو یقینی بنانے کے لیے اپنے کلاؤڈ سرورز پر ڈیٹا محفوظ کرنے کی اجازت دیں گے۔