Sakana AI کا Fugu Ultra v1.1 تازہ ترین اپ ڈیٹ میں Fable 5 سے بہتر کارکردگی دکھاتا ہے

Sakana AI نے اپنے ذہین ماڈل روٹر، Fugu Ultra v1.1 کے لیے ایک اہم اپ ڈیٹ جاری کی ہے، جس میں اہم تکنیکی بینچ مارکس پر کارکردگی میں بڑے اضافے کا دعویٰ کیا گیا ہے۔ یہ اپ ڈیٹ اعلیٰ درجے کے ماڈلز میں سوالات (queries) کی تقسیم کے طریقے کو بہتر بنانے کی ایک تزویراتی کوشش ہے تاکہ بہترین استدلال (reasoning) اور کوڈنگ کی صلاحیتیں حاصل کی جا سکیں۔

بینچ مارکس کو توڑنا: Fugu Ultra v1.1 کا فائدہ

Fugu Ultra v1.1 کی بنیادی جدت اس کی روٹنگ ذہانت میں پنہاں ہے، جو کسی بھی دیے گئے پرامپٹ (prompt) کے لیے عوامی سطح پر دستیاب LLMs کے مجموعے میں سے سب سے موزوں ماڈل کا انتخاب کرتی ہے۔ Sakana AI کے مطابق، یہ ورژن ابتدائی v1.0 کے مقابلے میں کارکردگی میں 7.9 پوائنٹس تک کا اضافہ فراہم کرتا ہے۔

سب سے نمایاں بات یہ ہے کہ روٹر نے مخصوص تکنیکی جائزوں، خاص طور پر ProgramBench اور TerminalBench 2.1 بینچ مارکس پر نمایاں بہتری دکھائی ہے۔ ایک حیران کن دعوے میں، Sakana کا کہنا ہے کہ Fugu Ultra v1.1 اب زیادہ تر بینچ مارکس پر Anthropic کے Fable 5 سے بہتر کارکردگی دکھاتا ہے—اگرچہ Fable 5 حقیقت میں روٹر کے انتخاب کے مجموعے میں شامل نہیں ہے۔ اگرچہ ان نتائج کی فی الحال آزادانہ طور پر تیسرے فریق سے تصدیق نہیں ہوئی ہے، لیکن یہ اس بات کی نشاندہی کرتے ہیں کہ روٹنگ لاجک موجودہ ماڈل آرکیٹیکچر سے بہترین کارکردگی حاصل کرنے میں انتہائی موثر ہو رہی ہے۔

تکنیکی آرکیٹیکچر اور ڈویلپر انٹیگریشن

جدید ترین ماڈلز کے مجموعے کو برقرار رکھنے کے لیے Sakana کا طریقہ کار سخت ہے؛ کمپنی کا کہنا ہے کہ کسی بھی نئے اعلیٰ درجے کے ماڈل کو باضابطہ طور پر Fugu ایکو سسٹم میں شامل کرنے سے پہلے تقریباً دو ہفتوں کی وقف شدہ تربیت اور جانچ پڑتال کی ضرورت ہوتی ہے۔ اس سے یہ یقینی بنایا جاتا ہے کہ روٹر کا فیصلہ سازی کا عمل مارکیٹ میں موجود تازہ ترین ویٹس (weights) اور صلاحیتوں کے لیے موزوں رہے۔

ڈویلپرز کے لیے، یہ اپ ڈیٹ ایک نیا Claude Code-compatible endpoint متعارف کرواتی ہے، جس سے صارفین اپنے ٹرمینل سے براہ راست Fugu کو کال کر سکتے ہیں۔ یہ انٹیگریشن ان انجینئرز کے ورک فلو کو آسان بناتی ہے جنہیں اعلیٰ درجے کے استدلال اور ٹرمینل پر مبنی خودکاری (automation) کی ضرورت ہوتی ہے۔ ان تکنیکی پیش رفتوں کے باوجود، قیمت پچھلے ورژن کے مطابق ہی ہے: $5 فی ملین ان پٹ ٹوکنز اور $30 فی ملین آؤٹ پٹ ٹوکنز۔ Fugu اس وقت OpenRouter اور Vercel سمیت بڑے پلیٹ فارمز کے ذریعے دستیاب ہے۔

مارکیٹ کے چیلنجز اور ریگولیشن کا سامنا کرنا

یہ ریلیز Fugu کے ابتدائی آغاز کے بعد تنقید کے ایک دور کے بعد سامنے آئی ہے۔ ابتدائی ناقدین نے زیادہ ٹوکن کے استعمال، لیٹنسی (latency) اور غیر مستقل نتائج کے حوالے سے مسائل پر روشنی ڈالی تھی۔ v1.1 کے ساتھ، Sakana ڈویلپرز کا اعتماد دوبارہ حاصل کرنے کے لیے کارکردگی اور مخصوص کاموں کی کارکردگی پر زیادہ توجہ مرکوز کرتا ہوا نظر آتا ہے۔

تاہم، عالمی سطح پر اپنائے جانے کے لیے جغرافیائی حدود اب بھی ایک رکاوٹ ہیں۔ Sakana AI فی الحال یورپی یونین (EU) یا یورپی اقتصادی ایریا (EEA) کے اندر صارفین کو خدمات فراہم نہیں کرتا، جس کی وجہ GDPR اور دیگر EU سے متعلق ریگولیٹری فریم ورکس کی پیچیدگیاں بتائی گئی ہیں۔ جیسے جیسے "ماڈل روٹر" کی کیٹیگری بڑھ رہی ہے، شفاف اور قابل تصدیق ڈیٹا کے ذریعے ان کارکردگی کے دعووں کو ثابت کرنے کی Sakana کی صلاحیت، مسابقتی AI منظر نامے میں اس کی بقا کا حتمی امتحان ہوگی۔

اہم نکات

  • اعلیٰ بینچ مارکنگ: Fugu Ultra v1.1، v1.0 کے مقابلے میں 7.9 پوائنٹس کی بہتری دکھاتا ہے، اور کئی پیمانوں پر Anthropic کے Fable 5 سے بہتر کارکردگی دکھاتا ہے، باوجود اس کے کہ Fable 5 روٹر کے مجموعے میں شامل نہیں ہے۔
  • ڈویلپر مرکز اپ ڈیٹس: نیا ورژن ایک Claude Code-compatible ٹرمینل اینڈ پوائنٹ شامل کرتا ہے، جو کوڈنگ ورک فلو کے لیے آسان انٹیگریشن کو ممکن بناتا ہے۔
  • سخت انتخاب کا عمل: Sakana روٹر میں شامل کیے جانے والے ہر نئے ماڈل کے لیے دو ہفتوں کا جانچ کا دورانیہ استعمال کرتا ہے تاکہ اعلیٰ درستگی اور کارکردگی کو برقرار رکھا جا سکے۔