Sakana AI च्या Fugu Ultra v1.1 ने नवीनतम अपडेटमध्ये Fable 5 ला मागे टाकले

Sakana AI ने त्यांच्या इंटेलिजेंट मॉडेल राउटर, Fugu Ultra v1.1 साठी एक महत्त्वपूर्ण अपडेट जारी केले आहे, ज्यामध्ये महत्त्वाच्या तांत्रिक बेंचमार्कवर कामगिरीमध्ये मोठी झेप घेतल्याचा दावा केला आहे. उत्कृष्ट तर्कक्षमता (reasoning) आणि कोडिंग क्षमता प्राप्त करण्यासाठी क्वेरीज (queries) उच्च-स्तरीय मॉडेल्समध्ये कशा प्रकारे वितरित केल्या जातात, यामध्ये सुधारणा करण्याचा हा एक धोरणात्मक प्रयत्न आहे.

बेंचमार्क तोडणे: Fugu Ultra v1.1 चा फायदा

Fugu Ultra v1.1 मधील मुख्य नाविन्य त्याच्या 'राउटिंग इंटेलिजन्स'मध्ये आहे, जे कोणत्याही दिलेल्या प्रॉम्प्टसाठी उपलब्ध असलेल्या LLMs च्या संग्रहातून सर्वात योग्य मॉडेल निवडते. Sakana AI ने कळवले आहे की, हे व्हर्जन सुरुवातीच्या v1.0 च्या तुलनेत ७.९ पॉइंट्सपर्यंत कामगिरीमध्ये वाढ देते.

विशेषतः, या राउटरने विशेष तांत्रिक मूल्यमापनांमध्ये, विशेषतः ProgramBench आणि TerminalBench 2.1 बेंचमार्कवर लक्षणीय प्रगती दर्शविली आहे. एक आश्चर्यकारक दावा करताना, Sakana ने असे म्हटले आहे की Fugu Ultra v1.1 आता बहुतेक बेंचमार्कवर Anthropic च्या Fable 5 पेक्षा सरस कामगिरी करते—जरी Fable 5 राउटरच्या निवड सूचीमध्ये (selection pool) समाविष्ट नसले तरीही. जरी या निकालांना सध्या स्वतंत्र तृतीय-पक्ष पडताळणीचा अभाव असला, तरी त्यावरून असे सूचित होते की, विद्यमान मॉडेल आर्किटेक्चरमधून उत्कृष्ट कामगिरी मिळवण्यासाठी राउटिंग लॉजिक अत्यंत कार्यक्षम होत आहे.

तांत्रिक आर्किटेक्चर आणि डेव्हलपर इंटिग्रेशन

अत्याधुनिक मॉडेल पूल राखण्यासाठी Sakana चा दृष्टिकोन अत्यंत कडक आहे; कंपनीचे म्हणणे आहे की, कोणतेही नवीन उच्च-स्तरीय मॉडेल अधिकृतपणे Fugu इकोसिस्टममध्ये समाविष्ट करण्यापूर्वी त्याला साधारणपणे दोन आठवड्यांच्या समर्पित प्रशिक्षण आणि मूल्यमापनाची आवश्यकता असते. यामुळे राउटरची निर्णय घेण्याची प्रक्रिया बाजारातील नवीनतम वेट्स (weights) आणि क्षमतांसाठी ऑप्टिमाइझ राहील याची खात्री मिळते.

डेव्हलपर्ससाठी, हे अपडेट एक नवीन Claude Code-compatible endpoint आणते, ज्यामुळे वापरकर्ते त्यांच्या टर्मिनलवरून थेट Fugu ला कॉल करू शकतात. हे इंटिग्रेशन उच्च-स्तरीय तर्कक्षमता आणि टर्मिनल-आधारित ऑटोमेशनची आवश्यकता असलेल्या इंजिनिअर्ससाठी वर्कफ्लो सुलभ करते. या तांत्रिक प्रगतीनंतरही, किंमत मागील व्हर्जनप्रमाणेच कायम आहे: $5 प्रति मिलियन इनपुट टोकन्स आणि $30 प्रति मिलियन आउटपुट टोकन्स. Fugu सध्या OpenRouter आणि Vercel सह प्रमुख प्लॅटफॉर्मद्वारे उपलब्ध आहे.

बाजारपेठेतील आव्हाने आणि नियमन हाताळणे

Fugu च्या सुरुवातीच्या लाँचनंतर झालेल्या टीकेच्या काळानंतर हे अपडेट आले आहे. सुरुवातीच्या टीकाकारांनी उच्च टोकन वापर, लॅटन्सी (latency) आणि विसंगत निकालांबाबत समस्या उठवल्या होत्या. v1.1 सह, Sakana डेव्हलपर्सचा विश्वास पुन्हा मिळवण्यासाठी कार्यक्षमता आणि विशेष कार्य कामगिरीवर (specialized task performance) अधिक भर देताना दिसत आहे.

तथापि, जागतिक स्तरावर स्वीकारण्यासाठी भौगोलिक मर्यादा अजूनही एक अडथळा आहेत. GDPR आणि इतर EU-विशिष्ट नियामक चौकटींमधील गुंतागुंत नमूद करून, Sakana AI सध्या युरोपियन युनियन (EU) किंवा युरोपियन इकॉनॉमिक एरिया (EEA) मधील वापरकर्त्यांना सेवा देत नाही. जशी "model router" श्रेणी वाढत आहे, तसे पारदर्शक आणि पडताळण्यायोग्य डेटाद्वारे या कामगिरीच्या दाव्यांची सिद्धता करण्याची Sakana ची क्षमता, स्पर्धात्मक AI क्षेत्रात त्याच्या टिकून राहण्याच्या क्षमतेची अंतिम परीक्षा असेल.

मुख्य मुद्दे

  • उत्कृष्ट बेंचमार्किंग: Fugu Ultra v1.1 मध्ये v1.0 च्या तुलनेत ७.९ पॉइंट्सची सुधारणा दिसून येते, विशेषतः Fable 5 राउटरच्या पूलमध्ये नसतानाही अनेक निकषांवर Anthropic च्या Fable 5 पेक्षा सरस कामगिरी करते.
  • डेव्हलपर-केंद्रित अपडेट्स: नवीन व्हर्जनमध्ये Claude Code-compatible टर्मिनल एंडपॉइंट जोडण्यात आले आहे, ज्यामुळे कोडिंग वर्कफ्लोसाठी इंटिग्रेशन सोपे होते.
  • कडक निवड प्रक्रिया: उच्च अचूकता आणि कामगिरी राखण्यासाठी, राउटरमध्ये जोडल्या जाणाऱ्या प्रत्येक नवीन मॉडेलसाठी Sakana दोन आठवड्यांचे मूल्यमापन चक्र वापरते.