Anthropic ने १ सप्टेंबर रोजी Claude Fable 5.1 आणि Claude Mythos 5.1 लाँच केले. दोन्ही मॉडेल्स आता १ दशलक्ष (1 million) टोकन्सचा कॉन्टेक्स्ट स्वीकारू शकतात, १२८k टोकन्सपर्यंत आउटपुट देऊ शकतात आणि खर्चात कपात करताना त्यांच्या तर्काची खोली (reasoning depth) गरजेनुसार बदलू शकतात. हे अपग्रेड्स केवळ बेंचमार्क स्कोअर सुधारण्यासाठी नसून, स्वस्त आणि अधिक विश्वसनीय AI-आधारित कोडिंग आणि उच्च-जोखीम असलेल्या संशोधनासाठी (high-stakes research) आहेत.

नवीन आवृत्त्या का महत्त्वाच्या आहेत

मागील Claude पिढीमध्ये कॉन्टेक्स्ट विंडो काही हजार टोकन्सपर्यंत मर्यादित होती, ज्यामुळे डेव्हलपर्सना कोड किंवा डेटा मॅन्युअली विभाजित करावा लागत असे. वापरकर्त्यांना तर्काची खोली (reasoning depth) देखील मॅन्युअली सेट करावी लागत असे, ज्यामुळे साध्या प्रॉम्प्टचे रूपांतर 'प्रयत्न आणि त्रुटी' (trial-and-error) च्या खेळात होत असे. कॅश-रीड (Cache-read) शुल्कामुळे लांब सत्रे आणि वारंवार होणारे टूल कॉल्स महाग पडत होते, आणि सुरक्षा टीम्सनी कोड रिव्ह्यूचा वेग कमी करणाऱ्या चुकीच्या (false-positive) चेतावणींच्या अतिरेकाबाबत तक्रारी केल्या होत्या.

Claude Fable 5.1 आणि Claude Mythos 5.1 या समस्यांवर थेट प्रहार करतात. दोन्ही मॉडेल्सचे मूळ मेंदू (core brain) एकच आहे, परंतु Anthropic प्रत्येक मॉडेलच्या लक्ष्यित प्रेक्षकांनुसार त्यावर वेगवेगळे सुरक्षा नियम (guardrails) लागू करते.

या बदलांमुळे नेमके काय होते

  • खर्च कमी करणे – Anthropic ने कॅश रीडच्या (cache reads) किमती कमी केल्या आहेत, त्यामुळे आता लांब, पुनरावृत्ती होणाऱ्या कोडिंग सत्रांचा आणि वारंवार होणाऱ्या टूल कॉल्सचा खर्च लक्षणीयरीत्या कमी झाला आहे—जे स्टार्टअप्स आणि इन-हाऊस डेव्हलपमेंट टीम्ससाठी एक निर्णायक घटक आहे.
  • अनुकूल विचार प्रक्रिया (Adaptive thinking) – एखादे कार्य पूर्ण करण्यासाठी किती तर्काची (reasoning) आवश्यकता आहे, याचा निर्णय मॉडेल स्वतः घेते. वापरकर्त्यांना आता "प्रयत्न पातळी" (effort levels) बदलण्याची किंवा किती 'चेन-ऑफ-थॉट' प्रॉम्प्टिंग आवश्यक आहे याचा अंदाज लावण्याची गरज नाही.
  • टर्न-स्कोप्ड मेसेजेस (Turn-scoped messages) – सिस्टम-लेव्हल सूचना केवळ एका विशिष्ट संवादासाठी लागू होतात, ज्यामुळे जुन्या सूचना नंतरच्या संवादांमध्ये अडथळा आणू शकत नाहीत.
  • सुरक्षा सुधारणा – Claude Code वापरकर्त्यांनी सायबर सुरक्षा क्षेत्रातील 'फॉल्स-पॉझिटिव्ह' (false positives) चेतावणींमध्ये सुमारे ६०% घट झाल्याचे नोंदवले आहे, ज्यामुळे काल्पनिक चेतावणींचा पाठलाग करण्यात जाणारा वेळ वाचला आहे.
  • त्रुटी शोधणे (Vulnerability detection) – Fable 5.1 सॉफ्टवेअरमधील त्रुटी शोधते परंतु एक्सप्लॉइट कोड (exploit code) तयार करण्यास प्रतिबंधित आहे, ज्यामुळे ऑडिटर्सची उत्पादकता कायम राहते आणि दुर्भावनापूर्ण घटकांना संधीही मिळत नाही.
  • उच्च-जोखीम संशोधनावर लक्ष केंद्रित करणे – Mythos 5.1 सायबर सुरक्षा आणि लाइफ सायन्सेसमधील विश्वसनीय प्रोग्राम्सना सेवा देते. Anthropic या मॉडेलची सायफर डिझाइन (cipher design) सारख्या कामांवर चाचणी घेते आणि त्यानंतर त्यातून मिळालेले निष्कर्ष सामान्य-उद्देशीय Fable मॉडेलमध्ये समाविष्ट करते.

कोणाला फायदा होईल आणि कोण मागे सुटू शकते

IDE असिस्टंट, CI पाइपलाइन किंवा कस्टम बॉट्स तयार करणारे डेव्हलपर्स पैसे वाचवू शकतील आणि सुरक्षाविषयक अडथळे कमी होतील. सुरक्षा विश्लेषक आणि बायोटेक संशोधक जे Anthropic च्या विश्वासार्हतेच्या निकषांची पूर्तता करतात, ते संवेदनशील कामांसाठी Mythos 5.1 च्या अधिक कडक सुरक्षा नियमांचा (guardrails) वापर करू शकतात. याचा तोटा असा की, Mythos सर्वसामान्यांसाठी खुले नाही, त्यामुळे विश्वसनीय-प्रोग्राम संबंध नसलेल्या लहान टीम्सना अधिक लवचिक असलेल्या Fable 5.1 वर अवलंबून राहावे लागेल.

संभाव्य तोटे किंवा उघड्या प्रश्नांची सुटका

एक्सप्लॉइट जनरेशन रोखल्यामुळे 'रेड-टीम' (red-team) वापरकर्त्यांना त्रास होऊ शकतो, ज्यांना संरक्षणाची चाचणी घेण्यासाठी वास्तववादी अटॅक कोडची आवश्यकता असते. "ट्रस्टेड-प्रोग्राम" प्रवेशामुळे एआय मार्केटमध्ये दोन स्तर निर्माण होऊ शकतात, जिथे केवळ मोठ्या संस्थांनाच सर्वात सुरक्षित आणि उच्च-क्षमता असलेले मॉडेल उपलब्ध होईल. जरी कॅश-रीडचे दर कमी झाले असले तरी, Anthropic ने पूर्ण खर्च मॉडेल (cost model) जाहीर केलेले नाही, ज्यामुळे मोठ्या कामांसाठी (massive workloads) नेमकी किती बचत होईल याबद्दल डेव्हलपर्सना अनिश्चितता आहे.

पुढे काय पाहावे

खर्च आणि सुरक्षेची आश्वासने वास्तविक उत्पादकता वाढीमध्ये रूपांतरित होतात की नाही, हे स्वीकारण्याचे प्रमाण (adoption rates) दर्शवेल. जर डेव्हलपर्सनी मोठ्या कोडबेससाठी 1 M-टोकन विंडोला पसंती दिली, तर Anthropic ला Mythos-स्तरीय सुरक्षा नियम व्यापक प्रेक्षकांसाठी खुले करण्यासाठी दबाव जाणवू शकतो. नवीन सुरक्षा व्यवस्था हल्ल्यांच्या परिस्थितीत कशी टिकून राहते, हे मोजण्यासाठी फॉल्स-पॉझिटिव्हमधील घट आणि व्हल्नेरेबिलिटी-स्कॅनिंग पाइपलाइनवरील परिणाम यावर लक्ष ठेवा.

निष्कर्ष: Claude Fable 5.1 आणि Claude Mythos 5.1 चे उद्दिष्ट केवळ बेंचमार्क मोडणे नसून, संवेदनशील उपयोगांसाठी सुरक्षा मजबूत करताना दीर्घकाळ चालणाऱ्या AI वर्कफ्लोचा खर्च कमी करणे हे आहे.