Anthropic oficjalnie wprowadziło na rynek swoje wyczekiwane modele Claude Fable 5.1 oraz Mythos 5.1, odpowiadając na rosnące zapotrzebowanie na wydajne, wysokowydajne agenty AI. Ta aktualizacja koncentruje się na obniżeniu kosztów operacyjnych, dopracowaniu barier bezpieczeństwa oraz ulepszeniu zdolności rozumowania w przypadku złożonych, wieloetapowych procesów pracy.

Drastyczne obniżki kosztów dla procesów agentycznych

Jedną z najważniejszych zmian w tym wydaniu jest agresywna nowa struktura cenowa zaprojektowana z myślą o zadaniach „agentycznych” – procesach, w których AI musi wykonać wiele iteracyjnych kroków, aby osiągnąć cel. Anthropic twierdzi, że Claude Fable 5.1 jest zazwyczaj o 25% tańszy od swojego poprzednika, Fable 5, ale może oferować oszczędności sięgające nawet 45% w przypadku złożonych operacji agentycznych.

Ta ogromna redukcja jest możliwa dzięki zoptymalizowanemu cennikowi dla danych w pamięci podręcznej. Obniżając koszty danych, które zostały już przetworzone i zapisane, Anthropic sprawia, że budowanie długotrwałych, wymagających dużej ilości pamięci agentów AI, opierających się na powtarzalnym pobieraniu kontekstu, staje się ekonomicznie opłacalne dla programistów.

Wybitne możliwości programowania i rozumowania

Pierwsi użytkownicy z branży już raportują znaczące skoki wydajności. Dan Shipper, CEO Every, określił Fable 5.1 jako najsilniejszy dostępny obecnie model programistyczny, zauważając, że model ten jest nie tylko szybszy i bardziej efektywny pod względem zużycia tokenów, ale posiada także bardziej naturalny, ludzki ton konwersacji.

Ulepszenia wykraczają poza proste generowanie tekstu, obejmując również niuansową interpretację danych. Aaron Levie, CEO Box, zauważył, że agenty jego firmy korzystające z Fable 5.1 były w stanie wykryć subtelności i niejednoznaczności w zestawach danych, które poprzedni model Fable 5 całkowicie pomijał. Co więcej, model Mythos 5.1 wykazał się niezwykłą wydajnością; dane z benchmarków sugerują, że Mythos 5.1 w trybie „low reasoning” osiąga wyniki porównywalne z ustawieniami „Max reasoning” poprzedniej generacji, co stanowi ogromny skok w wydajności architektury.

Dopracowane zabezpieczenia i prywatność korporacyjna

Anthropic odnosi się również do wieloletniej krytyki dotyczącej „nadgorliwych” filtrów bezpieczeństwa. Fable 5.1 oferuje bardziej precyzyjne zabezpieczenia, co zmniejsza prawdopodobieństwo wystąpienia błędnych wyników pozytywnych przy nieszkodliwych zapytaniach, takich jak podstawowe pytania z zakresu biologii. Chociaż Mythos 5.1 utrzymuje surowsze ograniczenia biologiczne, ogólnym celem jest zapewnienie użytkownikom doświadczeń bardziej skoncentrowanych na użyteczności.

W ramach dużego sukcesu dla bezpieczeństwa korporacyjnego, Anthropic ogłosiło wprowadzenie funkcji „Enterprise Frontier Safeguards”. Funkcja ta, która zostanie wdrożona jesienią, zapewnia „pełną prywatność”, umożliwiając klientom przechowywanie danych na własnych serwerach chmurowych zamiast na infrastrukturze Anthropic. Dodatkowo, choć Fable 5.1 jest obecnie dopuszczony do identyfikowania podatności oprogramowania, Anthropic zachowuje ścisłą granicę, przekierowując zadania wysokiego ryzyka – takie jak generowanie exploitów czy testy penetracyjne – do swoich potężniejszych modeli Opus.

Kluczowe wnioski

  • Efektywność ekonomiczna: Claude Fable 5.1 oferuje do 45% niższe koszty zadań agentycznych dzięki zoptymalizowanemu cennikowi dla danych w pamięci podręcznej.
  • Wzrost wydajności: Wczesne opinie podkreślają wybitne zdolności programistyczne, lepsze radzenie sobie z niejednoznacznością danych oraz poprawioną wydajność rozumowania.
  • Zwiększona prywatność: Nowe zabezpieczenia Enterprise Frontier Safeguards pozwolą firmom na przechowywanie danych na własnych serwerach chmurowych, zapewniając całkowitą prywatność.