Anthropic wprowadziło Claude Fable 5.1 oraz Claude Mythos 5.1 1 września. Oba modele obsługują teraz okno kontekstowe o wielkości 1 miliona tokenów, mogą generować do 128 tys. tokenów i dynamicznie dostosowywać głębię rozumowania — a wszystko to przy jednoczesnym obniżeniu kosztów pojedynczego wywołania. Ulepszenia te mają na celu zapewnienie tańszego i bardziej niezawodnego programowania wspomaganego przez AI oraz prowadzenie zaawansowanych badań, a nie tylko uzyskiwanie wyższych wyników w benchmarkach.
Dlaczego nowe wersje są istotne
Poprzednia generacja Claude ograniczała okna kontekstowe do kilku tysięcy tokenów, co zmuszało programistów do ręcznego dzielenia kodu lub danych. Użytkownicy musieli również ręcznie ustawiać głębię rozumowania, co zmieniało proste zapytanie w grę metodą prób i błędów. Opłaty za odczyt z pamięci podręcznej (cache-read) sprawiały, że długie sesje i powtarzalne wywołania narzędzi były kosztowne, a zespoły ds. bezpieczeństwa skarżyły się na falę fałszywych alarmów (false-positive), które spowalniały przeglądy kodu.
Claude Fable 5.1 i Claude Mythos 5.1 bezpośrednio rozwiązują te problemy. Modele te dzielą ten sam rdzeń, ale Anthropic stosuje inne zabezpieczenia (guardrails) dla każdego z nich, aby dopasować je do docelowej grupy odbiorców.
Co faktycznie zmieniają te ulepszenia
- Niższe koszty – Anthropic obniżyło cenę odczytu z pamięci podręcznej, dzięki czemu długie, iteracyjne sesje programistyczne i powtarzalne wywołania narzędzi kosztują teraz znacznie mniej — co jest kluczowym czynnikiem dla startupów i wewnętrznych zespołów deweloperskich.
- Adaptacyjne myślenie – Model na bieżąco decyduje, jak dużej analizy wymaga dane zadanie. Użytkownicy nie muszą już przełączać „poziomów wysiłku” ani zgadywać, jak bardzo rozbudowany musi być prompt typu chain-of-thought.
- Wiadomości ograniczone do tury – Instrukcje na poziomie systemowym mają zastosowanie tylko do pojedynczej wymiany zdań, co zapobiega przenikaniu nieaktualnych wytycznych do późniejszych etapów rozmowy.
- Poprawa bezpieczeństwa – Użytkownicy Claude Code zgłaszają o około 60 % mniej fałszywych alarmów w obszarze cyberbezpieczeństwa, co drastycznie skraca czas poświęcany na śledzenie widmowych ostrzeżeń.
- Wykrywanie podatności – Fable 5.1 wykrywa błędy w oprogramowaniu, ale ma zakaz generowania kodu exploitów, co pozwala audytorom pracować wydajnie, nie otwierając jednocześnie drzwi dla cyberprzestępców.
- Koncentracja na badaniach o krytycznym znaczeniu – Mythos 5.1 służy zaufanym programom w dziedzinie cyberbezpieczeństwa i nauk o życiu (life sciences). Anthropic poddaje go testom obciążeniowym w zadaniach takich jak projektowanie szyfrów, a następnie wykorzystuje uzyskane wnioski do ulepszenia ogólnego modelu Fable.
Kto zyskuje, a kto może zostać pominięty
Deweloperzy budujący asystentów IDE, potoki CI lub niestandardowe boty zaoszczędzą pieniądze i będą rzadziej rozpraszani przez błędy bezpieczeństwa. Analitycy bezpieczeństwa i badacze biotechnologiczni, którzy spełniają kryteria zaufania Anthropic, mogą korzystać z bardziej rygorystycznych zabezpieczeń Mythos 5.1 w przypadku wrażliwych zadań. Ceną za to jest fakt, że Mythos pozostaje niedostępny dla szerokiej publiczności, więc mniejsze zespoły, które nie mają statusu „zaufanego programu”, muszą polegać na bardziej otwartym modelu Fable 5.1.
Potencjalne wady lub otwarte pytania
Blokowanie generowania exploitów może frustrować użytkowników z grup red-team, którzy potrzebują realistycznego kodu ataków do testowania systemów obronnych. Bariera „zaufanego programu” może doprowadzić do powstania dwupoziomowego rynku AI, na którym tylko dobrze dofinansowane organizacje będą miały dostęp do najbardziej bezpiecznego i wydajnego modelu. Mimo że ceny odczytu z pamięci podręcznej spadły, Anthropic nie ujawniło pełnego modelu kosztów, co pozostawia deweloperów w niepewności co do realnych oszczędności przy masowych obciążeniach.
Na co warto zwrócić uwagę
Tempo adopcji pokaże, czy obietnice dotyczące kosztów i bezpieczeństwa przełożą się na realny wzrost produktywności. Jeśli deweloperzy zaczną preferować okno 1 M-tokenów do pracy z dużymi bazami kodu, Anthropic może odczuć presję, aby udostępnić zabezpieczenia na poziomie Mythos szerszemu gronu odbiorców. Należy śledzić częstotliwość redukcji fałszywych alarmów oraz wpływ na potoki skanowania podatności, aby ocenić, jak nowa postawa w zakresie bezpieczeństwa radzi sobie w warunkach intensywnych ataków.
Podsumowanie: Claude Fable 5.1 i Claude Mythos 5.1 nie mają na celu przede wszystkim bicia rekordów w benchmarkach, lecz redukcję kosztów długotrwałych procesów AI przy jednoczesnym wzmocnieniu siatek bezpieczeństwa dla najbardziej wrażliwych zastosowań.
