Anthropic zaprezentował Claude Fable 5.1 i Claude Mythos 5.1, dwa warianty tego samego modelu, które różnią się poziomem zabezpieczeń i zasadami dostępu. Fable 5.1 jest dostępny ogólnie, natomiast Mythos 5.1 trafia wyłącznie do zweryfikowanych użytkowników. Dla firm najważniejsze są deklarowane obniżki kosztów, nowe reguły przechowywania danych i rzadsze blokowanie legalnych zadań.
Czym różnią się Fable 5.1 i Mythos 5.1
Anthropic opisuje Fable 5.1 jako model do programowania, pracy z wiedzą i długich zadań agentowych. Producent deklaruje wyższą skuteczność niż w Fable 5, zwłaszcza w wieloetapowym rozwiązywaniu problemów. Przy ustawieniu Low lub Medium effort nowy model ma osiągać wyniki zbliżone do poprzednika albo lepsze przy niższym koszcie. Claude Code domyślnie używa poziomu High, a Claude Cowork i Claude.ai poziomu Medium.
Mythos 5.1 ma ten sam model bazowy, ale bardziej liberalne zabezpieczenia dla wybranych prac z zakresu cyberbezpieczeństwa i nauk przyrodniczych. Dostęp otrzymają zweryfikowani uczestnicy specjalnych programów. Anthropic przygotował program biologiczny we współpracy z rządem Stanów Zjednoczonych i zapowiada nabór naukowców, jednak nie wskazuje jego daty.
Ile ma kosztować korzystanie z Fable 5.1
Przy rozliczeniach za tokeny typowe zadania mają kosztować około 25% mniej niż w Fable 5. Wynika to z obniżenia ceny odczytów z pamięci podręcznej, czyli ponownego używania wcześniej przetworzonych i zapisanych danych wejściowych. W zadaniach wymagających intensywnej pracy agentowej oszczędność może według Anthropic sięgać około 45%. Producent nie podał w materiale pełnego cennika.
Firma zapowiedziała również Enterprise Frontier Safeguards, w skrócie EFS. W tym systemie dane pozostają w infrastrukturze chmurowej kontrolowanej przez klienta, a nie przez Anthropic. Ma to zapewniać prywatność odpowiadającą zasadzie braku retencji danych, a domyślną kontrolę treści przez człowieka przeprowadzi sam klient.
EFS powstał przy współpracy z ponad 100 organizacjami oraz Amazon Web Services, Google Cloud i Microsoft Azure. System ma działać między innymi w Claude Code, Claude Enterprise, Amazon Bedrock, Google Agent Platform i Microsoft Foundry. Wdrażanie rozpocznie się etapami jesienią, ale brak daty publikacji źródła nie pozwala ustalić dokładnego terminu. Uprawnieni klienci mogą do tego czasu korzystać z Fable 5.1 bez retencji danych.
Jak model poradził sobie z kodem i badaniami
Partner testujący model na CursorBench 3.2 podał wynik 73,4% przy maksymalnym poziomie effort. W innym teście agentów przeglądarkowych Fable 5.1 wykonał 82% zadań, wobec 74% dla Opus 5 i 57% dla Fable 5. Anthropic przytacza też test firmy inwestycyjnej Millennium. Model miał ustalić przyczynę rzadkiej awarii kodu, której inżynierowie i inne modele nie potrafili wyjaśnić przez kilka lat. Wymagało to analizy biblioteki zewnętrznego dostawcy i zrzutu pamięci.
Anthropic sprawdził również zastosowania naukowe. Mythos 5.1 zaprojektował białka wiążące, które dla trzech celów uzyskały dziesięciokrotnie wyższe powinowactwo niż najlepsze projekty z konkursów Adaptyv Bio. Dla 12 celów prawie 50% projektów okazało się zdolnych do wiązania, podczas gdy producent podaje 10-15% jako typowy wynik.
Fable 5.1 wytrenował też sieć neuronową, która utworzyła dokładniejszą mapę wysokościową jednej trzeciej Wenus. Rozdzielczość szczegółów wzrosła z 10-20 km do 2-3 km, a dokładność wysokości miała poprawić się nawet o 25%. Z kolei Mythos 5.1 przyspieszył siedem otwartych modeli biologicznych maksymalnie 2,5 raza. Szacowane koszty GPU dla trzech analiz całego genomu spadły o 30-60%.
Jak Anthropic zmienił zabezpieczenia modeli
Fable 5.1 może służyć do identyfikowania podatności oprogramowania, ale nie do tworzenia exploitów. Nowe filtry cyberbezpieczeństwa mają powodować średnio około 60% mniej interwencji podczas sesji Claude Code. Zadania podwójnego zastosowania, w tym testy penetracyjne, generowanie exploitów i skanowanie podatności w plikach binarnych, nadal są przekierowywane do modeli Opus. Filtry biologiczne mają natomiast reagować o 85% rzadziej na nieszkodliwe pytania z podstaw biologii i medycyny.
Testy Mythos 5.1 objęły ryzyka chemiczne, biologiczne, cybernetyczne, ataki przez prompt injection i zachowanie podczas zadań agentowych. Anthropic nie znalazł krytycznego sposobu obejścia zabezpieczeń Fable 5.1, ale przyznaje, że oceny słabiej obejmują bardzo długie konteksty, środowiska wieloagentowe i zadania niemożliwe do wykonania. Firma wzmocniła też ochronę przed destylacją możliwości modelu. Nowe konta API nie mogą ręcznie zmieniać wcześniejszego kontekstu rozmowy z zachowaniem zapisu wcześniejszego rozumowania modelu.
Dla polskich firm oznacza to potrzebę porównywania kosztu całego zadania, a nie wyłącznie ceny pojedynczego tokena. Przy przetwarzaniu danych wrażliwych trzeba również sprawdzić dostępność EFS w używanej chmurze oraz warunki zakwalifikowania do braku retencji danych.
