course
GPT-5.6 Sol od OpenAI zebrał recenzje, według których zrównał się z Anthropic. Firma oceniająca Vals AI powiedziała New York Timesowi, że Sol mniej więcej dorównuje Claude Fable 5 na standardowych benchmarkach. Odpowiedź Anthropic z września 2026 to Claude Fable 5.1, określany jako najnowocześniejszy na świecie model do kodowania i pracy z wiedzą, obok jego ograniczonego bliźniaka, Claude Mythos 5.1.
Fable 5.1 utrzymuje cenę katalogową Fable 5: $10 za milion tokenów wejściowych i $50 za milion wyjściowych, a koszt odczytów z cache obniża o 75% do $0.25 za milion. Anthropic szacuje praktyczną oszczędność na około 25% dla typowych zadań rozliczanych per token i do około 45% dla mocno agentycznych. Model obsługuje okno kontekstu 1M tokenów z maksymalnym wyjściem 128K i ponad dwukrotnie przebija wynik Fable 5 w Terminal-Bench-Science 0.1.
W tym artykule omawiam wszystko, co nowe w Claude Fable 5.1: funkcje, wyniki benchmarków i realne koszty użycia. Zobacz też nasze przewodniki po Claude Fable 5 oraz porównanie Claude Opus 5 vs Claude Fable 5.
Szybkie podsumowanie
- Claude Fable 5.1 to powszechnie dostępny model graniczny Anthropic do długofalowego kodowania i badań.
- Cena katalogowa bez zmian względem Fable 5, więc oszczędność wynika wyłącznie z dużo tańszego cache'owanego kontekstu.
- Teraz wyprzedza Claude Opus 5 we wszystkich benchmarkach opublikowanych przez Anthropic, odwracając wcześniejsze przypadki przewagi Opus 5.
- Sięgaj po niego przy niepilnowanych przebiegach agentów, a do codziennej rozmowy i pisania zostań przy Sonnet 5 lub Opus 5.
- Claude Mythos 5.1 to ten sam model z luźniejszymi zabezpieczeniami w cyber i biologii; dostęp tylko na zaproszenie.
Czym jest Claude Fable 5.1?
Claude Fable 5.1 to powszechnie dostępny model graniczny Anthropic do wymagającego rozumowania i długofalowej pracy agentów. Cenowo stoi na szczycie rodziny Claude, powyżej Claude Opus 5 za $5 / $25 za milion tokenów i Claude Sonnet 5 za $2 / $10, a dokumentacja Anthropic ocenia jego opóźnienia jako wolniejsze od obu.
Za tę dopłatę dostajesz możliwości w cenie Fable 5, plus odczyty z cache za jedną czwartą dotychczasowego kosztu. Myślenie jest adaptacyjne i zawsze włączone, sterowane ustawieniem wysiłku domyślnie high w API Claude. Granica wiedzy to czerwiec 2026.
Najważniejszy wynik to Terminal-Bench-Science 0.1, agentyczny benchmark badań naukowych, gdzie Fable 5.1 uzyskuje 52.6% wobec 24.7% dla Fable 5. Anthropic łączy to z historią firmy inwestycyjnej Millennium, której starszy menedżer portfela opisał awarię rzędu jeden na milion, której jego zespół nie wyjaśnił przez 4–5 lat. Fable 5.1 zdeasemblował bibliotekę zewnętrznego dostawcy, porównał ją ze zrzutem pamięci i prześledził awarię do błędu w tej bibliotece.
Czym jest Claude Mythos 5.1?
Claude Mythos 5.1 to ten sam model co Fable 5.1, z bardziej liberalnymi zabezpieczeniami, dostępny wyłącznie przez programy zaufanego dostępu Anthropic. Nie jest to większy model ani inna architektura i Anthropic nie opublikował dla niego osobnego cennika. Jedyna różnica to zakres działań dopuszczanych przez zabezpieczenia.
Dostęp obecnie obejmuje zestaw organizacji z USA, z planem szerszej rekrutacji. Dostęp jest limitowany przez dwa programy, oba we współpracy z rządem USA:
- Cyber Verification Program obejmuje defensywne prace z zakresu bezpieczeństwa.
- Life Sciences Verification Program obejmuje profesjonalne badania i rozwój w naukach przyrodniczych.
Różnicę między bliźniakami widać w kodowaniu: Mythos 5.1 ma 60.9% w Terminal-Bench 4.0 wobec 55.8% dla Fable 5.1. Decrypt przypisał to dodatkowym zabezpieczeniom Fable, które kierują pewne ryzykowne zadania do Claude Opus 4.8, co opisaliśmy w naszym samouczku Claude Fable 5. Claude Security, produkt Anthropic do skanowania baz kodu i proponowania poprawek do przeglądu przez ludzi, działa teraz na Mythos 5.1, a nasz przewodnik po Claude Mythos 5 wyjaśnia, jak działała poprzednia generacja tego podziału.
Kluczowe funkcje Claude Fable 5.1
Pięć zmian w Fable 5.1 wpływa na to, co realnie możesz zrobić z modelem Claude, z czego jedna to decyzja cenowa, a nie czysta zdolność.
Zostaw agenta kodującego na noc
Możesz powierzyć Fable 5.1 wielogodzinne zadanie i wrócić do gotowej pracy zamiast zapętlonego procesu. Partnerzy wczesnego dostępu Anthropic byli tu wyjątkowo konkretni:
- Ron Sanzone z MongoDB opisał prototyp zbudowany w około 3 dni, gdzie model najpierw zbadał kod i dokumentację ich usług, przygotował projekt, a potem działał godzinami bez nadzoru z pętlami weryfikacyjnymi.
- Dwight Temple z Ramp zgłosił pojedynczy 38-godzinny niepilnowany przebieg dla problemu ML, który zdiagnozował wcześniejszy wynik jako artefakt etykiety, skorygował go, uruchomił 6 równoległych eksperymentów przez noc i wrócił z wynikiem oraz kolejnymi krokami.
- Ben Lafferty z Shopify ujął to wprost: model prowadzi własne zapiski, zmienia priorytety wraz ze zmianami i wznawia pracę od miejsca, w którym przerwał.
Okno kontekstu 1M tokenów i maksymalne wyjście 128K umożliwiają tak długie przebiegi, a Craig Falls z Jane Street zauważył, że Fable 5.1 pozostaje czytelny przy długich, wieloetapowych zadaniach, gdzie wcześniejsze modele robiły się trudne do śledzenia.
Anthropic mierzył bezpieczeństwo agentów na wagach Mythos 5.1, czyli tych samych parametrach z luźniejszymi zabezpieczeniami, i raportuje, że to najtrudniejszy wydany przez firmę model do złamania na zewnętrznym benchmarku wstrzyknięć promptów. Zautomatyzowany audyt zachowań wykazał, że Mythos 5.1 rzadziej próbuje i rzadziej skutecznie dokonuje reward hackingu niż Mythos 5 oraz rzadziej sięga po zasoby poza środowiskiem testowym, gdy dostaje zadanie niemożliwe do wykonania.
Anthropic wskazuje też lukę w tych badaniach: audyt ma mniejszą widoczność w ustawieniach bardzo długiego kontekstu i wielu agentów — czyli dokładnie tam, gdzie mieszczą się przebiegi rzędu 38 godzin.
Utrzymaj agenta klasy Fable w rozsądnej cenie dzięki cache
Odczyty z cache kosztują teraz $0.25 za milion tokenów, o 75% mniej, co zmienia rachunek w każdej pętli agenta, która co turę czyta ten sam kontekst. Anthropic szacuje około 25% niższy koszt dla typowych zadań rozliczanych per token i do około 45% dla złożonego kodowania i mocno agentycznych prac. Jeśli cache'owanie promptów to dla ciebie nowość, nasz przewodnik po cache'owaniu promptów wyjaśnia mechanikę.
Szukanie podatności w oprogramowaniu bez ciągłych odmów
Fable 5.1 można teraz używać do wykrywania podatności w oprogramowaniu, choć nie do opracowywania exploitów. Anthropic twierdzi, że najnowsze zabezpieczenia cyber blokują o 60% mniej fałszywych alarmów niż wcześniej, a użytkownicy Claude Code powinni widzieć średnio około 60% mniej interwencji na sesję.
Ograniczenia nie zniknęły. Testy penetracyjne, generowanie exploitów i skanowanie podatności na binariach wciąż są przekierowywane do modeli Opus Anthropic, podobnie jak prace B+R w naukach przyrodniczych. Po stronie biologii zabezpieczenia dla Fable 5.1 i Fable 5 uruchamiają się teraz o 85% rzadziej przy nieszkodliwych elementarnych pytaniach z biologii i medycyny, co rozwiązuje problem fałszywych alarmów, a nie znosi ograniczeń możliwości.
Przekaż mu problem badawczy i pozwól kopać głębiej
Fable 5.1 wytrenował sieć neuronową, która stworzyła nową mapę wysokości o wysokiej rozdzielczości, obejmującą jedną trzecią Wenus, na podstawie obrazów radarowych z misji Magellan NASA sprzed ponad 30 lat. Mapa rozróżnia obiekty w skali 2–3 km zamiast 10–20 km, a wysokości są do 25% dokładniejsze niż wcześniej. Anthropic udostępnił ją na licencji Creative Commons na Zenodo, przed misjami NASA VERITAS i ESA EnVision.
Wyniki z nauk przyrodniczych dostarczył Mythos 5.1 — warto to rozróżniać, czytając ogłoszenie szybko. Zaprojektował białkowe bindery o powinowactwach 10 razy wyższych niż najlepsze projekty zgłoszone do konkursów Adaptyv Bio na 3 celach i osiągnął odsetek skutecznych binderów bliski 50% na 12 celach, gdzie dziś typowo jest to 10–15%. Napisał też własne jądra GPU, które przyspieszyły 7 otwartych modeli deep learning do 2,5 raza przy identycznych wynikach, obniżając szacunkowe koszty GPU w analizach genomowych o 30–60%.
Jeśli pracujesz w laboratorium, ścieżka dostępu jest równie ważna jak możliwości. Program AI for Science Anthropic daje badaczom darmowe kredyty na projekty o dużym wpływie, a dla naukowców jest mocno przeceniony plan Claude Team. Firma zapowiedziała też Model Hardware Standard, który pozwala Claude bezpośrednio obsługiwać sprzęt laboratoryjny.
Trzymaj dane firmowe w swojej chmurze
Enterprise Frontier Safeguards (EFS) przechowuje dane klientów w ich własnej infrastrukturze chmurowej, a nie u Anthropic, co daje prywatność porównywalną z umową o zerowej retencji danych, a jednocześnie umożliwia wykrywanie nadużyć. Przegląd ręczny domyślnie wykonuje klient. Anthropic zbudował EFS z ponad 100 klientami oraz partnerami chmurowymi: Amazon Web Services, Google Cloud i Microsoft Azure.
Wprowadzanie zaczyna się falami od tej jesieni, obejmując Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Agent Platform Google i Microsoft Foundry. Do czasu wdrożenia kwalifikujący się klienci mogą uruchamiać Fable 5.1 z zerową retencją danych.
Jak Claude Fable 5.1 wypada w benchmarkach?
Fable 5.1 pokonuje Claude Opus 5 we wszystkich benchmarkach opublikowanych przez Anthropic, co VentureBeat odnotował jako odwrócenie wcześniejszych przypadków przewagi Opus 5. Zyski względem Fable 5 są największe w agentycznej nauce i terminalowym kodowaniu, a najmniejsze w akademickim rozumowaniu.
| Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
| GDPval-AA v2 (Elo) | 1853 | 1723 | 1824 | 1711 |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| Humanity's Last Exam (with tools) | 65.0% | 63.8% | 63.6% | Not published |
| OSWorld 2.0 (strict) | 41.7% | 36.1% | 39.6% | Not published |
Każda liczba pochodzi od Anthropic, mierzona przy włączonych produkcyjnych zabezpieczeniach Fable 5.1.
Agentystyczne badania naukowe i kodowanie w terminalu
Tu różnicę pokoleniową widać najmocniej. W Terminal-Bench-Science 0.1, który ocenia agentyczne badania naukowe prowadzone w terminalu, Fable 5.1 osiąga 52.6% wobec 24.7% dla Fable 5, 29.0% dla Opus 5 i 22.4% dla GPT-5.6 Sol.

Czytaj margines, nie miejsca po przecinku. Anthropic podaje błąd standardowy rzędu ±3.5 do 4.5 punktu na model w tym benchmarku i zaznacza, że publiczna tabela liderów umieszcza Opus 5 na 30.0% i Fable 5 na 21.4%, co ich własne ustawienia odtwarzają w granicach szumu.
Terminal-Bench 4.0, który testuje wieloetapowe kodowanie i debugowanie w wierszu poleceń, daje Fable 5.1 55.8% wobec 42.0% dla Fable 5 i 52.3% dla Opus 5. Na CursorBench 3.2.0, oceniającym kodowanie w przepływie pracy IDE, osiąga 73.4%, kilka punktów ponad Fable 5 (70.5%) i Opus 5 (70.0%).
Praca z wiedzą i przepływy biznesowe
Praca z wiedzą też się poprawia, ale w innej skali. W GDPval-AA v2, miarze jakości pracy z wiedzą w stylu Elo, Fable 5.1 ma 1853 wobec 1824 dla Opus 5 i 1723 dla Fable 5. Na tle Opus 5 to umiarkowany krok; na tle Fable 5 — wyraźny.
AutomationBench, obejmujący automatyzację przepływów biznesowych, rozdziela je znacznie mocniej: 31.4% dla Fable 5.1, 26.9% dla Opus 5 i 17.1% dla Fable 5. Anthropic zaznacza, że Fable 5 uzyskiwał zero w zadaniach, gdzie interweniowały zabezpieczenia produkcyjne, więc traktuj ten dolny wynik jako minimum.
Rozumowanie i obsługa komputera
Akademickie rozumowanie to najbardziej spłaszczony wiersz tabeli. Humanity's Last Exam daje Fable 5.1 60.9% bez narzędzi i 65.0% z nimi wobec 57.8% i 63.8% dla Fable 5 oraz 56.6% i 63.6% dla Opus 5. Anthropic nie opublikował wyniku GPT-5.6 Sol dla tego benchmarku.
Obsługa komputera wygląda mocniej i trudniej jej ufać. Fable 5.1 prowadzi w OSWorld 2.0 z 77.9% w ustawieniu partial i 41.7% w strict, wobec 75.4% i 39.6% dla Opus 5. Anthropic liczył to na sierpniowym wydaniu zadań 2026 autorów benchmarku, więc liczby nie są porównywalne z wcześniej publikowanymi wynikami OSWorld 2.0, a oba modele Fable dostawały zera w zadaniach z interwencją zabezpieczeń.
Jedno zastrzeżenie dotyczy całości tabeli. Tam, gdzie zabezpieczenia blokowały zadanie, prace cyber wykonywał Claude Opus 4.8, a prace biologiczne — Claude Opus 5, co według Anthropic raczej zaniża raportowane wyniki Fable, niż je zawyża.
Który wariant Claude wybrać?
Fable 5.1 to dobry domyślny wybór tylko wtedy, gdy zadanie trwa na tyle długo, że zły skręt kosztuje więcej niż tokeny. Do wszystkiego krótszego rodzina Anthropic wygrywa ceną i opóźnieniami, a Sonnet 5 jest rozsądnym wyborem na co dzień, zamiast któregoś z flagowców.

System wariantów ma dwie osie. Fable 5.1 i Mythos 5.1 to jeden model rozdzielony zabezpieczeniami, a ponad nimi działa ustawienie wysiłku: Low, Medium i High. Anthropic podaje, że Fable 5.1 przy Low lub Medium dorównuje lub przebija Fable 5 przy znacznie niższym koszcie, więc pokrętło wysiłku to kontrola kosztów, a nie przełącznik jakości.
Domyślne ustawienia różnią się zależnie od powierzchni, co warto wiedzieć, zanim ocenisz model po jednej sesji. Fable 5.1 domyślnie działa na High w Claude Code, Medium w Claude Cowork i na Claude.ai oraz high w API Claude.
| Use case | Pick | Why |
|---|---|---|
| Multi-hour unattended agent runs | Fable 5.1 at High effort | Holds a plan across long jobs, and $0.25 cache reads keep the loop affordable |
| Thorough repo planning and review | Opus 5 | The same 1M context window and adaptive thinking at half the price, $5 / $25, with moderate rather than slow latency |
| Everyday coding and chat | Sonnet 5 | $2 / $10 for a 1M context window, and Anthropic rates it fast |
| High-volume or latency-sensitive work | Haiku 4.5 | $1 / $5 and the fastest in the family, though it drops to a 200K context window and 64K max output |
| Defensive vulnerability research and life sciences work | Mythos 5.1 | The only route past safeguards that redirect this work to Opus models |
| Agent work you want on Fable but cannot afford at High | Fable 5.1 at Low or Medium effort | Anthropic reports results at or above Fable 5 for much less |
Ceny i dostępność Claude Fable 5.1
Fable 5.1 kosztuje $10 za milion tokenów wejściowych i $50 za milion wyjściowych — dokładnie tyle co Fable 5. Cała zmiana ceny dotyczy odczytów z cache, które spadają o 75% do $0.25 za milion.
| Rate | Price per million tokens |
|---|---|
| Input | $10 |
| Output | $50 |
| Cache read | $0.25 |
| Cache write (5 minute) | $12.50 |
| Cache write (1 hour) | $20 |
| Batch API | 50% discount on input and output |
Szacunek Anthropic dla efektu netto to około 25% niższy koszt dla typowych zadań rozliczanych per token i do około 45% dla złożonego kodowania i wysoce agentycznych prac. Nie opublikowano, czy tokeny rozumowania są rozliczane po stawce wyjściowej — co ma tu większe znaczenie niż gdzie indziej, bo myślenie jest zawsze włączone.
Fable 5.1 jest powszechnie dostępny już dziś na platformach, w tym Amazon Web Services, Google Cloud i Microsoft Azure. Mythos 5.1 nie: trafia do zweryfikowanych obrońców cyberbezpieczeństwa i naukowców przyrodniczych przez CVP i LSVP, obecnie w zestawie organizacji z USA, a Anthropic koordynuje z rządem USA rozszerzenie tego dostępu.
Dwie mniejsze zmiany dotyczą deweloperów:
- Nowe konta API utworzone od dnia premiery nie mogą już edytować wcześniejszego kontekstu Claude w rozmowie wieloturlej przy zachowaniu transkryptu wcześniejszego rozumowania — to środek przeciwko destylacji, który będzie dotyczył wszystkich kont w przyszłych wydaniach.
- W ramach Kodeksu postępowania przejrzystości treści generowanych przez AI w Akcie o AI UE, Anthropic znakuję wodą wyjścia modeli wydanych po 2 sierpnia 2026 r., a API detekcji jest w prywatnych testach.
Jak uzyskać dostęp do Claude Fable 5.1?
ID modelu, którego używają deweloperzy, to claude-fable-5-1, dostępny w API Claude od dnia premiery. Poza natywnym API Fable 5.1 jest dostępny w Claude Code, Claude Cowork, na Claude.ai i w głównych chmurach, a Amazon Bedrock, Agent Platform Google i Microsoft Foundry są wskazane jako powierzchnie wspierane przez EFS.
Minimalne wywołanie wygląda tak:
from anthropic import Anthropic
client = Anthropic()
response = client.messages.create(
model="claude-fable-5-1",
max_tokens=1024,
messages=[
{"role": "user", "content": "Trace this crash to its root cause and explain the fix."}
],
)
print(response.content[0].text)
Pełną konfigurację, w tym kontrolę kosztów i strumieniowanie, znajdziesz w naszym kompletnym przewodniku po API Claude. Nasz samouczek API Claude Fable 5 buduje asystenta zadań deweloperskich w Pythonie i wymaga tylko podmiany ID modelu, a tekst o najlepszych praktykach Claude Code opisuje przepływ pracy w terminalu, gdzie domyślnie ustawiony jest High.
Końcowe przemyślenia
Anthropic stawia na to, że granica będzie mierzona w godzinach bez nadzoru, a nie turach czatu, i wycenił Fable 5.1 tak, by ten zakład był tani. Utrzymanie ceny katalogowej przy jednoczesnym cięciu odczytów z cache o 75% to ruch ciekawszy niż jakikolwiek pojedynczy wiersz w benchmarkach, bo celuje w ten jeden typ pracy, gdzie stawka $50 za wyjście da się przeżyć.
Sam od razu wyłączyłbym Fable 5 i zostawił codzienną pracę na Sonnet 5 lub Opus 5. Zastanawia mnie liczba zer z powodu zabezpieczeń w samej tabeli Anthropic i fakt, że najbardziej uderzające wyniki naukowe pochodzą z Mythos 5.1, do którego prawie nikt z czytelników nie ma dostępu.
Jeśli chcesz wykorzystać model klasy Fable we własnym terminalu, polecam nasz kurs Claude Code 101.
FAQs
Jak Claude Fable 5.1 wypada na tle Claude Opus 5?
Claude Fable 5.1 prowadzi z Claude Opus 5 we wszystkich benchmarkach opublikowanych przez Anthropic, m.in. 52.6% do 29.0% w Terminal-Bench-Science 0.1 i 55.8% do 52.3% w Terminal-Bench 4.0. Opus 5 nadal kosztuje o połowę mniej w cenniku — $5 / $25 za milion tokenów wobec $10 / $50 w Fable 5.1 — i Anthropic ocenia jego opóźnienia jako umiarkowane, gdy Fable 5.1 jest wolniejszy. Używaj Fable 5.1 do długich niepilnowanych przebiegów agentów, a Opus 5 do codziennego kodowania i pracy z wiedzą.
Ile kosztuje Claude Fable 5.1?
Fable 5.1 kosztuje $10 za milion tokenów wejściowych i $50 za milion wyjściowych, bez zmian względem Fable 5. Odczyty z cache spadły o 75% do $0.25 za milion, zapisy do cache kosztują $12.50 dla okna 5-minutowego i $20 dla 1-godzinnego, a Batch API daje 50% zniżki na wejście i wyjście. Anthropic szacuje około 25% niższy koszt ogólny dla typowych zadań rozliczanych per token i do około 45% dla wysoce agentycznych.
Gdzie mogę uzyskać dostęp do Claude Fable 5.1?
Fable 5.1 jest powszechnie dostępny na platformach, w tym Amazon Web Services, Google Cloud i Microsoft Azure. Deweloperzy wywołują go w API Claude z ID modelu claude-fable-5-1, a działa też w Claude Code, Claude Cowork i na Claude.ai.
Jaka jest różnica między Claude Fable 5.1 a Claude Mythos 5.1?
To ten sam model z różnymi zabezpieczeniami. Fable 5.1 jest powszechnie dostępny, a Mythos 5.1 ma bardziej liberalne zabezpieczenia w cyberbezpieczeństwie i naukach przyrodniczych i jest ograniczony do Cyber Verification Program i Life Sciences Verification Program Anthropic, obecnie w zestawie organizacji z USA. Różnicę w luźniejszych zabezpieczeniach widać w kodowaniu: Mythos 5.1 ma 60.9% w Terminal-Bench 4.0 wobec 55.8% dla Fable 5.1.
Jakie ustawienie wysiłku stosować z Claude Fable 5.1?
Fable 5.1 domyślnie działa na High w Claude Code, na Medium w Claude Cowork i na Claude.ai oraz na high w API Claude. Anthropic podaje, że poziomy Low lub Medium dorównują lub przebijają Fable 5 przy dużo niższym koszcie, więc niższe poziomy są realną kontrolą kosztów, a nie degradacją. Zostaw High dla pracy agentów o długim horyzoncie, gdzie zły skręt kosztuje więcej niż tokeny.