Qwen-Image-2.1: otwarte wagi i przezroczyste PNG, ale tylko do badańCzytaj →
News

Claude Fable 5.1: ta sama cena na papierze, w praktyce nawet 45% taniej

Anthropic wydał Claude Fable 5.1: cena bazowa 10/50 USD bez zmian, ale odczyt z cache tańszy o 75%, do 45% oszczędności na pracy agentowej.

Wykres pokazujący spadek realnego kosztu Claude Fable 5.1: cena bazowa bez zmian, słupek kosztu pracy agentowej niższy o 45%

Anthropic wydał 1 września Claude Fable 5.1, aktualizację swojego najdroższego i najmocniejszego modelu. Na cenniku nic się nie zmienia: dalej jest to 10 USD za milion tokenów na wejściu i 50 USD na wyjściu. A jednak w praktyce Fable potaniał. Odczyt z pamięci podręcznej kosztuje teraz o 75 procent mniej, co ścina rachunek za typowe zadanie o mniej więcej jedną czwartą, a za pracę agentową nawet o 45 procent. Do tego model według Anthropic bije Opus 5 w kodowaniu i rzadziej blokuje legalną pracę w Claude Code.

Skąd oszczędność, skoro cena bazowa stoi w miejscu

Sekret jest w pamięci podręcznej. Kiedy pracujesz z modelem nad jednym projektem, ten sam kontekst, czyli twój kod, instrukcje i historia rozmowy, wraca do modelu przy każdym kroku. Zamiast liczyć go za każdym razem od nowa po pełnej stawce, model czyta go z cache po stawce obniżonej. W Fable 5.1 ten odczyt zszedł do 0,25 USD za milion tokenów, czyli o 75 procent taniej niż wcześniej.

Dla kogoś, kto klika prostą aplikację, różnica będzie mała, bo krótkie rozmowy prawie nie korzystają z cache. Ale przy pracy agentowej, gdzie model wykonuje dziesiątki kroków nad tym samym projektem, oszczędność sięga deklarowanych 45 procent. To jest dokładnie ten scenariusz, w którym używa się najdroższego modelu, więc obniżka trafia tam, gdzie boli najbardziej.

Wyniki w kodowaniu

Anthropic pokazuje skok jakości w zadaniach, które dotyczą pisania i uruchamiania kodu:

  • Terminal-Bench 4.0 (kodowanie agentowe w terminalu): 55,8 procent wobec 42,0 procent w Fable 5.
  • Terminal-Bench-Science 0.1 (agentowa praca badawcza): 52,6 procent, ponad dwa razy tyle co 24,7 procent u Fable 5. Dla porównania Opus 5 uzyskał tu 29,0 procent, a GPT-5.6 Sol 22,4 procent.
  • CursorBench 3.2.0: 73,4 procent wobec 70,5 procent.

Jak zawsze przy benchmarkach od producenta, to liczby z własnych testów Anthropic, więc traktuj je jako punkt startu, nie jako niezależny wyrok. Firma podpiera je jednak opiniami klientów: Jane Street twierdzi, że model „rozwiązuje więcej naszych problemów z kodem niż Fable 5 czy Opus 5”, a Block mówi, że jest „znacznie wydajniejszy w przeliczeniu na token niż Opus 5”. Ta wydajność na token jest ważniejsza niż sam wynik w tabeli, bo to ona decyduje o rachunku.

Mniej fałszywych alarmów w Claude Code

Druga zmiana, mniej efektowna, ale dla naszego czytelnika bardzo praktyczna, dotyczy tego, jak często model odmawia pracy bez powodu. Anthropic podaje, że filtry związane z cyberbezpieczeństwem uruchamiają się teraz o 60 procent rzadziej w przeliczeniu na sesję, a zabezpieczenia biologiczne o 85 procent rzadziej przy niewinnych prośbach. W praktyce oznacza to, że Claude Code rzadziej blokuje twoją legalną robotę, biorąc zwykłą operację na plikach albo skrypt za coś groźnego. Model pozwala teraz wykrywać luki w kodzie, choć nadal nie pomaga w budowaniu exploitów.

Czym jest Mythos 5.1

Przy okazji Anthropic wydał też Mythos 5.1. To ten sam model co Fable 5.1, ale z obniżonymi zabezpieczeniami, udostępniany wyłącznie przez programy zaufanego dostępu dla cyberbezpieczeństwa i nauk przyrodniczych, na razie tylko dla organizacji z USA. Dla twórcy aplikacji w Polsce jest praktycznie nieosiągalny. Warto o nim wiedzieć głównie jako o ciekawym podziale: Anthropic trzyma jeden mocno pilnowany model dla wszystkich i drugi, luźniejszy, dla wąskiej grupy zweryfikowanych odbiorców.

Co to znaczy dla vibe codingu

Fable to najwyższa półka Anthropic i taką pozostaje. Przy 10 i 50 USD za milion tokenów to model do trudnych, długich zadań, a nie do codziennego klikania aplikacji. Do tego drugiego dalej najrozsądniejszym wyborem jest Sonnet 5, który kosztuje 2 i 10 USD i któremu właśnie odwołano zapowiadaną podwyżkę.

Zmienia się za to rachunek opłacalności przy zadaniach, które naprawdę wymagają najmocniejszego modelu. Jeśli budujesz coś, przy czym agent pracuje godzinami nad jednym projektem, tańszy odczyt z cache i wyższa wydajność na token robią z Fable 5.1 realnie tańszą opcję niż Fable 5, a według Anthropic i cytowanych klientów lepszą i oszczędniejszą niż Opus 5. Praktyczny wniosek jest prosty. Sonnet do lekkiej roboty, Fable dopiero wtedy, gdy zadanie się o niego prosi, a od tej wersji ten drugi wybór mniej boli w portfelu.

Newsletter

Opanuj AI‑coding w 5 minut. W każdy poniedziałek.

Konkretne premiery, analizy cen i jeden trik, który przyspieszy Twoją pracę. Po polsku, bez żargonu, prosto na maila.

Zero spamu · wypisujesz się jednym kliknięciem.