Przejdź do treści

Claude Opus 5 vs Fable 5 - co się zmienia dla wdrożeń produkcyjnych

Przeczytasz w 8 min.

24 lipca 2026 Anthropic udostępnił Claude Opus 5. W komunikacie prasowym pada jedno zdanie, które w mediach zdominowało narrację: model ma zbliżać się do Fable 5 przy połowie ceny. Dla osoby utrzymującej produkcyjne integracje z API to za mało. Poniżej: specyfikacja, zachowanie w runtime, warstwa bezpieczeństwa, rozliczenia i prosta decyzja, który model wziąć na start.

Porządek w rodzinie modeli

Anthropic ma dziś cztery poziomy dostępności, które łatwo pomylić, bo marketing mówi o „rodzinie Claude”, a API rozlicza osobne identyfikatory modeli.

  • Mythos 5 - model bazowy bez klasyfikatorów bezpieczeństwa. Nie jest ogólnie dostępny; trafia do wąskiej grupy organizacji w programie Project Glasswing (głównie cyberobrona i operatorzy infrastruktury).
  • Fable 5 - ten sam model bazowy co Mythos 5, ale z warstwą klasyfikatorów, które potrafią odmówić odpowiedzi. Ogólnie dostępny od 9 czerwca 2026.
  • Opus 5 - osobny model tierowy, następca Opus 4.8. Premiera 24 lipca 2026.
  • Sonnet 5 / Haiku 4.5 - niższe warstwy kosztowe na wolumen.

W większości relacji ginie prosta informacja: Fable 5 i Mythos 5 to jeden model w dwóch konfiguracjach bezpieczeństwa. Opus 5 to inna linia produktowa, z inną charakterystyką kosztową i innymi domyślnymi ustawieniami API.

Specyfikacja - zestawienie

Parametr Claude Opus 5 Claude Fable 5
API model ID claude-opus-5 claude-fable-5
Cena wejście / wyjście (za 1M tokenów) 5 USD / 25 USD 10 USD / 50 USD
Okno kontekstu 1M tokenów (domyślnie i maksymalnie) 1M tokenów
Maks. tokenów wyjścia 128k 128k
Tryb myślenia włączony domyślnie; można wyłączyć przy effort ≤ high zawsze włączony; nie da się wyłączyć
Surowy łańcuch rozumowania dostępny w standardowym trybie thinking nie zwracany (tylko podsumowanie albo pusty blok)
Poziomy effort low, medium, high, xhigh, max effort obsługiwany
Fast mode tak, ok. 2,5× szybciej, 10 USD / 50 USD brak
Minimalny cache promptu 512 tokenów -
Retencja danych brak wymogu retencji w dostępie ogólnym 30 dni; brak opcji zero data retention (Covered Model)
Dostępność Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry Claude API, Bedrock, Google Cloud, Microsoft Foundry

Dwie pozycje w tej tabeli ważą więcej niż reszta.

Retencja danych. Fable 5 i Mythos 5 są Covered Models z obowiązkową 30-dniową retencją, bez możliwości wyłączenia. Opus 5, podobnie jak Opus 4.8, nie ma takiego wymogu w dostępie ogólnym. Jeśli dział prawny wymaga zero data retention, Fable 5 odpada niezależnie od wyników benchmarków. To nie jest kwestia gustu, tylko dopuszczalności.

Fast mode. Opus 5 w trybie Fast kosztuje tyle, co Fable 5 w trybie podstawowym: 10 USD za milion tokenów wejściowych i 50 USD za milion wyjściowych. Przy zbliżonych wynikach na kodzie i knowledge work ten sam budżet kupuje albo Fable 5, albo Opus 5 działający około 2,5 raza szybciej. Fast mode jest na razie tylko na Claude API (research preview), nie na Bedrock, Google Cloud ani Microsoft Foundry.

Wyniki - co mówią liczby Anthropic

Anthropic publikuje wyniki w ujęciu efekt/koszt, nie jako pojedynczą liczbę na slajdzie. Przy planowaniu budżetu na agentów to właściwa perspektywa.

  • Frontier-Bench v0.1 (inżynieria oprogramowania): Opus 5 wyprzedza pozostałe modele i ponad dwukrotnie poprawia wynik Opus 4.8 przy niższym koszcie na zadanie.
  • CursorBench 3.2: przy maksymalnym effort Opus 5 mieści się w granicy 0,5% szczytowego wyniku Fable 5 przy połowie kosztu na zadanie.
  • OSWorld 2.0 (computer use): Opus 5 przewyższa najlepszy wynik Fable 5 przy nieco ponad jednej trzeciej kosztu.
  • ARC-AGI 3 (nowe, nieznane problemy): wynik około trzykrotnie wyższy niż kolejny model w stawce.
  • Zapier AutomationBench (zadania biznesowe end-to-end): skuteczność około 1,5 raza wyższa niż następny model przy tym samym koszcie na zadanie. Nawet na najniższym effort Opus 5 przechodzi więcej zadań niż jakikolwiek inny model w materiale Anthropic.

Różnica nie polega na tym, że jeden model jest „mądrzejszy” w abstrakcji. Opus 5 często dochodzi do podobnego wyniku zużywając mniej tokenów i taniej za token. W długich pętlach agentowych ta różnica kumuluje się na rachunku miesięcznym.

Na zadaniach cyber Opus 5 nie był celowo trenowany pod ofensywę, ale jako efekt uboczny ogólnego wzrostu możliwości zbliżył się do Mythos 5 w wyszukiwaniu podatności, pozostając z tyłu w tworzeniu exploitów. Anthropic pokazuje to m.in. na OSS-Fuzz. Do przeglądu kodu pod kątem luk Opus 5 zwykle wystarczy; do pełnego łańcucha ofensywnego nie.

Klasyfikatory, odmowy i fallback

Tu różnica między modelami wychodzi poza slajdy z benchmarków i ląduje w kodzie integracji.

Fable 5 ma klasyfikatory bezpieczeństwa, które mogą odrzucić zapytanie. Anthropic przyznaje, że nastroił je konserwatywnie: uruchamiają się średnio w mniej niż 5% sesji, także na zapytaniach nieszkodliwych. Klasyfikatory cyber w Opus 5 mają według testów Anthropic odpalać się około 85% rzadziej niż w Fable 5. W Claude.ai, Claude Code i Claude Cowork oznaczone zapytania domyślnie trafiają do Opus 4.8. Zapytania biologiczne blokowane na Fable 5 są teraz kierowane do Opus 5, nie do Opus 4.8.

W API warto pamiętać o czterech rzeczach:

  1. Odmowa nie jest błędem HTTP. Messages API zwraca stop_reason: "refusal" z kodem 200. Handler, który traktuje wszystko poza end_turn jako awarię, generuje fałszywe alarmy w monitoringu.
  2. Rozliczenie. Zapytanie odrzucone przed wygenerowaniem outputu nie jest fakturowane.
  3. Fallback. Do wyboru: server-side (parametr fallbacks, beta), client-side (middleware SDK) albo własne retry. Mechanizm fallback credit zwraca koszt cache promptu przy przełączeniu modelu.
  4. Nowość w Opus 5. Parametr fallbacks obsługuje tryb "default", który stosuje rekomendacje Anthropic według kategorii odmowy zamiast listy modelów po twojej stronie. Wymaga nagłówka beta server-side-fallback-2026-07-01.

Jeśli budujesz na Fable 5, obsługa odmowy nie jest dodatkiem. To ścieżka krytyczna obok happy path.

Co przełamuje istniejący kod przy migracji z Opus 4.8

Migracja to nie tylko zamiana identyfikatora modelu na claude-opus-5. Są dwie zmiany, które potrafią wywalić produkcję bez ostrzeżenia w changelogu, jeśli nikt ich nie przeczyta.

Thinking domyślnie włączony. Na Opus 4.8 zapytanie bez pola thinking szło bez rozumowania. Na Opus 5 to samo zapytanie uruchamia thinking, a głębokość steruje effort. Ponieważ max_tokens obejmuje łącznie rozumowanie i tekst odpowiedzi, limity ustawione pod stary tryb wymagają rewizji.

Wyłączenie thinking tylko przy effort ≤ high. thinking: {"type": "disabled"} z effort xhigh lub max zwraca błąd 400. Na Opus 4.8 oba ustawienia były niezależne.

Poza API zmienia się też styl odpowiedzi. Domyślne teksty i dokumenty są dłuższe. W sesjach agentowych model częściej raportuje postęp, chętniej deleguje do subagentów i weryfikuje własną pracę bez polecenia. Instrukcje w stylu „dodaj krok weryfikacji na końcu” albo „użyj subagenta do sprawdzenia”, przeniesione ze starszych promptów, często prowadzą do nadmiarowej weryfikacji. Przy migracji usuń je i zmierz ruch na własnym ruchu.

Na kosztach widać też drobiazg: minimalna długość promptu podlegającego cache spadła do 512 tokenów z 1024 na Opus 4.8. Krótkie prompty systemowe, które wcześniej nie łapały cache, teraz go tworzą bez zmiany kodu.

Do tego beta zmiany narzędzi w trakcie rozmowy (nagłówek mid-conversation-tool-changes-2026-07-01): można dodawać i usuwać narzędzia między turami bez unieważniania cache promptu. Dla agentów z dużą listą narzędzi, gdzie dotąd trzeba było przesyłać stały zestaw przez całą sesję, to wymierna oszczędność.

Kontekst regulacyjny

Fable 5 i Mythos 5 miały premierę 9 czerwca 2026. Trzy dni później Anthropic zawiesił dostęp do obu modeli w związku z kontrolą eksportu Departamentu Handlu USA. Ograniczenia zdjęto 30 czerwca, dostęp przywrócono 1 lipca. To nie jest teoretyczny scenariusz: dwutygodniowa przerwa już się zdarzyła.

Jeśli architektura ma jeden punkt zależności od Fable 5, warstwa fallback ma uzasadnienie nie tylko przy odmowach klasyfikatora, ale też przy ryzyku regulacyjnym na górnej półce modeli. Warstwy niższe (Sonnet, Haiku) historycznie nie były objęte tym samym cyklem wstrzymań.

Który model wybrać

Opus 5 jako domyślny. Dla większości wdrożeń produkcyjnych - kodowanie agentowe, analiza, dokumenty i arkusze, computer use, długi kontekst - Opus 5 daje wynik na poziomie Fable 5 lub wyższy przy połowie ceny i bez wymogu 30-dniowej retencji. Jest nowym modelem domyślnym w Claude Max i najmocniejszym dostępnym w Claude Pro.

Fable 5 tam, gdzie jest już zwalidowany. Działający pipeline nastrojony pod Fable 5 z mierzalnymi wynikami nie wymaga migracji „na wczoraj”. Warto jednak przeliczyć koszt: przy zbliżonej jakości płacisz dwukrotnie wyższą stawkę za token.

Mythos 5 tylko przez Project Glasswing. Nadal mocniejszy w ofensywnym cyberbezpieczeństwie i w długich, autonomicznych zadaniach badawczych z obszaru biologii. Dostęp wymaga kwalifikacji do programu.

Sonnet 5 do wolumenu. Gdy zadanie jest powtarzalne i dobrze zdefiniowane, różnica jakości zwykle nie uzasadnia stawki Opus.

W skrócie

Benchmark mówi „podobna jakość, połowa ceny”. Produkcja mówi: retencja, odmowy, max_tokens z thinkingiem i fallback. Jeśli nie masz twardego powodu, żeby zostawać na Fable 5, Opus 5 jest sensownym domyślnym wyborem od 24 lipca 2026.

Lista kontrolna przed migracją

  1. Zweryfikuj max_tokens we wszystkich wywołaniach - thinking wchodzi do tego limitu.
  2. Znajdź miejsca z thinking: {"type": "disabled"} i sprawdź effort (xhigh i max zwrócą 400).
  3. Usuń ze promptów instrukcje wymuszające weryfikację - Opus 5 robi to sam.
  4. Sprawdź handler stop_reason pod kątem wartości refusal.
  5. Skonfiguruj fallback (tryb "default" upraszcza sprawę).
  6. Przelicz koszt sesji po zmianie: niższa stawka za token, ale domyślnie włączony thinking i dłuższe odpowiedzi. Netto powinno wyjść taniej - zmierz na własnym ruchu, nie zakładaj.
  7. Zweryfikuj wymagania retencji po stronie klienta, jeśli rozważasz Fable 5.

Darmowe narzędzia analityczne

Kalkulatory i generatory dla marketerów i analityków

Encyklopedia GA4 Wszystkie zdarzenia GA4
Audytor GA4 Sprawdź konfigurację
Symulator Atrybucji Porównaj modele atrybucji
Kalkulator BigQuery Oszacuj koszty GA4 + BQ
Kreator Linków UTM/PK Taguj kampanie GA4/Piwik
Generator dataLayer Ecommerce, formularze, eventy
Kalkulator ROAS/ROI Rentowność kampanii
Kalkulator LTV Wartość życiowa klienta
Zobacz wszystkie narzędzia →

Przeczytaj również

Więcej w temacie: Sztuczna Inteligencja

Porady i wskazówki

Szybkie tipy dla analityków

Więcej porad →