Claude Fable 5.1: taniej w pętli agentowej, surowiej wobec danych
Nowy flagowy model Anthropic obniża cenę odczytu z pamięci podręcznej do jednej czwartej i jednocześnie jako Covered Model jest wyłączony z zero data retention.
Tłumaczenie wygenerowane automatycznie przez AI. Wersja niemiecka jest oryginałem zweryfikowanym redakcyjnie.
1 września 2026 roku Anthropic opublikował Claude Fable 5.1, a dla firmy działającej w Niemczech ta premiera opowiada dwie historie, które prowadzą w przeciwne strony. Historia techniczna brzmi: model stał się wyraźnie tańszy w pętli agentowej, ponieważ Anthropic obniżył cenę odczytów z pamięci podręcznej do 0,25 dolara amerykańskiego za milion tokenów. Historia zarządcza brzmi: ten sam model został przez Anthropic sklasyfikowany jako Covered Model, wymaga obowiązkowego 30-dniowego przechowywania danych i bez wyraźnej zgody Anthropic nie jest dostępny w trybie zero data retention. Oba fakty znajdują się we własnej dokumentacji Anthropic, na dwóch różnych stronach, i tylko jeden z nich pojawia się w ogłoszeniu.
Ten tekst czyta premierę tak, jak powinna ją czytać firma, która właśnie decyduje, czy na niej budować: które specyfikacje naprawdę się liczą, co w strukturze cen jest faktem, a co modelowanym szacunkiem, co psuje się na poziomie interfejsu i dlaczego europejska droga do tego modelu prowadzi przez chmurę partnerską, a nie przez Anthropic.
01. Co faktycznie opublikowano 1 września
Anthropic opublikował Claude Fable 5.1 w dniu 1 września 2026 roku, razem z Claude Mythos 5.1. Zgodnie z własnym opisem Anthropic oba są tym samym modelem o różnych poziomach zabezpieczeń: Fable 5.1 jest ogólnie dostępny, Mythos 5.1 wyłącznie na zaproszenie, poprzez programy zaufanego dostępu. Prasa branżowa potwierdza datę oraz dostępność na wszystkich platformach od dnia premiery.
Identyfikator modelu to claude-fable-5-1, a na Amazon Bedrock anthropic.claude-fable-5-1. Model dostarczany jest przez Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry oraz Claude Platform na AWS. Jako powierzchnie Anthropic wymienia Claude Code, Claude Enterprise i Claude Platform, z różnymi ustawieniami domyślnymi poziomu wysiłku: high w Claude Code oraz medium w Claude Cowork i na claude.ai. Istnieje zobowiązanie dotyczące wycofania: na platformach prowadzonych przez Anthropic model nie zostanie wyłączony wcześniej niż 1 września 2027 roku, natomiast Bedrock i Google Cloud wyznaczają własne terminy.
Na uwagę zasługuje to, co Anthropic dopisuje w tej samej dokumentacji. Fable 5.1 opisywany jest jako model do wymagającego wnioskowania i długodystansowej pracy agentowej; jako domyślny wybór dla większości obciążeń Anthropic nadal wyraźnie zaleca Claude Opus 5, a Fable 5.1 rezerwuje na przypadki, w których Opus 5 przy wysokim poziomie wysiłku nie wystarcza. Kto musi uzasadnić zmianę wewnątrz organizacji, powinien znać to zdanie: sam producent nie zaleca swojego nowego modelu flagowego w sposób ogólny.
02. Specyfikacje, na których opiera się decyzja
Dane podstawowe pochodzą z dokumentacji modeli Anthropic i dla decyzji architektonicznej ważą więcej niż jakikolwiek ranking.
| Cecha | Claude Fable 5.1 |
|---|---|
| Okno kontekstu | 1 000 000 tokenów |
| Maksymalne wyjście | 128 000 tokenów (synchroniczne Messages API) |
| Modalności | tekst i obraz na wejściu, tekst na wyjściu, bez dźwięku |
| Stan wiedzy | czerwiec 2026 |
| Tryb myślenia | adaptacyjny, stale włączony |
| Domyślny poziom wysiłku | high |
| Identyfikator modelu | claude-fable-5-1 |
Dwie pozycje zasługują na więcej niż wiersz tabeli. Po pierwsze tryb myślenia: Fable 5.1 myśli adaptacyjnie i nieprzerwanie, a starszy tryb ręczny z thinking.type: enabled i budget_tokens nie jest już przyjmowany. Kto przenosi istniejącą integrację, musi ruszyć to miejsce w kodzie.
Po drugie okno kontekstu. Milion tokenów odpowiada według Anthropic około 555 000 angielskich słów, mierzonych obecnym tokenizerem wprowadzonym wraz z Claude Opus 4.7. Ten sam tokenizer wytwarza dla tego samego tekstu około 30 procent więcej tokenów niż poprzedni. Liczba opisująca okno kontekstu nie jest zatem informacją o pojemności, którą można lekko porównywać między generacjami modeli, a tym bardziej między dostawcami. Dla planowania budżetu liczy się to, ile tokenów faktycznie generuje Państwa własny zasób tekstów, a nie nagłówek.
Wyniki wydajnościowe ten tekst świadomie traktuje skrótowo, ponieważ są przedmiotem osobnego artykułu porównawczego. Tylko tyle, i wyraźnie jako dane producenta: Anthropic podaje dla Fable 5.1 wynik 52,6 procent w Terminal-Bench-Science 0.1 wobec 24,7 procent dla Fable 5 oraz 55,8 procent w Terminal-Bench 4.0 wobec 42,0 procent. Kolumną porównawczą we własnej tabeli Anthropic jest GPT-5.6 Sol. Obecny model flagowy OpenAI, GPT-6 Astra, ukazał się dwa dni po tej premierze i w liczbach Anthropic w ogóle nie występuje.
03. Cena: zmienił się dokładnie jeden wiersz
Dokumentacja cenowa Anthropic podaje dla Fable 5.1 następujące wartości, w dolarach amerykańskich za milion tokenów.
| Pozycja | Cena za milion tokenów |
|---|---|
| Wejście | 10,00 |
| Wyjście | 50,00 |
| Zapis pamięci podręcznej, 5 minut | 12,50 |
| Zapis pamięci podręcznej, 1 godzina | 20,00 |
| Odczyt z pamięci podręcznej (trafienie) | 0,25 |
| Batch API | 5,00 wejście i 25,00 wyjście |
Interesujący jest dokładnie jeden wiersz. W Fable 5.1 i Mythos 5.1 odczyty z pamięci podręcznej wyceniane są na 0,025-krotność ceny wejścia, podczas gdy w każdym innym modelu Claude obowiązuje mnożnik 0,1. To jedyna zmiana cenowa wobec Fable 5, którego odczyt z pamięci podręcznej kosztował 1,00 dolara amerykańskiego za milion tokenów. Wejście i wyjście pozostają bez zmian. Pełne okno kontekstu rozliczane jest według zwykłych stawek za token; dopłaty za długi kontekst nie ma.
Anthropic określa oszczędność na około 25 procent wobec Fable 5 dla typowych obciążeń i do około 45 procent dla pracy silnie agentowej. Ta liczba jest na tyle ważna, by przeczytać ją właściwie: to modelowany szacunek producenta, wynikający w całości z wiersza dotyczącego pamięci podręcznej, a nie obniżka cen. Kto wysyła zapytania rzadko odczytujące ponownie ten sam kontekst, nie oszczędza nic. Kto prowadzi pętlę agentową, która sto razy wczytuje ten sam prompt systemowy, tę samą bazę kodu i te same definicje narzędzi, oszczędza znacząco. Różnicą między tymi przypadkami jest współczynnik trafień pamięci podręcznej, a zna go wyłącznie Państwa własny profil obciążenia.
Jeszcze jeden szczegół do rachunku kosztów: jeśli inferencja zostanie przypisana do Stanów Zjednoczonych przez inference_geo: "us", obowiązuje mnożnik 1,1 dla wejścia, wyjścia, zapisu i odczytu pamięci podręcznej.
W otoczeniu konkurencyjnym ten wiersz jest jedyną realną różnicą cenową na szczycie. OpenAI również podaje dla gpt-6-astra 10 i 50 dolarów amerykańskich za milion tokenów wejścia i wyjścia, ale 1,00 dolara za wejście z pamięci podręcznej. Przy odczytach z pamięci podręcznej Fable 5.1 kosztuje więc jedną czwartą tego, co konkurent, co w długich pętlach agentowych może przesądzić o wyborze. Wszystko pozostałe w tym porównaniu, wraz z pytaniem, które liczby benchmarkowe są w ogóle porównywalne, znajduje się w osobnym tekście.
04. Co zmienia się w interfejsie i co przy tym pęka
Jako dowód długodystansowej autonomii Anthropic przywołuje jeden nienadzorowany przebieg trwający 38 godzin nad problemem uczenia maszynowego. Kto chce na tym budować, powinien jednak najpierw przeczytać listę zmian w interfejsie, ponieważ trzy z nich psują istniejący kod.
Zmiany łamiące zgodność wobec Fable 5:
- Wymuszone użycie narzędzi zwraca błąd.
- Wcześniejsze modele nie potrafią odczytać bloków myślenia Fable 5.1.
- Edycja wcześniejszych tur rozmowy unieważnia bloki myślenia.
Uzupełnienia:
- Poziom wysiłku ustawiany dla pojedynczej wiadomości (beta).
- Wiadomości systemowe obowiązujące w zakresie jednej tury (beta).
- Czytelne komunikaty o postępie między wywołaniami narzędzi przez
display: "updates"(beta). - Obniżona cena odczytów z pamięci podręcznej.
- Oznaczanie pochodzenia treści.
Dla architektur agentowych istotny jest też narzut tokenów zestawów narzędzi: computer_toolset_20260801 dokłada na zapytanie około 4500 tokenów wejściowych, a browser_toolset_20260801 około 6600. To obciążenie podstawowe występujące przy każdym pojedynczym zapytaniu i należy je uwzględnić w każdej kalkulacji kosztów. Tryb szybki, istniejący jako podgląd badawczy w Claude Opus 5 i Opus 4.8, dla Fable 5.1 nie jest dostępny.
Po stronie bezpieczeństwa Anthropic podaje, że zabezpieczenia w obszarze cyberbezpieczeństwa blokują o 60 procent mniej fałszywych alarmów niż wcześniej, a zabezpieczenia biologiczne uruchamiają się o 85 procent rzadziej przy nieszkodliwych pytaniach z zakresu biologii elementarnej. Jednocześnie całe klasy zadań pozostają wyłączone: testy penetracyjne, generowanie exploitów, skanowanie oparte na plikach binarnych oraz zadania badawcze z biologii są przekierowywane do modeli Opus. Fable 5.1 potrafi identyfikować podatności w oprogramowaniu, natomiast generowanie exploitów pozostaje zablokowane. Nowe konta API nie mogą ponadto ręcznie edytować wcześniejszego kontekstu w rozmowach wieloturowych; Anthropic uzasadnia to tym, że zamyka w ten sposób powszechną i publicznie udokumentowaną technikę destylacji. Dla zespołów, które programowo przepisują historie rozmów, jest to zmiana zachowania o bezpośrednich skutkach dla istniejących architektur.
05. Rezydencja danych: u samego Anthropic nie ma regionu UE
W tym miejscu historia inżynierska rozchodzi się z historią zarządczą. Dokumentacja Anthropic dotycząca rezydencji danych jest jednoznaczna: parametr inference_geo przyjmuje dokładnie dwie wartości, global i us. Wśród aktualnych ograniczeń napisano wprost, że dostępne są wyłącznie te dwie. Regionu inferencji w UE na własnym API Anthropic nie ma.
To samo dotyczy danych w spoczynku. Region workspace ustalany jest przy jego tworzeniu, później nie da się go zmienić, a jedyną dostępną wartością są Stany Zjednoczone.
Dwa źródła Anthropic zdają się tu sobie przeczyć i należy to powiedzieć otwarcie. Centrum pomocy dotyczące prywatności, ostatnio zaktualizowane 15 czerwca 2026 roku, podaje, że ruch klientów może być domyślnie kierowany do wybranych krajów w USA, Europie, Azji i Australii, i w tym samym tekście dodaje, że dane przechowywane są w USA. Dokumentacja platformy zna natomiast tylko dwa wymienione regiony inferencji. Pogodzenie tych zapisów leży w rozróżnieniu między trasowaniem a rezydencją: tryb global może przechodzić przez Europę, ale nie jest wybieralną gwarancją, że przetwarzanie i przechowywanie odbywają się w UE. Kto potrzebuje takiej gwarancji, tutaj jej nie znajdzie.
Sam parametr inference_geo istnieje dopiero od Claude 4.6; wcześniejsze modele odpowiadają błędem 400. Na Amazon Bedrock i Google Cloud go nie ma, tam region wyznacza punkt końcowy lub profil inferencji. Microsoft Foundry oferuje zamiast tego typ wdrożenia z amerykańską strefą danych. Parametr nie jest też dostępny przez punkt końcowy zgodny z SDK OpenAI.
Wykonalna droga europejska nie prowadzi zatem przez Anthropic, lecz przez chmurę partnerską. Bedrock i Google Cloud oferują regionalne punkty końcowe z gwarantowanym trasowaniem danych, według dokumentacji cenowej Anthropic z dopłatą 10 procent wobec punktów globalnych, i wyznaczają własne terminy cyklu życia. Czyni to również rozpowszechnione zdanie, że Claude ma rezydencję danych w UE, bo działa we Frankfurcie, w połowie prawdziwym i w efekcie mylącym: modele Claude mogą działać w regionach UE, ale podmiotem przetwarzającym jest tam dostawca chmury, a nie Anthropic. Dla konstrukcji umownej to właśnie jest cała różnica.
06. Covered Model: 30 dni przechowywania to warunek, nie opcja
Najbardziej niewygodne zdanie całej dokumentacji znajduje się na stronie Anthropic poświęconej API i przechowywaniu danych. Napisano tam o Claude Fable 5.1, Mythos 5.1, Fable 5 i Mythos 5, że modele te wymagają 30-dniowego przechowywania danych i nie są dostępne w trybie zero data retention, o ile Anthropic wyraźnie na to nie zezwoli. Zostały sklasyfikowane jako Covered Models.
W praktyce oznacza to, że organizacja pracująca dziś w trybie zero data retention nie może po prostu włączyć Fable 5.1. Musi wyraźnie aktywować 30-dniowe przechowywanie dla konkretnego workspace, w przeciwnym razie API odpowiada komunikatem 400 invalid_request_error. To nie subtelność konfiguracyjna, lecz decyzja, która w wielu firmach musi przejść przez zgodę działu ochrony danych, zanim powstanie pierwsza linia kodu integracyjnego.
Dla pełności obrazu obok tego stoją zobowiązania Anthropic: przechowywane dane, według własnych słów firmy, nigdy nie są wykorzystywane do trenowania modeli bez wyraźnej zgody, a treść rozmów nie jest domyślnie przechowywana poza wyjątkiem dotyczącym Covered Models.
Także ten, kto już wdrożył zero data retention, powinien znać granice tego trybu, węższe, niż sugeruje nazwa.
- ZDR aktywowany jest dla pojedynczej organizacji na wniosek złożony przez dział sprzedaży i nie przenosi się automatycznie na organizacje siostrzane w ramach tego samego konta.
- Nie obejmuje Batch API, Files API, wykonywania kodu, Claude for Excel ani interfejsów produktowych Claude Teams i Claude Enterprise. Claude Code przez Claude Enterprise z ZDR jest wskazanym wyjątkiem.
- CORS nie jest wspierany dla organizacji z ZDR.
- Jeśli czat lub sesja zostaną oznaczone, Anthropic może przechowywać dane wejściowe i wyjściowe do dwóch lat, również w trybie ZDR.
Kierunek jest zatem jednoznaczny i biegnie wbrew historii cenowej. Fable 5.1 jest w pętli agentowej tańszy niż każdy inny model Claude, a przy surowych regułach danych w UE jednocześnie trudniejszy do wdrożenia niż modele Claude, których na tej liście nie ma.
07. Artykuł 50: znak wodny od pierwszego dnia, z zastrzeżeniem samego Anthropic
Według Anthropic Fable 5.1 i Mythos 5.1 niosą niewidoczny znak wodny w tekście od dnia premiery. Artykuł 50 unijnego aktu o sztucznej inteligencji, który wymaga maszynowo czytelnego oznaczania treści syntetycznych, obowiązuje od 2 sierpnia 2026 roku. Anthropic stosuje oznaczenie na całym świecie, a nie tylko w UE.
Kto chce wbudować znak wodny w proces kontroli, powinien znać zastrzeżenie samego Anthropic, wyrażone wprost w centrum pomocy: wykryty znak wskazuje, że treść mogła zostać przetworzona przez Claude, jest "not fully conclusive" i sam w sobie nie potwierdza pełnego pochodzenia treści. Nie jest to zatem dowód w sensie prawnym, a oczekiwanie, że da się w ten sposób ustalić autorstwo, wykracza poza to, co twierdzi sam producent. Układ jest godny uwagi: oznaczanie jest realną cechą modelu, a jego moc dowodową relatywizuje ta sama firma, która je oferuje.
Dochodzi do tego kwestia dostępu. Interfejs wykrywania znajduje się w prywatnym podglądzie i jest otwarty wyłącznie dla uprawnionych organizacji; wymieniane są organy regulacyjne, organy ścigania, media, weryfikatorzy faktów, badacze, instytucje edukacyjne oraz organizacje społeczeństwa obywatelskiego w UE. Firma, która chciałaby sama sprawdzać napływające teksty, tą drogą obecnie tego nie zrobi.
Otaczające ramy regulacyjne, tak jak opisują je publikujące je instytucje: egzekwowanie wobec modeli AI ogólnego przeznaczenia trwa również od 2 sierpnia 2026 roku, z karami do 15 milionów euro lub 3 procent światowego rocznego obrotu dla niezgodnych dostawców takich modeli, niezależnie od tego, czy podpisali kodeks postępowania. Kodeks postępowania Komisji Europejskiej zobowiązuje sygnatariuszy do opublikowanego formularza przejrzystości, metodyki oceny ryzyk systemowych oraz ram zgodności z prawem autorskim, z przechowywaniem dokumentacji przez co najmniej dziesięć lat. Obowiązki te spoczywają na dostawcach modeli. To, co z nich wynika dla Państwa własnej organizacji, zależy od Państwa roli w łańcuchu dostaw i jest pytaniem do doradców prawnych, a nie do artykułu branżowego.
08. Co to oznacza dla decyzji podejmowanej w Niemczech
Razem wzięta premiera daje wyjątkowo klarowny obraz właśnie dlatego, że obie historie prowadzą w przeciwne strony. Technicznie Fable 5.1 jest tańszym wyborem do długich pętli agentowych, w których wciąż na nowo odczytywany jest ten sam kontekst. Regulacyjnie jest to model, którego bez 30-dniowego przechowywania w ogóle nie da się uruchomić.
Dlatego przed rozpoczęciem integracji powinny zostać rozstrzygnięte cztery pytania.
- Jaki naprawdę jest Państwa współczynnik trafień pamięci podręcznej? Cała oszczędność zależy od tego jednego wskaźnika. Proszę zmierzyć go na realnym profilu obciążenia, zanim wpiszą Państwo do budżetu 25 procent.
- Czy Państwa zgoda w zakresie ochrony danych zniesie 30-dniowe przechowywanie? Jeśli nie, Fable 5.1 nie jest opcją do czasu wyraźnej zgody Anthropic, a pytania tego nie da się obejść technicznie.
- Przez który punkt końcowy przebiega inferencja? Jeśli wymagane jest przetwarzanie w UE, droga prowadzi przez Bedrock lub Google Cloud, z dopłatą 10 procent wobec punktów globalnych, z dostawcą chmury jako podmiotem przetwarzającym i z jego własnymi terminami cyklu życia.
- Czy wystarczy Opus 5? Sam Anthropic zaleca Opus 5 jako wybór domyślny, a Opus 5 nie figuruje na liście Covered Models. Część opisanych tu pytań zarządczych w tej formie tam nie powstaje.
Nic z tego nie jest argumentem przeciwko Anthropic. Fable 5.1 to mocny model, zmiana w pamięci podręcznej jest realną poprawą dla pracy agentowej, a to, że niewygodne fakty da się czysto odczytać we własnej dokumentacji Anthropic, przemawia raczej za dostawcą niż przeciw niemu. To argument za odwróceniem kolejności: najpierw ustalić, na jakich warunkach wolno przetwarzać Państwa dane, a dopiero potem wybrać model. Czym Fable 5.1 wykazuje się w codziennej pracy, opisuje osobny tekst o możliwościach w praktyce; jak wypada w bezpośrednim zestawieniu z GPT-6 Astra, kolejny.

