AI · 10 MIN

Claude Fable 5.1: goedkoper in de agentlus, strenger op data

Anthropics nieuwe vlaggenschip verlaagt de cache-leesprijs tot een kwart en is tegelijk als Covered Model uitgesloten van zero data retention.

Claude Fable 5.1: goedkoper in de agentlus, strenger op data
LOCATIE
Duitsland
AUTEUR
Aashwin Shrivastava
GEPUBLICEERD
10 sep 2026
BEELD
AI-GEGENEREERD

Vertaling automatisch gegenereerd met AI. De Duitse versie is het redactioneel gecontroleerde origineel.

Op 1 september 2026 heeft Anthropic Claude Fable 5.1 uitgebracht, en voor een onderneming in Duitsland vertelt die release twee verhalen die in tegengestelde richtingen wijzen. Het technische verhaal luidt: het model is in de agentlus duidelijk goedkoper geworden, omdat Anthropic de prijs voor cache-leesbewerkingen heeft verlaagd naar 0,25 Amerikaanse dollar per miljoen tokens. Het governanceverhaal luidt: hetzelfde model is door Anthropic aangemerkt als Covered Model, vereist dwingend een bewaartermijn van 30 dagen en is zonder uitdrukkelijke toestemming van Anthropic niet beschikbaar onder zero data retention. Beide feiten staan in Anthropics eigen documentatie, op twee verschillende pagina's, en slechts één ervan staat in de aankondiging.

Dit artikel leest de release zoals een organisatie die overweegt erop te bouwen hem zou moeten lezen: welke specificaties werkelijk tellen, wat aan de prijsstructuur echt is en wat een gemodelleerde schatting, wat er breekt op het niveau van de interface, en waarom de Europese route naar dit model via een partnercloud loopt en niet via Anthropic zelf.

01. Wat er op 1 september daadwerkelijk is uitgebracht

Anthropic heeft Claude Fable 5.1 op 1 september 2026 uitgebracht, samen met Claude Mythos 5.1. Volgens Anthropics eigen weergave zijn beide hetzelfde model met verschillende beveiligingsniveaus: Fable 5.1 is algemeen beschikbaar, Mythos 5.1 uitsluitend op uitnodiging via programma's voor vertrouwde toegang. De vakpers bevestigt de datum en de beschikbaarheid op alle platforms vanaf de dag van verschijnen.

De model-id luidt claude-fable-5-1, op Amazon Bedrock anthropic.claude-fable-5-1. Het model wordt geleverd via de Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry en Claude Platform op AWS. Als oppervlakken noemt Anthropic Claude Code, Claude Enterprise en Claude Platform, met verschillende standaardwaarden voor het inspanningsniveau: high in Claude Code en medium in Claude Cowork en op claude.ai. Er is een toezegging over uitfasering: op de door Anthropic beheerde platforms wordt het model niet eerder dan 1 september 2027 uitgezet, terwijl Bedrock en Google Cloud hun eigen data vaststellen.

Opmerkelijk is wat Anthropic in diezelfde documentatie toevoegt. Fable 5.1 wordt beschreven als bedoeld voor veeleisend redeneren en langlopend agentisch werk; als standaard voor de meeste workloads beveelt Anthropic nog altijd uitdrukkelijk Claude Opus 5 aan, en Fable 5.1 pas daar waar Opus 5 op een hoog inspanningsniveau tekortschiet. Wie de overstap intern moet verantwoorden, zou die zin moeten kennen: de leverancier zelf beveelt zijn nieuwe vlaggenschip niet in algemene zin aan.

02. De specificaties die een beslissing dragen

De kerngegevens komen uit Anthropics modeldocumentatie en wegen voor een architectuurbeslissing zwaarder dan welke ranglijst dan ook.

KenmerkClaude Fable 5.1
Contextvenster1.000.000 tokens
Maximale uitvoer128.000 tokens (synchrone Messages API)
Modaliteitentekst en beeld in, tekst uit, geen audio
Kennisdatumjuni 2026
Denkmodusadaptief, permanent actief
Standaard inspanningsniveauhigh
Model-idclaude-fable-5-1

Twee punten verdienen meer dan een tabelregel. Ten eerste de denkmodus: Fable 5.1 denkt adaptief en permanent, en de oudere handmatige modus met thinking.type: enabled en budget_tokens wordt niet meer geaccepteerd. Wie een bestaande integratie overzet, moet die plek in de code aanpassen.

Ten tweede het contextvenster. Eén miljoen tokens komt volgens Anthropic overeen met ongeveer 555.000 Engelse woorden, gemeten met de huidige tokenizer die met Claude Opus 4.7 is ingevoerd. Diezelfde tokenizer produceert voor dezelfde tekst ongeveer 30 procent meer tokens dan de vorige. Een getal voor het contextvenster is daarmee geen capaciteitsopgave die men luchtig kan vergelijken tussen modelgeneraties, laat staan tussen leveranciers. Voor de budgetplanning telt hoeveel tokens uw eigen tekstbestand daadwerkelijk oplevert, niet de kop boven het bericht.

Prestatiecijfers houdt dit artikel bewust kort, omdat die het onderwerp zijn van een apart vergelijkingsartikel. Alleen dit, en uitdrukkelijk als opgave van de leverancier: Anthropic rapporteert voor Fable 5.1 52,6 procent op Terminal-Bench-Science 0.1 tegenover 24,7 procent voor Fable 5, en 55,8 procent op Terminal-Bench 4.0 tegenover 42,0 procent. De vergelijkingskolom in Anthropics eigen tabel is GPT-5.6 Sol. OpenAI's huidige vlaggenschip GPT-6 Astra verscheen twee dagen na deze release en komt in Anthropics cijfers helemaal niet voor.

03. De prijs: precies één regel is veranderd

Anthropics prijsdocumentatie noemt voor Fable 5.1 de volgende waarden, telkens in Amerikaanse dollar per miljoen tokens.

PostPrijs per miljoen tokens
Invoer10,00
Uitvoer50,00
Cache schrijven, 5 minuten12,50
Cache schrijven, 1 uur20,00
Cache lezen (treffer)0,25
Batch API5,00 invoer en 25,00 uitvoer

Precies één regel is interessant. Bij Fable 5.1 en Mythos 5.1 worden cache-leesbewerkingen berekend tegen 0,025 maal de invoerprijs, terwijl bij elk ander Claude-model een factor 0,1 geldt. Dat is de enige prijswijziging ten opzichte van Fable 5, waarvan de cache-leesbewerking op 1,00 Amerikaanse dollar per miljoen tokens stond. Invoer en uitvoer zijn ongewijzigd. Het volledige contextvenster wordt tegen de gewone tokentarieven afgerekend; een toeslag voor lange context bestaat niet.

Anthropic becijfert de besparing op ongeveer 25 procent ten opzichte van Fable 5 voor typische workloads en op tot ongeveer 45 procent voor sterk agentisch werk. Dat getal is belangrijk genoeg om goed te lezen: het is een gemodelleerde schatting van de leverancier die volledig uit de cacheregel voortkomt, en geen prijsverlaging. Wie verzoeken stuurt die zelden dezelfde context opnieuw lezen, bespaart niets. Wie een agentlus draait die honderd keer dezelfde systeemprompt, dezelfde codebase en dezelfde tooldefinities opnieuw inleest, bespaart aanzienlijk. Het verschil tussen beide gevallen is uw cache-trefferpercentage, en dat kent alleen uw eigen belastingprofiel.

Nog een detail voor de kostenberekening: wordt de inferentie via inference_geo: "us" vastgelegd op de Verenigde Staten, dan geldt een factor 1,1 op invoer, uitvoer, cache schrijven en cache lezen.

In het concurrentieveld is deze cacheregel het enige echte prijsverschil aan de top. OpenAI noemt voor gpt-6-astra eveneens 10 en 50 Amerikaanse dollar per miljoen tokens voor invoer en uitvoer, maar 1,00 dollar voor invoer uit de cache. Bij cache-leesbewerkingen zit Fable 5.1 daarmee op een kwart van de prijs, wat in lange agentlussen de doorslag kan geven. Al het overige over die vergelijking, inclusief de vraag welke benchmarkcijfers überhaupt vergelijkbaar zijn, staat in het afzonderlijke artikel.

04. Wat er verandert aan de interface, en wat daarbij breekt

Als bewijs van langlopende autonomie noemt Anthropic één onbeheerde run van 38 uur aan een machine learning-probleem. Wie daarop wil bouwen, zou echter eerst de lijst met interfacewijzigingen moeten lezen, want drie daarvan breken bestaande code.

Breaking changes ten opzichte van Fable 5:

  • Geforceerd toolgebruik geeft een fout terug.
  • Eerdere modellen kunnen de denkblokken van Fable 5.1 niet lezen.
  • Het bewerken van eerdere gespreksbeurten maakt denkblokken ongeldig.

Aanvullingen:

  • Inspanningsniveau per bericht (bèta).
  • Systeemberichten met geldigheid voor één beurt (bèta).
  • Leesbare voortgangsmeldingen tussen toolaanroepen via display: "updates" (bèta).
  • De verlaagde prijs voor cache-leesbewerkingen.
  • Herkomstmarkering van de gegenereerde inhoud.

Voor agentarchitecturen is bovendien de tokenopslag van de toolsets relevant: computer_toolset_20260801 voegt per verzoek ongeveer 4.500 invoertokens toe, browser_toolset_20260801 ongeveer 6.600. Dat is een basislast die bij elk afzonderlijk verzoek optreedt en die in elke kostenraming thuishoort. De fast mode, die bij Claude Opus 5 en Opus 4.8 als onderzoeksvoorbeeld bestaat, is voor Fable 5.1 niet beschikbaar.

Aan de veiligheidskant meldt Anthropic dat de beveiligingen op het gebied van cybersecurity 60 procent minder valse positieven blokkeren dan voorheen, en dat de biologiebeveiligingen 85 procent minder vaak afgaan bij onschuldige vragen over elementaire biologie. Tegelijk blijven hele klassen taken uitgesloten: penetratietests, exploitgeneratie, binaire scans en onderzoekstaken uit de biologie worden doorgestuurd naar Opus-modellen. Fable 5.1 kan kwetsbaarheden in software identificeren, terwijl het genereren van exploits geblokkeerd blijft. Nieuwe API-accounts kunnen daarnaast de voorafgaande context in gesprekken met meerdere beurten niet meer handmatig bewerken; Anthropic motiveert dat met de stelling dat het daarmee een gangbare, publiek gedocumenteerde destillatietechniek afsluit. Voor teams die gespreksverlopen programmatisch herschrijven, is dat een gedragswijziging met directe gevolgen voor bestaande architecturen.

05. Dataresidentie: bij Anthropic zelf bestaat geen EU-regio

Hier scheidt het technische verhaal zich van het governanceverhaal. Anthropics documentatie over dataresidentie is ondubbelzinnig: de parameter inference_geo accepteert precies twee waarden, global en us. Onder de huidige beperkingen staat letterlijk dat alleen die twee beschikbaar zijn. Een EU-inferentieregio bestaat op Anthropics eigen API niet.

Voor data in rust geldt hetzelfde. De regio van een workspace wordt bij het aanmaken vastgelegd, kan daarna niet meer worden gewijzigd, en de enige beschikbare waarde zijn de Verenigde Staten.

Twee Anthropic-bronnen lijken elkaar hier tegen te spreken, en dat hoort openlijk vermeld. Het privacy-helpcentrum, laatst bijgewerkt op 15 juni 2026, schrijft dat klantverkeer standaard naar geselecteerde landen in de VS, Europa, Azië en Australië kan worden gerouteerd, en voegt in dezelfde tekst toe dat data in de VS worden opgeslagen. De platformdocumentatie kent daarentegen alleen de twee genoemde inferentieregio's. De verzoening ligt in het onderscheid tussen routering en residentie: de modus global kan Europa aandoen, maar is geen selecteerbare garantie dat verwerking en opslag in de EU plaatsvinden. Wie zo'n garantie nodig heeft, vindt die hier niet.

De parameter inference_geo bestaat bovendien pas vanaf Claude 4.6; oudere modellen antwoorden met een 400-fout. Op Amazon Bedrock en Google Cloud bestaat hij niet, daar bepalen endpoint of inferentieprofiel de regio. Microsoft Foundry biedt in plaats daarvan een implementatietype met een Amerikaanse datazone. Via het met de OpenAI SDK compatibele endpoint is de parameter evenmin beschikbaar.

De begaanbare EU-route loopt daarom niet via Anthropic maar via een partnercloud. Bedrock en Google Cloud bieden regionale endpoints met gegarandeerde datarouting, volgens Anthropics prijsdocumentatie met een toeslag van 10 procent ten opzichte van de globale endpoints, en zij stellen hun eigen levenscyclusdata vast. Daarmee is ook de wijdverbreide bewering dat Claude EU-dataresidentie heeft omdat het in Frankfurt draait half waar en per saldo misleidend: Claude-modellen kunnen in EU-regio's draaien, maar daar is de cloudaanbieder de verwerker en niet Anthropic. Voor de contractuele constructie is dat precies het verschil.

06. Covered Model: 30 dagen bewaren is een voorwaarde, geen optie

De ongemakkelijkste zin uit de hele documentatie staat op Anthropics pagina over API en dataretentie. Daar staat over Claude Fable 5.1, Mythos 5.1, Fable 5 en Mythos 5 dat deze modellen een bewaartermijn van 30 dagen vereisen en niet beschikbaar zijn onder zero data retention, tenzij Anthropic dat uitdrukkelijk toestaat. Zij zijn aangemerkt als Covered Models.

Praktisch betekent dat: een organisatie die vandaag onder zero data retention werkt, kan Fable 5.1 niet eenvoudigweg bijschakelen. Zij moet voor een bepaalde workspace uitdrukkelijk de bewaartermijn van 30 dagen activeren, anders antwoordt de API met 400 invalid_request_error. Dat is geen configuratiefijnzinnigheid maar een beslissing die in veel organisaties eerst langs de privacygoedkeuring moet, voordat de eerste regel integratiecode bestaat.

Voor de volledigheid horen Anthropics toezeggingen ernaast: bewaarde data worden naar eigen zeggen nooit zonder uitdrukkelijke toestemming gebruikt voor modeltraining, en gespreksinhoud wordt buiten de Covered Model-uitzondering standaard niet bewaard.

Ook wie zero data retention al heeft ingericht, zou de grenzen ervan moeten kennen, want die zijn nauwer dan de naam doet vermoeden.

  • ZDR wordt per organisatie op aanvraag via sales vrijgeschakeld en gaat niet automatisch over op zusterorganisaties onder hetzelfde account.
  • Niet gedekt zijn de Batch API, de Files API, code-uitvoering, Claude for Excel en de productinterfaces van Claude Teams en Claude Enterprise. Claude Code via Claude Enterprise met ZDR is de genoemde uitzondering.
  • CORS wordt voor ZDR-organisaties niet ondersteund.
  • Wordt een chat of sessie gemarkeerd, dan mag Anthropic invoer en uitvoer tot twee jaar bewaren, ook onder ZDR.

De richting is daarmee eenduidig, en zij loopt tegen het prijsverhaal in. Fable 5.1 is in de agentlus goedkoper dan elk ander Claude-model, en onder strikte EU-dataregels tegelijk lastiger in te voeren dan de Claude-modellen die niet op die lijst staan.

07. Artikel 50: een watermerk vanaf dag één, met Anthropics eigen voorbehoud

Volgens Anthropic dragen Fable 5.1 en Mythos 5.1 vanaf de dag van verschijnen een onzichtbaar tekstwatermerk. Artikel 50 van de EU-AI-verordening, dat machineleesbare markering van synthetische inhoud verlangt, geldt sinds 2 augustus 2026. Anthropic past de markering wereldwijd toe en niet alleen in de EU.

Wie het watermerk in een controleproces wil inbouwen, zou Anthropics eigen voorbehoud moeten kennen, en dat staat duidelijk in het helpcentrum: een gedetecteerd merk geeft aan dat inhoud mogelijk door Claude is verwerkt, is "not fully conclusive" en bevestigt op zichzelf niet de volledige herkomst van de inhoud. Een bewijs in juridische zin is het dus niet, en de verwachting daarmee auteurschap te kunnen vaststellen gaat verder dan wat de leverancier zelf beweert. Dat is een opmerkelijke constellatie: de markering is een echt kenmerk van het model, en de bewijskracht ervan wordt gerelativeerd door hetzelfde bedrijf dat haar aanbiedt.

Daar komt de toegang bij. De detectie-API bevindt zich in een private preview en staat alleen open voor in aanmerking komende organisaties; genoemd worden toezichthouders, opsporingsdiensten, media, factcheckers, onderzoek, onderwijsinstellingen en maatschappelijke organisaties in de EU. Een onderneming die inkomende teksten zelf op deze markering wil controleren, kan dat langs deze weg momenteel niet.

Het omringende regelgevende kader, zoals de publicerende instanties het beschrijven: de handhaving voor AI-modellen voor algemene doeleinden loopt eveneens sinds 2 augustus 2026, met boetes tot 15 miljoen euro of 3 procent van de wereldwijde jaaromzet voor niet-conforme aanbieders van zulke modellen, ongeacht of zij de gedragscode hebben ondertekend. De gedragscode van de Europese Commissie verplicht ondertekenaars tot een gepubliceerd transparantieformulier, een methodiek voor de beoordeling van systeemrisico's en een kader voor naleving van het auteursrecht, met een documentatiebewaring van ten minste tien jaar. Deze verplichtingen rusten op de modelaanbieders. Wat daaruit voor uw eigen organisatie volgt, hangt af van uw rol in de toeleveringsketen en is een vraag voor uw juridisch adviseur, niet voor een vakartikel.

08. Wat dit betekent voor een beslissing in Duitsland

Bij elkaar genomen levert de release een ongewoon helder beeld op, juist omdat de twee verhalen in tegengestelde richtingen wijzen. Technisch is Fable 5.1 de goedkopere keuze voor lange agentlussen waarin steeds opnieuw dezelfde context wordt gelezen. Regelgevend is het een model dat men zonder bewaartermijn van 30 dagen niet eens kan starten.

Vier vragen zouden daarom beantwoord moeten zijn voordat de integratie begint.

  1. Hoe hoog is uw cache-trefferpercentage werkelijk? De volledige besparing hangt aan dat ene kengetal. Meet het aan een echt belastingprofiel voordat u met 25 procent rekent.
  2. Verdraagt uw privacygoedkeuring een bewaartermijn van 30 dagen? Zo niet, dan is Fable 5.1 geen optie tot Anthropic uitdrukkelijk toestemming geeft, en die vraag laat zich technisch niet omzeilen.
  3. Via welk endpoint loopt de inferentie? Is verwerking in de EU vereist, dan loopt de weg via Bedrock of Google Cloud, met 10 procent toeslag ten opzichte van de globale endpoints, met de cloudaanbieder als verwerker en met diens eigen levenscyclusdata.
  4. Volstaat Opus 5? Anthropic zelf beveelt Opus 5 als standaard aan, en Opus 5 staat niet op de lijst met Covered Models. Een deel van de hier beschreven governancevragen speelt daar in deze vorm niet.

Niets hiervan is een argument tegen Anthropic. Fable 5.1 is een sterk model, de cachewijziging is voor agentisch werk een echte verbetering, en dat de ongemakkelijke feiten netjes na te lezen zijn in Anthropics eigen documentatie pleit voor de leverancier en niet tegen hem. Het is een argument om de volgorde om te draaien: eerst vaststellen onder welke voorwaarden uw data verwerkt mogen worden, dan het model kiezen. Wat Fable 5.1 in het dagelijkse werk daadwerkelijk presteert, behandelt een apart artikel over de mogelijkheden in de praktijk; hoe het zich verhoudt tot GPT-6 Astra, een ander.

← Signals

Wayne Dyer

“Als u de manier waarop u naar dingen kijkt verandert, veranderen de dingen waar u naar kijkt.”