KI · 4 MIN

GLM-5.2, Sakana Fugu, Claude Fable 5: drei Frontier-Modelle, drei Antworten auf Kontrolle

Drei Frontier-Modelle, eine echte Frage für einen B2B-Käufer: wohin gehen Ihre Daten, und wie viel des Stacks kontrollieren Sie?

GLM-5.2, Sakana Fugu, Claude Fable 5: drei Frontier-Modelle, drei Antworten auf Kontrolle
STANDORT
Rheinland-Pfalz
AUTOR
Aashwin Shrivastava
VERÖFFENTLICHT
25. Juni 2026

Wenn ich diese drei für einen Kunden in Rheinland-Pfalz nebeneinanderstelle, geben die Benchmark-Abstände selten den Ausschlag. Alle drei sind Mitte 2026 auf Frontier-Niveau. Die Entscheidung ist, wohin die Daten gehen und wie viel des Stacks der Kunde kontrolliert, und GLM-5.2, Sakana Fugu und Claude Fable 5 geben drei wirklich verschiedene Antworten. Nur eines von ihnen kann im eigenen Haus laufen. Das ist der Vergleich, der eine Beschaffungsprüfung übersteht, also ist es der, mit dem ich beginne.

01. DREI VERÖFFENTLICHUNGEN, SCHLICHT GESAGT

Jede davon erschien im Juni 2026 binnen zweier Wochen der anderen, und jede ist eine andere Art Sache. Es lohnt Präzision, denn zwei davon werden weithin falsch beschrieben.

GLM-5.2, von Z.ai in Peking, erschien am 17. Juni. Es ist ein Open-Weight-Mixture-of-Experts-Modell, rund 750 Milliarden Parameter mit etwa 40 Milliarden aktiven, ein Kontext von einer Million Token und, entscheidend, eine MIT-Lizenz mit auf HuggingFace veröffentlichten Gewichten.

Sakana Fugu, von Sakana AI in Tokio, erschien am 22. Juni. Es ist kein herkömmliches Modell, und die übliche Einordnung liegt daneben: Fugu ist ein trainierter Orchestrator, der einen Pool anderer Modelle aufruft und deren Arbeit synthetisiert. Es ist nur per API verfügbar, angeboten als OpenAI-kompatibler Endpunkt.

Claude Fable 5, von Anthropic in den Vereinigten Staaten, erschien am 9. Juni. Der zweite häufige Fehler ist, Fable als schnelle oder kreative Stufe einzuordnen. Es ist das Flaggschiff, Anthropics fähigstes breit veröffentlichtes Modell, sicherheitsgesteuert, nur in der Cloud, bei 10 und 50 Dollar je Million Token. Seine Benchmark-Zahlen sind stark; für diesen Beitrag sind sie zugleich nebensächlich.

02. DER EINZIGE VERGLEICH, DER DIE BESCHAFFUNG ÜBERSTEHT

Lassen Sie die Rangliste weg und stellen Sie sie auf den Dimensionen auf, für die ein deutscher B2B-Käufer tatsächlich verantwortlich ist. Das Bild ist klar, und es geht nicht darum, welches am klügsten ist.

DimensionGLM-5.2Sakana FuguClaude Fable 5
OffenheitOffene Gewichte, MITGeschlossen, nur APIGeschlossen, nur API
RechtsraumChina (Selbsthosting entfernt ihn)JapanVereinigte Staaten
On-prem betreibbarJa, etwa 744 GB GPUNeinNein
API-Kosten je M TokenEtwa 1,40 und 4,40Nicht offengelegt10 und 50
BelegqualitätAnbieter und SekundärquellenNur Anbieter-SelbstauskunftAnbieter, starke Bilanz

Zwei ehrliche Vorbehalte gehören auf diese Tabelle. Der Standardweg von GLM-5.2, die Z.ai-API, unterliegt Chinas Datengesetzen mit ihren verpflichtenden Zugriffsklauseln, was genau der Grund ist, warum die offenen Gewichte zählen: Selbsthosting in der EU neutralisiert dieses Risiko. Und Fugus Behauptung von Frontier-Gleichstand ist vollständig selbst berichtet, geschwächt dadurch, dass Fable und das eingeschränkte Mythos-Modell nicht einmal in seinem Pool sind. Ich würde eine Entscheidung auf keine der beiden Anbieter-Benchmarks stützen.

03. WAS ICH EINEM KUNDEN TATSÄCHLICH SAGE

Ich empfehle keines davon im Abstrakten. Ich passe die Haltung an das an, was der Kunde finanzieren kann und wofür er verantwortlich ist.

🔸 GLM-5.2 ist der On-Prem-Zug. Die offenen MIT-Gewichte sind der ganze Punkt: Sie können es im eigenen Rechenzentrum betreiben, und die Prompts verlassen nie Ihr Netz. Der Haken ist der GPU-Fußabdruck, rund 744 Gigabyte in FP8, es passt also zum Kunden, der die Hardware finanzieren kann und Daten im Haus halten muss. Es ist die sauberste Souveränitätsgeschichte der drei.

🔸 Claude Fable 5 ist der Zug für gemanagte Zusicherung. Sie mieten Fähigkeit von einem US-Anbieter, zum höchsten Preis hier, mit echter Sicherheitssteuerung und regionalem Daten-Routing auf den großen Clouds. Für ein Team, das ein Spitzenmodell will, ohne den Stack zu besitzen, und mit einer Cloud-Abhängigkeit leben kann, ist es die stärkste gemanagte Option.

🔸 Sakana Fugu ist der Bequemlichkeits-Zug, mit der schwächsten Kontrollgeschichte. Eine API, die über einen Pool von Modellen leitet, ist clever, und Japan ist geopolitisch weicher als China. Aber Sie können es nicht on-prem betreiben, Sie wählen nicht, welches Modell die Daten sieht, und die Belege sind dünn. Ich würde es als interessant behandeln, nicht als Standard für regulierte Arbeit.

Das ist dieselbe Lehre, die Claude Fable 5 auf die harte Tour lehrte, als ein früheres Modell in 72 Stunden abgeschaltet wurde: gemietete Fähigkeit ist widerrufbar, und Kontrolle ist eine Eigenschaft des Stacks, nicht des Scores. Deshalb weise ich Kunden immer wieder auf Open-Weight-Modelle hin, die sie tatsächlich besitzen können.

04. DIE FRAGE, FÜR DIE ES SICH ZU DESIGNEN LOHNT

Wenn Sie eines hieraus mitnehmen, dann die Frage, nicht die Rangfolge. Die Modelle werden binnen eines Quartals auf der Rangliste wieder die Plätze tauschen; das ist Rauschen. Die haltbare Frage ist die, die ein Beschaffungsverantwortlicher am ersten Tag stellen sollte: welches davon können Sie noch betreiben, prüfen und bezahlen, wenn der Anbieter die Bedingungen ändert? Für die meisten regulierten Kunden, mit denen ich arbeite, beantwortet sich diese Frage von selbst, und sie zeigt nicht auf den höchsten Benchmark. Bevor Sie also das klügste Modell wählen: was würde es Sie kosten, es zu verlieren?

Dazu arbeiten wir

← Signals

Wayne Dyer

“Wenn du die Art und Weise änderst, wie du die Dinge betrachtest, ändern sich die Dinge, die du betrachtest.”