Claude 5. Generation: Fable 5, Opus 5, Mythos 5 — Das Gute, das Schlechte, die Kosten
Diesen Sommer hat Anthropic innerhalb von sechs Wochen gleich drei neue Modelle veröffentlicht — und einen Präzedenzfall für KI-Exportkontrollen geschaffen. Hier ist, was man für die Praxis wissen muss.
Die drei Modelle auf einen Blick
| Modell | Launch | Input-Preis | Output-Preis | Positionierung |
|---|---|---|---|---|
| Fable 5 | 9. Juni 2026 | $10 / MTok | $50 / MTok | Frontier-Intelligenz mit Cyber/Bio-Safeguards |
| Mythos 5 | 9. Juni 2026 | $10 / MTok | $50 / MTok | Ungeschütztes Frontier-Modell (vetted only) |
| Opus 5 | 24. Juli 2026 | $5 / MTok | $25 / MTok | Near-Fable-Performance zum halben Preis |
Dazu kommen Sonnet 5 ($2/$10 MTok, Einführungspreis bis 31. August, danach $3/$15) und Haiku 4.5 ($1/$5 MTok) für Alltag und Massenaufgaben.
Mythos 5 und Fable 5 sind dasselbe Modell. Der Unterschied: Fable 5 hat Sicherheits-Klassifikatoren, die Cyber- und Biologie-Anfragen automatisch an schwächere Opus-Modelle umleiten. Mythos 5 hat diese nicht — und ist deshalb nur für vetted partners zugänglich.
Das Gute
1. LLM Arena: Anthropic dominiert die Spitze
In der Agent Arena (Stand 28. Juli 2026, 1,4 Mio. Sessions, 44 Modelle) belegt Anthropic die ersten drei Plätze — und fünf der Top 10:
| Rang | Modell | Net Improvement |
|---|---|---|
| #1 | Claude Fable 5 (High) | 12,58 % |
| #2 | Claude Opus 5 (Max) | 11,88 % |
| #3 | Claude Opus 5 (High) | 11,73 % |
| #4 | GPT 5.6 Sol (xHigh) | 10,02 % |
| #5 | Kimi K3 (Max) | 9,91 % |
| #6 | Claude Opus 4.8 (Thinking) | 9,43 % |
| #7 | Claude Sonnet 5 (High) | 8,57 % |
| #8 | GPT 5.5 (xHigh) | 8,49 % |
| #9 | Claude Opus 4.7 (Thinking) | 8,19 % |
| #10 | GPT 5.5 (High) | 7,89 % |

Und in den Einzelsignalen: Opus 5 führt bei Confirmed Success (17,56 %) und Praise vs Complaint (25,63 %). Fable 5 führt bei Steerability (12,93 %) — es landet User-Korrekturen am zuverlässigsten.
2. Opus 5: Frontier-Qualität zum halben Preis
Opus 5 ist das Preisleistungs-Highlight. Es kostet exakt dasselbe wie Opus 4.8 ($5/$25), liefert aber:
- Frontier-Bench v0.1: Neuer State-of-the-Art, mehr als doppelt so gut wie Opus 4.8 — bei niedrigeren Kosten pro Task
- CursorBench 3.2: Auf Max-Effort innerhalb von 0,5 % an Fable 5, aber zum halben Preis
- ARC-AGI 3: Dreimal so hoher Score wie das nächstbeste Modell
- OSWorld 2.0 (Computer Use): Übertrifft Fable 5s Bestwert mit nur einem Drittel der Kosten
- AutomationBench (Zapier): 1,5× höhere Pass-Rate als jedes andere Modell, selbst auf dem niedrigsten Effort-Level
Cursor-Co-Founder Sualeh Asif bringt es auf den Punkt: "Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost."
3. Project Glasswing: 10.000+ kritische Schwachstellen gefunden
Mythos 5 findet in Project Glasswing — einer Kooperation mit AWS, Apple, Google, Microsoft, NVIDIA und anderen — Schwachstellen in systemkritischer Software. Stand Mai 2026: über 10.000 High- oder Critical-Severity-Schwachstellen. Seit Juni auf 150+ Organisationen in 15+ Ländern ausgeweitet.
4. Agentic Coding: Tage statt Monate
Mehrere Early-Access-Kunden berichten von dramatischen Produktivitätssprüngen:
- Zapier: Opus 5 erreichte 100 % auf AutomationBench — frühere Modelle scheiterten komplett
- Lovable: 22 % bessere Agentic-Coding-Performance als Opus 4.7, mit deutlich weniger Varianz
- Zapier (Intern): Ein Engineer bei einem Trading-Unternehmen baute mit Opus 5 einen kompletten Market-Data-Feed für eine neue Börse in einer Session — vorherige Modelle scheiterten selbst mit detaillierten Plänen
5. Opus 5: Sicherstes Modell bisher
Laut Anthropic ist Opus 5 das am besten aligned Modell, das sie je gebaut haben — es hält sich besser an die Constitution als Opus 4.8, Sonnet 5 oder Fable 5, zeigt die niedrigste Rate an deceptive behavior und ist am schwersten zu jailbreaken. Es hat keine Data-Retention-Pflicht (anders als Fable/Mythos 5 mit 30 Tagen).
Das Schlechte
1. 23 Tage Downtime im Juni
Fable 5 und Mythos 5 wurden am 9. Juni gelauncht. Drei Tage später — am 12. Juni — zog die US-Regierung die Exportkontrolle für Mythos 5. Fable 5 war mitbetroffen, weil es dasselbe zugrundeliegende Modell ist. Beide waren bis zum 1. Juli nicht verfügbar.
Für Entwickler, die bereits auf die neuen Modelle migriert hatten, bedeutete das: 23 Tage Fallback auf Opus 4.8 — und die Frage, ob man Produktions-Pipelines auf ein Modell bauen kann, das jederzeit wieder verschwinden könnte.
2. Fable 5: Safety-Klassifikatoren blocken produktive Arbeit
Fable 5 routet Cyber- und Biologie-Anfragen automatisch an schwächere Opus-Modelle um — und das nicht immer treffsicher. Entwickler, die legitime Security-Automation oder Code-Analyse mit Fable 5 machen wollen, landen unerwartet auf Opus 4.8. Die Fallback-Erfahrung ist dokumentiert (Why Claude switched models), aber nicht wegkonfigurierbar.
Opus 5 greift dagegen 85 % seltener ein — und hat einen Cyber Verification Program (CVP) für legitime Security-Arbeit.
3. Mythos 5: Nicht für dich (außer du bist vetted)
Mythos 5 bleibt auf einen kleinen Kreis von Partnern beschränkt. Project Glasswing ist zwar auf 150+ Organisationen gewachsen, aber für jeden anderen ist das Modell unzugänglich. Wer die ungefilterte Frontier-Performance braucht, muss über Fable 5 + Fallback leben — oder warten.
4. Fable 5: Nur 10,26 % Confirmed Success
Ein überraschender Datenpunkt aus der Agent Arena: Fable 5 erreicht bei "Confirmed Success" (wie oft User die Aufgabe als erledigt bestätigen) nur 10,26 % — während Opus 5 Max bei 17,56 % liegt und Kimi K3 bei 14,23 %. Das heißt: Fable 5 mag klüger sein, aber es beendet Aufgaben seltener zur Zufriedenheit des Users. Möglicherweise ein Overthinking-Problem bei kürzeren Tasks.
5. 30 Tage Data Retention für Fable/Mythos
Anders als Opus 5 (keine Data Retention) müssen Fable 5 und Mythos 5 mit 30-tägiger Datenspeicherung für Safety Monitoring akzeptiert werden. Für regulierte Branchen oder DSGVO-sensitive Workloads ein echtes Hindernis.
Die Kosten: Was zahlt man wirklich?
API-Preise im Vergleich
| Modell | Input | Output | Prompt Cache Write | Prompt Cache Read | Batch (50 % Rabatt) |
|---|---|---|---|---|---|
| Fable 5 | $10,00 | $50,00 | $12,50 | $1,00 | $5,00 / $25,00 |
| Mythos 5 | $10,00 | $50,00 | — | — | — |
| Opus 5 | $5,00 | $25,00 | $6,25 | $0,50 | $2,50 / $12,50 |
| Sonnet 5 | $2,00* | $10,00* | $2,50* | $0,20* | — |
| Haiku 4.5 | $1,00 | $5,00 | $1,25 | $0,10 | — |
| Opus 4.8 (Legacy) | $5,00 | $25,00 | $6,25 | $0,50 | $2,50 / $12,50 |
| Opus 4.1 (Legacy) | $15,00 | $75,00 | $18,75 | $1,50 | — |
* Sonnet 5 Einführungspreis bis 31. August 2026, danach $3/$15 MTok.
Prompt Caching bringt bis zu 90 % Ersparnis auf Input-Tokens — der größte Hebel für Kostensenkung bei wiederholten System-Prompts oder langen Konversationen.
Opus 5 Effort Levels
Opus 5 hat einstellbare Effort-Stufen. Auf niedrigem Effort ist es günstiger (weniger Reasoning-Tokens), auf Maximum erreicht es fast Fable-5-Niveau. Das ermöglicht:
- High-Value Tasks (Code-Review, Architektur): Max Effort, Frontier-Qualität
- Alltags-Tasks (Dokumentation, Refactoring): Mittlerer Effort, niedrigere Kosten
- Massen-Tasks (Klassifizierung, Extraktion): Niedriger Effort oder auf Sonnet/Haiku ausweichen
Fast Mode für Opus 5
Mit Fast Mode läuft Opus 5 ca. 2,5× schneller — zum doppelten Preis ($10/$50 MTok). Nützlich für interaktive Coding-Sessions, wo Latenz wichtiger ist als Kosten.
Plan-Preise (Consumer)
| Plan | Preis | Modelle |
|---|---|---|
| Free | $0 | Haiku, eingeschränkt Fable |
| Pro | $17–20/Monat | Opus 5, Sonnet 5, Haiku 4.5 |
| Max 5× | $100/Monat | Opus 5 (Default), Fable 5 |
| Max 20× | $200/Monat | Opus 5 (Default), Fable 5 |
| Team | $20–25/Seat | Opus 5, mehr Usage als Pro |
| Enterprise | $20/Seat + API-Raten | Alle Modelle, 500k Context, SCIM, Audit Logs |
Preisverfall gegenüber Opus 4.1
Der Vergleich mit Opus 4.1 ($15/$75 MTok, November 2025) zeigt den Preisverfall: Opus 5 kostet 67 % weniger als Opus 4.1 und ist dabei deutlich leistungsfähiger. Die $50/MTok von Fable 5 entsprechen dem Output-Preis von GPT-4 im März 2024 — Inflation-adjusted also günstiger.
Arena-Vergleich: Anthropic vs. OpenAI vs. Kimi vs. Grok
Zum Vergleich die Top-Modelle in der Agent Arena (Net Improvement, Stand 28. Juli 2026):
| Rang | Modell | Net Impr. | Sessions |
|---|---|---|---|
| #1 | Claude Fable 5 (High) | 12,58 % | 23.807 |
| #2 | Claude Opus 5 (Max) | 11,88 % | 7.253 |
| #3 | Claude Opus 5 (High) | 11,73 % | 11.114 |
| #4 | GPT 5.6 Sol (xHigh) | 10,02 % | 16.966 |
| #5 | Kimi K3 (Max) | 9,91 % | 19.586 |
| #7 | Claude Sonnet 5 (High) | 8,57 % | 24.657 |
| #8 | GPT 5.5 (xHigh) | 8,49 % | 43.122 |
| #14 | Grok 4.5 | 5,54 % | 24.139 |
| #38 | Grok 4.3 (High) | -8,03 % | 52.987 |
Der Abstand zwischen Fable 5 (12,58 %) und GPT 5.6 Sol (10,02 %) beträgt 2,56 Prozentpunkte — ein signifikanter Vorsprung. Und der Abstand zu Grok 4.3 (-8,03 %, auf Rang 38) ist ein ganzes Universum.
Der Trend geht aber Richtung smartere, günstigere Workhorse-Modelle: Sonnet 5 (#7, 8,57 %) hat bereits mehr Sessions (24.657) als Fable 5 (23.807) und dürfte in den nächsten Wochen noch steigen, sobald die Einführungswelle anrollt.
Welches Modell für wen?
Nimm Opus 5, wenn du...
- Coding-Agents im Alltag einsetzt (Claude Code, Cursor, Lovable, Devin)
- Enterprise-Workflows automatisierst, die kein Fable-Budget rechtfertigen
- Datenschutz-sensitiv arbeitest (keine Data Retention)
- Kein gutes Gefühl bei $50/MTok Output hast
Nimm Fable 5, wenn du...
- Mehrtägige Agent-Läufe brauchst, die Opus 5 nicht zuverlässig durchhält
- Frontier-Forschung betreibst und jedes Prozent Genauigkeit zählt
- Vision-Aufgaben mit komplexen Diagrams, Charts oder PDFs hast
- Das Budget für $50/MTok Output hast
Nimm Mythos 5, wenn du...
- Bei Project Glasswing oder einem anderen vetted program bist
- Cyber-Security-Forschung auf Schwachstellen-Exploitation-Ebene betreibst
- Biologie-Forschung ohne Safety-Fallback brauchst
Nimm Sonnet 5, wenn du...
- Hohes Volumen bei soliden Coding-Ergebnissen willst ($2/$10 MTok)
- Schnelle, kostengünstige Agent-Läufe brauchst
- Den Preissprung von Haiku auf Opus nicht rechtfertigen kannst
Fazit
Anthropic hat mit der 5. Generation drei Modelle gebaut, die die LLM Arena dominieren — aber die eigentliche Story ist nicht Fable 5, sondern Opus 5: Frontier-Qualität zum halben Preis, ohne Data Retention, mit besseren Bestätigungsraten als Fable 5 in der Praxis.
Die 23-tägige Downtime im Juni war ein Weckruf für alle, die ihre Produktions-Pipelines auf ein einziges Modell ausrichten. Wer heute baut, sollte einen Fallback auf Opus 5 (oder Sonnet 5) einplanen — nicht weil die Modelle oft ausfallen, sondern weil Exportkontrollen bei Frontier-Modellen keine theoretische Möglichkeit mehr sind.
Für die meisten Mittelstands-Workloads ist die Rechnung einfach: Opus 5 (Max) für Agentic Coding, Sonnet 5 fürs Tagesgeschäft, Haiku 4.5 für Massenaufgaben. Fable 5 ist der Ferrari — beeindruckend, aber im Alltag fährst du mit dem Opus weiter.