senn-techsenn-tech
Back to blog
KI-News
KI-News2026-07-30

Claude 5. Generation: Fable 5, Opus 5, Mythos 5 — Das Gute, das Schlechte, die Kosten

Diesen Sommer hat Anthropic innerhalb von sechs Wochen gleich drei neue Modelle veröffentlicht — und einen Präzedenzfall für KI-Exportkontrollen geschaffen. Hier ist, was man für die Praxis wissen muss.

Die drei Modelle auf einen Blick

ModellLaunchInput-PreisOutput-PreisPositionierung
Fable 59. Juni 2026$10 / MTok$50 / MTokFrontier-Intelligenz mit Cyber/Bio-Safeguards
Mythos 59. Juni 2026$10 / MTok$50 / MTokUngeschütztes Frontier-Modell (vetted only)
Opus 524. Juli 2026$5 / MTok$25 / MTokNear-Fable-Performance zum halben Preis

Dazu kommen Sonnet 5 ($2/$10 MTok, Einführungspreis bis 31. August, danach $3/$15) und Haiku 4.5 ($1/$5 MTok) für Alltag und Massenaufgaben.

Mythos 5 und Fable 5 sind dasselbe Modell. Der Unterschied: Fable 5 hat Sicherheits-Klassifikatoren, die Cyber- und Biologie-Anfragen automatisch an schwächere Opus-Modelle umleiten. Mythos 5 hat diese nicht — und ist deshalb nur für vetted partners zugänglich.

Das Gute

1. LLM Arena: Anthropic dominiert die Spitze

In der Agent Arena (Stand 28. Juli 2026, 1,4 Mio. Sessions, 44 Modelle) belegt Anthropic die ersten drei Plätze — und fünf der Top 10:

RangModellNet Improvement
#1Claude Fable 5 (High)12,58 %
#2Claude Opus 5 (Max)11,88 %
#3Claude Opus 5 (High)11,73 %
#4GPT 5.6 Sol (xHigh)10,02 %
#5Kimi K3 (Max)9,91 %
#6Claude Opus 4.8 (Thinking)9,43 %
#7Claude Sonnet 5 (High)8,57 %
#8GPT 5.5 (xHigh)8,49 %
#9Claude Opus 4.7 (Thinking)8,19 %
#10GPT 5.5 (High)7,89 %

LLM Agent Arena Top 10 — Stand 28. Juli 2026

Und in den Einzelsignalen: Opus 5 führt bei Confirmed Success (17,56 %) und Praise vs Complaint (25,63 %). Fable 5 führt bei Steerability (12,93 %) — es landet User-Korrekturen am zuverlässigsten.

2. Opus 5: Frontier-Qualität zum halben Preis

Opus 5 ist das Preisleistungs-Highlight. Es kostet exakt dasselbe wie Opus 4.8 ($5/$25), liefert aber:

  • Frontier-Bench v0.1: Neuer State-of-the-Art, mehr als doppelt so gut wie Opus 4.8 — bei niedrigeren Kosten pro Task
  • CursorBench 3.2: Auf Max-Effort innerhalb von 0,5 % an Fable 5, aber zum halben Preis
  • ARC-AGI 3: Dreimal so hoher Score wie das nächstbeste Modell
  • OSWorld 2.0 (Computer Use): Übertrifft Fable 5s Bestwert mit nur einem Drittel der Kosten
  • AutomationBench (Zapier): 1,5× höhere Pass-Rate als jedes andere Modell, selbst auf dem niedrigsten Effort-Level

Cursor-Co-Founder Sualeh Asif bringt es auf den Punkt: "Claude Opus 5 delivers near Fable 5 intelligence at Opus speed and cost."

3. Project Glasswing: 10.000+ kritische Schwachstellen gefunden

Mythos 5 findet in Project Glasswing — einer Kooperation mit AWS, Apple, Google, Microsoft, NVIDIA und anderen — Schwachstellen in systemkritischer Software. Stand Mai 2026: über 10.000 High- oder Critical-Severity-Schwachstellen. Seit Juni auf 150+ Organisationen in 15+ Ländern ausgeweitet.

4. Agentic Coding: Tage statt Monate

Mehrere Early-Access-Kunden berichten von dramatischen Produktivitätssprüngen:

  • Zapier: Opus 5 erreichte 100 % auf AutomationBench — frühere Modelle scheiterten komplett
  • Lovable: 22 % bessere Agentic-Coding-Performance als Opus 4.7, mit deutlich weniger Varianz
  • Zapier (Intern): Ein Engineer bei einem Trading-Unternehmen baute mit Opus 5 einen kompletten Market-Data-Feed für eine neue Börse in einer Session — vorherige Modelle scheiterten selbst mit detaillierten Plänen

5. Opus 5: Sicherstes Modell bisher

Laut Anthropic ist Opus 5 das am besten aligned Modell, das sie je gebaut haben — es hält sich besser an die Constitution als Opus 4.8, Sonnet 5 oder Fable 5, zeigt die niedrigste Rate an deceptive behavior und ist am schwersten zu jailbreaken. Es hat keine Data-Retention-Pflicht (anders als Fable/Mythos 5 mit 30 Tagen).

Das Schlechte

1. 23 Tage Downtime im Juni

Fable 5 und Mythos 5 wurden am 9. Juni gelauncht. Drei Tage später — am 12. Juni — zog die US-Regierung die Exportkontrolle für Mythos 5. Fable 5 war mitbetroffen, weil es dasselbe zugrundeliegende Modell ist. Beide waren bis zum 1. Juli nicht verfügbar.

Für Entwickler, die bereits auf die neuen Modelle migriert hatten, bedeutete das: 23 Tage Fallback auf Opus 4.8 — und die Frage, ob man Produktions-Pipelines auf ein Modell bauen kann, das jederzeit wieder verschwinden könnte.

2. Fable 5: Safety-Klassifikatoren blocken produktive Arbeit

Fable 5 routet Cyber- und Biologie-Anfragen automatisch an schwächere Opus-Modelle um — und das nicht immer treffsicher. Entwickler, die legitime Security-Automation oder Code-Analyse mit Fable 5 machen wollen, landen unerwartet auf Opus 4.8. Die Fallback-Erfahrung ist dokumentiert (Why Claude switched models), aber nicht wegkonfigurierbar.

Opus 5 greift dagegen 85 % seltener ein — und hat einen Cyber Verification Program (CVP) für legitime Security-Arbeit.

3. Mythos 5: Nicht für dich (außer du bist vetted)

Mythos 5 bleibt auf einen kleinen Kreis von Partnern beschränkt. Project Glasswing ist zwar auf 150+ Organisationen gewachsen, aber für jeden anderen ist das Modell unzugänglich. Wer die ungefilterte Frontier-Performance braucht, muss über Fable 5 + Fallback leben — oder warten.

4. Fable 5: Nur 10,26 % Confirmed Success

Ein überraschender Datenpunkt aus der Agent Arena: Fable 5 erreicht bei "Confirmed Success" (wie oft User die Aufgabe als erledigt bestätigen) nur 10,26 % — während Opus 5 Max bei 17,56 % liegt und Kimi K3 bei 14,23 %. Das heißt: Fable 5 mag klüger sein, aber es beendet Aufgaben seltener zur Zufriedenheit des Users. Möglicherweise ein Overthinking-Problem bei kürzeren Tasks.

5. 30 Tage Data Retention für Fable/Mythos

Anders als Opus 5 (keine Data Retention) müssen Fable 5 und Mythos 5 mit 30-tägiger Datenspeicherung für Safety Monitoring akzeptiert werden. Für regulierte Branchen oder DSGVO-sensitive Workloads ein echtes Hindernis.

Die Kosten: Was zahlt man wirklich?

API-Preise im Vergleich

ModellInputOutputPrompt Cache WritePrompt Cache ReadBatch (50 % Rabatt)
Fable 5$10,00$50,00$12,50$1,00$5,00 / $25,00
Mythos 5$10,00$50,00
Opus 5$5,00$25,00$6,25$0,50$2,50 / $12,50
Sonnet 5$2,00*$10,00*$2,50*$0,20*
Haiku 4.5$1,00$5,00$1,25$0,10
Opus 4.8 (Legacy)$5,00$25,00$6,25$0,50$2,50 / $12,50
Opus 4.1 (Legacy)$15,00$75,00$18,75$1,50

* Sonnet 5 Einführungspreis bis 31. August 2026, danach $3/$15 MTok.

Prompt Caching bringt bis zu 90 % Ersparnis auf Input-Tokens — der größte Hebel für Kostensenkung bei wiederholten System-Prompts oder langen Konversationen.

Opus 5 Effort Levels

Opus 5 hat einstellbare Effort-Stufen. Auf niedrigem Effort ist es günstiger (weniger Reasoning-Tokens), auf Maximum erreicht es fast Fable-5-Niveau. Das ermöglicht:

  • High-Value Tasks (Code-Review, Architektur): Max Effort, Frontier-Qualität
  • Alltags-Tasks (Dokumentation, Refactoring): Mittlerer Effort, niedrigere Kosten
  • Massen-Tasks (Klassifizierung, Extraktion): Niedriger Effort oder auf Sonnet/Haiku ausweichen

Fast Mode für Opus 5

Mit Fast Mode läuft Opus 5 ca. 2,5× schneller — zum doppelten Preis ($10/$50 MTok). Nützlich für interaktive Coding-Sessions, wo Latenz wichtiger ist als Kosten.

Plan-Preise (Consumer)

PlanPreisModelle
Free$0Haiku, eingeschränkt Fable
Pro$17–20/MonatOpus 5, Sonnet 5, Haiku 4.5
Max 5×$100/MonatOpus 5 (Default), Fable 5
Max 20×$200/MonatOpus 5 (Default), Fable 5
Team$20–25/SeatOpus 5, mehr Usage als Pro
Enterprise$20/Seat + API-RatenAlle Modelle, 500k Context, SCIM, Audit Logs

Preisverfall gegenüber Opus 4.1

Der Vergleich mit Opus 4.1 ($15/$75 MTok, November 2025) zeigt den Preisverfall: Opus 5 kostet 67 % weniger als Opus 4.1 und ist dabei deutlich leistungsfähiger. Die $50/MTok von Fable 5 entsprechen dem Output-Preis von GPT-4 im März 2024 — Inflation-adjusted also günstiger.

Arena-Vergleich: Anthropic vs. OpenAI vs. Kimi vs. Grok

Zum Vergleich die Top-Modelle in der Agent Arena (Net Improvement, Stand 28. Juli 2026):

RangModellNet Impr.Sessions
#1Claude Fable 5 (High)12,58 %23.807
#2Claude Opus 5 (Max)11,88 %7.253
#3Claude Opus 5 (High)11,73 %11.114
#4GPT 5.6 Sol (xHigh)10,02 %16.966
#5Kimi K3 (Max)9,91 %19.586
#7Claude Sonnet 5 (High)8,57 %24.657
#8GPT 5.5 (xHigh)8,49 %43.122
#14Grok 4.55,54 %24.139
#38Grok 4.3 (High)-8,03 %52.987

Der Abstand zwischen Fable 5 (12,58 %) und GPT 5.6 Sol (10,02 %) beträgt 2,56 Prozentpunkte — ein signifikanter Vorsprung. Und der Abstand zu Grok 4.3 (-8,03 %, auf Rang 38) ist ein ganzes Universum.

Der Trend geht aber Richtung smartere, günstigere Workhorse-Modelle: Sonnet 5 (#7, 8,57 %) hat bereits mehr Sessions (24.657) als Fable 5 (23.807) und dürfte in den nächsten Wochen noch steigen, sobald die Einführungswelle anrollt.

Welches Modell für wen?

Nimm Opus 5, wenn du...

  • Coding-Agents im Alltag einsetzt (Claude Code, Cursor, Lovable, Devin)
  • Enterprise-Workflows automatisierst, die kein Fable-Budget rechtfertigen
  • Datenschutz-sensitiv arbeitest (keine Data Retention)
  • Kein gutes Gefühl bei $50/MTok Output hast

Nimm Fable 5, wenn du...

  • Mehrtägige Agent-Läufe brauchst, die Opus 5 nicht zuverlässig durchhält
  • Frontier-Forschung betreibst und jedes Prozent Genauigkeit zählt
  • Vision-Aufgaben mit komplexen Diagrams, Charts oder PDFs hast
  • Das Budget für $50/MTok Output hast

Nimm Mythos 5, wenn du...

  • Bei Project Glasswing oder einem anderen vetted program bist
  • Cyber-Security-Forschung auf Schwachstellen-Exploitation-Ebene betreibst
  • Biologie-Forschung ohne Safety-Fallback brauchst

Nimm Sonnet 5, wenn du...

  • Hohes Volumen bei soliden Coding-Ergebnissen willst ($2/$10 MTok)
  • Schnelle, kostengünstige Agent-Läufe brauchst
  • Den Preissprung von Haiku auf Opus nicht rechtfertigen kannst

Fazit

Anthropic hat mit der 5. Generation drei Modelle gebaut, die die LLM Arena dominieren — aber die eigentliche Story ist nicht Fable 5, sondern Opus 5: Frontier-Qualität zum halben Preis, ohne Data Retention, mit besseren Bestätigungsraten als Fable 5 in der Praxis.

Die 23-tägige Downtime im Juni war ein Weckruf für alle, die ihre Produktions-Pipelines auf ein einziges Modell ausrichten. Wer heute baut, sollte einen Fallback auf Opus 5 (oder Sonnet 5) einplanen — nicht weil die Modelle oft ausfallen, sondern weil Exportkontrollen bei Frontier-Modellen keine theoretische Möglichkeit mehr sind.

Für die meisten Mittelstands-Workloads ist die Rechnung einfach: Opus 5 (Max) für Agentic Coding, Sonnet 5 fürs Tagesgeschäft, Haiku 4.5 für Massenaufgaben. Fable 5 ist der Ferrari — beeindruckend, aber im Alltag fährst du mit dem Opus weiter.

Weiterführende Quellen