Anthropic hat mit Claude Fable 5.1 und Claude Mythos 5.1 zwei neue Modelle veröffentlicht, die insbesondere bei anspruchsvollen agentischen Aufgaben deutlich zulegen. Während Fable 5.1 in aktuellen Benchmarks die Spitzenposition erobert, bleiben die API-Preise unverändert hoch – ein Umstand, der vor allem bei intensiver Nutzung den Kostenvorteil durch günstigere Cache-Zugriffe wieder aufzehren kann.
Benchmark-Ergebnisse: Fable 5.1 übertrifft alle Vorgänger
In eigenen Tests von Anthropic zeigt das Modell vor allem bei komplexen, mehrstufigen Arbeitsabläufen eine deutliche Verbesserung. Im Terminal-Bench-Science, der wissenschaftliche Arbeitsabläufe in einer Terminal-Umgebung prüft, steigt die Erfolgsquote von 24,7 Prozent (Fable 5) auf 52,6 Prozent. Beim Terminal-Bench 4.0, der agentische Coding-Aufgaben bewertet, verbessert sich das Modell von 42,0 auf 55,8 Prozent. Der AutomationBench, der Büroaufgaben über verschiedene Anwendungen hinweg simuliert, zeigt einen Sprung von 17,1 auf 31,4 Prozent. Kleinere Zuwächse verzeichnet Anthropic zudem bei Wissensarbeit, Computersteuerung und allgemeinem logischen Schlussfolgern.
Externe Tests von Artificial Analysis untermauern den Leistungssprung: Im Intelligence Index erreicht Fable 5.1 bei maximaler Denkleistung 66 Punkte und setzt sich damit an die Spitze des Rankings. Zum Vergleich: Fable 5 erzielt 62 Punkte, Opus 5 kommt auf 63 und GPT-5.6 Sol auf 61 Punkte. Auch bei Terminal-Bench v2.1 und SciCode erzielt Fable 5.1 die bislang höchsten Werte. Bei anderen Tests für agentische Wissensarbeit liegt es jedoch praktisch gleichauf mit Opus 5.
Kostenstruktur: Trotz günstigerer Cache-Zugriffe bleibt Fable 5.1 teuer
Die regulären API-Preise von Fable 5.1 ändern sich gegenüber dem Vorgänger nicht: 10 Dollar pro Million Eingabe-Token und 50 Dollar pro Million Ausgabe-Token. Damit kostet das Modell bei normalen Ein- und Ausgaben doppelt so viel wie Opus 5. Anthropic selbst empfiehlt Opus 5 für die meisten Anwendungen und Fable 5.1 vor allem für besonders anspruchsvolle und langwierige Aufgaben.
Deutlich günstiger werden dagegen die wiederholten Zugriffe auf bereits verarbeitete Inhalte. Cache Reads kosten nur noch 0,25 statt 1 Dollar pro Million Token – damit sind sie bei Fable 5.1 sogar halb so teuer wie bei Opus 5. Davon profitieren insbesondere Workloads, bei denen Kontext wiederverwendet wird. Anthropic schätzt, dass die Gesamtkosten gegenüber Fable 5 bei typischen Workloads um rund 25 Prozent und bei stark agentischen Workloads um bis zu 45 Prozent sinken.
Die Tests von Artificial Analysis zeigen jedoch, dass ein höherer Tokenverbrauch diese Ersparnis wieder zunichtemachen kann. Bei maximaler Denkleistung erzeugte Fable 5.1 rund 1,7-mal so viele Ausgabe-Token wie Fable 5. Eine Aufgabe im Intelligence Index kostete dadurch im Schnitt 3,76 Dollar – 20 Prozent mehr als mit Fable 5 und rund 60 Prozent mehr als mit Opus 5.
Mythos 5.1: Weniger strikte Schutzmechanismen für risikobereite Anwender
Anthropic hat auch die Sicherheitsmechanismen überarbeitet. Fable 5.1 darf nun Schwachstellen in Quellcode identifizieren, während riskantere Cyberaufgaben wie Penetrationstests, Exploit-Generierung und binäres Schwachstellen-Scanning weiterhin eingeschränkt bleiben. Durch präzisere Schutzmechanismen greifen die Cyber-Safeguards in Claude Code im Schnitt rund 60 Prozent seltener ein als bei Fable 5.
Das nur für geprüfte Nutzer und Organisationen zugängliche Mythos 5.1 verfügt über weniger strikte Cyber-Safeguards als Fable 5.1. In internen Sicherheitstests zeigte es die stärksten Cyberfähigkeiten aller bislang veröffentlichten Anthropic-Modelle, liegt nach Einschätzung des Unternehmens aber noch unter der Schwelle zur höheren Cyber-Risikokategorie.
Beide Modelle, Fable 5.1 und Mythos 5.1, sind die ersten neuen Claude-Modelle mit Anthropics Text-Wasserzeichen. Eine zunächst beschränkt zugängliche Erkennungs-API soll unter anderem Medien, Faktencheckern und Forschern ermöglichen, solche Texte zu identifizieren.
Mit der Veröffentlichung von Fable 5.1 positioniert sich Anthropic als Anbieter eines der leistungsfähigsten Modelle für hochkomplexe Aufgaben – allerdings zu einem Preis, der vor allem Unternehmen mit spezifischen Anforderungen anspricht. Die Kosteneinsparungen durch optimierte Cache-Zugriffe werden durch den höheren Tokenverbrauch bei maximaler Denkleistung teilweise neutralisiert, sodass der tatsächliche Kostenvorteil stark vom Einsatzszenario abhängt. Die strategische Entscheidung, Opus 5 als kosteneffizientere Alternative für Standardaufgaben zu belassen, zeigt, dass Anthropic sein Portfolio bewusst differenziert und auf unterschiedliche Budgets und Anwendungsfälle ausrichtet. Die Einführung von Mythos 5.1 mit reduzierten Schutzmechanismen richtet sich gezielt an Sicherheitsexperten und Entwickler, die tiefere Analysen benötigen, während das Wasserzeichen einen weiteren Baustein für mehr Transparenz und Nachvollziehbarkeit von KI-generierten Inhalten darstellt.