{"id":50904,"date":"2026-09-02T11:48:31","date_gmt":"2026-09-02T09:48:31","guid":{"rendered":"https:\/\/overcentral.com\/de\/?p=50904"},"modified":"2026-09-02T11:48:31","modified_gmt":"2026-09-02T09:48:31","slug":"claude-fable-5-1-benchmarks-spitze-50904","status":"publish","type":"post","link":"https:\/\/overcentral.com\/de\/claude-fable-5-1-benchmarks-spitze-50904\/","title":{"rendered":"Claude Fable 5.1 setzt sich in Benchmarks an die Spitze, bleibt aber teuer"},"content":{"rendered":"<p><a href=\"https:\/\/www.anthropic.com\" target=\"_blank\" rel=\"noopener noreferrer\" data-iacss-external=\"1\">Anthropic<\/a> hat mit Claude Fable 5.1 und Claude Mythos 5.1 zwei neue Modelle ver\u00f6ffentlicht, die insbesondere bei anspruchsvollen agentischen Aufgaben deutlich zulegen. W\u00e4hrend Fable 5.1 in aktuellen Benchmarks die Spitzenposition erobert, bleiben die API-Preise unver\u00e4ndert hoch \u2013 ein Umstand, der vor allem bei intensiver Nutzung den Kostenvorteil durch g\u00fcnstigere Cache-Zugriffe wieder aufzehren kann.<\/p>\n<h2>Benchmark-Ergebnisse: Fable 5.1 \u00fcbertrifft alle Vorg\u00e4nger<\/h2>\n<p>In eigenen Tests von Anthropic zeigt das Modell vor allem bei komplexen, mehrstufigen Arbeitsabl\u00e4ufen eine deutliche Verbesserung. Im Terminal-Bench-Science, der wissenschaftliche Arbeitsabl\u00e4ufe in einer Terminal-Umgebung pr\u00fcft, steigt die Erfolgsquote von 24,7 Prozent (Fable 5) auf 52,6 Prozent. Beim Terminal-Bench 4.0, der agentische Coding-Aufgaben bewertet, verbessert sich das Modell von 42,<a href=\"https:\/\/overcentral.com\/de\/modder-bringen-windows-nt-4-0-auf-den-nintendo-gamecube\/\" title=\"Modder bringen Windows NT 4.0 auf den Nintendo GameCube\" data-iacss-internal=\"1\">0 auf<\/a> 55,8 Prozent. Der AutomationBench, der B\u00fcroaufgaben \u00fcber verschiedene Anwendungen hinweg simuliert, zeigt einen Sprung von 17,1 auf 31,4 Prozent. Kleinere Zuw\u00e4chse verzeichnet Anthropic zudem bei Wissensarbeit, Computersteuerung und allgemeinem logischen Schlussfolgern.<\/p>\n<p>Externe Tests von Artificial Analysis untermauern den Leistungssprung: Im Intelligence Index erreicht Fable 5.1 bei maximaler Denkleistung 66 Punkte und setzt sich damit an die Spitze des Rankings. Zum Vergleich: Fable 5 erzielt 62 Punkte, Opus 5 kommt auf 63 und GPT-5.6 Sol auf 61 Punkte. Auch bei Terminal-Bench v2.1 und SciCode erzielt Fable 5.1 die bislang h\u00f6chsten Werte. Bei anderen Tests f\u00fcr agentische Wissensarbeit liegt es jedoch praktisch gleichauf mit Opus 5.<\/p>\n<h3>Kostenstruktur: Trotz g\u00fcnstigerer Cache-Zugriffe bleibt Fable 5.1 teuer<\/h3>\n<p>Die regul\u00e4ren API-Preise von Fable 5.1 \u00e4ndern sich gegen\u00fcber dem Vorg\u00e4nger nicht: 10 Dollar pro Million Eingabe-Token und 50 Dollar pro Million Ausgabe-Token. Damit kostet das Modell bei normalen Ein- und Ausgaben doppelt so viel wie Opus 5. Anthropic selbst empfiehlt Opus 5 f\u00fcr die meisten Anwendungen und Fable 5.1 vor allem f\u00fcr besonders anspruchsvolle und langwierige Aufgaben.<\/p>\n<p>Deutlich g\u00fcnstiger werden dagegen die wiederholten Zugriffe auf bereits verarbeitete Inhalte. Cache Reads kosten nur noch 0,25 statt 1 Dollar pro Million Token \u2013 damit sind sie bei Fable 5.1 sogar halb so teuer wie bei Opus 5. Davon profitieren insbesondere Workloads, bei denen Kontext wiederverwendet wird. Anthropic sch\u00e4tzt, dass die Gesamtkosten gegen\u00fcber Fable 5 bei typischen Workloads um rund 25 Prozent und bei stark agentischen Workloads um bis zu 45 Prozent sinken.<\/p>\n<p>Die Tests von Artificial Analysis zeigen jedoch, dass ein h\u00f6herer Tokenverbrauch diese Ersparnis wieder zunichtemachen kann. Bei maximaler Denkleistung erzeugte Fable 5.1 rund 1,7-mal so viele Ausgabe-Token wie Fable 5. Eine Aufgabe im Intelligence Index kostete dadurch im Schnitt 3,76 Dollar \u2013 <a href=\"https:\/\/overcentral.com\/de\/emea-netzausfaelle-steigen-20-prozent\/\" title=\"EMEA-Netzausf\u00e4lle steigen um 20 Prozent\" data-iacss-internal=\"1\">20 Prozent<\/a> mehr als mit Fable 5 und rund 60 Prozent mehr als mit Opus 5.<\/p>\n<h2>Mythos 5.1: Weniger strikte Schutzmechanismen f\u00fcr risikobereite Anwender<\/h2>\n<p>Anthropic hat auch die Sicherheitsmechanismen \u00fcberarbeitet. Fable 5.1 darf nun Schwachstellen in Quellcode identifizieren, w\u00e4hrend riskantere Cyberaufgaben wie Penetrationstests, Exploit-Generierung und bin\u00e4res Schwachstellen-Scanning weiterhin eingeschr\u00e4nkt bleiben. Durch pr\u00e4zisere Schutzmechanismen greifen die Cyber-Safeguards in <a href=\"https:\/\/overcentral.com\/de\/china-warnt-vor-hintertuer-claude-code-50252\/\" title=\"China warnt vor Hintert\u00fcr in Claude Code - Anthropic widerspricht\" data-iacss-internal=\"1\">Claude Code<\/a> im Schnitt rund 60 Prozent seltener ein als bei Fable 5.<\/p>\n<p>Das nur f\u00fcr gepr\u00fcfte Nutzer und Organisationen zug\u00e4ngliche Mythos 5.1 verf\u00fcgt \u00fcber weniger strikte Cyber-Safeguards als Fable 5.1. In internen Sicherheitstests zeigte es die st\u00e4rksten Cyberf\u00e4higkeiten aller bislang ver\u00f6ffentlichten Anthropic-Modelle, liegt nach Einsch\u00e4tzung des Unternehmens aber noch unter der Schwelle zur h\u00f6heren Cyber-Risikokategorie.<\/p>\n<p>Beide Modelle, Fable 5.1 und Mythos 5.1, sind die ersten neuen Claude-Modelle mit Anthropics Text-Wasserzeichen. Eine zun\u00e4chst beschr\u00e4nkt zug\u00e4ngliche Erkennungs-API soll unter anderem Medien, Faktencheckern und Forschern erm\u00f6glichen, solche Texte zu identifizieren.<\/p>\n<p>Mit der Ver\u00f6ffentlichung von Fable 5.1 positioniert sich Anthropic als Anbieter eines der leistungsf\u00e4higsten Modelle f\u00fcr hochkomplexe Aufgaben \u2013 allerdings zu einem Preis, der vor allem Unternehmen mit spezifischen Anforderungen anspricht. Die Kosteneinsparungen durch optimierte Cache-Zugriffe werden durch den h\u00f6heren Tokenverbrauch bei maximaler Denkleistung teilweise neutralisiert, sodass der tats\u00e4chliche Kostenvorteil stark vom Einsatzszenario abh\u00e4ngt. Die strategische Entscheidung, Opus 5 als kosteneffizientere Alternative f\u00fcr Standardaufgaben zu belassen, zeigt, dass Anthropic sein Portfolio bewusst differenziert und auf unterschiedliche Budgets und Anwendungsf\u00e4lle ausrichtet. Die Einf\u00fchrung von Mythos 5.1 mit reduzierten Schutzmechanismen richtet sich gezielt an Sicherheitsexperten und Entwickler, die tiefere Analysen ben\u00f6tigen, w\u00e4hrend das Wasserzeichen einen weiteren Baustein f\u00fcr mehr Transparenz und Nachvollziehbarkeit von KI-generierten Inhalten darstellt.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Anthropic hat mit Claude Fable 5.1 und Claude Mythos 5.1 zwei neue Modelle ver\u00f6ffentlicht, die insbesondere bei anspruchsvollen agentischen Aufgaben deutlich zulegen. W\u00e4hrend Fable 5.1 in aktuellen Benchmarks die Spitzenposition erobert, bleiben die API-Preise unver\u00e4ndert hoch \u2013 ein Umstand, der vor allem bei intensiver Nutzung den Kostenvorteil durch g\u00fcnstigere Cache-Zugriffe wieder aufzehren kann. Benchmark-Ergebnisse: Fable [&hellip;]<\/p>\n","protected":false},"author":5,"featured_media":53647,"comment_status":"closed","ping_status":"","sticky":false,"template":"","format":"standard","meta":{"fifu_image_url":"https:\/\/cards.overcentral.com\/cards\/de\/50904.png","fifu_image_alt":"Claude Fable 5.1 setzt sich in Benchmarks an die Spitze, bleibt aber","footnotes":""},"categories":[6671],"tags":[],"class_list":["post-50904","post","type-post","status-publish","format-standard","has-post-thumbnail","category-scherheit"],"fifu_image_url":"https:\/\/cards.overcentral.com\/cards\/de\/50904.png","fifu_image_alt":"Claude Fable 5.1 setzt sich in Benchmarks an die Spitze, bleibt aber","_links":{"self":[{"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/posts\/50904","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/users\/5"}],"replies":[{"embeddable":true,"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/comments?post=50904"}],"version-history":[{"count":2,"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/posts\/50904\/revisions"}],"predecessor-version":[{"id":50906,"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/posts\/50904\/revisions\/50906"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/media\/53647"}],"wp:attachment":[{"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/media?parent=50904"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/categories?post=50904"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/overcentral.com\/de\/wp-json\/wp\/v2\/tags?post=50904"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}