Claude Opus 5 übertrifft Fable 5 in den meisten Benchmarks – zum halben Preis

By: rootdata|2026/07/24 18:28:43

Claude Opus 5 ist heute erschienen. Es ist günstiger für Unternehmen zu betreiben als Anthropics führendes Modell, Claude Fable 5, das das Unternehmen als das alltägliche Spitzenprodukt für zahlende Nutzer positioniert hatte. Darüber hinaus übertrifft Opus 5 es auch in wichtigen Benchmarks.

Um zu verstehen, wo Opus 5 passt: Anthropics Produktpalette umfasst vier Stufen. Haiku ist schnell und günstig. Sonnet ist im mittleren Preissegment. Opus ist das Arbeitstier. Darüber hinaus gibt es die Mythos-Klasse – eine Stufe, die Anthropic diesen Frühling eingeführt hat – die Claude Fable 5 für die Öffentlichkeit und Claude Mythos 5, eine Version mit weniger Einschränkungen, die über Project Glasswing für geprüfte Cybersicherheitsforscher und Betreiber kritischer Infrastrukturen reserviert ist, umfasst.

Fable 5 hatte eine schwierige Zeit als Flaggschiff für Abonnenten. Es wurde am 9. Juni gestartet, drei Tage später weltweit zurückgezogen, nachdem die US-Regierung eine Notfall-Ausfuhrkontrollanordnung wegen einer Jailbreak-Sicherheitsanfälligkeit erlassen hatte, und kam am 30. Juni zurück – nur um sofort auf ein Modell nur mit Credits umzustellen, das nicht mehr in den Standardplänen enthalten war. Opus 5 füllt nun die Lücke, die Fable 5 nicht halten konnte.

Lovable, eine Entwicklerplattform mit Millionen von Nutzern, hat Opus 5 in ihren internen Bewertungen getestet und festgestellt, dass die Gewinne über die reinen Punktzahlen hinausgehen: "Es ist nicht nur besser bei unseren schwierigsten agentischen Codierungsaufgaben, 22 % besser als Opus 4.7, es ist auch stabiler, mit viel weniger Varianz von Lauf zu Lauf," sagte Fabian Hedin in einer von Anthropic geteilten Erklärung.

Die Benchmarks

Es mag seltsam erscheinen, aber Opus übertrifft Fable in fast allem, was für den alltäglichen Nutzer wichtig ist, ohne als Mythos-Klasse wie Fable gekennzeichnet zu sein.

Bei Frontier-Bench v0.1 – einem Benchmark, der testet, ob KI-Coding-Agenten echte Software-Engineering-Aufgaben von Anfang bis Ende abschließen können, bewertet als Prozentsatz der bestandenen Aufgaben – erreichte Opus 5 43,3 %. Fable 5 kam auf 33,7 %. OpenAIs GPT-5.6 Sol, Anthropics Hauptkonkurrent, erzielte 34,4 %.

Der größte Abstand besteht bei ARC-AGI-3, einem Test für echtes Problemlösen, der auf neuartigen Rätseln basiert, die ein Modell nicht aus Trainingsdaten hätte auswendig lernen können, bewertet als Prozentsatz der gelösten Rätsel. Opus 5 erreichte 30,2 %; GPT-5.6 Sol erzielte 7,8 %; und Fable 5 wurde überhaupt nicht getestet. Bei GDPval-AA v2 – einem Benchmark für Wissensarbeit, bewertet über Elo-Rankings, das Schach-ähnliche Rankingsystem zur Messung der relativen Leistung bei realen professionellen Aufgaben – erreichte Opus 5 1.861 gegenüber Fable 5s 1.747 und GPT-5.6 Sols 1.736.

Zapier testete Opus 5 auf AutomationBench, einer Bewertung, die misst, ob ein Modell einen vollständigen Geschäftsablauf von Anfang bis Ende ohne menschliche Hilfe durchführen kann. Ihr Urteil: Das Modell "nahm ein rohes Konto-Gesundheits-Arbeitsbuch und führte eine vollständige Abwanderungspräventionssequenz von Anfang bis Ende durch: Kennzeichnung gefährdeter Konten, Benachrichtigung des richtigen Eigentümers und Zusammenfassung für die Retentionsoperationen. Frühere Modelle bestanden nicht; Opus 5 erreichte 100 %."

Anthropic positioniert Opus 5 auch als Forschungsupgrade. Ultima Genomics, ein Unternehmen für DNA-Sequenzierung, sagte, das Modell "verhält sich mehr wie ein sorgfältiger Wissenschaftler als jedes Modell, das wir getestet haben. Es greift nach den richtigen statistischen Tests, um Störfaktoren auszuschließen, überprüft seine eigenen Ergebnisse mit unabhängigen Methoden und bleibt bei langen mehrstufigen Analysen auf Kurs."

Das gesagt, sind diese beiden Bereiche – Recht und Gesundheit – die einzigen, in denen Fable 5 mit einem kleinen Vorsprung glänzt.

Die Veröffentlichung erfolgt eine Woche, nachdem Moonshot AI, ein in Peking ansässiges Startup, das von Alibaba unterstützt wird, Kimi K3 vorgestellt hat – ein 2,8 Billionen Parameter umfassendes Open-Weight-Modell (was bedeutet, dass jeder den zugrunde liegenden Code herunterladen kann, um es unabhängig auszuführen), das Moonshot als das größte offene KI-System der Welt beschreibt. Unabhängige Benchmarks platzieren Kimi K3 konsequent auf dem dritten Platz, hinter sowohl Fable 5 als auch GPT-5.6 Sol, und übertrifft diese beiden in bestimmten Bereichen.

Opus 5 ist jetzt über API für 5 USD pro Million Eingabetokens und 25 USD pro Million Ausgabetokens verfügbar. (Tokens sind die grundlegende Informationseinheit, die ein KI-Modell sowohl bei Eingaben als auch bei Ausgaben verarbeiten kann). Ein schneller Modus, der mit etwa 2,5-mal der Standardgeschwindigkeit läuft, ist ebenfalls verfügbar, zum doppelten Basispreis – 10 USD pro Million Eingabetokens und 50 USD pro Million Ausgabetokens.

Diese Veröffentlichung könnte die Sorgen über die mangelnde öffentliche Verfügbarkeit von Fable 5 beenden. Opus ist auch für alle über ein Abonnement verfügbar.

Haftungsausschluss: Dieser Inhalt wird nur zu allgemeinen Marketing- und Informationszwecken bereitgestellt und stellt keine finanzielle, Anlage-, Rechts- oder Steuerberatung dar. Alle Events, Prämien, Online-Aktionen oder zugehörige Informationen sollten nicht als Empfehlung, Aufforderung oder Einladung zum Kauf, Verkauf, Handel oder anderweitigem Umgang mit Krypto-Assets oder zur Nutzung von Services betrachtet werden. Krypto-Assets sind sehr volatil und können zu Verlusten führen. WEEX Services und Online-Aktionen sind möglicherweise nicht in allen Regionen verfügbar und unterliegen geltenden Gesetzen, Vorschriften und Berechtigungsanforderungen. Sie sind dafür verantwortlich sicherzustellen, dass Ihre Nutzung von WEEX Services mit lokalen Gesetzen übereinstimmt, und sorgfältig die Risiken vor der Teilnahme an Krypto-bezogenen Aktivitäten zu bewerten.

Das könnte Ihnen auch gefallen

iconiconiconiconiconiconicon
Kundenservice:@weikecs
Geschäftliche Zusammenarbeit:@weikecs
Quant-Trading & MM:bd@weex.com
VIP-Programm:support@weex.com