Anthropic startete Claude Opus 4.8 am 28. Mai 2026 — nur 41 Tage nach Opus 4.7. Die Veröffentlichung wird als bedeutendes Qualitäts-Update positioniert: schnellere Antworten, bessere Konsistenz bei langen Kontexten und ein dramatischer Sprung in mathematischem Denken.

Math-Benchmark: 69,3% zu 96,7%

Die auffälligste Verbesserung ist beim USAMO 2026 — der USA Mathematical Olympiad Benchmark. Opus 4.8 erreicht 96,7%, gegenüber 69,3% bei Opus 4.7. Das ist ein 27-Punkt-Sprung in 41 Tagen, was Opus 4.8 zum stärksten öffentlich verfügbaren Modell für fortgeschrittene Mathematik macht.

Opus 4.8 ist auch ungefähr viermal weniger wahrscheinlich, Mängel in seinem eigenen Code zu übersehen, ohne sie zu kennzeichnen, und signalisiert proaktiv Unsicherheit, anstatt selbstbewusst zu halluzinieren.

Dynamic Workflows in Claude Code

Die größte agentenbasierte Funktion ist Dynamic Workflows: Claude Code kann jetzt eine große Aufgabe planen, bis zu 1.000 parallele Subagenten starten, die Arbeit auf sie verteilen und die Ausgaben gegen Ihre Test-Suite überprüfen — alles ohne menschliches Zutun. Die Funktion ist für Repository-Migrationen im großen Maßstab und Umgestaltungen von Hunderttausenden Codezeilen konzipiert, die zuvor ein Team von Ingenieuren erfordern würden.

Preisgestaltung: gleiche Basis, günstigerer Fast-Modus

Die Standard-Preisgestaltung bleibt bei $5 pro Million Input-Token und $25 pro Million Output-Token — identisch mit Opus 4.7. Die große Änderung liegt im Fast-Modus: er sinkt von $30/$150 pro Million Token (Opus 4.7) auf $10/$50 — eine 3× Kostenreduktion für Latenz-sensitive Arbeitslasten. Prompt Caching bringt Einsparungen bis zu 90%; Batch-Verarbeitung bietet 50% Rabatt.

Opus 4.8 ist in Claude.ai für Pro-, Max-, Team- und Enterprise-Abonnenten verfügbar und über die Anthropic API, AWS Bedrock, Google Cloud Vertex AI und Microsoft Foundry.

Mythos Preview kommt bald

Getrennt davon bestätigte Anthropic, dass Claude Mythos Preview — das Modell mit eingeschränktem Zugriff für Cybersicherheit — in den „kommenden Wochen" für genehmigte Organisationen verfügbar sein wird. Während seiner 30-tägigen Vorschau identifizierten Mythos und ~50 Partnerorganisationen mehr als 10.000 Schwachstellen mit hohem oder kritischem Schweregrad in systemisch wichtiger Software.