Am 22. September 2026 hat Anthropic über sein offizielles Newsroom Claude Opus 5.5 vorgestellt – das erste Modell der neuen 5.5-Familie. Laut dem Unternehmen erreicht es bei den meisten Aufgaben das Niveau des Top-Modells Claude Fable 5.1, kostet im typischen Betrieb aber 40 % weniger als sein Vorgänger Opus 5, erzeugt Ausgaben mehr als 30 % schneller, und die API-Preise sinken von 5/25 US-Dollar auf 4/20 US-Dollar pro Million Input-/Output-Tokens – ein Minus von 20 %.
Stärker, aber nicht teurer: Der Trumpf ist Effizienz
Das ist kein gewöhnliches „größer und stärker"-Upgrade. Anthropics Vergleichstabelle zeigt Opus 5.5 vorn bei mehreren Benchmarks für agentisches Coding und Wissensarbeit – Terminal-Bench 4.0 (66,4 %), FrontierCode v1.1, GDPval-AA v2.1 – auch vor OpenAIs GPT-6 Astra. Der unabhängige Evaluator Artificial Analysis vergab 58 Punkte im Intelligence Index – der höchste je gemessene Wert, rund fünf Punkte vor Fable 5.1 und GPT-6 Astra.
Die Preisangaben brauchen jedoch einen Sternchenhinweis. Artificial Analysis stellte auch fest, dass Opus 5.5 in der Maximalstufe rund 119.000 Tokens pro Benchmark-Aufgabe verbraucht – deutlich mehr als GPT-6 Astra mit 27.000. Die Stückpreise sanken um 20 %, doch das Modell geht großzügiger mit Tokens um, sodass die Kosten pro Aufgabe in der Maximalstufe etwa auf dem Niveau von Opus 5 liegen. Wirklich gespart wird in den mittleren und niedrigeren Stufen: Vier der fünf Stufen liegen auf der Pareto-Front von Intelligenz gegen Kosten pro Aufgabe – unter den Modellen über 50 Punkten ist Opus 5.5 also entweder günstiger oder stärker.
Erstmals: Der Sicherheitsbericht kommt gleich mit
Bemerkenswert wie der Preis ist, dass Anthropic die Sicherheitsbewertung auf Augenhöhe mit der Leistung präsentiert. Vor dem Release wurde Opus 5.5 von zwei externen Organisationen – METR und Frontier Design – getestet und erreichte im automatisierten Verhaltensaudit von Anthropic die höchste je gemessene Punktzahl. Tests der Sicherheitsfirma Gray Swan zeigen, dass es zusammen mit Fable 5.1 die niedrigste Prompt-Injection-Erfolgsrate aller getesteten Modelle hat. Die begleitende Systemkarte legt die Bewertung vollständig offen: Weil die Fähigkeiten in Biologie und Cybersicherheit an Fable 5.1 heranreichen, gelten gleichwertige Schutzmaßnahmen – geprüfte Forschungseinrichtungen können sich über das Life Sciences Verification Program für die Nutzung in der Biologieforschung bewerben.
Einordnung: Die erste Antwort nach dem Tempo-Manifest
Dies ist der erste große Release, seit Anthropic-CEO Dario Amodei öffentlich dazu aufgerufen hat, das Tempo der Frontier-Entwicklung zu drosseln. Die Haltung dieser Antwort ist klar: beim Flaggschiff in der Leistung gleichziehen, bei den Preisen nach unten gehen, bei der Sicherheit vorangehen. Die neue Version von Claude Code macht Opus 5.5 bereits zum Standard-Opus-Modell, die Fünf-Stunden-Nutzungslimits für Pro, Max, Team und Enterprise wurden erhöht, und Sonnet 5.5 sowie Haiku 5.5 folgen in den kommenden Wochen.
Für die Branche ist das Signal eindeutig: Der Wettbewerb der Frontier-Modelle verlagert sich von reinen Benchmark-Punkten hin zu den Kosten pro erledigter realer Aufgabe. Wenn das stärkste Modell gleichzeitig günstiger und transparenter wird, müssen Entwickler ihre Kalkulation neu aufstellen.