Claude Opus 5.5: Neuerungen, Preise, Benchmarks und Vergleich mit Opus 5

Avatar
Lisa Ernst · 26.09.2026 · Künstliche Intelligenz · 11 Min.

Claude Opus 5.5 ist seit dem 22. September 2026 verfügbar und löst Opus 5 nach nur rund zwei Monaten als stärkstes Opus-Modell von Anthropic ab. Die auffälligste Änderung ist nicht nur die höhere Benchmark-Leistung: Die regulären API-Preise sinken von 5 auf 4 US-Dollar pro Million Input-Tokens und von 25 auf 20 US-Dollar pro Million Output-Tokens. Anthropic beziffert die Kosten typischer tokenbasierter Workloads gegenüber Opus 5 sogar auf rund 40 Prozent weniger, weil Opus 5.5 zusätzlich effizienter mit Tokens umgehen soll.

Dieser Überblick zeigt, was bei Opus 5.5 tatsächlich neu ist, wie sich Preis, Kontextfenster und Benchmarks gegenüber Opus 5 verändern, welche Migrationsfallen Entwickler kennen müssen und für wen ein Wechsel sinnvoll ist. Benchmark-Angaben werden dabei als Herstellerwerte eingeordnet und nicht als allgemeingültige Rangliste behandelt.

Kurz & knapp

Was ist Claude Opus 5.5?

Opus 5.5 ist Anthropics neues Spitzenmodell für anspruchsvolle Coding-, Agenten- und Wissensarbeit. Anthropic positioniert es für lange, mehrstufige Aufgaben in grossen Codebasen, komplexe Tool-Nutzung und professionelle Workflows. Wer Claude grundsätzlich einordnen möchte, findet im Zerlo-Überblick Was ist Claude AI? die wichtigsten Grundlagen zu Anthropic, Modellen und Nutzungsmöglichkeiten.

Technisch bleibt vieles vertraut: Opus 5.5 verarbeitet Text und Bilder als Eingabe und erzeugt Text als Ausgabe. Das Kontextfenster liegt laut aktueller Claude-Platform-Dokumentation bei 1 Million Tokens, die reguläre maximale Ausgabe bei 128.000 Tokens. Der verlässliche Wissensstand wird mit Juni 2026 angegeben. Für Ereignisse nach diesem Zeitpunkt braucht das Modell daher weiterhin aktuelle externe Datenquellen oder Web-/Tool-Zugriff.

Was ist bei Opus 5.5 neu?

1. Niedrigere Token-Kosten und höhere Effizienz

Der direkte Listenpreis fällt gegenüber Opus 5 um 20 Prozent: Input sinkt von 5 auf 4 US-Dollar pro Million Tokens, Output von 25 auf 20 US-Dollar. Bei Prompt-Caching ist der Unterschied grösser. Cache-Reads kosten bei Opus 5.5 0,20 US-Dollar pro Million Tokens statt 0,50 US-Dollar bei Opus 5.

Anthropic spricht dennoch von ungefähr 40 Prozent niedrigeren Kosten für typische tokenbasierte Workloads. Der Grund: Nicht nur der Preis pro Token ist niedriger, sondern das Modell soll bei vielen Aufgaben auch weniger Tokens benötigen. Diese 40 Prozent sind deshalb keine pauschale Rabattgarantie. Der tatsächliche Unterschied hängt stark davon ab, wie viel Input, Output und Cache-Nutzung ein konkreter Workflow erzeugt.

2. Adaptive Thinking ist immer aktiv

Bei Opus 5.5 lässt sich Thinking nicht mehr vollständig deaktivieren. Stattdessen steuert der Effort-Parameter, wie viel Rechenaufwand das Modell für eine Anfrage einsetzen soll. Der Standardwert ist bei Opus 5.5 medium; bei Opus 5 war der Standard laut Modelldokumentation high. Das ist für Kosten- und Latenzvergleiche wichtig, weil zwei Modelle bei unterschiedlichen Effort-Stufen nicht direkt miteinander vergleichbar sind.

3. Stärkerer Fokus auf Coding und Agenten

Anthropic hebt insbesondere lang laufende Softwareaufgaben hervor. In veröffentlichten Tests wurden grosse Code-Migrationen, Refactorings, Terminal-Aufgaben und Multi-Tool-Workflows untersucht. Solche Beispiele stammen teilweise von Anthropic oder frühen Testkunden und sind deshalb als Hersteller- beziehungsweise Testergebnisse zu verstehen – nicht als Garantie, dass jedes reale Projekt denselben Zeitgewinn erreicht.

Eine Person arbeitet in einem Computerraum an mehreren Monitoren.

Quelle: ctan.org

Opus 5.5 richtet sich besonders an Entwickler, die lange Coding- und Agenten-Workflows automatisieren. Entscheidend sind dabei nicht nur Benchmark-Punkte, sondern auch Token-Verbrauch, Tool-Nutzung und die Zuverlässigkeit über viele Arbeitsschritte.

4. Erweiterte Sicherheits- und Verhaltensprüfungen

Anthropic berichtet, dass Opus 5.5 in der eigenen automatisierten Verhaltensprüfung besser als frühere Modelle abschneidet und widerstandsfähiger gegen Prompt Injection als Opus 5 sei. Gleichzeitig betont das Unternehmen, dass weiterhin Grenzen bestehen. Das Modell startet zudem mit einer ähnlichen Klasse zusätzlicher Schutzmechanismen wie Fable 5.1, unter anderem für Cybersecurity, Biologie und den Schutz vor Modelldestillation. Für produktive Systeme ersetzt das keine eigene Rechteverwaltung, Eingabevalidierung oder Kontrolle kritischer Aktionen.

Claude Opus 5.5 vs. Opus 5: technische Daten

Merkmal Claude Opus 5.5 Claude Opus 5
Veröffentlichung 22. September 2026 24. Juli 2026
API-Modell-ID claude-opus-5-5 claude-opus-5
Kontextfenster 1 Mio. Tokens 1 Mio. Tokens
Max. reguläre Ausgabe 128.000 Tokens 128.000 Tokens
Input-Preis 4 USD / 1 Mio. Tokens 5 USD / 1 Mio. Tokens
Output-Preis 20 USD / 1 Mio. Tokens 25 USD / 1 Mio. Tokens
Cache-Read 0,20 USD / 1 Mio. Tokens 0,50 USD / 1 Mio. Tokens
Thinking Adaptive Thinking immer aktiv Adaptive Thinking konfigurierbar
Standard-Effort Medium High
Verlässlicher Wissens-Cutoff Juni 2026 Mai 2026
Status Aktuelles Opus-Modell Aktiv, aber Legacy

Claude Opus 5.5: Preise im Detail

Für Entwickler ist die Preisänderung eine der wichtigsten Neuerungen. Die folgende Tabelle zeigt die regulären Claude-API-Listenpreise. Cloud-Anbieter können eigene Abrechnungsdetails haben; Steuern, regionale Zuschläge oder spezielle Inferenzoptionen sind hier nicht berücksichtigt.

API-Kosten pro 1 Mio. Tokens Opus 5.5 Opus 5 Veränderung
Input 4 USD 5 USD -20 %
Output 20 USD 25 USD -20 %
5-Minuten-Cache-Write 5 USD 6,25 USD -20 %
Cache-Read 0,20 USD 0,50 USD -60 %

Ein einfaches Rechenbeispiel zeigt den Basiseffekt: 10 Millionen Input-Tokens plus 2 Millionen Output-Tokens kosten ohne Caching bei Opus 5.5 insgesamt 80 US-Dollar. Mit Opus 5 wären es 100 US-Dollar. Das entspricht genau der 20-prozentigen Reduktion der Listenpreise. Bei cache-intensiven Agenten kann der Unterschied grösser werden.

Zusätzlich gibt es für Opus 5.5 einen Fast Mode mit bis zu 2,5-facher Geschwindigkeit. Er kostet 8 US-Dollar pro Million Input-Tokens und 40 US-Dollar pro Million Output-Tokens. Wer eher auf Kosten als auf minimale Latenz optimiert, sollte deshalb beim normalen Modus bleiben. Die Batch API kann für geeignete asynchrone Aufgaben Input- und Output-Kosten um 50 Prozent reduzieren.

Claude-Abo und API sind getrennt

Opus 5.5 ist in den Claude-Produkten für Pro-, Max-, Team- und Enterprise-Nutzer verfügbar. Die Nutzung der Claude API wird jedoch separat nach API-Verbrauch abgerechnet und ist nicht automatisch durch ein Claude-Pro-Abo enthalten. Für Unternehmen ist diese Trennung wichtig, weil sich Chat-Nutzung und produktive API-Workloads kostenmässig unabhängig entwickeln können.

Benchmarks: Wie viel schneller oder besser ist Opus 5.5?

Anthropic veröffentlicht für Opus 5.5 mehrere eigene Vergleichswerte. In der folgenden Auswahl wird nur Opus 5.5 mit seinem direkten Vorgänger Opus 5 verglichen. Prozentwerte sind absolute Treffer- beziehungsweise Erfolgsraten; bei GDPval-AA handelt es sich um einen Punktwert.

Benchmark Opus 5.5 Opus 5 Differenz
Terminal-Bench 4.0 66,4 % 52,3 % +14,1 Prozentpunkte
FrontierCode v1.1 Main 54,4 % 48,0 % +6,4 Prozentpunkte
CursorBench 4.0 57,8 % 46,6 % +11,2 Prozentpunkte
GDPval-AA v2.1 1846 1708 +138 Punkte
AutomationBench 40,0 % 26,9 % +13,1 Prozentpunkte
Humanity's Last Exam 67,7 % 63,6 % +4,1 Prozentpunkte
Terminal-Bench-Science 0.1 58,7 % 29,0 % +29,7 Prozentpunkte
OSWorld 2.0 81,8 % 74,0 % +7,8 Prozentpunkte

Wichtig: Das sind von Anthropic veröffentlichte Benchmark-Ergebnisse. Die Testkonfigurationen unterscheiden sich je nach Benchmark; sofern nicht anders angegeben, verwendet Anthropic für Opus 5.5 hohe beziehungsweise maximale Effort-Einstellungen. Schutzmechanismen und Fallbacks können ebenfalls das Ergebnis beeinflussen. Ein Benchmark ist deshalb ein Hinweis auf Fähigkeiten, aber kein Ersatz für einen Test mit dem eigenen Prompt, Datensatz, Tool-Setup und Kostenprofil.

Für einen breiteren Vergleich mit einem anderen grossen Modellanbieter ist auch der Zerlo-Artikel Gemini vs. Claude hilfreich. Bei solchen Vergleichen sollte aber immer darauf geachtet werden, welche konkrete Modellgeneration und welcher Testzeitpunkt gemeint sind.

Migration von Opus 5 auf Opus 5.5

Wer Opus 5 nur in der Claude-App nutzt, muss in der Regel wenig beachten. Für API-Integrationen gibt es dagegen mehrere Änderungen, die vor einem produktiven Wechsel getestet werden sollten.

  1. Modell-ID anpassen: Die API verwendet claude-opus-5-5.
  2. Thinking nicht mehr abschalten: Bei Opus 5.5 ist Adaptive Thinking immer aktiv. Anwendungen sollten den Rechenaufwand über effort steuern, statt Thinking komplett zu deaktivieren.
  3. Tool Choice prüfen: Erzwungene Varianten wie any oder ein fest ausgewähltes Tool können bei Opus 5.5 zu einem 400-Fehler führen. Anthropic empfiehlt unter anderem auto in Verbindung mit strikter Tool-Nutzung beziehungsweise strukturierter Ausgabe.
  4. Computer-Use-Tool aktualisieren: Auf der Claude API und bei Google Cloud ist für Opus 5.5 das neuere Computer-Toolset vorgesehen. Bei Amazon Bedrock gelten aus Kompatibilitätsgründen teilweise andere Vorgaben.
  5. Thinking-Blöcke nicht umschreiben: Anwendungen, die Conversation History selbst verarbeiten, sollten Thinking-Blöcke anhand ihres Typs behandeln und unverändert weiterreichen.
Mehrere Personen arbeiten in einem Computerraum an Desktop-PCs.

Quelle: ctan.org

Bei bestehenden API-Workflows lohnt sich vor dem Modellwechsel ein gezielter Regressionstest: besonders bei Tool Choice, Computer Use, strukturierten Ausgaben, langen Konversationen und eigener Kostensteuerung.

Wo ist Claude Opus 5.5 verfügbar?

Für Endnutzer steht Opus 5.5 laut Anthropic in Claude für Pro, Max, Team und Enterprise bereit. Entwickler können das Modell über die Claude Platform beziehungsweise Claude API nutzen. Zusätzlich nennt Anthropic Amazon Web Services, Google Cloud und Microsoft Foundry als unterstützte Plattformen.

Anthropic hat ausserdem die Fünf-Stunden-Nutzungslimits für Pro, Max, Team und sitzbasierte Enterprise-Pläne mit der Einführung von Opus 5.5 erhöht. Wie viel Nutzung tatsächlich möglich ist, hängt trotzdem vom jeweiligen Plan, der Aufgabe und dem Tokenverbrauch ab.

Für wen lohnt sich der Wechsel von Opus 5?

Für neue API-Projekte spricht wenig dafür, noch mit Opus 5 zu starten, wenn keine spezielle Kompatibilitätsanforderung besteht. Opus 5.5 ist günstiger pro Token, aktueller und erreicht in Anthropics veröffentlichten Tests durchgehend bessere Werte als Opus 5 in den hier betrachteten Benchmarks.

Für bestehende Coding- und Agenten-Systeme ist der Wechsel besonders interessant, wenn Cache-Reads, lange Kontexte und viele Tool-Aufrufe einen grossen Teil der Kosten ausmachen. Hier kann die Kombination aus niedrigeren Listenpreisen, deutlich günstigeren Cache-Reads und möglicher Token-Effizienz stärker wirken als die reine 20-Prozent-Preissenkung.

Für produktive Integrationen mit fest verdrahteter Tool-Steuerung sollte die Migration dagegen nicht nur durch Austausch des Modellnamens erfolgen. Die Änderungen bei Thinking und Tool Choice können Verhalten oder API-Fehler verursachen. Ein kurzer Testkatalog mit typischen und kritischen Workflows ist sinnvoller als ein ungeprüfter Rollout.

Grenzen und wichtige Einordnung

FAQ

Wann wurde Claude Opus 5.5 veröffentlicht?

Anthropic veröffentlichte Claude Opus 5.5 am 22. September 2026. Opus 5 war zuvor am 24. Juli 2026 erschienen.

Wie viel kostet Claude Opus 5.5 über die API?

Der reguläre Listenpreis beträgt 4 US-Dollar pro Million Input-Tokens und 20 US-Dollar pro Million Output-Tokens. Cache-Reads kosten 0,20 US-Dollar pro Million Tokens. Fast Mode kostet 8 US-Dollar für Input und 40 US-Dollar für Output pro Million Tokens.

Ist Opus 5.5 günstiger als Opus 5?

Ja. Die regulären Input- und Output-Preise sind jeweils 20 Prozent niedriger. Cache-Reads sind 60 Prozent günstiger. Anthropic schätzt typische tokenbasierte Workloads insgesamt auf rund 40 Prozent weniger Kosten, weil Opus 5.5 zusätzlich weniger Tokens pro Aufgabe benötigen kann.

Hat Claude Opus 5.5 ein grösseres Kontextfenster als Opus 5?

Nein. Beide Modelle werden in der aktuellen Claude-Platform-Dokumentation mit einem Kontextfenster von bis zu 1 Million Tokens und einer regulären maximalen Ausgabe von 128.000 Tokens geführt.

Ist Opus 5.5 besser beim Programmieren als Opus 5?

In den von Anthropic veröffentlichten Coding- und Terminal-Benchmarks liegt Opus 5.5 vor Opus 5, unter anderem bei Terminal-Bench 4.0, FrontierCode und CursorBench 4.0. Für reale Projekte sollte die Qualität trotzdem mit dem eigenen Codebestand, Tooling und Prompt-Setup getestet werden.

Muss ich meine API-Integration für Opus 5.5 ändern?

Mindestens die Modell-ID muss angepasst werden. Je nach Integration sind zusätzlich Änderungen bei Thinking, Tool Choice und Computer Use erforderlich. Wer diese Funktionen nutzt, sollte Anthropics Migrationshinweise prüfen und die Anwendung vor dem produktiven Wechsel testen.

Ist Claude Opus 5.5 im kostenlosen Claude-Tarif enthalten?

Anthropic nennt Opus 5.5 für Pro-, Max-, Team- und Enterprise-Nutzer. Der kostenlose Claude-Tarif gehört nicht zu den von Anthropic für Opus 5.5 aufgeführten Plänen.

Fazit

Claude Opus 5.5 ist kein kleines Zwischenupdate. Gegenüber Opus 5 kombiniert Anthropic höhere veröffentlichte Benchmark-Werte mit niedrigeren API-Preisen, deutlich günstigeren Cache-Reads und einer stärkeren Ausrichtung auf lange Coding- und Agenten-Aufgaben. Das 1-Million-Token-Kontextfenster bleibt erhalten; neu sind vor allem Effizienz, Modellverhalten und API-Details rund um Thinking und Tools.

Für neue anspruchsvolle Claude-Projekte ist Opus 5.5 damit die naheliegende Opus-Version. Bei bestehenden Opus-5-Systemen lohnt sich der Wechsel ebenfalls, sollte aber wegen der Änderungen an Thinking, Tool Choice und Computer Use als echte Migration getestet werden. Die Benchmark-Vorteile sind vielversprechend, entscheidend bleibt jedoch das Ergebnis im eigenen Workflow – inklusive Kosten, Latenz und Fehlerrate.

Teilen Sie doch unseren Beitrag!
Quellen