Anthropic hat am 28. September 2026 seinen Prompting-Leitfaden für Claude Opus 5.5 in der offiziellen Claude-Plattformdokumentation veröffentlicht. Der Leitfaden handelt nicht davon, wie stark das Modell ist — er behandelt nur eines: welche Prompts und Engineering-Setups, die von Opus 5 übernommen wurden, geändert werden müssen. Es gibt eine einzige Kernänderung — bei Opus 5.5 lässt sich Thinking nicht mehr abschalten.
Die größte Änderung: Effort wird zum wichtigsten Stellrad
Opus 5 erlaubte das Deaktivieren von Thinking bei High und darunter; Opus 5.5 akzeptiert diese Option nicht mehr. Stattdessen gibt es die Effort-Stufe: 5.5 startet standardmäßig mit Medium, Opus 5 mit High. In Anthropics Tests erreicht oder übertrifft 5.5 auf Medium bei Coding- und Wissensaufgaben bereits Opus 5 auf High, wobei Low bei einigen Coding-Evaluierungen nah herankommt — zu deutlich geringeren Kosten.
Übernehmen Sie bei der Migration nicht einfach den alten Effort-Wert: Auf derselben Stufe denkt 5.5 pro Turn mehr nach, besonders bei XHigh und Max werden Turns länger und tokenreicher. Anthropic empfiehlt, bei Medium zu starten und jede Stufe gegen eigene Evaluierungen zu testen, statt die Opus-5-Konfiguration zu kopieren. Zwei weitere Fallstricke: Thinking zählt zu max_tokens, daher kann ein für Opus 5 mit deaktiviertem Thinking bemessenes Limit Antworten abschneiden — für lange Agentenaufgaben haben sich 128.000 bewährt; und das Ändern des Top-Level-Effort-Werts invalidiert den Prompt-Cache, also nutzen Sie die Beta-Funktion per-message effort change, um einzelne Turns anzupassen und den Cache zu erhalten.
Vier Änderungen bei der Migration von Thinking-deaktivierten Setups
Lief Ihre Integration mit deaktiviertem Thinking, nennt der Leitfaden vier Änderungen: bei Low Effort starten und messen, bei Qualitätsverlust auf Medium wechseln; Anweisungen entfernen, die das Modell als Thinking-Ersatz sein Reasoning in die Antwort schreiben ließen, und stattdessen aus zusammengefassten Thinking-Blöcken lesen; die Thinking-deaktiviert-Minderungen aus der Opus-5-Ära erneut testen und Überflüssiges streichen; Antworten nach Blocktyp lesen statt anzunehmen, der erste Block sei Text — ein Thinking-Block ist unter der Standardanzeige leer.
Auch sicherheitsseitig gibt es Neues: Neben Biologie und Cybersicherheit existiert eine neue reasoning_extraction-Ablehnungskategorie — Prompts, die das Modell dazu drängen, sein internes Reasoning im Antworttext zu reproduzieren, werden abgelehnt und liefern stop_reason refusal.
Zwei Fallen für unbeaufsichtigte Agenten
Bei langen Aufgaben meldet Opus 5.5 proaktiv Fortschritte, und manche dieser Updates beenden den Turn mit reinem Text. Wer ein textbasiertes Turn-Ende als Aufgabenerledigung wertet, stoppt eine unbeaufsichtigte Schleife zu früh. Der Leitfaden empfiehlt, es als Bericht zu behandeln, nicht als Erledigungsnachweis: Aufgabenbestandteile in einer Checkliste oder Datei verfolgen, und wenn Punkte offen bleiben ohne gemeldete Blockade, eine kurze Nutzernachricht senden, die sie benennt; nach zwei bis drei automatischen Fortsetzungen bei derselben Aufgabe anhalten und manuell prüfen.
Die andere Falle ist „Stille": Fortschritts-Updates stecken in Thinking-Blöcken, deren Text unter der Standardanzeige leer ist, sodass ein Client, der nur Text-Blöcke rendert, lange Turns als Funkstille wahrnimmt. Mit der Beta-Option display: "updates" erhält man eine Zusammenfassung jedes Updates.
Opus 5.5 hat diesmal keine neuen Parameter hinzugefügt — es hat das Kostenmodell ausgetauscht: Bei ständig aktivem Thinking kommen Token-Einsparungen nicht vom Abschalten des Denkens, sondern von der Kalibrierung von Effort auf die Stufe, die die Aufgabe wirklich braucht. Migration bedeutet im Kern nicht, einen Modellnamen zu tauschen, sondern jede Engineering-Annahme aus der Ära des abschaltbaren Thinkings einzeln neu zu verifizieren.