Vorab: Opus 5.5 ist kein Modellstring-Tausch. Am 22. September 2026 hat Anthropic Claude Opus 5.5 (claude-opus-5-5) ausgeliefert. Die Preisliste wirkt freundlich: $4 / $20 Input / Output, 20 % unter Opus 5; Cache-Reads $0.20, minus 60 %. Anthropic sagt, typische Lasten kosten etwa 40 % weniger. Am selben Tag hat OpenAI GPT-6 Sol und Luna ungefähr halbiert. Was Produktion bricht, sind vier harte Fehler: thinking lässt sich nicht abschalten; tool_choice-Werte any und tool liefern 400; thinking-Blöcke sind an Modell und Conversation gebunden; die Claude API und Google Cloud lehnen computer_20251124 ab. Pipelines, die ein JSON-Objekt durch einen erzwungenen Tool-Call garantiert haben, müssen jetzt auto plus strict: true und ein JSON Schema nutzen — oder Structured Output.
Stand 24. September 2026, gegen Anthropics Modellseite und „What’s new“, die an dem Tag noch aktuell waren. Diese Seite hat bereits warum Tool Calling von JSON Schema abhängt, was Structured Output ist und warum Agenten nach der Agents API JSON brauchen. Dieser Text beantwortet nur, welche Schicht des JSON-Vertrags sich ändern muss, wenn Sie auf 5.5 gehen.
Was am 22. September erschienen ist
Claude Opus 5.5 ist das erste Modell der Claude-5.5-Familie. Offizielle Positionierung: langlebige agentische Coding- und Wissensarbeit. Die ID ist claude-opus-5-5 auf der Claude API, Google Cloud und Microsoft Foundry; Bedrock nutzt anthropic.claude-opus-5-5. Retirement nicht vor dem 22. September 2027. Sonnet 5.5 und Haiku 5.5 folgen „in den kommenden Wochen.“
Preise pro Million Tokens: $4 rein, $20 raus, $5 für einen 5-Minuten-Cache-Write, $8 für einen 1-Stunden-Cache-Write, $0.20 für einen Cache-Read. Batch ist halber Preis. Fast Mode nur auf der Claude API: speed: "fast" plus fast-mode-2026-02-01, $8 / $40, bis etwa 2,5× Tempo. Default-effort ist medium — Opus 5 defaultete auf high. Lassen Sie effort weg, ändert sich das Verhalten. Das ist keine stille Kompatibilität.
Die Launch-Tabelle setzt Terminal-Bench 4.0 auf 66,4 % gegen 57,9 % von GPT-6 Astra. Anthropic sagt außerdem: in dieser Fähigkeitsklasse sind Score-Lücken ein schwächerer Leitfaden als echte Tasks, und der gefühlte Abstand zu Fable 5.1 ist schmaler als die Tabelle. Dieser Artikel wählt kein Modell von einer Rangliste.
Vier harte Fehler, eine Tabelle
Die Docs listen die Requests, die auf 5.5 zu 400 werden. Die ersten drei gelten auch für Fable 5.1:
| Alter Request | Auf 5.5 | Was Sie stattdessen senden |
|---|---|---|
thinking: {"type": "disabled"} oder enabled plus budget_tokens | 400 invalid_request_error | thinking weglassen oder {"type": "adaptive"} senden; Tiefe mit effort steuern |
tool_choice: {"type": "any"} oder {"type": "tool", "name": "..."} | 400; der Token-Counting-Endpunkt wendet denselben Check an | auto (oder none) plus strict: true, oder Structured Output |
| Einen thinking-Block replayen, nachdem Sie system / tools / eine frühere Message editiert haben | 400 per Default auf Accounts, die nach dem 31. August 2026 angelegt wurden | Conversation nur anhängen; Instructions mit einer Mid-Conversation-System-Message ändern |
computer_20251124 auf der Claude API oder Google Cloud | 400 | computer_toolset_20260801; Bedrock akzeptiert das alte Tool weiter |
Eine weitere Änderung bricht den Request nicht, wird aber still: die kurzen Notizen zwischen Tool-Calls kommen jetzt als thinking-Blöcke. Beim Default display: "omitted" ist der Text leer. Eine UI, die diese Sätze als Fortschrittsbalken gestreamt hat, verstummt. Setzen Sie thinking.display, wenn Sie den Fortschritt brauchen.
Warum Sie JSON nicht mehr mit tool_choice erzwingen können
Der Patch 2024–2025 war: ein „extract“-Tool definieren, tool_choice auf any setzen oder das Tool benennen, und das Modell musste ein Objekt liefern, das zu input_schema passt. Das Programm las die Tool-Arguments und rief nie JSON.parse auf Chat-Prosa auf. Auf 5.5 ist dieser Pfad ein 400:
tool_choice: type "tool" and "any" are not supported for this model.
Der offizielle Ersatz ist nicht wieder „bitte JSON ausgeben“. Lassen Sie tool_choice auf auto, setzen Sie strict: true am Tool, und pinnen Sie die Parameter mit JSON Schema. Wenn die finale Antwort eine feste Form haben muss, legen Sie das Schema auf Structured Output. Wenn das Modell ein Tool rufen soll statt in Prosa zu antworten, sagen Sie im Prompt, wann das Tool gilt. Der Prompt beeinflusst, welches Tool auto wählt. Er ersetzt das Schema nicht.
5.5 macht JSON also nicht weniger wichtig. Es nimmt die Krücke eines erzwungenen Calls. Ist die Krücke weg, muss der Vertrag allein stehen. Siehe warum Tool Calling von JSON Schema abhängt.
auto + strict + JSON Schema
Die kleinste Form nach der Migration ist:
{
"model": "claude-opus-5-5",
"tool_choice": { "type": "auto" },
"tools": [
{
"name": "extract_order",
"description": "Extract a confirmed order. Call when the user has named a sku and a quantity.",
"strict": true,
"input_schema": {
"type": "object",
"properties": {
"sku": { "type": "string" },
"qty": { "type": "integer", "minimum": 1 }
},
"required": ["sku", "qty"],
"additionalProperties": false
}
}
]
}
strict: true lässt den Decoder Parameter gegen das Schema annehmen. Fehlende Felder, falsche Typen und Extra-Keys sollten hier sterben — nicht auf die Wette, dass ein erzwungener Call ein Objekt liefert. Wenn die finale Antwort auch in ein Programm geht, nutzen Sie Structured Output. Assistant-Sätze nicht parsen. Siehe was Structured Output ist und warum JSON.parse scheitert.
Um ein Tool-Schema mitten in der Conversation zu ändern, kann 5.5 eine volle Definition in einer Mid-Conversation-System-Message unter inline-tools-2026-09-15 mitführen, ohne das Top-Level-tools-Array zu editieren. Das ist dieselbe Regel wie prefix-gebundenes Thinking: History anhängen; keinen Vertrags-Snapshot umschreiben, der schon raus ist.
Thinking bleibt an, und Sie dürfen das Replay nicht editieren
Adaptive Thinking ist bei 5.5 immer an. disabled oder ein manuelles budget_tokens ist ein 400. Tiefe, Latenz und Kosten laufen über effort: low / medium / high / xhigh / max. Wo Sie früher Thinking abgeschaltet haben, um Tokens zu sparen, senken Sie effort. Bei gleichem effort-Setting denkt 5.5 pro Turn tendenziell mehr als Opus 5, besonders bei xhigh und max. Lassen Sie in max_tokens Platz für dieses Thinking.
Jeder thinking-Block merkt, welches Modell ihn geschrieben hat. 5.5 kann Blöcke von Opus 5 und früheren Opus / Sonnet / Haiku lesen. Es liest nicht Fable oder Mythos. Andersherum: Fable 5.1 und Mythos 5.1 auf der Claude API können 5.5-Blöcke lesen; kein anderes Modell kann das. Unlesbare Blöcke fallen weg, bevor das Modell sie sieht. Der Request liefert weiter 200; weggefallene Blöcke werden nicht berechnet. Um zu sehen, was weggefallen ist, senden Sie thinking-binding-controls-2026-08-01 und lesen Sie das Top-Level-Array input_transformations.
Prefix-Binding ist strenger. Accounts, die am oder nach dem 31. August 2026, 00:00 UTC, angelegt wurden, prüfen per Default, ob System-Prompt, Tools oder eine frühere Message sich geändert haben, seit der Block entstanden ist. Replay nach so einer Änderung ist ein 400. Das ist Preserved Thinking von Fable 5.1. Gehen Sie nicht zurück und editieren Sie kein Tool-Schema in der History, um „den Vertrag zu reparieren“ — das macht das Thinking ungültig. Neue Tools mit einer Mid-Conversation-System-Message anhängen. Thinking-Blöcke unverändert echoen, wenn Sie Tool-Results zurückgeben.
computer_20251124 und ein stiller Fortschrittsbalken
Auf der Claude API und Google Cloud akzeptiert 5.5 nur computer_toolset_20260801. Behalten Sie den Beta-Header computer-use-2025-11-24 und den alten Tool-Typ, bekommen Sie 400. Bedrock akzeptiert computer_20251124 weiter. Browser Use und Integrationen, die schon auf dem Toolset liegen, brauchen keine Änderung. Der Loop muss Member-tool_use-Blöcke, gebatchte Actions und toolset_name auf Results verarbeiten.
Der kurze Satz zwischen Tool-Calls ist kein text-Block mehr. Bei display omitted stirbt der Fortschrittsstream, und es gibt keinen Fehler. Das ist kein Schema-Fehler. Es ist Lesen von Blöcken nach Position statt nach type. Zuerst nach type branchen, dann entscheiden, ob Sie thinking.display setzen.
Sol und Luna stehen neben der Preisliste
Am selben Tag hat OpenAI GPT-6 Sol (gpt-6-sol, $2 / $10) und GPT-6 Luna (gpt-6-luna, $0.10 / $0.50) ausgeliefert, etwa die Hälfte der GPT-5.6-Peers. Astra bleibt bei $10 / $50. Lunas offizielle Aufgabe ist High-Volume-Extraktion und -Zusammenfassung mit klarem Ziel — die Spur, die JSON-Pipelines mögen. Ein niedrigerer Listenpreis legitimiert kein lockereres Schema.
Wählen Sie keine Route nur nach Listenpreis. Die typischen 40 % Ersparnis bei Opus 5.5 sind zur Hälfte Cache und weniger Tokens pro Task, nicht die 20 % auf der Karte. Default-effort von high auf medium verschiebt Rechnung und Latenz. Fahren Sie dasselbe Schema durch einen Extraktions-Sweep, bevor Sie das Routing ändern. GPT-5.5 verlässt ChatGPT / Work / Codex weiter am 14. Oktober (die API liegt außerhalb dieses Retirements). Das ist eine andere Produktlinie. Mischen Sie sie nicht mit diesen Breaking Changes in ein Ticket „alles upgraden“.
Vier Checks, bevor Sie den Modellstring ändern
- Suchen Sie nach
tool_choice. Jedesany/ benanntetooldurchautoersetzen. Für stabiles JSONstricteinschalten undinput_schemaanziehen. - Suchen Sie nach
thinking.disabledundbudget_tokensentfernen.effortexplizit setzen. Blöcke nachtypelesen. Thinking unverändert echoen. - Suchen Sie nach
computer_20251124. Auf der Claude API und Google Cloud auf das Toolset gehen. Bedrock kann warten. - Replay und Cache. Auf Accounts nach dem 31. August Tools oder system in der History nicht editieren. Ein Schema mit einer angehängten Message ändern. Compaction (
compact-2026-09-04) kann eine signierte Summary einsetzen und Thinking gültig halten, unter den Bedingungen auf Anthropics Compaction-Seite.
Das Schema mit lokalen JSON-Tools prüfen
Bevor Sie das Modell auf claude-opus-5-5 setzen, drei Texte im Browser auslegen: das alte input_schema, ein arguments-Objekt, das Sie früher mit tool_choice erzwungen haben, und das Schema, das Sie strict markieren wollen.
- JSON-Validator — ist die Grammatik legal; wenn Sie ein Schema haben, Pflichtfelder und Extra-Keys zusammen prüfen.
- JSON-Formatierer — eine einzeilige Tool-Definition aufklappen und sehen, ob
additionalPropertiesgesetzt ist. - JSON Diff — ein Sample aus einem erzwungenen Call mit dem kleinsten Objekt vergleichen, das das strict-Schema erlaubt.
Nichts verlässt den Browser. Den Vertrag stabilisieren, dann den Modellstring ändern. 5.5 wird effort ändern, mehr denken und das alte tool_choice ablehnen. Ihre Feldnamen und die required-Liste sollten nicht mit ihm lockern.
FAQ
Reicht es, nur das Modell auf claude-opus-5-5 zu stellen?
Nicht als Default. Wenn der Request weiter thinking.disabled, budget_tokens, tool_choice any/tool oder computer_20251124 auf der Claude API hat, bekommen Sie 400.
Ohne erzwungenes Tool, wie bekomme ich weiter JSON?
Lassen Sie tool_choice auf auto, setzen Sie strict am Tool, füllen Sie required, und setzen Sie additionalProperties auf false. Die finale Antwort auf Structured Output legen. Chat-Prosa nicht mit JSON.parse parsen.
Wenn thinking nicht abschaltbar ist, ist die Rechnung immer höher?
Nicht unbedingt. Listenpreise sind niedriger, Cache-Reads günstiger, und Anthropic nennt etwa 40 % weniger bei typischer Last. Default-effort ist medium. Tiefe mit effort handeln. Die Rechnung nicht mit disabled handeln.
Braucht Fable 5.1 dieselben Edits?
Immer-an-Thinking, keine erzwungenen Tools und gebundene thinking-Blöcke gelten schon für Fable 5.1. Der computer_20251124-Bruch sitzt vor allem auf der Claude API und Google Cloud für 5.5. Bedrock akzeptiert das ältere Computer-Tool weiter.
Warum ist der Fortschrittsbalken verstummt?
Die kurzen Notizen zwischen Tool-Calls sind in thinking-Blöcke gewandert. Default-display lässt den Text weg. Blöcke nach type lesen und thinking.display setzen, wenn Sie Fortschritt brauchen. Das ist kein Schema-Validierungsfehler.
Ist das dasselbe wie das GPT-5.5-Retirement am 14. Oktober?
Nein. GPT-5.5 verlässt ChatGPT / Work / Codex; der Hinweis berührt die API nicht. Opus 5.5 ist das neue Modell eines anderen Vendors plus Breaking Changes. Die zwei Linien getrennt migrieren.
Fazit
Opus 5.5 macht „einen Tool-Call erzwingen“ aus einer legalen Krücke zu einem 400. Die Preisliste und die typischen 40 % Ersparnis decken die vier harten Fehler nicht. Für stabiles JSON: auto plus strict plus JSON Schema, oder Structured Output. Thinking bleibt an, Blöcke binden an die Conversation, und das alte Computer-Tool stirbt auf manchen Plattformen — das ist eine Checkliste, bevor Sie den String ändern, keine Beobachtung nach dem Launch.
Ziehen Sie das Schema, ein Sample-arguments-Objekt und den strict-Vertrag zuerst in einem lokalen Validator glatt, dann wechseln Sie auf claude-opus-5-5. Modelle ändern sich. Effort wandert. Ihr Feldvertrag sollte nicht mit ihnen lockern.