Technische Recherche mit Quellenangaben. Eigene Messungen sind im Artikel gekennzeichnet.

Dieser Artikel wurde mit KI-Unterstützung recherchiert und geschrieben. Inhaltlich verantwortlich: Julian Dominic Altmann. Wie diese Seite entsteht

Veröffentlicht: 29. September 2026 Aktualisiert: 29. September 2026

Über den Autor

Stand: 29. September 2026

Anthropic hat Claude Sonnet 5.5 am 28. September 2026 veröffentlicht. Das Modell behält den API-Preis von Sonnet 5 bei, soll laut Anthropic aber deutlich schneller und effizienter arbeiten. Gleichzeitig gibt es mehrere API-Änderungen, die bei einer direkten Migration von Sonnet 5 zu Fehlern führen können.

Die wichtigsten Eckdaten: 1 Million Tokens Kontext, 128.000 reguläre maximale Output-Tokens und $2 pro Million Input- sowie $10 pro Million Output-Tokens. Prompt-Cache-Reads kosten $0,20 pro Million Tokens.

Claude Sonnet 5.5 ist kein einfaches Preisupdate. Der Tokenpreis bleibt unverändert, Anthropic meldet jedoch höhere Geschwindigkeit, bessere Coding- und Agentenleistung und geringere Kosten pro erledigter Aufgabe. Für bestehende Integrationen sind insbesondere Thinking, Tool Choice und anbieterspezifische Modell-IDs relevant.

Claude Sonnet 5.5 auf einen Blick

MerkmalClaude Sonnet 5.5
Veröffentlichung28. September 2026
Claude-API-IDclaude-sonnet-5-5
Kontextfenster1.000.000 Tokens
Reguläres Outputlimit128.000 Tokens
Batch-Output-Betabis 300.000 Tokens
Inputpreis$2 / 1 Mio. Tokens
Outputpreis$10 / 1 Mio. Tokens
5-Minuten-Cache-Write$2,50 / 1 Mio. Tokens
1-Stunden-Cache-Write$4 / 1 Mio. Tokens
Cache-Read$0,20 / 1 Mio. Tokens
ThinkingAdaptive
Standard-Effort in der APIHigh
Knowledge CutoffJuni 2026
Training CutoffJuni 2026

Quelle: Anthropic Claude Platform, geprüft am 29. September 2026.

anthropic/claude-sonnet-5.5 oder claude-sonnet-5-5?

Beides kann korrekt sein – aber nicht auf derselben Plattform.

  • Claude API: claude-sonnet-5-5
  • Vercel AI Gateway: anthropic/claude-sonnet-5.5
  • OpenRouter: anthropic/claude-sonnet-5.5
  • Amazon Bedrock: anthropic.claude-sonnet-5-5
  • AWS Global Inference: global.anthropic.claude-sonnet-5-5
  • Google Cloud: claude-sonnet-5-5
  • Microsoft Foundry: claude-sonnet-5-5

Diese Unterscheidung ist technisch relevant: Wer eine Gateway-ID direkt in die native Anthropic SDK übernimmt, verwendet nicht die korrekte native Modellbezeichnung.

Tabelle der anbieterspezifischen Modell-IDs für Claude Sonnet 5.5: Claude API und Google Cloud nutzen claude-sonnet-5-5, Amazon Bedrock anthropic.claude-sonnet-5-5, AWS Global Inference global.anthropic.claude-sonnet-5-5, Microsoft Foundry claude-sonnet-5-5, Vercel AI Gateway und OpenRouter anthropic/claude-sonnet-5.5.

Was verbessert Sonnet 5.5 gegenüber Sonnet 5?

Anthropic nennt zwei zentrale Verbesserungen:

  1. mehr als 30 % höhere Ausgabegeschwindigkeit
  2. bis zu 30 % geringere Kosten pro erledigter Aufgabe

Der zweite Punkt ist leicht misszuverstehen. Der Listenpreis pro Token ist nicht gesunken. Sonnet 5 und Sonnet 5.5 kosten beide $2 pro Million Input- und $10 pro Million Output-Tokens.

Anthropic führt die geringeren Aufgabenkosten stattdessen auf weniger benötigte Tokens und Tool-Aufrufe zurück. Das ist eine Effizienzbehauptung und keine pauschale 30-%-Rabattgarantie.

Benchmarks: besonders stark bei Coding und Agenten

Anthropic berichtet unter anderem:

BenchmarkSonnet 5.5Sonnet 5Opus 5.5
Terminal-Bench 4.070,6 %10,3 %66,4 %
FrontierCode 1.146,2 % Max / 52,1 % Xhigh42,4 %54,4 %
CursorBench 4.055,5 %34,1 %57,8 %
GDPval-AA v2.1184414491846
AA-Briefcase v1.1181113591822

Diese Werte stammen aus Anthropics Launchmaterial und sind deshalb Hersteller-Benchmarks.

Balkenvergleich der von Anthropic berichteten Coding-Benchmarks: Sonnet 5.5 erreicht Terminal-Bench 4.0 mit 70,6 Prozent gegenüber 10,3 Prozent für Sonnet 5 und 66,4 Prozent für Opus 5.5, bei CursorBench 4.0 55,5 gegenüber 34,1 und 57,8 Prozent.

Wichtige Beobachtung: Max Effort ist nicht automatisch besser

Auf FrontierCode erreicht Sonnet 5.5 laut Anthropic mit Xhigh 52,1 %, mit Max dagegen 46,2 %.

Anthropic erklärt das damit, dass Max häufiger zusätzliche Code-Review-Subagenten einsetzte. Das führte in einigen Fällen zu Timeouts oder zu Änderungen außerhalb des eigentlichen Aufgabenbereichs.

Für reale Deployments bedeutet das: Effort-Level sollten mit eigenen Evals getestet werden.

Was zeigen unabhängige Benchmarks?

Vals AI meldet für Sonnet 5.5 einen Vals Index von 69,22 ± 0,96 %. Das Modell erreicht dort unter anderem:

  • Code Migration: 69,83 %
  • Vibe Code Bench v1.1: 92,39 %
  • Terminal-Bench 4.0: 53,03 %

Der Terminal-Bench-Wert liegt deutlich unter Anthropics 70,6 %. Daraus folgt nicht automatisch, dass einer der beiden Werte falsch ist.

Agentische Benchmarks reagieren stark auf Unterschiede bei:

  • Harness
  • Effort-Level
  • Tool-Konfiguration
  • Timeouts
  • Fallbacks
  • Agent-Loop

Hersteller- und unabhängige Benchmarkwerte sollten deshalb getrennt dargestellt werden.

Was kostet Claude Sonnet 5.5 praktisch?

Preisübersicht der Claude-Sonnet-5.5-API je eine Million Tokens: Input 2 US-Dollar, Output 10 US-Dollar, Cache-Read 0,20 US-Dollar und 5-Minuten-Cache-Write 2,50 US-Dollar.

Ein Request mit 10.000 Input-Tokens und 2.000 Output-Tokens kostet ohne Cache:

  • Input: 10.000 / 1.000.000 × $2 = $0,02
  • Output: 2.000 / 1.000.000 × $10 = $0,02
  • Gesamt: $0,04

1.000 identische Aufrufe mit dieser Tokenverteilung kosten damit ungefähr $40 reine Tokenkosten.

Prompt Caching

Wenn von 10.000 Input-Tokens bei einem Folgeaufruf 8.000 Tokens aus dem Cache gelesen werden:

  • 2.000 neue Input-Tokens: $0,004
  • 8.000 Cache-Read-Tokens: $0,0016
  • 2.000 Output-Tokens: $0,02
  • Gesamt: $0,0256

Der vorherige Cache-Write wird separat berechnet.

Batch API

Nicht zeitkritische Batch-Verarbeitung reduziert reguläre Input- und Outputpreise um 50 % auf effektiv $1 / $5 pro Million Tokens.

Die wichtigsten Breaking Changes

Übersicht der vier zentralen API-Änderungen beim Wechsel von Sonnet 5 auf Sonnet 5.5: Thinking disabled wird durch between_tools ersetzt, erzwungene Tool-Auswahl durch automatische Auswahl mit Strict Tool Use, der Thinking-Verlauf soll nur ergänzt werden und Computer Use verlangt das Toolset computer_toolset_20260801.

1. thinking: disabled funktioniert nicht mehr

Sonnet 5 akzeptierte:

{"thinking":{"type":"disabled"}}

Sonnet 5.5 lehnt diese Konfiguration ab.

Für weniger Upfront-Reasoning steht stattdessen zur Verfügung:

{"thinking":{"type":"between_tools"}}

between_tools funktioniert bei Low, Medium und High Effort. Xhigh und Max verwenden Adaptive Thinking.

2. Forced Tool Choice fällt weg

tool_choice: any und ein erzwungenes konkretes Tool werden nicht mehr unterstützt.

Anthropic empfiehlt automatische Auswahl und bei Bedarf Strict Tool Use.

3. Thinking-Blöcke sind stärker an Modell und Conversation gebunden

Gespräche mit Sonnet 5.5 sollten im Regelfall append-only behandelt werden. Nachträgliche Änderungen an älteren Messages, Tools oder Systemprompts können vorhandene Thinking-Blöcke ungültig machen.

4. Computer Use wurde geändert

Für Claude API und Google Cloud wird statt computer_20251124 das neuere computer_toolset_20260801 benötigt. Provider können sich dabei unterscheiden.

5. Effort-Level neu evaluieren

Low, Medium, High, Xhigh und Max sollten nicht als direkt identische Fortsetzung der Sonnet-5-Stufen behandelt werden.

Kontextfenster und Output

Claude Sonnet 5.5 bietet:

  • 1.000.000 Tokens Kontext
  • 128.000 reguläre Output-Tokens
  • bis 300.000 Output-Tokens über Batch-Beta

Das Outputlimit ist nicht mit dem Kontextfenster zu verwechseln.

Claude Sonnet 5.5 vs. Opus 5.5

ModellInput / 1 Mio.Output / 1 Mio.
Sonnet 5.5$2$10
Opus 5.5$4$20

Sonnet 5.5 kostet damit pro regulärem Input- und Output-Token halb so viel wie Opus 5.5.

Anthropic positioniert Sonnet 5.5 für klar definierte Coding-, Agenten- und Knowledge-Work-Aufgaben, während Opus 5.5 bei besonders komplexen, offenen Aufgaben stärker positioniert bleibt.

Für wen lohnt sich Sonnet 5.5?

Sonnet 5.5 ist besonders interessant für:

  • Coding-Agenten
  • automatisierte Tool-Workflows
  • lange Dokumentkontexte
  • Knowledge-Work
  • Anwendungen mit hohem Tokenvolumen
  • Workflows, in denen Opus-Qualität nicht zwingend erforderlich ist

Weniger sinnvoll ist ein pauschaler Wechsel ohne eigene Tests, wenn ein Workflow empfindlich auf Tool-Verhalten, Reasoning-Level oder Agent-Loops reagiert.

Fazit: Migration vor Feature-Denken

Claude Sonnet 5.5 kombiniert ein 1M-Kontextfenster, relativ niedrige $2/$10 API-Preise und eine Leistung, die in mehreren Hersteller- und unabhängigen Benchmarks nahe an die Flaggschiffklasse heranreicht.

Der wichtigste praktische Punkt ist jedoch die Migration: Sonnet 5.5 ist nicht in jeder Konfiguration ein vollständig kompatibler Drop-in-Replacement für Sonnet 5.

Thinking, Tool Choice, Conversation State, Computer Use und Effort-Level sollten vor einem Produktionswechsel gezielt geprüft werden.

Häufig gestellte Fragen

Was ist der Unterschied zwischen Claude Sonnet 5 und Sonnet 5.5?

Sonnet 5.5 wurde am 28. September 2026 veröffentlicht. Der Token-Preis bleibt bei 2 US-Dollar pro Million Input- und 10 US-Dollar pro Million Output-Tokens, Anthropic nennt aber über 30 Prozent schnellere Ausgabe und bis zu 30 Prozent geringere Kosten pro erledigter Aufgabe. Die API verhält sich anders: Thinking Disabled und erzwungene Tool-Auswahl entfallen.

Wie hoch sind die API-Kosten für Claude Sonnet 5.5?

Ein Request mit 10.000 Input- und 2.000 Output-Tokens kostet ohne Cache 0,04 US-Dollar. 1.000 solcher Requests kosten rund 40 US-Dollar. Kommen 8.000 der Input-Tokens aus dem Prompt-Cache, sinkt derselbe Request auf 0,0256 US-Dollar. Über die Batch-API gelten 50 Prozent niedrigere Raten, also effektiv 1 und 5 US-Dollar pro Million Tokens.

Welche Modell-ID nutze ich für Claude Sonnet 5.5?

In der Claude API heißt das Modell claude-sonnet-5-5, bei OpenRouter und Vercel AI Gateway anthropic/claude-sonnet-5.5, bei Amazon Bedrock anthropic.claude-sonnet-5-5 und für AWS Global Inference global.anthropic.claude-sonnet-5-5. Eine Gateway-ID funktioniert nicht automatisch im nativen Anthropic-SDK.

Kann ich Sonnet 5.5 direkt für Sonnet 5 einsetzen?

Nicht in jeder Konfiguration. Die Option thinking disabled wird mit einem 400-Fehler abgelehnt, stattdessen gibt es between_tools. Erzwungene Tool-Auswahl mit tool_choice any oder einem festen Tool wird nicht mehr unterstützt. Gespräche sollten append-only behandelt werden, und Computer Use verlangt unter Claude API und Google Cloud das Toolset computer_toolset_20260801.

Lohnt sich der Wechsel auf Sonnet 5.5 für Agenten-Workflows?

Für Coding-Agenten, automatisierte Tool-Workflows und lange Dokumentkontexte ist Sonnet 5.5 naheliegend, weil das 1M-Kontextfenster erhalten bleibt und die Coding-Benchmarks deutlich über Sonnet 5 liegen. Bei workflows, die auf Tool-Verhalten oder Agent-Loops reagieren, sollten Thinking, Tool-Auswahl und Effort-Level vorher mit eigenen Tests geprüft werden.

Warum weichen die Benchmark-Werte von Anthropic und Vals AI ab?

Anthropic meldet für Sonnet 5.5 auf Terminal-Bench 4.0 70,6 Prozent, Vals AI dagegen 53,03 Prozent. Agentische Benchmarks reagieren stark auf Harness, Effort-Level, Tool-Konfiguration, Timeouts und Fallbacks. Kein Wert ist deshalb automatisch falsch, beide sollten getrennt und mit Methodik-Label dargestellt werden.

Transparenz

Quellen und Prüfgrundlage

16

Diese Primär- und Referenzquellen bilden die Grundlage der technischen Einordnung. Herstellerangaben und externe Benchmarks werden im Artikel als solche gekennzeichnet.

  1. anthropic.com claude-sonnet-5-5
  2. platform.claude.com sonnet-5-5 / overview
  3. platform.claude.com sonnet-5-5 / whats-new-sonnet-5-5
  4. platform.claude.com sonnet-5-5 / migration-guide
  5. platform.claude.com about-claude / pricing
  6. platform.claude.com build-with-claude / extended-thinking
  7. platform.claude.com build-with-claude / prompt-caching
  8. platform.claude.com build-with-claude / effort
  9. platform.claude.com build-with-claude / preserved-thinking
  10. aws.amazon.com machine-learning / introducing-claude-sonnet-5-5-on-aws
  11. docs.cloud.google.com claude / sonnet-5-5
  12. learn.microsoft.com concepts / models-from-partners
  13. vercel.com changelog / claude-sonnet-5-5-now-available-on-ai-gateway
  14. vals.ai models / anthropic_claude-sonnet-5-5
  15. venturebeat.com technology / anthropic-launches-claude-sonnet-5-5-with-30-cost-reduction-per-task-due-to-faster-speeds-and-fewer-tool-calls
  16. tbench.ai www.tbench.ai