Was ist neu in Claude Sonnet 5
Überblick über neue Funktionen und Verhaltensänderungen in Claude Sonnet 5.
Claude Sonnet 5 ist die nächste Generation von Anthropics Sonnet-Modellfamilie. Es ist ein Drop-in-Upgrade für Claude Sonnet 4.6 mit drei Verhaltensänderungen: adaptives Denken ist standardmäßig aktiviert, manuelles erweitertes Denken gibt jetzt einen 400-Fehler zurück (es wurde auf Claude Sonnet 4.6 abgekündigt), und das Setzen von Sampling-Parametern (temperature, top_p, top_k) auf Nicht-Standardwerte gibt einen 400-Fehler zurück. Diese Seite fasst alles Neue zum Launch zusammen, einschließlich eines neuen Tokenizers.
Neues Modell
| Modell | API-Modell-ID | Beschreibung |
|---|---|---|
| Claude Sonnet 5 | claude-sonnet-5 | Die beste Kombination aus Geschwindigkeit und Intelligenz |
Claude Sonnet 5 unterstützt standardmäßig das 1M-Token-Kontextfenster (1M Token ist sowohl der Standard als auch das Maximum; es gibt keine kleinere Kontextvariante), 128k maximale Ausgabe-Token, adaptives Denken und denselben Satz an Tools und Plattformfunktionen wie Claude Sonnet 4.6, mit Ausnahme von Priority Tier, das auf Claude Sonnet 5 nicht verfügbar ist. Auf der Claude API und Google Cloud unterstützt Claude Sonnet 5 außerdem das Browser-Use-Tool und die stabile computer_toolset_20260801-Version des Computer-Use-Tools, von denen Claude Sonnet 4.6 keines unterstützt; die frühere computer_20251124-Version wird weiterhin auf beiden Modellen akzeptiert. Um eine bestehende Integration zu aktualisieren, siehe Migration von computer_20251124.
Für vollständige Preise und Spezifikationen siehe die Modellübersicht.
Verhaltensänderungen
Adaptives Denken standardmäßig aktiviert
Auf Claude Sonnet 4.6 laufen Anfragen ohne ein thinking-Feld ohne Denken. Auf Claude Sonnet 5 laufen dieselben Anfragen mit adaptivem Denken. Um das Denken auszuschalten, übergib thinking: {type: "disabled"}. Da max_tokens ein hartes Limit für die Gesamtausgabe ist (Denken plus Antworttext), überprüfe es für Workloads, die auf Claude Sonnet 4.6 ohne Denken liefen.
Sampling-Parameter werden nicht akzeptiert
Das Setzen von temperature, top_p oder top_k auf einen Nicht-Standardwert gibt einen 400-Fehler zurück. Entferne diese Parameter bei der Migration; der Standardwert (oder das Weglassen des Parameters) wird akzeptiert. Verwende System-Prompt-Anweisungen, um das Modellverhalten zu steuern. Dies ist neu für Modelle der Sonnet-Klasse; dieselbe Einschränkung wurde zuvor auf Claude Opus 4.7 eingeführt.
Manuelles erweitertes Denken entfernt
Manuelles erweitertes Denken (thinking: {type: "enabled", budget_tokens: N}) wurde auf Claude Sonnet 4.6 abgekündigt; auf Claude Sonnet 5 ist es entfernt und gibt einen 400-Fehler zurück, genau wie auf Claude Opus 4.8 und Claude Opus 4.7. Verwende stattdessen adaptives Denken mit dem Effort-Parameter.
# Nicht unterstützt bei Claude Sonnet 5 (gibt 400 zurück)
thinking = {"type": "enabled", "budget_tokens": 32000}
# Verwende stattdessen dies
thinking = {"type": "adaptive"}Neuer Tokenizer
Claude Sonnet 5 verwendet einen neuen Tokenizer. Derselbe Eingabetext erzeugt etwa 30 % mehr Token als auf Claude Sonnet 4.6. Der genaue Anstieg hängt vom Inhalt ab. Dies ist keine API-Änderung: Anfragen, Antworten und Streaming-Ereignisse behalten dieselbe Form, und es sind keine Codeänderungen erforderlich.
Die Änderung betrifft alles, was du in Token misst oder budgetierst:
- Token-Zählungen:
usage-Felder und Token-Zählungs-Ergebnisse für denselben Text sind höher als auf Claude Sonnet 4.6. Verwende keine Zählungen wieder, die gegen frühere Modelle gemessen wurden; zähle gegen Claude Sonnet 5 neu. - Kontextfenster-Kapazität in Textbegriffen: Das Kontextfenster beträgt 1M Token, aber jedes Token deckt im Durchschnitt weniger Text ab, sodass dasselbe Fenster weniger Text fasst als auf Claude Sonnet 4.6.
max_tokens-Budgets: Ein für Claude Sonnet 4.6 abgestimmtes Ausgabelimit kann äquivalente Ausgaben auf Claude Sonnet 5 abschneiden. Überprüfe Limits, die nahe an deiner erwarteten Ausgabelänge dimensioniert sind.- Kosten pro Anfrage: Die Preise pro Token sind niedriger als die von Claude Sonnet 4.6 (siehe Preise), aber da derselbe Text mehr Token erzeugt, sinken die Kosten einer äquivalenten Anfrage nicht direkt proportional.
Von Claude Sonnet 4.6 geerbte API-Einschränkungen
Assistant-Message-Prefilling wird nicht unterstützt
Das Prefilling der Assistant-Message gibt einen 400-Fehler zurück, unverändert gegenüber Claude Sonnet 4.6. Verwende stattdessen strukturierte Ausgaben, System-Prompt-Anweisungen oder output_config.format.
Fähigkeitsverbesserungen
Claude Sonnet 5 ist ein Fähigkeits-Upgrade gegenüber Claude Sonnet 4.6 zu einem niedrigeren Preis. Es ist auch eine Option für Workloads, die mehr Fähigkeiten benötigen, als Claude Sonnet 4.6 bietet, ohne zu einem Modell der Opus-Klasse zu wechseln.
Die größten Zuwächse gegenüber Claude Sonnet 4.6 liegen bei Coding- und agentischen Aufgaben. Für Benchmark-Ergebnisse siehe Anthropics Transparency Hub.
Cybersicherheits-Schutzmaßnahmen
Claude Sonnet 5 ist das erste Modell der Sonnet-Stufe mit Echtzeit-Cybersicherheits-Schutzmaßnahmen. Anfragen, die verbotene oder hochriskante Cybersicherheitsthemen betreffen, können abgelehnt werden. Ablehnungen werden als erfolgreiche HTTP-200-Antwort mit stop_reason: "refusal" zurückgegeben, nicht als Fehler. Siehe Echtzeit-Cyber-Schutzmaßnahmen auf Claude Opus und Sonnet dafür, was die Schutzmaßnahmen blockieren und wie legitime Sicherheitsarbeit sich für das Cyber Verification Program bewerben kann.
Preise
Claude Sonnet 5 kostet 2 $ pro Million Eingabe-Token und 10 $ pro Million Ausgabe-Token, niedrigere Preise pro Token als die 3 $/15 $ von Claude Sonnet 4.6. Da der neue Tokenizer etwa 30 % mehr Token für denselben Text erzeugt, sinken die Kosten einer äquivalenten Anfrage beim Vergleich mit Claude Sonnet 4.6 nicht direkt proportional zu den Preisen pro Token. Der genaue Unterschied hängt vom Inhalt und der Workload-Form ab.
Siehe Preise für vollständige Preise, einschließlich Batch-Verarbeitung und Prompt-Caching-Raten.
Verfügbarkeit
Zum Launch ist Claude Sonnet 5 verfügbar auf:
- Claude API: verfügbar für alle Kunden.
- AWS: verfügbar über Claude in Amazon Bedrock und Claude Platform on AWS. Auf Amazon Bedrock ist Claude Sonnet 5 auch über die
InvokeModel-API erreichbar, bereitgestellt von derselben Infrastruktur wie Claude in Amazon Bedrock. Die veraltete Claude on Amazon Bedrock (Opus 4.6 und früher)-Integration umfasst Claude Sonnet 5 nicht. - Google Cloud: verfügbar über Claude on Google Cloud.
- Microsoft Foundry: verfügbar über Claude in Microsoft Foundry.
Claude Sonnet 5 unterstützt Zero Data Retention für Organisationen mit ZDR-Vereinbarungen.
Migrationsleitfaden
Claude Sonnet 5 ist ein Drop-in-Ersatz für Claude Sonnet 4.6. Aktualisiere deine Modell-ID:
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # AfterÜberprüfe dann Folgendes:
- Token-Budgets und -Zählungen: Der neue Tokenizer erzeugt etwa 30 % mehr Token für denselben Text. Der genaue Anstieg hängt vom Inhalt und der Workload-Form ab. Zähle Prompts mit Token-Zählung neu und überprüfe
max_tokens-Limits, die nahe an deiner erwarteten Ausgabelänge dimensioniert sind. - Erweitertes Denken: Wenn du noch
budget_tokenssetzt, migriere zu adaptivem Denken. Manuelles erweitertes Denken (thinking: {type: "enabled"}) wird nicht unterstützt und gibt einen 400-Fehler zurück. - Sampling-Parameter: Anfragen, die Sampling-Parameter (
temperature,top_p,top_k) auf einen Nicht-Standardwert setzen, geben einen 400-Fehler zurück; entferne sie bei der Migration. Tool-Definitionen und Antwortformen sind unverändert, und Assistant-Message-Prefilling wurde bereits auf Claude Sonnet 4.6 nicht unterstützt.
Siehe Migration zu Claude Sonnet 5 von Claude Sonnet 4.6 für Details.
Nächste Schritte
Vollständige Spezifikationen und Preise für alle aktuellen Claude-Modelle.
Miss deine Prompts unter dem neuen Tokenizer, bevor du migrierst.
Der empfohlene Denken-an-Modus auf Claude Sonnet 5.
Wie das 1M-Token-Kontextfenster funktioniert.
Vollständige Preise, einschließlich Batch-Verarbeitung und Prompt-Caching-Raten.
Was this page helpful?