Claude Platform Docs
Modelle & PreiseClaude Sonnet 5

Was ist neu in Claude Sonnet 5

Überblick über neue Funktionen und Verhaltensänderungen in Claude Sonnet 5.

Claude Sonnet 5 ist die nächste Generation von Anthropics Sonnet-Modellfamilie. Es ist ein Drop-in-Upgrade für Claude Sonnet 4.6 mit drei Verhaltensänderungen: adaptives Denken ist standardmäßig aktiviert, manuelles erweitertes Denken gibt jetzt einen 400-Fehler zurück (es wurde auf Claude Sonnet 4.6 abgekündigt), und das Setzen von Sampling-Parametern (temperature, top_p, top_k) auf Nicht-Standardwerte gibt einen 400-Fehler zurück. Diese Seite fasst alles Neue zum Launch zusammen, einschließlich eines neuen Tokenizers.

Neues Modell

ModellAPI-Modell-IDBeschreibung
Claude Sonnet 5claude-sonnet-5Die beste Kombination aus Geschwindigkeit und Intelligenz

Claude Sonnet 5 unterstützt standardmäßig das 1M-Token-Kontextfenster (1M Token ist sowohl der Standard als auch das Maximum; es gibt keine kleinere Kontextvariante), 128k maximale Ausgabe-Token, adaptives Denken und denselben Satz an Tools und Plattformfunktionen wie Claude Sonnet 4.6, mit Ausnahme von Priority Tier, das auf Claude Sonnet 5 nicht verfügbar ist. Auf der Claude API und Google Cloud unterstützt Claude Sonnet 5 außerdem das Browser-Use-Tool und die stabile computer_toolset_20260801-Version des Computer-Use-Tools, von denen Claude Sonnet 4.6 keines unterstützt; die frühere computer_20251124-Version wird weiterhin auf beiden Modellen akzeptiert. Um eine bestehende Integration zu aktualisieren, siehe Migration von computer_20251124.

Für vollständige Preise und Spezifikationen siehe die Modellübersicht.

Verhaltensänderungen

Adaptives Denken standardmäßig aktiviert

Auf Claude Sonnet 4.6 laufen Anfragen ohne ein thinking-Feld ohne Denken. Auf Claude Sonnet 5 laufen dieselben Anfragen mit adaptivem Denken. Um das Denken auszuschalten, übergib thinking: {type: "disabled"}. Da max_tokens ein hartes Limit für die Gesamtausgabe ist (Denken plus Antworttext), überprüfe es für Workloads, die auf Claude Sonnet 4.6 ohne Denken liefen.

Sampling-Parameter werden nicht akzeptiert

Das Setzen von temperature, top_p oder top_k auf einen Nicht-Standardwert gibt einen 400-Fehler zurück. Entferne diese Parameter bei der Migration; der Standardwert (oder das Weglassen des Parameters) wird akzeptiert. Verwende System-Prompt-Anweisungen, um das Modellverhalten zu steuern. Dies ist neu für Modelle der Sonnet-Klasse; dieselbe Einschränkung wurde zuvor auf Claude Opus 4.7 eingeführt.

Manuelles erweitertes Denken entfernt

Manuelles erweitertes Denken (thinking: {type: "enabled", budget_tokens: N}) wurde auf Claude Sonnet 4.6 abgekündigt; auf Claude Sonnet 5 ist es entfernt und gibt einen 400-Fehler zurück, genau wie auf Claude Opus 4.8 und Claude Opus 4.7. Verwende stattdessen adaptives Denken mit dem Effort-Parameter.

# Nicht unterstützt bei Claude Sonnet 5 (gibt 400 zurück)
thinking = {"type": "enabled", "budget_tokens": 32000}

# Verwende stattdessen dies
thinking = {"type": "adaptive"}

Neuer Tokenizer

Claude Sonnet 5 verwendet einen neuen Tokenizer. Derselbe Eingabetext erzeugt etwa 30 % mehr Token als auf Claude Sonnet 4.6. Der genaue Anstieg hängt vom Inhalt ab. Dies ist keine API-Änderung: Anfragen, Antworten und Streaming-Ereignisse behalten dieselbe Form, und es sind keine Codeänderungen erforderlich.

Die Änderung betrifft alles, was du in Token misst oder budgetierst:

  • Token-Zählungen: usage-Felder und Token-Zählungs-Ergebnisse für denselben Text sind höher als auf Claude Sonnet 4.6. Verwende keine Zählungen wieder, die gegen frühere Modelle gemessen wurden; zähle gegen Claude Sonnet 5 neu.
  • Kontextfenster-Kapazität in Textbegriffen: Das Kontextfenster beträgt 1M Token, aber jedes Token deckt im Durchschnitt weniger Text ab, sodass dasselbe Fenster weniger Text fasst als auf Claude Sonnet 4.6.
  • max_tokens-Budgets: Ein für Claude Sonnet 4.6 abgestimmtes Ausgabelimit kann äquivalente Ausgaben auf Claude Sonnet 5 abschneiden. Überprüfe Limits, die nahe an deiner erwarteten Ausgabelänge dimensioniert sind.
  • Kosten pro Anfrage: Die Preise pro Token sind niedriger als die von Claude Sonnet 4.6 (siehe Preise), aber da derselbe Text mehr Token erzeugt, sinken die Kosten einer äquivalenten Anfrage nicht direkt proportional.

Von Claude Sonnet 4.6 geerbte API-Einschränkungen

Assistant-Message-Prefilling wird nicht unterstützt

Das Prefilling der Assistant-Message gibt einen 400-Fehler zurück, unverändert gegenüber Claude Sonnet 4.6. Verwende stattdessen strukturierte Ausgaben, System-Prompt-Anweisungen oder output_config.format.

Fähigkeitsverbesserungen

Claude Sonnet 5 ist ein Fähigkeits-Upgrade gegenüber Claude Sonnet 4.6 zu einem niedrigeren Preis. Es ist auch eine Option für Workloads, die mehr Fähigkeiten benötigen, als Claude Sonnet 4.6 bietet, ohne zu einem Modell der Opus-Klasse zu wechseln.

Die größten Zuwächse gegenüber Claude Sonnet 4.6 liegen bei Coding- und agentischen Aufgaben. Für Benchmark-Ergebnisse siehe Anthropics Transparency Hub.

Cybersicherheits-Schutzmaßnahmen

Claude Sonnet 5 ist das erste Modell der Sonnet-Stufe mit Echtzeit-Cybersicherheits-Schutzmaßnahmen. Anfragen, die verbotene oder hochriskante Cybersicherheitsthemen betreffen, können abgelehnt werden. Ablehnungen werden als erfolgreiche HTTP-200-Antwort mit stop_reason: "refusal" zurückgegeben, nicht als Fehler. Siehe Echtzeit-Cyber-Schutzmaßnahmen auf Claude Opus und Sonnet dafür, was die Schutzmaßnahmen blockieren und wie legitime Sicherheitsarbeit sich für das Cyber Verification Program bewerben kann.

Preise

Claude Sonnet 5 kostet 2 $ pro Million Eingabe-Token und 10 $ pro Million Ausgabe-Token, niedrigere Preise pro Token als die 3 $/15 $ von Claude Sonnet 4.6. Da der neue Tokenizer etwa 30 % mehr Token für denselben Text erzeugt, sinken die Kosten einer äquivalenten Anfrage beim Vergleich mit Claude Sonnet 4.6 nicht direkt proportional zu den Preisen pro Token. Der genaue Unterschied hängt vom Inhalt und der Workload-Form ab.

Siehe Preise für vollständige Preise, einschließlich Batch-Verarbeitung und Prompt-Caching-Raten.

Verfügbarkeit

Zum Launch ist Claude Sonnet 5 verfügbar auf:

Claude Sonnet 5 unterstützt Zero Data Retention für Organisationen mit ZDR-Vereinbarungen.

Migrationsleitfaden

Claude Sonnet 5 ist ein Drop-in-Ersatz für Claude Sonnet 4.6. Aktualisiere deine Modell-ID:

model = "claude-sonnet-4-6"  # Before
model = "claude-sonnet-5"  # After

Überprüfe dann Folgendes:

  1. Token-Budgets und -Zählungen: Der neue Tokenizer erzeugt etwa 30 % mehr Token für denselben Text. Der genaue Anstieg hängt vom Inhalt und der Workload-Form ab. Zähle Prompts mit Token-Zählung neu und überprüfe max_tokens-Limits, die nahe an deiner erwarteten Ausgabelänge dimensioniert sind.
  2. Erweitertes Denken: Wenn du noch budget_tokens setzt, migriere zu adaptivem Denken. Manuelles erweitertes Denken (thinking: {type: "enabled"}) wird nicht unterstützt und gibt einen 400-Fehler zurück.
  3. Sampling-Parameter: Anfragen, die Sampling-Parameter (temperature, top_p, top_k) auf einen Nicht-Standardwert setzen, geben einen 400-Fehler zurück; entferne sie bei der Migration. Tool-Definitionen und Antwortformen sind unverändert, und Assistant-Message-Prefilling wurde bereits auf Claude Sonnet 4.6 nicht unterstützt.

Siehe Migration zu Claude Sonnet 5 von Claude Sonnet 4.6 für Details.

Nächste Schritte

Vollständige Spezifikationen und Preise für alle aktuellen Claude-Modelle.

Miss deine Prompts unter dem neuen Tokenizer, bevor du migrierst.

Der empfohlene Denken-an-Modus auf Claude Sonnet 5.

Wie das 1M-Token-Kontextfenster funktioniert.

Vollständige Preise, einschließlich Batch-Verarbeitung und Prompt-Caching-Raten.

Was this page helpful?