Claude Platform Docs
Modelle & PreiseClaude Sonnet 5.5

Migration zu Claude Sonnet 5.5

Code von Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5, Claude Sonnet 4, Claude 3.7 Sonnet oder Claude Haiku 4.5 auf Claude Sonnet 5.5 umstellen: Einstellungen, die Fehler zurückgeben, Änderungen beim Nachdenken und eine Checkliste für jedes Ausgangsmodell.

Dieser Leitfaden listet die Codeänderungen für den Umstieg von Claude Sonnet 5, Claude Sonnet 4.6, Claude Sonnet 4.5, Claude Sonnet 4, Claude 3.7 Sonnet oder Claude Haiku 4.5 auf Claude Sonnet 5.5 auf. Lies die ersten beiden Abschnitte und lies dann weiter bis zum Abschnitt für dein aktuelles Modell. Die Migrations-Checkliste listet jede Änderung nach Ausgangsmodell auf.

Claude Sonnet 5.5 hat dieselben Preise wie Claude Sonnet 5. Siehe Claude-Preise. Zum „context window" (Kontextfenster) und zu den Ausgabelimits siehe die Modellseite zu Claude Sonnet 5.5. Zu Funktionen und Prompting siehe Neuerungen in Claude Sonnet 5.5 und Prompting für Claude Sonnet 5.5.

Eine Anfrage an Claude Sonnet 5.5 senden

Diese Anfrage funktioniert auf Claude Sonnet 5.5 unverändert. Sie legt eine Stufe für „effort" (Aufwand) fest, und die SDK-Tabs lesen die Antwort nach Blocktyp. Sie lässt fünf Einstellungen weg, die einen 400-Fehler zurückgeben: Thinking-Budgets, Sampling-Parameter, Assistant-Prefill, erzwungene Tool-Auswahl und thinking: {"type": "disabled"}.

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=4096,
    messages=[
        {
            "role": "user",
            "content": "Analyze the trade-offs between microservices and monolithic architectures",
        }
    ],
    output_config={"effort": "medium"},
)

print(f"Stop reason: {response.stop_reason}")
for block in response.content:
    if block.type == "text":
        print(block.text)

Nachdenken läuft standardmäßig

Auf Claude Sonnet 5.5 läuft eine Anfrage ohne thinking-Feld mit „adaptive thinking" (adaptivem Nachdenken), ebenso wie thinking: {"type": "adaptive"}. Auf Claude Sonnet 4.6 und früheren Modellen sowie auf Claude Haiku 4.5 lief diese Anfrage ohne Nachdenken. Um weiterhin ohne vorgelagertes Nachdenken zu arbeiten, siehe Vorgelagertes Nachdenken ausschalten.

ModellNachdenken ohne thinking-FeldAkzeptierte thinking.type-WerteStandard-display
Claude Sonnet 5.5An"adaptive", "between_tools""omitted"
Claude Sonnet 5An"adaptive", "disabled""omitted"
Claude Sonnet 4.6Aus"adaptive", "disabled", "enabled" (abgekündigt)"summarized"
Claude Sonnet 4.5 und Claude Haiku 4.5Aus"disabled", "enabled""summarized"

Nachdenken in Antworten verarbeiten

Code, der ohne Nachdenken lief, braucht alle drei Punkte. Code von Claude Sonnet 5 hat wahrscheinlich bereits die ersten beiden.

  • Lies Content-Blöcke nach type. Eine Antwort kann mit thinking-Blöcken beginnen, daher bricht Code, der content[0].text liest.
  • Gib thinking-Blöcke unverändert zurück in Schleifen mit Tool-Nutzung, einschließlich leerer Blöcke. Siehe Thinking-Blöcke beibehalten.
  • Überprüfe max_tokens. Es umfasst Nachdenken plus Text, und Thinking-Token werden als Ausgabe-Token abgerechnet. Siehe Kostenkontrolle.

Der Thinking-Text wird standardmäßig weggelassen. thinking-Blöcke kommen mit einem leeren thinking-Feld und einer signature an. Um lesbare Zusammenfassungen zu erhalten, setze display: "summarized", den Standard auf Claude Sonnet 4.6 und früheren Modellen sowie auf Claude Haiku 4.5. Siehe Anzeige des Nachdenkens steuern.

Vorgelagertes Nachdenken ausschalten

Um vorgelagertes Nachdenken auf Claude Sonnet 5.5 auszuschalten, sende thinking: {"type": "between_tools"}. Das ist die niedrigste Thinking-Einstellung. Ihre Fortschrittsupdates zwischen Tool-Aufrufen kommen weiterhin als thinking-Blöcke mit ihrem Zusammenfassungstext zurück. Ohne Tools enthält die Antwort nur Text. Claude Sonnet 5 schaltet das Nachdenken stattdessen mit thinking: {"type": "disabled"} aus, und frühere Modelle laufen standardmäßig ohne Nachdenken. Auf Claude Sonnet 5.5 gibt disabled einen 400-invalid_request_error zurück:

"thinking.type.disabled" is not supported for this model. Use "thinking.type.between_tools" for the lowest thinking setting, or "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

between_tools funktioniert auf jeder Plattform, die Claude Sonnet 5.5 anbietet, ohne Beta-Header. Es wird bei low, medium und high Effort akzeptiert. Bei xhigh oder max gibt es einen 400-Fehler zurück. Um auf diesen Stufen zu arbeiten, verwende adaptives Nachdenken: Lass das thinking-Feld weg oder sende thinking: {"type": "adaptive"}. between_tools akzeptiert kein weiteres Feld: display, budget_tokens oder block_binding zusammen damit gesendet gibt einen 400-Fehler zurück. Mit serverseitigem Fallback läuft eine between_tools-Anfrage, die auf Claude Sonnet 5 zurückfällt, dort mit thinking: {"type": "disabled"}.

Mit between_tools kann sich der Effort nicht mitten im Gespräch ändern: Ein nachrichtenspezifisches output_config.effort, das von der geltenden Stufe abweicht, gibt einen 400-Fehler zurück. Um den Effort pro Runde zu variieren, verwende adaptives Nachdenken. Hinweise zum Prompting findest du unter Ausführung ohne vorgelagertes Nachdenken.

In SDK-Versionen, die between_tools nicht definieren, schlagen die Python- und TypeScript-Beispiele bei der Typprüfung fehl. Aktualisiere das SDK oder übergib den Wert als rohes JSON, wie es die C#-, Go- und Java-Beispiele tun.

Vorher (Claude Sonnet 5):

client.messages.create(
    model="claude-sonnet-5",
    max_tokens=16000,
    thinking={"type": "disabled"},
    output_config={"effort": "xhigh"},
    messages=[{"role": "user", "content": "..."}],
)

Nachher (Claude Sonnet 5.5):

client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=16000,
    thinking={"type": "between_tools"},
    output_config={"effort": "high"},
    messages=[{"role": "user", "content": "..."}],
)

Migrations-Checkliste nach Ausgangsmodell

Arbeite die Gruppen von oben nach unten ab und höre nach der Gruppe auf, die dein Modell nennt. Wende auf Claude Haiku 4.5 jede Gruppe außer „Claude Sonnet 4 oder früher" an und ende mit „Nur Claude Haiku 4.5".

Jedes Ausgangsmodell

Claude Sonnet 4.6 oder früher

Claude Sonnet 4.5 oder früher

  • Ersetze Assistant-Prefills.
  • Parse Tool-Aufruf-Eingaben mit einem Standard-JSON-Parser.
  • Verlagere Computer Use auf Amazon Bedrock von computer_20250124 auf computer_20251124.
  • Setze output_config.effort explizit.
  • Entferne jeden Kontextfenster-Beta-Header.
  • Entferne interleaved-thinking-2025-05-14 und ersetze fine-grained-tool-streaming-2025-05-14 durch eager_input_streaming.
  • Verschiebe output_format nach output_config.format.

Claude Sonnet 4 oder früher

  • Aktualisiere die Tool-Versionen auf text_editor_20250728 und code_execution_20260521.
  • Behandle die Stop-Gründe refusal und model_context_window_exceeded.
  • Prüfe String-Parameter von Tools auf abschließende Zeilenumbrüche.
  • Entferne token-efficient-tools-2025-02-19 und output-128k-2025-02-19.
  • Überprüfe deine Prompts.

Nur Claude Haiku 4.5

  • Ersetze claude-haiku-4-5-20251001 oder seinen Alias.
  • Lege die Kostenbasis beim höheren Preis pro Token neu fest.
  • Überprüfe Prompts, die auf Claude Haiku 4.5 zu kurz zum Cachen waren.

Migration zu Claude Sonnet 5.5 von Claude Sonnet 5

Jedes Ausgangsmodell benötigt die Änderungen in diesem Abschnitt. Ersetze deine Modell-ID durch claude-sonnet-5-5, die kein Datumssuffix hat. Auf anderen Plattformen verwende die ID, die unter Verfügbarkeit aufgeführt ist.

Erzwungene Tool-Nutzung wird nicht unterstützt

Jedes frühere Modell auf dieser Seite akzeptiert eine tool_choice vom Typ any oder tool. Claude Sonnet 5.5 lehnt beide mit einem 400-Fehler ab, auch am Endpunkt für Token-Zählung:

tool_choice: type "tool" and "any" are not supported for this model.

Sende tool_choice: {"type": "auto"} und markiere das Tool mit strict: true, damit seine Eingabe dem Schema entspricht. Das Modell kann dann antworten, ohne das Tool aufzurufen, also gib im Prompt an, wann es verwendet werden soll. Strikte Tool-Nutzung unterstützt eine Teilmenge von JSON Schema und benötigt additionalProperties: false bei jedem Objekt. Siehe Einschränkungen von JSON Schema. Auf Amazon Bedrock sind strukturierte Ausgaben, zu denen die strikte Tool-Nutzung gehört, für Claude Sonnet 5.5 nicht verfügbar. Sende dort auto ohne strict, gib im Prompt an, wann das Tool aufgerufen werden soll, und validiere die Tool-Eingabe in deinem Code.

Vorher (Claude Sonnet 5):

client.messages.create(
    model="claude-sonnet-5",
    max_tokens=1024,
    tools=tools,
    tool_choice={"type": "tool", "name": "get_weather"},
    messages=[{"role": "user", "content": "What's the weather in Paris?"}],
)

Nachher (Claude Sonnet 5.5):

client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=1024,
    # strikte Tool-Nutzung: jeder Aufruf entspricht dem input_schema des Tools
    tools=[{**tool, "strict": True} for tool in tools],
    tool_choice={"type": "auto"},
    messages=[
        {
            "role": "user",
            "content": "What's the weather in Paris? Use the get_weather tool.",
        }
    ],
)

Das Beispiel markiert jedes Tool in der Liste als strikt. Eine Anfrage kann höchstens 20 strikte Tools enthalten, und die Toolset-Einträge für MCP, Computer Use und Browser Use akzeptieren kein strict. Markiere in einer längeren Tool-Liste nur die Tools, die es benötigen.

Thinking-Blöcke sind an das Modell und das Gespräch gebunden

Claude Sonnet 5.5 liest Thinking-Blöcke von Claude Sonnet 5, Claude Opus 4.8, Claude Haiku 4.5 und früheren Modellen. Es liest keine Blöcke von Claude Opus 5, Claude Opus 5.5 oder einem Claude Fable- oder Claude Mythos-Modell. Die API verwirft Blöcke, die das Modell nicht lesen kann. Die Anfrage gibt trotzdem 200 zurück, und verworfene Blöcke werden nicht abgerechnet. Siehe Modellwechsel mitten im Gespräch.

Jeder Thinking-Block von Claude Sonnet 5.5 ist außerdem über das vorangehende Gespräch signiert. Für Konten, die am oder nach dem 31. August 2026, 00:00 UTC, erstellt wurden, erzwingt die API dies standardmäßig auf der Claude API, Amazon Bedrock und Google Cloud. Bei diesen Konten gibt eine Anfrage, die einen Block nach einer Bearbeitung des früheren Verlaufs erneut sendet, einen 400-Fehler zurück. Halte Gespräche append-only und ändere Anweisungen oder Tools mit System-Nachrichten mitten im Gespräch. Thinking-Blöcke, die Claude Sonnet 5.5 erzeugt, funktionieren nur in dem Konto, das sie erzeugt hat, oder in einem damit verknüpften Konto. Siehe Beibehaltenes Nachdenken.

Computer Use benötigt das Toolset auf der Claude API und Google Cloud

Auf der Claude API und Google Cloud unterstützt Claude Sonnet 5.5 „computer use" (Computernutzung) nur über das Toolset computer_toolset_20260801. Dort gibt computer_20251124 einen 400-Fehler zurück. Claude Sonnet 5.5 akzeptiert computer_20250124 auf keiner Plattform. Finde die Version, die du heute sendest:

Version, die du heute sendestAusgangsmodelle, die sie sendenAuf der Claude API und Google Cloud sendenAuf Amazon Bedrock senden
computer_20251124Claude Sonnet 5, Claude Sonnet 4.6computer_toolset_20260801computer_20251124
computer_20250124Claude Sonnet 4.5, Claude Haiku 4.5, Claude Sonnet 4computer_toolset_20260801computer_20251124

Wenn du den Beta-Header fine-grained-tool-streaming-2025-05-14 sendest, entferne ihn beim Wechsel zum Toolset. Zusammen mit einem Toolset-Eintrag gibt er einen 400-Fehler zurück. Setze stattdessen eager_input_streaming: true für jedes Tool, das es benötigt.

Code, der das Toolset bereits sendet, benötigt keine Änderung. Migration von computer_20251124 listet die Änderungen an der Anfrage und der Agent-Schleife auf. Für andere Plattformen siehe Kompatibilität.

Das Advisor-Tool akzeptiert weniger Advisors

Mit dem Advisor-Tool benötigt ein Claude Sonnet 5.5-Executor einen dieser Advisors: Claude Opus 5, Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5, Claude Fable 5.1, Claude Mythos 5 oder Claude Mythos 5.1. Advisors vom Typ Claude Opus 4.8, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5 und Claude Sonnet 4.6 geben einen 400-Fehler zurück. Der Ratschlag kommt verschlüsselt als advisor_redacted_result-Block zurück, sodass sein Text in der Antwort nicht lesbar ist. Siehe Modellkompatibilität.

Text zwischen Tool-Aufrufen wird in Thinking-Blöcken zurückgegeben

Auf Claude Sonnet 5.5 kommen Notizen, die länger als ein oder zwei Sätze sind und die das Modell zwischen Tool-Aufrufen schreibt, als thinking-Blöcke mit Fortschrittsupdates zurück, die beim Standard-display leer sind. Kürzere Bemerkungen bleiben text. Auf Claude Sonnet 5 und früheren Modellen kommt sämtlicher Text zwischen Tool-Aufrufen als text-Blöcke zurück. Keine Anfrage schlägt fehl, aber eine Oberfläche, die diese Notizen anzeigt, wird still.

Setze bei adaptivem Nachdenken display auf "updates" (Beta, Header thinking-display-updates-2026-08-18), um nur die Updates zu erhalten, oder auf "summarized", um sie gemischt mit dem Reasoning zu erhalten. Rendere jeden nicht leeren thinking-Block vor dem darauffolgenden tool_use-Block. Mit between_tools kommt der Text ohne display zurück. Siehe Fortschrittsupdates für Nutzer.

Sicherheitsklassifikatoren und Fallback

Claude Sonnet 5.5 lehnt in mehr Kategorien ab als Claude Sonnet 5. Eine Ablehnung gibt stop_reason: "refusal" zurück, und ihre stop_details können eine dieser Kategorien nennen:

  • "cyber": Die Anfrage könnte Cyberschäden ermöglichen, etwa die Entwicklung von Malware oder Exploits.
  • "bio": Die Anfrage könnte biologische Schäden ermöglichen, etwa gefährliche Labormethoden.
  • "frontier_llm": Die Anfrage könnte die Entwicklung konkurrierender KI-Modelle unterstützen.
  • "reasoning_extraction": Die Anfrage fordert das Modell auf, sein internes Reasoning im Antworttext wiederzugeben.
  • "general_harms": Die Anfrage fällt unter einen anderen Bereich der Nutzungsrichtlinien. Auch harmlose Arbeit kann diese Kategorie auslösen.

Serverseitiger Fallback (fallbacks: "default", Beta, nur Claude API) wiederholt "cyber"- und "frontier_llm"-Ablehnungen auf Claude Sonnet 5. Ablehnungen vom Typ "bio", "reasoning_extraction" oder "general_harms" wiederholt er nicht. Siehe Ablehnungen und Fallback und Wie Ablehnungen abgerechnet werden.

Echtzeit-Cyber-Schutzmaßnahmen sind neu für Code von Claude Sonnet 4.6, Claude Sonnet 4.5 und Claude Haiku 4.5. Bewirb dich für legitime Sicherheitsarbeit beim Cyber Verification Program.

Weitere Änderungen

  • Prompt-Caching: Der minimale Prompt, der sich für „prompt caching" (Prompt-Caching) eignet, beträgt 512 Token, gegenüber 1.024 auf Claude Sonnet 5, Claude Sonnet 4.6 und Claude Sonnet 4.5. Siehe Prompt-Caching.
  • Neue Funktionen: Zu System-Nachrichten mitten im Gespräch, Tool-Änderungen mitten im Gespräch und Effort pro Nachricht siehe Neuerungen in Claude Sonnet 5.5. Mit between_tools kann sich der Effort nicht mitten im Gespräch ändern.

Führe deinen Effort-Sweep erneut durch. Claude Sonnet 5.5 hat fünf Effort-Stufen: low, medium, high, xhigh und max. Der Standard auf der Claude API ist high. Die Stufen sind neu kalibriert, sodass eine Stufe nicht dieselbe Menge an Nachdenken erzeugt wie auf Claude Sonnet 5. Beginne mit high, es sei denn, deine Workload ist agentisch oder latenzempfindlich. Für agentisches Coding und mehrstufige Tool-Nutzung beginne bei klar spezifizierten Aufgaben mit medium und wechsle bei schwierigeren oder längeren Aufgaben zu high. Für Chat und andere latenzempfindliche Arbeit beginne mit medium oder low. Lege die Stufe in output_config.effort fest. Siehe Empfohlene Effort-Stufen für Claude Sonnet 5.5. Bewerte anschließend modellspezifische Prompt-Anweisungen anhand von Prompting für Claude Sonnet 5.5 neu.

Migration zu Claude Sonnet 5.5 von Claude Sonnet 4.6 und früheren Sonnet-Modellen

Wende zuerst jeden vorangehenden Abschnitt an und ersetze dabei claude-sonnet-4-6. Nimm dann diese Änderungen vor. Fahre bei Claude Sonnet 4.5 oder früher mit den folgenden Unterabschnitten fort.

Breaking Changes

Nachdenken läuft bei Anfragen, die es weggelassen haben. Siehe Nachdenken läuft standardmäßig und Vorgelagertes Nachdenken ausschalten.

Thinking-Budgets geben einen Fehler zurück. Claude Sonnet 4.6 akzeptiert thinking: {"type": "enabled", "budget_tokens": N} als abgekündigte Einstellung. Claude Sonnet 4.5 und Claude Haiku 4.5 verwenden es für jedes Nachdenken. Claude Sonnet 5.5 gibt einen 400-Fehler zurück:

"thinking.type.enabled" is not supported for this model. Use "thinking.type.adaptive" and "output_config.effort" to control thinking behavior.

Entferne das Budget und lege eine Effort-Stufe fest. Es gibt keine feste Zuordnung von einem Budget zu einer Effort-Stufe, also führe deine Evaluierungen auf zwei oder drei Stufen durch.

Vorher (Claude Sonnet 4.6):

client.messages.create(
    model="claude-sonnet-4-6",
    max_tokens=16000,
    thinking={"type": "enabled", "budget_tokens": 10000},
    messages=[{"role": "user", "content": "..."}],
)

Nachher (Claude Sonnet 5.5):

client.messages.create(
    model="claude-sonnet-5-5",
    max_tokens=16000,
    thinking={"type": "adaptive"},
    output_config={"effort": "high"},  # or "max", "xhigh", "medium", "low"
    messages=[{"role": "user", "content": "..."}],
)

Sampling-Parameter geben einen Fehler zurück. Claude Sonnet 4.6 und frühere Modelle sowie Claude Haiku 4.5 akzeptieren temperature, top_p und top_k. Auf Claude Sonnet 5.5 gibt ein nicht standardmäßiger Wert einen 400-Fehler zurück. Entferne sie.

Thinking-Text wird standardmäßig weggelassen. Siehe Nachdenken in Antworten verarbeiten.

Weitere Änderungen

  • Etwa 30 % mehr Token: Claude Sonnet 5.5 verwendet den Tokenizer von Claude Sonnet 5. Im Vergleich zu Claude Sonnet 4.6, Claude Sonnet 4.5 und Claude Haiku 4.5 erzeugt derselbe Text je nach Inhalt etwa 30 % mehr Token. Zähle mit Token-Zählung neu und überprüfe max_tokens und die Kosten.
  • Effort: xhigh ist neu, und die Stufen sind neu kalibriert. Siehe Empfohlene Änderungen.
  • Bilder: Claude Sonnet 5.5 verwendet die hochauflösende Bildstufe mit bis zu 2576 Pixeln an der langen Kante und 4.784 visuellen Token pro Bild. Claude Sonnet 4.6, Claude Sonnet 4.5 und Claude Haiku 4.5 enden bei 1568 Pixeln und 1.568 Token. Ein Bild mit 2000×1500 kostet auf Claude Sonnet 5.5 etwa 2,5-mal so viele Token. Siehe Auflösung und Token-Kosten.

Migration von Claude Sonnet 4.5 oder früher

Wende bei Claude Sonnet 4.5, Claude Sonnet 4 oder Claude 3.7 Sonnet zuerst jeden vorangehenden Abschnitt an, dann diese Änderungen.

„Prefill" (Vorbefüllung) gibt einen Fehler zurück. Claude Sonnet 5.5 lehnt einen vorbefüllten letzten Assistant-Turn mit einem 400-Fehler ab, wie es Claude Sonnet 4.6 und Claude Sonnet 5 tun. Claude Sonnet 4.5, Claude Haiku 4.5 und ältere Modelle akzeptieren einen. Der Fehler lautet:

This model does not support assistant message prefill. The conversation must end with a user message.

Ersetze jedes Prefill je nach seinem Zweck:

  • Ausgabeformat: Verwende strukturierte Ausgaben oder Tools mit Enum-Feldern für die Klassifizierung.
  • Präambeln: Bitte im System-Prompt um eine direkte Antwort.
  • Unerwünschte Ablehnungen: Klare Anweisungen in der Nutzernachricht reichen in der Regel aus.
  • Fortsetzungen: Verschiebe sie in die Nutzernachricht, zum Beispiel „Deine vorherige Antwort wurde unterbrochen und endete mit [previous_response]. Fahre dort fort, wo du aufgehört hast."
  • Kontexterinnerungen: Platziere sie im Nutzer-Turn.

Escaping von Tool-Eingaben. Das Escaping in Tool-Aufruf-Argumenten kann abweichen. Parse input mit einem Standard-JSON-Parser.

Computer Use. Claude Sonnet 5.5 akzeptiert computer_20250124 nicht. Siehe die Computer-Use-Tabelle.

Effort. Claude Sonnet 4.5 hat keinen Effort-Parameter. Lege eine Effort-Stufe explizit fest, wie unter Empfohlene Änderungen beschrieben.

Kontext und Ausgabe. Claude Sonnet 5.5 hat ein größeres Kontextfenster, ohne Beta-Header, und ein höheres Ausgabelimit. Siehe die Modellseite. Entferne jeden Kontextfenster-Beta-Header.

Beta-Header. Entferne interleaved-thinking-2025-05-14, da adaptives Nachdenken automatisch verschachtelt. Ersetze fine-grained-tool-streaming-2025-05-14 durch eager_input_streaming: true für jedes Tool, das es benötigt. Dieser Header gibt zusammen mit einem Toolset-Eintrag für Computer Use oder Browser Use einen 400-Fehler zurück. Siehe Feingranulares Tool-Streaming.

Strukturierte Ausgaben. Der Parameter output_format ist abgekündigt und wird in Zukunft entfernt. Um ihn trotzdem zu verwenden, füge den Beta-Header structured-outputs-2025-11-13 hinzu. Ohne ihn gibt die API einen 400-Fehler zurück. Verwende stattdessen output_config.format.

Migration von Claude Sonnet 4 oder früher

Claude Sonnet 4 ist auf der Claude API eingestellt und auf Amazon Bedrock und Google Cloud weiterhin verfügbar. Claude 3.7 Sonnet ist eingestellt. Wende bei beiden Modellen zuerst jeden vorangehenden Abschnitt an, dann diese Änderungen:

  • Tool-Versionen: Verwende text_editor_20250728 mit dem Tool-Namen str_replace_based_edit_tool und ohne den Befehl undo_edit. Verwende code_execution_20260521. Siehe das Text-Editor-Tool und das Code-Execution-Tool.
  • Stop-Gründe: Behandle refusal. Claude 4.5 und spätere Modelle stoppen außerdem mit model_context_window_exceeded am Limit des Kontextfensters. Siehe Umgang mit Stop-Gründen.
  • Abschließende Zeilenumbrüche: Claude 4.5 und spätere Modelle behalten sie in String-Parametern von Tool-Aufrufen bei.
  • Veraltete Beta-Header: Entferne token-efficient-tools-2025-02-19 und output-128k-2025-02-19.
  • Prompts: Überprüfe sie anhand der Best Practices für Prompting.

Migration zu Claude Sonnet 5.5 von Claude Haiku 4.5

Wende zuerst jeden Abschnitt bis einschließlich Migration von Claude Sonnet 4.5 oder früher an und überspringe dabei den Unterabschnitt zu Claude Sonnet 4. Nimm dann diese Änderungen vor:

  • Modell-ID: Ersetze claude-haiku-4-5-20251001 oder den Alias claude-haiku-4-5 durch claude-sonnet-5-5.
  • Kosten: Der Preis pro Token ist höher, und derselbe Text erzeugt mehr Token. Zähle Token neu und lege die Kostenbasis neu fest. Siehe Claude-Preise.
  • Prompt-Caching: Der minimale cachebare Prompt sinkt von 4.096 Token auf das Minimum von Claude Sonnet 5.5.
  • Verschachteltes Nachdenken: Adaptives Nachdenken läuft automatisch zwischen Tool-Aufrufen, ohne Beta-Header.
  • Routing: Claude Sonnet 5.5 liest Thinking-Blöcke von Claude Haiku 4.5. Ein Gespräch, das nach oben wechselt, behält sein Reasoning. Eines, das zurück zu Claude Haiku 4.5 wechselt, verwirft die Blöcke von Claude Sonnet 5.5.

Was this page helpful?