Die Versionshinweise zur Claude Platform listen Änderungen an der Claude API, den Client-SDKs und der Claude Console auf, die neuesten zuerst.
20. August 2026
Wir haben v1.0 des Python SDK veröffentlicht. Die HTTP-Schicht des SDK wechselt von httpx zu httpx2, einem gepflegten, API-kompatiblen Fork: Erstelle benutzerdefinierte http_client-, Timeout- und Transport-Objekte aus httpx2 (die DefaultHttpxClient-Helfer bleiben unverändert) und rufe beim Start httpx2.alias_httpx() auf, wenn du auf Tracing- oder Mocking-Bibliotheken angewiesen bist, die httpx patchen. v1.0 erfordert Python 3.10 oder neuer und entfernt seit Langem abgekündigte Oberflächen, darunter die veraltete Text Completions API, die Parameter temperature, top_p und top_k bei Messages-Methoden sowie das clientseitige compaction_control des Tool-Runners. Beim asynchronen Client benötigen .with_raw_response-Ergebnisse jetzt await response.parse(), und AnthropicBedrock löst jetzt einen Fehler aus, wenn keine AWS-Region konfiguriert ist, anstatt standardmäßig us-east-1 zu verwenden. Im v1-Migrationsleitfaden findest du jede Änderung mit Vorher-Nachher-Snippets.
19. August 2026
Das Computer-Use-Tool hat die Beta-Phase auf der Claude API als Toolset computer_toolset_20260801 verlassen: kein Beta-Header, Batch-Aktionen (mehrere Aktionen in einem Zug), zoom standardmäßig aktiviert und Konfiguration pro Mitglied über configs. Frühere Beta-Versionen bleiben verfügbar. Das Upgrade einer bestehenden Integration ändert die Anfrageform und die Tool-Behandlung; siehe Migration von computer_20251124.
Wir haben das Browser-Use-Tool (browser_toolset_20260801) eingeführt, ein Client-Toolset zum Steuern eines Browsers, den deine Anwendung hostet. Es arbeitet innerhalb eines Browser-Viewports statt eines ganzen Desktops, liest die Seite selbst (ihren Accessibility-Baum, Elemente, Formulare und Tabs) und ergänzt die Screenshot-und-Klick-Steuerung um Elementreferenzen, Formulareingaben, Tab-Verwaltung, Download-Berichte und optionalen Datei-Upload.
Beide Toolsets sind für Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Sonnet 5 und Claude Opus 4.8 auf der Claude API verfügbar.
Die Files API hat die Beta-Phase auf der Claude API verlassen. Anfragen an die /v1/files-Endpunkte sowie Messages-API-Anfragen, die auf eine hochgeladene Datei verweisen, erfordern den Beta-Header files-api-2025-04-14 nicht mehr. Anfragen ohne den Header verwenden das aktuelle Antwortformat: Dateiablauf (setze expires_in_seconds beim Hochladen einer Datei; Dateiobjekte melden expires_at) sowie page- und next_page-Paginierung plus einen ids[]-Filter beim Auflisten von Dateien. /v1/files-Anfragen, die den Beta-Header weiterhin senden, funktionieren weiter und geben das vorherige Antwortformat zurück.
Agent Skills und die Skills API (/v1/skills) haben die Beta-Phase auf der Claude API verlassen. Anfragen erfordern den Beta-Header skills-2025-10-02 nicht mehr, einschließlich Messages-API-Anfragen, die Skills über den Parameter container laden. Anfragen, die den Header weiterhin senden, funktionieren unverändert weiter. Siehe Agent Skills mit der API verwenden.
Die Benutzerverwaltungs-Endpunkte der Admin API für Claude Enterprise-Organisationen (claude.ai) (Mitglieder, Einladungen, Gruppen und benutzerdefinierte Rollen) haben die Beta-Phase verlassen. Der Header anthropic-beta: ce-user-management-2026-07-13 ist bei Gruppen- und benutzerdefinierten Rollenanfragen nicht mehr erforderlich; Anfragen, die ihn weiterhin senden, werden unverändert akzeptiert. Siehe Benutzerverwaltung.
Du kannst jetzt einschränken, welche Websites die Tools web_search und web_fetch eines Claude-Managed-Agents-Agenten erreichen können. Setze allowed_domains oder blocked_domains im Eintrag des Tools im configs-Array von agent_toolset_20260401; web_fetch akzeptiert außerdem max_content_tokens und web_search akzeptiert user_location. Jeder configs-Eintrag wird durch seinen name identifiziert und durch einen optionalen type typisiert, und Anfragen, die nur name, enabled und permission_policy übergeben, funktionieren weiterhin; in den typisierten SDKs werden configs-Einträge zu Typen pro Tool. Siehe Domains für Websuche und Web-Fetch einschränken.
Claude-Managed-Agents-Sitzungen, die in einer selbst gehosteten Sandbox laufen, können jetzt Memory Stores anhängen. Die Worker der Python-, TypeScript- und Go-SDKs laden jeden angehängten Store in die Sandbox an seinen mount_path herunter und synchronisieren die Änderungen des Agenten zurück in den Store. Siehe Memory Stores verwenden.
Der Sitzungs-Viewer in der Claude Console wurde neu gestaltet, mit einer Timeline-Minimap, einem nach Modellanfrage gruppierten Transkript und einem Inspector-Panel für Sitzungsdetails und Kosten, Rohereignisse, Statistiken pro Tool, eingebundene Ressourcen und Aktivität pro Thread. Siehe Observability in der Console.
18. August 2026
Workbench heißt in der Claude Console jetzt Playground. Playground unterstützt jeden Parameter der Messages API und enthält Vorlagen, die API-Funktionen wie Codeausführung und Websuche demonstrieren. Es zeigt für jeden Lauf die vollständige SDK-Anfrage und die API-Antwort, damit du die API besser verstehst und damit entwickeln kannst. Mehr dazu findest du im Claude Help Center, oder probiere es unter platform.claude.com/playground aus.
11. August 2026
Die Compliance API gibt jetzt Transkripte von Cowork- und Claude-Code-Sitzungen zurück, die auf den Rechnern deiner Nutzer laufen, in der Beta für Claude-Enterprise-Organisationen. GET /v1/compliance/apps/sessions/local listet Sitzungen in deiner gesamten Organisation auf, GET /v1/compliance/apps/sessions/local/{session_id} ruft die Metadaten einer Sitzung ab und GET /v1/compliance/apps/sessions/local/{session_id}/messages gibt ihr Transkript zurück, alles mit deinem bestehenden Compliance Access Key und dem Scope read:compliance_user_data. Siehe Sitzungen auf den Rechnern der Nutzer.
Wir haben der Claude API den Antwort-Header anthropic-workspace-id hinzugefügt. Er enthält die mit wrkspc_ präfixierte ID des Workspace, zu dem der API-Key oder das Zugriffstoken der Anfrage aufgelöst wurde, einschließlich des Default Workspace deiner Organisation. Siehe Den Workspace hinter einer API-Antwort identifizieren.
10. August 2026
Der Einführungspreis für Claude Sonnet 5 (2 $ / 10 $ pro MTok) ist jetzt der Standardpreis: Die zuvor für den 1. September 2026 geplante Erhöhung auf 3 $ / 15 $ pro MTok findet nicht statt. Siehe Preise.
7. August 2026
Du kannst jetzt ein Budget für eine Claude-Managed-Agents-Sitzung festlegen: eine harte Obergrenze für die Ausgaben der Sitzung, berechnet zu öffentlichen Listenpreisen. Eine Sitzung, die ihr Budget erreicht, pausiert mit dem Stop-Reason budget_reached, anstatt neue Modellanfragen zu starten; das Ändern oder Entfernen des Budgets setzt sie fort. Deployments akzeptieren dasselbe Budget und wenden es auf jede Sitzung an, die sie starten. Siehe Sitzungsbudgets.
Du kannst einer Claude-Managed-Agents-Sitzung jetzt einen Advisor geben: ein Modell, das mindestens so leistungsfähig ist wie das eigene des Agenten und das der primäre Thread der Sitzung mitten im Zug für strategische Orientierung konsultieren kann. Konfiguriere ihn als {"type": "advisor"}-Eintrag im Multiagent-Roster des Agenten und gib das zu konsultierende model an. Siehe Der Sitzung einen Advisor geben.
Claude-Managed-Agents-Sitzungen können jetzt Skills aus einem GitHub-Repository laden. Wenn eine Sitzung ein Repository einbindet, werden alle Skills in dessen Stammverzeichnis .claude/skills beim Sitzungsstart automatisch erkannt und stehen dem Agenten für diese Sitzung zur Verfügung.
5. August 2026
Inference Hooks sind jetzt in der Beta für Claude-Enterprise-Organisationen verfügbar. Verweise Claude auf den KI-Sicherheitsserver deiner Organisation, und jeder regulierte Prompt in claude.ai, Cowork und Claude Code wird zurückgehalten, bis der Server ein Allow- oder Deny-Urteil abgibt, bevor die Inferenz fortgesetzt wird. Anfragen sind signiert, die Fehlerbehandlung ist konfigurierbar und jede Ablehnung wird im Compliance-Activity Feed aufgezeichnet. Siehe Inference Hooks.
Wir haben das Modell Claude Opus 4.1 (claude-opus-4-1-20250805) eingestellt. Alle Anfragen an dieses Modell auf der Claude API geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Opus 5. Forschende können über das External Researcher Access Program fortlaufenden Zugriff beantragen.
3. August 2026
Die Compliance API gibt jetzt Transkripte von Cowork-Sitzungen zurück, die über claude.ai im Web oder mobil gestartet wurden, in der Beta für Claude-Enterprise-Organisationen. GET /v1/compliance/apps/sessions/remote listet Sitzungen auf und GET /v1/compliance/apps/sessions/remote/{session_id}/messages gibt das Transkript einer Sitzung zurück, mit deinem bestehenden Compliance Access Key mit dem Scope read:compliance_user_data. Siehe Sitzungen in der Cloud.
Bei Claude Opus 5 ist das Deaktivieren des Denkens nur bei Effort high oder niedriger erlaubt: thinking: {"type": "disabled"} mit Effort xhigh oder max gibt einen 400-Fehler zurück, eine Breaking Change gegenüber Claude Opus 4.8. Siehe Neues in Claude Opus 5.
Effort ist die primäre Steuerung für Claude Opus 5: Das Modell unterstützt die vollständige Stufenleiter (low, medium, high, xhigh, max), mit max für leistungskritische Arbeit.
Tool-Änderungen mitten im Gespräch sind jetzt in der Beta für Claude Fable 5, Claude Mythos 5, Claude Opus 4.8 und Claude Opus 5 verfügbar: Füge zwischen den Zügen eines Gesprächs Tools hinzu oder entferne sie, während der Prompt-Cache erhalten bleibt. Füge deinen Anfragen den Beta-Header mid-conversation-tool-changes-2026-07-01 hinzu.
Der Parameter fallbacks unterstützt jetzt einen Modus "default", der die von Anthropic empfohlenen Fallback-Modelle nach Ablehnungskategorie anwendet. Serverseitiges Fallback ist in der Beta, und der Modus "default" erfordert den Beta-Header server-side-fallback-2026-07-01. Siehe Ablehnungen und Fallback.
Wir haben den Fast Mode für Claude Opus 4.7 entfernt. Anfragen an claude-opus-4-7 mit speed: "fast" geben jetzt einen Fehler zurück; anders als bei Claude Opus 4.6 fallen sie nicht auf Standardgeschwindigkeit zurück. Claude Opus 4.7 selbst bleibt mit Standardgeschwindigkeit verfügbar. Um den Fast Mode weiter zu nutzen, migriere zu Claude Opus 5 oder Claude Opus 4.8. Mehr dazu unter Fast Mode.
22. Juli 2026
Du kannst jetzt eine effort-Stufe in der Modellkonfiguration eines Claude-Managed-Agents-Agenten festlegen. Übergib effort innerhalb des model-Objekts, wenn du den Agenten erstellst. Unter Effort-Stufen erfährst du, was jede Stufe bewirkt.
Webhooks für Claude Managed Agents decken jetzt den Lebenszyklus von Environments und Memory Stores ab: vier environment.*-Ereignistypen und drei memory_store.*-Ereignistypen. Du kannst auf Lebenszyklusänderungen von Environments und Memory Stores reagieren, ohne zu pollen. Siehe die Tabs „Environment events" und „Memory store events" unter Webhooks abonnieren.
Beim Erstellen einer Claude-Managed-Agents-Sitzung kannst du sie jetzt mit initialen Ereignissen vorbelegen. Übergib initial_events bei POST /v1/sessions mit bis zu 50 user.message- und user.define_outcome-Ereignissen. Eine nicht leere Liste startet die Agentenschleife im selben Aufruf, sodass du keine separate Send-Events-Anfrage benötigst, um die Arbeit zu beginnen.
Die Thread-Ereignisstreams von Claude-Managed-Agents-Sitzungen unterstützen jetzt Event-Deltas. GET /v1/sessions/{session_id}/threads/{thread_id}/stream akzeptiert denselben Query-Parameter event_deltas[] wie der Stream auf Sitzungsebene, sodass du den Text eines Subagenten in der Vorschau sehen kannst, während das Modell ihn generiert. Eine Verbindung zeigt nur den Thread in der Vorschau, den sie liest. Siehe Vorschau von Sitzungs-Thread-Ereignissen.
17. Juli 2026
Die veraltete Workbench (platform.claude.com/workbench) in der Claude Console wird eingestellt; der Zugriff endet am 17. August 2026. Gespeicherte Prompts, Variablen und Evals werden in der aktualisierten Workbench nicht unterstützt. Du kannst alle Daten, die du behalten möchtest, über das Banner und unter deinen Organisationseinstellungen exportieren. Mehr dazu unter Wie verwende ich die Workbench? im Claude Help Center.
Die experimentellen Prompt-Tools-APIs zum Generieren, Verbessern und Templatisieren von Prompts (/v1/experimental/generate_prompt, /v1/experimental/improve_prompt und /v1/experimental/templatize_prompt) werden zusammen mit der Workbench am 17. August 2026 eingestellt. Nach der Entfernung geben Anfragen an diese Endpunkte einen Fehler zurück.
Du kannst jetzt die Personen in deiner Claude Enterprise-Organisation (claude.ai) mit der Admin API verwalten, in der Beta für alle Claude-Enterprise-Organisationen: Mitglieder auflisten und per E-Mail-Adresse nachschlagen, die Rolle eines Mitglieds ändern, Mitglieder entfernen, Einladungen senden und zurückziehen, Gruppen und deren Mitgliedschaft verwalten sowie benutzerdefinierte Rollen lesen. Gruppen- und benutzerdefinierte Rollenanfragen erfordern den Beta-Header anthropic-beta: ce-user-management-2026-07-13; Mitglieder- und Einladungsanfragen benötigen keinen Beta-Header. Ein Admin-API-Key mit dem Scope read:org_audit kann außerdem jeden GET-Endpunkt der Benutzerverwaltung aufrufen. Siehe Benutzerverwaltung.
10. Juli 2026
Dreams (Research Preview) unterstützt jetzt Claude Fable 5 und Claude Sonnet 5. Siehe Unterstützte Modelle.
Wir haben die Access Transparency-Dokumentation zu cmek_preserve-Ereignissen um ein Filterbeispiel, eine Beispiel-Ereignis-Payload und zwei Aufbewahrungs-Reason-Codes (policy_violation_investigation, csae_report) erweitert. Die Dokumentation stellt jetzt außerdem klar, dass ein Aufbewahrungsereignis geschrieben wird, unabhängig davon, ob die Aufbewahrung von einem menschlichen Prüfer oder einer automatisierten Sicherheitspipeline initiiert wurde. Siehe CMEK-Inhaltsaufbewahrung.
8. Juli 2026
Du kannst jetzt ein Ablaufdatum festlegen, wenn du einen API-Key oder einen Admin-API-Key in der Claude Console erstellst. Wähle eine Voreinstellung, eine benutzerdefinierte Dauer oder Nie. Bei Keys mit einer Lebensdauer von mindestens 7 Tagen benachrichtigt Anthropic den Ersteller vor Ablauf per E-Mail. Bestehende Keys sind nicht betroffen. Die Admin API meldet das Ablaufdatum jedes Keys im Feld expires_at. Siehe Authentifizierung.
2. Juli 2026
Wir haben den Beta-Header agent-memory-2026-07-22 hinzugefügt, der das Verhalten beim Auflisten von Memories (GET /v1/memory_stores/{memory_store_id}/memories) ändert: Ergebnisse werden in einer stabilen, serverdefinierten Reihenfolge zurückgegeben und die Parameter order_by und order werden ignoriert; depth akzeptiert nur 0, 1 oder das Weglassen (andere Werte geben einen 400-Fehler zurück); und path_prefix muss mit / enden und gleicht ganze Pfadsegmente statt eines Teilstrings ab. Ohne den Header ausgegebene Seiten-Cursor sind mit ihm nicht gültig, beginne also wieder bei der ersten Seite, wenn du ihn übernimmst. Bei Memory-Store-Endpunkten ersetzt agent-memory-2026-07-22 den Header managed-agents-2026-04-01; das Senden beider gibt einen 400-Fehler zurück. Am 22. Juli 2026 übernimmt der Header managed-agents-2026-04-01 dasselbe Listenverhalten. Siehe Beta-Header.
Die SDKs für Python (0.116.0), TypeScript (0.110.0), Go (1.56.0), Java (2.48.0), Ruby (1.55.0), PHP (0.36.0), C# (12.35.0) und die CLI (1.16.0) senden jetzt bei allen Memory-Store-Aufrufen agent-memory-2026-07-22 statt managed-agents-2026-04-01. Wenn dein Code bei Memory-Store-Aufrufen betas explizit übergibt, ersetze dort managed-agents-2026-04-01 durch agent-memory-2026-07-22, anstatt einen zweiten Wert hinzuzufügen.
1. Juli 2026
Wir haben den Zugriff auf Claude Fable 5 und Claude Mythos 5 wiederhergestellt. Weitere Informationen findest du in unserer Stellungnahme.
30. Juni 2026
Wir haben Claude Sonnet 5 (claude-sonnet-5) eingeführt, die nächste Generation unserer Sonnet-Modellfamilie, zum Einführungspreis von 2 $ / 10 $ pro MTok (am 10. August 2026 zum Standardpreis gemacht). Claude Sonnet 5 unterstützt ein Kontextfenster von 1 Mio. Token, 128k maximale Ausgabe-Token und denselben Satz an Tools und Plattformfunktionen wie Claude Sonnet 4.6, mit Ausnahme von Priority Tier, das für Claude Sonnet 5 nicht verfügbar ist. Bei der Migration gelten drei Verhaltensänderungen: Adaptives Denken ist jetzt standardmäßig aktiviert; manuelles „extended thinking" (erweitertes Denken) (thinking: {type: "enabled", budget_tokens: N}) wurde entfernt und gibt einen 400-Fehler zurück (es war bei Sonnet 4.6 abgekündigt); und das Setzen von Sampling-Parametern (temperature, top_p, top_k) auf Nicht-Standardwerte gibt einen 400-Fehler zurück. Claude Sonnet 5 verwendet außerdem einen neuen Tokenizer, der für denselben Text etwa 30 % mehr Token erzeugt. Die genaue Zunahme hängt vom Inhalt und der Form des Workloads ab. Unter Neues in Claude Sonnet 5 findest du Details und Migrationshinweise. Verhaltensunterschiede und modellspezifische Prompting-Muster findest du unter Prompting für Claude Sonnet 5.
Die Ereignisstreams von Claude-Managed-Agents-Sitzungen unterstützen jetzt Event-Deltas. Aktiviere sie mit dem Query-Parameter event_deltas[] bei GET /v1/sessions/{session_id}/events/stream. Die Ereignisse event_start und event_delta zeigen den Text einer Agentennachricht in der Vorschau, während er generiert wird, bevor das vollständige agent.message-Ereignis eintrifft.
Das Auflisten von Sitzungen für Claude Managed Agents unterstützt jetzt Rückwärts-Paginierung. GET /v1/sessions gibt neben next_page einen prev_page-Cursor zurück; übergib ihn als Parameter page, um zur vorherigen Seite zurückzukehren. Siehe Paginierung.
Beim Erstellen einer Claude-Managed-Agents-Sitzung kannst du jetzt die Konfiguration des Agenten für diese Sitzung überschreiben. Übergib agent mit type: "agent_with_overrides", um das Modell, den System-Prompt, die Tools, MCP-Server oder Skills für eine einzelne Sitzung zu ersetzen. Der Agent selbst bleibt unverändert.
Claude-Managed-Agents-Vaults unterstützen jetzt eine Einstellung injection_location bei Umgebungsvariablen-Credentials (der Tab „Environment variable"). Sie steuert, ob der Wert des Credentials beim Egress in die ausgehenden Anfrage-Header des Agenten, den Anfrage-Body oder beides eingesetzt wird.
Webhooks für Claude Managed Agents decken jetzt den Lebenszyklus von Agenten, Deployments und Deployment-Läufen ab. Du kannst auf eine neu veröffentlichte Agentenversion, ein pausiertes Deployment oder einen fehlgeschlagenen geplanten Lauf reagieren, ohne zu pollen. Siehe die Tabs „Agent events", „Deployment events" und „Deployment run events" unter Webhooks abonnieren.
29. Juni 2026
Wir haben den Fast Mode für Claude Opus 4.6 entfernt. Anfragen an claude-opus-4-6 mit speed: "fast" laufen nicht mehr mit hoher Geschwindigkeit oder zu Premium-Preisen: Sie laufen mit Standardgeschwindigkeit, werden zu Standardtarifen abgerechnet und geben keinen Fehler zurück. Das Feld usage.speed der Antwort meldet die verwendete Geschwindigkeit. Um den Fast Mode weiter zu nutzen, migriere zu Claude Opus 4.8. Mehr dazu unter Fast Mode.
26. Juni 2026
Wir haben die „rate limits" (Ratenlimits) auf der gesamten Claude API angehoben; siehe Ratenlimits. Die Ratenlimits für Claude Sonnet und Claude Haiku entsprechen jetzt in jeder Nutzungsstufe denen von Claude Opus, und die Nutzungsstufen wurden zu drei zusammengefasst: Start, Build und Scale. Die meisten Organisationen wechseln in eine höhere Stufe, keine Organisation erhält niedrigere Limits als zuvor, und es ist keine Aktion erforderlich. Du kannst deine Stufe und deine aktuellen Limits in der Claude Console einsehen.
25. Juni 2026
Wir haben den Fast Mode für Claude Opus 4.7 abgekündigt, mit Entfernung am 24. Juli 2026. Nach der Entfernung geben Anfragen an claude-opus-4-7 mit speed: "fast" einen Fehler zurück. Migriere zum Fast Mode für Claude Opus 4.8. Mehr dazu unter Fast Mode.
22. Juni 2026
MCP-Tunnels (Research Preview): Die Verwaltungs-API ist von /v1/organizations/tunnels auf der Admin API zu /v1/tunnels auf der Claude API umgezogen. Die neue Oberfläche verwendet den Header anthropic-beta: mcp-tunnels-2026-06-22 und den WIF-Scope workspace:manage_tunnels. Die vorherige Oberfläche bleibt während eines Migrationszeitraums verfügbar. Siehe die Tunnels-API-Referenz.
18. Juni 2026
Die SDKs für Python, TypeScript, Go, Java, Ruby, PHP und C# unterstützen jetzt code_execution_20260120, die Version des Code-Execution-Tools, die REPL-Zustandspersistenz hinzufügt und die Mindestversion für programmatisches Tool-Calling ist. Um sie zu übernehmen, setze den type des Tools auf code_execution_20260120; es ist kein Beta-Header erforderlich. Sie ist für Claude Fable 5, Claude Mythos 5, Claude Opus 4.5 und neuer sowie Claude Sonnet 4.5 und neuer verfügbar; siehe die Modellkompatibilitätstabelle.
15. Juni 2026
Wir haben das Modell Claude Sonnet 4 (claude-sonnet-4-20250514) und das Modell Claude Opus 4 (claude-opus-4-20250514) eingestellt. Alle Anfragen an diese Modelle auf der Claude API geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Sonnet 4.6 bzw. Claude Opus 4.8. Forschende können über das External Researcher Access Program fortlaufenden Zugriff beantragen.
11. Juni 2026
Das Code-Execution-Tool unterstützt jetzt code_execution_20260521, das das Ausführungszeitlimit von 90 Sekunden pro Zelle in der Tool-Beschreibung offenlegt, damit Claude lang laufende Zellen einplanen kann. Es ist kein Beta-Header erforderlich.
Das Web-Search-Tool und das Web-Fetch-Tool unterstützen jetzt web_search_20260318 und web_fetch_20260318 und fügen einen Parameter response_inclusion hinzu, um verbrauchte Ergebnisblöcke für agentische Workflows aus der API-Antwort zu entfernen. Es ist kein Beta-Header erforderlich.
Wir haben Claude Fable 5 (claude-fable-5) eingeführt, unser leistungsfähigstes breit veröffentlichtes Modell, zusammen mit Claude Mythos 5 (claude-mythos-5) für Teilnehmende an Project Glasswing. Beide Modelle unterstützen standardmäßig ein Kontextfenster von 1 Mio. Token, 128k maximale Ausgabe-Token und stets aktives adaptives Denken. Unter Einführung von Claude Fable 5 und Claude Mythos 5 findest du Fähigkeiten, API-Änderungen und Verfügbarkeit.
Claude Fable 5 und Claude Mythos 5 verwenden den mit Claude Opus 4.7 eingeführten Tokenizer. Im Vergleich zu Modellen vor Claude Opus 4.7 erzeugt derselbe Text etwa 30 % mehr Token. Die genaue Zunahme hängt vom Inhalt und der Form des Workloads ab. Verwende die Token-Counting-API mit model: "claude-fable-5", um deine Prompts mit dem neuen Tokenizer zu messen.
Claude Fable 5 führt Sicherheitsklassifikatoren bei Anfragen und während der Antwortgenerierung aus. Wenn ein Klassifikator eine Anfrage ablehnt, gibt die Messages API stop_reason: "refusal" zurück. Eine Anfrage, die abgelehnt wird, bevor eine Ausgabe generiert wurde, wird dir nicht berechnet. Ein optionaler Parameter fallbacks (in der Beta auf der Claude API und Claude Platform on AWS; auf der Message Batches API nicht unterstützt) führt abgelehnte Anfragen auf einem anderen Modell erneut aus, abgerechnet zu den Tarifen des Fallback-Modells. Siehe Umgang mit Stop-Reasons.
Das Feld stop_details.category bei Ablehnungsantworten enthält bei Claude Fable 5 jetzt "reasoning_extraction", das zurückgegeben wird, wenn eine Anfrage gemäß den Beschränkungen der Nutzungsbedingungen von Anthropic zum Reverse Engineering oder Duplizieren von Modellausgaben blockiert wird. Die bestehenden Kategorien "cyber" und "bio" bleiben unverändert. Es ist kein Beta-Header erforderlich.
Bei Claude Fable 5 und Claude Mythos 5 ist adaptives Denken der einzige Denkmodus: thinking: {"type": "disabled"} wird nicht unterstützt, und manuelle Budgets für erweitertes Denken sowie Assistant-Prefill werden nicht unterstützt (beide geben einen 400-Fehler zurück). Siehe Migration von Claude Mythos Preview zu Claude Mythos 5.
Bei Claude Fable 5 und Claude Mythos 5 ist thinking.display standardmäßig "omitted", genau wie bei Claude Opus 4.8, Claude Opus 4.7 und Claude Mythos Preview; setze display: "summarized", um lesbare Denkzusammenfassungen zu erhalten. Die rohe Gedankenkette wird nie zurückgegeben; gib Thinking-Blöcke in mehrzügigen Gesprächen mit demselben Modell unverändert zurück. Siehe Denkausgabe bei Claude Fable 5 und Claude Mythos 5.
Claude Managed Agents unterstützt jetzt geplante Deployments, mit denen du Sitzungen nach einem Cron-Zeitplan ausführen kannst, ohne einen eigenen Scheduler zu verwalten.
Claude-Managed-Agents-Vaults unterstützen jetzt Umgebungsvariablen-Credentials, sodass du Secrets sicher in die Sandbox des Agenten für CLIs, SDKs und andere Dienste einspeisen kannst, die sich über Umgebungsvariablen authentifizieren.
Die Webhook-Ereignisse session.thread_* enthalten jetzt ein Feld session_thread_id, das den Multiagent-Thread identifiziert, der das Ereignis ausgelöst hat.
Wir haben ein Swift-Paket in der Beta veröffentlicht, das Claude als serverseitiges LanguageModel in Apples Foundation-Models-Framework hinzufügt. Rufe Claude über dieselbe LanguageModelSession-API wie Apples On-Device-Modell auf iOS 27, macOS 27, visionOS 27 und watchOS 27 (Beta) auf.
5. Juni 2026
Wir haben die Abkündigung des Modells Claude Opus 4.1 (claude-opus-4-1-20250805) angekündigt; die Einstellung auf der Claude API ist für den 5. August 2026 geplant. Wir empfehlen die Migration zu Claude Opus 4.8. Mehr dazu unter Modellabkündigungen.
2. Juni 2026
Das Advisor-Tool unterstützt jetzt einen Parameter max_tokens, um die Ausgabe des Advisor-Modells pro Aufruf zu begrenzen, was Latenz und Ausgabe-Token-Kosten für Workloads reduziert, die keine Advisor-Antworten in voller Länge benötigen. Setze tools[].max_tokens in der Advisor-Tool-Definition; siehe Advisor-Ausgabe begrenzen.
Auf der Claude API wird dir eine Anfrage nicht mehr berechnet, wenn sie stop_reason: "refusal" zurückgibt, ohne dass Claude eine Ausgabe generiert hat. Unter Streaming-Ablehnungen erfährst du, wie du Ablehnungen erkennst und behandelst.
Wir haben Claude Opus 4.8 () veröffentlicht, unser leistungsfähigstes breit veröffentlichtes Modell. Claude Opus 4.8 unterstützt standardmäßig ein „context window" (Kontextfenster) von 1 Mio. Token auf der Claude API, Amazon Bedrock, Google Cloud und Microsoft Foundry, 128k maximale Ausgabe-Token sowie denselben Satz an Tools und Plattformfunktionen wie Claude Opus 4.7. Siehe den Migrationsleitfaden für Basiseinstellungen, Funktionen und Migrationshinweise.
Wir haben System-Nachrichten mitten im Gespräch eingeführt. Auf Claude Opus 4.8 kannst du role: "system"-Nachrichten nach einem Benutzer-Turn (vorbehaltlich der Platzierungsregeln) im messages-Array senden und dabei Prompt-Cache-Treffer beibehalten, wenn sich Anweisungen während einer lang laufenden Sitzung ändern. Es ist kein Beta-Header erforderlich.
Das Feld stop_details bei Ablehnungsantworten ist jetzt öffentlich dokumentiert; es gibt eine category (cyber, bio oder null) und eine menschenlesbare explanation zurück, sodass deine Anwendung verschiedene Klassen von Ablehnungen an den richtigen nächsten Schritt weiterleiten kann. Es ist kein Beta-Header erforderlich.
Auf Claude Opus 4.8 ist der Effort-Parameter standardmäßig auf allen Oberflächen auf high gesetzt, einschließlich Claude Code und der Messages API.
Auf Claude Opus 4.8 beträgt die minimale cachefähige Prompt-Länge für „prompt caching" (Prompt-Caching) 1.024 Token, weniger als auf Claude Opus 4.7.
Mit aktiviertem adaptivem Denken löst Claude Opus 4.8 Reasoning nur dann aus, wenn ein Turn es benötigt, und reduziert so verschwendete Denk-Token im Vergleich zu Claude Opus 4.7 auf derselben Effort-Stufe.
Claude Opus 4.8 unterstützt hochauflösende Bildeingaben (bis zu 2576 Pixel an der langen Kante), genau wie Claude Opus 4.7.
Der Fast Mode für Claude Opus 4.8 ist als Research Preview ausschließlich auf der Claude API verfügbar.
Das Setzen der Sampling-Parameter temperature, top_p oder top_k auf einen nicht standardmäßigen Wert gibt auf Claude Opus 4.8 einen 400-Fehler zurück, genau wie auf Claude Opus 4.7. Siehe den Migrationsleitfaden für Details.
In Claude Code haben wir den Auto-Modus für lang laufende Aufgaben auf mehr Nutzer ausgeweitet. Siehe die Claude Code-Dokumentation.
In Claude Code verwenden Nutzer des Max-Plans jetzt standardmäßig den Fast Mode auf Claude Opus 4.8. Siehe die Claude Code-Dokumentation.
In Claude Code sind Workflows als Research Preview verfügbar, mit denen du mehrstufige agentische Pläne definieren und ausführen kannst. Siehe die Claude Code-Dokumentation.
Wir haben den Fast Mode für Claude Opus 4.6 abgekündigt; die Entfernung erfolgt etwa 30 Tage nach dem Launch. Migriere zum Fast Mode für Claude Opus 4.8 oder Claude Opus 4.7. Lies mehr unter Fast Mode.
Für Updates zu claude.ai, Cowork, Claude for Microsoft 365 und anderen Claude-Apps in diesem Release siehe die Release Notes für Claude Apps.
27. Mai 2026
Die Antwort der Messages API enthält jetzt usage.output_tokens_details.thinking_tokens, das angibt, wie viele der abgerechneten Ausgabe-Token auf „extended thinking" (erweitertes Denken) entfielen. Beim Streaming erscheint die Aufschlüsselung nur im abschließenden message_delta-Event. Es ist kein Beta-Header erforderlich.
19. Mai 2026
MCP-Tunnels sind jetzt als Research Preview verfügbar, sodass du dich mit MCP-Servern in deinem privaten Netzwerk verbinden kannst.
Selbst gehostete Sandboxes sind jetzt für Claude Managed Agents verfügbar, als Alternative zur Tool-Ausführung in der Infrastruktur von Anthropic. Siehe Selbst gehostete Sandboxes.
Mit Claude Managed Agents kannst du jetzt die MCP-Server- und Tool-Konfigurationen des Agenten aktualisieren, die mit einer aktiven Sitzung verknüpft sind.
Mit Claude Managed Agents werden große Ausgaben von agent_toolset und MCP-Tools, die 100K Zeichen (etwa 25K Token) überschreiten, jetzt automatisch in eine Datei in der Sandbox ausgelagert. Das Modell erhält eine gekürzte Vorschau mit dem Dateipfad und kann den vollständigen Inhalt von dort lesen.
18. Mai 2026
Das Web-Search-Tool gibt jetzt umfangreichere SEC-Filing-Daten zurück, was es einfacher macht, Finanzrecherche-Agenten, Ergebnisanalysen und Due-Diligence-Workflows mit Zitaten auf Primärquellen zu stützen.
13. Mai 2026
Wir haben Cache-Diagnosen in der öffentlichen Beta eingeführt. Übergib diagnostics.previous_message_id in einer Messages-Anfrage, und die API meldet einen cache_miss_reason, der erklärt, wo das Prompt-Cache-Präfix vom vorherigen Turn abgewichen ist. Füge den Beta-Header cache-diagnosis-2026-04-07 in deine Anfragen ein.
12. Mai 2026
Der Fast Mode (Research Preview) unterstützt jetzt Claude Opus 4.7. Setze speed: "fast" mit model: "claude-opus-4-7" und dem Beta-Header fast-mode-2026-02-01 für eine deutlich schnellere Generierung von Ausgabe-Token zu Premium-Preisen. Preise, „rate limits" (Ratenlimits) und Zugang sind dieselben wie beim Fast Mode für Opus 4.6; interessierte Kunden sollten sich auf die Warteliste setzen lassen.
11. Mai 2026
Wir haben Claude Platform on AWS eingeführt und bringen damit die Claude API auf von Anthropic verwaltete Infrastruktur, die über AWS zugänglich ist, mit AWS-Abrechnung und IAM-Authentifizierung. Greife über native AWS-Endpunkte auf die vollständige Messages API, Files API, Message Batches API, Claude Managed Agents, Agent Skills, Code-Ausführung und „tool use" (Tool-Nutzung) zu. Erfahre mehr unter Claude Platform on AWS.
6. Mai 2026
Multiagenten-Orchestrierung und Outcomes sind jetzt in der öffentlichen Beta unter dem Standard-Beta-Header managed-agents-2026-04-01 verfügbar.
Die Hintergrundaktualisierung von Vault-Anmeldedaten für Claude Managed Agents wird jetzt für mcp_oauth-Anmeldedaten unterstützt. Siehe Mit Vaults authentifizieren.
Webhooks für Claude Managed Agents werden jetzt unterstützt. Zu den Webhook-Event-Typen gehören Lebenszyklus-Events für Sitzungen und Vaults. Siehe Webhooks abonnieren.
Zusätzliche Filter- und Sortieroptionen werden jetzt für Claude Managed Agents unterstützt. Sitzungen können nach Status gefiltert werden, und Events können nach Typ gefiltert werden. Events können jetzt nach Erstellungszeit gefiltert werden.
Dreams für Claude Managed Agents sind jetzt als Research Preview verfügbar. Ein Dream liest einen bestehenden Memory Store zusammen mit Transkripten vergangener Sitzungen und erzeugt einen neu organisierten Ausgabe-Memory-Store, in dem Duplikate zusammengeführt, veraltete Einträge ersetzt und neue Erkenntnisse hervorgehoben werden. Dream-Endpunkte sind durch den Beta-Header dreaming-2026-04-21 geschützt. Fordere Zugang an, um es auszuprobieren.
4. Mai 2026
Wir haben Workload Identity Federation eingeführt. Authentifiziere Workloads gegenüber der Claude API mit kurzlebigen OIDC-Token von deinem eigenen Identitätsanbieter (AWS IAM, Google Cloud, GitHub Actions, Kubernetes, Microsoft Entra ID, Okta, SPIFFE und mehr) anstelle von langlebigen statischen „API keys" (API-Keys). Konfiguriere Issuer und Föderationsregeln in der Claude Console, und das SDK übernimmt Token-Austausch und -Aktualisierung automatisch. Siehe Authentifizierung.
30. April 2026
Wir haben die Beta für das Kontextfenster von 1 Mio. Token (context-1m-2025-08-07) für Claude Sonnet 4.5 und Claude Sonnet 4 eingestellt. Der Beta-Header hat jetzt keine Wirkung mehr auf diese Modelle, und Anfragen, die das Standard-Kontextfenster von 200k Token überschreiten, geben einen Fehler zurück. Um das 1M-Kontextfenster zu nutzen, migriere zu Claude Sonnet 4.6 oder Claude Opus 4.6, wo es zu Standardpreisen ohne erforderlichen Beta-Header enthalten ist.
29. April 2026
Wir haben den Claude API Skill veröffentlicht, einen Open-Source-Agent Skill, der Claude aktuelles Referenzmaterial für die Entwicklung mit der Messages API und Claude Managed Agents in 8 Sprachen bereitstellt. Der Skill ist in Claude Code enthalten und im Anthropic Skills Repository verfügbar.
24. April 2026
Wir haben die Rate Limits API veröffentlicht, mit der Administratoren die für ihre Organisation und Workspaces konfigurierten Ratenlimits programmatisch abfragen können.
23. April 2026
Memory für Claude Managed Agents ist jetzt in der öffentlichen Beta unter dem Standard-Header managed-agents-2026-04-01 verfügbar. Siehe Agent Memory verwenden für den vollständigen Integrationsleitfaden.
20. April 2026
Wir haben das Modell Claude Haiku 3 (claude-3-haiku-20240307) eingestellt. Alle Anfragen an dieses Modell geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Haiku 4.5.
16. April 2026
Wir haben Claude Opus 4.7 veröffentlicht, unser leistungsfähigstes breit veröffentlichtes Modell für komplexes Reasoning und agentisches Coding, zum selben Preis von 5 $ / 25 $ pro MTok wie Opus 4.6. Siehe Was ist neu in Claude Opus 4.7 für Verbesserungen der Fähigkeiten, neue Funktionen und den aktualisierten Tokenizer. Opus 4.7 enthält API-Breaking-Changes gegenüber Opus 4.6; siehe den Migrationsleitfaden vor dem Upgrade.
Claude in Amazon Bedrock ist jetzt für alle Amazon Bedrock-Kunden geöffnet. Claude Opus 4.7 und Claude Haiku 4.5 sind per Self-Service über die Bedrock-Konsole über den Messages API-Endpunkt unter /anthropic/v1/messages verfügbar, in 27 AWS-Regionen mit globalen und regionalen Endpunkten.
Wir haben Task-Budgets in der Beta auf Claude Opus 4.7 eingeführt. Gib Claude ein beratendes Token-Budget für eine vollständige agentische Schleife (Denken, Tool-Aufrufe, Tool-Ergebnisse und Ausgabe), und das Modell sieht einen laufenden Countdown, den es nutzt, um Arbeit zu priorisieren und sauber abzuschließen, während das Budget verbraucht wird. Füge den Beta-Header task-budgets-2026-03-13 in deine Anfragen ein.
Claude Opus 4.7 unterstützt hochauflösende Bildeingaben und erhöht die maximale Bildauflösung von 1568 auf 2576 Pixel an der langen Kante für verbesserte Leistung bei Computer Use, Screenshot-Verständnis und Dokumentenanalyse. Die Unterstützung hoher Auflösungen erfolgt automatisch und erfordert keinen Beta-Header; Bilder können bis zu etwa 3x mehr Bild-Token verbrauchen als bei früheren Modellen.
Wir haben die Effort-Stufe xhigh auf Claude Opus 4.7 hinzugefügt. xhigh liegt zwischen high und max und ist auf lang laufende agentische und Coding-Aufgaben (über 30 Minuten) mit Token-Budgets im Millionenbereich abgestimmt. Es ist kein Beta-Header erforderlich.
14. April 2026
Wir haben die Abkündigung des Modells Claude Sonnet 4 (claude-sonnet-4-20250514) und des Modells Claude Opus 4 (claude-opus-4-20250514) angekündigt; die Einstellung auf der Claude API ist für den 15. Juni 2026 geplant. Wir empfehlen die Migration zu Claude Sonnet 4.6 bzw. Claude Opus 4.8. Lies mehr unter Modell-Abkündigungen.
9. April 2026
Wir haben das Advisor-Tool in der öffentlichen Beta eingeführt. Kombiniere ein schnelleres Executor-Modell mit einem intelligenteren Advisor-Modell, das mitten in der Generierung strategische Anleitung gibt, sodass agentische Workloads mit langem Horizont nahe an die Qualität des Advisors allein herankommen, während der Großteil der Token-Generierung zu den Preisen des Executor-Modells erfolgt. Füge den Beta-Header advisor-tool-2026-03-01 in deine Anfragen ein.
8. April 2026
Wir haben Claude Managed Agents in der öffentlichen Beta eingeführt, ein vollständig verwaltetes Agent-Harness zum Ausführen von Claude als autonomem Agenten mit sicherem Sandboxing, integrierten Tools und Server-Sent-Event-Streaming. Erstelle Agenten, konfiguriere Container und führe Sitzungen über die API aus. Alle Endpunkte erfordern den Beta-Header managed-agents-2026-04-01. Erfahre mehr in der Übersicht zu Claude Managed Agents.
Wir haben die ant CLI eingeführt, einen Kommandozeilen-Client für die Claude API, der eine schnellere Interaktion mit der Claude API, native Integration mit Claude Code und die Versionierung von API-Ressourcen in YAML-Dateien ermöglicht. Erfahre mehr im CLI-Schnellstart.
7. April 2026
Wir haben angekündigt, dass Claude Mythos Preview als zugangsbeschränkte Research Preview für defensive Cybersicherheitsarbeit im Rahmen von Project Glasswing verfügbar ist. Der Zugang erfolgt nur auf Einladung.
Die Messages API ist jetzt auf Amazon Bedrock als Research Preview verfügbar. Der neue Claude in Amazon Bedrock-Endpunkt unter /anthropic/v1/messages verwendet dieselbe Anfrageform wie die First-Party-Claude API und läuft auf von AWS verwalteter Infrastruktur ohne Operator-Zugriff. Verfügbar in us-east-1; kontaktiere deinen Anthropic Account Executive, um Zugang anzufordern. Erfahre mehr unter Claude in Amazon Bedrock.
30. März 2026
Wir haben die max_tokens-Obergrenze auf der Message Batches API für Claude Opus 4.6 und Sonnet 4.6 auf 300k angehoben. Füge den Beta-Header output-300k-2026-03-24 ein, um längere Single-Turn-Ausgaben für Langform-Inhalte, strukturierte Daten und große Code-Generierungsaufgaben zu erzeugen.
Wir stellen die Beta für das Kontextfenster von 1 Mio. Token für Claude Sonnet 4.5 und Claude Sonnet 4 am 30. April 2026 ein. Nach diesem Datum hat der Beta-Header context-1m-2025-08-07 keine Wirkung mehr auf diese Modelle, und Anfragen, die das Standard-Kontextfenster von 200k Token überschreiten, geben einen Fehler zurück. Um weiterhin 1M-Kontextfenster zu nutzen, migriere zu Claude Sonnet 4.6 oder Claude Opus 4.6, die das vollständige Kontextfenster von 1 Mio. Token zu Standardpreisen ohne erforderlichen Beta-Header unterstützen.
18. März 2026
Wir haben der Models API Felder für Modellfähigkeiten hinzugefügt. GET /v1/models und GET /v1/models/{model_id} geben jetzt max_input_tokens, max_tokens und ein capabilities-Objekt zurück. Frage die API ab, um herauszufinden, was jedes Modell unterstützt.
16. März 2026
Wir haben das Feld display für erweitertes Denken eingeführt, mit dem du Denkinhalte aus Antworten weglassen kannst, um schnelleres Streaming zu erreichen. Setze thinking.display: "omitted", um Thinking-Blöcke mit einem leeren thinking-Feld und beibehaltener signature für Multi-Turn-Kontinuität zu erhalten. Die Abrechnung bleibt unverändert. Erfahre mehr unter Steuerung der Thinking-Anzeige.
13. März 2026
Das Kontextfenster von 1 Mio. Token hat die Beta für Claude Opus 4.6 und Sonnet 4.6 verlassen, zu Standardpreisen. Anfragen über 200k Token funktionieren für diese Modelle automatisch ohne erforderlichen Beta-Header. Das Kontextfenster von 1 Mio. Token bleibt für Claude Sonnet 4.5 und Sonnet 4 in der Beta.
Wir haben die dedizierten 1M-Ratenlimits für alle unterstützten Modelle entfernt. Deine Standard-Kontolimits gelten jetzt für jede Kontextlänge.
Wir haben das Medienlimit bei Verwendung des Kontextfensters von 1 Mio. Token von 100 auf 600 Bilder oder PDF-Seiten pro Anfrage angehoben.
19. Februar 2026
Wir haben automatisches Caching für die Messages API eingeführt. Füge ein einzelnes cache_control-Feld zu deinem Request-Body hinzu, und das System cacht automatisch den letzten cachefähigen Block und verschiebt den Cache-Punkt nach vorne, während Gespräche wachsen. Keine manuelle Breakpoint-Verwaltung erforderlich. Funktioniert zusammen mit der bestehenden Cache-Steuerung auf Blockebene für feingranulare Optimierung. Verfügbar auf der Claude API und Microsoft Foundry (Preview). Erfahre mehr unter Prompt-Caching.
Wir haben das Modell Claude Sonnet 3.7 (claude-3-7-sonnet-20250219) und das Modell Claude Haiku 3.5 (claude-3-5-haiku-20241022) eingestellt. Alle Anfragen an Claude Sonnet 3.7 geben jetzt einen Fehler zurück. Anfragen an Claude Haiku 3.5 auf der Claude API geben jetzt einen Fehler zurück; es bleibt auf Amazon Bedrock und Google Cloud verfügbar. Wir empfehlen ein Upgrade auf Claude Sonnet 4.6 bzw. Claude Haiku 4.5. Forschende können fortlaufenden Zugang über das External Researcher Access Program beantragen.
Wir haben die Abkündigung des Modells Claude Haiku 3 (claude-3-haiku-20240307) angekündigt; die Einstellung ist für den 20. April 2026 geplant. Wir empfehlen die Migration zu Claude Haiku 4.5. Lies mehr unter Modell-Abkündigungen.
17. Februar 2026
Wir haben Claude Sonnet 4.6 veröffentlicht, unser neuestes ausgewogenes Modell, das Geschwindigkeit und Intelligenz für alltägliche Aufgaben kombiniert. Sonnet 4.6 liefert verbesserte Leistung bei agentischer Suche und verbraucht dabei weniger Token. Sonnet 4.6 unterstützt erweitertes Denken und ein Kontextfenster von 1 Mio. Token (Beta). Siehe Modelle & Preise für Details.
Die API-Code-Ausführung ist jetzt kostenlos, wenn sie mit Web Search oder Web Fetch verwendet wird. Code-Ausführung in einer Sandbox verbessert die Modellfähigkeiten und die Token-Effizienz. Siehe die Preisdetails für die eigenständige Nutzung.
Das Web-Search-Tool und programmatisches Tool-Calling sind ohne erforderlichen Beta-Header verfügbar. Web Search und Web Fetch unterstützen jetzt dynamisches Filtern, das Code-Ausführung nutzt, um Ergebnisse zu filtern, bevor sie das Kontextfenster erreichen, für bessere Leistung und geringere Token-Kosten.
Wir haben den Fast Mode als Research Preview für Opus 4.6 eingeführt, der über den Parameter speed eine deutlich schnellere Generierung von Ausgabe-Token bietet. Der Fast Mode ist bis zu 2,5x so schnell zu Premium-Preisen. Interessierte Kunden sollten sich auf die Warteliste setzen lassen.
5. Februar 2026
Wir haben Claude Opus 4.6 veröffentlicht, unser intelligentestes Modell für komplexe agentische Aufgaben und Arbeit mit langem Horizont. Opus 4.6 empfiehlt adaptives Denken (thinking: {type: "adaptive"}); manuelles Denken (type: "enabled" mit budget_tokens) ist abgekündigt. Opus 4.6 unterstützt kein Prefilling von Assistant-Nachrichten. Erfahre mehr unter Was ist neu in Claude 4.6.
Der Effort-Parameter erfordert keinen Beta-Header mehr und unterstützt jetzt Claude Opus 4.6. Effort ersetzt budget_tokens zur Steuerung der Denktiefe bei neuen Modellen.
Wir haben die Compaction API in der Beta eingeführt, die serverseitige Kontextzusammenfassung für praktisch unendliche Gespräche bietet. Verfügbar auf Opus 4.6.
Wir haben Kontrollen zur Datenresidenz eingeführt, mit denen du über den Parameter inference_geo festlegen kannst, wo die Modellinferenz ausgeführt wird. Inferenz ausschließlich in den USA ist zum 1,1-fachen Preis für Modelle verfügbar, die nach dem 1. Februar 2026 veröffentlicht wurden.
Das Kontextfenster von 1 Mio. Token ist jetzt in der Beta für Claude Opus 4.6 verfügbar, zusätzlich zu Sonnet 4.5 und Sonnet 4. Long-Context-Preise gelten für Anfragen, die 200k Eingabe-Token überschreiten.
Strukturierte Ausgaben haben die Beta auf der Claude API für Claude Sonnet 4.5, Claude Opus 4.5 und Claude Haiku 4.5 verlassen. Dieses Release umfasst erweiterte Schema-Unterstützung, verbesserte Latenz bei der Grammatik-Kompilierung und einen vereinfachten Integrationspfad ohne erforderlichen Beta-Header. Der Parameter output_format wurde nach output_config.format verschoben. Bestehende Beta-Nutzer können den Beta-Header während der Übergangsphase weiterhin verwenden. Strukturierte Ausgaben bleiben auf Amazon Bedrock und Microsoft Foundry in der öffentlichen Beta.
12. Januar 2026
console.anthropic.com leitet jetzt auf platform.claude.com weiter. Die Claude Console ist im Rahmen unserer Konsolidierung der Claude-Marke in ihr neues Zuhause umgezogen. Bestehende Lesezeichen und Links funktionieren über eine automatische Weiterleitung weiterhin. Weitere Details findest du in der Ankündigung vom 16. September 2025.
5. Januar 2026
Wir haben das Modell Claude Opus 3 (claude-3-opus-20240229) eingestellt. Alle Anfragen an dieses Modell geben jetzt einen Fehler zurück. Wir empfehlen ein Upgrade auf Claude Opus 4.5, das deutlich verbesserte Intelligenz zu einem Drittel der Kosten bietet. Forschende können fortlaufenden Zugang zu Claude Opus 3 auf der API über das External Researcher Access Program beantragen.
19. Dezember 2025
Wir haben die Abkündigung des Modells Claude Haiku 3.5 angekündigt. Lies mehr unter Modell-Abkündigungen.
Wir haben Claude Opus 4.5 veröffentlicht, unser intelligentestes Modell, das maximale Leistungsfähigkeit mit praktischer Performance kombiniert. Ideal für komplexe spezialisierte Aufgaben, professionelles Software-Engineering und fortgeschrittene Agenten. Bietet sprunghafte Verbesserungen bei Vision, Coding und Computer Use zu einem zugänglicheren Preis als frühere Opus-Modelle. Erfahre mehr in der Modellübersicht.
Wir haben programmatisches Tool-Calling in der öffentlichen Beta eingeführt, mit dem Claude Tools aus der Code-Ausführung heraus aufrufen kann, um Latenz und Token-Verbrauch in Multi-Tool-Workflows zu reduzieren.
Wir haben das Tool-Search-Tool in der öffentlichen Beta eingeführt, mit dem Claude Tools aus großen Tool-Katalogen dynamisch entdecken und bei Bedarf laden kann.
Wir haben den Effort-Parameter in der öffentlichen Beta für Claude Opus 4.5 eingeführt, mit dem du den Token-Verbrauch steuern kannst, indem du zwischen Gründlichkeit der Antwort und Effizienz abwägst.
Wir haben clientseitige Compaction zu unseren Python- und TypeScript-SDKs hinzugefügt, die den Gesprächskontext bei Verwendung von tool_runner automatisch durch Zusammenfassung verwaltet.
21. November 2025
Inhaltsblöcke für Suchergebnisse sind jetzt auf Amazon Bedrock ohne erforderlichen Beta-Header verfügbar. Erfahre mehr unter Suchergebnisse.
19. November 2025
Wir haben eine neue Dokumentationsplattform unter platform.claude.com/docs eingeführt. Unsere Dokumentation befindet sich jetzt Seite an Seite mit der Claude Console und bietet eine einheitliche Entwicklererfahrung. Die bisherige Docs-Seite unter docs.claude.com leitet auf den neuen Ort weiter.
18. November 2025
Wir haben Claude in Microsoft Foundry eingeführt und bringen damit Claude-Modelle zu Azure-Kunden mit Azure-Abrechnung und OAuth-Authentifizierung. Greife auf die vollständige Messages API zu, einschließlich erweitertem Denken, Prompt-Caching (5 Minuten und 1 Stunde), PDF-Unterstützung, Files API, Agent Skills und Tool-Nutzung. Erfahre mehr unter Claude in Microsoft Foundry.
14. November 2025
Wir haben strukturierte Ausgaben in der öffentlichen Beta eingeführt, die garantierte Schema-Konformität für Claudes Antworten bieten. Verwende JSON-Ausgaben für strukturierte Datenantworten oder strikte Tool-Nutzung für validierte Tool-Eingaben. Verfügbar für Claude Sonnet 4.5 und Claude Opus 4.1. Zum Aktivieren verwende den Beta-Header structured-outputs-2025-11-13.
28. Oktober 2025
Wir haben die Abkündigung des Modells Claude Sonnet 3.7 angekündigt. Lies mehr unter Modell-Abkündigungen.
Wir haben die Claude Sonnet 3.5-Modelle eingestellt. Alle Anfragen an diese Modelle geben jetzt einen Fehler zurück.
Wir haben Context Editing um das Löschen von Thinking-Blöcken (clear_thinking_20251015) erweitert, was die automatische Verwaltung von Thinking-Blöcken ermöglicht. Erfahre mehr unter Context Editing.
16. Oktober 2025
Wir haben Agent Skills (Beta skills-2025-10-02) eingeführt, eine neue Möglichkeit, Claudes Fähigkeiten zu erweitern. Skills sind organisierte Ordner mit Anweisungen, Skripten und Ressourcen, die Claude dynamisch lädt, um spezialisierte Aufgaben auszuführen. Das erste Release umfasst:
Von Anthropic verwaltete Skills: Vorgefertigte Skills für die Arbeit mit PowerPoint- (.pptx), Excel- (.xlsx), Word- (.docx) und PDF-Dateien
Benutzerdefinierte Skills: Lade deine eigenen Skills über die Skills API (/v1/skills-Endpunkte) hoch, um Domänenexpertise und organisatorische Workflows zu bündeln
Wir haben Claude Haiku 4.5 veröffentlicht, unser schnellstes und intelligentestes Haiku-Modell mit nahezu Frontier-Leistung. Ideal für Echtzeitanwendungen, Verarbeitung mit hohem Volumen und kostensensible Deployments, die starkes Reasoning erfordern. Erfahre mehr in der Modellübersicht.
29. September 2025
Wir haben Claude Sonnet 4.5 veröffentlicht, unser bestes Modell für komplexe Agenten und Coding, mit der höchsten Intelligenz bei den meisten Aufgaben. Erfahre mehr in der Modellübersicht.
Wir haben Preise für globale Endpunkte für Amazon Bedrock und Vertex AI eingeführt. Die Preise der Claude API (1P) sind davon nicht betroffen.
Wir haben einen neuen Stop-Reason model_context_window_exceeded eingeführt, mit dem du die maximal möglichen Token anfordern kannst, ohne die Eingabegröße zu berechnen. Erfahre mehr unter Umgang mit Stop-Reasons.
Wir haben das Memory-Tool in der Beta eingeführt, mit dem Claude Informationen über Gespräche hinweg speichern und abrufen kann. Erfahre mehr unter Memory-Tool.
Wir haben Context Editing in der Beta eingeführt, das Strategien zur automatischen Verwaltung des Gesprächskontexts bietet. Das erste Release unterstützt das Löschen älterer Tool-Ergebnisse und -Aufrufe bei Annäherung an Token-Limits. Erfahre mehr unter Context Editing.
17. September 2025
Wir haben Tool-Helper in der Beta für die Python- und TypeScript-SDKs eingeführt, die die Erstellung und Ausführung von Tools mit typsicherer Eingabevalidierung und einem Tool-Runner für die automatisierte Tool-Verarbeitung in Gesprächen vereinfachen. Details findest du in der Dokumentation für das Python SDK und das TypeScript SDK.
16. September 2025
Wir haben unsere Entwicklerangebote unter der Marke Claude vereinheitlicht. Du solltest aktualisierte Bezeichnungen und URLs auf unserer Plattform und in unserer Dokumentation sehen, aber unsere Entwicklerschnittstellen bleiben dieselben. Hier sind einige bemerkenswerte Änderungen:
API-Endpunkte, Header, Umgebungsvariablen und SDKs bleiben dieselben. Deine bestehenden Integrationen funktionieren ohne Änderungen weiter.
10. September 2025
Wir haben das Web-Fetch-Tool in der Beta eingeführt, mit dem Claude vollständige Inhalte von angegebenen Webseiten und PDF-Dokumenten abrufen kann. Erfahre mehr unter Web-Fetch-Tool.
Wir haben die Claude Code Analytics API eingeführt, mit der Organisationen programmatisch auf täglich aggregierte Nutzungsmetriken für Claude Code zugreifen können, einschließlich Produktivitätsmetriken, Statistiken zur Tool-Nutzung und Kostendaten.
8. September 2025
Wir haben eine Beta-Version des C# SDK veröffentlicht.
5. September 2025
Wir haben Ratenlimit-Diagramme auf der Seite Usage der Console eingeführt, mit denen du deine API-Ratenlimit-Nutzung und Caching-Raten im Zeitverlauf überwachen kannst.
3. September 2025
Wir haben Unterstützung für zitierbare Dokumente in clientseitigen Tool-Ergebnissen eingeführt. Erfahre mehr unter Tool-Aufrufe verarbeiten.
2. September 2025
Wir haben v2 des Code-Execution-Tools in der öffentlichen Beta eingeführt, das das ursprüngliche reine Python-Tool durch Bash-Befehlsausführung und direkte Dateimanipulationsfunktionen ersetzt, einschließlich des Schreibens von Code in anderen Sprachen.
27. August 2025
Wir haben eine Beta-Version des PHP SDK veröffentlicht.
Das Kontextfenster von 1 Mio. Token ist jetzt auf Vertex AI verfügbar. Weitere Informationen findest du unter Claude auf Vertex AI.
19. August 2025
Request-IDs sind jetzt direkt in den Bodies von Fehlerantworten enthalten, zusätzlich zum bestehenden request-id-Header. Erfahre mehr unter Fehler.
18. August 2025
Wir haben die Usage & Cost API veröffentlicht, mit der Administratoren die Nutzungs- und Kostendaten ihrer Organisation programmatisch überwachen können.
Wir haben der Admin API einen neuen Endpunkt zum Abrufen von Organisationsinformationen hinzugefügt. Details findest du in der Organization Info Admin API-Referenz.
13. August 2025
Wir haben die Abkündigung der Claude Sonnet 3.5-Modelle (claude-3-5-sonnet-20240620 und claude-3-5-sonnet-20241022) angekündigt. Diese Modelle werden am 28. Oktober 2025 eingestellt. Wir empfehlen die Migration zu Claude Sonnet 4.5 (claude-sonnet-4-5-20250929) für verbesserte Leistung und Fähigkeiten. Mehr dazu in Modell-Abkündigungen.
Die 1-Stunden-Cache-Dauer für „prompt caching" (Prompt-Caching) erfordert keinen Beta-Header mehr. Mehr dazu in Prompt-Caching.
Einige Kunden könnten nach einem starken Anstieg der API-Nutzung aufgrund von Beschleunigungslimits der API auf 429-Fehler (rate_limit_error) stoßen. Zuvor traten in ähnlichen Szenarien 529-Fehler (overloaded_error) auf.
8. August 2025
Suchergebnis-Inhaltsblöcke sind auf der Claude API und Vertex AI nicht mehr in der Beta-Phase. Diese Funktion ermöglicht natürliche Zitate für RAG-Anwendungen mit korrekter Quellenangabe. Der Beta-Header search-results-2025-06-09 ist nicht mehr erforderlich. Mehr dazu in Suchergebnisse.
5. August 2025
Wir haben Claude Opus 4.1 eingeführt, ein inkrementelles Update zu Claude Opus 4 mit erweiterten Fähigkeiten und Leistungsverbesserungen.* Mehr dazu in der Modellübersicht.
*Opus 4.1 erlaubt nicht, dass die Parameter temperature und top_p gleichzeitig angegeben werden. Bitte verwende nur einen davon.
28. Juli 2025
Wir haben text_editor_20250728 veröffentlicht, ein aktualisiertes Texteditor-Tool, das einige Probleme der vorherigen Versionen behebt und einen optionalen Parameter max_characters hinzufügt, mit dem du die Kürzungslänge beim Anzeigen großer Dateien steuern kannst.
24. Juli 2025
Wir haben die „rate limits" (Ratenlimits) für Claude Opus 4 auf der Claude API erhöht, um dir mehr Kapazität zum Entwickeln und Skalieren mit Claude zu geben. Für Kunden mit Ratenlimits der Nutzungsstufen 1–4 gelten diese Änderungen sofort für dein Konto – es ist keine Aktion erforderlich.
21. Juli 2025
Wir haben die Modelle Claude 2.0, Claude 2.1 und Claude Sonnet 3 eingestellt. Alle Anfragen an diese Modelle geben nun einen Fehler zurück. Mehr dazu in Modell-Abkündigungen.
17. Juli 2025
Wir haben die Ratenlimits für Claude Sonnet 4 auf der Claude API erhöht, um dir mehr Kapazität zum Entwickeln und Skalieren mit Claude zu geben. Für Kunden mit Ratenlimits der Nutzungsstufen 1–4 gelten diese Änderungen sofort für dein Konto – es ist keine Aktion erforderlich.
3. Juli 2025
Wir haben Suchergebnis-Inhaltsblöcke in der Beta-Phase eingeführt, die natürliche Zitate für RAG-Anwendungen ermöglichen. Tools können nun Suchergebnisse mit korrekter Quellenangabe zurückgeben, und Claude zitiert diese Quellen automatisch in seinen Antworten – mit derselben Zitatqualität wie bei der Websuche. Dadurch entfällt die Notwendigkeit von Dokument-Workarounds in benutzerdefinierten Wissensdatenbank-Anwendungen. Mehr dazu in Suchergebnisse. Um diese Funktion zu aktivieren, verwende den Beta-Header search-results-2025-06-09.
30. Juni 2025
Wir haben die Abkündigung des Modells Claude Opus 3 angekündigt. Mehr dazu in Modell-Abkündigungen.
23. Juni 2025
Console-Nutzer mit der Rolle „Developer" können nun auf die Seite Cost zugreifen. Zuvor erlaubte die Rolle „Developer" den Zugriff auf die Seite Usage, aber nicht auf die Seite „Cost".
11. Juni 2025
Wir haben feingranulares Tool-Streaming in der öffentlichen Beta eingeführt, eine Funktion, die es Claude ermöglicht, Parameter der „tool use" (Tool-Nutzung) ohne Pufferung / JSON-Validierung zu streamen. Um feingranulares Tool-Streaming zu aktivieren, verwende den Beta-Headerfine-grained-tool-streaming-2025-05-14.
Das Standardverhalten des erweiterten Denkens in Claude 4-Modellen gibt eine Zusammenfassung von Claudes vollständigem Denkprozess zurück, wobei das vollständige Denken verschlüsselt im Feld signature der thinking-Block-Ausgabe zurückgegeben wird.
Wir haben verschachteltes Denken in der öffentlichen Beta eingeführt, eine Funktion, die es Claude ermöglicht, zwischen Tool-Aufrufen zu denken. Um verschachteltes Denken zu aktivieren, verwende den Beta-Headerinterleaved-thinking-2025-05-14.
Wir haben die Files API in der öffentlichen Beta eingeführt, mit der du Dateien hochladen und in der Messages API sowie im Code-Ausführungstool referenzieren kannst.
Wir haben das Code-Ausführungstool in der öffentlichen Beta eingeführt, ein Tool, das es Claude ermöglicht, Python-Code in einer sicheren Sandbox-Umgebung auszuführen.
Wir haben den MCP-Konnektor in der öffentlichen Beta eingeführt, eine Funktion, mit der du dich direkt aus der Messages API mit entfernten MCP-Servern verbinden kannst.
Um die Antwortqualität zu erhöhen und Tool-Fehler zu verringern, haben wir den Standardwert des top_p-Parameters für Nucleus Sampling in der Messages API für alle Modelle von 0.999 auf 0.99 geändert. Um diese Änderung rückgängig zu machen, setze top_p auf 0.999.
Zusätzlich kannst du nun, wenn erweitertes Denken aktiviert ist, top_p auf Werte zwischen 0.95 und 1 setzen.
Unser Go SDK ist von der Beta-Phase in seine erste stabile Version übergegangen.
Wir haben der Seite Usage der Console eine Granularität auf Minuten- und Stundenebene sowie 429-Fehlerraten auf der Usage-Seite hinzugefügt.
21. Mai 2025
Unser Ruby SDK ist von der Beta-Phase in seine erste stabile Version übergegangen.
7. Mai 2025
Wir haben ein Websuche-Tool in der API eingeführt, mit dem Claude auf aktuelle Informationen aus dem Web zugreifen kann. Mehr dazu in Websuche-Tool.
1. Mai 2025
Cache Control muss nun direkt im übergeordneten content-Block von tool_result und document.source angegeben werden. Aus Gründen der Abwärtskompatibilität wird Cache Control, wenn es im letzten Block in tool_result.content oder document.source.content erkannt wird, stattdessen automatisch auf den übergeordneten Block angewendet. Cache Control auf allen anderen Blöcken innerhalb von tool_result.content und document.source.content führt zu einem Validierungsfehler.
9. April 2025
Wir haben eine Beta-Version des Ruby SDK eingeführt.
31. März 2025
Unser Java SDK ist von der Beta-Phase in seine erste stabile Version übergegangen.
Wir haben unser Go SDK von Alpha zu Beta überführt.
27. Februar 2025
Wir haben URL-Quellblöcke für Bilder und PDFs in der Messages API hinzugefügt. Du kannst nun Bilder und PDFs direkt über eine URL referenzieren, anstatt sie base64-kodieren zu müssen. Mehr dazu in Vision und PDF-Unterstützung.
Wir haben Unterstützung für eine Option none beim Parameter tool_choice in der Messages API hinzugefügt, die verhindert, dass Claude Tools aufruft. Außerdem musst du keine tools mehr angeben, wenn du tool_use- und tool_result-Blöcke einfügst.
Wir haben einen OpenAI-kompatiblen API-Endpunkt eingeführt, mit dem du Claude-Modelle testen kannst, indem du in bestehenden OpenAI-Integrationen lediglich deinen „API key" (API-Key), die Basis-URL und den Modellnamen änderst. Diese Kompatibilitätsschicht unterstützt die Kernfunktionalität von Chat Completions. Mehr dazu in OpenAI SDK-Kompatibilität.
24. Februar 2025
Wir haben Claude Sonnet 3.7 eingeführt, unser bisher intelligentestes Modell. Claude Sonnet 3.7 kann nahezu sofortige Antworten liefern oder sein erweitertes Denken Schritt für Schritt zeigen. Ein Modell, zwei Arten zu denken. Mehr über alle Claude-Modelle in der Modellübersicht.
Wir haben Claude Haiku 3.5 Vision-Unterstützung hinzugefügt, sodass das Modell Bilder analysieren und verstehen kann.
Wir haben eine token-effiziente Implementierung der Tool-Nutzung veröffentlicht, die die Gesamtleistung bei der Verwendung von Tools mit Claude verbessert. Mehr dazu in Tool-Nutzung mit Claude.
Wir haben die Standard-Temperatur in der Console für neue Prompts von 0 auf 1 geändert, um Konsistenz mit der Standard-Temperatur in der API herzustellen. Bestehende gespeicherte Prompts bleiben unverändert.
Wir haben aktualisierte Versionen unserer Tools veröffentlicht, die das Textbearbeitungs- und das Bash-Tool vom „system prompt" (System-Prompt) für Computer Use entkoppeln:
bash_20250124: Gleiche Funktionalität wie die vorherige Version, aber unabhängig von Computer Use. Erfordert keinen Beta-Header.
text_editor_20250124: Gleiche Funktionalität wie die vorherige Version, aber unabhängig von Computer Use. Erfordert keinen Beta-Header.
computer_20250124: Aktualisiertes Computer-Use-Tool mit neuen Befehlsoptionen, darunter "hold_key", "left_mouse_down", "left_mouse_up", "scroll", "triple_click" und "wait". Dieses Tool erfordert den anthropic-beta-Header "computer-use-2025-01-24".
Mehr dazu in Tool-Nutzung mit Claude.
10. Februar 2025
Wir haben den Antwort-Header anthropic-organization-id zu allen API-Antworten hinzugefügt. Dieser Header liefert die Organisations-ID, die mit dem in der Anfrage verwendeten API-Key verknüpft ist.
31. Januar 2025
Wir haben unser Java SDK von Alpha zu Beta überführt.
23. Januar 2025
Wir haben die Zitatfunktion in der API eingeführt, mit der Claude Quellenangaben für Informationen bereitstellen kann. Mehr dazu in Zitate.
Wir haben Unterstützung für Klartextdokumente und Dokumente mit benutzerdefiniertem Inhalt in der Messages API hinzugefügt.
21. Januar 2025
Wir haben die Abkündigung der Modelle Claude 2, Claude 2.1 und Claude Sonnet 3 angekündigt. Mehr dazu in Modell-Abkündigungen.
15. Januar 2025
Wir haben Prompt-Caching aktualisiert, damit es einfacher zu verwenden ist. Wenn du nun einen Cache-Breakpoint setzt, lesen wir automatisch von deinem längsten zuvor gecachten Präfix.
Du kannst Claude nun bei der Verwendung von Tools Worte in den Mund legen.
Wir haben die Möglichkeit hinzugefügt, auf den Seiten Usage und Cost der Developer Console nach API-Key zu gruppieren.
Wir haben zwei neue Spalten Last used at und Cost sowie die Möglichkeit, nach jeder Spalte zu sortieren, auf der Seite API keys der Developer Console hinzugefügt.
21. November 2024
Wir haben die Admin API veröffentlicht, mit der Nutzer die Ressourcen ihrer Organisation programmatisch verwalten können.
20. November 2024
Wir haben unsere Ratenlimits für die Messages API aktualisiert. Wir haben das Ratenlimit für Token pro Minute durch neue Ratenlimits für Eingabe- und Ausgabe-Token pro Minute ersetzt. Mehr dazu in Ratenlimits.
Wir haben PDF-Unterstützung für alle Claude Sonnet 3.5-Modelle hinzugefügt. Mehr dazu in PDF-Unterstützung.
6. November 2024
Wir haben die Modelle Claude 1 und Instant eingestellt. Mehr dazu in Modell-Abkündigungen.
4. November 2024
Claude Haiku 3.5 ist nun auf der Claude API als reines Textmodell verfügbar.
1. November 2024
Wir haben PDF-Unterstützung für die Verwendung mit dem neuen Claude Sonnet 3.5 hinzugefügt. Mehr dazu in PDF-Unterstützung.
Wir haben außerdem Token-Zählung hinzugefügt, mit der du die Gesamtzahl der Token in einer Message ermitteln kannst, bevor du sie an Claude sendest. Mehr dazu in Token-Zählung.
22. Oktober 2024
Wir haben von Anthropic definierte Computer-Use-Tools zu unserer API hinzugefügt, zur Verwendung mit dem neuen Claude Sonnet 3.5. Mehr dazu in Computer-Use-Tool.
Claude Sonnet 3.5, unser bisher intelligentestes Modell, hat gerade ein Upgrade erhalten und ist nun auf der Claude API verfügbar. Mehr dazu in der Claude Sonnet-Dokumentation.
8. Oktober 2024
Die Message Batches API ist nun in der Beta-Phase verfügbar. Verarbeite große Stapel von Anfragen asynchron in der Claude API zu 50 % geringeren Kosten. Mehr dazu in Batch-Verarbeitung.
Wir haben die Einschränkungen bei der Reihenfolge von user-/assistant-Turns in unserer Messages API gelockert. Aufeinanderfolgende user-/assistant-Nachrichten werden zu einer einzigen Nachricht zusammengefasst, anstatt einen Fehler auszulösen, und wir verlangen nicht mehr, dass die erste Eingabenachricht eine user-Nachricht ist.
Wir haben die Pläne Build und Scale zugunsten einer Standard-Funktionssuite (früher als Build bezeichnet) abgekündigt, zusammen mit zusätzlichen Funktionen, die über den Vertrieb verfügbar sind. Mehr dazu in unseren API-Preisinformationen.
3. Oktober 2024
Wir haben die Möglichkeit hinzugefügt, parallele Tool-Nutzung in der API zu deaktivieren. Setze disable_parallel_tool_use: true im Feld tool_choice, um sicherzustellen, dass Claude höchstens ein Tool verwendet. Mehr dazu in Parallele Tool-Nutzung.
10. September 2024
Wir haben Workspaces zur Developer Console hinzugefügt. Mit Workspaces kannst du benutzerdefinierte Ausgaben- oder Ratenlimits festlegen, API-Keys gruppieren, die Nutzung nach Projekt verfolgen und den Zugriff mit Benutzerrollen steuern. Mehr dazu in unserem Blogbeitrag.
4. September 2024
Wir haben die Abkündigung der Claude 1-Modelle angekündigt. Mehr dazu in Modell-Abkündigungen.
22. August 2024
Wir haben Unterstützung für die Verwendung des SDK in Browsern hinzugefügt, indem CORS-Header in den API-Antworten zurückgegeben werden. Setze dangerouslyAllowBrowser: true bei der SDK-Instanziierung, um diese Funktion zu aktivieren.
19. August 2024
Ausgaben mit 8.192 Token auf Claude Sonnet 3.5 sind nicht mehr in der Beta-Phase und erfordern den Header max-tokens-3-5-sonnet-2024-07-15 nicht mehr.
14. August 2024
Prompt-Caching ist nun als Beta-Funktion in der Claude API verfügbar. Cache und verwende Prompts wieder, um die Latenz um bis zu 80 % und die Kosten um bis zu 90 % zu senken.
15. Juli 2024
Generiere Ausgaben mit einer Länge von bis zu 8.192 Token mit Claude Sonnet 3.5 mithilfe des neuen Headers anthropic-beta: max-tokens-3-5-sonnet-2024-07-15.
9. Juli 2024
Generiere automatisch Testfälle für deine Prompts mit Claude in der Developer Console.
Vergleiche die Ausgaben verschiedener Prompts nebeneinander im neuen Ausgabe-Vergleichsmodus in der Developer Console.
27. Juni 2024
Sieh dir API-Nutzung und Abrechnung aufgeschlüsselt nach Dollarbetrag, Token-Anzahl und API-Keys in den neuen Tabs Usage und Cost in der Developer Console an.
Claude Sonnet 3.5, unser bisher intelligentestes Modell, ist nun auf der Claude API, Amazon Bedrock und Vertex AI verfügbar.
30. Mai 2024
Tool-Nutzung ist auf der Claude API, Amazon Bedrock und Vertex AI nicht mehr in der Beta-Phase, und es ist kein Beta-Header erforderlich.
10. Mai 2024
Unser Prompt-Generator-Tool ist nun in der Developer Console verfügbar. Der Prompt Generator macht es einfach, Claude dazu anzuleiten, hochwertige Prompts zu generieren, die auf deine spezifischen Aufgaben zugeschnitten sind. Mehr dazu in unserem Blogbeitrag.