Preise
Erfahre mehr über die Preisstruktur von Anthropic für Modelle und Funktionen
Diese Seite bietet detaillierte Preisinformationen für die Modelle und Funktionen von Anthropic. Alle Preise sind in USD angegeben.
Die aktuellsten Preisinformationen findest du unter claude.com/pricing.
Modellpreise
Die folgende Tabelle zeigt die Preise für alle Claude-Modelle:
| Modell | Basis-Input-Token | 5m Cache-Schreibvorgänge | 1h Cache-Schreibvorgänge | Cache-Treffer und -Aktualisierungen | Output-Token |
|---|---|---|---|---|---|
| Claude Fable 5.1 | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 0,25 $ / MTok1 | 50 $ / MTok |
| Claude Mythos 5.1 (eingeschränkte Verfügbarkeit) | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 0,25 $ / MTok1 | 50 $ / MTok |
| Claude Fable 5 | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 1 $ / MTok | 50 $ / MTok |
| Claude Mythos 5 (eingeschränkte Verfügbarkeit) | 10 $ / MTok | 12,50 $ / MTok | 20 $ / MTok | 1 $ / MTok | 50 $ / MTok |
| Claude Opus 5 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.8 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.7 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.6 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.5 | 5 $ / MTok | 6,25 $ / MTok | 10 $ / MTok | 0,50 $ / MTok | 25 $ / MTok |
| Claude Opus 4.1 (eingestellt, außer auf Bedrock und Google Cloud) | 15 $ / MTok | 18,75 $ / MTok | 30 $ / MTok | 1,50 $ / MTok | 75 $ / MTok |
| Claude Opus 4 (eingestellt, außer auf Google Cloud) | 15 $ / MTok | 18,75 $ / MTok | 30 $ / MTok | 1,50 $ / MTok | 75 $ / MTok |
| Claude Sonnet 5 | 2 $ / MTok | 2,50 $ / MTok | 4 $ / MTok | 0,20 $ / MTok | 10 $ / MTok |
| Claude Sonnet 4.6 | 3 $ / MTok | 3,75 $ / MTok | 6 $ / MTok | 0,30 $ / MTok | 15 $ / MTok |
| Claude Sonnet 4.5 | 3 $ / MTok | 3,75 $ / MTok | 6 $ / MTok | 0,30 $ / MTok | 15 $ / MTok |
| Claude Sonnet 4 (eingestellt, außer auf Bedrock und Google Cloud) | 3 $ / MTok | 3,75 $ / MTok | 6 $ / MTok | 0,30 $ / MTok | 15 $ / MTok |
| Claude Haiku 4.5 | 1 $ / MTok | 1,25 $ / MTok | 2 $ / MTok | 0,10 $ / MTok | 5 $ / MTok |
| Claude Haiku 3.5 (eingestellt, außer auf Bedrock und Google Cloud) | 0,80 $ / MTok | 1 $ / MTok | 1,60 $ / MTok | 0,08 $ / MTok | 4 $ / MTok |
1 Cache-Treffer und -Aktualisierungen bei Claude Fable 5.1 und Claude Mythos 5.1 werden mit dem 0,025-Fachen des Basis-Input-Preises berechnet. Alle anderen Modelle verwenden den Standard-Multiplikator von 0,1x.
Die Preise für Claude Platform on AWS findest du unter Preise für Claude Platform on AWS.
Preise für Cloud-Plattformen
Dieser Abschnitt behandelt von Partnern betriebene Cloud-Plattformen, bei denen der Cloud-Anbieter dir die Rechnung stellt. Für von Anthropic betriebene Cloud-Plattformen, die über einen Marketplace abgerechnet werden, siehe Preise für Claude Platform on AWS und Preise für Claude in Microsoft Foundry.
Claude-Modelle sind auf Amazon Bedrock und Google Cloud verfügbar. Die offiziellen Preise findest du unter:
Preise für Claude Platform on AWS
Claude Platform on AWS wird über den AWS Marketplace mithilfe von „Claude Consumption Units“ (Claude-Verbrauchseinheiten), oder CCUs, abgerechnet. Anthropic bewertet deine Token-Nutzung in USD zu den Standardtarifen pro Modell und pro Funktion, wendet etwaige ausgehandelte Rabatte an, rechnet das Ergebnis zu 0,01 $ pro CCU in CCUs um und meldet die CCU-Menge stündlich an den AWS Marketplace. Deine AWS-Rechnung zeigt eine einzelne CCU-Position.
| Konzept | Details |
|---|---|
| Abrechnungseinheit | Claude Consumption Unit (CCU) |
| CCU-Preis | 0,01 $ pro CCU (fest; Rabatte werden bei der Umrechnung von Token in CCUs angewendet, nicht auf den CCU-Preis) |
| Umrechnung | Token-Nutzung wird in USD zu den Standardtarifen pro Modell und pro Funktion bewertet (identisch mit den Claude API-Preisen) und dann zu 0,01 $ pro CCU in CCUs umgerechnet |
| Abrechnungsrhythmus | Stündliche Messung an den AWS Marketplace; monatliche Rechnungen |
| Zahlungsmodell | Nur nachträglich (Postpaid); keine Prepaid-Guthaben |
| Rabatte | Werden als geringere Anzahl gemessener CCUs angewendet |
| Steuern | Messung vor Steuern; der AWS Marketplace übernimmt die Steuerabwicklung |
| Kostentransparenz | Echtzeit-Aufschlüsselung in der Claude Console (Zugriff über die AWS Console); AWS Cost Explorer zeigt aggregierte CCUs |
Inferenz-Geografie
Für Claude 4.6 und neuere Modelle gilt bei Verwendung von inference_geo: "us" ein Preismultiplikator von 1,1x. inference_geo: "global" (Standard) verwendet die Standardpreise. Details findest du unter Datenresidenz.
Private Angebote
Wenn du dich auf der Serviceseite Claude Platform on AWS in der AWS Console registrierst, sucht die AWS Console nach einem mit deinem Konto verknüpften privaten Angebot und fordert dich auf, es im AWS Marketplace anzunehmen. Wende dich für die Bedingungen privater Angebote an deinen Anthropic-Ansprechpartner.
Preise für Claude in Microsoft Foundry
Claude in Microsoft Foundry wird über den Azure Marketplace mithilfe von Claude Consumption Units (CCUs) abgerechnet. Anthropic bewertet deine Token-Nutzung in USD zu den Standardtarifen pro Modell und pro Funktion, wendet etwaige ausgehandelte Rabatte an, rechnet das Ergebnis zu 0,01 $ pro CCU in CCUs um und meldet die CCU-Menge stündlich an den Azure Marketplace. Deine Azure-Rechnung zeigt eine einzelne CCU-Position.
| Konzept | Details |
|---|---|
| Abrechnungseinheit | Claude Consumption Unit (CCU) |
| CCU-Preis | 0,01 $ pro CCU (fest; Rabatte werden bei der Umrechnung von Token in CCUs angewendet, nicht auf den CCU-Preis) |
| Umrechnung | Token-Nutzung wird in USD zu den Standardtarifen pro Modell und pro Funktion bewertet (identisch mit den Claude API-Preisen) und dann zu 0,01 $ pro CCU in CCUs umgerechnet |
| Abrechnungsrhythmus | Stündliche Messung an den Azure Marketplace; monatliche Rechnungen |
| Zahlungsmodell | Nur nachträglich (Postpaid); keine Prepaid-Guthaben |
| Rabatte | Werden als geringere Anzahl gemessener CCUs angewendet |
| Steuern | Messung vor Steuern; der Azure Marketplace übernimmt die Steuerabwicklung |
| Kostentransparenz | Azure Cost Management zeigt aggregierte CCUs |
Inferenz-Geografie
Auf Azure gehostete Deployments können den Deployment-Typ US Data Zone Standard verwenden, der die Inferenz innerhalb der Vereinigten Staaten hält. Dies entspricht inference_geo: "us" auf der Claude API und wendet denselben Preismultiplikator von 1,1x an. Details findest du unter Datenresidenz.
Funktionsspezifische Preise
Prompt-Caching
„Prompt caching“ (Prompt-Caching) reduziert Kosten und Latenz, indem zuvor verarbeitete Teile deines Prompts über API-Aufrufe hinweg wiederverwendet werden. Anstatt denselben großen System-Prompt, dasselbe Dokument oder denselben Gesprächsverlauf bei jeder Anfrage erneut zu verarbeiten, liest die API aus dem Cache zu einem Bruchteil des Standard-Input-Preises.
Es gibt zwei Möglichkeiten, Prompt-Caching zu aktivieren:
- Automatisches Caching: Füge ein einzelnes
cache_control-Feld auf der obersten Ebene deiner Anfrage hinzu. Das System verwaltet Cache-Breakpoints automatisch, während Gespräche wachsen. Dies ist der empfohlene Ausgangspunkt für die meisten Anwendungsfälle. - Explizite Cache-Breakpoints: Platziere
cache_controldirekt auf einzelnen Inhaltsblöcken, um feingranular zu steuern, was genau gecacht wird.
Prompt-Caching verwendet die folgenden Preismultiplikatoren relativ zu den Basis-Input-Token-Tarifen:
| Cache-Operation | Multiplikator | Dauer |
|---|---|---|
| 5-Minuten-Cache-Schreibvorgang | 1,25x Basis-Input-Preis | Cache 5 Minuten gültig |
| 1-Stunden-Cache-Schreibvorgang | 2x Basis-Input-Preis | Cache 1 Stunde gültig |
| Cache-Lesevorgang (Treffer) | 0,1x Basis-Input-Preis (0,025x bei Claude Fable 5.1 und Claude Mythos 5.1) | Gleiche Dauer wie der vorangegangene Schreibvorgang |
Cache-Schreib-Token werden berechnet, wenn Inhalte erstmals gespeichert werden. Cache-Lese-Token werden berechnet, wenn eine nachfolgende Anfrage die gecachten Inhalte abruft. Ein Cache-Treffer kostet 10 % des Standard-Input-Preises, was bedeutet, dass sich Caching bei der 5-Minuten-Dauer (1,25x Schreibvorgang) nach einem Cache-Lesevorgang auszahlt oder bei der 1-Stunden-Dauer (2x Schreibvorgang) nach zwei Cache-Lesevorgängen. Bei Claude Fable 5.1 und Claude Mythos 5.1 kostet ein Cache-Treffer 2,5 % des Standard-Input-Preises (0,25 $ USD pro Million Token).
Diese Multiplikatoren lassen sich mit anderen Preismodifikatoren kombinieren, einschließlich des Batch API-Rabatts und der Datenresidenz.
Implementierungsdetails, unterstützte Modelle und Codebeispiele findest du unter Prompt-Caching.
Preise für Datenresidenz
Für Claude 4.6 und neuere Modelle fällt bei der Angabe von reiner US-Inferenz über den Parameter inference_geo ein Multiplikator von 1,1x auf alle Token-Preiskategorien an, einschließlich Input-Token, Output-Token, Cache-Schreibvorgängen und Cache-Lesevorgängen. Globales Routing (der Standard) verwendet die Standardpreise.
Dies gilt für die Claude API (First-Party) und Claude Platform on AWS. Bei Claude in Microsoft Foundry gilt derselbe Multiplikator von 1,1x für Deployments, die den Deployment-Typ US Data Zone Standard verwenden (siehe Inferenz-Geografie). Von Partnern betriebene Plattformen (Bedrock und Google Cloud) haben eigenständige regionale Preise. Details findest du unter Bedrock und Google Cloud. Ältere Modelle unterstützen den Parameter inference_geo nicht und verwenden immer die Standardpreise; Anfragen, die den Parameter bei diesen Modellen enthalten, geben einen 400-Fehler zurück.
Weitere Informationen findest du unter Datenresidenz.
Preise für den Fast-Modus
Der Fast-Modus, in der Research Preview, bietet deutlich schnelleren Output für Claude Opus 5 und Claude Opus 4.8 zu Premium-Preisen. Die Preise für den Fast-Modus gelten über das gesamte Kontextfenster, einschließlich Anfragen mit mehr als 200k Input-Token. Der Fast-Modus ist nur auf der Claude API (First-Party) verfügbar; er ist nicht auf Claude Platform on AWS oder von Partnern betriebenen Cloud-Plattformen verfügbar.
| Modell | Input | Output |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | 10 $ / MTok | 50 $ / MTok |
Der Fast-Modus ist nicht verfügbar auf Claude Opus 4.7 (Anfragen mit speed: "fast" geben einen Fehler zurück) oder Claude Opus 4.6 (Anfragen laufen mit Standardgeschwindigkeit und werden zu Standardtarifen abgerechnet). Siehe Fast-Modus.
Die Preise für den Fast-Modus lassen sich mit anderen Preismodifikatoren kombinieren:
- Prompt-Caching-Multiplikatoren werden zusätzlich zu den Fast-Modus-Preisen angewendet
- Datenresidenz-Multiplikatoren werden zusätzlich zu den Fast-Modus-Preisen angewendet
Der Fast-Modus ist nicht mit der Batch API verfügbar.
Weitere Informationen findest du unter Fast-Modus.
Batch-Verarbeitung
Die Batch API ermöglicht die asynchrone Verarbeitung großer Mengen von Anfragen mit einem Rabatt von 50 % auf Input- und Output-Token.
| Modell | Batch-Eingabe | Batch-Ausgabe |
|---|---|---|
| Claude Fable 5.1 | 5 $ / MTok | 25 $ / MTok |
| Claude Mythos 5.1 (eingeschränkte Verfügbarkeit) | 5 $ / MTok | 25 $ / MTok |
| Claude Fable 5 | 5 $ / MTok | 25 $ / MTok |
| Claude Mythos 5 (eingeschränkte Verfügbarkeit) | 5 $ / MTok | 25 $ / MTok |
| Claude Opus 5 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.8 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.7 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.6 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.5 | 2,50 $ / MTok | 12,50 $ / MTok |
| Claude Opus 4.1 (eingestellt, außer auf Bedrock und Google Cloud) | 7,50 $ / MTok | 37,50 $ / MTok |
| Claude Opus 4 (eingestellt, außer auf Google Cloud) | 7,50 $ / MTok | 37,50 $ / MTok |
| Claude Sonnet 5 | 1 $ / MTok | 5 $ / MTok |
| Claude Sonnet 4.6 | 1,50 $ / MTok | 7,50 $ / MTok |
| Claude Sonnet 4.5 | 1,50 $ / MTok | 7,50 $ / MTok |
| Claude Sonnet 4 (eingestellt, außer auf Bedrock und Google Cloud) | 1,50 $ / MTok | 7,50 $ / MTok |
| Claude Haiku 4.5 | 0,50 $ / MTok | 2,50 $ / MTok |
| Claude Haiku 3.5 (eingestellt, außer auf Bedrock und Google Cloud) | 0,40 $ / MTok | 2 $ / MTok |
Weitere Informationen zur Batch-Verarbeitung findest du unter Batch-Verarbeitung.
Preise für langen Kontext
Claude 4.6 und neuere Modelle sowie Claude Mythos Preview beinhalten das vollständige Kontextfenster von 1M Token zu Standardpreisen. (Eine Anfrage mit 900k Token wird zum selben Tarif pro Token abgerechnet wie eine Anfrage mit 9k Token.) Rabatte für Prompt-Caching und Batch-Verarbeitung gelten zu Standardtarifen über das gesamte Kontextfenster.
Preise für Tool-Nutzung
Anfragen mit „tool use“ (Tool-Nutzung) werden auf folgender Grundlage abgerechnet:
- Die Gesamtzahl der an das Modell gesendeten Input-Token (einschließlich derer im Parameter
tools) - Die Anzahl der generierten Output-Token
- Bei serverseitigen Tools zusätzliche nutzungsbasierte Preise (zum Beispiel wird bei der Websuche pro durchgeführter Suche abgerechnet)
Clientseitige Tools werden genauso abgerechnet wie jede andere Claude-API-Anfrage, während bei serverseitigen Tools je nach ihrer spezifischen Nutzung zusätzliche Kosten anfallen können.
Die zusätzlichen Token durch Tool-Nutzung stammen aus:
- Dem Parameter
toolsin API-Anfragen (Tool-Namen, Beschreibungen und Schemas) tool_use-Inhaltsblöcken in API-Anfragen und -Antwortentool_result-Inhaltsblöcken in API-Anfragen
Wenn du tools verwendest, fügt die API außerdem automatisch einen speziellen „system prompt“ (System-Prompt) für das Modell hinzu, der die Tool-Nutzung ermöglicht. Die Anzahl der für jedes Modell erforderlichen Tool-Nutzungs-Token ist in der folgenden Tabelle aufgeführt (ohne die zuvor genannten zusätzlichen Token). Beachte, dass die Tabelle davon ausgeht, dass mindestens 1 Tool bereitgestellt wird. Wenn keine tools bereitgestellt werden, verbraucht eine Tool-Auswahl von none 0 zusätzliche System-Prompt-Token.
| Modell | Tool-Auswahl | Token-Anzahl des System-Prompts für Tool-Nutzung |
|---|---|---|
| Claude Opus 5 | auto, noneany, tool | 286 Token 406 Token |
| Claude Opus 4.8 | auto, noneany, tool | 290 Token 410 Token |
| Claude Opus 4.7 | auto, noneany, tool | 675 Token 804 Token |
| Claude Opus 4.6 | auto, noneany, tool | 497 Token 589 Token |
| Claude Opus 4.5 | auto, noneany, tool | 496 Token 588 Token |
| Claude Opus 4.1 (eingestellt, außer auf Bedrock und Google Cloud) | auto, noneany, tool | 313 Token 315 Token |
| Claude Opus 4 (eingestellt, außer auf Google Cloud) | auto, noneany, tool | 313 Token 315 Token |
| Claude Sonnet 5 | auto, noneany, tool | 354 Token 474 Token |
| Claude Sonnet 4.6 | auto, noneany, tool | 497 Token 589 Token |
| Claude Sonnet 4.5 | auto, noneany, tool | 496 Token 588 Token |
| Claude Sonnet 4 (eingestellt, außer auf Bedrock und Google Cloud) | auto, noneany, tool | 313 Token 315 Token |
| Claude Haiku 4.5 | auto, noneany, tool | 496 Token 588 Token |
| Claude Haiku 3.5 (eingestellt, außer auf Bedrock und Google Cloud) | auto, noneany, tool | 264 Token 355 Token |
Diese Token-Anzahlen werden zu deinen normalen Input- und Output-Token addiert, um die Gesamtkosten einer Anfrage zu berechnen.
Die aktuellen Preise pro Modell findest du im Abschnitt Modellpreise.
Weitere Informationen zur Implementierung von „tool use“ (Tool-Nutzung) und zu Best Practices findest du unter Tool-Nutzung.
Preise für spezifische Tools
Bash-Tool
Die Bash-Tool-Definition fügt deiner Anfrage die folgenden Input-Token hinzu. Dies gilt zusätzlich zum modellspezifischen System-Prompt für die Tool-Nutzung, der immer dann angewendet wird, wenn ein beliebiges Tool vorhanden ist.
| Modell | Zusätzliche Input-Token |
|---|---|
| Claude Opus 5, Claude Opus 4.8 und Claude Opus 4.7 | 325 Token |
| Claude Opus 4.6, Claude Sonnet 4.6 und früher | 244 Token |
Zusätzliche Token werden verbraucht durch:
- Befehlsausgaben (stdout/stderr)
- Fehlermeldungen
- Große Dateiinhalte
Vollständige Preisdetails findest du unter Preise für Tool-Nutzung.
Code-Ausführungs-Tool
Die Code-Ausführung ist kostenlos, wenn sie zusammen mit Web Search oder Web Fetch verwendet wird. Wenn web_search_20260209 (oder neuer) oder web_fetch_20260209 (oder neuer) in deiner API-Anfrage enthalten ist, fallen für Aufrufe des Code-Ausführungs-Tools keine zusätzlichen Gebühren über die standardmäßigen Kosten für Eingabe- und Ausgabe-Token hinaus an.
Bei Verwendung ohne diese Tools wird die Code-Ausführung nach Ausführungszeit abgerechnet, die getrennt von der Token-Nutzung erfasst wird:
- Die Ausführungszeit beträgt mindestens 5 Minuten
- Jede Organisation erhält 1.550 kostenlose Stunden Nutzung pro Monat
- Zusätzliche Nutzung über 1.550 Stunden hinaus wird mit 0,05 $ (USD) pro Stunde und pro Container abgerechnet
- Wenn Dateien in der Anfrage enthalten sind, wird die Ausführungszeit auch dann abgerechnet, wenn das Tool nicht aufgerufen wird, da die Dateien vorab in den Container geladen werden
Die Nutzung der Code-Ausführung wird in der Antwort erfasst:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}Texteditor-Tool
Das Text-Editor-Tool verwendet dieselbe Preisstruktur wie andere Tools, die mit Claude verwendet werden. Es folgt der standardmäßigen Preisgestaltung für Input- und Output-Token, basierend auf dem Claude-Modell, das du verwendest.
Zusätzlich zu den Basis-Token werden für das Text-Editor-Tool die folgenden zusätzlichen Input-Token benötigt:
| Tool | Zusätzliche Input-Token |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 Token |
Vollständige Preisdetails findest du unter Preise für Tool-Nutzung.
Websuche-Tool
Die Nutzung der „web search“ (Websuche) wird zusätzlich zur Token-Nutzung berechnet:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}Die Websuche ist auf der Claude API für 10 $ pro 1.000 Suchen verfügbar, zuzüglich der Standard-Token-Kosten für durch die Suche generierte Inhalte. Websuchergebnisse, die im Verlauf einer Konversation abgerufen werden, werden als Input-Token gezählt – sowohl bei Suchiterationen, die innerhalb eines einzelnen Turns ausgeführt werden, als auch in nachfolgenden Konversations-Turns.
Jede Websuche zählt als eine Nutzung, unabhängig von der Anzahl der zurückgegebenen Ergebnisse. Wenn während der Websuche ein Fehler auftritt, wird die Websuche nicht in Rechnung gestellt.
Web-Fetch-Tool
Die Nutzung von Web Fetch verursacht keine zusätzlichen Gebühren über die Standard-Token-Kosten hinaus:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}Das Web-Fetch-Tool ist auf der Claude API ohne zusätzliche Kosten verfügbar. Du zahlst nur die Standard-Token-Kosten für die abgerufenen Inhalte, die Teil deines Gesprächskontexts werden.
Um dich davor zu schützen, versehentlich große Inhalte abzurufen, die übermäßig viele Token verbrauchen würden, verwende den Parameter max_content_tokens, um angemessene Limits basierend auf deinem Anwendungsfall und deinen Budgetüberlegungen festzulegen.
Beispielhafter Token-Verbrauch für typische Inhalte:
- Durchschnittliche Webseite (10 kB): ~2.500 Token
- Große Dokumentationsseite (100 kB): ~25.000 Token
- Forschungsarbeit als PDF (500 kB): ~125.000 Token
Computer-Use-Tool
„Computer use“ (Computernutzung) folgt der standardmäßigen Preisgestaltung für Tool-Nutzung. Bei der Verwendung des Computer-Use-Tools gilt:
Overhead der Toolset-Definition: Die Deklaration von computer_toolset_20260801 mit seinen Standardmitgliedern fügt einer Anfrage etwa 4.500 Input-Token hinzu (etwa 4.520 bei Claude Fable 5, Claude Mythos 5, Claude Opus 5 und Claude Opus 4.8 sowie etwa 4.590 bei Claude Sonnet 5). Dies umfasst die Definitionen der Mitglieds-Tools und den System-Prompt für die Tool-Nutzung. Das Deaktivieren von zoom über configs entfernt etwa 410 dieser Token. Die genaue Anzahl für eine Anfrage wird in der Antwort unter usage ausgewiesen, und du kannst sie im Voraus mit dem Token-Counting-Endpunkt schätzen.
Frühere Tool-Versionen: Die folgenden Zahlen gelten für die Tool-Versionen computer_20251124 und computer_20250124, nicht für computer_toolset_20260801:
- System-Prompt-Overhead: 466–499 Token, die dem System-Prompt hinzugefügt werden
- Tool-Definition: etwa 735 Input-Token pro Tool-Definition (gemessen mit
computer_20250124)
Zusätzlicher Token-Verbrauch:
- Screenshot- und Zoom-Bilder, die in Tool-Ergebnissen zurückgegeben werden, abgerechnet als Bild-Input (siehe Vision-Preisgestaltung)
- Ergebnisse der Tool-Ausführung, die an Claude zurückgegeben werden
Browser-Use-Tool
„Browser use“ (Browser-Nutzung) folgt der standardmäßigen Preisgestaltung für Tool-Nutzung. Bei der Verwendung des Browser-Use-Tools gilt:
Overhead der Toolset-Definition: Die Deklaration von browser_toolset_20260801 mit seinen Standardmitgliedern fügt einer Anfrage etwa 6.600 Input-Token hinzu (etwa 6.610 bei Claude Fable 5, Claude Mythos 5, Claude Opus 5 und Claude Opus 4.8 sowie etwa 6.670 bei Claude Sonnet 5), was die Definitionen der Mitglieds-Tools und den System-Prompt für die Tool-Nutzung abdeckt. Das Aktivieren aller vier optionalen Mitglieder fügt etwa 880 Token hinzu, und das Deaktivieren von Mitgliedern über configs verringert die Anzahl. Die genaue Anzahl für eine Anfrage wird in der usage der Antwort ausgewiesen, und du kannst sie im Voraus mit dem Token-Counting-Endpunkt abschätzen.
Zusätzlicher Token-Verbrauch:
- Screenshot- und Zoom-Bilder, die in Tool-Ergebnissen zurückgegeben werden, abgerechnet als Bild-Input (siehe Vision-Preisgestaltung)
- Text-Tool-Ergebnisse, die an Claude zurückgegeben werden, wie z. B. Accessibility-Trees, Seitentext sowie Konsolen- oder Netzwerkeinträge
Preise für Claude Managed Agents
Claude Managed Agents wird nach zwei Dimensionen abgerechnet: Token und Session-Laufzeit.
Token
Alle von einer Claude Managed Agents-Session verbrauchten Token werden zu den unter Modellpreise angegebenen Tarifen abgerechnet. Prompt-Caching-Multiplikatoren gelten identisch. Eine innerhalb einer Session ausgelöste Websuche kostet die üblichen 10 $ pro 1.000 Suchen. Auf Claude Platform on AWS werden Token- und Laufzeitgebühren von Sessions zum Standardtarif in Claude Consumption Units umgerechnet. Die Premium-Preise des Fast-Modus gelten, wenn model.speed eines Agenten auf "fast" gesetzt ist.
Der Datenresidenz-Multiplikator gilt ebenfalls: Wenn model.inference_geo eines Agenten auf "us" festgelegt ist, werden die von Sessions mit diesem Agenten verbrauchten Token zum 1,1-Fachen der Standardtarife abgerechnet – derselbe Multiplikator, der für reine US-Inferenz auf der Messages API gilt.
Die folgenden Modifikatoren der Messages API gelten nicht für Claude Managed Agents-Sessions:
| Modifikator | Warum er nicht gilt |
|---|---|
| Batch API-Rabatt | Sessions sind zustandsbehaftet und interaktiv. Es gibt keinen Batch-Modus. |
| Preise für Cloud-Plattformen | Nicht auf von Partnern betriebenen Cloud-Plattformen verfügbar. |
Session-Laufzeit
| SKU | Tarif | Messung |
|---|---|---|
| Session-Laufzeit | 0,08 $ pro Session-Stunde | Dauer im Status running |
Die Laufzeit wird auf die Millisekunde genau gemessen und fällt nur an, während der Status der Session running ist. Zeit im Status idle (Warten auf deine nächste Nachricht oder eine Tool-Bestätigung), rescheduling oder terminated zählt nicht zur Laufzeit.
Durchgerechnetes Beispiel
Eine einstündige Coding-Session mit Claude Opus 5, die 50.000 Input-Token und 15.000 Output-Token verbraucht:
| Position | Berechnung | Kosten |
|---|---|---|
| Input-Token | 50.000 × 5 $ / 1.000.000 | 0,25 $ |
| Output-Token | 15.000 × 25 $ / 1.000.000 | 0,375 $ |
| Session-Laufzeit | 1,0 Stunde × 0,08 $ | 0,08 $ |
| Gesamt | 0,705 $ |
Wenn Prompt-Caching aktiv ist und 40.000 der Input-Token Cache-Lesevorgänge sind:
| Position | Berechnung | Kosten |
|---|---|---|
| Nicht gecachte Input-Token | 10.000 × 5 $ / 1.000.000 | 0,05 $ |
| Cache-Lese-Token | 40.000 × 5 $ × 0,1 / 1.000.000 | 0,02 $ |
| Output-Token | 15.000 × 25 $ / 1.000.000 | 0,375 $ |
| Session-Laufzeit | 1,0 Stunde × 0,08 $ | 0,08 $ |
| Gesamt | 0,525 $ |
Eine detaillierte Schritt-für-Schritt-Erklärung dieser Berechnung findest du im Leitfaden für Kundensupport-Agenten.
Zusätzliche Preisüberlegungen
Strategien zur Kostenoptimierung
Beim Erstellen von Agenten mit Claude:
- Verwende geeignete Modelle: Wähle Haiku für einfache Aufgaben, Sonnet für die meisten Produktions-Workloads und Opus für das komplexeste Reasoning
- Implementiere Prompt-Caching: Reduziere Kosten für wiederholten Kontext
- Batch-Operationen: Verwende die Batch API für nicht zeitkritische Aufgaben
- Überwache Nutzungsmuster: Verfolge den Token-Verbrauch, um Optimierungsmöglichkeiten zu identifizieren
Ratenlimits
„Rate limits“ (Ratenlimits) variieren je nach Nutzungsstufe und beeinflussen, wie viele Anfragen du stellen kannst:
- Start-Stufe: Einstiegslimits für den Anfang
- Build-Stufe: Erhöhte Limits für wachsende Anwendungen
- Scale-Stufe: Höchste Standardlimits für Produktions-Workloads
Detaillierte Informationen zu Ratenlimits findest du unter Ratenlimits.
Für Limits über die Scale-Stufe hinaus oder individuelle Preisvereinbarungen wende dich an das Vertriebsteam.
Mengenrabatte
Für Nutzer mit hohem Volumen können Mengenrabatte verfügbar sein. Diese werden im Einzelfall ausgehandelt.
- Standard-Nutzungsstufen verwenden die unter Modellpreise angegebenen Preise
- Enterprise-Kunden können für individuelle Preise den Vertrieb kontaktieren
- Rabatte für akademische Einrichtungen und Forschung können verfügbar sein
Enterprise-Preise
Für Enterprise-Kunden mit spezifischen Anforderungen:
- Individuelle Ratenlimits
- Mengenrabatte
- Dedizierter Support
- Individuelle Bedingungen
Kontaktiere das Vertriebsteam unter sales@anthropic.com oder über die Claude Console, um Enterprise-Preisoptionen zu besprechen.
Abrechnung und Zahlung
- Die Abrechnung basiert auf der tatsächlichen monatlichen Nutzung
- Alle Zahlungen erfolgen in USD
- Kreditkarten- und Rechnungsoptionen verfügbar
- Nutzungsverfolgung in der Claude Console verfügbar
Häufig gestellte Fragen
Wie wird die Token-Nutzung berechnet?
Token sind Textstücke, die Modelle verarbeiten. Als grobe Schätzung entspricht 1 Token etwa 4 Zeichen oder 0,75 Wörtern im Englischen. Die genaue Anzahl variiert je nach Sprache und Inhaltstyp.
Gibt es kostenlose Stufen oder Testversionen?
Neue Nutzer erhalten eine kleine Menge kostenloser Guthaben, um die API zu testen. Kontaktiere den Vertrieb für Informationen zu erweiterten Testversionen für die Enterprise-Evaluierung.
Wie lassen sich Rabatte kombinieren?
Batch API- und Prompt-Caching-Rabatte können kombiniert werden. Die gemeinsame Nutzung beider Funktionen bietet beispielsweise erhebliche Kosteneinsparungen im Vergleich zu Standard-API-Aufrufen. Wie die Multiplikatoren zusammenwirken, findest du unter Prompt-Caching-Preise.
Welche Zahlungsmethoden werden akzeptiert?
Für Standardkonten werden gängige Kreditkarten akzeptiert. Enterprise-Kunden können Rechnungsstellung und andere Zahlungsmethoden vereinbaren.
Bei weiteren Fragen zu den Preisen wende dich an support@anthropic.com.
Was this page helpful?