Claude Platform Docs
Modelos y preciosCiclo de vida y referencia

Precios

Conoce la estructura de precios de Anthropic para modelos y funciones

Esta página proporciona información detallada de precios para los modelos y funciones de Anthropic. Todos los precios están en USD.

Para obtener la información de precios más actualizada, visita claude.com/pricing.

Precios de modelos

La siguiente tabla muestra los precios de todos los modelos Claude:

ModelBase tokensPrompt caching
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$10 /
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$4 / MTok
$20 / MTok
$5 / MTok
$8 / MTok
/ MTok
Claude Sonnet 5.5The best combination of speed and intelligence
$2 / MTok
$10 / MTok
$2.50 / MTok
$4 / MTok
$0.20 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$1 / MTok
$5 / MTok
$1.25 / MTok
$2 / MTok
$0.10 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
Claude Opus 4.1
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
Claude Opus 4
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
/ MTok
/ MTok
$2.50 / MTok
$4 / MTok
$0.20 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Sonnet 4
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Haiku 3.5
$0.80 / MTok
$4 / MTok
$1 / MTok
$1.60 / MTok
$0.08 / MTok
Additional notes
All other models use the standard 0.1x multiplier.
Claude 4.7 and later models and Claude Mythos Preview use a newer tokenizer that contributes to their improved performance on a wide range of tasks. This tokenizer produces approximately 30% more tokens for the same text. The exact increase depends on the content and workload shape. Claude Sonnet 4.6 and earlier models use the previous tokenizer.

Precios de plataformas en la nube

Esta sección cubre las plataformas en la nube operadas por socios, donde el proveedor de la nube te factura. Para las plataformas en la nube operadas por Anthropic y facturadas a través de un marketplace, consulta Precios de Claude Platform on AWS y Precios de Claude in Microsoft Foundry.

Los modelos Claude están disponibles en Amazon Bedrock y Google Cloud. Para precios oficiales, visita:

Precios de Claude Platform on AWS

Claude Platform on AWS factura a través de AWS Marketplace usando Claude Consumption Units (unidades de consumo de Claude), o CCUs. Anthropic valora tu uso de tokens en USD a las tarifas estándar por modelo y por función, aplica cualquier descuento negociado, convierte el resultado a CCUs a $0.01 por CCU e informa la cantidad de CCUs a AWS Marketplace cada hora. Tu factura de AWS muestra una única partida de CCU.

ConceptoDetalles
Unidad de facturaciónClaude Consumption Unit ()
Precio de la CCU$0.01 por CCU (fijo; los descuentos se aplican en la conversión de tokens a CCU, no al precio de la CCU)
ConversiónEl uso de tokens se valora en USD según las tarifas estándar por modelo y por función (las mismas que los precios de la Claude API) y luego se convierte a CCU a $0.01 por CCU
Frecuencia de facturaciónMedición por hora hacia AWS Marketplace; facturas mensuales
Modelo de pagoSolo a plazo vencido (pospago); sin créditos prepagados
DescuentosSe aplican como una menor cantidad de CCU medidas
ImpuestosMedición antes de impuestos; AWS Marketplace gestiona los impuestos
Visibilidad de costosDesglose en tiempo real en la Claude Console (acceso a través de la AWS Console); AWS Cost Explorer muestra las CCU agregadas

Geografía de inferencia

Para los modelos Claude 4.6 y posteriores, usar inference_geo: "us" aplica un multiplicador de precio de 1.1x. inference_geo: "global" (predeterminado) usa los precios estándar. Consulta Residencia de datos para más detalles.

Ofertas privadas

Cuando te registras en la página del servicio Claude Platform on AWS de la AWS Console, la AWS Console busca cualquier oferta privada asociada con tu cuenta y te solicita aceptarla en AWS Marketplace. Contacta a tu representante de cuenta de Anthropic para conocer los términos de las ofertas privadas.

Precios de Claude in Microsoft Foundry

Claude in Microsoft Foundry factura a través del Azure Marketplace usando Claude Consumption Units (CCUs). Anthropic valora tu uso de tokens en USD a las tarifas estándar por modelo y por función, aplica cualquier descuento negociado, convierte el resultado a CCUs a $0.01 por CCU e informa la cantidad de CCUs al Azure Marketplace cada hora. Tu factura de Azure muestra una única partida de CCU.

ConceptoDetalles
Unidad de facturaciónClaude Consumption Unit ()
Precio de la CCU$0.01 por CCU (fijo; los descuentos se aplican en la conversión de tokens a CCU, no al precio de la CCU)
ConversiónEl uso de tokens se valora en USD según las tarifas estándar por modelo y por función (las mismas que los precios de la Claude API) y luego se convierte a CCU a $0.01 por CCU
Frecuencia de facturaciónMedición por hora hacia Azure Marketplace; facturas mensuales
Modelo de pagoSolo a plazo vencido (pospago); sin créditos prepagados
DescuentosSe aplican como una menor cantidad de CCU medidas
ImpuestosMedición antes de impuestos; Azure Marketplace gestiona los impuestos
Visibilidad de costosAzure Cost Management muestra las CCU agregadas

Geografía de inferencia

Los despliegues alojados en Azure pueden usar el tipo de despliegue US Data Zone Standard, que mantiene la inferencia dentro de los Estados Unidos. Esto es equivalente a inference_geo: "us" en la Claude API y aplica el mismo multiplicador de precio de 1.1x. Consulta Residencia de datos para más detalles.

Precios específicos por función

Almacenamiento en caché de prompts

El "prompt caching" (almacenamiento en caché de prompts) reduce los costos y la latencia al reutilizar porciones previamente procesadas de tu prompt entre llamadas a la API. En lugar de reprocesar la misma "system prompt" (indicación del sistema) extensa, documento o historial de conversación en cada solicitud, la API lee desde la caché a una fracción del precio estándar de entrada.

Hay dos formas de habilitar el almacenamiento en caché de prompts:

  • Caché automática: Agrega un único campo cache_control en el nivel superior de tu solicitud. El sistema gestiona automáticamente los puntos de interrupción de caché a medida que las conversaciones crecen. Este es el punto de partida recomendado para la mayoría de los casos de uso.
  • Puntos de interrupción de caché explícitos: Coloca cache_control directamente en bloques de contenido individuales para un control detallado sobre exactamente qué se almacena en caché.

El almacenamiento en caché de prompts usa los siguientes multiplicadores de precio relativos a las tarifas base de tokens de entrada:

Operación de cachéMultiplicadorDuración
Escritura en caché de 5 minutos1.25x el precio de entrada baseCaché válida durante 5 minutos
Escritura en caché de 1 hora2x el precio de entrada baseCaché válida durante 1 hora
Lectura de caché (acierto)0.1x el precio de entrada base (0.025x en Claude Fable 5.1 y Claude Mythos 5.1; 0.05x en Claude Opus 5.5)Misma duración que la escritura anterior

Los tokens de escritura en caché se cobran cuando el contenido se almacena por primera vez. Los tokens de lectura de caché se cobran cuando una solicitud posterior recupera el contenido almacenado en caché. Un acierto de caché cuesta el 10% del precio estándar de entrada, lo que significa que el almacenamiento en caché resulta rentable después de una lectura de caché para la duración de 5 minutos (escritura de 1.25x), o después de dos lecturas de caché para la duración de 1 hora (escritura de 2x). En Claude Fable 5.1 y Claude Mythos 5.1, un acierto de caché cuesta el 2.5% del precio estándar de entrada ($0.25 USD por millón de tokens). En Claude Opus 5.5, un acierto de caché cuesta el 5% del precio estándar de entrada ($0.20 USD por millón de tokens).

Estos multiplicadores se acumulan con otros modificadores de precio, incluidos el descuento de la Batch API y la residencia de datos.

Para detalles de implementación, modelos compatibles y ejemplos de código, consulta Almacenamiento en caché de prompts.

Precios de residencia de datos

Para los modelos Claude 4.6 y posteriores, especificar inferencia solo en EE. UU. mediante el parámetro inference_geo conlleva un multiplicador de 1.1x en todas las categorías de precios de tokens, incluidos tokens de entrada, tokens de salida, escrituras en caché y lecturas de caché. El enrutamiento global (el predeterminado) usa los precios estándar.

Esto se aplica a la Claude API (de primera parte) y a Claude Platform on AWS. En Claude in Microsoft Foundry, el mismo multiplicador de 1.1x se aplica a los despliegues que usan el tipo de despliegue US Data Zone Standard (consulta Geografía de inferencia). Las plataformas operadas por socios (Bedrock y Google Cloud) tienen precios regionales independientes. Consulta Bedrock y Google Cloud para más detalles. Los modelos anteriores no admiten el parámetro inference_geo y siempre usan los precios estándar; las solicitudes que incluyen el parámetro en estos modelos devuelven un error 400.

Para más información, consulta Residencia de datos.

Precios del modo rápido

El "fast mode" (modo rápido), en vista previa de investigación, ofrece una salida significativamente más rápida para Claude Opus 5.5, Claude Opus 5 y Claude Opus 4.8 a un precio premium. Los precios del modo rápido se aplican en toda la "context window" (ventana de contexto), incluidas las solicitudes de más de 200k tokens de entrada. El modo rápido está disponible solo en la Claude API (de primera parte); no está disponible en Claude Platform on AWS ni en plataformas en la nube operadas por socios.

ModeloEntradaSalida
Claude Opus 5.5$8 / MTok$40 / MTok
Claude Opus 5 / Claude Opus 4.8$10 / MTok$50 / MTok

El modo rápido no está disponible en Claude Opus 4.7 (las solicitudes con speed: "fast" devuelven un error) ni en Claude Opus 4.6 (las solicitudes se ejecutan a velocidad estándar y se facturan a tarifas estándar). Consulta Modo rápido.

Los precios del modo rápido se acumulan con otros modificadores de precio:

El modo rápido no está disponible con la Batch API.

Para más información, consulta Modo rápido.

Procesamiento por lotes

La Batch API permite el procesamiento asíncrono de grandes volúmenes de solicitudes con un descuento del 50% tanto en tokens de entrada como de salida.

ModelBatch tokens
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$5 /
$25 / MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$2 / MTok
$10 / MTok
Claude Sonnet 5.5The best combination of speed and intelligence
$1 / MTok
$5 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$0.50 / MTok
$2.50 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
Claude Opus 4.1
$7.50 / MTok
$37.50 / MTok
Claude Opus 4
$7.50 / MTok
$37.50 / MTok
$1 / MTok
$5 / MTok
$1.50 / MTok
$7.50 / MTok
$1.50 / MTok
$7.50 / MTok
Claude Sonnet 4
$1.50 / MTok
$7.50 / MTok
Claude Haiku 3.5
$0.40 / MTok
$2 / MTok

Para más información sobre el procesamiento por lotes, consulta Procesamiento por lotes.

Precios de contexto largo

Los modelos Claude 4.6 y posteriores y Claude Mythos Preview incluyen la ventana de contexto de 1M de tokens completa a precios estándar. (Una solicitud de 900k tokens se factura a la misma tarifa por token que una solicitud de 9k tokens). Los descuentos del almacenamiento en caché de prompts y del procesamiento por lotes se aplican a tarifas estándar en toda la ventana de contexto.

Precios del uso de herramientas

Las solicitudes de "tool use" (uso de herramientas) se cobran en función de:

  1. El número total de tokens de entrada enviados al modelo (incluidos los del parámetro tools)
  2. El número de tokens de salida generados
  3. Para las herramientas del lado del servidor, precios adicionales basados en el uso (por ejemplo, la búsqueda web cobra por cada búsqueda realizada)

Las herramientas del lado del cliente tienen el mismo precio que cualquier otra solicitud a la Claude API, aunque las herramientas del lado del servidor pueden generar cargos adicionales según su uso específico.

Los tokens adicionales del uso de herramientas provienen de:

  • El parámetro tools en las solicitudes a la API (nombres, descripciones y esquemas de las herramientas)
  • Los bloques de contenido tool_use en las solicitudes y respuestas de la API
  • Los bloques de contenido tool_result en las solicitudes a la API

Cuando usas tools, la API también incluye automáticamente un "system prompt" (indicación del sistema) especial para el modelo que habilita el uso de herramientas. El número de tokens de uso de herramientas requeridos para cada modelo se indica en la siguiente tabla (sin incluir los tokens adicionales mencionados anteriormente). Ten en cuenta que la tabla asume que se proporciona al menos 1 herramienta. Si no se proporcionan tools, entonces una elección de herramienta de none usa 0 tokens adicionales de indicación del sistema.

ModelTool use system prompt tokens
NameToken count
Claude Opus 5.5For long-running agentic coding and knowledge work
auto, none
286 tokens
Claude Sonnet 5.5The best combination of speed and intelligence
auto, none
286 tokens
Claude Haiku 4.5The fastest model with near-frontier intelligence
auto, none
496 tokens
any, tool
588 tokens
auto, none
286 tokens
any, tool
406 tokens
auto, none
290 tokens
any, tool
410 tokens
auto, none
675 tokens
any, tool
804 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Opus 4.1
auto, none
313 tokens
any, tool
315 tokens
Claude Opus 4
auto, none
313 tokens
any, tool
315 tokens
auto, none
354 tokens
any, tool
474 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Sonnet 4
auto, none
313 tokens
any, tool
315 tokens
Claude Haiku 3.5
auto, none
264 tokens
any, tool
355 tokens

Estas cantidades de tokens se suman a tus tokens normales de entrada y salida para calcular el costo total de una solicitud.

Para los precios actuales por modelo, consulta la sección de precios de modelos.

Para más información sobre la implementación del "tool use" (uso de herramientas) y las mejores prácticas, consulta Uso de herramientas.

Precios de herramientas específicas

Herramienta Bash

La definición de la herramienta bash agrega los siguientes tokens de entrada a tu solicitud. Esto es adicional a la indicación del sistema de uso de herramientas por modelo que se aplica siempre que haya alguna herramienta presente.

ModeloTokens de entrada adicionales
Claude Opus 5, Claude Opus 4.8 y Claude Opus 4.7325 tokens
Claude Opus 4.6, Claude Sonnet 4.6 y anteriores244 tokens

Se consumen tokens adicionales por:

  • Salidas de comandos (stdout/stderr)
  • Mensajes de error
  • Contenidos de archivos grandes

Consulta precios del uso de herramientas para obtener los detalles completos de precios.

Herramienta de ejecución de código

La ejecución de código es gratuita cuando se usa con web search o web fetch. Cuando web_search_20260209 (o posterior) o web_fetch_20260209 (o posterior) se incluye en tu solicitud a la API, no hay cargos adicionales por las llamadas a la herramienta de ejecución de código más allá de los costos estándar de tokens de entrada y salida.

Cuando se usa sin estas herramientas, la ejecución de código se factura por tiempo de ejecución, registrado por separado del uso de tokens:

  • El tiempo de ejecución tiene un mínimo de 5 minutos
  • Cada organización recibe 1,550 horas gratuitas de uso por mes
  • El uso adicional más allá de las 1,550 horas se factura a $0.05 USD por hora, por contenedor
  • Si se incluyen archivos en la solicitud, el tiempo de ejecución se factura incluso si no se llama a la herramienta, porque los archivos se precargan en el contenedor

El uso de la ejecución de código se registra en la respuesta:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 239,
    "server_tool_use": {
      "code_execution_requests": 1
    }
  }
}

Herramienta de editor de texto

La herramienta de editor de texto utiliza la misma estructura de precios que otras herramientas usadas con Claude. Sigue los precios estándar de tokens de entrada y salida según el modelo de Claude que estés usando.

Además de los tokens base, se necesitan los siguientes tokens de entrada adicionales para la herramienta de editor de texto:

HerramientaTokens de entrada adicionales
text_editor_20250429 (Claude 4.x)700 tokens

Consulta precios del uso de herramientas para obtener los detalles completos de precios.

Herramienta de búsqueda web

El uso de la búsqueda web se cobra además del uso de tokens:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 6039,
    "cache_read_input_tokens": 7123,
    "cache_creation_input_tokens": 7345,
    "server_tool_use": {
      "web_search_requests": 1
    }
  }
}

La búsqueda web está disponible en la Claude API por $10 por cada 1,000 búsquedas, más los costos estándar de tokens por el contenido generado por las búsquedas. Los resultados de búsqueda web recuperados a lo largo de una conversación se cuentan como tokens de entrada, tanto en las iteraciones de búsqueda ejecutadas durante un solo turno como en los turnos posteriores de la conversación.

Cada búsqueda web cuenta como un uso, independientemente del número de resultados devueltos. Si ocurre un error durante la búsqueda web, esta no se facturará.

Herramienta de obtención web

El uso de web fetch no tiene cargos adicionales más allá de los costos estándar de tokens:

{
  "usage": {
    "input_tokens": 25039,
    "output_tokens": 931,
    "cache_read_input_tokens": 0,
    "cache_creation_input_tokens": 0,
    "server_tool_use": {
      "web_fetch_requests": 1
    }
  }
}

La herramienta web fetch está disponible en la Claude API sin costo adicional. Solo pagas los costos estándar de tokens por el contenido obtenido que pasa a formar parte del contexto de tu conversación.

Para protegerte contra la obtención inadvertida de contenido grande que consumiría tokens en exceso, usa el parámetro max_content_tokens para establecer límites apropiados según tu caso de uso y consideraciones de presupuesto.

Ejemplo de uso de tokens para contenido típico:

  • Página web promedio (10 kB): ~2,500 tokens
  • Página de documentación grande (100 kB): ~25,000 tokens
  • PDF de artículo de investigación (500 kB): ~125,000 tokens

Herramienta de uso de computadora

El uso de computadora sigue los precios estándar de uso de herramientas. Al usar la herramienta de uso de computadora:

Sobrecarga de la definición del conjunto de herramientas: Declarar computer_toolset_20260801 con sus miembros predeterminados agrega aproximadamente 4,500 tokens de entrada a una solicitud (aproximadamente 4,520 en Claude Fable 5, Claude Mythos 5, Claude Opus 5 y Claude Opus 4.8, y aproximadamente 4,590 en Claude Sonnet 5), lo que cubre las definiciones de las herramientas miembro y la indicación del sistema de uso de herramientas. Deshabilitar zoom con configs elimina aproximadamente 410 de esos tokens. El recuento exacto para una solicitud se informa en el campo usage de la respuesta, y puedes estimarlo con anticipación con el endpoint de conteo de tokens.

Versiones anteriores de la herramienta: Las siguientes cifras se aplican a las versiones de herramienta computer_20251124 y computer_20250124, no a computer_toolset_20260801:

  • Sobrecarga de la indicación del sistema: 466–499 tokens agregados a la indicación del sistema
  • Definición de la herramienta: aproximadamente 735 tokens de entrada por definición de herramienta (medido con computer_20250124)

Consumo adicional de tokens:

  • Imágenes de capturas de pantalla y de zoom devueltas en los resultados de herramientas, facturadas como entrada de imagen (consulta Precios de visión)
  • Resultados de ejecución de herramientas devueltos a Claude

Herramienta de uso de navegador

El uso del navegador sigue los precios estándar del uso de herramientas. Al usar la herramienta de uso del navegador:

Sobrecarga de la definición del conjunto de herramientas: Declarar browser_toolset_20260801 con sus miembros predeterminados agrega aproximadamente 6,600 tokens de entrada a una solicitud (aproximadamente 6,610 en Claude Fable 5, Claude Mythos 5, Claude Opus 5 y Claude Opus 4.8, y aproximadamente 6,670 en Claude Sonnet 5), lo que cubre las definiciones de las herramientas miembro y la indicación del sistema del uso de herramientas. Habilitar los cuatro miembros opcionales agrega aproximadamente 880 tokens, y deshabilitar miembros con configs reduce el recuento. El recuento exacto para una solicitud se informa en el usage de la respuesta, y puedes estimarlo con anticipación con el endpoint de conteo de tokens.

Consumo adicional de tokens:

  • Imágenes de capturas de pantalla y de zoom devueltas en los resultados de herramientas, facturadas como entrada de imagen (consulta Precios de visión)
  • Resultados de herramientas de texto devueltos a Claude, como árboles de accesibilidad, texto de la página y entradas de consola o de red

Precios de Claude Managed Agents

Claude Managed Agents se factura en dos dimensiones: tokens y tiempo de ejecución de sesión.

Tokens

Todos los tokens consumidos por una sesión de Claude Managed Agents se facturan a las tarifas mostradas en Precios de modelos. Los multiplicadores del almacenamiento en caché de prompts se aplican de forma idéntica. La búsqueda web activada dentro de una sesión conlleva el cargo estándar de $10 por cada 1,000 búsquedas. En Claude Platform on AWS, los cargos por tokens y tiempo de ejecución de sesión se convierten a Claude Consumption Units a la tarifa estándar. Los precios premium del modo rápido se aplican cuando el model.speed de un agente está configurado en "fast".

El multiplicador de residencia de datos también se aplica: cuando el model.inference_geo de un agente está fijado en "us", los tokens consumidos por las sesiones que ejecutan ese agente se facturan a 1.1x las tarifas estándar, el mismo multiplicador que se aplica a la inferencia solo en EE. UU. en la Messages API.

Los siguientes modificadores de la Messages API no se aplican a las sesiones de Claude Managed Agents:

ModificadorPor qué no se aplica
Descuento de la Batch APILas sesiones son con estado e interactivas. No hay modo por lotes.
Precios de plataformas en la nubeNo disponible en plataformas en la nube operadas por socios.

Tiempo de ejecución de sesión

SKUTarifaMedición
Tiempo de ejecución de sesión$0.08 por hora de sesiónDuración del estado running

El tiempo de ejecución se mide al milisegundo y se acumula solo mientras el estado de la sesión es running. El tiempo en estado idle (esperando tu siguiente mensaje o una confirmación de herramienta), rescheduling o terminated no cuenta para el tiempo de ejecución.

Ejemplo práctico

Una sesión de programación de una hora usando Claude Opus 5 que consume 50,000 tokens de entrada y 15,000 tokens de salida:

PartidaCálculoCosto
Tokens de entrada50,000 × $5 / 1,000,000$0.25
Tokens de salida15,000 × $25 / 1,000,000$0.375
Tiempo de ejecución de sesión1.0 hora × $0.08$0.08
Total$0.705

Si el almacenamiento en caché de prompts está activo y 40,000 de los tokens de entrada son lecturas de caché:

PartidaCálculoCosto
Tokens de entrada sin caché10,000 × $5 / 1,000,000$0.05
Tokens de lectura de caché40,000 × $5 × 0.1 / 1,000,000$0.02
Tokens de salida15,000 × $25 / 1,000,000$0.375
Tiempo de ejecución de sesión1.0 hora × $0.08$0.08
Total$0.525

Para un recorrido detallado de este cálculo, consulta la guía del agente de soporte al cliente.

Consideraciones adicionales de precios

Estrategias de optimización de costos

Al crear agentes con Claude:

  1. Usa los modelos apropiados: Elige Haiku para tareas simples, Sonnet para la mayoría de las cargas de trabajo de producción y Opus para el razonamiento más complejo
  2. Implementa el almacenamiento en caché de prompts: Reduce los costos del contexto repetido
  3. Agrupa operaciones por lotes: Usa la Batch API para tareas que no son sensibles al tiempo
  4. Monitorea los patrones de uso: Rastrea el consumo de tokens para identificar oportunidades de optimización

Límites de velocidad

Los "rate limits" (límites de velocidad) varían según el nivel de uso y afectan cuántas solicitudes puedes realizar:

  • Nivel Start: Límites de nivel inicial para comenzar
  • Nivel Build: Límites aumentados para aplicaciones en crecimiento
  • Nivel Scale: Los límites estándar más altos para cargas de trabajo de producción

Para información detallada sobre los límites de velocidad, consulta Límites de velocidad.

Para límites más allá del nivel Scale o acuerdos de precios personalizados, contacta al equipo de ventas.

Descuentos por volumen

Puede haber descuentos por volumen disponibles para usuarios de alto volumen. Estos se negocian caso por caso.

  • Los niveles de uso estándar usan los precios mostrados en Precios de modelos
  • Los clientes empresariales pueden contactar a ventas para precios personalizados
  • Puede haber descuentos académicos y de investigación disponibles

Precios empresariales

Para clientes empresariales con necesidades específicas:

  • Límites de velocidad personalizados
  • Descuentos por volumen
  • Soporte dedicado
  • Términos personalizados

Contacta al equipo de ventas en sales@anthropic.com o a través de la Claude Console para analizar las opciones de precios empresariales.

Facturación y pago

  • La facturación se basa en el uso mensual real
  • Todos los pagos son en USD
  • Opciones de tarjeta de crédito y facturación disponibles
  • Seguimiento de uso disponible en la Claude Console

Preguntas frecuentes

¿Cómo se calcula el uso de tokens?

Los tokens son fragmentos de texto que los modelos procesan. Como estimación aproximada, 1 token equivale aproximadamente a 4 caracteres o 0.75 palabras en inglés. El recuento exacto varía según el idioma y el tipo de contenido.

¿Hay niveles gratuitos o pruebas?

Los nuevos usuarios reciben una pequeña cantidad de créditos gratuitos para probar la API. Contacta a ventas para obtener información sobre pruebas extendidas para evaluación empresarial.

¿Cómo se acumulan los descuentos?

Los descuentos de la Batch API y del almacenamiento en caché de prompts pueden combinarse. Por ejemplo, usar ambas funciones juntas proporciona ahorros de costos significativos en comparación con las llamadas estándar a la API. Consulta precios del almacenamiento en caché de prompts para ver cómo interactúan los multiplicadores.

¿Qué métodos de pago se aceptan?

Se aceptan las principales tarjetas de crédito para cuentas estándar. Los clientes empresariales pueden acordar facturación y otros métodos de pago.

Para preguntas adicionales sobre precios, contacta a support@anthropic.com.

Was this page helpful?