Esta página proporciona información detallada sobre los precios de los modelos y funcionalidades de Anthropic. Todos los precios están en USD.
Para obtener la información de precios más actualizada, visita claude.com/pricing.
La siguiente tabla muestra los precios de todos los modelos de Claude:
| Modelo | Tokens de entrada base | Escrituras en caché de 5 min | Escrituras en caché de 1 h | Aciertos y actualizaciones de caché | Tokens de salida |
|---|---|---|---|---|---|
| Claude Fable 5 | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5 (disponibilidad limitada) | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.1 (retirado, excepto en Bedrock y Google Cloud) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Opus 4 (retirado, excepto en Google Cloud) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Sonnet 5 | $2 / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok | $10 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4 (retirado, excepto en Bedrock y Google Cloud) | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok | $5 / MTok |
| Claude Haiku 3.5 (retirado, excepto en Bedrock y Google Cloud) | $0.80 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok | $4 / MTok |
Para los precios de Claude Platform on AWS, consulta Precios de Claude Platform on AWS.
Esta sección cubre las plataformas en la nube operadas por socios, donde el proveedor de la nube te factura. Para las plataformas en la nube operadas por Anthropic que se facturan a través de un marketplace, consulta Precios de Claude Platform on AWS y Precios de Claude en Microsoft Foundry.
Los modelos de Claude están disponibles en Amazon Bedrock y Google Cloud. Para los precios oficiales, visita:
Claude Platform on AWS factura a través de AWS Marketplace usando Claude Consumption Units (CCUs). Anthropic calcula tu uso de tokens en USD según las tarifas estándar por modelo y por funcionalidad, aplica cualquier descuento negociado, convierte el resultado a CCUs a $0.01 por CCU y reporta la cantidad de CCUs a AWS Marketplace cada hora. Tu factura de AWS muestra una sola línea de CCU.
| Concepto | Detalles |
|---|---|
| Unidad de facturación | Claude Consumption Unit (CCU) |
| Precio de CCU | $0.01 por CCU (fijo; los descuentos se aplican en la conversión de tokens a CCU, no al precio de CCU) |
| Conversión | Uso de tokens calculado en USD según las tarifas estándar por modelo y por funcionalidad (igual que los precios de la API de Claude), luego convertido a CCUs a $0.01 por CCU |
| Cadencia de facturación | Medición por hora a AWS Marketplace; facturas mensuales |
| Modelo de pago | Solo pago posterior (postpago); sin créditos prepagados |
| Descuentos | Aplicados como menos CCUs medidas |
| Impuestos | Medición antes de impuestos; AWS Marketplace gestiona los impuestos |
| Visibilidad de costos | Desglose en tiempo real en Claude Console (acceso a través de la consola de AWS); AWS Cost Explorer muestra CCU agregadas |
Para los modelos Claude 4.6 y posteriores, usar inference_geo: "us" aplica un multiplicador de precios de 1.1x. inference_geo: "global" (predeterminado) usa precios estándar. Consulta Residencia de datos para más detalles.
Cuando te registras en la página del servicio Claude Platform on AWS de la consola de AWS, la consola de AWS busca cualquier oferta privada asociada con tu cuenta y te solicita que la aceptes en AWS Marketplace. Contacta a tu representante de cuenta de Anthropic para conocer los términos de la oferta privada.
Claude en Microsoft Foundry factura a través de Azure Marketplace usando Claude Consumption Units (CCUs). Anthropic calcula tu uso de tokens en USD según las tarifas estándar por modelo y por funcionalidad, aplica cualquier descuento negociado, convierte el resultado a CCUs a $0.01 por CCU y reporta la cantidad de CCUs a Azure Marketplace cada hora. Tu factura de Azure muestra una sola línea de CCU.
| Concepto | Detalles |
|---|---|
| Unidad de facturación | Claude Consumption Unit (CCU) |
| Precio de CCU | $0.01 por CCU (fijo; los descuentos se aplican en la conversión de tokens a CCU, no al precio de CCU) |
| Conversión | Uso de tokens calculado en USD según las tarifas estándar por modelo y por funcionalidad (igual que los precios de la API de Claude), luego convertido a CCUs a $0.01 por CCU |
| Cadencia de facturación | Medición por hora a Azure Marketplace; facturas mensuales |
| Modelo de pago | Solo pago posterior (postpago); sin créditos prepagados |
| Descuentos | Aplicados como menos CCUs medidas |
| Impuestos | Medición antes de impuestos; Azure Marketplace gestiona los impuestos |
| Visibilidad de costos | Azure Cost Management muestra CCU agregadas |
Las implementaciones alojadas en Azure pueden usar el tipo de implementación US Data Zone Standard, que mantiene la inferencia dentro de los Estados Unidos. Esto es equivalente a inference_geo: "us" en la API de Claude y aplica el mismo multiplicador de precios de 1.1x. Consulta Residencia de datos para más detalles.
El "prompt caching" (almacenamiento en caché de prompts) reduce los costos y la latencia al reutilizar porciones previamente procesadas de tu prompt en múltiples llamadas a la API. En lugar de reprocesar la misma indicación del sistema extensa, documento o historial de conversación en cada solicitud, la API lee desde la caché a una fracción del precio estándar de entrada.
Hay dos formas de habilitar el almacenamiento en caché de prompts:
cache_control en el nivel superior de tu solicitud. El sistema gestiona automáticamente los puntos de interrupción de caché a medida que las conversaciones crecen. Este es el punto de partida recomendado para la mayoría de los casos de uso.cache_control directamente en bloques de contenido individuales para un control detallado sobre exactamente qué se almacena en caché.El almacenamiento en caché de prompts usa los siguientes multiplicadores de precios en relación con las tarifas base de tokens de entrada:
| Operación de caché | Multiplicador | Duración |
|---|---|---|
| Escritura en caché de 5 minutos | 1.25x del precio base de entrada | Caché válida por 5 minutos |
| Escritura en caché de 1 hora | 2x del precio base de entrada | Caché válida por 1 hora |
| Lectura de caché (acierto) | 0.1x del precio base de entrada | Misma duración que la escritura precedente |
Los tokens de escritura en caché se cobran cuando el contenido se almacena por primera vez. Los tokens de lectura de caché se cobran cuando una solicitud posterior recupera el contenido almacenado en caché. Un acierto de caché cuesta el 10% del precio estándar de entrada, lo que significa que el almacenamiento en caché se amortiza después de una lectura de caché para la duración de 5 minutos (escritura de 1.25x), o después de dos lecturas de caché para la duración de 1 hora (escritura de 2x).
Estos multiplicadores se acumulan con otros modificadores de precios, incluido el descuento de la Batch API y la residencia de datos.
Para detalles de implementación, modelos compatibles y ejemplos de código, consulta Almacenamiento en caché de prompts.
Para los modelos Claude 4.6 y posteriores, especificar inferencia solo en EE. UU. a través del parámetro inference_geo incurre en un multiplicador de 1.1x en todas las categorías de precios de tokens, incluidos tokens de entrada, tokens de salida, escrituras en caché y lecturas de caché. El enrutamiento global (el predeterminado) usa precios estándar.
Esto se aplica a la API de Claude (de primera parte) y a Claude Platform on AWS. En Claude en Microsoft Foundry, el mismo multiplicador de 1.1x se aplica a las implementaciones que usan el tipo de implementación US Data Zone Standard (consulta Geografía de inferencia). Las plataformas operadas por socios (Bedrock y Google Cloud) tienen precios regionales independientes. Consulta Bedrock y Google Cloud para más detalles. Los modelos anteriores no admiten el parámetro inference_geo y siempre usan precios estándar; las solicitudes que incluyen el parámetro en estos modelos devuelven un error 400.
Para más información, consulta Residencia de datos.
El modo rápido, en vista previa de investigación, proporciona una salida significativamente más rápida para Claude Opus 5 y Claude Opus 4.8 a precios premium. Los precios del modo rápido se aplican en toda la ventana de contexto, incluidas las solicitudes de más de 200k tokens de entrada. El modo rápido está disponible solo en la API de Claude (de primera parte); no está disponible en Claude Platform on AWS ni en plataformas en la nube operadas por socios.
| Modelo | Entrada | Salida |
|---|---|---|
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
El modo rápido no está disponible en Claude Opus 4.7 (las solicitudes con speed: "fast" devuelven un error) ni en Claude Opus 4.6 (las solicitudes se ejecutan a velocidad estándar y se facturan a tarifas estándar). Consulta Modo rápido.
Los precios del modo rápido se acumulan con otros modificadores de precios:
El modo rápido no está disponible con la Batch API.
Para más información, consulta Modo rápido.
La Batch API permite el procesamiento asíncrono de grandes volúmenes de solicitudes con un descuento del 50% tanto en tokens de entrada como de salida.
| Modelo | Entrada por lote | Salida por lote |
|---|---|---|
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5 (disponibilidad limitada) | $5 / MTok | $25 / MTok |
| Claude Opus 5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.8 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.7 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.6 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.1 (retirado, excepto en Bedrock y Google Cloud) | $7.50 / MTok | $37.50 / MTok |
| Claude Opus 4 (retirado, excepto en Google Cloud) | $7.50 / MTok | $37.50 / MTok |
| Claude Sonnet 5 | $1 / MTok | $5 / MTok |
| Claude Sonnet 4.6 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4.5 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4 (retirado, excepto en Bedrock y Google Cloud) | $1.50 / MTok | $7.50 / MTok |
| Claude Haiku 4.5 | $0.50 / MTok | $2.50 / MTok |
| Claude Haiku 3.5 (retirado, excepto en Bedrock y Google Cloud) | $0.40 / MTok | $2 / MTok |
Para más información sobre el procesamiento por lotes, consulta Procesamiento por lotes.
Los modelos Claude 4.6 y posteriores, así como Claude Mythos Preview, incluyen la ventana de contexto de 1M de tokens completa a precios estándar. (Una solicitud de 900k tokens se factura a la misma tarifa por token que una solicitud de 9k tokens). Los descuentos de almacenamiento en caché de prompts y procesamiento por lotes se aplican a tarifas estándar en toda la ventana de contexto.
Las solicitudes de uso de herramientas se cobran en función de:
tools)Las herramientas del lado del cliente tienen el mismo precio que cualquier otra solicitud a la API de Claude, aunque las herramientas del lado del servidor pueden generar cargos adicionales según su uso específico.
Los tokens adicionales del uso de herramientas provienen de:
tools en las solicitudes a la API (nombres, descripciones y esquemas de las herramientas)tool_use en las solicitudes y respuestas de la APItool_result en las solicitudes a la APICuando usas tools, la API también incluye automáticamente una indicación del sistema especial para el modelo que habilita el uso de herramientas. El número de tokens de uso de herramientas requeridos para cada modelo se indica en la siguiente tabla (sin incluir los tokens adicionales mencionados anteriormente). Ten en cuenta que la tabla asume que se proporciona al menos 1 herramienta. Si no se proporcionan tools, entonces una elección de herramienta de none usa 0 tokens adicionales de indicación del sistema.
| Modelo | Elección de herramienta | Recuento de tokens de la indicación del sistema para uso de herramientas |
|---|---|---|
| Claude Opus 5 | auto, noneany, tool | 286 tokens 406 tokens |
| Claude Opus 4.8 | auto, noneany, tool | 290 tokens 410 tokens |
| Claude Opus 4.7 | auto, noneany, tool | 675 tokens 804 tokens |
| Claude Opus 4.6 | auto, noneany, tool | 497 tokens 589 tokens |
| Claude Opus 4.5 | auto, noneany, tool | 496 tokens 588 tokens |
| Claude Opus 4.1 (retirado, excepto en Bedrock y Google Cloud) | auto, noneany, tool | 313 tokens 315 tokens |
| Claude Opus 4 (retirado, excepto en Google Cloud) | auto, noneany, tool | 313 tokens 315 tokens |
| Claude Sonnet 5 | auto, noneany, tool | 354 tokens 474 tokens |
| Claude Sonnet 4.6 | auto, noneany, tool | 497 tokens 589 tokens |
| Claude Sonnet 4.5 | auto, noneany, tool | 496 tokens 588 tokens |
| Claude Sonnet 4 (retirado, excepto en Bedrock y Google Cloud) | auto, noneany, tool | 313 tokens 315 tokens |
| Claude Haiku 4.5 | auto, noneany, tool | 496 tokens 588 tokens |
| Claude Haiku 3.5 (retirado, excepto en Bedrock y Google Cloud) | auto, noneany, tool | 264 tokens 355 tokens |
Estos recuentos de tokens se suman a tus tokens normales de entrada y salida para calcular el costo total de una solicitud.
Para los precios actuales por modelo, consulta la sección de precios de los modelos.
Para más información sobre la implementación del uso de herramientas y las mejores prácticas, consulta Uso de herramientas.
La definición de la herramienta bash agrega los siguientes tokens de entrada a tu solicitud. Esto es adicional a la indicación del sistema de uso de herramientas por modelo que se aplica siempre que haya alguna herramienta presente.
| Modelo | Tokens de entrada adicionales |
|---|---|
| Claude Opus 5, Claude Opus 4.8 y Claude Opus 4.7 | 325 tokens |
| Claude Opus 4.6, Claude Sonnet 4.6 y anteriores | 244 tokens |
Los tokens adicionales son consumidos por:
Consulta precios del uso de herramientas para obtener detalles completos de precios.
La ejecución de código es gratuita cuando se usa con búsqueda web o recuperación web. Cuando web_search_20260209 (o posterior) o web_fetch_20260209 (o posterior) se incluye en tu solicitud de API, no hay cargos adicionales por las llamadas a la herramienta de ejecución de código más allá de los costos estándar de tokens de entrada y salida.
Cuando se usa sin estas herramientas, la ejecución de código se factura por tiempo de ejecución, el cual se registra por separado del uso de tokens:
El uso de la ejecución de código se registra en la respuesta:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}La herramienta de editor de texto utiliza la misma estructura de precios que otras herramientas usadas con Claude. Sigue el precio estándar de tokens de entrada y salida según el modelo de Claude que estés usando.
Además de los tokens base, se necesitan los siguientes tokens de entrada adicionales para la herramienta de editor de texto:
| Herramienta | Tokens de entrada adicionales |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 tokens |
Consulta precios del uso de herramientas para obtener detalles completos de precios.
El uso de la búsqueda web se cobra además del uso de tokens:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}La búsqueda web está disponible en la API de Claude por $10 por cada 1,000 búsquedas, más los costos estándar de tokens por el contenido generado a partir de las búsquedas. Los resultados de búsqueda web obtenidos a lo largo de una conversación se cuentan como tokens de entrada, tanto en las iteraciones de búsqueda ejecutadas durante un solo turno como en los turnos posteriores de la conversación.
Cada búsqueda web cuenta como un uso, independientemente del número de resultados devueltos. Si ocurre un error durante la búsqueda web, esta no se facturará.
El uso de web fetch no tiene cargos adicionales más allá de los costos estándar de tokens:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}La herramienta web fetch está disponible en la API de Claude sin costo adicional. Solo pagas los costos estándar de tokens por el contenido obtenido que pasa a formar parte del contexto de tu conversación.
Para protegerte contra la obtención inadvertida de contenido de gran tamaño que consumiría una cantidad excesiva de tokens, usa el parámetro max_content_tokens para establecer límites apropiados según tu caso de uso y consideraciones de presupuesto.
Ejemplo de uso de tokens para contenido típico:
El uso de computadora sigue los precios estándar de uso de herramientas. Al usar la herramienta de uso de computadora:
Sobrecarga de la indicación del sistema: La beta de uso de computadora agrega 466–499 tokens a la indicación del sistema
Uso de tokens de la herramienta de uso de computadora:
| Modelo | Tokens de entrada por definición de herramienta |
|---|---|
| Modelos Claude 4.x | 735 tokens |
Consumo adicional de tokens:
Claude Managed Agents se factura en dos dimensiones: tokens y tiempo de ejecución de sesión.
Todos los tokens consumidos por una sesión de Claude Managed Agents se facturan a las tarifas mostradas en Precios de los modelos. Los multiplicadores de almacenamiento en caché de prompts se aplican de forma idéntica. La búsqueda web activada dentro de una sesión incurre en el cargo estándar de $10 por cada 1,000 búsquedas. En Claude Platform on AWS, los cargos de tokens y tiempo de ejecución de sesión se convierten a Claude Consumption Units a la tarifa estándar. Los precios premium del modo rápido se aplican cuando el model.speed de un agente está configurado en "fast".
El multiplicador de residencia de datos también se aplica: cuando el model.inference_geo de un agente está fijado en "us", los tokens consumidos por las sesiones que ejecutan ese agente se facturan a 1.1x las tarifas estándar, el mismo multiplicador que se aplica a la inferencia solo en EE. UU. en la Messages API.
Los siguientes modificadores de la Messages API no se aplican a las sesiones de Claude Managed Agents:
| Modificador | Por qué no se aplica |
|---|---|
| Descuento de Batch API | Las sesiones son con estado e interactivas. No hay modo por lotes. |
| Precios de plataformas en la nube | No disponible en plataformas en la nube operadas por socios. |
| SKU | Tarifa | Medición |
|---|---|---|
| Tiempo de ejecución de sesión | $0.08 por hora de sesión | Duración del estado running |
El tiempo de ejecución se mide al milisegundo y se acumula solo mientras el estado de la sesión es running. El tiempo transcurrido en idle (esperando tu próximo mensaje o una confirmación de herramienta), rescheduling o terminated no cuenta para el tiempo de ejecución.
Una sesión de programación de una hora usando Claude Opus 5 que consume 50,000 tokens de entrada y 15,000 tokens de salida:
| Concepto | Cálculo | Costo |
|---|---|---|
| Tokens de entrada | 50,000 × $5 / 1,000,000 | $0.25 |
| Tokens de salida | 15,000 × $25 / 1,000,000 | $0.375 |
| Tiempo de ejecución de sesión | 1.0 hora × $0.08 | $0.08 |
| Total | $0.705 |
Si el almacenamiento en caché de prompts está activo y 40,000 de los tokens de entrada son lecturas de caché:
| Concepto | Cálculo | Costo |
|---|---|---|
| Tokens de entrada sin caché | 10,000 × $5 / 1,000,000 | $0.05 |
| Tokens de lectura de caché | 40,000 × $5 × 0.1 / 1,000,000 | $0.02 |
| Tokens de salida | 15,000 × $25 / 1,000,000 | $0.375 |
| Tiempo de ejecución de sesión | 1.0 hora × $0.08 | $0.08 |
| Total | $0.525 |
Para un recorrido detallado de este cálculo, consulta la guía de agente de soporte al cliente.
Al construir agentes con Claude:
Los límites de velocidad varían según el nivel de uso y afectan cuántas solicitudes puedes hacer:
Para información detallada sobre límites de velocidad, consulta Límites de velocidad.
Para límites más allá del nivel Scale o acuerdos de precios personalizados, contacta al equipo de ventas.
Los descuentos por volumen pueden estar disponibles para usuarios de alto volumen. Estos se negocian caso por caso.
Para clientes empresariales con necesidades específicas:
Contacta al equipo de ventas en [email protected] o a través de Claude Console para discutir opciones de precios empresariales.
¿Cómo se calcula el uso de tokens?
Los tokens son fragmentos de texto que los modelos procesan. Como estimación aproximada, 1 token equivale aproximadamente a 4 caracteres o 0.75 palabras en inglés. El recuento exacto varía según el idioma y el tipo de contenido.
¿Hay niveles gratuitos o pruebas?
Los nuevos usuarios reciben una pequeña cantidad de créditos gratuitos para probar la API. Contacta a ventas para obtener información sobre pruebas extendidas para evaluación empresarial.
¿Cómo se acumulan los descuentos?
Los descuentos de la Batch API y del almacenamiento en caché de prompts se pueden combinar. Por ejemplo, usar ambas funcionalidades juntas proporciona ahorros de costos significativos en comparación con las llamadas estándar a la API. Consulta precios del almacenamiento en caché de prompts para ver cómo interactúan los multiplicadores.
¿Qué métodos de pago se aceptan?
Se aceptan las principales tarjetas de crédito para cuentas estándar. Los clientes empresariales pueden organizar facturación y otros métodos de pago.
Para preguntas adicionales sobre precios, contacta a [email protected].
Was this page helpful?