Precios
Conoce la estructura de precios de Anthropic para modelos y funciones
Esta página proporciona información detallada de precios para los modelos y funciones de Anthropic. Todos los precios están en USD.
Para obtener la información de precios más actualizada, visita claude.com/pricing.
Precios de modelos
La siguiente tabla muestra los precios de todos los modelos Claude:
| Model | Base tokens | Prompt caching | |||
|---|---|---|---|---|---|
| Name | Input | Output | |||
Claude Fable 5.1For demanding reasoning and long-horizon agentic work | $10 / | $50 / MTok | $12.50 / MTok | $20 / MTok | / MTok |
Claude Opus 5.5For long-running agentic coding and knowledge work | $4 / MTok | $20 / MTok | $5 / MTok | $8 / MTok | / MTok |
Claude Sonnet 5.5The best combination of speed and intelligence | $2 / MTok | $10 / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok |
Claude Haiku 4.5The fastest model with near-frontier intelligence | $1 / MTok | $5 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok |
$10 / MTok | $50 / MTok | $12.50 / MTok | $20 / MTok | / MTok | |
$10 / MTok | $50 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | |
$10 / MTok | $50 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
$5 / MTok | $25 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | |
Claude Opus 4.1 | $15 / MTok | $75 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok |
Claude Opus 4 | $15 / MTok | $75 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok |
/ MTok | / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok | |
$3 / MTok | $15 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | |
$3 / MTok | $15 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | |
Claude Sonnet 4 | $3 / MTok | $15 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok |
Claude Haiku 3.5 | $0.80 / MTok | $4 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok |
Precios de plataformas en la nube
Esta sección cubre las plataformas en la nube operadas por socios, donde el proveedor de la nube te factura. Para las plataformas en la nube operadas por Anthropic y facturadas a través de un marketplace, consulta Precios de Claude Platform on AWS y Precios de Claude in Microsoft Foundry.
Los modelos Claude están disponibles en Amazon Bedrock y Google Cloud. Para precios oficiales, visita:
Precios de Claude Platform on AWS
Claude Platform on AWS factura a través de AWS Marketplace usando Claude Consumption Units (unidades de consumo de Claude), o CCUs. Anthropic valora tu uso de tokens en USD a las tarifas estándar por modelo y por función, aplica cualquier descuento negociado, convierte el resultado a CCUs a $0.01 por CCU e informa la cantidad de CCUs a AWS Marketplace cada hora. Tu factura de AWS muestra una única partida de CCU.
| Concepto | Detalles |
|---|---|
| Unidad de facturación | Claude Consumption Unit () |
| Precio de la CCU | $0.01 por CCU (fijo; los descuentos se aplican en la conversión de tokens a CCU, no al precio de la CCU) |
| Conversión | El uso de tokens se valora en USD según las tarifas estándar por modelo y por función (las mismas que los precios de la Claude API) y luego se convierte a CCU a $0.01 por CCU |
| Frecuencia de facturación | Medición por hora hacia AWS Marketplace; facturas mensuales |
| Modelo de pago | Solo a plazo vencido (pospago); sin créditos prepagados |
| Descuentos | Se aplican como una menor cantidad de CCU medidas |
| Impuestos | Medición antes de impuestos; AWS Marketplace gestiona los impuestos |
| Visibilidad de costos | Desglose en tiempo real en la Claude Console (acceso a través de la AWS Console); AWS Cost Explorer muestra las CCU agregadas |
Geografía de inferencia
Para los modelos Claude 4.6 y posteriores, usar inference_geo: "us" aplica un multiplicador de precio de 1.1x. inference_geo: "global" (predeterminado) usa los precios estándar. Consulta Residencia de datos para más detalles.
Ofertas privadas
Cuando te registras en la página del servicio Claude Platform on AWS de la AWS Console, la AWS Console busca cualquier oferta privada asociada con tu cuenta y te solicita aceptarla en AWS Marketplace. Contacta a tu representante de cuenta de Anthropic para conocer los términos de las ofertas privadas.
Precios de Claude in Microsoft Foundry
Claude in Microsoft Foundry factura a través del Azure Marketplace usando Claude Consumption Units (CCUs). Anthropic valora tu uso de tokens en USD a las tarifas estándar por modelo y por función, aplica cualquier descuento negociado, convierte el resultado a CCUs a $0.01 por CCU e informa la cantidad de CCUs al Azure Marketplace cada hora. Tu factura de Azure muestra una única partida de CCU.
| Concepto | Detalles |
|---|---|
| Unidad de facturación | Claude Consumption Unit () |
| Precio de la CCU | $0.01 por CCU (fijo; los descuentos se aplican en la conversión de tokens a CCU, no al precio de la CCU) |
| Conversión | El uso de tokens se valora en USD según las tarifas estándar por modelo y por función (las mismas que los precios de la Claude API) y luego se convierte a CCU a $0.01 por CCU |
| Frecuencia de facturación | Medición por hora hacia Azure Marketplace; facturas mensuales |
| Modelo de pago | Solo a plazo vencido (pospago); sin créditos prepagados |
| Descuentos | Se aplican como una menor cantidad de CCU medidas |
| Impuestos | Medición antes de impuestos; Azure Marketplace gestiona los impuestos |
| Visibilidad de costos | Azure Cost Management muestra las CCU agregadas |
Geografía de inferencia
Los despliegues alojados en Azure pueden usar el tipo de despliegue US Data Zone Standard, que mantiene la inferencia dentro de los Estados Unidos. Esto es equivalente a inference_geo: "us" en la Claude API y aplica el mismo multiplicador de precio de 1.1x. Consulta Residencia de datos para más detalles.
Precios específicos por función
Almacenamiento en caché de prompts
El "prompt caching" (almacenamiento en caché de prompts) reduce los costos y la latencia al reutilizar porciones previamente procesadas de tu prompt entre llamadas a la API. En lugar de reprocesar la misma "system prompt" (indicación del sistema) extensa, documento o historial de conversación en cada solicitud, la API lee desde la caché a una fracción del precio estándar de entrada.
Hay dos formas de habilitar el almacenamiento en caché de prompts:
- Caché automática: Agrega un único campo
cache_controlen el nivel superior de tu solicitud. El sistema gestiona automáticamente los puntos de interrupción de caché a medida que las conversaciones crecen. Este es el punto de partida recomendado para la mayoría de los casos de uso. - Puntos de interrupción de caché explícitos: Coloca
cache_controldirectamente en bloques de contenido individuales para un control detallado sobre exactamente qué se almacena en caché.
El almacenamiento en caché de prompts usa los siguientes multiplicadores de precio relativos a las tarifas base de tokens de entrada:
| Operación de caché | Multiplicador | Duración |
|---|---|---|
| Escritura en caché de 5 minutos | 1.25x el precio de entrada base | Caché válida durante 5 minutos |
| Escritura en caché de 1 hora | 2x el precio de entrada base | Caché válida durante 1 hora |
| Lectura de caché (acierto) | 0.1x el precio de entrada base (0.025x en Claude Fable 5.1 y Claude Mythos 5.1; 0.05x en Claude Opus 5.5) | Misma duración que la escritura anterior |
Los tokens de escritura en caché se cobran cuando el contenido se almacena por primera vez. Los tokens de lectura de caché se cobran cuando una solicitud posterior recupera el contenido almacenado en caché. Un acierto de caché cuesta el 10% del precio estándar de entrada, lo que significa que el almacenamiento en caché resulta rentable después de una lectura de caché para la duración de 5 minutos (escritura de 1.25x), o después de dos lecturas de caché para la duración de 1 hora (escritura de 2x). En Claude Fable 5.1 y Claude Mythos 5.1, un acierto de caché cuesta el 2.5% del precio estándar de entrada ($0.25 USD por millón de tokens). En Claude Opus 5.5, un acierto de caché cuesta el 5% del precio estándar de entrada ($0.20 USD por millón de tokens).
Estos multiplicadores se acumulan con otros modificadores de precio, incluidos el descuento de la Batch API y la residencia de datos.
Para detalles de implementación, modelos compatibles y ejemplos de código, consulta Almacenamiento en caché de prompts.
Precios de residencia de datos
Para los modelos Claude 4.6 y posteriores, especificar inferencia solo en EE. UU. mediante el parámetro inference_geo conlleva un multiplicador de 1.1x en todas las categorías de precios de tokens, incluidos tokens de entrada, tokens de salida, escrituras en caché y lecturas de caché. El enrutamiento global (el predeterminado) usa los precios estándar.
Esto se aplica a la Claude API (de primera parte) y a Claude Platform on AWS. En Claude in Microsoft Foundry, el mismo multiplicador de 1.1x se aplica a los despliegues que usan el tipo de despliegue US Data Zone Standard (consulta Geografía de inferencia). Las plataformas operadas por socios (Bedrock y Google Cloud) tienen precios regionales independientes. Consulta Bedrock y Google Cloud para más detalles. Los modelos anteriores no admiten el parámetro inference_geo y siempre usan los precios estándar; las solicitudes que incluyen el parámetro en estos modelos devuelven un error 400.
Para más información, consulta Residencia de datos.
Precios del modo rápido
El "fast mode" (modo rápido), en vista previa de investigación, ofrece una salida significativamente más rápida para Claude Opus 5.5, Claude Opus 5 y Claude Opus 4.8 a un precio premium. Los precios del modo rápido se aplican en toda la "context window" (ventana de contexto), incluidas las solicitudes de más de 200k tokens de entrada. El modo rápido está disponible solo en la Claude API (de primera parte); no está disponible en Claude Platform on AWS ni en plataformas en la nube operadas por socios.
| Modelo | Entrada | Salida |
|---|---|---|
| Claude Opus 5.5 | $8 / MTok | $40 / MTok |
| Claude Opus 5 / Claude Opus 4.8 | $10 / MTok | $50 / MTok |
El modo rápido no está disponible en Claude Opus 4.7 (las solicitudes con speed: "fast" devuelven un error) ni en Claude Opus 4.6 (las solicitudes se ejecutan a velocidad estándar y se facturan a tarifas estándar). Consulta Modo rápido.
Los precios del modo rápido se acumulan con otros modificadores de precio:
- Los multiplicadores del almacenamiento en caché de prompts se aplican sobre los precios del modo rápido
- Los multiplicadores de residencia de datos se aplican sobre los precios del modo rápido
El modo rápido no está disponible con la Batch API.
Para más información, consulta Modo rápido.
Procesamiento por lotes
La Batch API permite el procesamiento asíncrono de grandes volúmenes de solicitudes con un descuento del 50% tanto en tokens de entrada como de salida.
| Model | Batch tokens | |
|---|---|---|
| Name | Input | Output |
Claude Fable 5.1For demanding reasoning and long-horizon agentic work | $5 / | $25 / MTok |
Claude Opus 5.5For long-running agentic coding and knowledge work | $2 / MTok | $10 / MTok |
Claude Sonnet 5.5The best combination of speed and intelligence | $1 / MTok | $5 / MTok |
Claude Haiku 4.5The fastest model with near-frontier intelligence | $0.50 / MTok | $2.50 / MTok |
$5 / MTok | $25 / MTok | |
$5 / MTok | $25 / MTok | |
$5 / MTok | $25 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
$2.50 / MTok | $12.50 / MTok | |
Claude Opus 4.1 | $7.50 / MTok | $37.50 / MTok |
Claude Opus 4 | $7.50 / MTok | $37.50 / MTok |
$1 / MTok | $5 / MTok | |
$1.50 / MTok | $7.50 / MTok | |
$1.50 / MTok | $7.50 / MTok | |
Claude Sonnet 4 | $1.50 / MTok | $7.50 / MTok |
Claude Haiku 3.5 | $0.40 / MTok | $2 / MTok |
Para más información sobre el procesamiento por lotes, consulta Procesamiento por lotes.
Precios de contexto largo
Los modelos Claude 4.6 y posteriores y Claude Mythos Preview incluyen la ventana de contexto de 1M de tokens completa a precios estándar. (Una solicitud de 900k tokens se factura a la misma tarifa por token que una solicitud de 9k tokens). Los descuentos del almacenamiento en caché de prompts y del procesamiento por lotes se aplican a tarifas estándar en toda la ventana de contexto.
Precios del uso de herramientas
Las solicitudes de "tool use" (uso de herramientas) se cobran en función de:
- El número total de tokens de entrada enviados al modelo (incluidos los del parámetro
tools) - El número de tokens de salida generados
- Para las herramientas del lado del servidor, precios adicionales basados en el uso (por ejemplo, la búsqueda web cobra por cada búsqueda realizada)
Las herramientas del lado del cliente tienen el mismo precio que cualquier otra solicitud a la Claude API, aunque las herramientas del lado del servidor pueden generar cargos adicionales según su uso específico.
Los tokens adicionales del uso de herramientas provienen de:
- El parámetro
toolsen las solicitudes a la API (nombres, descripciones y esquemas de las herramientas) - Los bloques de contenido
tool_useen las solicitudes y respuestas de la API - Los bloques de contenido
tool_resulten las solicitudes a la API
Cuando usas tools, la API también incluye automáticamente un "system prompt" (indicación del sistema) especial para el modelo que habilita el uso de herramientas. El número de tokens de uso de herramientas requeridos para cada modelo se indica en la siguiente tabla (sin incluir los tokens adicionales mencionados anteriormente). Ten en cuenta que la tabla asume que se proporciona al menos 1 herramienta. Si no se proporcionan tools, entonces una elección de herramienta de none usa 0 tokens adicionales de indicación del sistema.
| Model | Tool use system prompt tokens | |
|---|---|---|
| Name | Token count | |
Claude Opus 5.5For long-running agentic coding and knowledge work | auto, none | 286 tokens |
Claude Sonnet 5.5The best combination of speed and intelligence | auto, none | 286 tokens |
Claude Haiku 4.5The fastest model with near-frontier intelligence | auto, none | 496 tokens |
any, tool | 588 tokens | |
auto, none | 286 tokens | |
any, tool | 406 tokens | |
auto, none | 290 tokens | |
any, tool | 410 tokens | |
auto, none | 675 tokens | |
any, tool | 804 tokens | |
auto, none | 497 tokens | |
any, tool | 589 tokens | |
auto, none | 496 tokens | |
any, tool | 588 tokens | |
Claude Opus 4.1 | auto, none | 313 tokens |
any, tool | 315 tokens | |
Claude Opus 4 | auto, none | 313 tokens |
any, tool | 315 tokens | |
auto, none | 354 tokens | |
any, tool | 474 tokens | |
auto, none | 497 tokens | |
any, tool | 589 tokens | |
auto, none | 496 tokens | |
any, tool | 588 tokens | |
Claude Sonnet 4 | auto, none | 313 tokens |
any, tool | 315 tokens | |
Claude Haiku 3.5 | auto, none | 264 tokens |
any, tool | 355 tokens | |
Estas cantidades de tokens se suman a tus tokens normales de entrada y salida para calcular el costo total de una solicitud.
Para los precios actuales por modelo, consulta la sección de precios de modelos.
Para más información sobre la implementación del "tool use" (uso de herramientas) y las mejores prácticas, consulta Uso de herramientas.
Precios de herramientas específicas
Herramienta Bash
La definición de la herramienta bash agrega los siguientes tokens de entrada a tu solicitud. Esto es adicional a la indicación del sistema de uso de herramientas por modelo que se aplica siempre que haya alguna herramienta presente.
| Modelo | Tokens de entrada adicionales |
|---|---|
| Claude Opus 5, Claude Opus 4.8 y Claude Opus 4.7 | 325 tokens |
| Claude Opus 4.6, Claude Sonnet 4.6 y anteriores | 244 tokens |
Se consumen tokens adicionales por:
- Salidas de comandos (stdout/stderr)
- Mensajes de error
- Contenidos de archivos grandes
Consulta precios del uso de herramientas para obtener los detalles completos de precios.
Herramienta de ejecución de código
La ejecución de código es gratuita cuando se usa con web search o web fetch. Cuando web_search_20260209 (o posterior) o web_fetch_20260209 (o posterior) se incluye en tu solicitud a la API, no hay cargos adicionales por las llamadas a la herramienta de ejecución de código más allá de los costos estándar de tokens de entrada y salida.
Cuando se usa sin estas herramientas, la ejecución de código se factura por tiempo de ejecución, registrado por separado del uso de tokens:
- El tiempo de ejecución tiene un mínimo de 5 minutos
- Cada organización recibe 1,550 horas gratuitas de uso por mes
- El uso adicional más allá de las 1,550 horas se factura a $0.05 USD por hora, por contenedor
- Si se incluyen archivos en la solicitud, el tiempo de ejecución se factura incluso si no se llama a la herramienta, porque los archivos se precargan en el contenedor
El uso de la ejecución de código se registra en la respuesta:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}Herramienta de editor de texto
La herramienta de editor de texto utiliza la misma estructura de precios que otras herramientas usadas con Claude. Sigue los precios estándar de tokens de entrada y salida según el modelo de Claude que estés usando.
Además de los tokens base, se necesitan los siguientes tokens de entrada adicionales para la herramienta de editor de texto:
| Herramienta | Tokens de entrada adicionales |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 tokens |
Consulta precios del uso de herramientas para obtener los detalles completos de precios.
Herramienta de búsqueda web
El uso de la búsqueda web se cobra además del uso de tokens:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}La búsqueda web está disponible en la Claude API por $10 por cada 1,000 búsquedas, más los costos estándar de tokens por el contenido generado por las búsquedas. Los resultados de búsqueda web recuperados a lo largo de una conversación se cuentan como tokens de entrada, tanto en las iteraciones de búsqueda ejecutadas durante un solo turno como en los turnos posteriores de la conversación.
Cada búsqueda web cuenta como un uso, independientemente del número de resultados devueltos. Si ocurre un error durante la búsqueda web, esta no se facturará.
Herramienta de obtención web
El uso de web fetch no tiene cargos adicionales más allá de los costos estándar de tokens:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}La herramienta web fetch está disponible en la Claude API sin costo adicional. Solo pagas los costos estándar de tokens por el contenido obtenido que pasa a formar parte del contexto de tu conversación.
Para protegerte contra la obtención inadvertida de contenido grande que consumiría tokens en exceso, usa el parámetro max_content_tokens para establecer límites apropiados según tu caso de uso y consideraciones de presupuesto.
Ejemplo de uso de tokens para contenido típico:
- Página web promedio (10 kB): ~2,500 tokens
- Página de documentación grande (100 kB): ~25,000 tokens
- PDF de artículo de investigación (500 kB): ~125,000 tokens
Herramienta de uso de computadora
El uso de computadora sigue los precios estándar de uso de herramientas. Al usar la herramienta de uso de computadora:
Sobrecarga de la definición del conjunto de herramientas: Declarar computer_toolset_20260801 con sus miembros predeterminados agrega aproximadamente 4,500 tokens de entrada a una solicitud (aproximadamente 4,520 en Claude Fable 5, Claude Mythos 5, Claude Opus 5 y Claude Opus 4.8, y aproximadamente 4,590 en Claude Sonnet 5), lo que cubre las definiciones de las herramientas miembro y la indicación del sistema de uso de herramientas. Deshabilitar zoom con configs elimina aproximadamente 410 de esos tokens. El recuento exacto para una solicitud se informa en el campo usage de la respuesta, y puedes estimarlo con anticipación con el endpoint de conteo de tokens.
Versiones anteriores de la herramienta: Las siguientes cifras se aplican a las versiones de herramienta computer_20251124 y computer_20250124, no a computer_toolset_20260801:
- Sobrecarga de la indicación del sistema: 466–499 tokens agregados a la indicación del sistema
- Definición de la herramienta: aproximadamente 735 tokens de entrada por definición de herramienta (medido con
computer_20250124)
Consumo adicional de tokens:
- Imágenes de capturas de pantalla y de zoom devueltas en los resultados de herramientas, facturadas como entrada de imagen (consulta Precios de visión)
- Resultados de ejecución de herramientas devueltos a Claude
Herramienta de uso de navegador
El uso del navegador sigue los precios estándar del uso de herramientas. Al usar la herramienta de uso del navegador:
Sobrecarga de la definición del conjunto de herramientas: Declarar browser_toolset_20260801 con sus miembros predeterminados agrega aproximadamente 6,600 tokens de entrada a una solicitud (aproximadamente 6,610 en Claude Fable 5, Claude Mythos 5, Claude Opus 5 y Claude Opus 4.8, y aproximadamente 6,670 en Claude Sonnet 5), lo que cubre las definiciones de las herramientas miembro y la indicación del sistema del uso de herramientas. Habilitar los cuatro miembros opcionales agrega aproximadamente 880 tokens, y deshabilitar miembros con configs reduce el recuento. El recuento exacto para una solicitud se informa en el usage de la respuesta, y puedes estimarlo con anticipación con el endpoint de conteo de tokens.
Consumo adicional de tokens:
- Imágenes de capturas de pantalla y de zoom devueltas en los resultados de herramientas, facturadas como entrada de imagen (consulta Precios de visión)
- Resultados de herramientas de texto devueltos a Claude, como árboles de accesibilidad, texto de la página y entradas de consola o de red
Precios de Claude Managed Agents
Claude Managed Agents se factura en dos dimensiones: tokens y tiempo de ejecución de sesión.
Tokens
Todos los tokens consumidos por una sesión de Claude Managed Agents se facturan a las tarifas mostradas en Precios de modelos. Los multiplicadores del almacenamiento en caché de prompts se aplican de forma idéntica. La búsqueda web activada dentro de una sesión conlleva el cargo estándar de $10 por cada 1,000 búsquedas. En Claude Platform on AWS, los cargos por tokens y tiempo de ejecución de sesión se convierten a Claude Consumption Units a la tarifa estándar. Los precios premium del modo rápido se aplican cuando el model.speed de un agente está configurado en "fast".
El multiplicador de residencia de datos también se aplica: cuando el model.inference_geo de un agente está fijado en "us", los tokens consumidos por las sesiones que ejecutan ese agente se facturan a 1.1x las tarifas estándar, el mismo multiplicador que se aplica a la inferencia solo en EE. UU. en la Messages API.
Los siguientes modificadores de la Messages API no se aplican a las sesiones de Claude Managed Agents:
| Modificador | Por qué no se aplica |
|---|---|
| Descuento de la Batch API | Las sesiones son con estado e interactivas. No hay modo por lotes. |
| Precios de plataformas en la nube | No disponible en plataformas en la nube operadas por socios. |
Tiempo de ejecución de sesión
| SKU | Tarifa | Medición |
|---|---|---|
| Tiempo de ejecución de sesión | $0.08 por hora de sesión | Duración del estado running |
El tiempo de ejecución se mide al milisegundo y se acumula solo mientras el estado de la sesión es running. El tiempo en estado idle (esperando tu siguiente mensaje o una confirmación de herramienta), rescheduling o terminated no cuenta para el tiempo de ejecución.
Ejemplo práctico
Una sesión de programación de una hora usando Claude Opus 5 que consume 50,000 tokens de entrada y 15,000 tokens de salida:
| Partida | Cálculo | Costo |
|---|---|---|
| Tokens de entrada | 50,000 × $5 / 1,000,000 | $0.25 |
| Tokens de salida | 15,000 × $25 / 1,000,000 | $0.375 |
| Tiempo de ejecución de sesión | 1.0 hora × $0.08 | $0.08 |
| Total | $0.705 |
Si el almacenamiento en caché de prompts está activo y 40,000 de los tokens de entrada son lecturas de caché:
| Partida | Cálculo | Costo |
|---|---|---|
| Tokens de entrada sin caché | 10,000 × $5 / 1,000,000 | $0.05 |
| Tokens de lectura de caché | 40,000 × $5 × 0.1 / 1,000,000 | $0.02 |
| Tokens de salida | 15,000 × $25 / 1,000,000 | $0.375 |
| Tiempo de ejecución de sesión | 1.0 hora × $0.08 | $0.08 |
| Total | $0.525 |
Para un recorrido detallado de este cálculo, consulta la guía del agente de soporte al cliente.
Consideraciones adicionales de precios
Estrategias de optimización de costos
Al crear agentes con Claude:
- Usa los modelos apropiados: Elige Haiku para tareas simples, Sonnet para la mayoría de las cargas de trabajo de producción y Opus para el razonamiento más complejo
- Implementa el almacenamiento en caché de prompts: Reduce los costos del contexto repetido
- Agrupa operaciones por lotes: Usa la Batch API para tareas que no son sensibles al tiempo
- Monitorea los patrones de uso: Rastrea el consumo de tokens para identificar oportunidades de optimización
Límites de velocidad
Los "rate limits" (límites de velocidad) varían según el nivel de uso y afectan cuántas solicitudes puedes realizar:
- Nivel Start: Límites de nivel inicial para comenzar
- Nivel Build: Límites aumentados para aplicaciones en crecimiento
- Nivel Scale: Los límites estándar más altos para cargas de trabajo de producción
Para información detallada sobre los límites de velocidad, consulta Límites de velocidad.
Para límites más allá del nivel Scale o acuerdos de precios personalizados, contacta al equipo de ventas.
Descuentos por volumen
Puede haber descuentos por volumen disponibles para usuarios de alto volumen. Estos se negocian caso por caso.
- Los niveles de uso estándar usan los precios mostrados en Precios de modelos
- Los clientes empresariales pueden contactar a ventas para precios personalizados
- Puede haber descuentos académicos y de investigación disponibles
Precios empresariales
Para clientes empresariales con necesidades específicas:
- Límites de velocidad personalizados
- Descuentos por volumen
- Soporte dedicado
- Términos personalizados
Contacta al equipo de ventas en sales@anthropic.com o a través de la Claude Console para analizar las opciones de precios empresariales.
Facturación y pago
- La facturación se basa en el uso mensual real
- Todos los pagos son en USD
- Opciones de tarjeta de crédito y facturación disponibles
- Seguimiento de uso disponible en la Claude Console
Preguntas frecuentes
¿Cómo se calcula el uso de tokens?
Los tokens son fragmentos de texto que los modelos procesan. Como estimación aproximada, 1 token equivale aproximadamente a 4 caracteres o 0.75 palabras en inglés. El recuento exacto varía según el idioma y el tipo de contenido.
¿Hay niveles gratuitos o pruebas?
Los nuevos usuarios reciben una pequeña cantidad de créditos gratuitos para probar la API. Contacta a ventas para obtener información sobre pruebas extendidas para evaluación empresarial.
¿Cómo se acumulan los descuentos?
Los descuentos de la Batch API y del almacenamiento en caché de prompts pueden combinarse. Por ejemplo, usar ambas funciones juntas proporciona ahorros de costos significativos en comparación con las llamadas estándar a la API. Consulta precios del almacenamiento en caché de prompts para ver cómo interactúan los multiplicadores.
¿Qué métodos de pago se aceptan?
Se aceptan las principales tarjetas de crédito para cuentas estándar. Los clientes empresariales pueden acordar facturación y otros métodos de pago.
Para preguntas adicionales sobre precios, contacta a support@anthropic.com.
Was this page helpful?