Claude Platform Docs
Modelos e preçosCiclo de vida e referência

Preços

Saiba mais sobre a estrutura de preços da Anthropic para modelos e recursos

Esta página fornece informações detalhadas de preços para os modelos e recursos da Anthropic. Todos os preços estão em USD.

Para as informações de preços mais atualizadas, visite claude.com/pricing.

Preços dos modelos

A tabela a seguir mostra os preços de todos os modelos Claude:

ModelBase tokensPrompt caching
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$10 /
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$4 / MTok
$20 / MTok
$5 / MTok
$8 / MTok
/ MTok
Claude Sonnet 5.5The best combination of speed and intelligence
$2 / MTok
$10 / MTok
$2.50 / MTok
$4 / MTok
$0.20 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$1 / MTok
$5 / MTok
$1.25 / MTok
$2 / MTok
$0.10 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
/ MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$10 / MTok
$50 / MTok
$12.50 / MTok
$20 / MTok
$1 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
$5 / MTok
$25 / MTok
$6.25 / MTok
$10 / MTok
$0.50 / MTok
Claude Opus 4.1
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
Claude Opus 4
$15 / MTok
$75 / MTok
$18.75 / MTok
$30 / MTok
$1.50 / MTok
/ MTok
/ MTok
$2.50 / MTok
$4 / MTok
$0.20 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Sonnet 4
$3 / MTok
$15 / MTok
$3.75 / MTok
$6 / MTok
$0.30 / MTok
Claude Haiku 3.5
$0.80 / MTok
$4 / MTok
$1 / MTok
$1.60 / MTok
$0.08 / MTok
Additional notes
All other models use the standard 0.1x multiplier.
Claude 4.7 and later models and Claude Mythos Preview use a newer tokenizer that contributes to their improved performance on a wide range of tasks. This tokenizer produces approximately 30% more tokens for the same text. The exact increase depends on the content and workload shape. Claude Sonnet 4.6 and earlier models use the previous tokenizer.

Preços em plataformas de nuvem

Esta seção abrange plataformas de nuvem operadas por parceiros, nas quais o provedor de nuvem emite a fatura para você. Para plataformas de nuvem operadas pela Anthropic e faturadas por meio de um marketplace, consulte Preços do Claude Platform on AWS e Preços do Claude in Microsoft Foundry.

Os modelos Claude estão disponíveis no Amazon Bedrock e no Google Cloud. Para preços oficiais, visite:

Preços do Claude Platform on AWS

O Claude Platform on AWS é faturado por meio do AWS Marketplace usando "Claude Consumption Units" (Unidades de Consumo do Claude), ou CCUs. A Anthropic calcula seu uso de tokens em USD com base nas tarifas padrão por modelo e por recurso, aplica qualquer desconto negociado, converte o resultado em CCUs a $0,01 por CCU e informa a quantidade de CCUs ao AWS Marketplace a cada hora. Sua fatura da AWS mostra um único item de linha de CCU.

ConceitoDetalhes
Unidade de faturamentoClaude Consumption Unit ()
Preço da CCU$0,01 por CCU (fixo; os descontos são aplicados na conversão de tokens para CCUs, não no preço da CCU)
ConversãoO uso de tokens é calculado em USD com base nas tarifas padrão por modelo e por recurso (as mesmas dos preços da Claude API) e depois convertido em CCUs a $0,01 por CCU
Cadência de faturamentoMedição horária para o AWS Marketplace; faturas mensais
Modelo de pagamentoSomente pós-pago; sem créditos pré-pagos
DescontosAplicados como menos CCUs medidas
ImpostosMedição antes dos impostos; o AWS Marketplace cuida dos impostos
Visibilidade de custosDetalhamento em tempo real no Claude Console (acesso pelo AWS Console); o AWS Cost Explorer mostra as CCUs agregadas

Geografia de inferência

Para modelos Claude 4.6 e posteriores, usar inference_geo: "us" aplica um multiplicador de preço de 1,1x. inference_geo: "global" (padrão) usa os preços padrão. Consulte Residência de dados para detalhes.

Ofertas privadas

Quando você se inscreve na página do serviço Claude Platform on AWS no AWS Console, o AWS Console procura qualquer oferta privada associada à sua conta e solicita que você a aceite no AWS Marketplace. Entre em contato com seu representante de conta da Anthropic para obter os termos de ofertas privadas.

Preços do Claude in Microsoft Foundry

O Claude in Microsoft Foundry é faturado por meio do Azure Marketplace usando Claude Consumption Units (CCUs). A Anthropic calcula seu uso de tokens em USD com base nas tarifas padrão por modelo e por recurso, aplica qualquer desconto negociado, converte o resultado em CCUs a $0,01 por CCU e informa a quantidade de CCUs ao Azure Marketplace a cada hora. Sua fatura do Azure mostra um único item de linha de CCU.

ConceitoDetalhes
Unidade de faturamentoClaude Consumption Unit ()
Preço da CCU$0,01 por CCU (fixo; os descontos são aplicados na conversão de tokens para CCUs, não no preço da CCU)
ConversãoO uso de tokens é calculado em USD com base nas tarifas padrão por modelo e por recurso (as mesmas dos preços da Claude API) e depois convertido em CCUs a $0,01 por CCU
Cadência de faturamentoMedição horária para o Azure Marketplace; faturas mensais
Modelo de pagamentoSomente pós-pago; sem créditos pré-pagos
DescontosAplicados como menos CCUs medidas
ImpostosMedição antes dos impostos; o Azure Marketplace cuida dos impostos
Visibilidade de custosO Azure Cost Management mostra as CCUs agregadas

Geografia de inferência

Implantações hospedadas no Azure podem usar o tipo de implantação US Data Zone Standard, que mantém a inferência dentro dos Estados Unidos. Isso é equivalente a inference_geo: "us" na Claude API e aplica o mesmo multiplicador de preço de 1,1x. Consulte Residência de dados para detalhes.

Preços específicos por recurso

Cache de prompt

O "prompt caching" (cache de prompt) reduz custos e latência ao reutilizar partes previamente processadas do seu prompt entre chamadas de API. Em vez de reprocessar o mesmo prompt do sistema extenso, documento ou histórico de conversa em cada requisição, a API lê do cache por uma fração do preço padrão de entrada.

Há duas maneiras de habilitar o cache de prompt:

  • Cache automático: Adicione um único campo cache_control no nível superior da sua requisição. O sistema gerencia automaticamente os pontos de interrupção do cache à medida que as conversas crescem. Este é o ponto de partida recomendado para a maioria dos casos de uso.
  • Pontos de interrupção de cache explícitos: Coloque cache_control diretamente em blocos de conteúdo individuais para um controle refinado sobre exatamente o que é armazenado em cache.

O cache de prompt usa os seguintes multiplicadores de preço em relação às tarifas base de tokens de entrada:

Operação de cacheMultiplicadorDuração
Escrita em cache de 5 minutos1,25x o preço base de entradaCache válido por 5 minutos
Escrita em cache de 1 hora2x o preço base de entradaCache válido por 1 hora
Leitura de cache (acerto)0,1x o preço base de entrada (0,025x no Claude Fable 5.1 e no Claude Mythos 5.1; 0,05x no Claude Opus 5.5)Mesma duração da escrita anterior

Os tokens de escrita em cache são cobrados quando o conteúdo é armazenado pela primeira vez. Os tokens de leitura de cache são cobrados quando uma requisição subsequente recupera o conteúdo armazenado em cache. Um acerto de cache custa 10% do preço padrão de entrada, o que significa que o cache compensa após uma leitura de cache para a duração de 5 minutos (escrita de 1,25x), ou após duas leituras de cache para a duração de 1 hora (escrita de 2x). No Claude Fable 5.1 e no Claude Mythos 5.1, um acerto de cache custa 2,5% do preço padrão de entrada ($0,25 USD por milhão de tokens). No Claude Opus 5.5, um acerto de cache custa 5% do preço padrão de entrada ($0,20 USD por milhão de tokens).

Esses multiplicadores se acumulam com outros modificadores de preço, incluindo o desconto da Batch API e a residência de dados.

Para detalhes de implementação, modelos suportados e exemplos de código, consulte Cache de prompt.

Preços de residência de dados

Para modelos Claude 4.6 e posteriores, especificar inferência somente nos EUA por meio do parâmetro inference_geo incorre em um multiplicador de 1,1x em todas as categorias de preço de tokens, incluindo tokens de entrada, tokens de saída, escritas em cache e leituras de cache. O roteamento global (o padrão) usa os preços padrão.

Isso se aplica à Claude API (primária) e ao Claude Platform on AWS. No Claude in Microsoft Foundry, o mesmo multiplicador de 1,1x se aplica a implantações que usam o tipo de implantação US Data Zone Standard (consulte Geografia de inferência). Plataformas operadas por parceiros (Bedrock e Google Cloud) têm preços regionais independentes. Consulte Bedrock e Google Cloud para detalhes. Modelos anteriores não suportam o parâmetro inference_geo e sempre usam os preços padrão; requisições que incluem o parâmetro nesses modelos retornam um erro 400.

Para mais informações, consulte Residência de dados.

Preços do modo rápido

O modo rápido, em prévia de pesquisa, oferece saída significativamente mais rápida para Claude Opus 5.5, Claude Opus 5, e Claude Opus 4.8 a preços premium. Os preços do modo rápido se aplicam a toda a "context window" (janela de contexto), incluindo requisições com mais de 200 mil tokens de entrada. O modo rápido está disponível somente na Claude API (primária); ele não está disponível no Claude Platform on AWS nem em plataformas de nuvem operadas por parceiros.

ModeloEntradaSaída
Claude Opus 5.5$8 / MTok$40 / MTok
Claude Opus 5 / Claude Opus 4.8$10 / MTok$50 / MTok

O modo rápido não está disponível no Claude Opus 4.7 (requisições com speed: "fast" retornam um erro) nem no Claude Opus 4.6 (as requisições são executadas em velocidade padrão e cobradas com tarifas padrão). Consulte Modo rápido.

Os preços do modo rápido se acumulam com outros modificadores de preço:

O modo rápido não está disponível com a Batch API.

Para mais informações, consulte Modo rápido.

Processamento em lote

A Batch API permite o processamento assíncrono de grandes volumes de requisições com um desconto de 50% tanto em tokens de entrada quanto de saída.

ModelBatch tokens
NameInputOutput
Claude Fable 5.1For demanding reasoning and long-horizon agentic work
$5 /
$25 / MTok
Claude Opus 5.5For long-running agentic coding and knowledge work
$2 / MTok
$10 / MTok
Claude Sonnet 5.5The best combination of speed and intelligence
$1 / MTok
$5 / MTok
Claude Haiku 4.5The fastest model with near-frontier intelligence
$0.50 / MTok
$2.50 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$5 / MTok
$25 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
$2.50 / MTok
$12.50 / MTok
Claude Opus 4.1
$7.50 / MTok
$37.50 / MTok
Claude Opus 4
$7.50 / MTok
$37.50 / MTok
$1 / MTok
$5 / MTok
$1.50 / MTok
$7.50 / MTok
$1.50 / MTok
$7.50 / MTok
Claude Sonnet 4
$1.50 / MTok
$7.50 / MTok
Claude Haiku 3.5
$0.40 / MTok
$2 / MTok

Para mais informações sobre processamento em lote, consulte Processamento em lote.

Preços de contexto longo

Os modelos Claude 4.6 e posteriores e o Claude Mythos Preview incluem a janela de contexto de 1M de tokens completa a preços padrão. (Uma requisição de 900 mil tokens é cobrada com a mesma tarifa por token de uma requisição de 9 mil tokens.) Os descontos de cache de prompt e processamento em lote se aplicam com tarifas padrão em toda a janela de contexto.

Preços de uso de ferramentas

As solicitações de "tool use" (uso de ferramentas) são precificadas com base em:

  1. O número total de tokens de entrada enviados ao modelo (incluindo no parâmetro tools)
  2. O número de tokens de saída gerados
  3. Para ferramentas do lado do servidor, precificação adicional baseada no uso (por exemplo, a pesquisa na web cobra por pesquisa realizada)

As ferramentas do lado do cliente são precificadas da mesma forma que qualquer outra solicitação da Claude API, embora as ferramentas do lado do servidor possam incorrer em cobranças adicionais com base em seu uso específico.

Os tokens adicionais do uso de ferramentas vêm de:

  • O parâmetro tools nas solicitações de API (nomes, descrições e esquemas das ferramentas)
  • Blocos de conteúdo tool_use nas solicitações e respostas de API
  • Blocos de conteúdo tool_result nas solicitações de API

Quando você usa tools, a API também inclui automaticamente um "system prompt" (prompt do sistema) especial para o modelo que habilita o uso de ferramentas. O número de tokens de uso de ferramentas necessários para cada modelo está listado na tabela a seguir (excluindo os tokens adicionais listados anteriormente). Observe que a tabela pressupõe que pelo menos 1 ferramenta seja fornecida. Se nenhuma tools for fornecida, então uma escolha de ferramenta none usa 0 tokens adicionais de prompt do sistema.

ModelTool use system prompt tokens
NameToken count
Claude Opus 5.5For long-running agentic coding and knowledge work
auto, none
286 tokens
Claude Sonnet 5.5The best combination of speed and intelligence
auto, none
286 tokens
Claude Haiku 4.5The fastest model with near-frontier intelligence
auto, none
496 tokens
any, tool
588 tokens
auto, none
286 tokens
any, tool
406 tokens
auto, none
290 tokens
any, tool
410 tokens
auto, none
675 tokens
any, tool
804 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Opus 4.1
auto, none
313 tokens
any, tool
315 tokens
Claude Opus 4
auto, none
313 tokens
any, tool
315 tokens
auto, none
354 tokens
any, tool
474 tokens
auto, none
497 tokens
any, tool
589 tokens
auto, none
496 tokens
any, tool
588 tokens
Claude Sonnet 4
auto, none
313 tokens
any, tool
315 tokens
Claude Haiku 3.5
auto, none
264 tokens
any, tool
355 tokens

Essas contagens de tokens são adicionadas aos seus tokens normais de entrada e saída para calcular o custo total de uma solicitação.

Para os preços atuais por modelo, consulte a seção preços dos modelos.

Para mais informações sobre a implementação de uso de ferramentas e melhores práticas, consulte Uso de ferramentas.

Preços de ferramentas específicas

Ferramenta Bash

A definição da ferramenta bash adiciona os seguintes tokens de entrada à sua requisição. Isso é adicional ao prompt do sistema de uso de ferramentas por modelo, que se aplica sempre que qualquer ferramenta está presente.

ModeloTokens de entrada adicionais
Claude Opus 5, Claude Opus 4.8 e Claude Opus 4.7325 tokens
Claude Opus 4.6, Claude Sonnet 4.6 e anteriores244 tokens

Tokens adicionais são consumidos por:

  • Saídas de comandos (stdout/stderr)
  • Mensagens de erro
  • Conteúdos de arquivos grandes

Consulte preços de uso de ferramentas para detalhes completos de preços.

Ferramenta de execução de código

A execução de código é gratuita quando usada com web search ou web fetch. Quando web_search_20260209 (ou posterior) ou web_fetch_20260209 (ou posterior) está incluído na sua requisição de API, não há cobranças adicionais por chamadas da ferramenta de execução de código além dos custos padrão de tokens de entrada e saída.

Quando usada sem essas ferramentas, a execução de código é cobrada por tempo de execução, rastreado separadamente do uso de tokens:

  • O tempo de execução tem um mínimo de 5 minutos
  • Cada organização recebe 1.550 horas gratuitas de uso por mês
  • O uso adicional além de 1.550 horas é cobrado a $0,05 USD por hora, por contêiner
  • Se arquivos forem incluídos na requisição, o tempo de execução é cobrado mesmo que a ferramenta não seja chamada, porque os arquivos são pré-carregados no contêiner

O uso da execução de código é rastreado na resposta:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 239,
    "server_tool_use": {
      "code_execution_requests": 1
    }
  }
}

Ferramenta de editor de texto

A ferramenta de editor de texto usa a mesma estrutura de preços que outras ferramentas usadas com o Claude. Ela segue os preços padrão de tokens de entrada e saída com base no modelo Claude que você está usando.

Além dos tokens base, os seguintes tokens de entrada adicionais são necessários para a ferramenta de editor de texto:

FerramentaTokens de entrada adicionais
text_editor_20250429 (Claude 4.x)700 tokens

Consulte preços de uso de ferramentas para detalhes completos de preços.

Ferramenta de pesquisa na web

O uso da pesquisa na web é cobrado além do uso de tokens:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 6039,
    "cache_read_input_tokens": 7123,
    "cache_creation_input_tokens": 7345,
    "server_tool_use": {
      "web_search_requests": 1
    }
  }
}

A pesquisa na web está disponível na Claude API por $10 por 1.000 pesquisas, mais os custos padrão de tokens para o conteúdo gerado pela pesquisa. Os resultados de pesquisa na web recuperados ao longo de uma conversa são contados como tokens de entrada, tanto nas iterações de pesquisa executadas durante um único turno quanto nos turnos subsequentes da conversa.

Cada pesquisa na web conta como um uso, independentemente do número de resultados retornados. Se ocorrer um erro durante a pesquisa na web, a pesquisa na web não será cobrada.

Ferramenta de busca na web (web fetch)

O uso do web fetch não tem cobranças adicionais além dos custos padrão de tokens:

{
  "usage": {
    "input_tokens": 25039,
    "output_tokens": 931,
    "cache_read_input_tokens": 0,
    "cache_creation_input_tokens": 0,
    "server_tool_use": {
      "web_fetch_requests": 1
    }
  }
}

A ferramenta web fetch está disponível na Claude API sem custo adicional. Você paga apenas os custos padrão de tokens pelo conteúdo buscado que se torna parte do contexto da sua conversa.

Para se proteger contra a busca inadvertida de conteúdo grande que consumiria tokens em excesso, use o parâmetro max_content_tokens para definir limites apropriados com base no seu caso de uso e em considerações de orçamento.

Exemplo de uso de tokens para conteúdo típico:

  • Página web média (10 kB): ~2.500 tokens
  • Página de documentação grande (100 kB): ~25.000 tokens
  • PDF de artigo de pesquisa (500 kB): ~125.000 tokens

Ferramenta de uso de computador

O uso do computador segue os preços padrão de uso de ferramentas. Ao usar a ferramenta de uso do computador:

Sobrecarga da definição do toolset: Declarar computer_toolset_20260801 com seus membros padrão adiciona cerca de 4.500 tokens de entrada a uma requisição (cerca de 4.520 no Claude Fable 5, Claude Mythos 5, Claude Opus 5 e Claude Opus 4.8, e cerca de 4.590 no Claude Sonnet 5), o que cobre as definições das ferramentas membros e o prompt do sistema de uso de ferramentas. Desabilitar zoom com configs remove cerca de 410 desses tokens. A contagem exata para uma requisição é informada no usage da resposta, e você pode estimá-la antecipadamente com o endpoint de contagem de tokens.

Versões anteriores da ferramenta: Os valores a seguir se aplicam às versões de ferramenta computer_20251124 e computer_20250124, não à computer_toolset_20260801:

  • Sobrecarga do prompt do sistema: 466–499 tokens adicionados ao prompt do sistema
  • Definição da ferramenta: cerca de 735 tokens de entrada por definição de ferramenta (medido com computer_20250124)

Consumo adicional de tokens:

  • Imagens de captura de tela e de zoom retornadas nos resultados das ferramentas, cobradas como entrada de imagem (consulte Preços de visão)
  • Resultados da execução de ferramentas retornados ao Claude

Ferramenta de uso de navegador

O uso do navegador segue os preços padrão de uso de ferramentas. Ao usar a ferramenta de uso do navegador:

Sobrecarga da definição do conjunto de ferramentas: Declarar browser_toolset_20260801 com seus membros padrão adiciona cerca de 6.600 tokens de entrada a uma requisição (cerca de 6.610 no Claude Fable 5, Claude Mythos 5, Claude Opus 5 e Claude Opus 4.8, e cerca de 6.670 no Claude Sonnet 5), o que cobre as definições das ferramentas membros e o prompt do sistema de uso de ferramentas. Habilitar todos os quatro membros opcionais adiciona cerca de 880 tokens, e desabilitar membros com configs reduz a contagem. A contagem exata para uma requisição é informada no usage da resposta, e você pode estimá-la antecipadamente com o endpoint de contagem de tokens.

Consumo adicional de tokens:

  • Imagens de capturas de tela e de zoom retornadas nos resultados de ferramentas, cobradas como entrada de imagem (consulte Preços de visão)
  • Resultados de ferramentas em texto retornados ao Claude, como árvores de acessibilidade, texto da página e entradas de console ou de rede

Preços do Claude Managed Agents

O Claude Managed Agents é cobrado em duas dimensões: tokens e tempo de execução da sessão.

Tokens

Todos os tokens consumidos por uma sessão do Claude Managed Agents são cobrados com as tarifas mostradas em Preços dos modelos. Os multiplicadores de cache de prompt se aplicam de forma idêntica. A pesquisa na web acionada dentro de uma sessão incorre no valor padrão de $10 por 1.000 pesquisas. No Claude Platform on AWS, as cobranças de tokens e de tempo de execução da sessão são convertidas em Claude Consumption Units à taxa padrão. Os preços premium do modo rápido se aplicam quando o model.speed de um agente está definido como "fast".

O multiplicador de residência de dados também se aplica: quando o model.inference_geo de um agente está fixado em "us", os tokens consumidos pelas sessões que executam esse agente são cobrados a 1,1x as tarifas padrão, o mesmo multiplicador que se aplica à inferência somente nos EUA na Messages API.

Os seguintes modificadores da Messages API não se aplicam às sessões do Claude Managed Agents:

ModificadorPor que não se aplica
Desconto da Batch APIAs sessões são com estado e interativas. Não há modo em lote.
Preços em plataformas de nuvemNão disponível em plataformas de nuvem operadas por parceiros.

Tempo de execução da sessão

SKUTarifaMedição
Tempo de execução da sessão$0,08 por hora de sessãoDuração do status running

O tempo de execução é medido em milissegundos e acumula apenas enquanto o status da sessão é running. O tempo gasto em idle (aguardando sua próxima mensagem ou uma confirmação de ferramenta), rescheduling ou terminated não conta para o tempo de execução.

Exemplo prático

Uma sessão de codificação de uma hora usando o Claude Opus 5 que consome 50.000 tokens de entrada e 15.000 tokens de saída:

Item de linhaCálculoCusto
Tokens de entrada50.000 × $5 / 1.000.000$0,25
Tokens de saída15.000 × $25 / 1.000.000$0,375
Tempo de execução da sessão1,0 hora × $0,08$0,08
Total$0,705

Se o cache de prompt estiver ativo e 40.000 dos tokens de entrada forem leituras de cache:

Item de linhaCálculoCusto
Tokens de entrada sem cache10.000 × $5 / 1.000.000$0,05
Tokens de leitura de cache40.000 × $5 × 0,1 / 1.000.000$0,02
Tokens de saída15.000 × $25 / 1.000.000$0,375
Tempo de execução da sessão1,0 hora × $0,08$0,08
Total$0,525

Para um passo a passo detalhado desse cálculo, consulte o guia do agente de suporte ao cliente.

Considerações adicionais sobre preços

Estratégias de otimização de custos

Ao criar agentes com o Claude:

  1. Use modelos apropriados: Escolha o Haiku para tarefas simples, o Sonnet para a maioria das cargas de trabalho de produção e o Opus para o raciocínio mais complexo
  2. Implemente o cache de prompt: Reduza custos para contexto repetido
  3. Operações em lote: Use a Batch API para tarefas que não são sensíveis ao tempo
  4. Monitore padrões de uso: Acompanhe o consumo de tokens para identificar oportunidades de otimização

Limites de taxa

Os "rate limits" (limites de taxa) variam de acordo com o nível de uso e afetam quantas requisições você pode fazer:

  • Nível Start: Limites de entrada para começar
  • Nível Build: Limites aumentados para aplicações em crescimento
  • Nível Scale: Os limites padrão mais altos para cargas de trabalho de produção

Para informações detalhadas sobre limites de taxa, consulte Limites de taxa.

Para limites além do nível Scale ou acordos de preços personalizados, entre em contato com a equipe de vendas.

Descontos por volume

Descontos por volume podem estar disponíveis para usuários de alto volume. Eles são negociados caso a caso.

Preços Enterprise

Para clientes Enterprise com necessidades específicas:

  • Limites de taxa personalizados
  • Descontos por volume
  • Suporte dedicado
  • Termos personalizados

Entre em contato com a equipe de vendas em sales@anthropic.com ou por meio do Claude Console para discutir opções de preços Enterprise.

Faturamento e pagamento

  • O faturamento é baseado no uso mensal real
  • Todos os pagamentos são em USD
  • Opções de cartão de crédito e faturamento disponíveis
  • Acompanhamento de uso disponível no Claude Console

Perguntas frequentes

Como o uso de tokens é calculado?

Tokens são pedaços de texto que os modelos processam. Como estimativa aproximada, 1 token equivale a aproximadamente 4 caracteres ou 0,75 palavras em inglês. A contagem exata varia de acordo com o idioma e o tipo de conteúdo.

Existem níveis gratuitos ou períodos de teste?

Novos usuários recebem uma pequena quantidade de créditos gratuitos para testar a API. Entre em contato com vendas para informações sobre períodos de teste estendidos para avaliação corporativa.

Como os descontos se acumulam?

Os descontos da Batch API e do cache de prompt podem ser combinados. Por exemplo, usar os dois recursos juntos proporciona economias de custo significativas em comparação com chamadas de API padrão. Consulte preços do cache de prompt para saber como os multiplicadores interagem.

Quais métodos de pagamento são aceitos?

Os principais cartões de crédito são aceitos para contas padrão. Clientes Enterprise podem combinar faturamento e outros métodos de pagamento.

Para perguntas adicionais sobre preços, entre em contato com support@anthropic.com.

Was this page helpful?