Esta página fornece informações detalhadas de preços para os modelos e recursos da Anthropic. Todos os preços estão em USD.
Para as informações de preços mais atualizadas, visite claude.com/pricing.
A tabela a seguir mostra os preços de todos os modelos Claude:
| Modelo | Tokens de Entrada Base | Gravações de Cache de 5m | Gravações de Cache de 1h | Acertos e Atualizações de Cache | Tokens de Saída |
|---|---|---|---|---|---|
| Claude Fable 5 | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Mythos 5 (disponibilidade limitada) | $10 / MTok | $12.50 / MTok | $20 / MTok | $1 / MTok | $50 / MTok |
| Claude Opus 4.8 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.7 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.6 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.5 | $5 / MTok | $6.25 / MTok | $10 / MTok | $0.50 / MTok | $25 / MTok |
| Claude Opus 4.1 (descontinuado) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Opus 4 (retirado, exceto no Google Cloud) | $15 / MTok | $18.75 / MTok | $30 / MTok | $1.50 / MTok | $75 / MTok |
| Claude Sonnet 5 até 31 de agosto de 2026 | $2 / MTok | $2.50 / MTok | $4 / MTok | $0.20 / MTok | $10 / MTok |
| Claude Sonnet 5 a partir de 1º de setembro de 2026 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4.6 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4.5 | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Sonnet 4 (retirado, exceto no Bedrock e Google Cloud) | $3 / MTok | $3.75 / MTok | $6 / MTok | $0.30 / MTok | $15 / MTok |
| Claude Haiku 4.5 | $1 / MTok | $1.25 / MTok | $2 / MTok | $0.10 / MTok | $5 / MTok |
| Claude Haiku 3.5 (retirado, exceto no Bedrock e Google Cloud) | $0.80 / MTok | $1 / MTok | $1.60 / MTok | $0.08 / MTok | $4 / MTok |
O preço introdutório de $2/$10 por milhão de tokens de entrada/saída está em vigor até 31 de agosto de 2026, após o qual o preço padrão de $3/$15 por milhão de tokens de entrada/saída entrará em vigor.
MTok = Milhão de tokens. A coluna "Base Input Tokens" mostra o preço padrão de entrada, as colunas "5m Cache Writes", "1h Cache Writes" e "Cache Hits & Refreshes" são específicas do cache de prompt, e "Output Tokens" mostra o preço de saída. Consulte preços de cache de prompt para uma explicação das colunas de cache e dos multiplicadores de preço.
Claude Opus 4.7 e modelos Opus posteriores, Claude Fable 5, Claude Mythos 5, Claude Mythos Preview e Claude Sonnet 5 usam um tokenizador mais novo que contribui para seu desempenho aprimorado em uma ampla gama de tarefas. Esse tokenizador produz aproximadamente 30% mais tokens para o mesmo texto. O aumento exato depende do conteúdo e do formato da carga de trabalho. Claude Sonnet 4.6 e modelos anteriores usam o tokenizador anterior.
Para preços do Claude Platform on AWS, consulte Preços do Claude Platform on AWS.
Esta seção cobre plataformas de nuvem operadas por parceiros, nas quais o provedor de nuvem fatura você. Para plataformas de nuvem operadas pela Anthropic faturadas por meio de um marketplace, consulte Preços do Claude Platform on AWS e Preços do Claude in Microsoft Foundry.
Os modelos Claude estão disponíveis no Amazon Bedrock e no Google Cloud. Para preços oficiais, visite:
Preços de endpoints regionais e multirregionais para modelos Claude 4.5 e posteriores
A partir do Claude Sonnet 4.5, Haiku 4.5 e Opus 4.5:
Endpoints regionais e multirregionais incluem um adicional de 10% em relação aos endpoints globais. A Claude API (primeira parte) é global por padrão; para opções e preços de residência de dados de primeira parte, consulte Preços de residência de dados.
Escopo: Esta estrutura de preços se aplica ao Claude Sonnet 4.5, Haiku 4.5, Opus 4.5 e todos os modelos futuros. Modelos anteriores (Claude Opus 4.1 (descontinuado) e versões anteriores) mantêm seus preços existentes.
Para detalhes de implementação e exemplos de código:
O Claude Platform on AWS fatura por meio do AWS Marketplace usando Claude Consumption Units (CCUs). A Anthropic calcula seu uso de tokens em USD nas tarifas padrão por modelo e por recurso, aplica qualquer desconto negociado, converte o resultado em CCUs a $0,01 por CCU e reporta a quantidade de CCUs ao AWS Marketplace a cada hora. Sua fatura da AWS mostra um único item de linha de CCU.
| Conceito | Detalhes |
|---|---|
| Unidade de faturamento | Claude Consumption Unit (CCU) |
| Preço da CCU | $0,01 por CCU (fixo; descontos se aplicam na conversão de token para CCU, não ao preço da CCU) |
| Conversão | Uso de tokens calculado em USD nas tarifas padrão por modelo e por recurso (as mesmas dos preços da Claude API), depois convertido em CCUs a $0,01 por CCU |
| Cadência de faturamento | Medição horária para o AWS Marketplace; faturas mensais |
| Modelo de pagamento | Apenas pós-pago; sem créditos pré-pagos |
| Descontos | Aplicados como menos CCUs medidas |
| Impostos | Medição antes de impostos; o AWS Marketplace lida com impostos |
| Visibilidade de custos | Detalhamento em tempo real no Claude Console (acesso pelo AWS Console); o AWS Cost Explorer mostra CCUs agregadas |
Claude Consumption Units. Se o Cliente acessar os Serviços por meio de determinadas Plataformas de Marketplace (por exemplo, Claude Platform on AWS), o uso será faturado em Claude Consumption Units ("CCU") em vez de por MTok. Uma CCU é uma unidade de medida usada exclusivamente para faturamento em Plataformas de Marketplace. Cem (100) CCUs representam $1,00 USD de taxas devidas pelos Serviços, calculadas nos preços aplicáveis em claude.com/pricing#api, após a aplicação de quaisquer descontos.
Para Claude Opus 4.6, Claude Sonnet 4.6 e modelos posteriores, usar inference_geo: "us" aplica um multiplicador de preço de 1,1x. inference_geo: "global" (padrão) usa o preço padrão. Consulte Residência de dados para detalhes.
Quando você se inscreve na página do serviço Claude Platform on AWS no AWS Console, o AWS Console procura qualquer oferta privada associada à sua conta e solicita que você a aceite no AWS Marketplace. Entre em contato com seu representante de conta da Anthropic para obter os termos de ofertas privadas.
Se você tiver uma oferta privada existente do Amazon Bedrock, entre em contato com seu representante de conta da Anthropic ou da AWS antes de começar a usar o Claude Platform on AWS para garantir que seus descontos sejam aplicados corretamente. Descontos não podem ser aplicados retroativamente ao uso incorrido antes da aceitação da sua oferta privada.
O Claude in Microsoft Foundry fatura por meio do Azure Marketplace usando Claude Consumption Units (CCUs). A Anthropic calcula seu uso de tokens em USD nas tarifas padrão por modelo e por recurso, aplica qualquer desconto negociado, converte o resultado em CCUs a $0,01 por CCU e reporta a quantidade de CCUs ao Azure Marketplace a cada hora. Sua fatura do Azure mostra um único item de linha de CCU.
| Conceito | Detalhes |
|---|---|
| Unidade de faturamento | Claude Consumption Unit (CCU) |
| Preço da CCU | $0,01 por CCU (fixo; descontos se aplicam na conversão de token para CCU, não ao preço da CCU) |
| Conversão | Uso de tokens calculado em USD nas tarifas padrão por modelo e por recurso (as mesmas dos preços da Claude API), depois convertido em CCUs a $0,01 por CCU |
| Cadência de faturamento | Medição horária para o Azure Marketplace; faturas mensais |
| Modelo de pagamento | Apenas pós-pago; sem créditos pré-pagos |
| Descontos | Aplicados como menos CCUs medidas |
| Impostos | Medição antes de impostos; o Azure Marketplace lida com impostos |
| Visibilidade de custos | O Azure Cost Management mostra CCUs agregadas |
Claude Consumption Units. Se o Cliente acessar os Serviços por meio de determinadas Plataformas de Marketplace (por exemplo, Claude Platform on AWS, Claude in Microsoft Foundry), o uso será faturado em Claude Consumption Units ("CCU") em vez de por MTok. Uma CCU é uma unidade de medida usada exclusivamente para faturamento em Plataformas de Marketplace. Cem (100) CCUs representam $1,00 USD de taxas devidas pelos Serviços, calculadas nos preços aplicáveis em claude.com/pricing#api, após a aplicação de quaisquer descontos.
Implantações hospedadas no Azure podem usar o tipo de implantação US Data Zone Standard, que mantém a inferência dentro dos Estados Unidos. Isso é equivalente a inference_geo: "us" na Claude API e aplica o mesmo multiplicador de preço de 1,1x. Consulte Residência de dados para detalhes.
O "prompt caching" (cache de prompt) reduz custos e latência ao reutilizar partes previamente processadas do seu prompt entre chamadas de API. Em vez de reprocessar o mesmo prompt do sistema extenso, documento ou histórico de conversa em cada solicitação, a API lê do cache a uma fração do preço padrão de entrada.
Há duas maneiras de habilitar o cache de prompt:
cache_control no nível superior da sua solicitação. O sistema gerencia automaticamente os pontos de interrupção do cache conforme as conversas crescem. Este é o ponto de partida recomendado para a maioria dos casos de uso.cache_control diretamente em blocos de conteúdo individuais para controle refinado sobre exatamente o que é armazenado em cache.O cache de prompt usa os seguintes multiplicadores de preço em relação às tarifas base de tokens de entrada:
| Operação de cache | Multiplicador | Duração |
|---|---|---|
| Gravação de cache de 5 minutos | 1,25x o preço base de entrada | Cache válido por 5 minutos |
| Gravação de cache de 1 hora | 2x o preço base de entrada | Cache válido por 1 hora |
| Leitura de cache (acerto) | 0,1x o preço base de entrada | Mesma duração da gravação anterior |
Tokens de gravação de cache são cobrados quando o conteúdo é armazenado pela primeira vez. Tokens de leitura de cache são cobrados quando uma solicitação subsequente recupera o conteúdo em cache. Um acerto de cache custa 10% do preço padrão de entrada, o que significa que o cache se paga após apenas uma leitura de cache para a duração de 5 minutos (gravação de 1,25x), ou após duas leituras de cache para a duração de 1 hora (gravação de 2x).
Esses multiplicadores se acumulam com outros modificadores de preço, incluindo o desconto da Batch API e a residência de dados.
Para detalhes de implementação, modelos suportados e exemplos de código, consulte Cache de prompt.
Para Claude Opus 4.6, Claude Sonnet 4.6 e modelos posteriores, especificar inferência apenas nos EUA por meio do parâmetro inference_geo incorre em um multiplicador de 1,1x em todas as categorias de preço de tokens, incluindo tokens de entrada, tokens de saída, gravações de cache e leituras de cache. O roteamento global (o padrão) usa o preço padrão.
Isso se aplica à Claude API (primeira parte) e ao Claude Platform on AWS. No Claude in Microsoft Foundry, o mesmo multiplicador de 1,1x se aplica a implantações que usam o tipo de implantação US Data Zone Standard (consulte Geografia de inferência). Plataformas operadas por parceiros (Bedrock e Google Cloud) têm preços regionais independentes. Consulte Bedrock e Google Cloud para detalhes. Modelos anteriores não suportam o parâmetro inference_geo e sempre usam o preço padrão; solicitações que incluem o parâmetro nesses modelos retornam um erro 400.
Para mais informações, consulte Residência de dados.
O modo rápido, em prévia de pesquisa, fornece saída significativamente mais rápida para Claude Opus 4.8 e Claude Opus 4.7 com preço premium. O preço do modo rápido se aplica a toda a janela de contexto, incluindo solicitações com mais de 200k tokens de entrada. O modo rápido não está disponível no Claude Platform on AWS.
| Modelo | Entrada | Saída |
|---|---|---|
| Claude Opus 4.8 | $10 / MTok | $50 / MTok |
| Claude Opus 4.7 | $30 / MTok | $150 / MTok |
O modo rápido para Claude Opus 4.7 está descontinuado e será removido em 24 de julho de 2026. A partir de 29 de junho de 2026, o modo rápido não está disponível no Claude Opus 4.6: solicitações para claude-opus-4-6 com speed: "fast" são executadas em velocidade padrão e cobradas nas tarifas padrão. Consulte Modo rápido.
O preço do modo rápido se acumula com outros modificadores de preço:
O modo rápido não está disponível com a Batch API.
Para mais informações, consulte Modo rápido.
A Batch API permite o processamento assíncrono de grandes volumes de solicitações com um desconto de 50% em tokens de entrada e de saída.
| Modelo | Entrada em lote | Saída em lote |
|---|---|---|
| Claude Fable 5 | $5 / MTok | $25 / MTok |
| Claude Mythos 5 (disponibilidade limitada) | $5 / MTok | $25 / MTok |
| Claude Opus 4.8 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.7 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.6 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.5 | $2.50 / MTok | $12.50 / MTok |
| Claude Opus 4.1 (descontinuado) | $7.50 / MTok | $37.50 / MTok |
| Claude Opus 4 (retirado, exceto no Google Cloud) | $7.50 / MTok | $37.50 / MTok |
| Claude Sonnet 5 até 31 de agosto de 2026 | $1 / MTok | $5 / MTok |
| Claude Sonnet 5 a partir de 1º de setembro de 2026 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4.6 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4.5 | $1.50 / MTok | $7.50 / MTok |
| Claude Sonnet 4 (retirado, exceto no Bedrock e Google Cloud) | $1.50 / MTok | $7.50 / MTok |
| Claude Haiku 4.5 | $0.50 / MTok | $2.50 / MTok |
| Claude Haiku 3.5 (retirado, exceto no Bedrock e Google Cloud) | $0.40 / MTok | $2 / MTok |
Para mais informações sobre processamento em lote, consulte Processamento em lote.
Claude Fable 5, Claude Mythos 5, Claude Mythos Preview, Claude Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5 e Sonnet 4.6 incluem a janela de contexto de 1M de tokens completa com preço padrão. (Uma solicitação de 900k tokens é cobrada na mesma tarifa por token que uma solicitação de 9k tokens.) Os descontos de cache de prompt e processamento em lote se aplicam nas tarifas padrão em toda a janela de contexto.
As requisições de uso de ferramentas são precificadas com base em:
tools)Ferramentas do lado do cliente são precificadas da mesma forma que qualquer outra requisição à API do Claude, enquanto ferramentas do lado do servidor podem incorrer em cobranças adicionais com base em seu uso específico.
Os tokens adicionais do uso de ferramentas vêm de:
tools nas requisições de API (nomes, descrições e esquemas de ferramentas)tool_use em requisições e respostas de APItool_result em requisições de APIQuando você usa tools, a API também inclui automaticamente um prompt do sistema especial para o modelo que habilita o uso de ferramentas. O número de tokens de uso de ferramentas necessários para cada modelo está listado abaixo (excluindo os tokens adicionais listados acima). Observe que a tabela pressupõe que pelo menos 1 ferramenta seja fornecida. Se nenhuma tools for fornecida, então uma escolha de ferramenta none usa 0 tokens adicionais de prompt do sistema.
| Modelo | Escolha de ferramenta | Contagem de tokens do prompt do sistema de uso de ferramentas |
|---|---|---|
| Claude Opus 4.8 | auto, noneany, tool | 290 tokens 410 tokens |
| Claude Opus 4.7 | auto, noneany, tool | 675 tokens 804 tokens |
| Claude Opus 4.6 | auto, noneany, tool | 497 tokens 589 tokens |
| Claude Opus 4.5 | auto, noneany, tool | 496 tokens 588 tokens |
| Claude Opus 4.1 (descontinuado) | auto, noneany, tool | 313 tokens 315 tokens |
| Claude Opus 4 (desativado, exceto no Google Cloud) | auto, noneany, tool | 313 tokens 315 tokens |
| Claude Sonnet 5 | auto, noneany, tool | 354 tokens 474 tokens |
| Claude Sonnet 4.6 | auto, noneany, tool | 497 tokens 589 tokens |
| Claude Sonnet 4.5 | auto, noneany, tool | 496 tokens 588 tokens |
| Claude Sonnet 4 (desativado, exceto no Bedrock e Google Cloud) | auto, noneany, tool | 313 tokens 315 tokens |
| Claude Haiku 4.5 | auto, noneany, tool | 496 tokens 588 tokens |
| Claude Haiku 3.5 (desativado, exceto no Bedrock e Google Cloud) | auto, noneany, tool | 264 tokens 355 tokens |
Essas contagens de tokens são adicionadas aos seus tokens normais de entrada e saída para calcular o custo total de uma requisição.
Para os preços atuais por modelo, consulte a seção de preços dos modelos.
Para mais informações sobre implementação de uso de ferramentas e melhores práticas, consulte Uso de ferramentas.
A definição da ferramenta bash adiciona os seguintes tokens de entrada à sua solicitação. Isso é adicional ao prompt do sistema de uso de ferramentas por modelo que se aplica sempre que qualquer ferramenta está presente.
| Modelo | Tokens de entrada adicionais |
|---|---|
| Claude Opus 4.7 e Claude Opus 4.8 | 325 tokens |
| Claude Opus 4.6, Claude Sonnet 4.6 e anteriores | 244 tokens |
Tokens adicionais são consumidos por:
Consulte preços de uso de ferramentas para detalhes completos de preços.
A execução de código é gratuita quando usada com busca na web ou web fetch. Quando web_search_20260209 (ou posterior) ou web_fetch_20260209 (ou posterior) está incluído na sua solicitação de API, não há cobranças adicionais para chamadas da ferramenta de execução de código além dos custos padrão de tokens de entrada e saída.
Quando usada sem essas ferramentas, a execução de código é cobrada por tempo de execução, rastreado separadamente do uso de tokens:
O uso da execução de código é rastreado na resposta:
{
"usage": {
"input_tokens": 105,
"output_tokens": 239,
"server_tool_use": {
"code_execution_requests": 1
}
}
}A ferramenta de editor de texto usa a mesma estrutura de preços que outras ferramentas usadas com o Claude. Ela segue a precificação padrão de tokens de entrada e saída com base no modelo do Claude que você está usando.
Além dos tokens base, os seguintes tokens de entrada adicionais são necessários para a ferramenta de editor de texto:
| Ferramenta | Tokens de entrada adicionais |
|---|---|
text_editor_20250429 (Claude 4.x) | 700 tokens |
Consulte preços de uso de ferramentas para detalhes completos de preços.
O uso da pesquisa na web é cobrado além do uso de tokens:
{
"usage": {
"input_tokens": 105,
"output_tokens": 6039,
"cache_read_input_tokens": 7123,
"cache_creation_input_tokens": 7345,
"server_tool_use": {
"web_search_requests": 1
}
}
}A pesquisa na web está disponível na API do Claude por US$ 10 por 1.000 pesquisas, além dos custos padrão de tokens para conteúdo gerado por pesquisa. Os resultados de pesquisa na web recuperados ao longo de uma conversa são contados como tokens de entrada, tanto nas iterações de pesquisa executadas durante um único turno quanto nos turnos subsequentes da conversa.
Cada pesquisa na web conta como um uso, independentemente do número de resultados retornados. Se ocorrer um erro durante a pesquisa na web, ela não será cobrada.
O uso do web fetch não tem cobranças adicionais além dos custos padrão de tokens:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}A ferramenta web fetch está disponível na API do Claude sem custo adicional. Você paga apenas os custos padrão de tokens pelo conteúdo buscado que se torna parte do contexto da sua conversa.
Para se proteger contra a busca inadvertida de conteúdo grande que consumiria tokens excessivos, use o parâmetro max_content_tokens para definir limites apropriados com base no seu caso de uso e considerações de orçamento.
Exemplo de uso de tokens para conteúdo típico:
O uso do computador segue a precificação padrão de uso de ferramentas. Ao usar a ferramenta de uso do computador:
Sobrecarga do prompt do sistema: O beta de uso do computador adiciona de 466 a 499 tokens ao prompt do sistema
Uso de tokens da ferramenta de uso do computador:
| Modelo | Tokens de entrada por definição de ferramenta |
|---|---|
| Modelos Claude 4.x | 735 tokens |
Consumo adicional de tokens:
Se você também estiver usando as ferramentas bash ou editor de texto junto com o uso do computador, essas ferramentas têm seus próprios custos de tokens, conforme documentado em suas respectivas páginas.
O Claude Managed Agents é cobrado em duas dimensões: tokens e tempo de execução da sessão.
Todos os tokens consumidos por uma sessão do Claude Managed Agents são cobrados nas tarifas mostradas em Preços dos modelos. Os multiplicadores de cache de prompt se aplicam de forma idêntica. A pesquisa na web acionada dentro de uma sessão incorre no padrão de $10 por 1.000 pesquisas. No Claude Platform on AWS, as cobranças de tokens e tempo de execução da sessão são convertidas em Claude Consumption Units na tarifa padrão.
Os seguintes modificadores da Messages API não se aplicam a sessões do Claude Managed Agents:
| Modificador | Por que não se aplica |
|---|---|
| Desconto da Batch API | As sessões são com estado e interativas. Não há modo em lote. |
| Premium do modo rápido | A velocidade de inferência é gerenciada pelo runtime. |
| Multiplicador de residência de dados | inference_geo é um campo de solicitação da Messages API. |
| Preços de plataformas de nuvem | Não disponível em plataformas de nuvem operadas por parceiros. |
| SKU | Tarifa | Medição |
|---|---|---|
| Tempo de execução da sessão | $0,08 por hora de sessão | Duração do status running |
O tempo de execução é medido em milissegundos e acumula apenas enquanto o status da sessão é running. O tempo gasto em idle (aguardando sua próxima mensagem ou uma confirmação de ferramenta), rescheduling ou terminated não conta para o tempo de execução.
O tempo de execução da sessão substitui o modelo de cobrança por hora de contêiner da Execução de Código ao usar o Claude Managed Agents. Você não é cobrado separadamente por horas de contêiner além do tempo de execução da sessão.
Uma sessão de codificação de uma hora usando Claude Opus 4.8 que consome 50.000 tokens de entrada e 15.000 tokens de saída:
| Item de linha | Cálculo | Custo |
|---|---|---|
| Tokens de entrada | 50.000 × $5 / 1.000.000 | $0,25 |
| Tokens de saída | 15.000 × $25 / 1.000.000 | $0,375 |
| Tempo de execução da sessão | 1,0 hora × $0,08 | $0,08 |
| Total | $0,705 |
Se o cache de prompt estiver ativo e 40.000 dos tokens de entrada forem leituras de cache:
| Item de linha | Cálculo | Custo |
|---|---|---|
| Tokens de entrada não armazenados em cache | 10.000 × $5 / 1.000.000 | $0,05 |
| Tokens de leitura de cache | 40.000 × $5 × 0,1 / 1.000.000 | $0,02 |
| Tokens de saída | 15.000 × $25 / 1.000.000 | $0,375 |
| Tempo de execução da sessão | 1,0 hora × $0,08 | $0,08 |
| Total | $0,525 |
Exemplo de cálculo para processar 10.000 tickets de suporte:
Para um passo a passo detalhado desse cálculo, consulte o guia de agente de suporte ao cliente.
Ao construir agentes com Claude:
Para aplicações de agentes de alto volume, entre em contato com a equipe de vendas corporativas para acordos de preços personalizados.
Os "rate limits" (limites de taxa) variam por nível de uso e afetam quantas solicitações você pode fazer:
Para informações detalhadas sobre limites de taxa, consulte Limites de taxa.
Para limites além do nível Scale ou acordos de preços personalizados, entre em contato com a equipe de vendas.
Descontos por volume podem estar disponíveis para usuários de alto volume. Eles são negociados caso a caso.
Para clientes corporativos com necessidades específicas:
Entre em contato com a equipe de vendas em [email protected] ou por meio do Claude Console para discutir opções de preços corporativos.
Como o uso de tokens é calculado?
Tokens são pedaços de texto que os modelos processam. Como estimativa aproximada, 1 token equivale a aproximadamente 4 caracteres ou 0,75 palavras em inglês. A contagem exata varia por idioma e tipo de conteúdo.
Existem níveis gratuitos ou testes?
Novos usuários recebem uma pequena quantidade de créditos gratuitos para testar a API. Entre em contato com vendas para informações sobre testes estendidos para avaliação corporativa.
Como os descontos se acumulam?
Os descontos da Batch API e do cache de prompt podem ser combinados. Por exemplo, usar os dois recursos juntos proporciona economias de custo significativas em comparação com chamadas de API padrão. Consulte preços de cache de prompt para saber como os multiplicadores interagem.
Quais métodos de pagamento são aceitos?
Os principais cartões de crédito são aceitos para contas padrão. Clientes corporativos podem organizar faturamento e outros métodos de pagamento.
Para perguntas adicionais sobre preços, entre em contato com [email protected].
Was this page helpful?