A Compliance API agora retorna transcrições de sessões do Cowork e do Claude Code executadas nas máquinas dos seus usuários, em beta para organizações Claude Enterprise. GET /v1/compliance/apps/sessions/local lista sessões em toda a sua organização, GET /v1/compliance/apps/sessions/local/{session_id} recupera os metadados de uma sessão, e GET /v1/compliance/apps/sessions/local/{session_id}/messages retorna sua transcrição, tudo com sua Compliance Access Key existente e o escopo read:compliance_user_data. Consulte Recuperar sessões locais.
10 de agosto de 2026
O preço introdutório do Claude Sonnet 5 ($2 / $10 por MTok) agora é o preço padrão: o aumento anteriormente programado para $3 / $15 por MTok em 1º de setembro de 2026 não ocorrerá. Consulte Preços.
7 de agosto de 2026
Agora você pode definir um orçamento em uma sessão do Claude Managed Agents: um limite rígido no gasto da sessão, precificado com base nas tarifas públicas de tabela. Uma sessão que atinge seu orçamento é pausada com o stop reason budget_reached em vez de iniciar novas requisições ao modelo; alterar ou remover o orçamento a retoma. Deployments aceitam o mesmo orçamento e o aplicam a cada sessão que iniciam. Consulte Orçamentos de sessão.
Agora você pode dar a uma sessão do Claude Managed Agents um advisor: um modelo pelo menos tão capaz quanto o do próprio agente, que a thread principal da sessão pode consultar no meio de um turno para obter orientação estratégica. Configure-o como uma entrada {"type": "advisor"} no roster multiagente do agente, nomeando o model a ser consultado. Consulte Dar um advisor à sessão.
Agora você pode controlar onde a inferência do modelo é executada para um agente do Claude Managed Agents. Defina inference_geo dentro do objeto model ao criar o agente, ou substitua-o para uma única sessão. Consulte Residência de dados para as regiões geográficas disponíveis e preços.
Sessões do Claude Managed Agents agora podem carregar skills de um repositório do GitHub. Quando uma sessão monta um repositório, quaisquer skills no diretório raiz .claude/skills são descobertas automaticamente no início da sessão e ficam disponíveis para o agente durante aquela sessão.
5 de agosto de 2026
Inference hooks agora estão em beta para organizações Claude Enterprise. Aponte o Claude para o servidor de segurança de IA da sua organização, e cada prompt governado no claude.ai, Cowork e Claude Code é retido aguardando o veredito de permitir ou negar do servidor antes que a inferência prossiga. As requisições são assinadas, o tratamento de falhas é configurável, e cada negação é registrada no Activity Feed de compliance. Consulte Inference hooks.
Desativamos o modelo Claude Opus 4.1 (claude-opus-4-1-20250805). Todas as requisições a este modelo na API do Claude agora retornarão um erro. Recomendamos atualizar para o Claude Opus 5. Pesquisadores podem solicitar acesso contínuo por meio do External Researcher Access Program.
3 de agosto de 2026
A Compliance API agora retorna transcrições de sessões do Cowork iniciadas no claude.ai web ou mobile, em beta para organizações Claude Enterprise. GET /v1/compliance/apps/sessions/remote lista sessões e GET /v1/compliance/apps/sessions/remote/{session_id}/messages retorna a transcrição de uma sessão, usando sua Compliance Access Key existente com o escopo read:compliance_user_data. Consulte Recuperar sessões remotas.
No Claude Opus 5, desabilitar o thinking é permitido apenas no effort high ou inferior: thinking: {"type": "disabled"} com effort xhigh ou max retorna um erro 400, uma mudança incompatível em relação ao Claude Opus 4.8. Consulte Novidades no Claude Opus 5.
Effort é o controle principal para direcionar o Claude Opus 5: o modelo suporta a escala completa (low, medium, high, xhigh, max), com max para trabalhos críticos em termos de capacidade.
Mudanças de ferramentas no meio da conversa agora estão em beta no Claude Fable 5, Claude Mythos 5, Claude Opus 4.8 e Claude Opus 5: adicione ou remova ferramentas entre turnos de uma conversa preservando o cache de prompt. Inclua o cabeçalho beta mid-conversation-tool-changes-2026-07-01 nas suas requisições.
O parâmetro fallbacks agora suporta um modo "default", que aplica os modelos de fallback recomendados pela Anthropic por categoria de recusa. O fallback do lado do servidor está em beta, e o modo "default" requer o cabeçalho beta server-side-fallback-2026-07-01. Consulte Recusas e fallback.
Removemos o fast mode para o Claude Opus 4.7. Requisições para claude-opus-4-7 com speed: "fast" agora retornam um erro; diferentemente do Claude Opus 4.6, elas não recorrem à velocidade padrão. O Claude Opus 4.7 em si continua disponível na velocidade padrão. Para continuar usando o fast mode, migre para o Claude Opus 5 ou Claude Opus 4.8. Leia mais em Fast mode.
22 de julho de 2026
Agora você pode definir um nível de effort na configuração de modelo de um agente do Claude Managed Agents. Passe effort dentro do objeto model ao criar o agente. Consulte Níveis de effort para saber o que cada nível faz.
Webhooks para o Claude Managed Agents agora cobrem o ciclo de vida de environment e memory store: quatro tipos de evento environment.* e três tipos de evento memory_store.*. Você pode reagir a mudanças no ciclo de vida de environment e memory store sem fazer polling. Consulte as abas Environment events e Memory store events em Assinar webhooks.
Ao criar uma sessão do Claude Managed Agents, agora você pode inicializá-la com eventos iniciais. Passe initial_events em POST /v1/sessions com até 50 eventos user.message e user.define_outcome. Uma lista não vazia inicia o loop do agente na mesma chamada, então você não precisa de uma requisição separada de envio de eventos para iniciar o trabalho.
Streams de eventos de thread de sessão do Claude Managed Agents agora suportam event deltas. GET /v1/sessions/{session_id}/threads/{thread_id}/stream aceita o mesmo parâmetro de query event_deltas[] que o stream no nível da sessão, então você pode visualizar o texto de um subagente conforme o modelo o gera. Uma conexão visualiza apenas a thread que está lendo. Consulte Visualizar eventos de thread de sessão.
17 de julho de 2026
O Workbench legado (platform.claude.com/workbench) no Claude Console está sendo descontinuado, com o acesso encerrando em 17 de agosto de 2026. Prompts salvos, variáveis e evals não são suportados no Workbench atualizado. Você pode exportar quaisquer dados que queira manter a partir do banner e em suas Configurações Organizacionais. Para mais informações, consulte Como uso o Workbench? no Claude Help Center.
As APIs experimentais de ferramentas de prompt para gerar, melhorar e criar templates de prompts (/v1/experimental/generate_prompt, /v1/experimental/improve_prompt e /v1/experimental/templatize_prompt) estão sendo desativadas junto com o Workbench em 17 de agosto de 2026. Após a remoção, requisições a esses endpoints retornarão um erro.
Agora você pode gerenciar as pessoas da sua organização Claude Enterprise (claude.ai) com a Admin API, em beta para todas as organizações Claude Enterprise: listar membros e procurá-los por endereço de e-mail, alterar a função de um membro, remover membros, enviar e retirar convites, gerenciar grupos e suas associações, e ler funções personalizadas. Requisições de grupo e função personalizada requerem o cabeçalho beta anthropic-beta: ce-user-management-2026-07-13; requisições de membro e convite não requerem cabeçalho beta. Uma chave da Admin API com o escopo read:org_audit também pode chamar todos os endpoints GET de gerenciamento de usuários. Consulte Gerenciamento de usuários.
10 de julho de 2026
Dreams (prévia de pesquisa) agora suporta Claude Fable 5 e Claude Sonnet 5. Consulte Modelos suportados.
Expandimos a documentação de Access Transparency sobre eventos cmek_preserve com um exemplo de filtro, um exemplo de payload de evento e dois códigos de motivo de preservação (policy_violation_investigation, csae_report). A documentação agora também esclarece que um evento de preservação é gravado independentemente de a preservação ter sido iniciada por um revisor humano ou por um pipeline automatizado de segurança. Consulte Preservação de conteúdo CMEK.
8 de julho de 2026
Agora você pode definir uma expiração ao criar uma chave de API ou uma chave da Admin API no Claude Console. Escolha uma predefinição, uma duração personalizada ou Nunca. Para chaves com vida útil de pelo menos 7 dias, a Anthropic envia um e-mail ao criador antes da expiração. Chaves existentes não são afetadas. A Admin API reporta a expiração de cada chave no campo expires_at. Consulte Autenticação.
2 de julho de 2026
Adicionamos o cabeçalho beta agent-memory-2026-07-22, que altera o comportamento de listar memórias (GET /v1/memory_stores/{memory_store_id}/memories): os resultados são retornados em uma ordem estável definida pelo servidor e os parâmetros order_by e order são ignorados; depth aceita apenas 0, 1 ou ser omitido (outros valores retornam um erro 400); e path_prefix deve terminar com / e corresponde a segmentos de caminho completos em vez de uma substring. Cursores de página emitidos sem o cabeçalho não são válidos com ele, então reinicie da primeira página ao adotá-lo. Nos endpoints de memory store, agent-memory-2026-07-22 substitui managed-agents-2026-04-01; enviar ambos retorna um erro 400. Em 22 de julho de 2026, o cabeçalho managed-agents-2026-04-01 adota o mesmo comportamento de listagem. Consulte Cabeçalhos beta.
Os SDKs Python (0.116.0), TypeScript (0.110.0), Go (1.56.0), Java (2.48.0), Ruby (1.55.0), PHP (0.36.0), C# (12.35.0) e CLI (1.16.0) agora enviam agent-memory-2026-07-22 em todas as chamadas de memory store em vez de managed-agents-2026-04-01. Se o seu código passa betas explicitamente em chamadas de memory store, substitua managed-agents-2026-04-01 por agent-memory-2026-07-22 ali em vez de adicionar um segundo valor.
1º de julho de 2026
Restauramos o acesso ao Claude Fable 5 e ao Claude Mythos 5. Consulte nosso comunicado para mais informações.
30 de junho de 2026
Lançamos o Claude Sonnet 5 (claude-sonnet-5), a próxima geração da nossa família de modelos Sonnet, com preço introdutório de $2 / $10 por MTok (tornado o preço padrão em 10 de agosto de 2026). O Claude Sonnet 5 suporta uma janela de contexto de 1M de tokens, 128k de tokens máximos de saída e o mesmo conjunto de ferramentas e recursos de plataforma que o Claude Sonnet 4.6, exceto Priority Tier, que não está disponível no Claude Sonnet 5. Três mudanças de comportamento se aplicam ao migrar: adaptive thinking agora está ativado por padrão; o pensamento estendido manual (thinking: {type: "enabled", budget_tokens: N}) foi removido e retorna um erro 400 (foi descontinuado no Sonnet 4.6); e definir parâmetros de amostragem (temperature, top_p, top_k) com valores não padrão retorna um erro 400. O Claude Sonnet 5 também usa um novo tokenizador que produz aproximadamente 30% mais tokens para o mesmo texto. O aumento exato depende do conteúdo e do formato da carga de trabalho. Consulte Novidades no Claude Sonnet 5 para detalhes e orientações de migração. Para diferenças comportamentais e padrões de prompting específicos do modelo, consulte Prompting do Claude Sonnet 5.
Streams de eventos de sessão do Claude Managed Agents agora suportam event deltas. Ative com o parâmetro de query event_deltas[] em GET /v1/sessions/{session_id}/events/stream. Os eventos event_start e event_delta mostram uma prévia do texto de uma mensagem do agente conforme é gerado, antes que o evento agent.message completo chegue.
Listar sessões para o Claude Managed Agents agora suporta paginação reversa. GET /v1/sessions retorna um cursor prev_page junto com next_page; passe-o como o parâmetro page para retornar à página anterior. Consulte Paginação.
Ao criar uma sessão do Claude Managed Agents, agora você pode substituir a configuração do agente para aquela sessão. Passe agent com type: "agent_with_overrides" para substituir o modelo, prompt do sistema, ferramentas, servidores MCP ou skills para uma única sessão. O agente em si permanece inalterado.
Vaults do Claude Managed Agents agora suportam uma configuração injection_location em credenciais de variável de ambiente (a aba Environment variable). Ela controla se o valor da credencial é substituído, na saída, nos cabeçalhos da requisição de saída do agente, no corpo da requisição, ou em ambos.
Webhooks para o Claude Managed Agents agora cobrem o ciclo de vida de agente, deployment e execução de deployment. Você pode reagir a uma versão de agente recém-publicada, um deployment pausado ou uma execução agendada com falha sem fazer polling. Consulte as abas Agent events, Deployment events e Deployment run events em Assinar webhooks.
29 de junho de 2026
Removemos o fast mode para o Claude Opus 4.6. Requisições para claude-opus-4-6 com speed: "fast" não são mais executadas em velocidade rápida nem com preço premium: elas são executadas na velocidade padrão, são cobradas com tarifas padrão e não retornam um erro. O campo usage.speed da resposta reporta a velocidade usada. Para continuar usando o fast mode, migre para o Claude Opus 4.8. Leia mais em Fast mode.
26 de junho de 2026
Aumentamos os limites de taxa em toda a API do Claude. Os limites de taxa do Claude Sonnet e do Claude Haiku agora correspondem aos do Claude Opus em todos os níveis de uso, e os níveis de uso foram consolidados em três: Start, Build e Scale. A maioria das organizações passa para um nível mais alto, nenhuma organização recebe limites mais baixos do que antes, e nenhuma ação é necessária. Você pode visualizar seu nível e limites atuais no Claude Console.
25 de junho de 2026
Descontinuamos o fast mode para o Claude Opus 4.7, com remoção em 24 de julho de 2026. Após a remoção, requisições para claude-opus-4-7 com speed: "fast" retornarão um erro. Migre para o fast mode do Claude Opus 4.8. Leia mais em Fast mode.
22 de junho de 2026
MCP tunnels (prévia de pesquisa): a API de gerenciamento foi movida de /v1/organizations/tunnels na Admin API para /v1/tunnels na API do Claude. A nova superfície usa o cabeçalho anthropic-beta: mcp-tunnels-2026-06-22 e o escopo WIF workspace:manage_tunnels. A superfície anterior permanece disponível durante uma janela de migração. Consulte a referência da Tunnels API.
18 de junho de 2026
Os SDKs Python, TypeScript, Go, Java, Ruby, PHP e C# agora incluem suporte para code_execution_20260120, a versão da ferramenta de execução de código que adiciona persistência de estado REPL e é a versão mínima para chamada programática de ferramentas. Para adotá-la, defina o type da ferramenta como code_execution_20260120; nenhum cabeçalho beta é necessário. Está disponível no Claude Fable 5, Claude Mythos 5, Claude Opus 4.5 e mais recentes, e Claude Sonnet 4.5 e mais recentes; consulte a tabela de compatibilidade de modelos.
15 de junho de 2026
Desativamos o modelo Claude Sonnet 4 (claude-sonnet-4-20250514) e o modelo Claude Opus 4 (claude-opus-4-20250514). Todas as requisições a esses modelos na API do Claude agora retornarão um erro. Recomendamos atualizar para o Claude Sonnet 4.6 e o Claude Opus 4.8, respectivamente. Pesquisadores podem solicitar acesso contínuo por meio do External Researcher Access Program.
11 de junho de 2026
A ferramenta de execução de código agora suporta code_execution_20260521, que divulga o limite de tempo de execução de 90 segundos por célula na descrição da ferramenta para que o Claude possa planejar células de longa duração. Nenhum cabeçalho beta é necessário.
A ferramenta de busca na web e a ferramenta de busca de conteúdo web agora suportam web_search_20260318 e web_fetch_20260318, adicionando um parâmetro response_inclusion para descartar blocos de resultado consumidos da resposta da API em fluxos de trabalho agênticos. Nenhum cabeçalho beta é necessário.
Lançamos o Claude Fable 5 (claude-fable-5), nosso modelo mais capaz amplamente disponível, junto com o Claude Mythos 5 (claude-mythos-5) para participantes do Project Glasswing. Ambos os modelos suportam uma janela de contexto de 1M de tokens por padrão, 128k de tokens máximos de saída e adaptive thinking sempre ativo. Consulte Apresentando o Claude Fable 5 e o Claude Mythos 5 para capacidades, mudanças na API e disponibilidade.
O Claude Fable 5 e o Claude Mythos 5 usam o tokenizador introduzido com o Claude Opus 4.7. Comparado a modelos anteriores ao Claude Opus 4.7, o mesmo texto produz aproximadamente 30% mais tokens. O aumento exato depende do conteúdo e do formato da carga de trabalho. Use a API de contagem de tokens com model: "claude-fable-5" para medir seus prompts com o novo tokenizador.
O Claude Fable 5 executa classificadores de segurança nas requisições e durante a geração de respostas. Quando um classificador recusa uma requisição, a Messages API retorna stop_reason: "refusal". Você não é cobrado por uma requisição recusada antes de qualquer saída ser gerada. Um parâmetro opcional fallbacks (em beta na API do Claude e na Claude Platform on AWS; não suportado na Message Batches API) reexecuta requisições recusadas em outro modelo, cobrado com as tarifas do modelo de fallback. Consulte Tratamento de stop reasons.
O campo stop_details.category em respostas de recusa agora inclui "reasoning_extraction" no Claude Fable 5, retornado quando uma requisição é bloqueada sob as restrições dos Termos de Serviço da Anthropic sobre engenharia reversa ou duplicação de saídas do modelo. As categorias existentes "cyber" e "bio" permanecem inalteradas. Nenhum cabeçalho beta é necessário.
No Claude Fable 5 e no Claude Mythos 5, adaptive thinking é o único modo de thinking: thinking: {"type": "disabled"} não é suportado, e orçamentos manuais de pensamento estendido e prefill do assistente não são suportados (ambos retornam um erro 400). Consulte Migrando do Claude Mythos Preview para o Claude Mythos 5.
No Claude Fable 5 e no Claude Mythos 5, thinking.display tem como padrão "omitted", o mesmo que no Claude Opus 4.8, Claude Opus 4.7 e Claude Mythos Preview; defina display: "summarized" para receber resumos legíveis do thinking. A cadeia de raciocínio bruta nunca é retornada; passe os blocos de thinking de volta sem alterações em conversas de múltiplos turnos no mesmo modelo. Consulte Saída de thinking no Claude Fable 5 e no Claude Mythos 5.
O Claude Managed Agents agora suporta deployments agendados, permitindo que você execute sessões em um agendamento cron sem gerenciar seu próprio agendador.
Vaults do Claude Managed Agents agora suportam credenciais de variável de ambiente, para que você possa injetar segredos com segurança no sandbox do agente para CLIs, SDKs e outros serviços que se autenticam por meio de variáveis de ambiente.
Os eventos de webhook session.thread_* agora incluem um campo session_thread_id identificando a thread multiagente que disparou o evento.
Lançamos um pacote Swift em beta que adiciona o Claude como um LanguageModel do lado do servidor no framework Foundation Models da Apple. Chame o Claude por meio da mesma API LanguageModelSession do modelo on-device da Apple no iOS 27, macOS 27, visionOS 27 e watchOS 27 (beta).
5 de junho de 2026
Anunciamos a descontinuação do modelo Claude Opus 4.1 (claude-opus-4-1-20250805), com desativação na API do Claude programada para 5 de agosto de 2026. Recomendamos migrar para o Claude Opus 4.8. Leia mais em Descontinuações de modelos.
2 de junho de 2026
A ferramenta advisor agora suporta um parâmetro max_tokens para limitar a saída do modelo advisor por chamada, reduzindo a latência e o custo de tokens de saída para cargas de trabalho que não precisam de respostas completas do advisor. Defina tools[].max_tokens na definição da ferramenta advisor; consulte Limitando a saída do advisor.
Na API do Claude, você não é mais cobrado por uma requisição quando ela retorna stop_reason: "refusal" sem que o Claude tenha gerado qualquer saída. Consulte Recusas em streaming para detectar e tratar recusas.
Lançamos o Claude Opus 4.8 (), nosso modelo mais capaz em disponibilidade geral. O Claude Opus 4.8 suporta uma janela de contexto de 1M de tokens por padrão na API do Claude, Amazon Bedrock, Google Cloud e Microsoft Foundry, 128k de tokens máximos de saída e o mesmo conjunto de ferramentas e recursos de plataforma que o Claude Opus 4.7. Consulte o guia de migração para configurações de base, recursos e orientações de migração.
Lançamos mensagens de sistema no meio da conversa. No Claude Opus 4.8, você pode enviar mensagens role: "system" após um turno do usuário (sujeito a regras de posicionamento) no array messages, preservando acertos do cache de prompt quando as instruções mudam durante uma sessão de longa duração. Nenhum cabeçalho beta é necessário.
O campo stop_details em respostas de recusa agora está documentado publicamente; ele retorna uma category (cyber, bio ou null) e uma explanation legível por humanos, para que sua aplicação possa encaminhar diferentes classes de recusa para o próximo passo correto. Nenhum cabeçalho beta é necessário.
No Claude Opus 4.8, o parâmetro effort tem como padrão high em todas as superfícies, incluindo o Claude Code e a Messages API.
No Claude Opus 4.8, o comprimento mínimo de prompt cacheável para cache de prompt é de 1.024 tokens, menor do que no Claude Opus 4.7.
Com adaptive thinking habilitado, o Claude Opus 4.8 aciona o raciocínio apenas quando um turno precisa dele, reduzindo tokens de thinking desperdiçados em comparação com o Claude Opus 4.7 no mesmo nível de effort.
Fast mode para o Claude Opus 4.8 está disponível como prévia de pesquisa apenas na API do Claude.
Definir os parâmetros de amostragem temperature, top_p ou top_k com um valor não padrão retorna um erro 400 no Claude Opus 4.8, igual ao Claude Opus 4.7. Consulte o guia de migração para detalhes.
No Claude Code, expandimos o modo Auto para mais usuários em tarefas de longa duração. Consulte a documentação do Claude Code.
No Claude Code, Workflows estão disponíveis como prévia de pesquisa, permitindo que você defina e execute planos agênticos de múltiplas etapas. Consulte a documentação do Claude Code.
Descontinuamos o fast mode para o Claude Opus 4.6, com remoção aproximadamente 30 dias após o lançamento. Migre para o fast mode do Claude Opus 4.8 ou do Claude Opus 4.7. Leia mais em Fast mode.
Para atualizações do claude.ai, Cowork, Claude for Microsoft 365 e outros aplicativos Claude neste lançamento, consulte as notas de lançamento dos Claude Apps.
27 de maio de 2026
A resposta da Messages API agora inclui usage.output_tokens_details.thinking_tokens, reportando quantos dos tokens de saída cobrados foram de pensamento estendido. Ao usar streaming, o detalhamento aparece apenas no evento final message_delta. Nenhum cabeçalho beta é necessário.
19 de maio de 2026
MCP tunnels agora está disponível como prévia de pesquisa, para que você possa se conectar a servidores MCP na sua rede privada.
Sandboxes auto-hospedados agora estão disponíveis para o Claude Managed Agents, como alternativa à execução de ferramentas na infraestrutura da Anthropic. Consulte Sandboxes auto-hospedados.
Com o Claude Managed Agents, agora você pode atualizar as configurações de servidor MCP e de ferramentas do agente associadas a uma sessão ativa.
Com o Claude Managed Agents, saídas grandes de ferramentas agent_toolset e MCP que excedem 100K caracteres (cerca de 25K tokens) agora são automaticamente transferidas para um arquivo no sandbox. O modelo recebe uma prévia truncada com o caminho do arquivo e pode ler o conteúdo completo a partir dele.
18 de maio de 2026
A ferramenta de busca na web agora retorna dados mais ricos de registros da SEC, facilitando fundamentar agentes de pesquisa financeira, análise de resultados e fluxos de trabalho de due diligence em fontes primárias com citações.
13 de maio de 2026
Lançamos diagnósticos de cache em beta público. Passe diagnostics.previous_message_id em uma requisição Messages e a API reporta um cache_miss_reason explicando onde o prefixo do cache de prompt divergiu do turno anterior. Inclua o cabeçalho beta cache-diagnosis-2026-04-07 nas suas requisições.
12 de maio de 2026
O Fast mode (prévia de pesquisa) agora oferece suporte ao Claude Opus 4.7. Defina speed: "fast" com model: "claude-opus-4-7" e o cabeçalho beta fast-mode-2026-02-01 para geração de tokens de saída significativamente mais rápida com preço premium. Preços, limites de taxa e acesso são os mesmos do fast mode do Opus 4.6; clientes interessados devem entrar na lista de espera.
11 de maio de 2026
Lançamos o Claude Platform on AWS, trazendo a API do Claude para infraestrutura gerenciada pela Anthropic acessível através da AWS, com faturamento da AWS e autenticação IAM. Acesse a Messages API completa, Files API, Message Batches API, Claude Managed Agents, Agent Skills, execução de código e uso de ferramentas através de endpoints nativos da AWS. Saiba mais em Claude Platform on AWS.
A atualização em segundo plano de credenciais de vault do Claude Managed Agents agora é suportada para credenciais mcp_oauth. Consulte Autenticar com vaults.
Webhooks para Claude Managed Agents agora são suportados. Os tipos de eventos de webhook incluem eventos de ciclo de vida de sessão e vault. Consulte Assinar webhooks.
Opções adicionais de filtragem e ordenação agora são suportadas para Claude Managed Agents. Sessões podem ser filtradas por status, e eventos podem ser filtrados por tipo. Eventos agora podem ser filtrados por hora de criação.
Dreams para Claude Managed Agents estão agora disponíveis como prévia de pesquisa. Um dream lê um armazenamento de memória existente junto com transcrições de sessões anteriores e produz um armazenamento de memória de saída reorganizado com duplicatas mescladas, entradas obsoletas substituídas e novos insights revelados. Os endpoints de dream são controlados pelo cabeçalho beta dreaming-2026-04-21. Solicite acesso para experimentar.
4 de maio de 2026
Workload Identity Federation está agora em disponibilidade geral. Autentique workloads na API do Claude com tokens OIDC de curta duração do seu próprio provedor de identidade (AWS IAM, Google Cloud, GitHub Actions, Kubernetes, Microsoft Entra ID, Okta, SPIFFE e outros) em vez de chaves de API estáticas de longa duração. Configure emissores e regras de federação no Claude Console, e o SDK gerencia a troca e atualização de tokens automaticamente. Consulte Autenticação.
30 de abril de 2026
Desativamos o beta de janela de contexto de 1M de tokens (context-1m-2025-08-07) para Claude Sonnet 4.5 e Claude Sonnet 4. O cabeçalho beta agora não tem efeito nesses modelos, e requisições que excedem a janela de contexto padrão de 200k tokens retornam um erro. Para usar a janela de contexto de 1M, migre para Claude Sonnet 4.6 ou Claude Opus 4.6, onde ela está em disponibilidade geral com preço padrão sem necessidade de cabeçalho beta.
29 de abril de 2026
Lançamos a Claude API skill, uma Agent Skill de código aberto que fornece ao Claude material de referência atualizado para construir com a Messages API e Claude Managed Agents em 8 linguagens. A skill vem incluída no Claude Code e está disponível no repositório de skills da Anthropic.
24 de abril de 2026
Lançamos a Rate Limits API, permitindo que administradores consultem programaticamente os limites de taxa configurados para sua organização e workspaces.
23 de abril de 2026
A memória para Claude Managed Agents está agora em beta público sob o cabeçalho padrão managed-agents-2026-04-01. Consulte Usando memória de agente para o guia completo de integração.
20 de abril de 2026
Desativamos o modelo Claude Haiku 3 (claude-3-haiku-20240307). Todas as requisições a este modelo agora retornarão um erro. Recomendamos atualizar para Claude Haiku 4.5.
16 de abril de 2026
Lançamos o Claude Opus 4.7, nosso modelo mais capaz em disponibilidade geral para raciocínio complexo e codificação agêntica, com o mesmo preço de $5 / $25 por MTok do Opus 4.6. Consulte Novidades no Claude Opus 4.7 para melhorias de capacidade, novos recursos e o tokenizador atualizado. O Opus 4.7 inclui mudanças incompatíveis na API em relação ao Opus 4.6; consulte o guia de migração antes de atualizar.
Claude in Amazon Bedrock está agora aberto a todos os clientes do Amazon Bedrock. Claude Opus 4.7 e Claude Haiku 4.5 estão disponíveis em autoatendimento no console do Bedrock através do endpoint da Messages API em /anthropic/v1/messages, em 27 regiões da AWS com endpoints globais e regionais.
Lançamos task budgets em beta no Claude Opus 4.7. Forneça ao Claude um orçamento consultivo de tokens para um loop agêntico completo (pensamento, chamadas de ferramentas, resultados de ferramentas e saída) e o modelo vê uma contagem regressiva em execução, usando-a para priorizar o trabalho e finalizar de forma adequada conforme o orçamento é consumido. Inclua o cabeçalho beta task-budgets-2026-03-13 em suas requisições.
O Claude Opus 4.7 oferece suporte a entrada de imagem em alta resolução, aumentando a resolução máxima de imagem de 1568 para 2576 pixels no lado mais longo para melhor desempenho em uso de computador, compreensão de capturas de tela e análise de documentos. O suporte a alta resolução é automático e não requer cabeçalho beta; imagens podem usar até aproximadamente 3x mais tokens de imagem do que em modelos anteriores.
Adicionamos o nível de effortxhigh no Claude Opus 4.7. xhigh fica entre high e max e é ajustado para tarefas agênticas e de codificação de longa duração (mais de 30 minutos) com orçamentos de tokens na casa dos milhões. Nenhum cabeçalho beta é necessário.
14 de abril de 2026
Anunciamos a descontinuação do modelo Claude Sonnet 4 (claude-sonnet-4-20250514) e do modelo Claude Opus 4 (claude-opus-4-20250514), com desativação na API do Claude agendada para 15 de junho de 2026. Recomendamos migrar para Claude Sonnet 4.6 e Claude Opus 4.8 respectivamente. Leia mais em Descontinuações de modelos.
9 de abril de 2026
Lançamos a advisor tool em beta público. Combine um modelo executor mais rápido com um modelo advisor de maior inteligência que fornece orientação estratégica durante a geração, para que workloads agênticos de longo horizonte obtenham qualidade próxima à do advisor sozinho enquanto a maior parte da geração de tokens acontece com as tarifas do modelo executor. Inclua o cabeçalho beta advisor-tool-2026-03-01 em suas requisições.
8 de abril de 2026
Lançamos o Claude Managed Agents em beta público, um harness de agente totalmente gerenciado para executar o Claude como um agente autônomo com sandboxing seguro, ferramentas integradas e streaming de eventos enviados pelo servidor. Crie agentes, configure contêineres e execute sessões através da API. Todos os endpoints requerem o cabeçalho beta managed-agents-2026-04-01. Saiba mais em Visão geral do Claude Managed Agents.
Lançamos a CLI ant, um cliente de linha de comando para a API do Claude que permite interação mais rápida com a API do Claude, integração nativa com o Claude Code e versionamento de recursos da API em arquivos YAML. Saiba mais no início rápido da CLI.
7 de abril de 2026
Anunciamos que o Claude Mythos Preview está disponível como prévia de pesquisa restrita para trabalho de cibersegurança defensiva como parte do Project Glasswing. O acesso é apenas por convite.
A Messages API está agora disponível no Amazon Bedrock como prévia de pesquisa. O novo endpoint Claude in Amazon Bedrock em /anthropic/v1/messages usa o mesmo formato de requisição da API do Claude de primeira parte e é executado em infraestrutura gerenciada pela AWS com zero acesso de operador. Disponível em us-east-1; entre em contato com seu executivo de contas da Anthropic para solicitar acesso. Saiba mais em Claude in Amazon Bedrock.
30 de março de 2026
Aumentamos o limite de max_tokens para 300k na Message Batches API para Claude Opus 4.6 e Sonnet 4.6. Inclua o cabeçalho beta output-300k-2026-03-24 para gerar saídas de turno único mais longas para conteúdo de formato longo, dados estruturados e tarefas de geração de código extensas.
Estamos desativando o beta de janela de contexto de 1M de tokens para Claude Sonnet 4.5 e Claude Sonnet 4 em 30 de abril de 2026. Após essa data, o cabeçalho beta context-1m-2025-08-07 não terá efeito nesses modelos, e requisições que excedam a janela de contexto padrão de 200k tokens retornarão um erro. Para continuar usando janelas de contexto de 1M, migre para Claude Sonnet 4.6 ou Claude Opus 4.6, que oferecem suporte à janela de contexto completa de 1M de tokens com preço padrão sem necessidade de cabeçalho beta.
18 de março de 2026
Adicionamos campos de capacidade de modelo à Models API. GET /v1/models e GET /v1/models/{model_id} agora retornam max_input_tokens, max_tokens e um objeto capabilities. Consulte a API para descobrir o que cada modelo suporta.
16 de março de 2026
Lançamos o campo display para pensamento estendido, permitindo que você omita o conteúdo de pensamento das respostas para streaming mais rápido. Defina thinking.display: "omitted" para receber blocos de pensamento com um campo thinking vazio e a signature preservada para continuidade multi-turno. O faturamento permanece inalterado. Saiba mais em Controlando a exibição de pensamento.
13 de março de 2026
A janela de contexto de 1M de tokens está agora em disponibilidade geral para Claude Opus 4.6 e Sonnet 4.6 com preço padrão. Requisições acima de 200k tokens funcionam automaticamente para esses modelos sem necessidade de cabeçalho beta. A janela de contexto de 1M de tokens permanece em beta para Claude Sonnet 4.5 e Sonnet 4.
Removemos os limites de taxa dedicados de 1M para todos os modelos suportados. Seus limites padrão de conta agora se aplicam a todos os comprimentos de contexto.
Aumentamos o limite de mídia de 100 para 600 imagens ou páginas de PDF por requisição ao usar a janela de contexto de 1M de tokens.
19 de fevereiro de 2026
Lançamos o cache automático para a Messages API. Adicione um único campo cache_control ao corpo da sua requisição e o sistema armazena em cache automaticamente o último bloco cacheável, movendo o ponto de cache para frente conforme as conversas crescem. Nenhum gerenciamento manual de breakpoints é necessário. Funciona junto com o cache control existente em nível de bloco para otimização refinada. Disponível na API do Claude e no Microsoft Foundry (prévia). Saiba mais em Cache de prompt.
Desativamos o modelo Claude Sonnet 3.7 (claude-3-7-sonnet-20250219) e o modelo Claude Haiku 3.5 (claude-3-5-haiku-20241022). Todas as requisições ao Claude Sonnet 3.7 agora retornarão um erro. Requisições ao Claude Haiku 3.5 na API do Claude agora retornarão um erro; ele permanece disponível no Amazon Bedrock e no Google Cloud. Recomendamos atualizar para Claude Sonnet 4.6 e Claude Haiku 4.5 respectivamente. Pesquisadores podem solicitar acesso contínuo através do External Researcher Access Program.
Anunciamos a descontinuação do modelo Claude Haiku 3 (claude-3-haiku-20240307), com desativação agendada para 20 de abril de 2026. Recomendamos migrar para Claude Haiku 4.5. Leia mais em Descontinuações de modelos.
17 de fevereiro de 2026
Lançamos o Claude Sonnet 4.6, nosso mais recente modelo equilibrado que combina velocidade e inteligência para tarefas do dia a dia. O Sonnet 4.6 oferece melhor desempenho de busca agêntica enquanto consome menos tokens. O Sonnet 4.6 oferece suporte a pensamento estendido e a uma janela de contexto de 1M de tokens (beta). Consulte Modelos e Preços para detalhes.
A execução de código da API agora é gratuita quando usada com web search ou web fetch. A execução de código em sandbox melhora a capacidade do modelo e a eficiência de tokens. Consulte os detalhes de preços para uso independente.
A web search tool e a chamada programática de ferramentas estão agora em disponibilidade geral (nenhum cabeçalho beta necessário). Web search e web fetch agora oferecem suporte a filtragem dinâmica, que usa execução de código para filtrar resultados antes que eles cheguem à janela de contexto, para melhor desempenho e custo reduzido de tokens.
Lançamos o fast mode em prévia de pesquisa para o Opus 4.6, fornecendo geração de tokens de saída significativamente mais rápida através do parâmetro speed. O fast mode é até 2,5x mais rápido com preço premium. Clientes interessados devem entrar na lista de espera.
5 de fevereiro de 2026
Lançamos o Claude Opus 4.6, nosso modelo mais inteligente para tarefas agênticas complexas e trabalho de longo horizonte. O Opus 4.6 recomenda pensamento adaptativo (thinking: {type: "adaptive"}); o pensamento manual (type: "enabled" com budget_tokens) está descontinuado. O Opus 4.6 não oferece suporte ao preenchimento prévio de mensagens do assistente. Saiba mais em Novidades no Claude 4.6.
O parâmetro effort está agora em disponibilidade geral (nenhum cabeçalho beta necessário) e oferece suporte ao Claude Opus 4.6. O effort substitui budget_tokens para controlar a profundidade de pensamento em novos modelos.
Lançamos a compaction API em beta, fornecendo sumarização de contexto do lado do servidor para conversas efetivamente infinitas. Disponível no Opus 4.6.
Introduzimos controles de residência de dados, permitindo que você especifique onde a inferência do modelo é executada com o parâmetro inference_geo. Inferência apenas nos EUA está disponível com preço de 1,1x para modelos lançados após 1º de fevereiro de 2026.
O streaming refinado de ferramentas está agora em disponibilidade geral em todos os modelos e plataformas (nenhum cabeçalho beta necessário).
29 de janeiro de 2026
Saídas estruturadas estão agora em disponibilidade geral na API do Claude para Claude Sonnet 4.5, Claude Opus 4.5 e Claude Haiku 4.5. A disponibilidade geral inclui suporte expandido a schemas, latência de compilação de gramática aprimorada e um caminho de integração simplificado sem necessidade de cabeçalho beta. O parâmetro output_format foi movido para output_config.format. Usuários beta existentes podem continuar usando o cabeçalho beta durante o período de transição. Saídas estruturadas permanecem em beta público no Amazon Bedrock e no Microsoft Foundry.
12 de janeiro de 2026
console.anthropic.com agora redireciona para platform.claude.com. O Claude Console foi movido para seu novo endereço como parte da nossa consolidação da marca Claude. Favoritos e links existentes continuarão funcionando através de um redirecionamento automático. Para mais detalhes, consulte o anúncio de 16 de setembro de 2025.
5 de janeiro de 2026
Desativamos o modelo Claude Opus 3 (claude-3-opus-20240229). Todas as requisições a este modelo agora retornarão um erro. Recomendamos atualizar para Claude Opus 4.5, que oferece inteligência significativamente aprimorada por um terço do custo. Pesquisadores podem solicitar acesso contínuo ao Claude Opus 3 na API através do External Researcher Access Program.
Lançamos o Claude Opus 4.5, nosso modelo mais inteligente que combina capacidade máxima com desempenho prático. Ideal para tarefas especializadas complexas, engenharia de software profissional e agentes avançados. Apresenta melhorias significativas em visão, codificação e uso de computador a um preço mais acessível do que modelos Opus anteriores. Saiba mais em Visão geral dos modelos.
Lançamos a chamada programática de ferramentas em beta público, permitindo que o Claude chame ferramentas de dentro da execução de código para reduzir latência e uso de tokens em fluxos de trabalho com múltiplas ferramentas.
Lançamos a tool search tool em beta público, permitindo que o Claude descubra e carregue ferramentas dinamicamente sob demanda a partir de grandes catálogos de ferramentas.
Lançamos o parâmetro effort em beta público para Claude Opus 4.5, permitindo que você controle o uso de tokens equilibrando entre completude da resposta e eficiência.
Adicionamos compactação do lado do cliente aos nossos SDKs Python e TypeScript, gerenciando automaticamente o contexto da conversa através de sumarização ao usar tool_runner.
21 de novembro de 2025
Blocos de conteúdo de resultado de busca estão agora em disponibilidade geral no Amazon Bedrock. Saiba mais em Resultados de busca.
19 de novembro de 2025
Lançamos uma nova plataforma de documentação em platform.claude.com/docs. Nossa documentação agora fica lado a lado com o Claude Console, proporcionando uma experiência unificada para desenvolvedores. O site de documentação anterior em docs.claude.com redirecionará para o novo local.
18 de novembro de 2025
Lançamos o Claude in Microsoft Foundry, trazendo modelos Claude para clientes do Azure com faturamento do Azure e autenticação OAuth. Acesse a Messages API completa incluindo pensamento estendido, cache de prompt (5 minutos e 1 hora), suporte a PDF, Files API, Agent Skills e uso de ferramentas. Saiba mais em Claude in Microsoft Foundry.
14 de novembro de 2025
Lançamos saídas estruturadas em beta público, fornecendo conformidade garantida com schema para as respostas do Claude. Use saídas JSON para respostas de dados estruturados ou uso estrito de ferramentas para entradas de ferramentas validadas. Disponível para Claude Sonnet 4.5 e Claude Opus 4.1. Para habilitar, use o cabeçalho beta structured-outputs-2025-11-13.
Desativamos os modelos Claude Sonnet 3.5. Todas as requisições a esses modelos agora retornarão um erro.
Expandimos a edição de contexto com limpeza de blocos de pensamento (clear_thinking_20251015), permitindo o gerenciamento automático de blocos de pensamento. Saiba mais em Edição de contexto.
16 de outubro de 2025
Lançamos Agent Skills (beta skills-2025-10-02), uma nova forma de estender as capacidades do Claude. Skills são pastas organizadas de instruções, scripts e recursos que o Claude carrega dinamicamente para executar tarefas especializadas. O lançamento inicial inclui:
Skills gerenciadas pela Anthropic: Skills pré-construídas para trabalhar com arquivos PowerPoint (.pptx), Excel (.xlsx), Word (.docx) e PDF
Skills personalizadas: Faça upload de suas próprias Skills através da Skills API (endpoints /v1/skills) para empacotar expertise de domínio e fluxos de trabalho organizacionais
Lançamos o Claude Haiku 4.5, nosso modelo Haiku mais rápido e inteligente com desempenho próximo ao de fronteira. Ideal para aplicações em tempo real, processamento de alto volume e implantações sensíveis a custo que exigem raciocínio robusto. Saiba mais em Visão geral dos modelos.
29 de setembro de 2025
Lançamos o Claude Sonnet 4.5, nosso melhor modelo para agentes complexos e codificação, com a maior inteligência na maioria das tarefas. Saiba mais na visão geral dos modelos.
Introduzimos preços de endpoint global para Amazon Bedrock e Vertex AI. Os preços da API do Claude (1P) não são afetados.
Introduzimos um novo stop reason model_context_window_exceeded que permite solicitar o máximo de tokens possível sem calcular o tamanho da entrada. Saiba mais em Tratando stop reasons.
Lançamos a memory tool em beta, permitindo que o Claude armazene e consulte informações entre conversas. Saiba mais em Memory tool.
Lançamos a edição de contexto em beta, fornecendo estratégias para gerenciar automaticamente o contexto da conversa. O lançamento inicial oferece suporte à limpeza de resultados e chamadas de ferramentas mais antigos ao se aproximar dos limites de tokens. Saiba mais em Edição de contexto.
17 de setembro de 2025
Lançamos tool helpers em beta para os SDKs Python e TypeScript, simplificando a criação e execução de ferramentas com validação de entrada type-safe e um tool runner para tratamento automatizado de ferramentas em conversas. Para detalhes, consulte a documentação do SDK Python e do SDK TypeScript.
16 de setembro de 2025
Unificamos nossas ofertas para desenvolvedores sob a marca Claude. Você deve ver nomes e URLs atualizados em nossa plataforma e documentação, mas nossas interfaces de desenvolvedor permanecerão as mesmas. Aqui estão algumas mudanças notáveis:
Endpoints da API, cabeçalhos, variáveis de ambiente e SDKs permanecem os mesmos. Suas integrações existentes continuarão funcionando sem nenhuma alteração.
10 de setembro de 2025
Lançamos a web fetch tool em beta, permitindo que o Claude recupere conteúdo completo de páginas web e documentos PDF especificados. Saiba mais em Web fetch tool.
Lançamos a Claude Code Analytics API, permitindo que organizações acessem programaticamente métricas de uso agregadas diárias do Claude Code, incluindo métricas de produtividade, estatísticas de uso de ferramentas e dados de custo.
Lançamos gráficos de limite de taxa na página de Uso do Console, permitindo que você monitore o uso de limite de taxa da API e taxas de cache ao longo do tempo.
3 de setembro de 2025
Lançamos suporte para documentos citáveis em resultados de ferramentas do lado do cliente. Saiba mais em Tratar chamadas de ferramentas.
2 de setembro de 2025
Lançamos a v2 da Code Execution Tool em beta público, substituindo a ferramenta original apenas para Python por execução de comandos Bash e capacidades de manipulação direta de arquivos, incluindo escrita de código em outras linguagens.
Anunciamos a descontinuação dos modelos Claude Sonnet 3.5 (claude-3-5-sonnet-20240620 e claude-3-5-sonnet-20241022). Esses modelos serão desativados em 28 de outubro de 2025. Recomendamos migrar para Claude Sonnet 4.5 (claude-sonnet-4-5-20250929) para desempenho e capacidades aprimorados. Leia mais em Descontinuações de modelos.
A duração de cache de 1 hora para cache de prompt está agora em disponibilidade geral. Você agora pode usar o TTL de cache estendido sem um cabeçalho beta. Saiba mais em Cache de prompt.
Alguns clientes podem encontrar erros 429 (rate_limit_error) após um aumento acentuado no uso da API devido a limites de aceleração na API. Anteriormente, erros 529 (overloaded_error) ocorriam em cenários semelhantes.
8 de agosto de 2025
Blocos de conteúdo de resultado de busca estão agora em disponibilidade geral na API do Claude e no Vertex AI. Este recurso permite citações naturais para aplicações RAG com atribuição adequada de fonte. O cabeçalho beta search-results-2025-06-09 não é mais necessário. Saiba mais em Resultados de busca.
5 de agosto de 2025
Lançamos o Claude Opus 4.1, uma atualização incremental do Claude Opus 4 com capacidades aprimoradas e melhorias de desempenho.* Saiba mais em Visão geral dos modelos.
*O Opus 4.1 não permite que os parâmetros temperature e top_p sejam especificados juntos. Use apenas um.
28 de julho de 2025
Lançamos text_editor_20250728, uma ferramenta de editor de texto atualizada que corrige alguns problemas das versões anteriores e adiciona um parâmetro opcional max_characters que permite controlar o comprimento de truncamento ao visualizar arquivos grandes.
24 de julho de 2025
Aumentamos os limites de taxa para Claude Opus 4 na API do Claude para dar a você mais capacidade de construir e escalar com o Claude. Para clientes com limites de taxa de nível de uso 1-4, essas mudanças se aplicam imediatamente à sua conta - nenhuma ação necessária.
21 de julho de 2025
Desativamos os modelos Claude 2.0, Claude 2.1 e Claude Sonnet 3. Todas as requisições a esses modelos agora retornarão um erro. Leia mais em Descontinuações de modelos.
17 de julho de 2025
Aumentamos os limites de taxa para Claude Sonnet 4 na API do Claude para dar a você mais capacidade de construir e escalar com o Claude. Para clientes com limites de taxa de nível de uso 1-4, essas mudanças se aplicam imediatamente à sua conta - nenhuma ação necessária.
3 de julho de 2025
Lançamos blocos de conteúdo de resultado de busca em beta, permitindo citações naturais para aplicações RAG. Ferramentas agora podem retornar resultados de busca com atribuição adequada de fonte, e o Claude citará automaticamente essas fontes em suas respostas - igualando a qualidade de citação da busca na web. Isso elimina a necessidade de soluções alternativas com documentos em aplicações de base de conhecimento personalizadas. Saiba mais em Resultados de busca. Para habilitar este recurso, use o cabeçalho beta search-results-2025-06-09.
Usuários do Console com a função Developer agora podem acessar a página de Custo. Anteriormente, a função Developer permitia acesso à página de Uso, mas não à página de Custo.
11 de junho de 2025
Lançamos o streaming refinado de ferramentas em beta público, um recurso que permite ao Claude fazer streaming de parâmetros de uso de ferramentas sem buffering / validação JSON. Para habilitar o streaming refinado de ferramentas, use o cabeçalho betafine-grained-tool-streaming-2025-05-14.
O comportamento padrão do pensamento estendido nos modelos Claude 4 retorna um resumo do processo completo de pensamento do Claude, com o pensamento completo criptografado e retornado no campo signature da saída do bloco thinking.
Lançamos o interleaved thinking (pensamento intercalado) em beta público, um recurso que permite ao Claude pensar entre chamadas de ferramentas. Para habilitar o pensamento intercalado, use o cabeçalho betainterleaved-thinking-2025-05-14.
Lançamos a Files API em beta público, permitindo que você faça upload de arquivos e os referencie na Messages API e na ferramenta de execução de código.
Lançamos a ferramenta de execução de código em beta público, uma ferramenta que permite ao Claude executar código Python em um ambiente seguro e isolado (sandbox).
Lançamos o conector MCP em beta público, um recurso que permite conectar-se a servidores MCP remotos diretamente da Messages API.
Para aumentar a qualidade das respostas e diminuir erros de ferramentas, alteramos o valor padrão do parâmetro top_p de nucleus sampling (amostragem de núcleo) na Messages API de 0.999 para 0.99 em todos os modelos. Para reverter essa alteração, defina top_p como 0.999.
Além disso, quando o pensamento estendido está habilitado, agora você pode definir top_p com valores entre 0.95 e 1.
Movemos nosso SDK para Go de beta para disponibilidade geral (GA).
Incluímos granularidade em nível de minuto e hora na página de Uso do Console, juntamente com taxas de erro 429 na página de Uso.
21 de maio de 2025
Movemos nosso SDK para Ruby de beta para disponibilidade geral (GA).
7 de maio de 2025
Lançamos uma ferramenta de busca na web na API, permitindo que o Claude acesse informações atualizadas da web. Saiba mais em Ferramenta de busca na web.
1º de maio de 2025
O cache control agora deve ser especificado diretamente no bloco content pai de tool_result e document.source. Para compatibilidade com versões anteriores, se o cache control for detectado no último bloco em tool_result.content ou document.source.content, ele será automaticamente aplicado ao bloco pai. O cache control em quaisquer outros blocos dentro de tool_result.content e document.source.content resultará em um erro de validação.
Adicionamos blocos de origem por URL para imagens e PDFs na Messages API. Agora você pode referenciar imagens e PDFs diretamente por meio de uma URL, em vez de precisar codificá-los em base64. Saiba mais em Visão e Suporte a PDF.
Adicionamos suporte para uma opção none ao parâmetro tool_choice na Messages API, que impede o Claude de chamar qualquer ferramenta. Além disso, não é mais necessário fornecer tools ao incluir blocos tool_use e tool_result.
Lançamos um endpoint de API compatível com OpenAI, permitindo que você teste modelos Claude alterando apenas sua chave de API, URL base e nome do modelo em integrações OpenAI existentes. Essa camada de compatibilidade oferece suporte à funcionalidade principal de chat completions. Saiba mais em Compatibilidade com o SDK da OpenAI.
24 de fevereiro de 2025
Lançamos o Claude Sonnet 3.7, nosso modelo mais inteligente até agora. O Claude Sonnet 3.7 pode produzir respostas quase instantâneas ou mostrar seu pensamento estendido passo a passo. Um modelo, duas formas de pensar. Saiba mais sobre todos os modelos Claude em Visão geral dos modelos.
Adicionamos suporte a visão ao Claude Haiku 3.5, permitindo que o modelo analise e compreenda imagens.
Lançamos uma implementação de uso de ferramentas eficiente em tokens, melhorando o desempenho geral ao usar ferramentas com o Claude. Saiba mais em Uso de ferramentas com o Claude.
Alteramos a temperatura padrão no Console para novos prompts de 0 para 1, para manter consistência com a temperatura padrão na API. Prompts salvos existentes permanecem inalterados.
Lançamos versões atualizadas de nossas ferramentas que desacoplam as ferramentas de edição de texto e bash do prompt do sistema de uso de computador:
bash_20250124: Mesma funcionalidade da versão anterior, mas independente do uso de computador. Não requer um cabeçalho beta.
text_editor_20250124: Mesma funcionalidade da versão anterior, mas independente do uso de computador. Não requer um cabeçalho beta.
computer_20250124: Ferramenta de uso de computador atualizada com novas opções de comando, incluindo "hold_key", "left_mouse_down", "left_mouse_up", "scroll", "triple_click" e "wait". Essa ferramenta requer o cabeçalho anthropic-beta "computer-use-2025-01-24".
Saiba mais em Uso de ferramentas com o Claude.
10 de fevereiro de 2025
Adicionamos o cabeçalho de resposta anthropic-organization-id a todas as respostas da API. Esse cabeçalho fornece o ID da organização associado à chave de API usada na requisição.
Lançamos a capacidade de citações na API, permitindo que o Claude forneça atribuição de fonte para informações. Saiba mais em Citações.
Adicionamos suporte para documentos de texto simples e documentos de conteúdo personalizado na Messages API.
21 de janeiro de 2025
Anunciamos a descontinuação dos modelos Claude 2, Claude 2.1 e Claude Sonnet 3. Leia mais em Descontinuações de modelos.
15 de janeiro de 2025
Atualizamos o cache de prompt para ser mais fácil de usar. Agora, quando você define um ponto de interrupção de cache, leremos automaticamente do seu prefixo mais longo previamente armazenado em cache.
Agora você pode colocar palavras na boca do Claude ao usar ferramentas.
Adicionamos a capacidade de agrupar por chave de API nas páginas de Uso e Custo do Developer Console.
Adicionamos duas novas colunas, Último uso em e Custo, e a capacidade de ordenar por qualquer coluna na página de chaves de API do Developer Console.
21 de novembro de 2024
Lançamos a Admin API, permitindo que usuários gerenciem programaticamente os recursos de sua organização.
20 de novembro de 2024
Atualizamos nossos limites de taxa para a Messages API. Substituímos o limite de taxa de tokens por minuto por novos limites de taxa de tokens de entrada e de saída por minuto. Leia mais em Limites de taxa.
O Claude Haiku 3.5 agora está disponível na Claude API como um modelo somente de texto.
1º de novembro de 2024
Adicionamos suporte a PDF para uso com o novo Claude Sonnet 3.5. Leia mais em Suporte a PDF.
Também adicionamos contagem de tokens, que permite determinar o número total de tokens em uma Mensagem antes de enviá-la ao Claude. Leia mais em Contagem de tokens.
22 de outubro de 2024
Adicionamos ferramentas de uso de computador definidas pela Anthropic à nossa API para uso com o novo Claude Sonnet 3.5. Leia mais em Ferramenta de uso de computador.
O Claude Sonnet 3.5, nosso modelo mais inteligente até agora, acabou de receber uma atualização e agora está disponível na Claude API. Leia mais na documentação do Claude Sonnet.
8 de outubro de 2024
A Message Batches API agora está disponível em beta. Processe grandes lotes de consultas de forma assíncrona na Claude API por 50% menos custo. Leia mais em Processamento em lote.
Flexibilizamos as restrições sobre a ordem dos turnos user/assistant em nossa Messages API. Mensagens user/assistant consecutivas serão combinadas em uma única mensagem em vez de gerar erro, e não exigimos mais que a primeira mensagem de entrada seja uma mensagem user.
Descontinuamos os planos Build e Scale em favor de um conjunto padrão de recursos (anteriormente chamado de Build), juntamente com recursos adicionais disponíveis por meio da equipe de vendas. Leia mais em nossas informações de preços da API.
3 de outubro de 2024
Adicionamos a capacidade de desabilitar o uso paralelo de ferramentas na API. Defina disable_parallel_tool_use: true no campo tool_choice para garantir que o Claude use no máximo uma ferramenta. Leia mais em Uso paralelo de ferramentas.
10 de setembro de 2024
Adicionamos Workspaces ao Developer Console. Workspaces permitem que você defina limites personalizados de gastos ou de taxa, agrupe chaves de API, acompanhe o uso por projeto e controle o acesso com funções de usuário. Leia mais em nosso post no blog.
Adicionamos suporte para uso do SDK em navegadores, retornando cabeçalhos CORS nas respostas da API. Defina dangerouslyAllowBrowser: true na instanciação do SDK para habilitar esse recurso.
19 de agosto de 2024
Movemos as saídas de 8.192 tokens de beta para disponibilidade geral no Claude Sonnet 3.5.
14 de agosto de 2024
O cache de prompt agora está disponível como um recurso beta na Claude API. Armazene em cache e reutilize prompts para reduzir a latência em até 80% e os custos em até 90%.
15 de julho de 2024
Gere saídas de até 8.192 tokens de comprimento com o Claude Sonnet 3.5 usando o novo cabeçalho anthropic-beta: max-tokens-3-5-sonnet-2024-07-15.
9 de julho de 2024
Gere automaticamente casos de teste para seus prompts usando o Claude no Developer Console.
Compare as saídas de diferentes prompts lado a lado no novo modo de comparação de saídas no Developer Console.
27 de junho de 2024
Visualize o uso e o faturamento da API detalhados por valor em dólar, contagem de tokens e chaves de API nas novas abas de Uso e Custo no Developer Console.
O Claude Sonnet 3.5, nosso modelo mais inteligente até agora, agora está em disponibilidade geral na Claude API, no Amazon Bedrock e no Vertex AI.
30 de maio de 2024
O uso de ferramentas agora está em disponibilidade geral na Claude API, no Amazon Bedrock e no Vertex AI.
10 de maio de 2024
Nossa ferramenta geradora de prompts agora está disponível no Developer Console. O Prompt Generator facilita orientar o Claude a gerar prompts de alta qualidade adaptados às suas tarefas específicas. Leia mais em nosso post no blog.