Claude Platform Docs
Modelos e preçosClaude Haiku 5.5

Novidades do Claude Haiku 5.5

Visão geral dos novos recursos, mudanças incompatíveis e mudanças de comportamento no Claude Haiku 5.5, com um link para o guia de cada recurso e para o guia de migração para alterações de código.

O Claude Haiku 5.5 foi criado para trabalhos de alto volume e sensíveis à latência, como classificação, roteamento, extração e tarefas de subagentes. Ele oferece suporte a "adaptive thinking" (pensamento adaptativo) com o parâmetro "effort" (esforço), uma "context window" (janela de contexto) de 1M tokens e até 128k tokens de saída. Ele usa o mesmo tokenizador mais recente do Claude 4.7 e modelos posteriores, portanto o mesmo texto conta como aproximadamente 30% mais tokens do que no Claude Haiku 4.5. Seus blocos de pensamento funcionam apenas na conta que os produziu ou em uma conta vinculada a ela.

Para alterações de código, consulte o guia de migração. Para IDs de modelo, preços e limites, consulte a visão geral do Claude Haiku 5.5. Para orientações sobre prompts, consulte Prompting do Claude Haiku 5.5.

Resumo das mudanças em relação ao Claude Haiku 4.5

Cada linha nomeia uma mudança, indica se ela é nova, alterada ou incompatível, e o que seu código precisa fazer.

MudançaTipoAção necessária
Pensamento adaptativo e esforçoNovaOpcional: defina effort para equilibrar a qualidade da resposta com velocidade e custo.
Janela de contexto e saída maioresNovaNenhuma. Os valores existentes de max_tokens continuam válidos, mas os tokens de pensamento contam para eles.
Ferramenta de uso do navegadorNovaNenhuma. Disponível na Claude API e no Google Cloud.
Classificadores de segurança podem recusar uma requisiçãoNovaTrate stop_reason: "refusal" no seu cliente. O fallback no lado do servidor não está disponível.
O pensamento estendido manual retorna um erroIncompatívelSubstitua budget_tokens pelo pensamento adaptativo.
Parâmetros de amostragem não padrão retornam um erroIncompatívelOmita temperature, top_p e top_k.
O preenchimento prévio de mensagem do assistente retorna um erroIncompatívelTermine messages com um turno do usuário.
O uso de computador precisa do toolset na Claude API e no Google CloudIncompatívelSubstitua computer_20250124 por computer_toolset_20260801.
Alterar turnos anteriores invalida os blocos de pensamentoIncompatívelMantenha as conversas apenas com acréscimos se você enviar blocos de pensamento de volta.
As respostas podem começar com blocos de pensamentoAlteradaSelecione blocos de conteúdo por type, não por posição.
O texto de pensamento é omitido por padrãoAlteradaPara receber o pensamento resumido, defina thinking.display como "summarized".
O mesmo texto conta como mais tokensAlteradaReconte os prompts e revise max_tokens e as estimativas de custo.
Reprodução de blocos de pensamento entre contasAlteradaSe você reproduzir conversas armazenadas por meio de uma conta diferente, reproduza cada uma por meio da conta que a produziu.

Novos recursos

Pensamento adaptativo e esforço

Com o pensamento adaptativo, o Claude Haiku 5.5 decide quando e quanto pensar. O pensamento adaptativo está ativado por padrão. Embora você ainda possa desativar o pensamento com thinking: {"type": "disabled"} no esforço high ou inferior, a melhor maneira de equilibrar a qualidade da resposta com velocidade e custo é usar o parâmetro effort.

Janela de contexto e saída maiores

O Claude Haiku 5.5 tem uma janela de contexto de 1M tokens e retorna até 128k tokens de saída, acima dos 200k e 64k do Claude Haiku 4.5. Os valores existentes de max_tokens continuam válidos, mas os tokens de pensamento contam para max_tokens, então um limite pequeno pode parar após um bloco thinking e antes de qualquer texto. Consulte Configure o pensamento.

Mudanças de comportamento

As respostas podem começar com blocos de pensamento

O pensamento adaptativo está ativado por padrão, então uma resposta pode começar com um ou mais blocos thinking mesmo quando a requisição não menciona pensamento. Código que lê o primeiro bloco de conteúdo como a resposta precisa selecionar os blocos pelo campo type. Consulte Configure o pensamento no guia de migração.

O mesmo texto conta como mais tokens

O Claude Haiku 5.5 usa o mesmo tokenizador mais recente do Claude 4.7 e modelos posteriores. Como em todos os modelos que usam esse tokenizador, o mesmo texto de entrada produz aproximadamente 30% mais tokens no Claude Haiku 5.5 do que no Claude Haiku 4.5. O aumento exato depende do conteúdo. O formato das requisições e respostas não depende do tokenizador, mas tudo o que você mede ou orça em tokens muda. Consulte Reconte os tokens no guia de migração.

Reprodução de blocos de pensamento entre contas

Os blocos de pensamento do Claude Haiku 5.5 funcionam apenas na conta que os produziu ou em uma conta vinculada a ela. Isso só importa se você armazena conversas e as reproduz por meio de uma conta diferente. Consulte Reproduza blocos de pensamento por meio da conta que os produziu.

Was this page helpful?