Novidades do Claude Haiku 5.5
Visão geral dos novos recursos, mudanças incompatíveis e mudanças de comportamento no Claude Haiku 5.5, com um link para o guia de cada recurso e para o guia de migração para alterações de código.
O Claude Haiku 5.5 foi criado para trabalhos de alto volume e sensíveis à latência, como classificação, roteamento, extração e tarefas de subagentes. Ele oferece suporte a "adaptive thinking" (pensamento adaptativo) com o parâmetro "effort" (esforço), uma "context window" (janela de contexto) de 1M tokens e até 128k tokens de saída. Ele usa o mesmo tokenizador mais recente do Claude 4.7 e modelos posteriores, portanto o mesmo texto conta como aproximadamente 30% mais tokens do que no Claude Haiku 4.5. Seus blocos de pensamento funcionam apenas na conta que os produziu ou em uma conta vinculada a ela.
Para alterações de código, consulte o guia de migração. Para IDs de modelo, preços e limites, consulte a visão geral do Claude Haiku 5.5. Para orientações sobre prompts, consulte Prompting do Claude Haiku 5.5.
Resumo das mudanças em relação ao Claude Haiku 4.5
Cada linha nomeia uma mudança, indica se ela é nova, alterada ou incompatível, e o que seu código precisa fazer.
| Mudança | Tipo | Ação necessária |
|---|---|---|
| Pensamento adaptativo e esforço | Nova | Opcional: defina effort para equilibrar a qualidade da resposta com velocidade e custo. |
| Janela de contexto e saída maiores | Nova | Nenhuma. Os valores existentes de max_tokens continuam válidos, mas os tokens de pensamento contam para eles. |
| Ferramenta de uso do navegador | Nova | Nenhuma. Disponível na Claude API e no Google Cloud. |
| Classificadores de segurança podem recusar uma requisição | Nova | Trate stop_reason: "refusal" no seu cliente. O fallback no lado do servidor não está disponível. |
| O pensamento estendido manual retorna um erro | Incompatível | Substitua budget_tokens pelo pensamento adaptativo. |
| Parâmetros de amostragem não padrão retornam um erro | Incompatível | Omita temperature, top_p e top_k. |
| O preenchimento prévio de mensagem do assistente retorna um erro | Incompatível | Termine messages com um turno do usuário. |
| O uso de computador precisa do toolset na Claude API e no Google Cloud | Incompatível | Substitua computer_20250124 por computer_toolset_20260801. |
| Alterar turnos anteriores invalida os blocos de pensamento | Incompatível | Mantenha as conversas apenas com acréscimos se você enviar blocos de pensamento de volta. |
| As respostas podem começar com blocos de pensamento | Alterada | Selecione blocos de conteúdo por type, não por posição. |
| O texto de pensamento é omitido por padrão | Alterada | Para receber o pensamento resumido, defina thinking.display como "summarized". |
| O mesmo texto conta como mais tokens | Alterada | Reconte os prompts e revise max_tokens e as estimativas de custo. |
| Reprodução de blocos de pensamento entre contas | Alterada | Se você reproduzir conversas armazenadas por meio de uma conta diferente, reproduza cada uma por meio da conta que a produziu. |
Novos recursos
Pensamento adaptativo e esforço
Com o pensamento adaptativo, o Claude Haiku 5.5 decide quando e quanto pensar. O pensamento adaptativo está ativado por padrão. Embora você ainda possa desativar o pensamento com thinking: {"type": "disabled"} no esforço high ou inferior, a melhor maneira de equilibrar a qualidade da resposta com velocidade e custo é usar o parâmetro effort.
Janela de contexto e saída maiores
O Claude Haiku 5.5 tem uma janela de contexto de 1M tokens e retorna até 128k tokens de saída, acima dos 200k e 64k do Claude Haiku 4.5. Os valores existentes de max_tokens continuam válidos, mas os tokens de pensamento contam para max_tokens, então um limite pequeno pode parar após um bloco thinking e antes de qualquer texto. Consulte Configure o pensamento.
Mudanças de comportamento
As respostas podem começar com blocos de pensamento
O pensamento adaptativo está ativado por padrão, então uma resposta pode começar com um ou mais blocos thinking mesmo quando a requisição não menciona pensamento. Código que lê o primeiro bloco de conteúdo como a resposta precisa selecionar os blocos pelo campo type. Consulte Configure o pensamento no guia de migração.
O mesmo texto conta como mais tokens
O Claude Haiku 5.5 usa o mesmo tokenizador mais recente do Claude 4.7 e modelos posteriores. Como em todos os modelos que usam esse tokenizador, o mesmo texto de entrada produz aproximadamente 30% mais tokens no Claude Haiku 5.5 do que no Claude Haiku 4.5. O aumento exato depende do conteúdo. O formato das requisições e respostas não depende do tokenizador, mas tudo o que você mede ou orça em tokens muda. Consulte Reconte os tokens no guia de migração.
Reprodução de blocos de pensamento entre contas
Os blocos de pensamento do Claude Haiku 5.5 funcionam apenas na conta que os produziu ou em uma conta vinculada a ela. Isso só importa se você armazena conversas e as reproduz por meio de uma conta diferente. Consulte Reproduza blocos de pensamento por meio da conta que os produziu.
Was this page helpful?