O que há de novo no Claude Fable 5.1
Visão geral dos novos recursos, mudanças incompatíveis e melhorias de capacidade no Claude Fable 5.1 e no Claude Mythos 5.1.
O Claude Fable 5.1 estende o Claude Fable 5 com os mesmos preços de entrada e saída, com leituras de cache a um quarto do custo, e traz codificação agêntica de longa duração mais robusta, pesquisa em várias etapas e trabalho com documentos, planilhas e slides. Para a maioria das cargas de trabalho, comece com o Claude Opus 5 (consulte Escolhendo um modelo). Use o Claude Fable 5.1 para raciocínio exigente e trabalho agêntico de longo horizonte, ou quando suas avaliações no Claude Opus 5 com esforço mais alto ainda ficarem aquém. O Claude Mythos 5.1 oferece as mesmas capacidades apenas aos participantes do Project Glasswing.
Se você já chama o Claude Fable 5, três mudanças são incompatíveis: o uso forçado de ferramentas retorna um erro, modelos anteriores não conseguem ler seus blocos de pensamento e editar turnos anteriores invalida os blocos de pensamento. Cinco são aditivas: esforço por mensagem (beta), mensagens de sistema com escopo de turno (beta), atualizações de progresso legíveis entre chamadas de ferramentas (display: "updates", beta), um preço de leitura de cache mais baixo e proveniência de conteúdo.
Modelos
| Modelo | ID na Claude API | Descrição | Disponibilidade |
|---|---|---|---|
| Claude Fable 5.1 | Sucessor do Claude Fable 5, para codificação agêntica de longa duração, trabalho de conhecimento e pesquisa | Todos os clientes, na Claude API e nas plataformas parceiras | |
| Claude Mythos 5.1 | Mesmas capacidades do Claude Fable 5.1. Sucessor do Claude Mythos 5. | Apenas participantes do Project Glasswing |
O Claude Fable 5.1 e o Claude Mythos 5.1 compartilham especificações e preços:
- Janela de contexto e saída: uma "context window" (janela de contexto) de 1M de tokens (padrão e máxima) com preço padrão por token em toda a janela, e 128k tokens de saída no máximo.
- Pensamento: o "adaptive thinking" (pensamento adaptativo) está sempre ativado. Use o parâmetro effort para controlar a profundidade do pensamento.
- Preços: os mesmos do Claude Fable 5, exceto por um preço de leitura de cache mais baixo.
- Tokenizador: o mesmo do Claude Fable 5 (introduzido com o Claude Opus 4.7). Em comparação com modelos mais antigos que o Claude Opus 4.7, o mesmo texto produz aproximadamente 30% mais tokens. Consulte Contagem de tokens.
Para todos os modelos atuais, consulte a visão geral dos modelos.
Mudanças incompatíveis
O uso forçado de ferramentas não é suportado
O Claude Fable 5.1 e o Claude Mythos 5.1 não suportam "forced tool use" (uso forçado de ferramentas). tool_choice definido como {"type": "any"} ou {"type": "tool", "name": "..."} retorna um erro 400 invalid_request_error:
tool_choice: type "tool" and "any" are not supported for this model.tool_choice: {"type": "auto"} (o padrão) e {"type": "none"} permanecem inalterados. A mesma validação se aplica ao endpoint de contagem de tokens.
O pensamento está sempre ativado para esses modelos, e uma chamada de ferramenta forçada o ignoraria. O modelo escreveria seu raciocínio nos argumentos da ferramenta, o que reduz a qualidade dos argumentos. Para JSON válido conforme o schema, mantenha tool_choice: {"type": "auto"} e defina strict: true com o uso estrito de ferramentas, ou mova o schema para saídas estruturadas. Para fazer o modelo chamar uma ferramenta em vez de responder em texto, indique no prompt quando a ferramenta se aplica (por exemplo, "Use a ferramenta get_weather para responder"). O Claude Fable 5.1 segue instruções explícitas de ferramentas de forma confiável.
Modelos anteriores não conseguem ler os blocos de pensamento do Claude Fable 5.1
Cada "thinking block" (bloco de pensamento) registra qual modelo o produziu, e ele é preservado em apenas uma direção: o Claude Fable 5.1 lê os blocos de pensamento de modelos anteriores, e nenhum modelo anterior lê os do Claude Fable 5.1. Uma conversa que passa para o Claude Fable 5.1 (a partir do Claude Opus 5, do Claude Fable 5 ou de qualquer modelo Claude anterior) mantém seu raciocínio. Uma conversa que passa do Claude Fable 5.1 para qualquer um desses modelos o perde nos turnos executados lá.
Quando uma requisição carrega um bloco que o modelo de destino não consegue ler (um roteador ou fallback que troca de modelo no meio da conversa, por exemplo), a API descarta o bloco antes que o modelo o veja. Blocos descartados não contam para input_tokens e não são cobrados. Com o cabeçalho beta thinking-binding-controls-2026-08-01, o descarte é relatado em um array input_transformations de nível superior. Sem ele, o descarte é silencioso. Consulte Pensamento preservado.
Editar turnos anteriores invalida os blocos de pensamento
Modificar qualquer coisa antes de um bloco de pensamento do Claude Fable 5.1 (o prompt system, as tools ou uma mensagem anterior) resulta em um erro na próxima requisição, ou no descarte do bloco se você optar por isso. O Claude Mythos 5.1 não executa essa verificação. O Claude Code, o claude.ai, o Claude Managed Agents e o Claude Agent SDK mantêm esse prefixo intacto para você. Se o seu código monta o array messages por conta própria, verifique-o antes de migrar: Pensamento preservado percorre a verificação e cada correção. A verificação é aplicada a novas contas criadas em ou após 31 de agosto de 2026. Para contas criadas antes, a API registra a incompatibilidade, mas só age sobre ela quando a requisição define thinking.block_binding.prefix_mismatch_behavior.
Estes padrões invalidam todos os blocos de pensamento posteriores:
- Editar, reordenar ou remover um turno anterior mantendo os posteriores.
- Injetar texto por requisição em um turno anterior (um lembrete ou linha de status) que você remove na próxima requisição.
- Reconstruir o prompt
systemde nível superior ou o arraytoolsentre requisições na mesma conversa. - Uma URL de imagem ou documento que serve bytes diferentes em uma requisição posterior (a verificação cobre os bytes, não a URL, portanto uma URL assinada rotativa para o mesmo arquivo não é problema).
Estes mantêm os blocos posteriores válidos: remover uma sequência inicial de blocos de pensamento (os mais antigos primeiro), deixar a compactação do lado do servidor ou a edição de contexto reduzir o histórico, mover marcadores cache_control e alterar effort entre requisições. Remover um bloco de pensamento de qualquer lugar que não seja o início da sequência invalida todos os blocos de pensamento depois dele.
Onde a verificação é aplicada, uma requisição que reenvia um bloco invalidado é rejeitada com um 400 cuja mensagem diz The block is bound to a different conversation. Para descartar o bloco e continuar, envie o cabeçalho beta thinking-binding-controls-2026-08-01 com thinking.block_binding.prefix_mismatch_behavior: "drop_block". O descarte é relatado em input_transformations com reason: "prefix_binding_mismatch".
Para manter o pensamento válido ao longo de uma sessão longa, trate a conversa como somente de acréscimo (append-only). Adicione instruções com uma mensagem de sistema no meio da conversa (com escopo de turno se ela deve se aplicar a apenas um turno) e altere ferramentas com alterações de ferramentas no meio da conversa em vez de editar system ou tools. Reduza o contexto com a edição de contexto ou a compactação do lado do servidor, que não contam como edições. Esses padrões também mantêm o "prompt cache" (cache de prompt) aquecido. Para descobrir se sua integração edita o histórico, execute uma sessão com prefix_mismatch_behavior: "drop_block" e registre input_transformations: o guia de migração tem a verificação em três etapas. Consulte Pensamento preservado para as regras completas.
Novos recursos
Alterar o esforço no meio da conversa (beta)
No Claude Fable 5.1, você pode alterar o nível de "effort" (esforço) no meio da conversa sem invalidar o cache de prompt. Aumente-o para uma etapa difícil e reduza-o para as rotineiras. O esforço por mensagem está em beta: inclua o cabeçalho beta mid-conversation-output-config-2026-07-01. O Claude Fable 5.1, o Claude Mythos 5.1 e o Claude Opus 5 o suportam na Claude API.
client = anthropic.Anthropic()
response = client.beta.messages.create(
model="claude-fable-5-1",
max_tokens=4096,
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
},
{
"role": "assistant",
"content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
},
# Mensagem do sistema apenas com effort: o novo nível entra em vigor a partir do próximo turno do usuário.
{"role": "system", "content": [], "output_config": {"effort": "low"}},
{"role": "user", "content": "Summarize the plan in one sentence."},
],
betas=["mid-conversation-output-config-2026-07-01"],
)
for block in response.content:
if block.type == "text":
print(block.text)Consulte Esforço por mensagem para detalhes.
Mensagens de sistema com escopo de turno (beta)
Uma mensagem de sistema no meio da conversa pode ter escopo de um único turno. Defina clear_at: "next_user_message" em uma mensagem role: "system" e seu texto carrega a autoridade de prompt do sistema para o turno atual, depois deixa de ser renderizado assim que existir uma mensagem user posterior. A mensagem permanece em messages e você continua enviando-a de volta literalmente, portanto nada anterior na conversa muda. O cache de prompt continua correspondendo, os blocos de pensamento posteriores permanecem válidos e uma mensagem limpa não custa tokens de entrada. Use-a para lembretes por turno em um loop de ferramentas ("verifique sua caixa de entrada antes de executar mais código", "o usuário não consegue ver a saída dessa ferramenta") em vez de injetar texto no histórico e excluí-lo na próxima requisição. As mensagens de sistema com escopo de turno estão em beta: inclua o cabeçalho beta mid-conversation-system-clear-at-2026-08-21. Consulte Mensagens de sistema com escopo de turno.
{
"role": "system",
"clear_at": "next_user_message",
"content": "Results have landed in your inbox. Check it before running more code."
}Atualizações de progresso entre chamadas de ferramentas (beta)
Assim como o Claude Fable 5, o Claude Fable 5.1 escreve breves atualizações de progresso entre chamadas de ferramentas sobre o que encontrou e o que fará em seguida, embora em menor quantidade (consulte O que mudou em relação ao Claude Fable 5). Cada atualização chega como seu próprio bloco thinking imediatamente antes da chamada de ferramenta. Com o thinking.display padrão de "omitted", esses blocos retornam vazios, como o raciocínio, portanto um turno agêntico longo pode parecer silencioso para seus usuários. A novidade é a opção display: "updates": defina-a com o cabeçalho beta thinking-display-updates-2026-08-18 para receber as atualizações de progresso como texto enquanto o raciocínio permanece oculto. Qualquer bloco thinking com texto não vazio é então uma linha de status que você pode mostrar ao usuário. "summarized" também as retorna, misturadas com o raciocínio resumido. Consulte Atualizações de progresso entre chamadas de ferramentas.
Proveniência de conteúdo
O texto gerado pelo Claude Fable 5.1 e pelo Claude Mythos 5.1 carrega a marca d'água estatística de texto da Anthropic em todas as plataformas onde o modelo está disponível. Os arquivos de imagem e vídeo suportados que o Claude produz (por meio da ferramenta de execução de código, por exemplo) carregam Content Credentials C2PA assinadas quando você os recupera por meio da Files API na Claude API.
A marca d'água não altera o significado, a qualidade ou a legibilidade da saída. Ela não adiciona tokens nem caracteres ocultos, não carrega nenhuma informação sobre você ou sua organização e não exige alterações em suas requisições ou respostas. Para mais contexto, consulte Como o Claude marca conteúdo gerado por IA e Como funciona a marca d'água de texto do Claude.
Diferenças de comportamento
O que mudou em relação ao Claude Fable 5
O Claude Fable 5.1 difere do Claude Fable 5 de várias maneiras que aparecem sem nenhuma alteração de código. Cada uma tem uma correção de prompt em Prompting do Claude Fable 5.1:
- A chamada paralela de ferramentas é mais variável. O Claude Fable 5.1 pode emitir uma chamada de ferramenta por turno onde o Claude Fable 5 agrupava várias. Isso aparece em loops de agente longos em que as próximas leituras independentes estão apenas implícitas: agentes de codificação personalizados, harnesses de bash e editor, uso de computador. Os turnos extras custam tokens, viagens de ida e volta e tempo de relógio, mas não reduzem a qualidade da resposta. Requisições que nomeiam várias coisas a buscar ainda são executadas em paralelo. Adicione a instrução de agrupamento de uma linha de Agrupe chamadas de ferramentas independentes em loops de agente.
- Menos atualizações de progresso durante execuções longas de ferramentas. O modelo escreve menos texto voltado ao usuário entre chamadas de ferramentas, especialmente com esforço mais alto. Defina
thinking.displaycomo"updates"(beta) para receber as atualizações de progresso que ele escreve, e remova qualquer linha de prompt que o instrua a guardar as descobertas para a resposta final. Se sua interface depende de narração, peça explicitamente uma linha de abertura, atualizações periódicas e uma recapitulação final. Consulte Peça atualizações de progresso voltadas ao usuário. - Responde de memória com mais frequência no esforço
low. No nível de esforço mais baixo, o modelo chama uma ferramenta de busca ou recuperação com menos frequência. Aumente o esforço para turnos que precisam de informações atualizadas, inclusive no meio da conversa, ou adicione o estímulo de verificação de Acionamento de busca com esforço baixo. - Prosa mais densa em alguns pontos. Em alguns casos, sua prosa é mais densa que a do Claude Fable 5, com frases mais longas e menos quebras de parágrafo. Consulte Densidade da escrita.
- Menos formatação no chat. O modelo usa negrito, cabeçalhos e listas menos do que os modelos Claude anteriores, portanto regras antiformatação escritas para esses modelos podem suprimir a estrutura de que o conteúdo precisa. Consulte Formatação no chat.
- Citações não marcadas em resumos. Ao resumir documentos, o modelo tem maior probabilidade de reproduzir trechos da fonte sem marcá-los como citações. Consulte Citando fontes recuperadas.
- Reescritas de arquivo inteiro para pequenas alterações. Ao editar arquivos de texto, o modelo tem maior probabilidade de reescrever o arquivo inteiro do que fazer uma edição pontual. O resultado geralmente é o mesmo, mas a reescrita custa mais tokens de saída e tempo. Consulte Prefira edições pontuais a reescritas de arquivo inteiro.
O que não mudou em relação ao Claude Fable 5
Estes comportamentos da Messages API são mantidos do Claude Fable 5 sem alterações:
- O pensamento adaptativo está sempre ativado.
thinking: {"type": "enabled"}combudget_tokensethinking: {"type": "disabled"}retornam ambos um erro 400. Omitathinkingou envie{"type": "adaptive"}. thinking.displaytem como padrão"omitted"."summarized"está disponível, e a cadeia de pensamento bruta nunca é retornada.- O raciocínio entre chamadas de ferramentas aparece em blocos de pensamento em vez de texto, e o pensamento intercalado é automático, sem cabeçalho beta.
- Preencher previamente a resposta do assistente retorna um erro 400.
- Valores não padrão de
temperature,top_poutop_kretornam um erro 400. - O comprimento mínimo de prompt armazenável em cache é de 512 tokens.
- Mensagens de sistema no meio da conversa e alterações de ferramentas são suportadas.
Melhorias de capacidade
O Claude Fable 5.1 melhora em relação ao Claude Fable 5, e a diferença é maior nos níveis de esforço mais altos. Os ganhos se concentram em seis áreas:
- Codificação agêntica em sessões longas, incluindo funcionalidades em vários arquivos, grandes refatorações e migrações, depuração e revisão de código em sessões que duram horas.
- Trabalho de conhecimento com documentos, planilhas e slides, levando uma análise de uma primeira pergunta a um documento finalizado, uma planilha com fórmulas ativas ou uma apresentação de slides construída a partir de uma página em branco.
- Pesquisa e busca, com maior precisão em pesquisa web em várias etapas e tarefas de pesquisa aprofundada que dão seguimento ao que encontram.
- Visão, lendo gráficos densos, documentos regulatórios e tabelas aninhadas em PDFs, inclusive com ferramentas de recorte e zoom em gráficos.
- Trabalho com contexto longo, raciocinando sobre e conectando detalhes ao longo de toda a janela de contexto de 1M de tokens.
- Uso de computador, operando um navegador e aplicativos de desktop de forma mais confiável e se recuperando de etapas que falharam.
O desempenho multilíngue está no mesmo nível do Claude Fable 5.
Recusas, fallback e cobrança
O Claude Fable 5.1 inclui classificadores de segurança que cobrem as mesmas categorias de stop_details do Claude Fable 5, e tudo em Recusas e fallback se aplica. Ele pode retornar stop_reason: "refusal", portanto trate as recusas e configure o fallback.
- Recusas: uma requisição recusada retorna HTTP 200 com
stop_reason: "refusal"e um objetostop_detailsque nomeia a área de política acionada. - Fallback: tente novamente uma requisição recusada em outro modelo com o fallback do lado do servidor, o middleware do SDK ou sua própria nova tentativa.
fallbacks: "default"(beta) tenta novamente uma requisição recusada no modelo que a Anthropic recomenda para aquela categoria. Os destinos de fallback permitidos para o Claude Fable 5.1 são o Claude Opus 4.8 e o Claude Opus 5. - Cobrança: você não é cobrado por uma recusa que chega antes de qualquer saída e, para o Claude Fable 5.1, o crédito de fallback reembolsa o custo de cache de prompt da troca de modelos.
Preços
O Claude Fable 5.1 e o Claude Mythos 5.1 têm os mesmos preços do Claude Fable 5, exceto pelas leituras de cache (preços em USD):
| Entrada base | Gravações de cache de 5m | Gravações de cache de 1h | Leituras de cache | Saída |
|---|---|---|---|---|
| $10 / MTok | $12,50 / MTok | $20 / MTok | $0,25 / MTok | $50 / MTok |
As leituras de cache (acertos e atualizações) custam 0,025 vezes o preço de entrada base nesses modelos, em comparação com 0,1 nos outros modelos Claude. Sessões agênticas longas que releem um prefixo em cache pagam um quarto da tarifa do Claude Fable 5. As gravações de cache e o comprimento mínimo de prompt armazenável em cache de 512 tokens permanecem inalterados.
O processamento em lote custa $5 USD por milhão de tokens de entrada e $25 USD por milhão de tokens de saída. Consulte Preços para residência de dados e preços de ferramentas.
Disponibilidade
O Claude Fable 5.1 está disponível em:
- Claude API: todos os clientes, como
claude-fable-5-1. - AWS: Claude no Amazon Bedrock, como
anthropic.claude-fable-5-1, e Claude Platform na AWS, comoclaude-fable-5-1. - Google Cloud: Claude no Google Cloud, como
claude-fable-5-1. - Microsoft Foundry: Claude no Microsoft Foundry, na infraestrutura da Anthropic.
O Claude Mythos 5.1 é oferecido apenas a clientes aprovados no Project Glasswing. Para obter acesso, entre em contato com sua equipe de conta da Anthropic, da AWS ou do Google Cloud.
O Claude Fable 5.1 e o Claude Mythos 5.1 têm retenção de dados de 30 dias e não estão disponíveis sob retenção zero de dados, a menos que expressamente autorizado pela Anthropic. Ambos são Modelos Cobertos, como o Claude Fable 5 e o Claude Mythos 5. Consulte Requisitos de retenção de dados específicos por modelo.
Migrar do Claude Fable 5
Para migrar do Claude Fable 5, atualize o ID do seu modelo:
model = "claude-fable-5" # Before
model = "claude-fable-5-1" # AfterEm seguida, revise estes itens:
- Remova qualquer
tool_choicedo tipoanyoutool. Mova a imposição de schema para o uso estrito de ferramentas comtool_choice: {"type": "auto"}ou para saídas estruturadas. - Devolva os blocos de pensamento sem alterações e mantenha o histórico somente de acréscimo. Se o seu código monta o array
messagespor conta própria, execute a verificação de edição de histórico: mova os lembretes por turno que você atualmente injeta e exclui para mensagens de sistema com escopo de turno, mova as alterações desystemetoolspara mensagens de sistema no meio da conversa, reduza o contexto do lado do servidor ou remova os blocos de pensamento dos turnos que você carrega através de um resumo do lado do cliente, e então escolha umprefix_mismatch_behaviorde produção e monitoreinput_transformations. - Reajuste o esforço a partir do padrão (
high) e considere alterá-lo no meio da conversa em vez de manter um único nível durante toda a sessão. - Em loops de agente, fique atento a uma chamada de ferramenta por turno onde o Claude Fable 5 agrupava várias, e adicione a nota por turno de Prompting do Claude Fable 5.1.
- Execute novamente suas avaliações. O tratamento de recusas, o fallback, o crédito de fallback e as contagens de tokens são mantidos sem alterações. As leituras de cache custam menos (consulte Preços), e o comportamento padrão difere das maneiras listadas em O que mudou em relação ao Claude Fable 5.
Consulte o guia de migração para instruções passo a passo, inclusive a partir do Claude Opus 5 e de modelos anteriores.
Próximos passos
Especificações e preços de todos os modelos Claude atuais.
Migrando do Claude Fable 5, do Claude Opus 5 e de modelos anteriores.
Padrões de prompting específicos do Claude Fable 5.1.
Was this page helpful?