Claude Platform Docs
Documentation

Migrando para o Claude Mythos 5 e o Claude Fable 5

Migre para o Claude Mythos 5 e o Claude Fable 5 a partir do Claude Mythos Preview, Claude Opus 5 ou Claude Opus 4.8: IDs de modelo, mudanças na API e checklists de migração.

O Claude Fable 5 foi construído para raciocínio exigente e trabalho agêntico de longo horizonte. O Claude Fable 5.1 se baseia nele. O Claude Fable 5 está disponível na Claude API, no Amazon Bedrock, na Claude Platform on AWS, no Google Cloud e no Microsoft Foundry. O Claude Mythos 5 compartilha as mesmas capacidades e é oferecido apenas a clientes aprovados no Project Glasswing.

As configurações básicas compartilhadas por claude-fable-5 e claude-mythos-5:

  • Pensamento: O pensamento adaptativo ("adaptive thinking") está sempre ativado. O modelo determina quando e quanto pensar em cada requisição, e nenhuma configuração de thinking é necessária. Tanto thinking: {type: "disabled"} quanto o "extended thinking" (pensamento estendido) manual (thinking: {type: "enabled", budget_tokens: N}) retornam um erro 400.
  • Prefill: Fazer prefill da mensagem do assistente retorna um erro 400. Use instruções no "system prompt" (prompt do sistema) em vez disso.
  • Janela de contexto e saída: Uma "context window" (janela de contexto) de 1M de tokens por padrão, e até 128k tokens de saída por requisição.
  • Preços: $10 USD por milhão de tokens de entrada e $50 USD por milhão de tokens de saída. Consulte Preços do Claude.
  • Retenção de dados: Ambos os modelos exigem retenção de dados de 30 dias e não estão disponíveis sob acordos de "zero data retention" (retenção zero de dados), ou ZDR, a menos que expressamente autorizado pela Anthropic. Ambos são designados Covered Models. Na Claude API, uma requisição ao Claude Fable 5 de uma organização cuja configuração de retenção de dados não atende a esse requisito retorna um invalid_request_error 400. Organizações com um acordo ZDR devem entrar em contato com sua equipe de conta da Anthropic para discutir a configuração de retenção de dados, ou configurar a retenção de dados por workspace. Consulte Requisitos de retenção de dados específicos por modelo para detalhes por plataforma.

Onde os dois modelos divergem:

  • Disponibilidade: O Claude Fable 5 não exige aprovação de acesso. O Claude Mythos 5 está disponível apenas para clientes aprovados no Project Glasswing.
  • Classificadores de segurança: O Claude Fable 5 executa classificadores de segurança que podem recusar requisições com stop_reason: "refusal". O Claude Mythos 5 não inclui esses classificadores. Consulte Recusas e fallback.
  • Priority Tier: O Priority Tier é suportado no Claude Fable 5, mas não no Claude Mythos 5.

Migrando para o Claude Mythos 5 e o Claude Fable 5 a partir do Claude Mythos Preview

O Claude Mythos 5 é o sucessor com acesso restrito do Claude Mythos Preview, a prévia de pesquisa disponível apenas por convite. O Claude Fable 5 oferece as mesmas capacidades e não exige aprovação de acesso. As mudanças nesta seção se aplicam igualmente a ambos os destinos.

A migração é, em grande parte, direta. O Claude Mythos 5 e o Claude Fable 5 usam a mesma Messages API e os mesmos padrões de "tool use" (uso de ferramentas) que o Claude Mythos Preview, e as contagens de tokens permanecem praticamente inalteradas porque os três modelos usam o mesmo tokenizador. As principais mudanças a verificar são os recursos que não estão mais disponíveis (listados na próxima seção) e a saída de pensamento. Se você migrar para o Claude Fable 5, planeje também para recusas de classificadores de segurança, que o Claude Mythos Preview e o Claude Mythos 5 não têm; consulte Recusas e fallback.

Para o cronograma de desativação do Claude Mythos Preview, consulte Descontinuações de modelos.

Atualize o nome do seu modelo

model = "claude-mythos-preview"  # Before
model = "claude-mythos-5"  # After

# Ou, para o modelo com as mesmas capacidades e sem exigência de aprovação de acesso:
model = "claude-fable-5"  # After

Recursos não disponíveis no Claude Mythos 5 e no Claude Fable 5

  1. Pensamento estendido e orçamentos de tokens de pensamento: O pensamento estendido manual (thinking: {type: "enabled", budget_tokens: N}) não é suportado em claude-mythos-5 ou claude-fable-5 e retorna um erro 400. O pensamento adaptativo está sempre ativado: o modelo determina quando e quanto pensar em cada requisição, e nenhuma configuração de thinking é necessária. thinking: {type: "disabled"} retorna um erro. budget_tokens não tem substituto direto: o pensamento é adaptativo, e o parâmetro effort é um controle separado no nível da saída, não um orçamento de pensamento.

    Antes (Claude Mythos Preview):

    client.messages.create(
        model="claude-mythos-preview",
        max_tokens=16000,
        thinking={"type": "enabled", "budget_tokens": 10000},
        messages=[{"role": "user", "content": "..."}],
    )

    Depois (Claude Mythos 5):

    client.messages.create(
        model="claude-mythos-5",
        max_tokens=16000,
        messages=[{"role": "user", "content": "..."}],
    )

    A mudança para o Claude Fable 5 é idêntica, com claude-fable-5 como nome do modelo.

  2. Prefill do assistente: Fazer prefill da mensagem do assistente não é suportado em claude-mythos-5 ou claude-fable-5 e retorna um erro 400, assim como no Claude Mythos Preview. Use instruções no prompt do sistema em vez disso.

  3. Saída de pensamento: Em claude-mythos-5 e claude-fable-5, a cadeia de pensamento bruta nunca é retornada, mas os blocos de pensamento ainda carregam texto resumido legível quando thinking.display está definido como summarized. Passe os blocos de pensamento de volta inalterados ao continuar uma conversa no mesmo modelo. Consulte Saída de pensamento nos modelos Claude Fable e Claude Mythos.

Contagem de tokens e cobrança

claude-mythos-5 e claude-fable-5 usam o mesmo tokenizador que claude-mythos-preview (o tokenizador introduzido com o Claude Opus 4.7). As contagens de tokens permanecem praticamente inalteradas ao migrar de claude-mythos-preview. Em comparação com modelos anteriores ao Claude Opus 4.7, o mesmo conteúdo pode ser tokenizado em aproximadamente 30% mais tokens, variando conforme o conteúdo e o formato da carga de trabalho.

/v1/messages/count_tokens retorna valores praticamente inalterados para claude-mythos-5 e claude-fable-5 em comparação com claude-mythos-preview. Refaça a linha de base de custo e "latency" (latência) em suas próprias cargas de trabalho.

Checklist de migração

  • Atualize o nome do modelo de claude-mythos-preview para claude-mythos-5, ou para claude-fable-5, que oferece as mesmas capacidades e não exige aprovação de acesso.
  • Remova a configuração de pensamento estendido manual (thinking: {type: "enabled", budget_tokens: N}). O pensamento adaptativo está sempre ativado, e nenhum campo thinking é necessário.
  • Remova qualquer configuração thinking: {type: "disabled"}. Desativar o pensamento retorna um erro em claude-mythos-5 e claude-fable-5.
  • Remova budget_tokens. Ele não tem substituto direto: o pensamento é adaptativo, e o parâmetro effort é um controle separado no nível da saída, não um orçamento de pensamento.
  • Verifique se qualquer código que analisa o campo thinking o trata apenas como texto de exibição e passa os blocos de pensamento de volta inalterados ao continuar no mesmo modelo. thinking.display tem como padrão "omitted" em claude-mythos-5 e claude-fable-5, assim como no Claude Mythos Preview. Defina display: "summarized" para receber resumos legíveis. Consulte Saída de pensamento nos modelos Claude Fable e Claude Mythos.
  • Se você reproduzir o histórico de conversa em um modelo anterior, remova primeiro os blocos thinking e redacted_thinking dos turnos anteriores do assistente. Os blocos de pensamento de claude-fable-5 e claude-mythos-5 são legíveis apenas pelo modelo que os produziu ou por um mais recente: modelos anteriores os ignoram silenciosamente, enquanto o Claude Fable 5.1 e o Claude Mythos 5.1 os leem, portanto mantenha-os ao mover uma conversa para esses modelos (consulte Pensamento preservado). A remoção mantém as requisições para modelos anteriores mínimas e uniformes.
  • Se você migrar para o Claude Fable 5, trate stop_reason: "refusal" e leia o campo stop_details.category. O Claude Fable 5 executa classificadores de segurança que o Claude Mythos Preview e o Claude Mythos 5 não têm. Consulte Recusas e fallback.
  • Refaça a linha de base de contagens de tokens e custos em suas próprias cargas de trabalho. As contagens de tokens permanecem praticamente inalteradas ao migrar de claude-mythos-preview.

Migrando para o Claude Mythos 5 e o Claude Fable 5 a partir do Claude Opus 5

O Claude Fable 5 e o Claude Mythos 5 usam a mesma Messages API e os mesmos padrões de uso de ferramentas que o Claude Opus 5, com a mesma janela de contexto de 1M de tokens por padrão e os mesmos 128k tokens máximos de saída. As restrições de prefill e de parâmetros de amostragem, e o comportamento de exibição do pensamento, são herdados do Claude Opus 5 sem alterações. As mudanças a verificar são o pensamento sempre ativado, preços, Priority Tier e retenção de dados.

Atualize o nome do seu modelo

model = "claude-opus-5"  # Before
model = "claude-fable-5"  # After

# Ou, para o modelo do Project Glasswing com as mesmas capacidades:
model = "claude-mythos-5"  # After

O que mudou

  1. O pensamento não pode mais ser desativado: No Claude Opus 5, o pensamento está ativado por padrão e pode ser desativado com thinking: {type: "disabled"} em um nível de effort high ou inferior. Em claude-fable-5 e claude-mythos-5, o pensamento adaptativo está sempre ativado, e thinking: {type: "disabled"} retorna um erro 400 em qualquer nível de effort. Remova a configuração thinking: {type: "disabled"} e use níveis de effort mais baixos para controlar o gasto de tokens em vez disso.

    Se suas requisições ao Claude Opus 5 desativavam o pensamento, o formato da resposta muda: uma resposta pode começar com um ou mais blocos thinking antes do primeiro bloco text, retornados com um campo thinking vazio no padrão display: "omitted" (o mesmo padrão do Claude Opus 5). Código que lê a resposta por posição, como content[0].text ou um handler de stream que trata o primeiro bloco de conteúdo como texto, deve selecionar os blocos de conteúdo pelo campo type em vez disso, e loops de uso de ferramentas devem passar os blocos thinking de volta completos e sem modificações junto com seus resultados de ferramentas. A API rejeita blocos de pensamento editados, reordenados ou parcialmente descartados com um erro 400 (consulte Preservando blocos de pensamento). Os tokens de pensamento são cobrados como tokens de saída mesmo quando o texto do pensamento não é retornado.

  2. Preços: O Claude Fable 5 e o Claude Mythos 5 têm preço de $10 USD por milhão de tokens de entrada e $50 USD por milhão de tokens de saída, em comparação com $5 USD e $25 USD para o Claude Opus 5. Consulte Preços do Claude.

  3. Priority Tier: O Priority Tier não é suportado no Claude Opus 5, portanto nenhum tráfego existente é afetado. Se sua organização tem um compromisso de Priority Tier, o Claude Fable 5 o suporta; o Claude Mythos 5 não.

  4. Retenção de dados: O Claude Fable 5 e o Claude Mythos 5 exigem retenção de dados de 30 dias e não estão disponíveis sob acordos de retenção zero de dados (ZDR), a menos que expressamente autorizado pela Anthropic. Ambos são designados Covered Models. Consulte Requisitos de retenção de dados específicos por modelo.

Checklist de migração

  • Atualize o nome do modelo de claude-opus-5 para claude-fable-5 (ou claude-mythos-5).
  • Remova qualquer configuração thinking: {type: "disabled"}; ela retorna um erro 400 em claude-fable-5 e claude-mythos-5. Use níveis de effort mais baixos para controlar o gasto de tokens em vez disso, e revise max_tokens para cargas de trabalho que eram executadas com o pensamento desativado no Claude Opus 5.
  • Se essas cargas de trabalho leem o conteúdo por posição, como content[0].text, atualize-as para selecionar os blocos de conteúdo por type: os blocos thinking agora chegam antes dos blocos text. Passe os blocos thinking de volta completos e sem modificações em loops de uso de ferramentas; blocos modificados retornam um erro 400.
  • Se sua organização tem um acordo de retenção zero de dados (ZDR), confirme a elegibilidade antes de migrar: esses modelos não estão disponíveis sob ZDR, a menos que expressamente autorizado pela Anthropic. Consulte Requisitos de retenção de dados específicos por modelo.
  • Refaça a linha de base de custo em suas próprias cargas de trabalho. As contagens de tokens permanecem praticamente inalteradas; o preço por token difere, e cargas de trabalho que eram executadas com o pensamento desativado agora produzem tokens de pensamento, que são cobrados como tokens de saída.

Migrando para o Claude Mythos 5 e o Claude Fable 5 a partir do Claude Opus 4.8

A migração é, em grande parte, direta. O Claude Fable 5 e o Claude Mythos 5 usam a mesma Messages API e os mesmos padrões de uso de ferramentas que o Claude Opus 4.8, com a mesma janela de contexto de 1M de tokens por padrão e os mesmos 128k tokens máximos de saída. As contagens de tokens permanecem praticamente inalteradas porque os modelos usam o mesmo tokenizador. As principais mudanças a verificar são o pensamento adaptativo sempre ativado, a saída de pensamento, recusas de classificadores de segurança (apenas Claude Fable 5) e preços.

Atualize o nome do seu modelo

model = "claude-opus-4-8"  # Before
model = "claude-fable-5"  # After

# Ou, para o modelo do Project Glasswing com as mesmas capacidades:
model = "claude-mythos-5"  # After

O que mudou

Os itens nesta seção descrevem as diferenças de API e de comportamento que vale a pena verificar depois de trocar o ID do modelo. Exceto onde indicado, eles se aplicam igualmente a claude-fable-5 e claude-mythos-5.

  1. O pensamento adaptativo está sempre ativado: O pensamento adaptativo é o único modo de pensamento em claude-fable-5 e claude-mythos-5. O modelo determina quando e quanto pensar em cada requisição, e nenhuma configuração de thinking é necessária. thinking: {type: "disabled"} retorna um erro. Use o parâmetro effort para controlar a profundidade do pensamento.

    A mudança de comportamento a verificar: no Claude Opus 4.8, requisições sem um campo thinking são executadas sem pensamento; em claude-fable-5 e claude-mythos-5, essas mesmas requisições são executadas com pensamento adaptativo. max_tokens continua sendo um limite rígido para a saída total, pensamento mais texto de resposta, portanto revise-o para cargas de trabalho que eram executadas sem pensamento no Claude Opus 4.8. Consulte Controle de custos. As respostas também podem começar com um ou mais blocos thinking antes do primeiro bloco text, portanto código que lê a resposta por posição (por exemplo, content[0].text, ou um handler de stream que trata o primeiro bloco de conteúdo como texto) deve selecionar os blocos de conteúdo pelo campo type em vez disso. Os tokens de pensamento são cobrados como tokens de saída mesmo quando o texto do pensamento não é retornado a você, portanto uma carga de trabalho que era executada sem pensamento no Claude Opus 4.8 produz mais tokens de saída por requisição, além da diferença de preço por token.

    Se você executa um loop de uso de ferramentas, passe os blocos thinking de cada resposta do assistente de volta para a API completos e sem modificações ao retornar os resultados de ferramentas, incluindo blocos cujo campo thinking está vazio. Repita a mensagem do assistente como recebida em vez de filtrar seus blocos de conteúdo por tipo ou reconstruí-la: a API rejeita blocos de pensamento editados, reordenados ou parcialmente descartados com um erro 400. Consulte Preservando blocos de pensamento.

    Antes (Claude Opus 4.8):

    client.messages.create(
        model="claude-opus-4-8",
        max_tokens=16000,
        thinking={"type": "adaptive"},
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Depois (Claude Fable 5):

    client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    A mudança para o Claude Mythos 5 é idêntica, com claude-mythos-5 como nome do modelo.

  2. Pensamento estendido e orçamentos de pensamento (inalterado): O pensamento estendido manual (thinking: {type: "enabled", budget_tokens: N}) não é suportado em claude-fable-5 ou claude-mythos-5 e retorna um erro 400, assim como no Claude Opus 4.8. budget_tokens não tem substituto direto: o pensamento é adaptativo, e o parâmetro effort é um controle separado no nível da saída, não um orçamento de pensamento.

  3. Prefill do assistente (inalterado): Fazer prefill da mensagem do assistente não é suportado em claude-fable-5 ou claude-mythos-5 e retorna um erro 400, assim como no Claude Opus 4.8. Use instruções no prompt do sistema em vez disso.

  4. Saída de pensamento: Em claude-fable-5 e claude-mythos-5, a cadeia de pensamento bruta nunca é retornada, mas os blocos de pensamento ainda carregam texto resumido legível quando thinking.display está definido como summarized. Passe os blocos de pensamento de volta inalterados ao continuar uma conversa no mesmo modelo. Consulte Saída de pensamento nos modelos Claude Fable e Claude Mythos.

  5. Classificadores de segurança e o motivo de parada refusal (apenas Claude Fable 5): claude-fable-5 executa classificadores de segurança nas requisições e durante a geração da resposta. O Claude Mythos 5 não inclui esses classificadores. Quando um classificador recusa uma requisição, a Messages API retorna stop_reason: "refusal" como uma resposta HTTP 200 bem-sucedida, não como um erro. O campo stop_details.category informa qual classificador foi acionado, com categorias como "cyber", "bio" e "reasoning_extraction", ou null quando a recusa não corresponde a nenhuma categoria nomeada. Consulte a tabela de categorias de recusa para o conjunto completo.

    Você não é cobrado pelos tokens de entrada de uma requisição recusada antes de qualquer saída ser gerada. Quando um classificador é acionado no meio do stream, a entrada e a saída já transmitida via streaming são cobradas; descarte a saída parcial.

    Para reexecutar automaticamente requisições recusadas em outro modelo, passe o parâmetro opcional fallbacks, que está em beta na Claude API. O parâmetro não está disponível na Message Batches API nem no Amazon Bedrock, Google Cloud e Microsoft Foundry; nessas três plataformas, execute a nova tentativa no lado do cliente ou use o middleware de fallback de recusa do SDK. Consulte Recusas e fallback.

  6. Comece com effort high: O padrão do parâmetro effort continua sendo high. No Claude Opus 4.8, a recomendação para codificação e trabalho de alta autonomia é definir xhigh explicitamente. Em claude-fable-5 e claude-mythos-5, use high como padrão para a maioria das tarefas e reserve xhigh para as cargas de trabalho mais sensíveis a capacidade. Configurações de effort mais baixas ainda têm bom desempenho e frequentemente superam o desempenho de xhigh em modelos anteriores. Reduza o effort se uma tarefa é concluída, mas leva mais tempo do que o necessário. Consulte Prompting do Claude Fable 5.

  7. Mínimo menor para cache de prompt: O comprimento mínimo de prompt armazenável em cache em claude-fable-5 e claude-mythos-5 é de 512 tokens, menor que os 1.024 tokens no Claude Opus 4.8. Prompts que eram curtos demais para serem armazenados em cache no Claude Opus 4.8 agora podem criar entradas de cache, sem necessidade de mudanças no código. Consulte "Prompt caching" (cache de prompt) para os mínimos por modelo.

Checklist de migração

  • Se sua organização tem um acordo de retenção zero de dados (ZDR), confirme a elegibilidade antes de migrar. claude-fable-5 e claude-mythos-5 exigem retenção de dados de 30 dias e não estão disponíveis sob ZDR, a menos que expressamente autorizado pela Anthropic. Na Claude API, requisições a claude-fable-5 que não atendem a esse requisito retornam um invalid_request_error 400. O Claude Opus 4.8 está disponível sob ZDR. Consulte Requisitos de retenção de dados específicos por modelo.
  • Atualize o nome do modelo de claude-opus-4-8 para claude-fable-5 (ou claude-mythos-5).
  • Remova qualquer configuração thinking: {type: "disabled"}. Desativar o pensamento retorna um erro em claude-fable-5 e claude-mythos-5, e requisições sem um campo thinking são executadas com pensamento adaptativo.
  • Atualize a análise de respostas que lê o conteúdo por posição, como content[0].text: com o pensamento adaptativo sempre ativado, os blocos thinking chegam antes dos blocos text. Selecione os blocos de conteúdo por type em vez disso, e passe os blocos thinking de volta completos e sem modificações em loops de uso de ferramentas; blocos modificados retornam um erro 400. Consulte Preservando blocos de pensamento.
  • Se você removeu o pensamento estendido manual e os prefills do assistente durante migrações anteriores, nenhuma ação é necessária: ambos continuam sem suporte em claude-fable-5 e claude-mythos-5.
  • Verifique se qualquer código que analisa o campo thinking o trata apenas como texto de exibição e passa os blocos de pensamento de volta inalterados ao continuar no mesmo modelo. thinking.display tem como padrão "omitted" em claude-fable-5 e claude-mythos-5, assim como no Claude Opus 4.8. Defina display: "summarized" para receber resumos legíveis. Consulte Saída de pensamento nos modelos Claude Fable e Claude Mythos.
  • Se você reproduzir o histórico de conversa em um modelo anterior, remova primeiro os blocos thinking e redacted_thinking dos turnos anteriores do assistente. Os blocos de pensamento de claude-fable-5 e claude-mythos-5 são legíveis apenas pelo modelo que os produziu ou por um mais recente: modelos anteriores os ignoram silenciosamente, enquanto o Claude Fable 5.1 e o Claude Mythos 5.1 os leem, portanto mantenha-os ao mover uma conversa para esses modelos (consulte Pensamento preservado). A remoção mantém as requisições para modelos anteriores mínimas e uniformes. A exceção é o resgate de um crédito de fallback, que exige que o corpo da requisição seja repetido conforme as regras exatas desse recurso.
  • Se você migrar para o Claude Fable 5, trate stop_reason: "refusal" e leia o campo stop_details.category. Para reexecutar automaticamente requisições recusadas em outro modelo, considere o parâmetro opcional fallbacks (beta). Consulte Recusas e fallback.
  • Reavalie sua configuração de effort. Comece com high para a maioria das tarefas, incluindo cargas de trabalho que eram executadas em xhigh no Claude Opus 4.8.
  • Refaça a linha de base de custo e latência em suas próprias cargas de trabalho. As contagens de tokens permanecem praticamente inalteradas ao migrar de claude-opus-4-8; o preço por token difere, e os tokens de pensamento são cobrados como tokens de saída, portanto cargas de trabalho que eram executadas sem pensamento produzem mais tokens de saída por requisição.

Was this page helpful?