Claude Platform Docs
Documentation

Claude Mythos 5 및 Claude Fable 5로 마이그레이션하기

Claude Mythos Preview, Claude Opus 5 또는 Claude Opus 4.8에서 Claude Mythos 5 및 Claude Fable 5로 마이그레이션하기: 모델 ID, API 변경 사항 및 마이그레이션 체크리스트.

Claude Fable 5는 까다로운 추론과 장기적인 에이전트 작업을 위해 만들어졌습니다. Claude Fable 5.1은 이를 기반으로 합니다. Claude Fable 5는 Claude API, Amazon Bedrock, Claude Platform on AWS, Google CloudMicrosoft Foundry에서 사용할 수 있습니다. Claude Mythos 5는 동일한 기능을 공유하며 Project Glasswing의 승인된 고객에게만 제공됩니다.

claude-fable-5claude-mythos-5가 공유하는 기본 설정은 다음과 같습니다.

  • 사고(Thinking): Adaptive thinking(적응형 사고)이 항상 켜져 있습니다. 모델이 각 요청에서 언제, 얼마나 사고할지를 결정하며, thinking 구성이 필요하지 않습니다. thinking: {type: "disabled"}와 수동 "extended thinking"(확장 사고)(thinking: {type: "enabled", budget_tokens: N}) 모두 400 오류를 반환합니다.
  • 프리필(Prefill): 어시스턴트 메시지를 프리필하면 400 오류가 반환됩니다. 대신 시스템 프롬프트 지침을 사용하세요.
  • 컨텍스트 윈도우 및 출력: 기본적으로 1M 토큰 "context window"(컨텍스트 윈도우)를 제공하며, 요청당 최대 128k 출력 토큰을 지원합니다.
  • 가격: 입력 토큰 백만 개당 $10 USD, 출력 토큰 백만 개당 $50 USD입니다. Claude 가격을 참조하세요.
  • 데이터 보존: 두 모델 모두 30일 데이터 보존이 필요하며, Anthropic이 명시적으로 승인하지 않는 한 "zero data retention"(제로 데이터 보존), 즉 ZDR 계약 하에서는 사용할 수 없습니다. 두 모델 모두 Covered Models로 지정되어 있습니다. Claude API에서 데이터 보존 구성이 이 요구 사항을 충족하지 않는 조직이 Claude Fable 5에 요청을 보내면 400 invalid_request_error가 반환됩니다. ZDR 계약이 있는 조직은 Anthropic 계정 팀에 문의하여 데이터 보존 구성을 논의하거나, 워크스페이스별로 데이터 보존을 구성해야 합니다. 플랫폼별 세부 사항은 모델별 데이터 보존 요구 사항을 참조하세요.

두 모델이 다른 점은 다음과 같습니다.

  • 가용성: Claude Fable 5는 액세스 승인이 필요하지 않습니다. Claude Mythos 5는 Project Glasswing의 승인된 고객에게만 제공됩니다.
  • 안전 분류기: Claude Fable 5는 stop_reason: "refusal"로 요청을 거부할 수 있는 안전 분류기를 실행합니다. Claude Mythos 5에는 이러한 분류기가 포함되어 있지 않습니다. 거부 및 폴백을 참조하세요.
  • Priority Tier: Priority Tier는 Claude Fable 5에서는 지원되지만 Claude Mythos 5에서는 지원되지 않습니다.

Claude Mythos Preview에서 Claude Mythos 5 및 Claude Fable 5로 마이그레이션하기

Claude Mythos 5는 초대 전용 연구 프리뷰인 Claude Mythos Preview의 액세스 제한 후속 모델입니다. Claude Fable 5는 동일한 기능을 제공하며 액세스 승인이 필요하지 않습니다. 이 섹션의 변경 사항은 두 대상 모델에 동일하게 적용됩니다.

마이그레이션은 대부분 그대로 교체(drop-in)하면 됩니다. Claude Mythos 5와 Claude Fable 5는 Claude Mythos Preview와 동일한 Messages API 및 동일한 "tool use"(도구 사용) 패턴을 사용하며, 세 모델 모두 동일한 토크나이저를 사용하므로 토큰 수는 거의 변하지 않습니다. 확인해야 할 주요 변경 사항은 더 이상 사용할 수 없는 기능(다음 섹션에 나열됨)과 사고 출력입니다. Claude Fable 5로 마이그레이션하는 경우, Claude Mythos Preview와 Claude Mythos 5에는 없는 안전 분류기 거부에 대해서도 대비하세요. 거부 및 폴백을 참조하세요.

Claude Mythos Preview 종료 일정은 모델 지원 중단을 참조하세요.

모델 이름 업데이트

model = "claude-mythos-preview"  # Before
model = "claude-mythos-5"  # After

# 또는 동일한 기능을 갖추고 액세스 승인이 필요 없는 모델의 경우:
model = "claude-fable-5"  # After

Claude Mythos 5 및 Claude Fable 5에서 사용할 수 없는 기능

  1. 확장 사고 및 사고 토큰 예산: 수동 확장 사고(thinking: {type: "enabled", budget_tokens: N})는 claude-mythos-5 또는 claude-fable-5에서 지원되지 않으며 400 오류를 반환합니다. 적응형 사고가 항상 켜져 있습니다. 모델이 각 요청에서 언제, 얼마나 사고할지를 결정하며, thinking 구성이 필요하지 않습니다. thinking: {type: "disabled"}는 오류를 반환합니다. budget_tokens에는 직접적인 대체 항목이 없습니다. 사고는 적응형이며, effort 파라미터는 사고 예산이 아닌 별도의 출력 수준 제어입니다.

    이전 (Claude Mythos Preview):

    client.messages.create(
        model="claude-mythos-preview",
        max_tokens=16000,
        thinking={"type": "enabled", "budget_tokens": 10000},
        messages=[{"role": "user", "content": "..."}],
    )

    이후 (Claude Mythos 5):

    client.messages.create(
        model="claude-mythos-5",
        max_tokens=16000,
        messages=[{"role": "user", "content": "..."}],
    )

    Claude Fable 5에 대한 변경 사항도 동일하며, 모델 이름으로 claude-fable-5를 사용합니다.

  2. 어시스턴트 프리필: 어시스턴트 메시지 프리필은 claude-mythos-5 또는 claude-fable-5에서 지원되지 않으며 Claude Mythos Preview와 마찬가지로 400 오류를 반환합니다. 대신 시스템 프롬프트 지침을 사용하세요.

  3. 사고 출력: claude-mythos-5claude-fable-5에서는 원시 사고 과정(chain of thought)이 절대 반환되지 않지만, thinking.displaysummarized로 설정된 경우 사고 블록에는 여전히 읽을 수 있는 요약 텍스트가 포함됩니다. 동일한 모델에서 대화를 계속할 때는 사고 블록을 변경하지 않고 그대로 다시 전달하세요. Claude Fable 및 Claude Mythos 모델의 사고 출력을 참조하세요.

토큰 카운팅 및 청구

claude-mythos-5claude-fable-5claude-mythos-preview와 동일한 토크나이저(Claude Opus 4.7과 함께 도입된 토크나이저)를 사용합니다. claude-mythos-preview에서 마이그레이션할 때 토큰 수는 거의 변하지 않습니다. Claude Opus 4.7 이전 모델과 비교하면, 동일한 콘텐츠가 약 30% 더 많은 토큰으로 토큰화될 수 있으며, 이는 콘텐츠와 워크로드 형태에 따라 달라집니다.

/v1/messages/count_tokensclaude-mythos-preview와 비교하여 claude-mythos-5claude-fable-5에 대해 거의 변하지 않은 값을 반환합니다. 자체 워크로드에서 비용과 지연 시간의 기준선을 다시 설정하세요.

마이그레이션 체크리스트

  • 모델 이름을 claude-mythos-preview에서 claude-mythos-5로, 또는 동일한 기능을 제공하며 액세스 승인이 필요하지 않은 claude-fable-5로 업데이트하세요.
  • 수동 확장 사고 구성(thinking: {type: "enabled", budget_tokens: N})을 제거하세요. 적응형 사고가 항상 켜져 있으며, thinking 필드가 필요하지 않습니다.
  • 모든 thinking: {type: "disabled"} 구성을 제거하세요. claude-mythos-5claude-fable-5에서 사고를 비활성화하면 오류가 반환됩니다.
  • budget_tokens를 제거하세요. 직접적인 대체 항목이 없습니다. 사고는 적응형이며, effort 파라미터는 사고 예산이 아닌 별도의 출력 수준 제어입니다.
  • thinking 필드를 파싱하는 모든 코드가 이를 표시용 텍스트로만 취급하고, 동일한 모델에서 계속할 때 사고 블록을 변경하지 않고 그대로 다시 전달하는지 확인하세요. thinking.display는 Claude Mythos Preview와 마찬가지로 claude-mythos-5claude-fable-5에서 기본값이 "omitted"입니다. 읽을 수 있는 요약을 받으려면 display: "summarized"를 설정하세요. Claude Fable 및 Claude Mythos 모델의 사고 출력을 참조하세요.
  • 이전 모델에서 대화 기록을 재생하는 경우, 먼저 이전 어시스턴트 턴에서 thinkingredacted_thinking 블록을 제거하세요. claude-fable-5claude-mythos-5의 사고 블록은 이를 생성한 모델 또는 더 새로운 모델만 읽을 수 있습니다. 이전 모델은 이를 조용히 무시하는 반면, Claude Fable 5.1과 Claude Mythos 5.1은 이를 읽으므로 대화를 해당 모델로 상향 이동할 때는 유지하세요(보존된 사고 참조). 제거하면 이전 모델에 대한 요청이 최소화되고 균일하게 유지됩니다.
  • Claude Fable 5로 마이그레이션하는 경우, stop_reason: "refusal"을 처리하고 stop_details.category 필드를 읽으세요. Claude Fable 5는 Claude Mythos Preview와 Claude Mythos 5에는 없는 안전 분류기를 실행합니다. 거부 및 폴백을 참조하세요.
  • 자체 워크로드에서 토큰 수와 비용의 기준선을 다시 설정하세요. claude-mythos-preview에서 마이그레이션할 때 토큰 수는 거의 변하지 않습니다.

Claude Opus 5에서 Claude Mythos 5 및 Claude Fable 5로 마이그레이션하기

Claude Fable 5와 Claude Mythos 5는 Claude Opus 5와 동일한 Messages API 및 동일한 도구 사용 패턴을 사용하며, 기본적으로 동일한 1M 토큰 컨텍스트 윈도우와 동일한 128k 최대 출력 토큰을 제공합니다. 프리필 및 샘플링 파라미터 제한과 사고 표시 동작은 Claude Opus 5에서 변경 없이 그대로 이어집니다. 확인해야 할 변경 사항은 항상 켜져 있는 사고, 가격, Priority Tier 및 데이터 보존입니다.

모델 이름 업데이트

model = "claude-opus-5"  # Before
model = "claude-fable-5"  # After

# 또는 동일한 기능을 갖춘 Project Glasswing 모델의 경우:
model = "claude-mythos-5"  # After

변경된 사항

  1. 사고를 더 이상 비활성화할 수 없음: Claude Opus 5에서는 사고가 기본적으로 켜져 있으며 effort 수준이 high 이하일 때 thinking: {type: "disabled"}로 끌 수 있습니다. claude-fable-5claude-mythos-5에서는 적응형 사고가 항상 켜져 있으며, thinking: {type: "disabled"}는 모든 effort 수준에서 400 오류를 반환합니다. thinking: {type: "disabled"} 구성을 제거하고 대신 더 낮은 effort 수준을 사용하여 토큰 소비를 제어하세요.

    Claude Opus 5 요청에서 사고를 비활성화했다면 응답 형태가 변경됩니다. 응답은 첫 번째 text 블록 앞에 하나 이상의 thinking 블록으로 시작할 수 있으며, 기본값인 display: "omitted"(Claude Opus 5와 동일한 기본값)에서는 빈 thinking 필드와 함께 반환됩니다. content[0].text와 같이 위치로 응답을 읽는 코드나 첫 번째 콘텐츠 블록을 텍스트로 취급하는 스트림 핸들러는 대신 type 필드로 콘텐츠 블록을 선택해야 하며, 도구 사용 루프는 도구 결과와 함께 thinking 블록을 완전하고 수정되지 않은 상태로 다시 전달해야 합니다. API는 편집되거나, 순서가 바뀌거나, 부분적으로 누락된 사고 블록을 400 오류로 거부합니다(사고 블록 보존 참조). 사고 토큰은 사고 텍스트가 반환되지 않더라도 출력 토큰으로 청구됩니다.

  2. 가격: Claude Fable 5와 Claude Mythos 5는 입력 토큰 백만 개당 $10 USD, 출력 토큰 백만 개당 $50 USD로 책정되며, Claude Opus 5는 각각 $5 USD와 $25 USD입니다. Claude 가격을 참조하세요.

  3. Priority Tier: Priority Tier는 Claude Opus 5에서 지원되지 않으므로 기존 트래픽에는 영향이 없습니다. 조직에 Priority Tier 약정이 있는 경우, Claude Fable 5는 이를 지원하지만 Claude Mythos 5는 지원하지 않습니다.

  4. 데이터 보존: Claude Fable 5와 Claude Mythos 5는 30일 데이터 보존이 필요하며, Anthropic이 명시적으로 승인하지 않는 한 제로 데이터 보존(ZDR) 계약 하에서는 사용할 수 없습니다. 두 모델 모두 Covered Models로 지정되어 있습니다. 모델별 데이터 보존 요구 사항을 참조하세요.

마이그레이션 체크리스트

  • 모델 이름을 claude-opus-5에서 claude-fable-5(또는 claude-mythos-5)로 업데이트하세요.
  • 모든 thinking: {type: "disabled"} 구성을 제거하세요. claude-fable-5claude-mythos-5에서는 400 오류를 반환합니다. 대신 더 낮은 effort 수준을 사용하여 토큰 소비를 제어하고, Claude Opus 5에서 사고를 비활성화한 상태로 실행되던 워크로드의 max_tokens를 재검토하세요.
  • 해당 워크로드가 content[0].text와 같이 위치로 콘텐츠를 읽는 경우, type으로 콘텐츠 블록을 선택하도록 업데이트하세요. 이제 thinking 블록이 text 블록보다 먼저 도착합니다. 도구 사용 루프에서 thinking 블록을 완전하고 수정되지 않은 상태로 다시 전달하세요. 수정된 블록은 400 오류를 반환합니다.
  • 조직에 제로 데이터 보존(ZDR) 계약이 있는 경우, 마이그레이션 전에 자격을 확인하세요. 이 모델들은 Anthropic이 명시적으로 승인하지 않는 한 ZDR 하에서 사용할 수 없습니다. 모델별 데이터 보존 요구 사항을 참조하세요.
  • 자체 워크로드에서 비용의 기준선을 다시 설정하세요. 토큰 수는 거의 변하지 않지만 토큰당 가격이 다르며, 사고를 비활성화한 상태로 실행되던 워크로드는 이제 출력 토큰으로 청구되는 사고 토큰을 생성합니다.

Claude Opus 4.8에서 Claude Mythos 5 및 Claude Fable 5로 마이그레이션하기

마이그레이션은 대부분 그대로 교체(drop-in)하면 됩니다. Claude Fable 5와 Claude Mythos 5는 Claude Opus 4.8과 동일한 Messages API 및 동일한 도구 사용 패턴을 사용하며, 기본적으로 동일한 1M 토큰 컨텍스트 윈도우와 동일한 128k 최대 출력 토큰을 제공합니다. 모델들이 동일한 토크나이저를 사용하므로 토큰 수는 거의 변하지 않습니다. 확인해야 할 주요 변경 사항은 항상 켜져 있는 적응형 사고, 사고 출력, 안전 분류기 거부(Claude Fable 5만 해당) 및 가격입니다.

모델 이름 업데이트

model = "claude-opus-4-8"  # Before
model = "claude-fable-5"  # After

# 또는 동일한 기능을 갖춘 Project Glasswing 모델의 경우:
model = "claude-mythos-5"  # After

변경된 사항

이 섹션의 항목들은 모델 ID를 교체한 후 확인할 가치가 있는 API 및 동작 차이를 설명합니다. 별도로 명시된 경우를 제외하고, claude-fable-5claude-mythos-5에 동일하게 적용됩니다.

  1. 적응형 사고가 항상 켜져 있음: 적응형 사고claude-fable-5claude-mythos-5에서 유일한 사고 모드입니다. 모델이 각 요청에서 언제, 얼마나 사고할지를 결정하며, thinking 구성이 필요하지 않습니다. thinking: {type: "disabled"}는 오류를 반환합니다. 사고 깊이를 제어하려면 effort 파라미터를 사용하세요.

    확인해야 할 동작 변경 사항: Claude Opus 4.8에서는 thinking 필드가 없는 요청이 사고 없이 실행되지만, claude-fable-5claude-mythos-5에서는 동일한 요청이 적응형 사고와 함께 실행됩니다. max_tokens는 사고와 응답 텍스트를 합한 총 출력에 대한 엄격한 제한으로 유지되므로, Claude Opus 4.8에서 사고 없이 실행되던 워크로드에 대해 이를 재검토하세요. 비용 제어를 참조하세요. 또한 응답은 첫 번째 text 블록 앞에 하나 이상의 thinking 블록으로 시작할 수 있으므로, 위치로 응답을 읽는 코드(예: content[0].text 또는 첫 번째 콘텐츠 블록을 텍스트로 취급하는 스트림 핸들러)는 대신 type 필드로 콘텐츠 블록을 선택해야 합니다. 사고 토큰은 사고 텍스트가 반환되지 않더라도 출력 토큰으로 청구되므로, Claude Opus 4.8에서 사고 없이 실행되던 워크로드는 토큰당 가격 차이에 더해 요청당 더 많은 출력 토큰을 생성합니다.

    도구 사용 루프를 실행하는 경우, 도구 결과를 반환할 때 각 어시스턴트 응답의 thinking 블록을 thinking 필드가 비어 있는 블록을 포함하여 완전하고 수정되지 않은 상태로 API에 다시 전달하세요. 어시스턴트 메시지의 콘텐츠 블록을 유형별로 필터링하거나 재구성하지 말고 받은 그대로 되돌려 보내세요. API는 편집되거나, 순서가 바뀌거나, 부분적으로 누락된 사고 블록을 400 오류로 거부합니다. 사고 블록 보존을 참조하세요.

    이전 (Claude Opus 4.8):

    client.messages.create(
        model="claude-opus-4-8",
        max_tokens=16000,
        thinking={"type": "adaptive"},
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    이후 (Claude Fable 5):

    client.messages.create(
        model="claude-fable-5",
        max_tokens=16000,
        output_config={"effort": "high"},
        messages=[{"role": "user", "content": "..."}],
    )

    Claude Mythos 5에 대한 변경 사항도 동일하며, 모델 이름으로 claude-mythos-5를 사용합니다.

  2. 확장 사고 및 사고 예산 (변경 없음): 수동 확장 사고(thinking: {type: "enabled", budget_tokens: N})는 claude-fable-5 또는 claude-mythos-5에서 지원되지 않으며 Claude Opus 4.8과 마찬가지로 400 오류를 반환합니다. budget_tokens에는 직접적인 대체 항목이 없습니다. 사고는 적응형이며, effort 파라미터는 사고 예산이 아닌 별도의 출력 수준 제어입니다.

  3. 어시스턴트 프리필 (변경 없음): 어시스턴트 메시지 프리필은 claude-fable-5 또는 claude-mythos-5에서 지원되지 않으며 Claude Opus 4.8과 마찬가지로 400 오류를 반환합니다. 대신 시스템 프롬프트 지침을 사용하세요.

  4. 사고 출력: claude-fable-5claude-mythos-5에서는 원시 사고 과정(chain of thought)이 절대 반환되지 않지만, thinking.displaysummarized로 설정된 경우 사고 블록에는 여전히 읽을 수 있는 요약 텍스트가 포함됩니다. 동일한 모델에서 대화를 계속할 때는 사고 블록을 변경하지 않고 그대로 다시 전달하세요. Claude Fable 및 Claude Mythos 모델의 사고 출력을 참조하세요.

  5. 안전 분류기 및 refusal 중지 사유 (Claude Fable 5만 해당): claude-fable-5는 요청 시와 응답 생성 중에 안전 분류기를 실행합니다. Claude Mythos 5에는 이러한 분류기가 포함되어 있지 않습니다. 분류기가 요청을 거부하면 Messages API는 오류가 아닌 성공적인 HTTP 200 응답으로 stop_reason: "refusal"을 반환합니다. stop_details.category 필드는 어떤 분류기가 작동했는지를 "cyber", "bio", "reasoning_extraction"과 같은 카테고리로 보고하며, 거부가 명명된 카테고리에 해당하지 않는 경우 null을 보고합니다. 전체 목록은 거부 카테고리 표를 참조하세요.

    출력이 생성되기 전에 거부된 요청의 입력 토큰에 대해서는 청구되지 않습니다. 분류기가 스트리밍 도중에 작동하면 입력과 이미 스트리밍된 출력이 청구되며, 부분 출력은 폐기하세요.

    거부된 요청을 다른 모델에서 자동으로 다시 실행하려면, Claude API에서 베타로 제공되는 옵트인 fallbacks 파라미터를 전달하세요. 이 파라미터는 Message Batches API나 Amazon Bedrock, Google Cloud, Microsoft Foundry에서는 사용할 수 없습니다. 이 세 플랫폼에서는 클라이언트 측에서 재시도를 실행하거나 SDK 거부 폴백 미들웨어를 사용하세요. 거부 및 폴백을 참조하세요.

  6. high effort에서 시작: effort 파라미터의 기본값은 high로 유지됩니다. Claude Opus 4.8에서는 코딩 및 고자율성 작업에 대해 xhigh를 명시적으로 설정하는 것이 권장됩니다. claude-fable-5claude-mythos-5에서는 대부분의 작업에 high를 기본값으로 사용하고, xhigh는 가장 기능에 민감한 워크로드에만 사용하세요. 더 낮은 effort 설정도 여전히 좋은 성능을 보이며 종종 이전 모델의 xhigh 성능을 능가합니다. 작업이 완료되지만 필요 이상으로 오래 걸린다면 effort를 낮추세요. Claude Fable 5 프롬프팅을 참조하세요.

  7. 더 낮은 프롬프트 캐싱 최소값: claude-fable-5claude-mythos-5에서 캐시 가능한 최소 프롬프트 길이는 512 토큰으로, Claude Opus 4.8의 1,024 토큰보다 낮습니다. Claude Opus 4.8에서 캐시하기에 너무 짧았던 프롬프트도 이제 코드 변경 없이 캐시 항목을 생성할 수 있습니다. 모델별 최소값은 "Prompt caching"(프롬프트 캐싱)을 참조하세요.

마이그레이션 체크리스트

  • 조직에 제로 데이터 보존(ZDR) 계약이 있는 경우, 마이그레이션 전에 자격을 확인하세요. claude-fable-5claude-mythos-5는 30일 데이터 보존이 필요하며, Anthropic이 명시적으로 승인하지 않는 한 ZDR 하에서 사용할 수 없습니다. Claude API에서 이 요구 사항을 충족하지 않는 claude-fable-5에 대한 요청은 400 invalid_request_error를 반환합니다. Claude Opus 4.8은 ZDR 하에서 사용할 수 있습니다. 모델별 데이터 보존 요구 사항을 참조하세요.
  • 모델 이름을 claude-opus-4-8에서 claude-fable-5(또는 claude-mythos-5)로 업데이트하세요.
  • 모든 thinking: {type: "disabled"} 구성을 제거하세요. claude-fable-5claude-mythos-5에서 사고를 비활성화하면 오류가 반환되며, thinking 필드가 없는 요청은 적응형 사고와 함께 실행됩니다.
  • content[0].text와 같이 위치로 콘텐츠를 읽는 응답 파싱을 업데이트하세요. 적응형 사고가 항상 켜져 있으므로 thinking 블록이 text 블록보다 먼저 도착합니다. 대신 type으로 콘텐츠 블록을 선택하고, 도구 사용 루프에서 thinking 블록을 완전하고 수정되지 않은 상태로 다시 전달하세요. 수정된 블록은 400 오류를 반환합니다. 사고 블록 보존을 참조하세요.
  • 이전 마이그레이션 중에 수동 확장 사고와 어시스턴트 프리필을 제거했다면 추가 조치가 필요하지 않습니다. 둘 다 claude-fable-5claude-mythos-5에서 계속 지원되지 않습니다.
  • thinking 필드를 파싱하는 모든 코드가 이를 표시용 텍스트로만 취급하고, 동일한 모델에서 계속할 때 사고 블록을 변경하지 않고 그대로 다시 전달하는지 확인하세요. thinking.display는 Claude Opus 4.8과 마찬가지로 claude-fable-5claude-mythos-5에서 기본값이 "omitted"입니다. 읽을 수 있는 요약을 받으려면 display: "summarized"를 설정하세요. Claude Fable 및 Claude Mythos 모델의 사고 출력을 참조하세요.
  • 이전 모델에서 대화 기록을 재생하는 경우, 먼저 이전 어시스턴트 턴에서 thinkingredacted_thinking 블록을 제거하세요. claude-fable-5claude-mythos-5의 사고 블록은 이를 생성한 모델 또는 더 새로운 모델만 읽을 수 있습니다. 이전 모델은 이를 조용히 무시하는 반면, Claude Fable 5.1과 Claude Mythos 5.1은 이를 읽으므로 대화를 해당 모델로 상향 이동할 때는 유지하세요(보존된 사고 참조). 제거하면 이전 모델에 대한 요청이 최소화되고 균일하게 유지됩니다. 예외는 폴백 크레딧을 사용하는 경우로, 이때는 해당 기능의 정확한 규칙에 따라 요청 본문을 그대로 되돌려 보내야 합니다.
  • Claude Fable 5로 마이그레이션하는 경우, stop_reason: "refusal"을 처리하고 stop_details.category 필드를 읽으세요. 거부된 요청을 다른 모델에서 자동으로 다시 실행하려면 옵트인 fallbacks 파라미터(베타)를 고려하세요. 거부 및 폴백을 참조하세요.
  • effort 설정을 재평가하세요. Claude Opus 4.8에서 xhigh로 실행되던 워크로드를 포함하여 대부분의 작업에 대해 high에서 시작하세요.
  • 자체 워크로드에서 비용과 지연 시간의 기준선을 다시 설정하세요. claude-opus-4-8에서 마이그레이션할 때 토큰 수는 거의 변하지 않지만 토큰당 가격이 다르며, 사고 토큰은 출력 토큰으로 청구되므로 사고 없이 실행되던 워크로드는 요청당 더 많은 출력 토큰을 생성합니다.

Was this page helpful?