Claude Platform Docs
모델 및 가격Claude Fable 5.1

Claude Fable 5.1의 새로운 기능

Claude Fable 5.1 및 Claude Mythos 5.1의 새로운 기능, 호환성이 깨지는 변경 사항, 역량 개선 사항에 대한 개요입니다.

Claude Fable 5.1은 Claude Fable 5와 동일한 입력 및 출력 가격으로 Claude Fable 5를 확장하며, 캐시 읽기 비용은 4분의 1 수준이고, 더 강력한 장기 실행 에이전틱 코딩, 다단계 리서치, 그리고 문서·스프레드시트·슬라이드 작업 능력을 제공합니다. 대부분의 워크로드에서는 Claude Opus 5로 시작하세요(모델 선택 참조). 까다로운 추론과 장기적 에이전틱 작업이 필요하거나, 더 높은 effort로 Claude Opus 5에서 실행한 평가 결과가 여전히 부족할 때 Claude Fable 5.1을 사용하세요. Claude Mythos 5.1은 동일한 기능을 Project Glasswing 참가자에게만 제공합니다.

이미 Claude Fable 5를 호출하고 있다면, 세 가지 변경 사항이 호환성을 깨뜨립니다: 강제 도구 사용은 오류를 반환합니다, 이전 모델은 이 모델의 thinking 블록을 읽을 수 없습니다, 이전 턴을 편집하면 thinking 블록이 무효화됩니다. 다섯 가지는 추가 기능입니다: 메시지별 effort(베타), 턴 범위 시스템 메시지(베타), 도구 호출 사이의 읽을 수 있는 진행 상황 업데이트(display: "updates", 베타), 더 낮은 캐시 읽기 가격, 그리고 콘텐츠 출처입니다.

모델

모델Claude API ID설명제공 범위
Claude Fable 5.1Claude Fable 5의 후속 모델로, 장기 실행 에이전틱 코딩, 지식 작업, 리서치용모든 고객, Claude API 및 파트너 플랫폼에서 제공
Claude Mythos 5.1Claude Fable 5.1과 동일한 기능. Claude Mythos 5의 후속 모델.Project Glasswing 참가자 전용

Claude Fable 5.1과 Claude Mythos 5.1은 사양과 가격이 동일합니다:

현재 제공되는 모든 모델은 모델 개요를 참조하세요.

호환성이 깨지는 변경 사항

강제 도구 사용은 지원되지 않습니다

Claude Fable 5.1과 Claude Mythos 5.1은 강제 "tool use"(도구 사용)를 지원하지 않습니다. tool_choice{"type": "any"} 또는 {"type": "tool", "name": "..."}로 설정하면 400 invalid_request_error가 반환됩니다:

tool_choice: type "tool" and "any" are not supported for this model.

tool_choice: {"type": "auto"}(기본값)와 {"type": "none"}은 변경되지 않았습니다. 동일한 검증이 토큰 카운팅 엔드포인트에도 적용됩니다.

이 모델들에서는 사고가 항상 켜져 있으며, 강제 도구 호출은 이를 건너뛰게 됩니다. 그러면 모델이 풀이 과정을 도구 인수에 대신 써넣게 되어 인수 품질이 낮아집니다. 스키마에 유효한 JSON이 필요하다면 tool_choice: {"type": "auto"}를 유지하고 엄격한 도구 사용으로 strict: true를 설정하거나, 스키마를 구조화된 출력으로 옮기세요. 모델이 텍스트로 답하는 대신 도구를 호출하게 하려면, 도구가 언제 적용되는지 프롬프트에 명시하세요(예: "get_weather 도구를 사용해 답하세요"). Claude Fable 5.1은 명시적인 도구 지시를 안정적으로 따릅니다.

이전 모델은 Claude Fable 5.1의 thinking 블록을 읽을 수 없습니다

모든 thinking 블록은 어떤 모델이 생성했는지를 기록하며, 한 방향으로만 보존됩니다: Claude Fable 5.1은 이전 모델의 thinking 블록을 읽지만, 어떤 이전 모델도 Claude Fable 5.1의 블록을 읽지 못합니다. Claude Fable 5.1로 옮겨가는 대화(Claude Opus 5, Claude Fable 5 또는 그 이전의 어떤 Claude 모델에서든)는 추론을 유지합니다. Claude Fable 5.1에서 그러한 모델 중 하나로 옮겨가는 대화는 해당 모델에서 실행되는 턴 동안 추론을 잃습니다.

요청에 대상 모델이 읽을 수 없는 블록이 포함된 경우(예: 대화 중간에 모델을 전환하는 라우터나 폴백), API는 모델이 보기 전에 해당 블록을 제거합니다. 제거된 블록은 input_tokens에 포함되지 않으며 과금되지 않습니다. thinking-binding-controls-2026-08-01 베타 헤더를 사용하면 제거 사실이 최상위 input_transformations 배열에 보고됩니다. 헤더가 없으면 제거는 조용히 이루어집니다. "Preserved thinking"(보존된 사고)를 참조하세요.

이전 턴을 편집하면 thinking 블록이 무효화됩니다

Claude Fable 5.1 thinking 블록 앞에 있는 무엇이든(system 프롬프트, tools, 또는 이전 메시지) 수정하면 다음 요청에서 오류가 발생하거나, 해당 동작을 선택한 경우 블록이 제거됩니다. Claude Mythos 5.1은 이 검사를 실행하지 않습니다. Claude Code, claude.ai, Claude Managed Agents, 그리고 Claude Agent SDK는 해당 접두부를 대신 온전하게 유지해 줍니다. 코드에서 messages 배열을 직접 구성한다면 마이그레이션 전에 확인하세요: 보존된 사고에서 검사 방법과 각 수정 방법을 안내합니다. 이 검사는 2026년 8월 31일 이후에 생성된 신규 계정에 대해 강제 적용됩니다. 그 이전에 생성된 계정의 경우, API는 불일치를 기록하지만 요청이 thinking.block_binding.prefix_mismatch_behavior를 설정한 경우에만 조치를 취합니다.

다음 패턴은 이후의 모든 thinking 블록을 무효화합니다:

  • 이후 턴은 유지하면서 이전 턴을 편집, 재정렬 또는 제거하는 것.
  • 다음 요청에서 제거할 요청별 텍스트(리마인더나 상태 줄)를 이전 턴에 주입하는 것.
  • 같은 대화 내 요청 사이에 최상위 system 프롬프트나 tools 배열을 재구성하는 것.
  • 이후 요청에서 다른 바이트를 제공하는 이미지 또는 문서 URL(검사는 URL이 아닌 바이트를 대상으로 하므로, 동일한 파일에 대한 순환 서명 URL은 괜찮습니다).

다음은 이후 블록을 유효하게 유지합니다: 선두에 연속된 thinking 블록을 제거하는 것(가장 오래된 것부터), 서버 측 컴팩션이나 컨텍스트 편집이 기록을 정리하도록 두는 것, cache_control 마커를 옮기는 것, 요청 사이에 effort를 변경하는 것. 연속 구간의 시작이 아닌 다른 위치에서 thinking 블록을 제거하면 그 뒤의 모든 thinking 블록이 무효화됩니다.

검사가 강제 적용되는 경우, 무효화된 블록을 재전송하는 요청은 The block is bound to a different conversation이라는 메시지와 함께 400으로 거부됩니다. 대신 블록을 제거하고 계속하려면 thinking-binding-controls-2026-08-01 베타 헤더와 함께 thinking.block_binding.prefix_mismatch_behavior: "drop_block"을 보내세요. 제거 사실은 input_transformationsreason: "prefix_binding_mismatch"로 보고됩니다.

긴 세션에 걸쳐 사고를 유효하게 유지하려면 대화를 추가 전용(append-only)으로 취급하세요. system이나 tools를 편집하는 대신 대화 중 시스템 메시지(한 턴에만 적용되어야 한다면 턴 범위)로 지시를 추가하고, 대화 중 도구 변경으로 도구를 변경하세요. 편집으로 간주되지 않는 서버 측 컨텍스트 편집 또는 컴팩션으로 컨텍스트를 정리하세요. 이러한 패턴은 프롬프트 캐시도 따뜻하게 유지합니다. 통합이 기록을 편집하는지 알아보려면 prefix_mismatch_behavior: "drop_block"으로 세션을 실행하고 input_transformations를 로깅하세요: 마이그레이션 가이드에 3단계 검사가 있습니다. 전체 규칙은 보존된 사고를 참조하세요.

새로운 기능

대화 중 effort 변경(베타)

Claude Fable 5.1에서는 프롬프트 캐시를 무효화하지 않고 대화 중에 effort 수준을 변경할 수 있습니다. 어려운 단계에서는 높이고 일상적인 단계에서는 낮추세요. 메시지별 effort는 베타입니다: mid-conversation-output-config-2026-07-01 베타 헤더를 포함하세요. Claude Fable 5.1, Claude Mythos 5.1, Claude Opus 5가 Claude API에서 이를 지원합니다.

client = anthropic.Anthropic()

response = client.beta.messages.create(
    model="claude-fable-5-1",
    max_tokens=4096,
    output_config={"effort": "high"},
    messages=[
        {
            "role": "user",
            "content": "Plan a migration from SQLite to PostgreSQL in three short steps.",
        },
        {
            "role": "assistant",
            "content": "1. Export the SQLite data. 2. Create the PostgreSQL schema. 3. Import the data and verify row counts.",
        },
        # Effort 전용 시스템 메시지: 새 수준은 다음 사용자 턴부터 적용됩니다.
        {"role": "system", "content": [], "output_config": {"effort": "low"}},
        {"role": "user", "content": "Summarize the plan in one sentence."},
    ],
    betas=["mid-conversation-output-config-2026-07-01"],
)

for block in response.content:
    if block.type == "text":
        print(block.text)

자세한 내용은 메시지별 effort를 참조하세요.

턴 범위 시스템 메시지(베타)

대화 중 시스템 메시지는 한 턴으로 범위를 지정할 수 있습니다. role: "system" 메시지에 clear_at: "next_user_message"를 설정하면 해당 텍스트는 현재 턴 동안 시스템 프롬프트 권한을 가지며, 이후 user 메시지가 존재하게 되면 렌더링을 멈춥니다. 메시지는 messages에 남아 있고 그대로 계속 다시 보내므로, 대화의 앞부분은 아무것도 바뀌지 않습니다. 프롬프트 캐시는 계속 일치하고, 이후 thinking 블록은 유효하게 유지되며, 지워진 메시지는 입력 토큰 비용이 들지 않습니다. 기록에 텍스트를 주입했다가 다음 요청에서 삭제하는 대신, 도구 루프에서 턴별 리마인더("코드를 더 실행하기 전에 받은 편지함을 확인하세요", "사용자는 그 도구 출력을 볼 수 없습니다")에 사용하세요. 턴 범위 시스템 메시지는 베타입니다: mid-conversation-system-clear-at-2026-08-21 베타 헤더를 포함하세요. 턴 범위 시스템 메시지를 참조하세요.

{
  "role": "system",
  "clear_at": "next_user_message",
  "content": "Results have landed in your inbox. Check it before running more code."
}

도구 호출 사이의 진행 상황 업데이트(베타)

Claude Fable 5와 마찬가지로, Claude Fable 5.1은 도구 호출 사이에 무엇을 발견했고 다음에 무엇을 할지에 대한 짧은 진행 상황 업데이트를 작성하지만, 그 수는 더 적습니다(Claude Fable 5에서 변경된 점 참조). 각 업데이트는 도구 호출 직전에 자체 thinking 블록으로 도착합니다. 기본 thinking.display 값인 "omitted"에서는 이러한 블록이 추론과 마찬가지로 비어 있는 상태로 돌아오므로, 긴 에이전틱 턴이 사용자에게는 조용해 보일 수 있습니다. 새로운 점은 display: "updates" 옵션입니다: thinking-display-updates-2026-08-18 베타 헤더와 함께 설정하면 추론은 숨겨진 채로 진행 상황 업데이트를 텍스트로 받을 수 있습니다. 그러면 비어 있지 않은 텍스트가 있는 모든 thinking 블록은 사용자에게 보여줄 수 있는 상태 줄이 됩니다. "summarized"도 이를 반환하지만, 요약된 추론과 섞여 있습니다. 도구 호출 사이의 진행 상황 업데이트를 참조하세요.

콘텐츠 출처

Claude Fable 5.1과 Claude Mythos 5.1이 생성한 텍스트는 모델이 제공되는 모든 플랫폼에서 Anthropic의 통계적 텍스트 워터마크를 포함합니다. Claude가 생성하는 지원되는 이미지 및 비디오 파일(예: 코드 실행 도구를 통해)은 Claude API의 Files API를 통해 가져올 때 서명된 C2PA Content Credentials를 포함합니다.

워터마크는 출력의 의미, 품질 또는 가독성을 바꾸지 않습니다. 토큰이나 숨겨진 문자를 추가하지 않고, 귀하나 귀하의 조직에 대한 정보를 담지 않으며, 요청이나 응답을 변경할 필요도 없습니다. 배경 정보는 Claude가 AI 생성 콘텐츠를 표시하는 방법Claude의 텍스트 워터마크 작동 방식을 참조하세요.

동작 차이

Claude Fable 5에서 변경된 점

Claude Fable 5.1은 코드 변경 없이도 드러나는 여러 면에서 Claude Fable 5와 다릅니다. 각각에 대한 프롬프팅 해결책이 Claude Fable 5.1 프롬프팅에 있습니다:

  • 병렬 도구 호출의 변동성이 더 큽니다. Claude Fable 5가 여러 개를 일괄 처리하던 곳에서 Claude Fable 5.1은 턴당 하나의 도구 호출을 발행할 수 있습니다. 이는 다음의 독립적인 읽기가 암시만 되어 있는 긴 에이전트 루프에서 나타납니다: 커스텀 코딩 에이전트, bash 및 에디터 하네스, 컴퓨터 사용. 추가 턴은 토큰, 왕복 횟수, 실제 경과 시간을 소모하지만 답변 품질을 떨어뜨리지는 않습니다. 가져올 여러 항목을 명시한 요청은 여전히 병렬로 실행됩니다. 에이전트 루프에서 독립적인 도구 호출 일괄 처리의 한 줄짜리 일괄 처리 지시를 추가하세요.
  • 긴 도구 실행 중 진행 상황 업데이트가 더 적습니다. 모델은 도구 호출 사이에 사용자 대상 텍스트를 덜 작성하며, 특히 높은 effort에서 그렇습니다. thinking.display"updates"(베타)로 설정하여 모델이 작성하는 진행 상황 업데이트를 받고, 발견 사항을 최종 응답까지 보류하라고 지시하는 프롬프트 줄은 제거하세요. UI가 내레이션에 의존한다면 시작 문장, 주기적 업데이트, 마무리 요약을 명시적으로 요청하세요. 사용자 대상 진행 상황 업데이트 요청을 참조하세요.
  • low effort에서 기억에 의존해 답하는 경우가 더 많습니다. 가장 낮은 effort 수준에서 모델은 검색 또는 검색(retrieval) 도구를 덜 자주 호출합니다. 최신 정보가 필요한 턴에서는 대화 중을 포함해 effort를 높이거나, 낮은 effort에서의 검색 트리거의 검증 유도 문구를 추가하세요.
  • 곳곳에서 더 밀도 높은 산문. 일부 경우 산문이 Claude Fable 5보다 밀도가 높아, 문장이 더 길고 단락 구분이 더 적습니다. 글쓰기 밀도를 참조하세요.
  • 채팅에서 서식이 더 적습니다. 모델은 이전 Claude 모델보다 굵은 글씨, 헤더, 목록을 덜 사용하므로, 그러한 모델을 위해 작성된 서식 억제 규칙이 콘텐츠에 필요한 구조까지 억제할 수 있습니다. 채팅에서의 서식을 참조하세요.
  • 요약에서 표시되지 않은 인용. 문서를 요약할 때 모델은 원문의 구절을 인용으로 표시하지 않고 그대로 재현할 가능성이 더 높습니다. 검색된 출처 인용을 참조하세요.
  • 작은 변경에 대한 파일 전체 재작성. 텍스트 파일을 편집할 때 모델은 대상을 좁힌 편집을 하기보다 파일 전체를 재작성할 가능성이 더 높습니다. 결과는 대개 같지만, 재작성은 더 많은 출력 토큰과 시간을 소모합니다. 파일 전체 재작성보다 대상을 좁힌 편집 선호를 참조하세요.

Claude Fable 5에서 변경되지 않은 점

다음 Messages API 동작은 Claude Fable 5에서 변경 없이 이어집니다:

  • 적응형 사고가 항상 켜져 있습니다. budget_tokens가 있는 thinking: {"type": "enabled"}thinking: {"type": "disabled"}는 모두 400 오류를 반환합니다. thinking을 생략하거나 {"type": "adaptive"}를 보내세요.
  • thinking.display의 기본값은 "omitted"입니다. "summarized"를 사용할 수 있으며, 원시 사고 사슬은 절대 반환되지 않습니다.
  • 도구 호출 사이의 추론은 텍스트가 아닌 thinking 블록에 나타나며, 인터리브 사고는 베타 헤더 없이 자동으로 적용됩니다.
  • 어시스턴트 응답을 프리필하면 400 오류가 반환됩니다.
  • 기본값이 아닌 temperature, top_p, top_k 값은 400 오류를 반환합니다.
  • 캐시 가능한 최소 프롬프트 길이는 512 토큰입니다.
  • 대화 중 시스템 메시지와 도구 변경이 지원됩니다.

역량 개선

Claude Fable 5.1은 Claude Fable 5보다 개선되었으며, 그 격차는 더 높은 effort 수준에서 가장 큽니다. 개선은 여섯 가지 영역에 집중됩니다:

  • 긴 세션에 걸친 에이전틱 코딩, 여러 파일에 걸친 기능, 대규모 리팩터링 및 마이그레이션, 디버깅, 그리고 몇 시간 동안 실행되는 세션에 걸친 코드 리뷰를 포함합니다.
  • 문서, 스프레드시트, 슬라이드를 활용한 지식 작업, 첫 질문에서 시작해 완성된 문서, 실시간 수식 스프레드시트, 또는 빈 페이지에서 만든 슬라이드 덱까지 분석을 이끌어 갑니다.
  • 리서치 및 검색, 발견한 내용을 후속 조사하는 다단계 웹 리서치와 딥 리서치 작업에서 더 높은 정확도를 보입니다.
  • 비전, 차트에 대한 자르기 및 확대 도구 사용을 포함해 PDF에 중첩된 밀도 높은 차트, 공시 자료, 표를 읽습니다.
  • 긴 컨텍스트 작업, 전체 1M 토큰 컨텍스트 윈도우에 걸쳐 세부 사항을 추론하고 연결합니다.
  • 컴퓨터 사용, 브라우저와 데스크톱 애플리케이션을 더 안정적으로 조작하고 실패한 단계에서 복구합니다.

다국어 성능은 Claude Fable 5와 동등합니다.

거부, 폴백, 과금

Claude Fable 5.1은 Claude Fable 5와 동일한 stop_details 카테고리를 다루는 안전 분류기를 포함하며, 거부 및 폴백의 모든 내용이 적용됩니다. stop_reason: "refusal"을 반환할 수 있으므로 거부를 처리하고 폴백을 구성하세요.

  • 거부: 거절된 요청은 HTTP 200과 함께 stop_reason: "refusal" 및 발동된 정책 영역을 명시하는 stop_details 객체를 반환합니다.
  • 폴백: 서버 측 폴백, SDK 미들웨어, 또는 자체 재시도로 거부된 요청을 다른 모델에서 재시도하세요. fallbacks: "default"(베타)는 거절된 요청을 해당 카테고리에 대해 Anthropic이 권장하는 모델에서 재시도합니다. Claude Fable 5.1에 허용되는 폴백 대상은 Claude Opus 4.8과 Claude Opus 5입니다.
  • 과금: 어떤 출력보다 먼저 도착한 거부에 대해서는 과금되지 않으며, Claude Fable 5.1의 경우 폴백 크레딧이 모델 전환에 따른 프롬프트 캐시 비용을 환불합니다.

가격

Claude Fable 5.1과 Claude Mythos 5.1은 캐시 읽기를 제외하면 Claude Fable 5와 가격이 동일합니다(가격은 USD 기준):

기본 입력5분 캐시 쓰기1시간 캐시 쓰기캐시 읽기출력
$10 / MTok$12.50 / MTok$20 / MTok$0.25 / MTok$50 / MTok

이 모델들에서 캐시 읽기(히트 및 갱신)는 기본 입력 가격의 0.025배이며, 다른 Claude 모델에서는 0.1배입니다. 캐시된 접두부를 다시 읽는 긴 에이전틱 세션은 Claude Fable 5 요율의 4분의 1을 지불합니다. 캐시 쓰기와 512 토큰 캐시 가능 최소 프롬프트 길이는 변경되지 않았습니다.

배치 처리는 입력 토큰 백만 개당 $5 USD, 출력 토큰 백만 개당 $25 USD입니다. 데이터 레지던시 및 도구 가격은 가격을 참조하세요.

제공 범위

Claude Fable 5.1은 다음에서 제공됩니다:

Claude Mythos 5.1은 Project Glasswing의 승인된 고객에게만 제공됩니다. 액세스하려면 Anthropic, AWS 또는 Google Cloud 계정 팀에 문의하세요.

Claude Fable 5.1과 Claude Mythos 5.1은 30일 데이터 보존이 적용되며, Anthropic이 명시적으로 승인하지 않는 한 제로 데이터 보존 하에서는 제공되지 않습니다. 둘 다 Claude Fable 5 및 Claude Mythos 5와 마찬가지로 Covered Models입니다. 모델별 데이터 보존 요구 사항을 참조하세요.

Claude Fable 5에서 마이그레이션

Claude Fable 5에서 마이그레이션하려면 모델 ID를 업데이트하세요:

model = "claude-fable-5"  # Before
model = "claude-fable-5-1"  # After

그런 다음 다음 항목을 검토하세요:

  1. any 또는 tool 유형의 tool_choice를 모두 제거하세요. 스키마 강제는 tool_choice: {"type": "auto"}와 함께 엄격한 도구 사용으로 옮기거나 구조화된 출력으로 옮기세요.
  2. thinking 블록을 변경 없이 다시 전달하고 기록을 추가 전용으로 유지하세요. 코드에서 messages 배열을 직접 구성한다면 기록 편집 검사를 실행하세요: 현재 주입했다가 삭제하는 턴별 리마인더를 턴 범위 시스템 메시지로 옮기고, systemtools 변경을 대화 중 시스템 메시지로 옮기고, 컨텍스트를 서버 측에서 정리하거나 클라이언트 측 요약을 거쳐 이어가는 턴에서 thinking 블록을 제거한 다음, 프로덕션용 prefix_mismatch_behavior를 선택하고 input_transformations를 모니터링하세요.
  3. 기본값(high)에서 effort를 다시 조정하고, 세션 전체에 한 수준을 유지하는 대신 대화 중에 변경하는 것을 고려하세요.
  4. 에이전트 루프에서 Claude Fable 5가 여러 개를 일괄 처리하던 곳에서 턴당 하나의 도구 호출이 발생하는지 살펴보고, Claude Fable 5.1 프롬프팅의 턴별 메모를 추가하세요.
  5. 평가를 다시 실행하세요. 거부 처리, 폴백, 폴백 크레딧, 토큰 수는 변경 없이 이어집니다. 캐시 읽기 비용은 더 낮아졌고(가격 참조), 기본 동작은 Claude Fable 5에서 변경된 점에 나열된 방식으로 다릅니다.

Claude Opus 5 및 이전 모델에서의 마이그레이션을 포함한 단계별 지침은 마이그레이션 가이드를 참조하세요.

다음 단계

현재 제공되는 모든 Claude 모델의 사양과 가격.

Claude Fable 5, Claude Opus 5 및 이전 모델에서 마이그레이션하기.

Claude Fable 5.1에 특화된 프롬프팅 패턴.

Was this page helpful?