Claude Platform Docs
모델 및 가격Claude Opus 5

Claude Opus 5의 새로운 기능

Claude Opus 5의 새로운 기능 및 동작 변경 사항에 대한 개요입니다.

Claude Opus 5는 Claude Opus 4.8 대비 단계적 도약 수준의 개선을 이룬 모델로, 심층 추론, 에이전트 및 장기 작업, 테스트 시점 컴퓨팅 확장에서 가장 큰 향상을 보입니다. 이 페이지에서는 대화 중 도구 변경을 포함하여 Claude Opus 5의 모든 새로운 사항을 요약하며, Claude Opus 4.8에서 실행되던 코드에 영향을 주는 두 가지 호환성이 깨지는 변경 사항도 다룹니다. 즉, thinking(사고)이 기본적으로 켜져 있으며, thinking은 effort high 이하에서만 비활성화할 수 있습니다.

새로운 모델

모델API 모델 ID설명
Claude Opus 5claude-opus-5복잡한 에이전트 코딩 및 엔터프라이즈 작업용

Claude Opus 5는 1M 토큰 "context window"(컨텍스트 윈도우)(1M 토큰이 기본값이자 최대값이며, 더 작은 컨텍스트 변형은 없습니다), 128k 최대 출력 토큰을 갖추고 있으며, thinking이 기본적으로 켜져 있습니다. Priority Tier는 Claude Opus 5에서 지원되지 않습니다.

전체 가격 및 사양은 모델 개요를 참조하세요.

새로운 기능

대화 중 도구 변경 (베타)

세션이 지속되는 동안 고정된 도구 목록을 다시 전송하는 대신, 프롬프트 캐시를 유지하면서 대화의 턴 사이에 도구를 추가하거나 제거할 수 있습니다. 대화 중 도구 변경은 베타 기능입니다. 요청에 mid-conversation-tool-changes-2026-07-01 베타 헤더를 포함하세요. 사용법은 대화 중 도구 변경을 참조하세요.

기본 fallbacks 모드

fallbacks 매개변수는 새로운 "default" 모드를 지원하며, 이 모드는 직접 관리하는 모델 목록 대신 거부 카테고리별로 Anthropic이 권장하는 폴백 모델을 적용합니다. fallbacks 매개변수 전체가 베타 상태입니다. "default" 모드와 명시적 모델 목록을 모두 지원하는 server-side-fallback-2026-07-01 베타 헤더를 사용하세요(이전의 server-side-fallback-2026-06-01 헤더는 명시적 목록만 허용합니다). 거부 및 폴백을 참조하세요.

낮아진 프롬프트 캐시 최소값

Claude Opus 5에서 캐시 가능한 최소 프롬프트 길이는 512 토큰으로, Claude Opus 4.8의 1,024 토큰에서 낮아졌습니다. Claude Opus 4.8에서 캐시하기에 너무 짧았던 프롬프트도 이제 코드 변경 없이 캐시 항목을 생성할 수 있습니다. 모델별 최소값은 "Prompt caching"(프롬프트 캐싱)을 참조하세요.

Fast mode

Fast mode(리서치 프리뷰)는 Claude API에서만 Claude Opus 5에 대해 사용할 수 있으며, 현재 Amazon Bedrock, Claude Platform on AWS, Google Cloud 또는 Microsoft Foundry에서는 사용할 수 없습니다. Claude Opus 5의 fast mode 가격은 입력 토큰 백만 개당 $10 USD, 출력 토큰 백만 개당 $50 USD입니다. 액세스, 지원 모델 및 가격은 Fast mode를 참조하세요.

동작 변경 사항

기본적으로 켜져 있는 thinking

Claude Opus 4.8에서는 thinking: {"type": "adaptive"}를 설정하지 않으면 요청이 thinking 없이 실행됩니다. Claude Opus 5에서는 동일한 요청이 기본적으로 adaptive thinking(적응형 사고)이 켜진 상태로 실행됩니다. 모델이 각 턴에서 언제, 얼마나 사고할지 결정하며, effort 매개변수가 사고 깊이를 제어하는 수단입니다. 전송 값은 변경되지 않았으며, thinking: {"type": "adaptive"}는 여전히 유효하고 기본값과 동일합니다.

이는 Claude Opus 4.8에서 thinking 없이 실행되던 코드에 대해 호환성이 깨지는 변경 사항입니다. 응답은 첫 번째 text 블록 앞에 하나 이상의 thinking 블록으로 시작할 수 있으며, 기본값인 display: "omitted"에서는 빈 thinking 필드와 함께 반환됩니다. 따라서 content[0].text를 읽거나 첫 번째 스트리밍 콘텐츠 블록을 텍스트로 취급하는 코드는 대신 type 필드로 콘텐츠 블록을 선택해야 합니다. 도구 사용 루프는 thinking 블록을 도구 결과와 함께 완전하고 수정되지 않은 상태로 다시 전달해야 합니다. thinking 블록 보존을 참조하세요.

Thinking 토큰은 출력 토큰으로 청구되며 max_tokens에 포함됩니다. max_tokens는 총 출력(thinking과 응답 텍스트의 합)에 대한 엄격한 한도이므로, Claude Opus 4.8에서 thinking 없이 실행되던 워크로드의 경우 max_tokens를 재검토하고 비용 기준선을 다시 설정하세요.

API는 thinking을 비활성화하는 옵션을 유지하며, 비활성화에는 effort 제한이 적용됩니다.

Effort의 중요성 증가

Claude Opus 5는 이전의 어떤 Opus 모델보다 추가 effort를 더 나은 결과로 더 안정적으로 전환하므로, 선택하는 effort 수준이 더 큰 영향을 미칩니다. 전체 단계를 사용할 수 있습니다. low, medium, high, xhigh, max이며, max는 가능한 가장 깊은 추론을 위한 최상위 단계입니다. 기본값인 high에서 시작하여 평가 결과에 따라 양방향으로 조정하세요. 품질이 유지되는 경우 단계를 낮춰 토큰과 지연 시간을 절약하거나, 가장 까다로운 작업에는 단계를 높이세요. xhigh 또는 max effort로 실행할 때는 모델이 서브에이전트와 도구 호출 전반에 걸쳐 사고하고 행동할 여유가 있도록 큰 max_tokens를 설정하세요.

다음 요청은 effort를 max까지 최대로 올립니다.

client = anthropic.Anthropic()

with client.messages.stream(
    model="claude-opus-5",
    max_tokens=64000,
    output_config={"effort": "max"},
    messages=[
        {
            "role": "user",
            "content": "Explain why the sum of two even numbers is always even.",
        }
    ],
) as stream:
    response = stream.get_final_message()

print(response)

Claude Opus 5에서는 thinking이 기본적으로 켜져 있으므로 thinking 필드가 필요하지 않습니다.

Thinking 비활성화에는 effort high 이하가 필요

Claude Opus 5에서 thinking: {"type": "disabled"}는 effort 수준이 high 이하일 때만 허용됩니다. effort xhigh 또는 max와 함께 thinking: {"type": "disabled"}를 설정하면 400 오류가 반환됩니다. 이 규칙은 Claude Opus 5 및 이후 모델에 대한 모든 요청에 적용됩니다. 이는 thinking 비활성화가 effort 수준과 독립적이었던 Claude Opus 4.8과 비교해 호환성이 깨지는 변경 사항입니다. Claude Opus 4.8 요청에서 effort xhigh 또는 max로 thinking을 비활성화하고 있다면, thinking을 비활성화 상태로 유지하고 effort를 high 이하로 설정하거나, effort 수준을 유지하고 thinking 필드를 제거하세요.

Thinking이 비활성화된 상태에서 Claude Opus 5는 간혹 tool_use 블록을 내보내는 대신 텍스트 출력에 도구 호출을 작성하거나, 표시되는 응답에 내부 XML 태그를 포함할 수 있습니다. 가능한 경우 thinking을 활성화 상태로 유지하고 낮은 effort 수준으로 토큰 비용을 제어하세요. thinking을 반드시 비활성화해야 하는 통합의 경우, 프롬프트 완화 방법은 thinking 비활성화 상태로 실행하기를 참조하세요.

모델 동작 차이

이러한 API 변경 사항 외에도, Claude Opus 5는 코드를 변경하지 않아도 알아차릴 수 있는 방식으로 Claude Opus 4.8과 다르게 동작합니다. 기본 사용자 대상 응답과 작성된 결과물이 더 길어집니다. 에이전트 세션에서 모델은 사용자에게 진행 상황을 더 자주 설명합니다. 멀티 에이전트 프레임워크에서는 서브에이전트에 더 쉽게 위임합니다. 또한 지시받지 않아도 자체 작업을 검증하므로, 이전 모델에서 이어져 온 검증 지시("최종 검증 단계를 포함하세요", "서브에이전트를 사용하여 검증하세요")를 제거하세요. 이러한 지시는 Claude Opus 5에서 과도한 검증을 유발합니다. 이러한 각 동작을 조정하는 프롬프트 패턴은 Claude Opus 5 프롬프팅을 참조하세요.

기능 개선

Claude Opus 4.8과 비교하여 Claude Opus 5는 점진적 개선이 아닌 단계적 도약 수준의 개선이며, Claude Fable 5의 절반 비용으로 최첨단 지능을 제공합니다. 가장 큰 향상은 다음 영역에서 나타납니다.

  • 심층 추론: 긴 문제 체인 전반에 걸쳐 다단계 분석을 지속합니다.
  • 에이전트 코딩 및 장기 작업: 확장된 도구 사용 루프 전반에 걸쳐 작업에 집중하며, 스텁이나 플레이스홀더를 남기지 않고 다중 파일 기능, 대규모 리팩터링, 엔드투엔드 기능 작업을 완료합니다.
  • 테스트 시점 컴퓨팅 확장: 추가 effort(max 수준까지)를 더 나은 결과로 전환합니다.
  • 낮은 effort 수준에서의 효율성: lowmedium effort가 더 높은 설정 대비 극히 일부의 토큰과 지연 시간으로 우수한 품질을 제공합니다.
  • 코드 리뷰 및 버그 탐지: 패스당 높은 비율로 실제 버그를 찾아내며 오탐이 적고, 낮은 effort 수준에서도 정확성을 유지합니다.
  • 비전: 차트, 문서, 다이어그램을 이해하고 UI 및 프런트엔드 시각 요소를 재현하며, 작업을 반복적으로 분석, 자르기, 검증할 수 있는 도구가 주어졌을 때 가장 강력합니다.
  • 긴 컨텍스트 작업: 기본값이자 최대값인 1M 토큰 컨텍스트 윈도우를 갖추고, 윈도우 전체에 걸쳐 일관된 지시 따르기, 도구 호출, 추론을 수행합니다.
  • 오피스 및 문서 작업: 복잡한 수식이 포함된 복잡한 다중 시트 스프레드시트를 생성 및 편집하고, 잘 구조화된 슬라이드 덱을 제작합니다.
  • 멀티 에이전트 조정: 효과적인 작성자-검증자 패턴으로 서브에이전트 팀을 운영하며, 에이전트가 서로의 작업을 덮어쓰는 경우가 거의 없습니다.

이러한 기능을 최대한 활용하는 프롬프트 패턴은 Claude Opus 5 프롬프팅을 참조하세요.

가격

Claude Opus 5의 가격은 입력 토큰 백만 개당 $5 USD, 출력 토큰 백만 개당 $25 USD로, Claude Opus 4.8과 동일합니다. thinking이 기본적으로 켜져 있고 thinking 토큰이 출력 토큰으로 청구되므로, Claude Opus 4.8에서 thinking 없이 실행되던 워크로드는 동일한 토큰당 요금으로 요청당 더 많은 출력 토큰을 생성할 수 있습니다. 비용 제어를 참조하세요.

배치 처리, 프롬프트 캐싱, fast mode 요금을 포함한 전체 가격은 가격을 참조하세요.

가용성

Claude Opus 5는 다음에서 사용할 수 있습니다.

  • Claude API: 모든 고객이 claude-opus-5로 사용할 수 있습니다.
  • AWS: Claude in Amazon Bedrock을 통해 anthropic.claude-opus-5로, 그리고 Claude Platform on AWS를 통해 사용할 수 있습니다. Amazon Bedrock에서 Claude Opus 5는 동일한 인프라에서 제공되는 bedrock-runtimeInvokeModel API를 통해서도 접근할 수 있습니다. Claude on Amazon Bedrock (레거시) 통합은 ARN 버전 모델 ID 표에 이 모델을 포함하지 않습니다.
  • Google Cloud: Claude on Google Cloud를 통해 claude-opus-5로 사용할 수 있습니다.
  • Microsoft Foundry: Claude in Microsoft Foundry를 통해 사용할 수 있습니다.

Claude Opus 4.8은 이 모든 플랫폼에서 계속 사용할 수 있습니다.

마이그레이션 가이드

Claude Opus 4.8에서 마이그레이션하려면 모델 ID를 업데이트하세요.

model = "claude-opus-4-8"  # Before
model = "claude-opus-5"  # After

그런 다음 동작 변경 사항의 두 가지 호환성이 깨지는 변경 사항을 검토하세요. thinking이 기본적으로 켜져 있으며(응답이 thinking 블록으로 시작할 수 있으므로 type으로 콘텐츠 블록을 선택하세요), effort xhigh 또는 max로 thinking을 비활성화하면 400 오류가 반환됩니다. 단계별 지침과 전체 체크리스트는 마이그레이션 가이드를 참조하세요.

다음 단계

현재 모든 Claude 모델의 전체 사양 및 가격.

Claude Opus 5에 특화된 동작 차이 및 프롬프트 패턴.

Claude가 응답할 때 사용하는 토큰 수를 low부터 max까지 제어합니다.

기본적으로 켜져 있을 때 thinking이 작동하는 방식과 비활성화할 수 있는 경우.

Claude가 작업 속도를 조절할 수 있도록 권고 토큰 예산을 제공합니다.

이전 Claude 버전에서 최신 Claude 모델로 마이그레이션하기 위한 가이드.

프리미엄 가격으로 Claude Opus 모델에서 더 높은 초당 출력 토큰을 얻으세요.

Was this page helpful?