이 가이드는 Messages API 코드 마이그레이션을 다룹니다. Claude Managed Agents를 사용하는 경우, 모델 이름 업데이트 외에는 변경이 필요하지 않습니다.
Claude API 스킬로 마이그레이션을 자동화하세요. Claude Code에서 /claude-api migrate를 실행하여 번들로 제공되는 Claude API 스킬을 호출할 수 있습니다. 이 페이지의 모든 대상 모델에 대해 작동합니다:
/claude-api migrate this project to claude-opus-4-8이 스킬은 코드 베이스 전체에 걸쳐 대상 모델에 대한 모델 ID 교체와 필요에 따라 호환성이 깨지는 파라미터 변경, prefill 교체, effort 보정을 적용한 다음, 수동으로 확인해야 할 항목의 체크리스트를 생성합니다. 파일을 편집하기 전에 마이그레이션 범위(전체 작업 디렉터리, 하위 디렉터리 또는 특정 파일 목록)를 확인하도록 요청합니다. 이 스킬은 또한 Amazon Bedrock, Google Cloud, Claude Platform on AWS, Microsoft Foundry 클라이언트를 감지하고 각 플랫폼에 맞게 모델 ID 형식과 기능 변경 사항을 조정합니다.
Claude Mythos 5는 초대 전용 연구 프리뷰인 Claude Mythos Preview의 액세스 제한 후속 모델입니다. 동일한 기능을 갖춘 정식 출시 모델은 Claude Fable 5를 참조하세요.
마이그레이션은 대부분 그대로 교체하면 됩니다. Claude Mythos 5는 Claude Mythos Preview와 동일한 Messages API와 동일한 도구 사용 패턴을 사용하며, 두 모델이 동일한 토크나이저를 사용하기 때문에 토큰 수는 거의 변하지 않습니다. 확인해야 할 주요 변경 사항은 더 이상 사용할 수 없는 기능(다음 섹션에 나열됨)과 thinking 출력입니다.
Claude Mythos Preview 지원 종료 일정은 모델 지원 중단을 참조하세요.
model = "claude-mythos-preview" # Before
model = "claude-mythos-5" # After확장 사고 및 thinking 토큰 예산: 수동 확장 사고(thinking: {type: "enabled", budget_tokens: N})는 claude-mythos-5에서 지원되지 않으며 400 오류를 반환합니다. 적응형 사고는 항상 켜져 있습니다. 모델이 각 요청에서 언제, 얼마나 생각할지 결정하며, thinking 구성이 필요하지 않습니다. thinking: {type: "disabled"}는 오류를 반환합니다. budget_tokens에는 직접적인 대체 항목이 없습니다. thinking은 적응형이며, effort 파라미터는 thinking 예산이 아닌 별도의 출력 수준 제어입니다.
이전 (Claude Mythos Preview):
client.messages.create(
model="claude-mythos-preview",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)이후 (Claude Mythos 5):
client.messages.create(
model="claude-mythos-5",
max_tokens=16000,
messages=[{"role": "user", "content": "..."}],
)어시스턴트 prefill: 어시스턴트 메시지 prefill은 claude-mythos-5에서 지원되지 않으며 Claude Mythos Preview와 마찬가지로 400 오류를 반환합니다. 대신 시스템 프롬프트 지침을 사용하세요.
Thinking 출력: claude-mythos-5에서는 원시 사고 과정(chain of thought)이 절대 반환되지 않지만, thinking.display가 summarized로 설정된 경우 thinking 블록에는 여전히 읽을 수 있는 요약 텍스트가 포함됩니다. 동일한 모델에서 대화를 계속할 때는 thinking 블록을 변경하지 않고 그대로 다시 전달하세요. Claude Fable 5 및 Claude Mythos 5의 thinking 출력을 참조하세요.
claude-mythos-5는 claude-mythos-preview와 동일한 토크나이저(Claude Opus 4.7에서 도입된 토크나이저)를 사용합니다. claude-mythos-preview에서 마이그레이션할 때 토큰 수는 거의 변하지 않습니다. Claude Opus 4.7 이전 모델과 비교하면, 동일한 콘텐츠가 콘텐츠와 워크로드 형태에 따라 약 30% 더 많은 토큰으로 토큰화될 수 있습니다.
/v1/messages/count_tokens는 claude-mythos-preview와 비교하여 claude-mythos-5에 대해 거의 변하지 않은 값을 반환합니다. 자체 워크로드에서 비용과 지연 시간의 기준을 다시 설정하세요.
claude-mythos-preview에서 claude-mythos-5로 업데이트하세요.thinking: {type: "enabled", budget_tokens: N})을 제거하세요. 적응형 사고는 항상 켜져 있으며, thinking 필드가 필요하지 않습니다.thinking: {type: "disabled"} 구성을 모두 제거하세요. claude-mythos-5에서 thinking을 비활성화하면 오류가 반환됩니다.budget_tokens를 제거하세요. 직접적인 대체 항목이 없습니다. thinking은 적응형이며, effort 파라미터는 thinking 예산이 아닌 별도의 출력 수준 제어입니다.thinking 필드를 파싱하는 코드가 이를 표시용 텍스트로만 취급하고, 동일한 모델에서 계속할 때 thinking 블록을 변경하지 않고 그대로 다시 전달하는지 확인하세요. thinking.display는 Claude Mythos Preview와 마찬가지로 claude-mythos-5에서 기본값이 "omitted"입니다. 읽을 수 있는 요약을 받으려면 display: "summarized"를 설정하세요. Claude Fable 5 및 Claude Mythos 5의 thinking 출력을 참조하세요.thinking 및 redacted_thinking 블록을 제거하세요. claude-mythos-5의 thinking 블록은 이를 생성한 모델에 연결되어 있으며, Claude Fable 5 및 Claude Mythos 5 이외의 모델은 이를 조용히 무시합니다. 제거하면 모델 간 요청을 최소화하고 일관되게 유지할 수 있습니다.claude-mythos-preview에서 마이그레이션할 때 토큰 수는 거의 변하지 않습니다.Claude Fable 5는 Anthropic의 가장 뛰어난 성능의 광범위하게 출시된 모델로, Claude API, Claude Platform on AWS, Amazon Bedrock, Google Cloud, Microsoft Foundry에서 정식으로 제공됩니다.
마이그레이션은 대부분 그대로 교체하면 됩니다. Claude Fable 5는 Claude Opus 4.8과 동일한 Messages API와 동일한 도구 사용 패턴을 사용합니다. 기본적으로 동일한 1M 토큰 컨텍스트 윈도우와 동일한 128k 최대 출력 토큰을 지원합니다. 두 모델이 동일한 토크나이저를 사용하기 때문에 토큰 수는 거의 변하지 않습니다.
확인해야 할 주요 변경 사항은 항상 켜져 있는 적응형 사고, thinking 출력, 안전 분류기 거부, 가격입니다. 마이그레이션 전에에서 가격과 데이터 보존을 다루고, 변경 사항에서 나머지를 다룹니다.
Claude Fable 5의 가격은 입력 토큰 100만 개당 $10, 출력 토큰 100만 개당 $50이며, Claude Opus 4.8은 각각 $5와 $25입니다. 자세한 내용은 Claude 가격을 참조하세요.
Claude Fable 5는 30일 데이터 보존이 필요하며 제로 데이터 보존(ZDR) 계약에서는 사용할 수 없습니다. 이 모델은 Covered Model로 지정되어 있습니다. Claude API에서 데이터 보존 구성이 이 요구 사항을 충족하지 않는 조직의 요청은 400 invalid_request_error를 반환합니다. ZDR 계약이 있는 조직은 Anthropic 계정 팀에 문의하여 데이터 보존 구성을 논의해야 합니다. Claude Opus 4.8은 ZDR에서 계속 사용할 수 있습니다. 또는 워크스페이스별로 데이터 보존을 구성할 수 있습니다. 30일 데이터 보존 요구 사항은 Claude Fable 5가 제공되는 모든 플랫폼에 적용됩니다. 플랫폼별 세부 정보는 모델별 데이터 보존 요구 사항을 참조하세요.
코드가 Claude Opus 4.7 이하에 있는 경우, 먼저 Claude Opus 4.7에서 Claude Opus 4.8로 마이그레이션을 적용하고, Claude Opus 4.7보다 이전 모델의 경우 Claude Opus 4.7 마이그레이션 단계를 적용하세요. 해당 섹션에서는 이 섹션에서 반복하지 않는 호환성이 깨지는 변경 사항(샘플링 파라미터 거부, 수동 확장 사고 거부, prefill 제거, 새 토크나이저)을 다룹니다.
model = "claude-opus-4-8" # Before
model = "claude-fable-5" # After이 섹션의 항목은 모델 ID를 교체한 후 확인할 가치가 있는 API 및 동작 차이를 설명합니다.
적응형 사고가 항상 켜져 있음: 적응형 사고는 claude-fable-5에서 유일한 thinking 모드입니다. 모델이 각 요청에서 언제, 얼마나 생각할지 결정하며, thinking 구성이 필요하지 않습니다. thinking: {type: "disabled"}는 오류를 반환합니다. thinking 깊이를 제어하려면 effort 파라미터를 사용하세요.
확인해야 할 동작 변경 사항: Claude Opus 4.8에서는 thinking 필드가 없는 요청이 thinking 없이 실행되지만, claude-fable-5에서는 동일한 요청이 적응형 사고와 함께 실행됩니다. max_tokens는 여전히 thinking과 응답 텍스트를 합한 총 출력에 대한 엄격한 제한이므로, Claude Opus 4.8에서 thinking 없이 실행되던 워크로드에 대해 다시 검토하세요. 비용 제어를 참조하세요.
이전 (Claude Opus 4.8):
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)이후 (Claude Fable 5):
client.messages.create(
model="claude-fable-5",
max_tokens=16000,
output_config={"effort": "high"},
messages=[{"role": "user", "content": "..."}],
)확장 사고 및 thinking 예산 (변경 없음): 수동 확장 사고(thinking: {type: "enabled", budget_tokens: N})는 claude-fable-5에서 지원되지 않으며 Claude Opus 4.8과 마찬가지로 400 오류를 반환합니다. budget_tokens에는 직접적인 대체 항목이 없습니다. thinking은 적응형이며, effort 파라미터는 thinking 예산이 아닌 별도의 출력 수준 제어입니다.
어시스턴트 prefill (변경 없음): 어시스턴트 메시지 prefill은 claude-fable-5에서 지원되지 않으며 Claude Opus 4.8과 마찬가지로 400 오류를 반환합니다. 대신 시스템 프롬프트 지침을 사용하세요.
Thinking 출력: claude-fable-5에서는 원시 사고 과정(chain of thought)이 절대 반환되지 않지만, thinking.display가 summarized로 설정된 경우 thinking 블록에는 여전히 읽을 수 있는 요약 텍스트가 포함됩니다. 동일한 모델에서 대화를 계속할 때는 thinking 블록을 변경하지 않고 그대로 다시 전달하세요. Claude Fable 5 및 Claude Mythos 5의 thinking 출력을 참조하세요.
안전 분류기와 refusal 중지 이유: claude-fable-5는 요청 시 및 응답 생성 중에 안전 분류기를 실행합니다. 분류기가 요청을 거부하면 Messages API는 오류가 아닌 성공적인 HTTP 200 응답으로 stop_reason: "refusal"을 반환합니다. stop_details.category 필드는 어떤 분류기가 작동했는지 보고하며, "cyber", "bio", "reasoning_extraction"과 같은 카테고리가 있고, 거부가 명명된 카테고리에 매핑되지 않는 경우 null입니다. 전체 목록은 거부 카테고리 표를 참조하세요.
출력이 생성되기 전에 거부된 요청의 입력 토큰에 대해서는 과금되지 않습니다. 분류기가 스트림 중간에 작동하면 입력과 이미 스트리밍된 출력에 대해 과금됩니다. 부분 출력은 폐기하세요.
거부된 요청을 다른 모델에서 자동으로 다시 실행하려면 옵트인 fallbacks 파라미터를 전달하세요. 이 파라미터는 Claude API 및 Claude Platform on AWS에서 베타로 제공됩니다. 이 파라미터는 Message Batches API 또는 Amazon Bedrock, Google Cloud, Microsoft Foundry에서는 사용할 수 없습니다. 이 세 플랫폼에서는 클라이언트 측에서 재시도를 실행하거나 SDK refusal-fallback 미들웨어를 사용하세요. 중지 이유 처리를 참조하세요.
high effort로 시작: effort 파라미터의 기본값은 여전히 high입니다. Claude Opus 4.8에서는 코딩 및 높은 자율성 작업에 대해 xhigh를 명시적으로 설정하는 것이 권장됩니다. claude-fable-5에서는 대부분의 작업에 high를 기본값으로 사용하고, 성능에 가장 민감한 워크로드에만 xhigh를 사용하세요. claude-fable-5에서 더 낮은 effort 설정도 여전히 좋은 성능을 보이며, 이전 모델의 xhigh 성능을 능가하는 경우가 많습니다. 작업이 완료되지만 필요 이상으로 오래 걸리는 경우 effort를 낮추세요. Claude Fable 5 프롬프팅을 참조하세요.
더 낮은 프롬프트 캐싱 최소값: claude-fable-5에서 캐시 가능한 최소 프롬프트 길이는 512 토큰으로, Claude Opus 4.8의 1,024 토큰보다 낮습니다. Claude Opus 4.8에서 캐시하기에 너무 짧았던 프롬프트가 이제 코드 변경 없이 캐시 항목을 생성할 수 있습니다. Amazon Bedrock에서 claude-fable-5의 최소값은 1,024 토큰입니다. 모델별 최소값은 프롬프트 캐싱을 참조하세요.
claude-fable-5는 30일 데이터 보존이 필요하며, Claude API에서는 그렇지 않은 경우 400 invalid_request_error를 반환합니다. 모델별 데이터 보존 요구 사항을 참조하세요.claude-opus-4-8에서 claude-fable-5로 업데이트하세요.thinking: {type: "disabled"} 구성을 모두 제거하세요. claude-fable-5에서 thinking을 비활성화하면 오류가 반환되며, thinking 필드가 없는 요청은 적응형 사고와 함께 실행됩니다.claude-fable-5에서 계속 지원되지 않습니다.thinking 필드를 파싱하는 코드가 이를 표시용 텍스트로만 취급하고, 동일한 모델에서 계속할 때 thinking 블록을 변경하지 않고 그대로 다시 전달하는지 확인하세요. thinking.display는 Claude Opus 4.8과 마찬가지로 claude-fable-5에서 기본값이 "omitted"입니다. 읽을 수 있는 요약을 받으려면 display: "summarized"를 설정하세요. Claude Fable 5 및 Claude Mythos 5의 thinking 출력을 참조하세요.thinking 및 redacted_thinking 블록을 제거하세요. claude-fable-5의 thinking 블록은 이를 생성한 모델에 연결되어 있으며, Claude Fable 5 및 Claude Mythos 5 이외의 모델은 이를 조용히 무시합니다. 제거하면 모델 간 요청을 최소화하고 일관되게 유지할 수 있습니다. 예외는 fallback credit을 사용하는 경우로, 해당 기능의 정확한 규칙에 따라 요청 본문을 그대로 전달해야 합니다.stop_reason: "refusal"을 처리하고 stop_details.category 필드를 읽으세요. 거부된 요청을 다른 모델에서 자동으로 다시 실행하려면 옵트인 fallbacks 파라미터(베타)를 고려하세요. 중지 이유 처리를 참조하세요.effort 설정을 다시 평가하세요. Claude Opus 4.8에서 xhigh로 실행되던 워크로드를 포함하여 대부분의 작업에 대해 high로 시작하세요.claude-opus-4-8에서 마이그레이션할 때 토큰 수는 거의 변하지 않지만, 토큰당 가격은 다릅니다.Claude Opus 4.8은 복잡한 에이전트 코딩 및 엔터프라이즈 작업을 위해 구축되었습니다. Claude Opus 4.7을 기반으로 합니다.
Claude Opus 4.8은 기존 Claude Opus 4.7 프롬프트 및 평가에서 별도 조정 없이도 강력한 성능을 발휘합니다. Claude Opus 4.7에서 이미 실행 중인 코드에 대해 호환성이 깨지는 API 변경 사항은 없습니다. 1M 토큰 컨텍스트 윈도우, 128k 최대 출력 토큰, 적응형 사고, 프롬프트 캐싱, 배치 처리, Files API, PDF 지원, 비전, 그리고 서버 측 및 클라이언트 측 도구의 전체 세트를 포함하여 Claude Opus 4.7과 동일한 기능 세트를 지원합니다. 또한 대화 중 시스템 메시지를 추가하고 거부 중지 세부 정보를 공개적으로 문서화합니다.
코드가 Claude Opus 4.6 이하에 있는 경우, Claude Opus 4.8로 업그레이드하기 전에 아래의 Claude Opus 4.7 마이그레이션 단계도 적용하세요. 해당 단계에는 4.8 업그레이드만으로는 다루지 않는 호환성이 깨지는 변경 사항(샘플링 파라미터 거부, 수동 확장 사고 거부, 새 토크나이저)이 포함되어 있습니다.
# Opus 마이그레이션
model = "claude-opus-4-7" # Before
model = "claude-opus-4-8" # After이는 호환성이 깨지는 변경 사항이 아닙니다. Claude Opus 4.7에서 실행되는 코드는 Claude Opus 4.8에서도 변경 없이 계속 작동합니다. 아래 항목은 모델 ID를 교체한 후 확인할 가치가 있는 동작 차이를 설명합니다.
샘플링 파라미터 (변경 없음): temperature, top_p 또는 top_k를 기본값이 아닌 값으로 설정하면 Claude Opus 4.7과 마찬가지로 Claude Opus 4.8에서 400 오류가 반환됩니다. SDK 요청 타입은 이전 모델과의 호환성을 위해 여전히 이러한 필드를 정의하므로, 이를 설정하는 코드는 타입 검사를 통과하지만 API는 서버 측에서 요청을 거부합니다. Opus 4.7로 마이그레이션할 때 이러한 파라미터를 제거했다면 추가 변경이 필요하지 않습니다.
Effort 기본값은 high: Claude Opus 4.8에서 effort 파라미터의 기본값은 Claude Code 및 Messages API를 포함한 모든 환경에서 high입니다. 이미 effort를 명시적으로 설정했다면 설정은 변경되지 않습니다. 코딩 및 높은 자율성 작업의 경우 xhigh를 명시적으로 설정하세요. 지연 시간 및 비용 예산에 맞춰 effort 설정을 다시 평가하세요.
1M 컨텍스트 윈도우가 기본값: Claude Opus 4.8은 베타 헤더 없이, 긴 컨텍스트 프리미엄 없이 기본적으로 전체 1M 토큰 컨텍스트 윈도우를 제공합니다. 클라이언트가 이전 모델과의 호환성을 위해 컨텍스트 윈도우 베타 헤더를 전달하는 경우, Claude Opus 4.8에서는 제거할 수 있습니다.
대화 중 시스템 메시지: Claude Opus 4.8은 messages 배열에서 사용자 턴 바로 뒤에 role: "system" 메시지를 허용합니다(배치 규칙에 따름). 처음부터 적용되는 지침에는 최상위 system 필드를 사용하세요. Claude Opus 4.7을 포함한 이전 모델은 messages의 role: "system"을 400 오류로 거부합니다. 지침을 업데이트하기 위해 전체 메시지 기록을 다시 구성하는 코드 경로를 유지하고 있다면, 이를 단순화하고 이전 턴에서 프롬프트 캐시 적중을 유지할 수 있습니다.
거부 중지 세부 정보: 거부 응답의 stop_details 객체(Claude Opus 4.7부터 사용 가능)가 이제 공개적으로 문서화되었습니다. 모델이 요청을 거부하면 기존 refusal 중지 이유와 함께 거부 카테고리를 식별합니다. 베타 헤더가 필요하지 않으며 옵트아웃도 없습니다. 중지 이유 처리를 참조하세요.
더 낮은 프롬프트 캐싱 최소값: Claude Opus 4.8에서 캐시 가능한 최소 프롬프트 길이는 1,024 토큰으로, Claude Opus 4.7보다 낮습니다. Claude Opus 4.7에서 캐시하기에 너무 짧았던 프롬프트가 이제 코드 변경 없이 캐시 항목을 생성할 수 있습니다. 모델별 최소값은 프롬프트 캐싱을 참조하세요.
Effort 수준 재보정: 각 effort 수준에 할당되는 토큰이 Claude Opus 4.7과 비교하여 Claude Opus 4.8에서 변경됩니다. medium은 다소 더 많은 thinking을 허용하고, high는 다소 적게, xhigh는 상당히 더 많이 허용합니다. Claude Opus 4.7의 비용 또는 지연 시간에 맞춰 effort 수준을 조정했다면, 조정하기 전에 동일한 수준에서 기준을 다시 설정하세요. Effort를 참조하세요.
claude-opus-4-7에서 claude-opus-4-8로 업데이트하세요(또는 별칭을 업데이트하세요).effort 설정을 다시 평가하세요. 기본값은 모든 환경에서 high입니다. 코딩 및 높은 자율성 작업의 경우 xhigh를 명시적으로 설정하세요.stop_details를 읽는지 확인하세요(Claude Opus 4.7부터 사용 가능, 이제 공개적으로 문서화됨).Claude Opus 4.7은 높은 자율성을 갖추고 있으며 장기적인 에이전트 작업, 지식 작업, 비전 작업, 메모리 작업에서 탁월한 성능을 발휘합니다.
Claude Opus 4.7은 동일한 MTok당 $5 / $25 가격으로 기존 Claude Opus 4.6 프롬프트 및 평가에서 별도 조정 없이도 강력한 성능을 발휘하지만, 마이그레이션할 때 알아두어야 할 몇 가지 동작 및 API 변경 사항이 있습니다. 다음을 포함하여 Claude Opus 4.6과 동일한 기능 세트를 지원합니다:
# Opus 마이그레이션
model = "claude-opus-4-6" # Before
model = "claude-opus-4-7" # After확장 사고 제거: thinking: {type: "enabled", budget_tokens: N}은 Claude Opus 4.7 이상 모델에서 더 이상 지원되지 않으며 400 오류를 반환합니다. 적응형 사고(thinking: {type: "adaptive"})로 전환하고 effort 파라미터를 사용하여 thinking 깊이를 제어하세요. 적응형 사고는 Claude Opus 4.7에서 기본적으로 꺼져 있습니다. thinking 필드가 없는 요청은 Opus 4.6 동작과 동일하게 thinking 없이 실행됩니다. 활성화하려면 thinking: {type: "adaptive"}를 명시적으로 설정하세요.
이전 (Claude Opus 4.6):
client.messages.create(
model="claude-opus-4-6",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 10000},
messages=[{"role": "user", "content": "..."}],
)이후 (Claude Opus 4.7):
client.messages.create(
model="claude-opus-4-7",
max_tokens=16000,
thinking={"type": "adaptive"},
output_config={"effort": "high"}, # or "max", "xhigh", "medium", "low"
messages=[{"role": "user", "content": "..."}],
)적응형 사고는 프롬프팅을 통해 조정할 수 있습니다. 모델이 과도하게 또는 부족하게 생각할 때 조정하는 방법에 대한 지침은 effort 및 thinking 깊이 보정을 참조하세요.
샘플링 파라미터 제거: Claude Opus 4.7에서 temperature, top_p 또는 top_k를 기본값이 아닌 값으로 설정하면 400 오류가 반환됩니다. 가장 안전한 마이그레이션 경로는 요청 페이로드에서 이러한 파라미터를 완전히 생략하는 것입니다. Claude Opus 4.7에서 모델 동작을 유도하는 권장 방법은 프롬프팅입니다. 결정론적 결과를 위해 temperature = 0을 사용하고 있었다면, 이전 모델에서도 동일한 출력을 보장한 적이 없다는 점에 유의하세요.
Thinking 콘텐츠 기본적으로 생략: Claude Opus 4.7에서 thinking 블록은 여전히 응답 스트림에 나타나지만, 명시적으로 옵트인하지 않는 한 thinking 필드는 비어 있습니다. 이는 요약된 thinking 텍스트를 반환하는 것이 기본값이었던 Claude Opus 4.6에서의 조용한 변경 사항입니다. Claude Opus 4.7에서 요약된 thinking 콘텐츠를 복원하려면 thinking.display를 "summarized"로 설정하세요:
thinking = {
"type": "adaptive",
"display": "summarized",
}Claude Opus 4.7에서 기본값은 "omitted"입니다. 제품이 사용자에게 추론 과정을 스트리밍하는 경우, 새 기본값은 출력이 시작되기 전에 긴 일시 중지로 나타납니다. thinking 중에 보이는 진행 상황을 복원하려면 display: "summarized"를 설정하세요. 자세한 내용은 확장 사고를 참조하세요.
업데이트된 토큰 계산: Claude Opus 4.7은 새로운 토크나이저를 사용하여 다양한 작업에서 향상된 성능에 기여합니다. 새 토크나이저는 이전 모델과 비교하여 텍스트를 처리할 때 약 1배에서 1.35배 더 많은 토큰을 사용할 수 있습니다(콘텐츠에 따라 최대 약 35% 더 많음).
/v1/messages/count_tokens는 Claude Opus 4.6과 다른 토큰 수를 Claude Opus 4.7에 대해 반환합니다. 토큰 효율성은 워크로드 형태에 따라 달라질 수 있습니다.
프롬프팅 개입, task_budget, effort는 비용을 제어하고 적절한 토큰 사용을 보장하는 데 도움이 될 수 있습니다. 이러한 제어는 모델 지능과 상충될 수 있습니다. 압축(compaction) 트리거를 포함하여 추가 여유 공간을 제공하도록 max_tokens 파라미터를 업데이트하세요. Claude Opus 4.7은 긴 컨텍스트 프리미엄 없이 표준 API 가격으로 1M 컨텍스트 윈도우를 제공합니다.
Prefill 제거 (Opus 4.6에서 이어짐): 어시스턴트 메시지 prefill은 Claude Opus 4.7에서 400 오류를 반환합니다. 대신 구조화된 출력, 시스템 프롬프트 지침 또는 output_config.format을 사용하세요.
effort 파라미터를 사용하면 Claude의 지능과 토큰 소비를 조정하여 더 빠른 속도와 더 낮은 비용을 위해 성능을 절충할 수 있습니다. 코딩 및 에이전트 사용 사례에는 새로운 xhigh effort 수준으로 시작하고, 지능에 민감한 대부분의 사용 사례에는 최소 high effort를 사용하세요. 토큰 사용량과 지능을 추가로 조정하려면 다른 effort 수준을 실험해 보세요:
max: Max effort는 일부 사용 사례에서 성능 향상을 제공할 수 있지만, 토큰 사용량 증가에 비해 수익이 감소할 수 있습니다. 이 설정은 때때로 과도한 사고(overthinking)가 발생하기 쉽습니다. 지능이 많이 요구되는 작업에 대해 max effort를 테스트하세요.xhigh (신규): Extra high effort는 대부분의 코딩 및 에이전트 사용 사례에 가장 적합한 설정입니다.high: 이 설정은 토큰 사용량과 지능의 균형을 맞춥니다. 지능에 민감한 대부분의 사용 사례에는 최소 high effort를 사용하세요.medium: 지능을 절충하면서 토큰 사용량을 줄여야 하는 비용에 민감한 사용 사례에 적합합니다.low: 지능에 민감하지 않은 짧고 범위가 제한된 작업 및 지연 시간에 민감한 워크로드에만 사용하세요.Effort는 이전의 어떤 Opus보다 이 모델에서 더 중요합니다. 업그레이드할 때 적극적으로 실험해 보세요.
Claude Opus 4.7은 Claude Opus 4.6과 비교하여 API 호환성을 깨뜨리는 변경은 아니지만 프롬프트 업데이트나 스캐폴딩 제거가 필요할 수 있는 몇 가지 동작상의 차이가 있습니다.
사용 사례에 따라 달라지는 응답 길이: Claude Opus 4.7은 고정된 상세도를 기본값으로 사용하는 대신, 작업의 복잡도를 스스로 판단하여 응답 길이를 조정합니다. 이는 일반적으로 단순한 조회에는 더 짧은 답변을, 개방형 분석에는 훨씬 더 긴 답변을 의미합니다.
제품이 특정 스타일이나 출력 상세도에 의존하는 경우 프롬프트를 조정해야 할 수 있습니다. 예를 들어, 상세도를 줄이려면 다음을 추가하세요: "간결하고 집중된 응답을 제공하세요. 필수적이지 않은 맥락은 생략하고 예시는 최소한으로 유지하세요." 특정 유형의 과도한 설명이 보이면 이를 방지하기 위한 구체적인 지침을 프롬프트에 추가하세요.
Claude가 적절한 수준의 간결함으로 소통하는 방법을 보여주는 긍정적인 예시가, 모델에게 하지 말아야 할 것을 알려주는 부정적인 예시나 지침보다 일반적으로 더 효과적입니다.
더 문자 그대로의 지침 준수: Claude Opus 4.7은 특히 낮은 effort 수준에서 Claude Opus 4.6보다 프롬프트를 더 문자 그대로, 명시적으로 해석합니다. 한 항목에 대한 지침을 다른 항목으로 암묵적으로 일반화하지 않으며, 사용자가 요청하지 않은 것을 추론하지 않습니다. 이러한 문자 그대로의 해석이 주는 장점은 정밀함과 불필요한 시행착오의 감소입니다. 신중하게 조정된 프롬프트, 구조화된 추출, 예측 가능한 동작이 필요한 파이프라인 등 API 사용 사례에서 일반적으로 더 나은 성능을 보입니다. Claude Opus 4.7로 마이그레이션할 때는 프롬프트와 하네스 검토가 특히 도움이 될 수 있습니다.
더 직접적인 어조: 다른 새 모델과 마찬가지로 장문 작성 시 산문 스타일이 달라질 수 있습니다. Claude Opus 4.7은 Claude Opus 4.6의 더 따뜻한 스타일에 비해 더 직접적이고 주관이 뚜렷하며, 공감 위주의 표현과 이모지가 더 적습니다. 제품이 특정 어조에 의존하는 경우 새로운 기준에 맞춰 스타일 프롬프트를 재평가하세요.
에이전트 트레이스에 내장된 진행 상황 업데이트: Claude Opus 4.7은 긴 에이전트 트레이스 전반에 걸쳐 사용자에게 더 규칙적이고 높은 품질의 업데이트를 제공합니다. 중간 상태 메시지를 강제하기 위한 스캐폴딩("도구 호출 3회마다 진행 상황을 요약하세요")을 추가했다면 제거해 보세요. Claude Opus 4.7의 사용자 대상 업데이트의 길이나 내용이 사용 사례에 잘 맞지 않는다면, 이러한 업데이트가 어떤 모습이어야 하는지 프롬프트에 명시적으로 설명하고 예시를 제공하세요.
기본적으로 더 적은 서브에이전트 생성: Claude Opus 4.7은 기본적으로 더 적은 수의 서브에이전트를 생성하는 경향이 있습니다. 그러나 이 동작은 프롬프팅을 통해 조정할 수 있습니다. 서브에이전트가 언제 필요한지에 대한 명시적인 지침을 Claude Opus 4.7에 제공하세요.
더 엄격한 effort 보정: Claude Opus 4.6과 의미 있게 달라진 점으로, Claude Opus 4.7은 특히 낮은 수준에서 effort 수준을 엄격하게 준수합니다. low와 medium에서는 모델이 요청된 범위를 넘어서지 않고 요청된 작업에만 집중합니다.
이는 latency(지연 시간)와 비용 측면에서 좋지만, low effort로 실행되는 중간 정도 복잡도의 작업에서는 사고가 부족할 위험이 있습니다. 복잡한 문제에서 얕은 추론이 관찰되면 프롬프트로 우회하기보다는 effort를 high 또는 xhigh로 올리세요.
latency를 위해 effort를 low로 유지해야 한다면 구체적인 지침을 추가하세요: "이 작업은 다단계 추론이 필요합니다. 응답하기 전에 문제를 신중하게 생각하세요." Claude Opus 4.7에 권장되는 effort 수준을 참조하세요.
기본적으로 더 적은 도구 호출: Claude Opus 4.7은 Claude Opus 4.6보다 도구를 덜 자주 사용하고 추론을 더 많이 사용하는 경향이 있습니다. 이는 대부분의 경우 더 나은 결과를 만들어냅니다.
도구 사용을 늘리려면 effort 설정을 높이세요. high 또는 xhigh effort 설정은 에이전트 검색 및 코딩에서 훨씬 더 많은 도구 사용을 보여줍니다. 또한 모델이 언제 어떻게 도구를 적절히 사용해야 하는지 명시적으로 지시하도록 프롬프트를 조정할 수도 있습니다.
실시간 사이버 보안 안전장치: Claude Opus 4.7에 새로 추가된 기능으로, 금지되거나 고위험 주제와 관련된 요청은 거부될 수 있습니다. 침투 테스트, 취약점 연구, 레드팀 활동과 같은 정당한 보안 작업의 경우 Cyber Verification Program에 신청하여 제한 완화를 요청하세요. 배경 정보는 안전장치, 경고 및 이의 제기를 참조하세요.
고해상도 이미지 지원: Claude Opus 4.7은 고해상도 이미지를 지원하는 최초의 Claude 모델입니다. 최대 이미지 해상도는 긴 변 기준 2576픽셀로, 이전 모델의 1568픽셀에서 증가했습니다. 이는 비전 중심 워크로드에서 성능 향상을 가져오며, 특히 컴퓨터 사용, 스크린샷 이해, 문서 분석에 유용합니다.
고해상도 지원은 자동으로 적용되며 베타 헤더나 클라이언트 측 옵트인이 필요하지 않습니다. 다음 두 가지를 고려해야 합니다:
max_tokens와 비용 예상치를 다시 산정하거나, 추가적인 선명도가 필요하지 않다면 전송 전에 다운샘플링하세요.자세한 내용은 Claude Opus 4.7의 고해상도 이미지 지원을 참조하세요.
다음은 필수는 아니지만 경험을 개선해 줍니다:
max_tokens 재평가: 동일한 텍스트가 Claude Opus 4.7에서 더 높은 토큰 수를 생성하므로, 압축(compaction) 트리거를 포함하여 추가 여유를 확보하도록 max_tokens 매개변수를 업데이트하세요. 프롬프팅 개입, task_budget, effort는 비용을 제어하고 적절한 토큰 사용을 보장하는 데 도움이 될 수 있습니다.
토큰 수 예상치 점검: 클라이언트 측에서 토큰을 추정하거나 고정된 토큰 대 문자 비율을 가정하는 모든 코드 경로는 Claude Opus 4.7에 대해 다시 테스트해야 합니다. 토큰 계산 엔드포인트를 사용하여 확인하세요.
작업 예산(베타) 도입: Claude Opus 4.7은 작업 예산(task budget)을 도입합니다. 이 예산을 통해 사고, 도구 호출, 도구 결과, 최종 출력을 포함한 전체 에이전트 루프에 사용할 수 있는 토큰 수를 Claude에게 알릴 수 있습니다. 모델은 실시간 카운트다운을 확인하고 이를 사용하여 작업의 우선순위를 정하고 예산이 소진됨에 따라 작업을 원활하게 마무리합니다. 사용하려면 베타 헤더 task-budgets-2026-03-13을 설정하고 출력 구성에 다음을 추가하세요:
output_config = {
"effort": "high",
"task_budget": {"type": "tokens", "total": 128000},
}사용 사례에 맞는 다양한 작업 예산을 실험해 봐야 할 수 있습니다. 모델에 너무 제한적인 작업 예산이 주어지면, 예산을 제약 조건으로 언급하면서 작업을 덜 철저하게 완료할 수 있습니다.
속도보다 품질이 중요한 개방형 에이전트 작업에는 작업 예산을 설정하지 마세요. 작업 예산은 모델이 토큰 할당량에 맞춰 작업 범위를 조정해야 하는 워크로드에만 사용하세요. 작업 예산의 최소값은 20k 토큰입니다.
작업 예산은 엄격한 상한이 아니라 모델이 인지하는 제안입니다. max_tokens와는 다음과 같이 다릅니다:
task_budget: 전체 에이전트 루프에 걸친 권고적 상한입니다. 모델이 이를 확인하고 속도를 조절하는 데 사용합니다.max_tokens: 생성되는 토큰에 대한 요청당 엄격한 상한입니다. 모델에 전달되지 않으므로 모델은 이를 인지하지 못합니다.모델이 스스로 조절하기를 원할 때는 task_budget을, 사용량을 제한하는 엄격한 상한으로는 max_tokens를 사용하세요.
max 또는 xhigh effort에서 큰 max_tokens 설정: Claude Opus 4.7을 max 또는 xhigh effort로 실행하는 경우, 모델이 서브에이전트와 도구 호출 전반에 걸쳐 사고하고 행동할 여유를 갖도록 큰 최대 출력 토큰 예산을 설정하세요. 64k 토큰에서 시작하여 조정하세요.
고해상도가 불필요한 경우 이미지 다운샘플링: Claude Opus 4.7은 최대 2576px / 3.75MP의 이미지를 지원합니다. 고해상도 이미지는 더 많은 토큰을 사용합니다. 추가적인 이미지 선명도가 불필요하다면, 토큰 사용량 증가를 피하기 위해 Claude에 전송하기 전에 이미지를 다운샘플링하세요. 이미지 및 비전을 참조하세요.
claude-opus-4-6에서 claude-opus-4-7로 업데이트합니다(또는 별칭을 업데이트합니다).temperature, top_p, top_k를 제거합니다.thinking: {type: "enabled", budget_tokens: N}을 thinking: {type: "adaptive"}와 effort 매개변수로 교체합니다.max_tokens를 다시 조정합니다.xhigh 또는 max effort를 사용하는 경우, 시작점으로 max_tokens를 최소 64k로 올립니다.Claude Opus 4.5, Opus 4.1(지원 중단됨) 또는 그 이전 모델에서 Claude Opus 4.7로 직접 마이그레이션하는 경우, **모든 Opus 4.7 변경 사항**과 함께 Opus 4.5와 Opus 4.7 사이에 적용된 이 섹션의 누적 변경 사항을 적용하세요. Opus 4.6에서 마이그레이션하는 경우에는 Opus 4.7 섹션만 필요합니다.
# Opus 마이그레이션
model = "claude-opus-4-5" # Before
model = "claude-opus-4-7" # After프리필 제거는 위의 Opus 4.7 호환성을 깨뜨리는 변경 사항에서 다룹니다.
도구 매개변수 인용 처리: Claude Opus 4.6 이상 모델은 도구 호출 인수에서 약간 다른 JSON 문자열 이스케이프를 생성할 수 있습니다(예: 유니코드 이스케이프 또는 슬래시 이스케이프의 다른 처리). 도구 호출 input을 JSON 파서를 사용하지 않고 원시 문자열로 파싱하는 경우, 파싱 로직을 확인하세요. 표준 JSON 파서(json.loads() 또는 JSON.parse() 등)는 이러한 차이를 자동으로 처리합니다.
이러한 변경 사항은 Opus 4.7에서의 경험을 개선합니다. **(Opus 4.7에서 필수)**로 표시된 항목은 Opus 4.6 출시 당시에는 선택적 권장 사항이었지만 이제는 필수입니다. 나머지는 여전히 권장 사항입니다.
적응형 사고로 마이그레이션(Opus 4.7에서 필수): thinking: {type: "enabled", budget_tokens: N}은 Claude Opus 4.7에서 400 오류를 반환합니다. thinking: {type: "adaptive"}로 전환하고 effort 매개변수를 사용하여 사고 깊이를 제어하세요. 적응형 사고를 참조하세요.
response = client.beta.messages.create(
model="claude-opus-4-5",
max_tokens=16000,
thinking={"type": "enabled", "budget_tokens": 32000},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)이 마이그레이션은 client.beta.messages.create에서 client.messages.create로의 전환도 포함합니다. 적응형 사고와 effort는 GA 기능이므로 베타 SDK 네임스페이스나 베타 헤더가 필요하지 않습니다.
effort 베타 헤더 제거: effort 매개변수는 이제 GA입니다. 요청에서 betas=["effort-2025-11-24"]를 제거하세요.
세분화된 도구 스트리밍 베타 헤더 제거: 세분화된 도구 스트리밍은 이제 GA입니다. 요청에서 betas=["fine-grained-tool-streaming-2025-05-14"]를 제거하세요.
인터리브 사고 베타 헤더 제거: 적응형 사고는 Claude Opus 4.7, Opus 4.6, Sonnet 4.6에서 인터리브 사고를 자동으로 활성화합니다. 요청에서 betas=["interleaved-thinking-2025-05-14"]를 제거하세요. 이 헤더는 수동 확장 사고를 사용하는 Sonnet 4.6에서는 여전히 작동하지만, 수동 모드는 지원 중단되었습니다.
output_config.format으로 마이그레이션: 구조화된 출력을 사용하는 경우 output_format={...}을 output_config={"format": {...}}으로 업데이트하세요. 이전 매개변수는 여전히 작동하지만 지원 중단되었으며 향후 모델 릴리스에서 제거될 예정입니다.
Opus 4.1(지원 중단됨) 또는 그 이전 모델에서 Claude Opus 4.7로 직접 마이그레이션하는 경우, 이 가이드 상단의 Claude Opus 4.7 변경 사항과 위의 누적 변경 사항에 더해 이 섹션의 추가 변경 사항을 적용하세요.
# Opus 4.1에서
model = "claude-opus-4-1-20250805" # Before
model = "claude-opus-4-7" # After
# Sonnet 3.7에서
model = "claude-3-7-sonnet-20250219" # Before
model = "claude-opus-4-7" # After샘플링 매개변수 제거
Claude 3.x 모델에서 마이그레이션할 때 호환성을 깨뜨리는 변경 사항입니다.
Claude Opus 4.7부터 temperature, top_p, top_k를 기본값이 아닌 값으로 설정하면 400 오류가 반환됩니다. 가장 안전한 마이그레이션 경로는 요청에서 이러한 매개변수를 완전히 생략하고 프롬프팅을 사용하여 모델의 동작을 유도하는 것입니다. 결정론적 출력을 위해 temperature = 0을 사용하고 있었다면, 이것이 동일한 출력을 보장한 적은 없었다는 점에 유의하세요.
# 이전 - Claude 4+ 모델에서는 오류가 발생합니다
response = client.messages.create(
model="claude-3-7-sonnet-20250219",
temperature=0.7,
top_p=0.9, # Non-default sampling params return 400 on Opus 4.7
# ...
)
# 이후
response = client.messages.create(
model="claude-opus-4-7",
# ...
)도구 버전 업데이트
Claude 3.x 모델에서 마이그레이션할 때 호환성을 깨뜨리는 변경 사항입니다.
최신 도구 버전으로 업데이트하세요. undo_edit 명령을 사용하는 코드를 모두 제거하세요.
# 이전
tools = [{"type": "text_editor_20250124", "name": "str_replace_editor"}]
# 이후
tools = [{"type": "text_editor_20250728", "name": "str_replace_based_edit_tool"}]text_editor_20250728과 str_replace_based_edit_tool을 사용하세요. 자세한 내용은 텍스트 편집기 도구 문서를 참조하세요.code_execution_20260521로 업그레이드하세요. 마이그레이션 지침은 코드 실행 도구 문서를 참조하세요.refusal stop reason 처리
refusal stop reason을 처리하도록 애플리케이션을 업데이트하세요:
response = client.messages.create(...)
if response.stop_reason == "refusal":
# 거부를 적절히 처리합니다
passmodel_context_window_exceeded stop reason 처리
Claude 4.5+ 모델은 요청된 max_tokens 제한이 아닌 컨텍스트 윈도우 제한에 도달하여 생성이 중단될 때 model_context_window_exceeded stop reason을 반환합니다. 이 새로운 stop reason을 처리하도록 애플리케이션을 업데이트하세요:
response = client.messages.create(...)
if response.stop_reason == "model_context_window_exceeded":
# 컨텍스트 윈도우 제한을 적절히 처리합니다
pass도구 매개변수 처리 확인(후행 줄바꿈)
Claude 4.5+ 모델은 이전에는 제거되었던 도구 호출 문자열 매개변수의 후행 줄바꿈을 보존합니다. 도구가 도구 호출 매개변수에 대한 정확한 문자열 일치에 의존하는 경우, 로직이 후행 줄바꿈을 올바르게 처리하는지 확인하세요.
동작 변경에 맞춰 프롬프트 업데이트
Claude 4+ 모델은 더 간결하고 직접적인 소통 스타일을 가지며 명시적인 지시가 필요합니다. 최적화 지침은 프롬프팅 모범 사례를 검토하세요.
token-efficient-tools-2025-02-19와 output-128k-2025-02-19를 제거하세요. 모든 Claude 4+ 모델에는 토큰 효율적인 도구 사용이 내장되어 있으며 이러한 헤더는 아무런 효과가 없습니다.claude-opus-4-7로 업데이트output_config.format 사용thinking: {type: "enabled", budget_tokens: N}을 thinking: {type: "adaptive"}와 effort 매개변수로 교체(Opus 4.7에서 400 반환)effort-2025-11-24 베타 헤더 제거(effort는 이제 GA)fine-grained-tool-streaming-2025-05-14 베타 헤더 제거interleaved-thinking-2025-05-14 베타 헤더 제거(적응형 사고가 인터리브 사고를 자동으로 활성화)output_format을 output_config.format으로 마이그레이션(해당하는 경우)temperature, top_p, top_k 제거(기본값이 아닌 값은 Opus 4.7에서 400 반환)text_editor_20250728, code_execution_20260521)refusal stop reason 처리model_context_window_exceeded stop reason 처리token-efficient-tools-2025-02-19, output-128k-2025-02-19)Claude Sonnet 5는 Claude 모델 제품군에서 속도와 지능의 최상의 조합을 제공합니다. Claude Sonnet 4.6을 기반으로 합니다.
Claude Sonnet 5는 동일한 MTok당 $3 / $15 가격으로 Claude Sonnet 4.6을 바로 대체할 수 있는 업그레이드입니다(2026년 8월 31일까지 MTok당 $2 / $10의 출시 기념 가격 적용. 가격 참조). Claude Sonnet 4.6에서 이미 실행 중인 코드에 대해 두 가지 호환성을 깨뜨리는 API 변경 사항이 있습니다: 수동 확장 사고(thinking: {type: "enabled", budget_tokens: N})와 기본값이 아닌 값으로 설정된 샘플링 매개변수(temperature, top_p, top_k)는 더 이상 허용되지 않으며 400 오류를 반환합니다. 대신 적응형 사고와 effort 매개변수를 사용하세요. Claude Sonnet 5는 1M 토큰 컨텍스트 윈도우, 적응형 사고, 프롬프트 캐싱, 배치 처리, Files API, PDF 지원, 비전, 그리고 서버 측 및 클라이언트 측 도구 전체를 포함하여 Claude Sonnet 4.6과 동일한 기능 세트를 지원합니다. Priority Tier는 Claude Sonnet 5에서 사용할 수 없습니다. Claude Sonnet 5는 또한 새로운 토크나이저를 사용합니다.
코드가 Claude Sonnet 4.5 이하에서 실행 중인 경우, Claude Sonnet 5로 업그레이드하기 전에 Claude Sonnet 4.6 마이그레이션 단계도 적용하세요. 해당 단계에는 Sonnet 5 업그레이드만으로는 다루지 않는 호환성을 깨뜨리는 변경 사항(어시스턴트 메시지 프리필 거부, 도구 매개변수 JSON 이스케이프 차이)이 포함되어 있습니다.
# Sonnet 마이그레이션
model = "claude-sonnet-4-6" # Before
model = "claude-sonnet-5" # After다음 목록의 4번과 5번 항목은 호환성을 깨뜨리는 변경 사항입니다. max_tokens는 여전히 전체 출력(사고와 응답 텍스트)에 대한 엄격한 제한이므로, Claude Sonnet 4.6에서 사고 없이 실행되던 워크로드에 대해 다시 검토하세요.
새로운 토크나이저: Claude Sonnet 5는 새로운 토크나이저를 사용합니다. 동일한 입력 텍스트가 Claude Sonnet 4.6보다 약 30% 더 많은 토큰을 생성합니다. 정확한 증가량은 콘텐츠에 따라 다릅니다. 요청, 응답, 스트리밍 이벤트는 동일한 형태를 유지하며 코드 변경이 필요하지 않지만, 토큰으로 측정하거나 예산을 책정하는 모든 것이 달라집니다: 동일한 텍스트에 대한 usage 필드와 토큰 계산 결과가 더 높아지고, 1M 토큰 컨텍스트 윈도우에 담을 수 있는 텍스트가 줄어들며, Claude Sonnet 4.6에 맞춰 조정된 max_tokens 제한이 동등한 출력을 잘라낼 수 있습니다. 토큰당 가격은 변경되지 않았으므로 동등한 요청의 비용이 달라질 수 있습니다. 이전 모델에서 측정한 수치를 재사용하지 말고 Claude Sonnet 5에 대해 토큰 계산을 다시 실행하세요.
128k 최대 출력 토큰(변경 없음): Claude Sonnet 5는 Claude Sonnet 4.6과 동일하게 최대 128k 출력 토큰을 지원합니다. 기존 max_tokens 값은 여전히 유효합니다. 크기를 정할 때 새로운 토크나이저를 고려하세요.
어시스턴트 메시지 프리필(변경 없음): 어시스턴트 메시지 프리필은 Claude Sonnet 4.6과 동일하게 Claude Sonnet 5에서 400 오류를 반환합니다. Claude Sonnet 4.6으로 마이그레이션할 때 프리필을 제거했다면 추가 변경이 필요하지 않습니다. 대신 구조화된 출력, 시스템 프롬프트 지침 또는 output_config.format을 사용하세요.
기본적으로 활성화된 적응형 사고: Claude Sonnet 4.6에서는 thinking 필드가 없는 요청이 사고 없이 실행되지만, Claude Sonnet 5에서는 동일한 요청이 적응형 사고와 함께 실행됩니다. 사고를 끄려면 thinking: {type: "disabled"}를 전달하세요. 수동 확장 사고(thinking: {type: "enabled", budget_tokens: N})는 지원되지 않으며 400 오류를 반환합니다. 사고 깊이를 제어하려면 effort 매개변수(기본값 high)를 사용하세요.
Claude Sonnet 5에서는 적응형 사고가 기본적으로 활성화되어 있습니다. 여기서는 display: "summarized"를 설정하기 위해 thinking 필드를 명시적으로 표시했습니다. thinking을 생략하면 Claude Sonnet 5는 기본적으로 응답에서 사고 내용을 생략합니다. 모델별 기본값은 적응형 사고를 참조하세요.
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-sonnet-5",
max_tokens=16000,
thinking={"type": "adaptive", "display": "summarized"},
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Are there an infinite number of prime numbers such that n mod 4 == 3?",
}
],
)
# 응답에는 요약된 사고 블록과 텍스트 블록이 포함됩니다
for block in response.content:
match block.type:
case "thinking":
print(f"\nThinking summary: {block.thinking}")
case "text":
print(f"\nResponse: {block.text}")샘플링 매개변수 제거: 기본값이 아닌 값으로 설정된 샘플링 매개변수(temperature, top_p, top_k)는 허용되지 않으며 400 오류를 반환합니다.
사이버 보안 안전장치: Claude Sonnet 5는 실시간 사이버 보안 안전장치를 갖춘 최초의 Sonnet 등급 모델입니다. 금지되거나 고위험 사이버 보안 주제와 관련된 요청은 거부될 수 있습니다. 거부는 오류가 아닌 stop_reason: "refusal"과 함께 성공적인 HTTP 200 응답으로 반환됩니다. 배경 정보는 안전장치, 경고 및 이의 제기를 참조하세요.
claude-sonnet-4-6에서 claude-sonnet-5로 업데이트합니다.max_tokens 제한을 다시 검토하고, 유용한 경우 최대 128k(Claude Sonnet 4.6과 동일)까지 올립니다.thinking: {type: "enabled", budget_tokens: N} 구성을 제거합니다(400 오류 반환). 적응형 사고는 기본적으로 활성화되어 있습니다. 끄려면 {type: "disabled"}를 전달하거나, 깊이를 제어하려면 effort 매개변수를 사용하세요.temperature, top_p, top_k 매개변수를 제거합니다(Claude Sonnet 5에서 400 오류 반환).stop_reason: "refusal" 처리를 추가합니다.max_tokens를 검토합니다.Claude Sonnet 4.6은 강력한 지능과 빠른 성능을 결합하며, 향상된 에이전트 검색 기능과 웹 검색 또는 웹 페치와 함께 사용할 때 무료 코드 실행을 제공합니다. 일상적인 코딩, 분석, 콘텐츠 작업에 이상적입니다.
기능에 대한 전체 개요는 모델 개요를 참조하세요.
Sonnet 4.6 가격은 입력 토큰 100만 개당 $3, 출력 토큰 100만 개당 $15입니다. 자세한 내용은 Claude 가격을 참조하세요.
모델 이름 업데이트:
# Sonnet 4.5부터
model = "claude-sonnet-4-5" # Before
model = "claude-sonnet-4-6" # After어시스턴트 메시지 프리필이 더 이상 지원되지 않음
Sonnet 4.5 이하에서 마이그레이션할 때 호환성을 깨뜨리는 변경 사항입니다.
어시스턴트 메시지 프리필은 Sonnet 4.6에서 400 오류를 반환합니다. 대신 구조화된 출력, 시스템 프롬프트 지침 또는 output_config.format을 사용하세요.
일반적인 프리필 사용 사례와 마이그레이션 방법:
출력 형식 제어(JSON/YAML 출력 강제): 분류 작업에는 구조화된 출력 또는 enum 필드가 있는 도구를 사용하세요.
서두 제거("Here is..." 문구 제거): 시스템 프롬프트에 직접적인 지침을 추가하세요: "서두 없이 바로 응답하세요. 'Here is...', 'Based on...' 등의 문구로 시작하지 마세요."
잘못된 거부 방지: Claude는 이제 적절한 거부를 훨씬 더 잘 수행합니다. 프리필 없이 사용자 메시지에서 명확하게 프롬프팅하는 것으로 충분합니다.
이어쓰기(중단된 응답 재개): 이어쓰기를 사용자 메시지로 옮기세요: "이전 응답이 중단되었으며 [previous_response]로 끝났습니다. 중단된 지점부터 계속하세요."
컨텍스트 하이드레이션 / 역할 일관성(긴 대화에서 컨텍스트 갱신): 이전에 프리필된 어시스턴트 리마인더였던 내용을 대신 사용자 턴에 삽입하세요.
도구 매개변수 JSON 이스케이프가 다를 수 있음
Sonnet 4.5 이하에서 마이그레이션할 때 호환성을 깨뜨리는 변경 사항입니다.
도구 매개변수의 JSON 문자열 이스케이프가 이전 모델과 다를 수 있습니다. 표준 JSON 파서는 이를 자동으로 처리하지만, 사용자 정의 문자열 기반 파싱은 업데이트가 필요할 수 있습니다.
샘플링 매개변수 업데이트
Claude 3.x 모델에서 마이그레이션할 때 호환성을 깨뜨리는 변경 사항입니다.
temperature 또는 top_p 중 하나만 사용하고 둘 다 사용하지 마세요.
도구 버전 업데이트
Claude 3.x 모델에서 마이그레이션할 때 호환성을 깨뜨리는 변경 사항입니다.
최신 도구 버전(text_editor_20250728, code_execution_20260521)으로 업데이트하세요. undo_edit 명령을 사용하는 코드를 모두 제거하세요.
refusal stop reason 처리
refusal stop reason을 처리하도록 애플리케이션을 업데이트하세요.
동작 변경에 맞춰 프롬프트 업데이트
Claude 4 모델은 더 간결하고 직접적인 소통 스타일을 가지고 있습니다. 최적화 지침은 프롬프팅 모범 사례를 검토하세요.
fine-grained-tool-streaming-2025-05-14 베타 헤더 제거: 세분화된 도구 스트리밍은 이제 Sonnet 4.6에서 GA이며 더 이상 베타 헤더가 필요하지 않습니다.output_format을 output_config.format으로 마이그레이션: output_format 매개변수는 지원 중단되었습니다. 대신 output_config.format을 사용하세요.Sonnet 4.5에서 Sonnet 4.6으로 마이그레이션하는 것을 고려하세요. Sonnet 4.6은 동일한 가격대에서 더 높은 지능을 제공합니다.
Sonnet 4.6은 effort 수준이 기본적으로 high로 설정되어 있으며, 이는 effort 매개변수가 없었던 Sonnet 4.5와 대조됩니다. Sonnet 4.5에서 Sonnet 4.6으로 마이그레이션할 때 effort 매개변수를 조정하는 것을 고려하세요. 명시적으로 설정하지 않으면 기본 effort 수준에서 더 높은 지연 시간이 발생할 수 있습니다.
Sonnet 4.5에서 확장 사고를 사용하지 않는 경우, Sonnet 4.6에서도 확장 사고 없이 계속 사용할 수 있습니다. 사용 사례에 적합한 수준으로 effort를 명시적으로 설정해야 합니다. 사고가 비활성화된 상태에서 low effort를 사용하면, 확장 사고가 없는 Sonnet 4.5와 비교하여 비슷하거나 더 나은 성능을 기대할 수 있습니다.
response = client.messages.create(
model="claude-sonnet-4-6",
max_tokens=8192,
output_config={"effort": "low"},
messages=[{"role": "user", "content": "Your prompt here"}],
)Sonnet 4.5에서 budget_tokens와 함께 확장 사고를 사용하고 있다면, Sonnet 4.6에서도 여전히 작동하지만 더 이상 사용되지 않습니다(deprecated). effort 매개변수와 함께 적응형 사고로 마이그레이션하세요.
적응형 사고는 Sonnet 4.6에서 budget_tokens를 대체하는 권장 방식입니다. 특히 다음과 같은 워크로드 패턴에 매우 적합합니다:
high effort로 시작하세요. 지연 시간이나 토큰 사용량이 우려된다면 medium으로 낮추세요.적응형 사고를 사용할 때는 작업에 대해 medium과 high effort를 평가하세요. 적절한 수준은 워크로드의 품질, 지연 시간, 토큰 사용량 간의 트레이드오프에 따라 달라집니다.
response = client.messages.create(
model="claude-sonnet-4-6",
max_tokens=64000,
thinking={"type": "adaptive"},
output_config={"effort": "medium"},
messages=[{"role": "user", "content": "Your prompt here"}],
)적응형 사고에서 일관되지 않은 동작이나 품질 저하가 발생하면, 먼저 effort 설정을 낮추거나 max_tokens를 하드 리밋으로 사용해 보세요. budget_tokens를 사용한 확장 사고는 Sonnet 4.6에서 여전히 작동하지만 더 이상 사용되지 않으며(deprecated) 더 이상 권장되지 않습니다.
마이그레이션하는 동안 일시적으로 budget_tokens를 유지해야 하는 경우, 약 16k 토큰의 예산은 토큰 사용량이 폭주할 위험 없이 더 어려운 문제를 위한 여유 공간을 제공합니다. 이 구성은 더 이상 사용되지 않으며(deprecated) 향후 모델 릴리스에서 제거될 예정입니다.
에이전트 코딩, 프론트엔드 디자인, 도구 중심 워크플로우, 복잡한 엔터프라이즈 워크플로우의 경우 medium effort로 시작하세요. 지연 시간이 너무 높다고 판단되면 effort를 low로 낮추는 것을 고려하세요. 더 높은 지능이 필요하다면 effort를 high로 높이거나 Opus 4.7로 마이그레이션하는 것을 고려하세요.
response = client.beta.messages.create(
model="claude-sonnet-4-6",
max_tokens=16384,
thinking={"type": "enabled", "budget_tokens": 16384},
output_config={"effort": "medium"},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)채팅, 콘텐츠 생성, 검색, 분류 및 기타 비코딩 작업의 경우 확장 사고와 함께 low effort로 시작하세요. 더 깊이 있는 처리가 필요하면 effort를 medium으로 높이세요.
response = client.beta.messages.create(
model="claude-sonnet-4-6",
max_tokens=8192,
thinking={"type": "enabled", "budget_tokens": 16384},
output_config={"effort": "low"},
betas=["interleaved-thinking-2025-05-14"],
messages=[{"role": "user", "content": "Your prompt here"}],
)claude-sonnet-4-6으로 업데이트output_config.format 사용text_editor_20250728, code_execution_20260521)으로 업데이트; 레거시 버전은 지원되지 않음(3.x에서 마이그레이션하는 경우)undo_edit 명령을 사용하는 모든 코드 제거(해당되는 경우)temperature 또는 top_p 중 하나만 사용하도록 업데이트(3.x에서 마이그레이션하는 경우)refusal 중지 이유 처리fine-grained-tool-streaming-2025-05-14 베타 헤더 제거(현재 GA)output_format을 output_config.format으로 마이그레이션thinking: {type: "enabled", budget_tokens: N}에서 effort 매개변수와 함께 thinking: {type: "adaptive"}로 마이그레이션(budget_tokens는 더 이상 사용되지 않으며 향후 릴리스에서 제거될 예정)Claude Sonnet 4.5는 강력한 지능과 빠른 성능을 결합하여 일상적인 코딩, 분석, 콘텐츠 작업에 이상적입니다.
기능에 대한 전체 개요는 모델 개요를 참조하세요.
Sonnet 4.5의 가격은 입력 토큰 100만 개당 $3, 출력 토큰 100만 개당 $15입니다. 자세한 내용은 Claude 가격을 참조하세요.
모델 이름 업데이트:
# Sonnet 3.7부터
model = "claude-3-7-sonnet-20250219" # Before
model = "claude-sonnet-4-5-20250929" # After이러한 주요 변경 사항은 Claude 3.x Sonnet 모델에서 마이그레이션할 때 적용됩니다.
샘플링 매개변수 업데이트
이는 Claude 3.x 모델에서 마이그레이션할 때의 주요 변경 사항입니다.
temperature 또는 top_p 중 하나만 사용하고, 둘 다 사용하지 마세요.
도구 버전 업데이트
이는 Claude 3.x 모델에서 마이그레이션할 때의 주요 변경 사항입니다.
최신 도구 버전(text_editor_20250728, code_execution_20260521)으로 업데이트하세요. undo_edit 명령을 사용하는 모든 코드를 제거하세요.
refusal 중지 이유 처리
refusal 중지 이유를 처리하도록 애플리케이션을 업데이트하세요.
동작 변경에 맞게 프롬프트 업데이트
Claude 4 모델은 더 간결하고 직접적인 커뮤니케이션 스타일을 가지고 있습니다. 최적화 지침은 프롬프팅 모범 사례를 검토하세요.
claude-sonnet-4-5-20250929로 업데이트text_editor_20250728, code_execution_20260521)으로 업데이트; 레거시 버전은 지원되지 않음(3.x에서 마이그레이션하는 경우)undo_edit 명령을 사용하는 모든 코드 제거(해당되는 경우)temperature 또는 top_p 중 하나만 사용하도록 업데이트(3.x에서 마이그레이션하는 경우)refusal 중지 이유 처리Claude Haiku 4.5는 프론티어에 가까운 성능을 갖춘 가장 빠르고 지능적인 Haiku 모델로, 대화형 애플리케이션과 대용량 처리를 위한 프리미엄 모델 품질을 제공합니다.
기능에 대한 전체 개요는 모델 개요를 참조하세요.
Haiku 4.5의 가격은 입력 토큰 100만 개당 $1, 출력 토큰 100만 개당 $5입니다. 자세한 내용은 Claude 가격을 참조하세요.
모델 이름 업데이트:
# Haiku 3.5부터
model = "claude-3-5-haiku-20241022" # Before
model = "claude-haiku-4-5-20251001" # After새로운 속도 제한 검토: Haiku 4.5는 Haiku 3.5와 별도의 속도 제한을 가집니다. 자세한 내용은 속도 제한 문서를 참조하세요.
코딩 및 추론 작업에서 상당한 성능 향상을 위해 thinking: {type: "enabled", budget_tokens: N}으로 확장 사고를 활성화하는 것을 고려하세요.
새로운 기능 탐색: 컨텍스트 인식, 증가된 출력 용량(64k 토큰), 더 높은 지능, 향상된 속도에 대한 자세한 내용은 모델 개요를 참조하세요.
이러한 주요 변경 사항은 Claude 3.x Haiku 모델에서 마이그레이션할 때 적용됩니다.
샘플링 매개변수 업데이트
이는 Claude 3.x 모델에서 마이그레이션할 때의 주요 변경 사항입니다.
temperature 또는 top_p 중 하나만 사용하고, 둘 다 사용하지 마세요.
도구 버전 업데이트
이는 Claude 3.x 모델에서 마이그레이션할 때의 주요 변경 사항입니다.
최신 도구 버전(text_editor_20250728, code_execution_20250825)으로 업데이트하세요. undo_edit 명령을 사용하는 모든 코드를 제거하세요.
refusal 중지 이유 처리
refusal 중지 이유를 처리하도록 애플리케이션을 업데이트하세요.
동작 변경에 맞게 프롬프트 업데이트
Claude 4 모델은 더 간결하고 직접적인 커뮤니케이션 스타일을 가지고 있습니다. 최적화 지침은 프롬프팅 모범 사례를 검토하세요.
claude-haiku-4-5-20251001로 업데이트text_editor_20250728, code_execution_20250825)으로 업데이트; 레거시 버전은 지원되지 않음undo_edit 명령을 사용하는 모든 코드 제거(해당되는 경우)temperature 또는 top_p 중 하나만 사용하도록 업데이트refusal 중지 이유 처리Was this page helpful?