Claude Platform Docs
모델 및 가격수명 주기 및 레퍼런스

가격

모델 및 기능에 대한 Anthropic의 가격 구조에 대해 알아보세요

이 페이지는 Anthropic의 모델 및 기능에 대한 자세한 가격 정보를 제공합니다. 모든 가격은 USD 기준입니다.

최신 가격 정보는 claude.com/pricing을 방문하세요.

모델 가격

다음 표는 모든 Claude 모델의 가격을 보여줍니다:

모델기본 입력 토큰5분 캐시 쓰기1시간 캐시 쓰기캐시 히트 및 갱신출력 토큰
Claude Fable 5.1$10 / MTok$12.50 / MTok$20 / MTok$0.25 / MTok1$50 / MTok
Claude Mythos 5.1 (제한적 제공)$10 / MTok$12.50 / MTok$20 / MTok$0.25 / MTok1$50 / MTok
Claude Fable 5$10 / MTok$12.50 / MTok$20 / MTok$1 / MTok$50 / MTok
Claude Mythos 5 (제한적 제공)$10 / MTok$12.50 / MTok$20 / MTok$1 / MTok$50 / MTok
Claude Opus 5$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Claude Opus 4.8$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Claude Opus 4.7$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Claude Opus 4.6$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Claude Opus 4.5$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Claude Opus 4.1 (종료됨, Bedrock 및 Google Cloud 제외)$15 / MTok$18.75 / MTok$30 / MTok$1.50 / MTok$75 / MTok
Claude Opus 4 (종료됨, Google Cloud 제외)$15 / MTok$18.75 / MTok$30 / MTok$1.50 / MTok$75 / MTok
Claude Sonnet 5$2 / MTok$2.50 / MTok$4 / MTok$0.20 / MTok$10 / MTok
Claude Sonnet 4.6$3 / MTok$3.75 / MTok$6 / MTok$0.30 / MTok$15 / MTok
Claude Sonnet 4.5$3 / MTok$3.75 / MTok$6 / MTok$0.30 / MTok$15 / MTok
Claude Sonnet 4 (종료됨, Bedrock 및 Google Cloud 제외)$3 / MTok$3.75 / MTok$6 / MTok$0.30 / MTok$15 / MTok
Claude Haiku 4.5$1 / MTok$1.25 / MTok$2 / MTok$0.10 / MTok$5 / MTok
Claude Haiku 3.5 (종료됨, Bedrock 및 Google Cloud 제외)$0.80 / MTok$1 / MTok$1.60 / MTok$0.08 / MTok$4 / MTok

1 Claude Fable 5.1 및 Claude Mythos 5.1의 캐시 히트 및 갱신은 기본 입력 가격의 0.025배로 책정됩니다. 다른 모든 모델은 표준 0.1배 배수를 사용합니다.

Claude Platform on AWS 가격은 Claude Platform on AWS 가격을 참조하세요.

클라우드 플랫폼 가격

이 섹션은 클라우드 제공업체가 청구서를 발행하는 파트너 운영 클라우드 플랫폼을 다룹니다. 마켓플레이스를 통해 청구되는 Anthropic 운영 클라우드 플랫폼에 대해서는 Claude Platform on AWS 가격Claude in Microsoft Foundry 가격을 참조하세요.

Claude 모델은 Amazon BedrockGoogle Cloud에서 사용할 수 있습니다. 공식 가격은 다음을 방문하세요:

Claude Platform on AWS 가격

Claude Platform on AWS는 "Claude Consumption Unit"(Claude 소비 단위), 즉 CCU를 사용하여 AWS Marketplace를 통해 청구합니다. Anthropic은 표준 모델별, 기능별 요율로 토큰 사용량을 USD로 산정하고, 협상된 할인을 적용한 후, 결과를 CCU당 $0.01로 CCU로 변환하여 매시간 AWS Marketplace에 CCU 수량을 보고합니다. AWS 청구서에는 단일 CCU 항목이 표시됩니다.

개념세부 사항
청구 단위Claude Consumption Unit (CCU)
CCU 가격CCU당 $0.01 (고정; 할인은 CCU 가격이 아닌 토큰-CCU 변환 시 적용)
변환토큰 사용량을 표준 모델별, 기능별 요율(Claude API 가격과 동일)로 USD로 산정한 후 CCU당 $0.01로 CCU로 변환
청구 주기AWS Marketplace에 매시간 계량; 월별 청구서
결제 모델후불만 가능(postpaid); 선불 크레딧 없음
할인더 적은 CCU 계량으로 적용
세금세전 계량; AWS Marketplace가 세금 처리
비용 가시성Claude Console에서 실시간 내역 확인(AWS Console을 통해 접근); AWS Cost Explorer는 집계된 CCU 표시

추론 지역

Claude 4.6 이후 모델의 경우 inference_geo: "us"를 사용하면 1.1x 가격 배수가 적용됩니다. inference_geo: "global"(기본값)은 표준 가격을 사용합니다. 자세한 내용은 데이터 레지던시를 참조하세요.

프라이빗 오퍼

AWS Console Claude Platform on AWS 서비스 페이지에서 가입하면, AWS Console이 계정과 연결된 프라이빗 오퍼를 조회하고 AWS Marketplace에서 이를 수락하도록 안내합니다. 프라이빗 오퍼 조건은 Anthropic 계정 담당자에게 문의하세요.

Claude in Microsoft Foundry 가격

Claude in Microsoft Foundry는 Claude Consumption Units(CCU)를 사용하여 Azure Marketplace를 통해 청구합니다. Anthropic은 표준 모델별, 기능별 요율로 토큰 사용량을 USD로 산정하고, 협상된 할인을 적용한 후, 결과를 CCU당 $0.01로 CCU로 변환하여 매시간 Azure Marketplace에 CCU 수량을 보고합니다. Azure 청구서에는 단일 CCU 항목이 표시됩니다.

개념세부 사항
청구 단위Claude Consumption Unit (CCU)
CCU 가격CCU당 $0.01 (고정; 할인은 CCU 가격이 아닌 토큰-CCU 변환 시 적용)
변환토큰 사용량을 표준 모델별, 기능별 요율(Claude API 가격과 동일)로 USD로 산정한 후 CCU당 $0.01로 CCU로 변환
청구 주기Azure Marketplace에 매시간 계량; 월별 청구서
결제 모델후불만 가능(postpaid); 선불 크레딧 없음
할인더 적은 CCU 계량으로 적용
세금세전 계량; Azure Marketplace가 세금 처리
비용 가시성Azure Cost Management가 집계된 CCU 표시

추론 지역

Azure에서 호스팅되는 배포는 추론을 미국 내로 유지하는 US Data Zone Standard 배포 유형을 사용할 수 있습니다. 이는 Claude API의 inference_geo: "us"와 동일하며 동일한 1.1x 가격 배수가 적용됩니다. 자세한 내용은 데이터 레지던시를 참조하세요.

기능별 가격

프롬프트 캐싱

"Prompt caching"(프롬프트 캐싱)은 API 호출 간에 이전에 처리된 프롬프트 부분을 재사용하여 비용과 지연 시간을 줄입니다. 매 요청마다 동일한 대규모 시스템 프롬프트, 문서 또는 대화 기록을 재처리하는 대신, API는 표준 입력 가격의 일부만으로 캐시에서 읽어옵니다.

프롬프트 캐싱을 활성화하는 방법은 두 가지입니다:

  • 자동 캐싱: 요청의 최상위 수준에 단일 cache_control 필드를 추가하세요. 대화가 늘어남에 따라 시스템이 자동으로 캐시 중단점을 관리합니다. 대부분의 사용 사례에 권장되는 시작점입니다.
  • 명시적 캐시 중단점: 정확히 무엇이 캐시되는지 세밀하게 제어하려면 개별 콘텐츠 블록에 직접 cache_control을 배치하세요.

프롬프트 캐싱은 기본 입력 토큰 요율 대비 다음 가격 배수를 사용합니다:

캐시 작업배수기간
5분 캐시 쓰기기본 입력 가격의 1.25x캐시 5분간 유효
1시간 캐시 쓰기기본 입력 가격의 2x캐시 1시간 유효
캐시 읽기(히트)기본 입력 가격의 0.1x (Claude Fable 5.1 및 Claude Mythos 5.1에서는 0.025x)선행 쓰기와 동일한 기간

캐시 쓰기 토큰은 콘텐츠가 처음 저장될 때 청구됩니다. 캐시 읽기 토큰은 후속 요청이 캐시된 콘텐츠를 가져올 때 청구됩니다. 캐시 히트는 표준 입력 가격의 10%이므로, 5분 기간(1.25x 쓰기)의 경우 캐시 읽기 한 번 후, 1시간 기간(2x 쓰기)의 경우 캐시 읽기 두 번 후에 캐싱이 이득이 됩니다. Claude Fable 5.1 및 Claude Mythos 5.1에서는 캐시 히트 비용이 표준 입력 가격의 2.5%(백만 토큰당 $0.25 USD)입니다.

이러한 배수는 Batch API 할인 및 데이터 레지던시를 포함한 다른 가격 수정자와 중첩됩니다.

구현 세부 사항, 지원 모델 및 코드 예제는 프롬프트 캐싱을 참조하세요.

데이터 레지던시 가격

Claude 4.6 이후 모델의 경우, inference_geo 매개변수를 통해 미국 전용 추론을 지정하면 입력 토큰, 출력 토큰, 캐시 쓰기, 캐시 읽기를 포함한 모든 토큰 가격 범주에 1.1x 배수가 적용됩니다. 글로벌 라우팅(기본값)은 표준 가격을 사용합니다.

이는 Claude API(퍼스트 파티) 및 Claude Platform on AWS에 적용됩니다. Claude in Microsoft Foundry에서는 US Data Zone Standard 배포 유형을 사용하는 배포에 동일한 1.1x 배수가 적용됩니다(추론 지역 참조). 파트너 운영 플랫폼(Bedrock 및 Google Cloud)은 독립적인 리전 가격을 가지고 있습니다. 자세한 내용은 BedrockGoogle Cloud를 참조하세요. 이전 모델은 inference_geo 매개변수를 지원하지 않으며 항상 표준 가격을 사용합니다. 이러한 모델에서 해당 매개변수를 포함한 요청은 400 오류를 반환합니다.

자세한 내용은 데이터 레지던시를 참조하세요.

Fast mode 가격

리서치 프리뷰 중인 Fast mode는 프리미엄 가격으로 Claude Opus 5 및 Claude Opus 4.8에 대해 훨씬 빠른 출력을 제공합니다. Fast mode 가격은 200k 입력 토큰을 초과하는 요청을 포함하여 전체 컨텍스트 윈도우에 걸쳐 적용됩니다. Fast mode는 Claude API(퍼스트 파티)에서만 사용할 수 있으며, Claude Platform on AWS 또는 파트너 운영 클라우드 플랫폼에서는 사용할 수 없습니다.

모델입력출력
Claude Opus 5 / Claude Opus 4.8$10 / MTok$50 / MTok

Fast mode는 Claude Opus 4.7(speed: "fast"가 포함된 요청은 오류 반환) 또는 Claude Opus 4.6(요청이 표준 속도로 실행되고 표준 요율로 청구됨)에서는 사용할 수 없습니다. Fast mode를 참조하세요.

Fast mode 가격은 다른 가격 수정자와 중첩됩니다:

Fast mode는 Batch API와 함께 사용할 수 없습니다.

자세한 내용은 Fast mode를 참조하세요.

배치 처리

Batch API는 입력 및 출력 토큰 모두에 50% 할인을 적용하여 대량의 요청을 비동기적으로 처리할 수 있게 합니다.

모델배치 입력배치 출력
Claude Fable 5.1$5 / MTok$25 / MTok
Claude Mythos 5.1 (제한적 제공)$5 / MTok$25 / MTok
Claude Fable 5$5 / MTok$25 / MTok
Claude Mythos 5 (제한적 제공)$5 / MTok$25 / MTok
Claude Opus 5$2.50 / MTok$12.50 / MTok
Claude Opus 4.8$2.50 / MTok$12.50 / MTok
Claude Opus 4.7$2.50 / MTok$12.50 / MTok
Claude Opus 4.6$2.50 / MTok$12.50 / MTok
Claude Opus 4.5$2.50 / MTok$12.50 / MTok
Claude Opus 4.1 (종료됨, Bedrock 및 Google Cloud 제외)$7.50 / MTok$37.50 / MTok
Claude Opus 4 (종료됨, Google Cloud 제외)$7.50 / MTok$37.50 / MTok
Claude Sonnet 5$1 / MTok$5 / MTok
Claude Sonnet 4.6$1.50 / MTok$7.50 / MTok
Claude Sonnet 4.5$1.50 / MTok$7.50 / MTok
Claude Sonnet 4 (종료됨, Bedrock 및 Google Cloud 제외)$1.50 / MTok$7.50 / MTok
Claude Haiku 4.5$0.50 / MTok$2.50 / MTok
Claude Haiku 3.5 (종료됨, Bedrock 및 Google Cloud 제외)$0.40 / MTok$2 / MTok

배치 처리에 대한 자세한 내용은 배치 처리를 참조하세요.

긴 컨텍스트 가격

Claude 4.6 이후 모델과 Claude Mythos Preview는 표준 가격으로 전체 1M 토큰 컨텍스트 윈도우를 포함합니다. (900k 토큰 요청은 9k 토큰 요청과 동일한 토큰당 요율로 청구됩니다.) 프롬프트 캐싱 및 배치 처리 할인은 전체 컨텍스트 윈도우에 걸쳐 표준 요율로 적용됩니다.

도구 사용 가격

도구 사용 요청의 가격은 다음을 기준으로 책정됩니다:

  1. 모델에 전송된 총 입력 토큰 수(tools 파라미터에 포함된 것 포함)
  2. 생성된 출력 토큰 수
  3. 서버 측 도구의 경우, 추가적인 사용량 기반 가격(예: 웹 검색은 수행된 검색당 요금 부과)

클라이언트 측 도구는 다른 모든 Claude API 요청과 동일하게 가격이 책정되지만, 서버 측 도구는 특정 사용량에 따라 추가 요금이 발생할 수 있습니다.

도구 사용으로 인한 추가 토큰은 다음에서 발생합니다:

  • API 요청의 tools 파라미터(도구 이름, 설명 및 스키마)
  • API 요청 및 응답의 tool_use 콘텐츠 블록
  • API 요청의 tool_result 콘텐츠 블록

tools를 사용하면 API는 도구 사용을 가능하게 하는 특별한 "system prompt"(시스템 프롬프트)를 모델에 자동으로 포함합니다. 각 모델에 필요한 도구 사용 토큰 수는 다음 표에 나와 있습니다(앞서 나열한 추가 토큰 제외). 이 표는 최소 1개의 도구가 제공된다고 가정합니다. tools가 제공되지 않으면 none 도구 선택은 추가 시스템 프롬프트 토큰을 0개 사용합니다.

모델도구 선택도구 사용 시스템 프롬프트 토큰 수
Claude Opus 5auto, none
any, tool
286 토큰
406 토큰
Claude Opus 4.8auto, none
any, tool
290 토큰
410 토큰
Claude Opus 4.7auto, none
any, tool
675 토큰
804 토큰
Claude Opus 4.6auto, none
any, tool
497 토큰
589 토큰
Claude Opus 4.5auto, none
any, tool
496 토큰
588 토큰
Claude Opus 4.1 (종료됨, Bedrock 및 Google Cloud 제외)auto, none
any, tool
313 토큰
315 토큰
Claude Opus 4 (종료됨, Google Cloud 제외)auto, none
any, tool
313 토큰
315 토큰
Claude Sonnet 5auto, none
any, tool
354 토큰
474 토큰
Claude Sonnet 4.6auto, none
any, tool
497 토큰
589 토큰
Claude Sonnet 4.5auto, none
any, tool
496 토큰
588 토큰
Claude Sonnet 4 (종료됨, Bedrock 및 Google Cloud 제외)auto, none
any, tool
313 토큰
315 토큰
Claude Haiku 4.5auto, none
any, tool
496 토큰
588 토큰
Claude Haiku 3.5 (종료됨, Bedrock 및 Google Cloud 제외)auto, none
any, tool
264 토큰
355 토큰

이러한 토큰 수는 일반 입력 및 출력 토큰에 더해져 요청의 총 비용을 계산하는 데 사용됩니다.

현재 모델별 가격은 모델 가격 섹션을 참조하세요.

도구 사용 구현 및 모범 사례에 대한 자세한 내용은 도구 사용을 참조하세요.

특정 도구 가격

Bash 도구

bash 도구 정의는 요청에 다음과 같은 입력 토큰을 추가합니다. 이는 도구가 하나라도 존재할 때마다 적용되는 모델별 도구 사용 시스템 프롬프트에 추가되는 것입니다.

모델추가 입력 토큰
Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7325 토큰
Claude Opus 4.6, Claude Sonnet 4.6 및 이전 모델244 토큰

추가 토큰은 다음에 의해 소비됩니다:

  • 명령 출력 (stdout/stderr)
  • 오류 메시지
  • 대용량 파일 내용

전체 가격 세부 사항은 도구 사용 가격을 참조하세요.

코드 실행 도구

코드 실행은 웹 검색 또는 웹 가져오기와 함께 사용할 경우 무료입니다. API 요청에 web_search_20260209(또는 이후 버전) 또는 web_fetch_20260209(또는 이후 버전)가 포함되어 있으면, 표준 입력 및 출력 토큰 비용 외에 코드 실행 도구 호출에 대한 추가 요금이 부과되지 않습니다.

이러한 도구 없이 사용할 경우, 코드 실행은 실행 시간을 기준으로 청구되며 토큰 사용량과는 별도로 추적됩니다:

  • 실행 시간은 최소 5분입니다
  • 각 조직은 매월 1,550시간의 무료 사용량을 제공받습니다
  • 1,550시간을 초과하는 추가 사용량은 컨테이너당 시간당 $0.05 USD로 청구됩니다
  • 요청에 파일이 포함된 경우, 파일이 컨테이너에 미리 로드되므로 도구가 호출되지 않더라도 실행 시간이 청구됩니다

코드 실행 사용량은 응답에서 추적됩니다:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 239,
    "server_tool_use": {
      "code_execution_requests": 1
    }
  }
}

텍스트 편집기 도구

텍스트 편집기 도구는 Claude와 함께 사용되는 다른 도구와 동일한 가격 구조를 사용합니다. 사용 중인 Claude 모델에 따른 표준 입력 및 출력 토큰 가격을 따릅니다.

기본 토큰 외에, 텍스트 편집기 도구에는 다음과 같은 추가 입력 토큰이 필요합니다:

도구추가 입력 토큰
text_editor_20250429 (Claude 4.x)700 토큰

전체 가격 세부 사항은 도구 사용 가격을 참조하세요.

웹 검색 도구

웹 검색 사용량은 토큰 사용량에 추가로 청구됩니다:

{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 6039,
    "cache_read_input_tokens": 7123,
    "cache_creation_input_tokens": 7345,
    "server_tool_use": {
      "web_search_requests": 1
    }
  }
}

웹 검색은 Claude API에서 검색 1,000회당 $10의 요금으로 이용할 수 있으며, 검색으로 생성된 콘텐츠에 대해서는 표준 토큰 비용이 추가됩니다. 대화 전반에 걸쳐 검색된 웹 검색 결과는 단일 턴 동안 실행된 검색 반복과 이후 대화 턴 모두에서 input tokens(입력 토큰)로 계산됩니다.

각 웹 검색은 반환된 결과 수에 관계없이 1회 사용으로 계산됩니다. 웹 검색 중 오류가 발생하면 해당 웹 검색에 대해서는 요금이 청구되지 않습니다.

웹 가져오기 도구

Web fetch(웹 가져오기) 사용에는 표준 토큰 비용 외에 추가 요금이 없습니다:

{
  "usage": {
    "input_tokens": 25039,
    "output_tokens": 931,
    "cache_read_input_tokens": 0,
    "cache_creation_input_tokens": 0,
    "server_tool_use": {
      "web_fetch_requests": 1
    }
  }
}

Web fetch 도구는 Claude API에서 추가 비용 없이 사용할 수 있습니다. 대화 컨텍스트의 일부가 되는 가져온 콘텐츠에 대해서만 표준 토큰 비용을 지불합니다.

과도한 토큰을 소비할 수 있는 대용량 콘텐츠를 의도치 않게 가져오는 것을 방지하려면, max_content_tokens 파라미터를 사용하여 사용 사례와 예산 고려 사항에 따라 적절한 한도를 설정하세요.

일반적인 콘텐츠의 토큰 사용량 예시:

  • 평균적인 웹 페이지 (10 kB): 약 2,500 토큰
  • 대용량 문서 페이지 (100 kB): 약 25,000 토큰
  • 연구 논문 PDF (500 kB): 약 125,000 토큰

컴퓨터 사용 도구

컴퓨터 사용은 표준 도구 사용 가격을 따릅니다. 컴퓨터 사용 도구를 사용할 때:

툴셋 정의 오버헤드: 기본 멤버와 함께 computer_toolset_20260801을 선언하면 요청에 약 4,500개의 입력 토큰이 추가됩니다(Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8에서는 약 4,520개, Claude Sonnet 5에서는 약 4,590개). 여기에는 멤버 도구 정의와 도구 사용 시스템 프롬프트가 포함됩니다. configszoom을 비활성화하면 이 중 약 410개의 토큰이 제거됩니다. 요청에 대한 정확한 수치는 응답의 usage에 보고되며, 토큰 카운팅 엔드포인트를 사용하여 미리 추정할 수 있습니다.

이전 도구 버전: 다음 수치는 computer_toolset_20260801이 아닌 computer_20251124computer_20250124 도구 버전에 적용됩니다:

  • 시스템 프롬프트 오버헤드: 시스템 프롬프트에 466–499개의 토큰 추가
  • 도구 정의: 도구 정의당 약 735개의 입력 토큰(computer_20250124로 측정)

추가 토큰 소비:

  • 도구 결과로 반환되는 스크린샷 및 확대 이미지는 이미지 입력으로 청구됩니다(비전 가격 참조)
  • Claude에 반환되는 도구 실행 결과

브라우저 사용 도구

브라우저 사용은 표준 도구 사용 가격을 따릅니다. 브라우저 사용 도구를 사용할 때:

툴셋 정의 오버헤드: 기본 멤버와 함께 browser_toolset_20260801을 선언하면 요청에 약 6,600개의 입력 토큰이 추가됩니다(Claude Fable 5, Claude Mythos 5, Claude Opus 5, Claude Opus 4.8에서는 약 6,610개, Claude Sonnet 5에서는 약 6,670개). 여기에는 멤버 도구 정의와 도구 사용 시스템 프롬프트가 포함됩니다. 네 가지 선택적 멤버를 모두 활성화하면 약 880개의 토큰이 추가되며, configs로 멤버를 비활성화하면 토큰 수가 줄어듭니다. 요청의 정확한 토큰 수는 응답의 usage에 보고되며, 토큰 카운팅 엔드포인트를 사용하여 미리 추정할 수 있습니다.

추가 토큰 소비:

  • 도구 결과로 반환되는 스크린샷 및 확대 이미지는 이미지 입력으로 청구됩니다(비전 가격 참조)
  • 접근성 트리, 페이지 텍스트, 콘솔 또는 네트워크 항목 등 Claude에 반환되는 텍스트 도구 결과

Claude Managed Agents 가격

Claude Managed Agents는 토큰과 세션 런타임이라는 두 가지 차원으로 청구됩니다.

토큰

Claude Managed Agents 세션에서 소비된 모든 토큰은 모델 가격에 표시된 요율로 청구됩니다. 프롬프트 캐싱 배수도 동일하게 적용됩니다. 세션 내에서 트리거된 웹 검색에는 표준 1,000회 검색당 $10가 부과됩니다. Claude Platform on AWS에서는 세션 토큰 및 런타임 요금이 표준 요율로 Claude Consumption Units로 변환됩니다. 에이전트의 model.speed"fast"로 설정된 경우 Fast mode 프리미엄 가격이 적용됩니다.

데이터 레지던시 배수도 적용됩니다. 에이전트의 model.inference_geo"us"로 고정된 경우, 해당 에이전트를 실행하는 세션에서 소비된 토큰은 표준 요율의 1.1x로 청구되며, 이는 Messages API의 미국 전용 추론에 적용되는 것과 동일한 배수입니다.

다음 Messages API 수정자는 Claude Managed Agents 세션에 적용되지 않습니다:

수정자적용되지 않는 이유
Batch API 할인세션은 상태를 유지하며 대화형입니다. 배치 모드가 없습니다.
클라우드 플랫폼 가격파트너 운영 클라우드 플랫폼에서는 사용할 수 없습니다.

세션 런타임

SKU요율계량
세션 런타임세션-시간당 $0.08running 상태 지속 시간

런타임은 밀리초 단위로 측정되며 세션 상태가 running인 동안에만 누적됩니다. idle(다음 메시지 또는 도구 확인 대기 중), rescheduling 또는 terminated 상태에서 소요된 시간은 런타임에 포함되지 않습니다.

계산 예시

50,000 입력 토큰과 15,000 출력 토큰을 소비하는 Claude Opus 5를 사용한 1시간 코딩 세션:

항목계산비용
입력 토큰50,000 × $5 / 1,000,000$0.25
출력 토큰15,000 × $25 / 1,000,000$0.375
세션 런타임1.0시간 × $0.08$0.08
합계$0.705

프롬프트 캐싱이 활성화되어 있고 입력 토큰 중 40,000개가 캐시 읽기인 경우:

항목계산비용
캐시되지 않은 입력 토큰10,000 × $5 / 1,000,000$0.05
캐시 읽기 토큰40,000 × $5 × 0.1 / 1,000,000$0.02
출력 토큰15,000 × $25 / 1,000,000$0.375
세션 런타임1.0시간 × $0.08$0.08
합계$0.525

이 계산에 대한 자세한 안내는 고객 지원 에이전트 가이드를 참조하세요.

추가 가격 고려 사항

비용 최적화 전략

Claude로 에이전트를 구축할 때:

  1. 적절한 모델 사용: 간단한 작업에는 Haiku, 대부분의 프로덕션 워크로드에는 Sonnet, 가장 복잡한 추론에는 Opus를 선택하세요
  2. 프롬프트 캐싱 구현: 반복되는 컨텍스트에 대한 비용을 줄이세요
  3. 배치 작업: 시간에 민감하지 않은 작업에는 Batch API를 사용하세요
  4. 사용 패턴 모니터링: 토큰 소비를 추적하여 최적화 기회를 파악하세요

속도 제한

"Rate limit"(속도 제한)은 사용 티어에 따라 다르며 요청할 수 있는 횟수에 영향을 미칩니다:

  • Start 티어: 시작을 위한 입문 수준 제한
  • Build 티어: 성장하는 애플리케이션을 위한 증가된 제한
  • Scale 티어: 프로덕션 워크로드를 위한 최고 표준 제한

자세한 속도 제한 정보는 속도 제한을 참조하세요.

Scale 티어를 초과하는 제한 또는 맞춤형 가격 협의는 영업팀에 문의하세요.

대량 할인

대용량 사용자에게는 대량 할인이 제공될 수 있습니다. 이는 사례별로 협상됩니다.

  • 표준 사용 티어는 모델 가격에 표시된 가격을 사용합니다
  • Enterprise 고객은 맞춤형 가격을 위해 영업팀에 문의할 수 있습니다
  • 학술 및 연구 할인이 제공될 수 있습니다

엔터프라이즈 가격

특정 요구 사항이 있는 엔터프라이즈 고객의 경우:

  • 맞춤형 속도 제한
  • 대량 할인
  • 전담 지원
  • 맞춤형 조건

엔터프라이즈 가격 옵션을 논의하려면 sales@anthropic.com 또는 Claude Console을 통해 영업팀에 문의하세요.

청구 및 결제

  • 청구는 실제 월별 사용량을 기준으로 합니다
  • 모든 결제는 USD로 이루어집니다
  • 신용카드 및 청구서 발행 옵션 사용 가능
  • Claude Console에서 사용량 추적 가능

자주 묻는 질문

토큰 사용량은 어떻게 계산되나요?

토큰은 모델이 처리하는 텍스트 조각입니다. 대략적인 추정으로, 1 토큰은 영어 기준 약 4자 또는 0.75단어입니다. 정확한 수는 언어와 콘텐츠 유형에 따라 다릅니다.

무료 티어나 체험판이 있나요?

신규 사용자는 API를 테스트할 수 있는 소량의 무료 크레딧을 받습니다. 엔터프라이즈 평가를 위한 연장 체험판에 대한 정보는 영업팀에 문의하세요.

할인은 어떻게 중첩되나요?

Batch API와 프롬프트 캐싱 할인은 결합할 수 있습니다. 예를 들어, 두 기능을 함께 사용하면 표준 API 호출에 비해 상당한 비용 절감 효과를 얻을 수 있습니다. 배수가 어떻게 상호작용하는지는 프롬프트 캐싱 가격을 참조하세요.

어떤 결제 방법이 허용되나요?

표준 계정에는 주요 신용카드가 허용됩니다. 엔터프라이즈 고객은 청구서 발행 및 기타 결제 방법을 협의할 수 있습니다.

가격에 대한 추가 질문은 support@anthropic.com으로 문의하세요.

Was this page helpful?