"zero data retention"(제로 데이터 보존), 즉 ZDR이 이 기능에 어떻게 적용되는지는 API 및 데이터 보존을 참조하세요.
웹 페치 도구를 사용하면 Claude가 지정된 웹 페이지와 PDF 문서에서 전체 콘텐츠를 가져올 수 있습니다.
최신 웹 페치 도구 버전(web_fetch_20260318)은 Claude Fable 5, Claude Opus 4.8, Claude Mythos 5, Claude Mythos Preview, Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 5, Claude Sonnet 4.6에서 동적 필터링을 지원합니다. Claude는 가져온 콘텐츠가 컨텍스트 윈도우에 도달하기 전에 이를 필터링하는 코드를 작성하고 실행하여 관련 정보만 유지하고 나머지는 버릴 수 있습니다. 이를 통해 응답 품질을 유지하면서 토큰 소비를 줄일 수 있습니다. web_fetch_20260318은 에이전트 워크플로를 위한 응답 포함 제어도 추가합니다. 이전 버전(동적 필터링 및 캐시 우회를 위한 web_fetch_20260309, 동적 필터링만 지원하는 web_fetch_20260209, 기본 페치를 위한 web_fetch_20250910)도 계속 사용할 수 있습니다.
웹 페치(동적 필터링 포함 및 미포함)는 Claude API, Claude Platform on AWS, Microsoft Foundry에서 사용할 수 있습니다. Microsoft Foundry에서 웹 페치를 사용하려면 Hosted on Anthropic 배포가 필요합니다. 현재 Amazon Bedrock 또는 Google Cloud에서는 사용할 수 없습니다.
Claude Mythos Preview의 경우, 웹 페치는 Claude API와 Microsoft Foundry에서 사용할 수 있습니다. 현재 Amazon Bedrock 또는 Google Cloud의 Mythos Preview에서는 사용할 수 없습니다.
피드백 양식을 사용하여 모델 응답의 품질, API 자체 또는 문서의 품질에 대한 피드백을 제공해 주세요.
Zero Data Retention 적격성 및 allowed_callers 해결 방법에 대해서는 서버 도구를 참조하세요.
Claude가 민감한 데이터와 함께 신뢰할 수 없는 입력을 처리하는 환경에서 웹 페치 도구를 활성화하면 데이터 유출 위험이 발생합니다. 신뢰할 수 있는 환경이나 민감하지 않은 데이터를 처리할 때만 이 도구를 사용하세요.
유출 위험을 최소화하기 위해 Claude는 URL을 동적으로 구성할 수 없습니다. Claude는 사용자가 명시적으로 제공했거나 이전 웹 검색 또는 웹 페치 결과에서 나온 URL만 가져올 수 있습니다. 그러나 이 도구를 사용할 때 신중하게 고려해야 할 잔여 위험이 여전히 존재합니다.
데이터 유출이 우려되는 경우 다음을 고려하세요:
max_uses 매개변수를 사용하여 요청 수 제한allowed_domains 매개변수를 사용하여 알려진 안전한 도메인으로 제한모델 지원에 대해서는 도구 참조를 참조하세요.
웹 페치는 서버 도구입니다. API가 요청 중에 콘텐츠를 가져와 결과를 대화에 삽입합니다. 사용자가 직접 실행하거나 tool_result를 반환할 필요가 없습니다. 예외는 Claude가 동일한 병렬 도구 호출 그룹에서 웹 페치와 클라이언트 도구 중 하나를 함께 호출하는 경우입니다. 이 경우 API는 해당 페치가 실행되기 전에 stop_reason: "tool_use"와 함께 응답을 반환한 다음, 클라이언트 tool_result 블록을 다시 보낼 때 페치를 실행합니다. 한 턴에서 서버 도구와 클라이언트 도구 혼합을 참조하세요.
API 요청에 웹 페치 도구를 추가하면:
웹 페치 도구는 현재 JavaScript로 동적으로 렌더링되는 웹사이트를 지원하지 않습니다.
Claude는 요청이 특정 페이지나 문서를 가리킬 때 페치합니다:
Claude는 특정 페이지를 참조하지 않는 일반 지식 또는 개방형 질문에 대해서는 페치하지 않습니다. "이 기사를 요약해 주세요: <url>"은 페치를 트리거합니다. "REST API 설계의 모범 사례는 무엇인가요?"는 직접 답변됩니다.
전체 웹 페이지와 PDF를 가져오면 특히 대용량 문서에서 특정 정보만 필요한 경우 토큰을 빠르게 소비할 수 있습니다. web_fetch_20260209 이상에서는 Claude가 가져온 콘텐츠를 컨텍스트에 로드하기 전에 필터링하는 코드를 작성하고 실행할 수 있습니다.
이 동적 필터링은 특히 다음과 같은 경우에 유용합니다:
동적 필터링은 코드 실행 도구에서 실행되며, API가 요청에 대해 자동으로 활성화합니다. tools 배열에 코드 실행 도구를 추가할 필요가 없습니다.
동적 필터링을 활성화하려면 web_fetch_20260209 또는 그 이후 버전을 사용하세요. 다음 예제는 web_fetch_20260318을 사용합니다:
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-4-8",
max_tokens=4096,
messages=[
{
"role": "user",
"content": "Fetch the content at https://example.com/research-paper and extract the key findings.",
}
],
tools=[{"type": "web_fetch_20260318", "name": "web_fetch"}],
)
print(response)API 요청에 웹 페치 도구를 제공하세요:
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-4-8",
max_tokens=1024,
messages=[
{
"role": "user",
"content": "Please analyze the content at https://example.com/article",
}
],
tools=[{"type": "web_fetch_20250910", "name": "web_fetch", "max_uses": 5}],
)
print(response)웹 페치 도구는 다음 매개변수를 지원합니다:
{
"type": "web_fetch_20250910",
"name": "web_fetch",
// Optional: Limit the number of fetches per request
"max_uses": 10,
// Optional: Only fetch from these domains
"allowed_domains": ["example.com", "docs.example.com"],
// Optional: Never fetch from these domains (cannot be combined with allowed_domains)
"blocked_domains": ["private.example.com"],
// Optional: Enable citations for fetched content
"citations": {
"enabled": true
},
// Optional: Maximum content length in tokens
"max_content_tokens": 100000
}이후 도구 버전에서는 두 가지 선택적 매개변수가 추가됩니다. use_cache는 web_fetch_20260309 이상이 필요하고(캐시 우회 참조), response_inclusion은 web_fetch_20260318 이상이 필요합니다(응답 포함 참조).
max_uses 매개변수는 수행되는 웹 페치 수를 제한합니다. 실패한 페치도 제한에 포함됩니다. Claude가 허용된 것보다 더 많은 페치를 시도하면 web_fetch_tool_result는 max_uses_exceeded 오류 코드와 함께 오류가 됩니다. 현재 기본 제한은 없습니다.
allowed_domains 및 blocked_domains를 사용한 도메인 필터링에 대해서는 서버 도구를 참조하세요.
max_content_tokens 매개변수는 컨텍스트에 포함되는 콘텐츠의 양을 제한합니다. 가져온 콘텐츠가 이 제한을 초과하면 도구가 이를 잘라냅니다. 이는 대용량 문서를 가져올 때 토큰 사용량을 제어하는 데 도움이 됩니다. 이 제한은 텍스트 콘텐츠에 적용되며 PDF와 같은 바이너리 콘텐츠에는 적용되지 않습니다.
max_content_tokens 매개변수 제한은 근사치입니다. 실제 사용되는 입력 토큰 수는 약간 다를 수 있습니다.
web_fetch_20260309 이상(web_fetch_20260318 포함)이 필요합니다.
use_cache 매개변수는 캐시된 콘텐츠가 반환될 수 있는지 여부를 제어합니다. 캐시를 우회하고 새로운 콘텐츠를 가져오려면 "use_cache": false로 설정하세요. 기본값은 true입니다. 캐시를 우회하면 지연 시간이 증가하므로, 사용자가 명시적으로 새로운 콘텐츠를 요청하거나 빠르게 변경되는 소스를 가져올 때만 캐싱을 비활성화하세요.
{
"tools": [
{
"type": "web_fetch_20260309",
"name": "web_fetch",
"use_cache": false
}
]
}web_fetch_20260318 이상이 필요합니다.
response_inclusion 매개변수는 동일한 턴에서 완료된 코드 실행 호출에 의해 결과가 소비된 경우 페치 결과 블록이 API 응답에 어떻게 나타나는지 제어합니다. "response_inclusion": "excluded"로 설정하면 중첩된 server_tool_use 및 결과 블록 쌍이 응답에서 완전히 제거되어, 원시 페이지 콘텐츠를 클라이언트에 다시 전달할 필요가 없는 에이전트 워크플로의 출력 토큰 비용을 줄일 수 있습니다. 기본값은 "full"입니다. 직접 호출의 결과 또는 완료 전에 일시 중지된 코드 실행 호출의 결과는 다음 턴에 다시 보낼 수 있도록 항상 전체가 반환됩니다.
{
"tools": [
{
"type": "web_fetch_20260318",
"name": "web_fetch",
"response_inclusion": "excluded"
}
]
}인용이 항상 활성화되는 웹 검색과 달리, 웹 페치에서는 인용이 선택 사항이며 기본적으로 비활성화되어 있습니다. Claude가 가져온 문서의 특정 구절을 인용할 수 있도록 하려면 "citations": {"enabled": true}로 설정하세요.
API 출력을 최종 사용자에게 직접 표시할 때는 원본 소스에 대한 인용을 포함하세요. API 출력을 수정하는 경우(재처리 및/또는 자체 자료와 결합하여 최종 사용자에게 표시하기 전에 수정하는 경우 포함), 법무팀과의 상담을 바탕으로 적절하게 인용을 표시하세요.
다음은 응답 구조의 예입니다:
{
"role": "assistant",
"content": [
// 1. Claude's decision to fetch
{
"type": "text",
"text": "I'll fetch the content from the article to analyze it."
},
// 2. The fetch request
{
"type": "server_tool_use",
"id": "srvtoolu_01234567890abcdef",
"name": "web_fetch",
"input": {
"url": "https://example.com/article"
}
},
// 3. Fetch results
{
"type": "web_fetch_tool_result",
"tool_use_id": "srvtoolu_01234567890abcdef",
"content": {
"type": "web_fetch_result",
"url": "https://example.com/article",
"content": {
"type": "document",
"source": {
"type": "text",
"media_type": "text/plain",
"data": "Full text content of the article..."
},
"title": "Article Title",
"citations": { "enabled": true }
},
"retrieved_at": "2025-08-25T10:30:00Z"
}
},
// 4. Claude's analysis with citations (if enabled)
{
"text": "Based on the article, ",
"type": "text"
},
{
"text": "the main argument presented is that artificial intelligence will transform healthcare",
"type": "text",
"citations": [
{
"type": "char_location",
"document_index": 0,
"document_title": "Article Title",
"start_char_index": 1234,
"end_char_index": 1456,
"cited_text": "Artificial intelligence is poised to revolutionize healthcare delivery..."
}
]
}
],
"id": "msg_a930390d3a",
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"server_tool_use": {
"web_fetch_requests": 1
}
},
"stop_reason": "end_turn"
}페치 결과에는 다음이 포함됩니다:
url: 가져온 URLcontent: 가져온 콘텐츠를 포함하는 문서 블록retrieved_at: 콘텐츠를 가져온 시점의 타임스탬프웹 페치 도구는 성능을 개선하고 중복 요청을 줄이기 위해 결과를 캐시합니다. 반환된 콘텐츠가 항상 해당 URL에서 사용 가능한 최신 버전을 반영하지 않을 수 있습니다. 캐시 동작은 자동으로 관리되며 다양한 콘텐츠 유형과 사용 패턴에 최적화하기 위해 시간이 지남에 따라 변경될 수 있습니다. 새로운 콘텐츠를 가져오려면 "use_cache": false로 설정하세요(캐시 우회 참조).
PDF 문서의 경우 콘텐츠는 base64로 인코딩된 데이터로 반환됩니다:
{
"type": "web_fetch_tool_result",
"tool_use_id": "srvtoolu_02",
"content": {
"type": "web_fetch_result",
"url": "https://example.com/paper.pdf",
"content": {
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "JVBERi0xLjQKJcOkw7zDtsOfCjIgMCBvYmo..."
},
"citations": { "enabled": true }
},
"retrieved_at": "2025-08-25T10:30:02Z"
}
}웹 페치 도구에서 오류가 발생하면 Claude API는 응답 본문에 오류가 표현된 200(성공) 응답을 반환합니다. Claude는 오류 결과를 확인하고 턴을 계속합니다. 예를 들어:
{
"type": "web_fetch_tool_result",
"tool_use_id": "srvtoolu_a93jad",
"content": {
"type": "web_fetch_tool_result_error",
"error_code": "url_not_accessible"
}
}가능한 오류 코드는 다음과 같습니다:
invalid_tool_input: 잘못된 형식의 URL 또는 HTTP(S)가 아닌 스킴과 같은 잘못된 도구 입력url_too_long: URL이 최대 길이(250자)를 초과함url_not_allowed: 도메인 필터링 규칙(조직의 설정 포함) 또는 비공개 주소 및 robots.txt와 같은 Anthropic 측 제한에 의해 차단된 URLurl_not_in_prior_context: URL이 대화에서 이전에 나타나지 않음(URL 검증 참조)url_not_accessible: 콘텐츠 가져오기 실패(HTTP 오류)too_many_requests: 속도 제한 초과unsupported_content_type: 지원되지 않는 콘텐츠 유형(텍스트, HTML, PDF만 지원)max_uses_exceeded: 최대 웹 페치 도구 사용 횟수 초과unavailable: 내부 오류 발생보안상의 이유로 웹 페치 도구는 대화 컨텍스트에 이전에 나타난 URL만 가져올 수 있습니다. 여기에는 다음이 포함됩니다:
이 도구는 Claude가 생성한 임의의 URL이나 컨테이너 기반 서버 도구(Code Execution 및 Bash 등)의 URL은 가져올 수 없습니다.
웹 검색 도구와 웹 페치 도구가 모두 활성화되어 있고 사용자가 URL을 제공하지 않고 특정 페이지나 문서를 지정하는 경우(예: "anthropics/anthropic-sdk-python 저장소의 README를 읽어주세요"), Claude는 웹 검색을 사용하여 이를 찾은 다음 결과를 가져옵니다. 다음 예제는 하나의 요청에서 검색과 분석을 요청합니다:
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-4-8",
max_tokens=4096,
messages=[
{
"role": "user",
"content": "Find recent articles about quantum computing and analyze the most relevant one in detail",
}
],
tools=[
{"type": "web_search_20250305", "name": "web_search", "max_uses": 3},
{
"type": "web_fetch_20250910",
"name": "web_fetch",
"max_uses": 5,
"citations": {"enabled": True},
},
],
)
print(response)이 워크플로에서 Claude는:
턴 간 도구 정의 캐싱에 대해서는 프롬프트 캐싱과 함께 도구 사용을 참조하세요.
스트리밍이 활성화되면 페치 이벤트는 콘텐츠 검색 중 일시 중지와 함께 스트림의 일부가 됩니다:
event: message_start
data: {"type": "message_start", "message": {"id": "msg_abc123", "type": "message"}}
event: content_block_start
data: {"type": "content_block_start", "index": 0, "content_block": {"type": "text", "text": ""}}
// Claude's decision to fetch
event: content_block_start
data: {"type": "content_block_start", "index": 1, "content_block": {"type": "server_tool_use", "id": "srvtoolu_xyz789", "name": "web_fetch"}}
// Fetch URL streamed
event: content_block_delta
data: {"type": "content_block_delta", "index": 1, "delta": {"type": "input_json_delta", "partial_json": "{\"url\":\"https://example.com/article\"}"}}
// Pause while fetch executes
// Fetch results streamed
event: content_block_start
data: {"type": "content_block_start", "index": 2, "content_block": {"type": "web_fetch_tool_result", "tool_use_id": "srvtoolu_xyz789", "content": {"type": "web_fetch_result", "url": "https://example.com/article", "content": {"type": "document", "source": {"type": "text", "media_type": "text/plain", "data": "Article content..."}}}}}
// Claude's response continues...Messages Batches API에 웹 페치 도구를 포함할 수 있습니다. Messages Batches API를 통한 웹 페치 도구 호출은 일반 Messages API 요청과 동일한 가격이 적용됩니다.
웹 가져오기 사용에는 표준 토큰 비용 외에 추가 요금이 없습니다:
{
"usage": {
"input_tokens": 25039,
"output_tokens": 931,
"cache_read_input_tokens": 0,
"cache_creation_input_tokens": 0,
"server_tool_use": {
"web_fetch_requests": 1
}
}
}웹 가져오기 도구는 Claude API에서 추가 비용 없이 사용할 수 있습니다. 대화 컨텍스트의 일부가 되는 가져온 콘텐츠에 대한 표준 토큰 비용만 지불하면 됩니다.
과도한 토큰을 소비할 수 있는 대용량 콘텐츠를 실수로 가져오는 것을 방지하려면, max_content_tokens 매개변수를 사용하여 사용 사례와 예산 고려 사항에 따라 적절한 제한을 설정하세요.
일반적인 콘텐츠에 대한 토큰 사용량 예시:
샌드박스 컨테이너에서 Python 및 bash 코드를 실행하여 데이터를 분석하고, 파일을 생성하고, 솔루션을 반복적으로 개선합니다.
Anthropic이 실행하는 도구로 작업합니다: server_tool_use 블록, pause_turn 연속, 도메인 필터링.
Anthropic이 제공하는 도구 디렉터리 및 선택적 도구 정의 속성에 대한 참조입니다.
Was this page helpful?