Claude Haiku 5.5의 새로운 기능
Claude Haiku 5.5의 새로운 기능, 호환성을 깨는 변경 사항 및 동작 변경 사항에 대한 개요로, 각 기능의 가이드와 코드 변경을 위한 마이그레이션 가이드 링크를 제공합니다.
Claude Haiku 5.5는 분류, 라우팅, 추출, 서브에이전트 작업과 같이 대량 처리가 필요하고 "latency"(지연 시간)에 민감한 작업을 위해 설계되었습니다. effort 매개변수를 사용하는 "adaptive thinking"(적응형 사고), 1M 토큰 "context window"(컨텍스트 윈도우), 최대 128k 출력 토큰을 지원합니다. Claude 4.7 이후 모델과 동일한 새로운 "tokenizer"(토크나이저)를 사용하므로, 동일한 텍스트가 Claude Haiku 4.5보다 약 30% 더 많은 토큰으로 계산됩니다. 사고 블록은 해당 블록을 생성한 계정 또는 그 계정에 연결된 계정에서만 작동합니다.
코드 변경 사항은 마이그레이션 가이드를 참조하세요. 모델 ID, 가격 및 제한 사항은 Claude Haiku 5.5 개요를 참조하세요. 프롬프팅 지침은 Claude Haiku 5.5 프롬프팅을 참조하세요.
Claude Haiku 4.5 대비 변경 사항 요약
각 행은 하나의 변경 사항과 그것이 새로운 기능인지, 변경된 것인지, 호환성을 깨는 것인지, 그리고 코드에서 해야 할 작업을 나타냅니다.
| 변경 사항 | 유형 | 필요한 조치 |
|---|---|---|
| 적응형 사고와 effort | 신규 | 선택 사항: 응답 품질과 속도 및 비용 간의 균형을 조정하려면 effort를 설정하세요. |
| 더 커진 컨텍스트 윈도우와 출력 | 신규 | 없음. 기존 max_tokens 값은 그대로 유효하지만, 사고 토큰이 여기에 포함됩니다. |
| 브라우저 사용 도구 | 신규 | 없음. Claude API 및 Google Cloud에서 사용할 수 있습니다. |
| 안전 분류기가 요청을 거부할 수 있음 | 신규 | 클라이언트에서 stop_reason: "refusal"을 처리하세요. 서버 측 폴백은 사용할 수 없습니다. |
| 수동 확장 사고는 오류를 반환함 | 호환성 깨짐 | budget_tokens를 적응형 사고로 대체하세요. |
| 기본값이 아닌 샘플링 매개변수는 오류를 반환함 | 호환성 깨짐 | temperature, top_p, top_k를 생략하세요. |
| 어시스턴트 메시지 프리필은 오류를 반환함 | 호환성 깨짐 | messages를 사용자 턴으로 끝내세요. |
| Claude API 및 Google Cloud에서 컴퓨터 사용에 도구 세트가 필요함 | 호환성 깨짐 | computer_20250124를 computer_toolset_20260801로 대체하세요. |
| 이전 턴을 변경하면 사고 블록이 무효화됨 | 호환성 깨짐 | 사고 블록을 다시 전송하는 경우 대화를 추가 전용으로 유지하세요. |
| 응답이 사고 블록으로 시작될 수 있음 | 변경됨 | 콘텐츠 블록을 위치가 아닌 type으로 선택하세요. |
| 사고 텍스트는 기본적으로 생략됨 | 변경됨 | 요약된 사고를 받으려면 thinking.display를 "summarized"로 설정하세요. |
| 동일한 텍스트가 더 많은 토큰으로 계산됨 | 변경됨 | 프롬프트의 토큰 수를 다시 계산하고 max_tokens 및 비용 추정치를 재검토하세요. |
| 계정 간 사고 블록 재생 | 변경됨 | 저장된 대화를 다른 계정을 통해 재생하는 경우, 각 대화를 해당 대화를 생성한 계정을 통해 재생하세요. |
새로운 기능
적응형 사고와 effort
적응형 사고를 사용하면 Claude Haiku 5.5가 언제, 얼마나 사고할지 스스로 결정합니다. 적응형 사고는 기본적으로 활성화되어 있습니다. high effort 이하에서는 여전히 thinking: {"type": "disabled"}로 사고를 끌 수 있지만, 응답 품질과 속도 및 비용 간의 균형을 조정하는 더 나은 방법은 effort 매개변수를 사용하는 것입니다.
더 커진 컨텍스트 윈도우와 출력
Claude Haiku 5.5는 1M 토큰 컨텍스트 윈도우를 가지며 최대 128k 출력 토큰을 반환합니다. 이는 Claude Haiku 4.5의 200k 및 64k에서 늘어난 것입니다. 기존 max_tokens 값은 그대로 유효하지만, 사고 토큰이 max_tokens에 포함되므로 제한이 작으면 thinking 블록 이후 텍스트가 나오기 전에 중단될 수 있습니다. 사고 구성하기를 참조하세요.
동작 변경 사항
응답이 사고 블록으로 시작될 수 있음
적응형 사고가 기본적으로 활성화되어 있으므로, 요청에서 사고를 언급하지 않더라도 응답이 하나 이상의 thinking 블록으로 시작될 수 있습니다. 첫 번째 콘텐츠 블록을 답변으로 읽는 코드는 type 필드로 블록을 선택해야 합니다. 마이그레이션 가이드의 사고 구성하기를 참조하세요.
동일한 텍스트가 더 많은 토큰으로 계산됨
Claude Haiku 5.5는 Claude 4.7 이후 모델과 동일한 새로운 토크나이저를 사용합니다. 이 토크나이저를 사용하는 모든 모델과 마찬가지로, 동일한 입력 텍스트가 Claude Haiku 4.5보다 Claude Haiku 5.5에서 약 30% 더 많은 토큰을 생성합니다. 정확한 증가량은 콘텐츠에 따라 다릅니다. 요청과 응답의 형태는 토크나이저에 따라 달라지지 않지만, 토큰 단위로 측정하거나 예산을 책정하는 모든 항목은 변경됩니다. 마이그레이션 가이드의 토큰 다시 계산하기를 참조하세요.
계정 간 사고 블록 재생
Claude Haiku 5.5의 사고 블록은 해당 블록을 생성한 계정 또는 그 계정에 연결된 계정에서만 작동합니다. 이는 대화를 저장하고 다른 계정을 통해 재생하는 경우에만 해당됩니다. 사고 블록을 생성한 계정을 통해 재생하기를 참조하세요.
Was this page helpful?