Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
Loading
GET /v1/compliance/apps/sessions/local 列出您组织内的所有会话,GET /v1/compliance/apps/sessions/local/{session_id} 检索单个会话的元数据,GET /v1/compliance/apps/sessions/local/{session_id}/messages 返回其记录,所有请求均使用您现有的 Compliance Access Key 和 read:compliance_user_data 权限范围。请参阅检索本地会话。budget_reached 停止原因暂停,而不会启动新的模型请求;更改或移除预算即可恢复会话。部署接受相同的预算设置,并将其应用于所启动的每个会话。请参阅会话预算。{"type": "advisor"} 条目,并指定要咨询的 model。请参阅为会话配置顾问。model 对象内设置 inference_geo,或为单个会话覆盖该设置。有关可用地理位置和定价,请参阅数据驻留。.claude/skills 中的所有技能会在会话启动时自动被发现,并在该会话期间供智能体使用。claude-opus-4-1-20250805)。现在,Claude API 上对该模型的所有请求都将返回错误。我们建议升级到 Claude Opus 5。研究人员可通过外部研究人员访问计划申请持续访问权限。GET /v1/compliance/apps/sessions/remote 列出会话,GET /v1/compliance/apps/sessions/remote/{session_id}/messages 返回单个会话的记录,使用您现有的 Compliance Access Key 和 read:compliance_user_data 权限范围。请参阅检索远程会话。claude-opus-5),相比 Claude Opus 4.8 实现了跨越式改进。Claude Opus 5 支持 100 万令牌上下文窗口(默认值和最大值均为 100 万)、128k 最大输出令牌,并默认开启思考功能,定价为每 MTok $5 / $25 美元,与 Claude Opus 4.8 相同。该模型可在 Claude API、Amazon Bedrock 中的 Claude、Google Cloud 上的 Claude 和 Microsoft Foundry 中的 Claude 上使用。有关新功能、行为变更和迁移指南,请参阅 Claude Opus 5 新特性;有关完整规格,请参阅模型概览。high 或更低时禁用思考:在 effort 为 xhigh 或 max 时使用 thinking: {"type": "disabled"} 会返回 400 错误,这是相对于 Claude Opus 4.8 的破坏性变更。请参阅 Claude Opus 5 新特性。low、medium、high、xhigh、max),其中 max 用于对能力要求极高的工作。mid-conversation-tool-changes-2026-07-01 Beta 标头。fallbacks 参数现在支持 "default" 模式,该模式按拒绝类别应用 Anthropic 推荐的回退模型。服务器端回退处于 Beta 阶段,"default" 模式需要 server-side-fallback-2026-07-01 Beta 标头。请参阅拒绝与回退。claude-opus-4-7 使用 speed: "fast" 的请求现在会返回错误;与 Claude Opus 4.6 不同,这些请求不会回退到标准速度。Claude Opus 4.7 本身仍可以标准速度使用。如需继续使用快速模式,请迁移到 Claude Opus 5 或 Claude Opus 4.8。详情请参阅快速模式。effort 级别。在创建智能体时在 model 对象内传递 effort。有关每个级别的作用,请参阅 Effort 级别。environment.* 事件类型和三种 memory_store.* 事件类型。您无需轮询即可响应环境和内存存储的生命周期变更。请参阅订阅 Webhook 中的"环境事件"和"内存存储事件"选项卡。POST /v1/sessions 上传递 initial_events,最多包含 50 个 user.message 和 user.define_outcome 事件。非空列表会在同一调用中启动智能体循环,因此您无需单独发送事件请求即可开始工作。version 字段现在为可选项。提供该字段可实现乐观并发控制(不匹配时返回 409 错误),省略该字段则无条件应用更新。请参阅更新语义。GET /v1/sessions/{session_id}/threads/{thread_id}/stream 接受与会话级流相同的 event_deltas[] 查询参数,因此您可以在模型生成子智能体文本时进行预览。一个连接仅预览其正在读取的线程。请参阅预览会话线程事件。/v1/experimental/generate_prompt、/v1/experimental/improve_prompt 和 /v1/experimental/templatize_prompt)将与 Workbench 一同于 2026 年 8 月 17 日停用。移除后,对这些端点的请求将返回错误。anthropic-beta: ce-user-management-2026-07-13 Beta 标头;成员和邀请请求无需 Beta 标头。具有 read:org_audit 权限范围的 Admin API 密钥也可以调用所有用户管理 GET 端点。请参阅用户管理。cmek_preserve 事件的内容,新增了一个筛选示例、一个事件负载示例和两个保留原因代码(policy_violation_investigation、csae_report)。文档现在还阐明,无论保留是由人工审核员还是自动化安全流程发起,都会写入保留事件。请参阅 CMEK 内容保留。expires_at 字段中报告每个密钥的过期时间。请参阅身份验证。agent-memory-2026-07-22 Beta 标头,它会改变列出内存(GET /v1/memory_stores/{memory_store_id}/memories)的行为:结果以稳定的、服务器定义的顺序返回,order_by 和 order 参数会被忽略;depth 仅接受 0、1 或省略(其他值返回 400 错误);path_prefix 必须以 / 结尾,并匹配完整路径段而非子字符串。不带该标头签发的分页游标在带该标头时无效,因此采用该标头时请从第一页重新开始。在内存存储端点上,agent-memory-2026-07-22 取代 managed-agents-2026-04-01;同时发送两者会返回 400 错误。2026 年 7 月 22 日,managed-agents-2026-04-01 标头将采用相同的列表行为。请参阅 Beta 标头。agent-memory-2026-07-22 而非 managed-agents-2026-04-01。如果您的代码在内存存储调用上显式传递 betas,请在那里将 managed-agents-2026-04-01 替换为 agent-memory-2026-07-22,而不是添加第二个值。claude-sonnet-5),这是我们 Sonnet 模型系列的新一代产品,推介定价为每 MTok $2 / $10(已于 2026 年 8 月 10 日成为标准价格)。Claude Sonnet 5 支持 100 万令牌上下文窗口、128k 最大输出令牌,以及与 Claude Sonnet 4.6 相同的工具和平台功能集,但不包括优先级层,该功能在 Claude Sonnet 5 上不可用。迁移时有三项行为变更:自适应思考现在默认开启;手动扩展思考(thinking: {type: "enabled", budget_tokens: N})已移除并返回 400 错误(该功能在 Sonnet 4.6 上已弃用);将采样参数(temperature、top_p、top_k)设置为非默认值会返回 400 错误。Claude Sonnet 5 还使用了新的分词器,对于相同文本会产生约 30% 更多的令牌。确切的增幅取决于内容和工作负载形态。有关详情和迁移指南,请参阅 Claude Sonnet 5 新特性。有关行为差异和特定于模型的提示模式,请参阅为 Claude Sonnet 5 编写提示。GET /v1/sessions/{session_id}/events/stream 上使用 event_deltas[] 查询参数选择启用。event_start 和 event_delta 事件会在完整的 agent.message 事件到达之前,预览智能体消息正在生成的文本。GET /v1/sessions 在 next_page 之外还返回 prev_page 游标;将其作为 page 参数传递即可返回上一页。请参阅分页。type: "agent_with_overrides" 的 agent 以替换单个会话的模型、系统提示、工具、MCP 服务器或技能。智能体本身不会改变。injection_location。它控制凭据的值在出口处是替换到智能体的出站请求标头、请求正文,还是两者都替换。claude-opus-4-6 使用 speed: "fast" 的请求不再以快速速度运行或按高级定价计费:它们以标准速度运行,按标准费率计费,且不会返回错误。响应的 usage.speed 字段会报告所使用的速度。如需继续使用快速模式,请迁移到 Claude Opus 4.8。详情请参阅快速模式。claude-opus-4-7 使用 speed: "fast" 的请求将返回错误。请迁移到 Claude Opus 4.8 的快速模式。详情请参阅快速模式。/v1/organizations/tunnels 迁移到 Claude API 上的 /v1/tunnels。新接口使用 anthropic-beta: mcp-tunnels-2026-06-22 标头和 workspace:manage_tunnels WIF 权限范围。在迁移窗口期间,之前的接口仍然可用。请参阅隧道 API 参考。code_execution_20260120,这是代码执行工具的一个版本,新增了 REPL 状态持久化,也是编程式工具调用所需的最低版本。要采用该版本,请将工具的 type 设置为 code_execution_20260120;无需 Beta 标头。它可在 Claude Fable 5、Claude Mythos 5、Claude Opus 4.5 及更新版本,以及 Claude Sonnet 4.5 及更新版本上使用;请参阅模型兼容性表。claude-sonnet-4-20250514)和 Claude Opus 4 模型(claude-opus-4-20250514)。现在,Claude API 上对这些模型的所有请求都将返回错误。我们建议分别升级到 Claude Sonnet 4.6 和 Claude Opus 4.8。研究人员可通过外部研究人员访问计划申请持续访问权限。code_execution_20260521,该版本在工具描述中披露了每个单元格 90 秒的执行时间限制,以便 Claude 为长时间运行的单元格合理分配时间。无需 Beta 标头。web_search_20260318 和 web_fetch_20260318,新增了 response_inclusion 参数,用于在智能体工作流中从 API 响应中删除已消费的结果块。无需 Beta 标头。GET /v1/environments/{id}/work 端点现已在 AWS 上的 Claude Platform 上可用。有关授权该端点的 GetEnvironment 操作,请参阅 AWS 上的 Claude Platform 的 IAM 操作。claude-fable-5),这是我们能力最强的广泛发布模型,同时为 Project Glasswing 参与者发布了 Claude Mythos 5(claude-mythos-5)。两个模型均默认支持 100 万令牌上下文窗口、128k 最大输出令牌,以及始终开启的自适应思考。有关功能、API 变更和可用性,请参阅 Claude Fable 5 和 Claude Mythos 5 介绍。model: "claude-fable-5" 来测量您的提示在新分词器下的令牌数。stop_reason: "refusal"。在生成任何输出之前被拒绝的请求不会计费。可选启用的 fallbacks 参数(在 Claude API 和 AWS 上的 Claude Platform 上处于 Beta 阶段;Message Batches API 不支持)会在另一个模型上重新运行被拒绝的请求,按回退模型的费率计费。请参阅处理停止原因。stop_details.category 字段现在在 Claude Fable 5 上包含 "reasoning_extraction",当请求因违反 Anthropic 服务条款中关于逆向工程或复制模型输出的限制而被阻止时返回。现有的 "cyber" 和 "bio" 类别保持不变。无需 Beta 标头。thinking: {"type": "disabled"},也不支持手动扩展思考预算和助手预填充(两者均返回 400 错误)。请参阅从 Claude Mythos Preview 迁移到 Claude Mythos 5。thinking.display 默认为 "omitted",与 Claude Opus 4.8、Claude Opus 4.7 和 Claude Mythos Preview 相同;设置 display: "summarized" 可接收可读的思考摘要。原始思维链永远不会返回;在同一模型的多轮对话中,请原样传回思考块。请参阅 Claude Fable 5 和 Claude Mythos 5 上的思考输出。GET /v1/compliance/activities)现已在 AWS 上的 Claude Platform 上可用。有关授权该端点的 ListComplianceActivities 操作,请参阅 AWS 上的 Claude Platform 的 IAM 操作。session.thread_* Webhook 事件现在包含 session_thread_id 字段,用于标识触发该事件的多智能体线程。LanguageModel 添加到 Apple 的 Foundation Models 框架中。在 iOS 27、macOS 27、visionOS 27 和 watchOS 27(Beta 版)上,通过与 Apple 设备端模型相同的 LanguageModelSession API 调用 Claude。claude-opus-4-1-20250805),计划于 2026 年 8 月 5 日在 Claude API 上停用。我们建议迁移到 Claude Opus 4.8。详情请参阅模型弃用。max_tokens 参数,用于限制顾问模型每次调用的输出上限,从而为不需要完整长度顾问响应的工作负载降低延迟和输出令牌成本。在顾问工具定义上设置 tools[].max_tokens;请参阅限制顾问输出。stop_reason: "refusal" 且 Claude 未生成任何输出时,您将不再被计费。有关检测和处理拒绝的信息,请参阅流式传输拒绝。AnthropicSelfHostedEnvironmentAccess 托管策略,请参阅 AWS 上的 Claude Platform 的 IAM 操作。messages 数组中的用户回合之后发送 role: "system" 消息(需遵守放置规则),从而在长时间运行的会话中指令发生变化时保留提示缓存命中。无需 Beta 标头。stop_details 字段现已公开记录在文档中;它返回一个 category(cyber、bio 或 null)和一个人类可读的 explanation,以便您的应用程序可以将不同类别的拒绝路由到正确的后续步骤。无需 Beta 标头。high。temperature、top_p 或 top_k 设置为非默认值会返回 400 错误,与 Claude Opus 4.7 相同。详情请参阅迁移指南。usage.output_tokens_details.thinking_tokens,报告计费输出令牌中有多少是扩展思考令牌。使用流式传输时,该明细仅出现在最终的 message_delta 事件上。无需 Beta 标头。agent_toolset 和 MCP 工具的超过 100K 字符(约 25K 令牌)的大型输出现在会自动溢出到沙箱中的文件。模型会收到带有文件路径的截断预览,并可从该路径读取完整内容。diagnostics.previous_message_id,API 会报告 cache_miss_reason,解释提示缓存前缀与上一回合的分歧位置。请在您的请求中包含 cache-diagnosis-2026-04-07 Beta 标头。speed: "fast" 并搭配 model: "claude-opus-4-7" 和 fast-mode-2026-02-01 测试版标头,即可以高级定价获得显著更快的输出令牌生成速度。定价、速率限制和访问权限与 Opus 4.6 快速模式相同;感兴趣的客户请加入候补名单。managed-agents-2026-04-01 测试版标头下进入公开测试阶段。mcp_oauth 凭据。请参阅使用保管库进行身份验证。dreaming-2026-04-21 测试版标头限制。申请访问权限以进行试用。context-1m-2025-08-07)。该测试版标头现在对这些模型不再生效,超过标准 20 万令牌上下文窗口的请求将返回错误。如需使用 100 万上下文窗口,请迁移至 Claude Sonnet 4.6 或 Claude Opus 4.6,这些模型已正式支持该功能,采用标准定价且无需测试版标头。managed-agents-2026-04-01 标头下进入公开测试阶段。请参阅使用智能体记忆获取完整的集成指南。claude-3-haiku-20240307)。对该模型的所有请求现在将返回错误。我们建议升级到 Claude Haiku 4.5。/anthropic/v1/messages 的 Messages API 端点,在 27 个 AWS 区域提供全球和区域端点。task-budgets-2026-03-13 测试版标头。xhigh effort 级别。xhigh 介于 high 和 max 之间,专为长时间运行的智能体和编码任务(超过 30 分钟)调优,令牌预算可达数百万。无需测试版标头。claude-sonnet-4-20250514)和 Claude Opus 4 模型(claude-opus-4-20250514),计划于 2026 年 6 月 15 日在 Claude API 上停用。我们建议分别迁移至 Claude Sonnet 4.6 和 Claude Opus 4.8。请参阅模型弃用了解更多信息。advisor-tool-2026-03-01。managed-agents-2026-04-01 测试版标头。请参阅 Claude Managed Agents 概述了解更多信息。ant CLI,这是 Claude API 的命令行客户端,可实现与 Claude API 更快的交互、与 Claude Code 的原生集成,以及在 YAML 文件中对 API 资源进行版本控制。请参阅 CLI 快速入门了解更多信息。/anthropic/v1/messages 的全新 Amazon Bedrock 中的 Claude 端点使用与第一方 Claude API 相同的请求格式,并在 AWS 托管的基础设施上运行,运营商零访问权限。在 us-east-1 可用;请联系您的 Anthropic 客户经理申请访问权限。请参阅 Amazon Bedrock 中的 Claude 了解更多信息。max_tokens 上限提高至 30 万。包含 output-300k-2026-03-24 测试版标头即可为长篇内容、结构化数据和大型代码生成任务生成更长的单轮输出。context-1m-2025-08-07 测试版标头将对这些模型不再生效,超过标准 20 万令牌上下文窗口的请求将返回错误。如需继续使用 100 万上下文窗口,请迁移至 Claude Sonnet 4.6 或 Claude Opus 4.6,这些模型以标准定价支持完整的 100 万令牌上下文窗口,无需测试版标头。GET /v1/models 和 GET /v1/models/{model_id} 现在返回 max_input_tokens、max_tokens 和 capabilities 对象。查询 API 以了解每个模型支持的功能。display 字段,允许您从响应中省略思考内容以实现更快的流式传输。设置 thinking.display: "omitted" 即可接收 thinking 字段为空但保留 signature 的思考块,以保持多轮连续性。计费不变。请参阅控制思考显示了解更多信息。cache_control 字段,系统会自动缓存最后一个可缓存的块,并随着对话增长向前移动缓存点。无需手动管理断点。可与现有的块级缓存控制配合使用以进行细粒度优化。在 Claude API 和 Microsoft Foundry(预览版)上可用。请参阅提示缓存了解更多信息。claude-3-7-sonnet-20250219)和 Claude Haiku 3.5 模型(claude-3-5-haiku-20241022)。对 Claude Sonnet 3.7 的所有请求现在将返回错误。在 Claude API 上对 Claude Haiku 3.5 的请求现在将返回错误;该模型在 Amazon Bedrock 和 Google Cloud 上仍然可用。我们建议分别升级到 Claude Sonnet 4.6 和 Claude Haiku 4.5。研究人员可通过外部研究人员访问计划申请持续访问权限。claude-3-haiku-20240307),计划于 2026 年 4 月 20 日停用。我们建议迁移至 Claude Haiku 4.5。请参阅模型弃用了解更多信息。thinking: {type: "adaptive"});手动思考(带 budget_tokens 的 type: "enabled")已弃用。Opus 4.6 不支持预填充助手消息。请参阅 Claude 4.6 新特性了解更多信息。budget_tokens 用于控制思考深度。inference_geo 参数指定模型推理的运行位置。对于 2026 年 2 月 1 日之后发布的模型,仅限美国的推理以 1.1 倍定价提供。output_format 参数已移至 output_config.format。现有测试版用户可在过渡期内继续使用测试版标头。结构化输出在 Amazon Bedrock 和 Microsoft Foundry 上仍处于公开测试阶段。console.anthropic.com 现在重定向至 platform.claude.com。作为我们 Claude 品牌整合的一部分,Claude Console 已迁移至新地址。现有书签和链接将通过自动重定向继续有效。更多详情,请参阅 2025 年 9 月 16 日公告。claude-3-opus-20240229)。对该模型的所有请求现在将返回错误。我们建议升级到 Claude Opus 4.5,该模型以三分之一的成本提供显著提升的智能。研究人员可通过外部研究人员访问计划申请在 API 上持续访问 Claude Opus 3。tool_runner 时通过摘要自动管理对话上下文。structured-outputs-2025-11-13。clear_thinking_20251015)扩展了上下文编辑功能,实现思考块的自动管理。请参阅上下文编辑了解更多信息。skills-2025-10-02 测试版),这是扩展 Claude 能力的新方式。技能是由指令、脚本和资源组成的有序文件夹,Claude 可动态加载以执行专业任务。初始版本包括:
/v1/skills 端点)上传您自己的技能,以打包领域专业知识和组织工作流model_context_window_exceeded,允许您在不计算输入大小的情况下请求最大可能的令牌数。请参阅处理停止原因了解更多信息。request-id 标头并存。请参阅错误了解更多信息。claude-3-5-sonnet-20240620 和 claude-3-5-sonnet-20241022)。这些模型将于 2025 年 10 月 28 日停用。我们建议迁移至 Claude Sonnet 4.5(claude-sonnet-4-5-20250929)以获得更好的性能和能力。请参阅模型弃用了解更多信息。rate_limit_error)错误。此前,在类似场景下会出现 529(overloaded_error)错误。search-results-2025-06-09。请参阅搜索结果了解更多信息。*Opus 4.1 不允许同时指定 temperature 和 top_p 参数。请仅使用其中一个。
text_editor_20250728,这是一个更新的文本编辑器工具,修复了之前版本的一些问题,并新增了可选的 max_characters 参数,允许您在查看大文件时控制截断长度。search-results-2025-06-09。fine-grained-tool-streaming-2025-05-14。thinking 块输出的 signature 字段中返回。interleaved-thinking-2025-05-14。top_p 核采样参数的默认值从 0.999 更改为 0.99。要恢复此更改,请将 top_p 设置为 0.999。
此外,当启用扩展思考时,您现在可以将 top_p 设置为 0.95 到 1 之间的值。tool_result 和 document.source 的父级 content 块中指定缓存控制。为了向后兼容,如果在 tool_result.content 或 document.source.content 的最后一个块上检测到缓存控制,它将自动应用于父级块。在 tool_result.content 和 document.source.content 内的任何其他块上设置缓存控制将导致验证错误。tool_choice 参数中添加了对 none 选项的支持,该选项可防止 Claude 调用任何工具。此外,在包含 tool_use 和 tool_result 块时,您不再需要提供任何 tools。bash_20250124:功能与之前版本相同,但独立于计算机使用。不需要 beta 标头。text_editor_20250124:功能与之前版本相同,但独立于计算机使用。不需要 beta 标头。computer_20250124:更新的计算机使用工具,包含新的命令选项,包括 "hold_key"、"left_mouse_down"、"left_mouse_up"、"scroll"、"triple_click" 和 "wait"。此工具需要 "computer-use-2025-01-24" anthropic-beta 标头。
请在使用 Claude 进行工具使用中了解更多信息。anthropic-organization-id 响应标头。此标头提供与请求中使用的 API 密钥关联的组织 ID。以下功能现已在 Claude API 中正式发布:
我们还发布了新的官方 SDK:
user/assistant 轮次顺序的限制。连续的 user/assistant 消息将被合并为单条消息而不是报错,并且我们不再要求第一条输入消息必须是 user 消息。tool_choice 字段中设置 disable_parallel_tool_use: true,以确保 Claude 最多使用一个工具。请在并行工具使用中了解更多信息。dangerouslyAllowBrowser: true 以启用此功能。anthropic-beta: max-tokens-3-5-sonnet-2024-07-15 标头,从 Claude Sonnet 3.5 生成长度多达 8,192 个令牌的输出。Was this page helpful?