Claude Platform 发布说明
Claude Platform 的更新,包括 Claude API、客户端 SDK 和 Claude Console。
Claude Platform 发布说明列出了 Claude API、客户端 SDK 和 Claude Console 的变更,按时间从新到旧排列。
2026 年 10 月 8 日
- Compliance API 的聊天端点现在还会返回来自统一 Claude 体验的聊天,该功能面向 Claude Enterprise 组织提供 beta 版,使用您现有的 Compliance Access Key 即可。请参阅检索和删除聊天、文件及项目。
2026 年 10 月 7 日
- 我们已将 Claude Sonnet 5.5 上 "prompt cache"(提示缓存)读取的价格从每百万令牌 $0.20 美元降至 $0.10 美元:即基础输入价格的 0.05 倍,而非 0.1 倍。缓存写入及所有其他价格保持不变。请参阅提示缓存定价。
2026 年 10 月 7 日
- 我们推出了 Claude Haiku 5.5(
claude-haiku-5-5),这是我们针对高吞吐量和延迟敏感型工作调优的能力最强的模型。它具有 1M 令牌 context window(上下文窗口)、128k 最大输出令牌,以及支持 effort 参数的 adaptive thinking(自适应思考)。它可在 Claude API、Claude in Amazon Bedrock、Claude Platform on AWS、Claude on Google Cloud 和 Claude in Microsoft Foundry 上使用。请参阅 Claude Haiku 5.5 的新功能。 - 为 Claude Haiku 4.5 编写的代码在 Claude Haiku 5.5 上可能会出错。手动 "extended thinking"(扩展思考)(
budget_tokens)会返回 400 错误,并且自适应思考默认开启,因此响应可能以thinking块开头。相同的文本也会计为更多令牌。请参阅迁移指南。有关特定于模型的提示模式,请参阅为 Claude Haiku 5.5 编写提示。
2026 年 10 月 7 日
- Python 和 TypeScript SDK 现在包含用于浏览器使用工具和计算机使用工具的类(beta 版)。您只需继承其中一个类,并针对您自己的浏览器或桌面自动化为每个工具编写一个方法。SDK 会运行工具循环、您为浏览器设置的 URL 和文件策略,以及您的审批回调。请参阅使用 SDK 工具集进行浏览器和计算机使用。
2026 年 10 月 7 日
- Claude Max 和 Team 计划现在包含每月 API 额度。要了解如何领取,请参阅 Max 和 Team 计划的 API 额度。
2026 年 10 月 7 日
- 在 Claude Managed Agents 中,使用
limited网络的云环境现在也会将其allowed_hosts应用于web_search和web_fetch工具。对allowed_hosts不匹配的主机上的 URL 发起的web_fetch调用会向智能体返回url_not_allowed错误结果。web_search会省略来自此类主机的结果。当allowed_hosts未列出任何主机时,这两个工具都不会返回页面或搜索结果。allow_package_managers和allow_mcp_servers不会为这些工具添加任何主机。要让这些工具访问某个主机,请将其添加到allowed_hosts,这也会向沙箱开放该主机。unrestricted网络和自托管环境不会限制这些工具。请参阅环境网络。 - 使用
limited网络时,如果已启用的 Web 工具的allowed_domains中有不在allowed_hosts范围内的条目,创建会话将失败并返回 400 错误。添加此类条目的会话更新也是如此。allowed_hosts条目只匹配一个确切的主机,除非它以*.开头,因此docs.example.com不在["example.com"]范围内。要修复该错误,请将该主机添加到allowed_hosts,或从allowed_domains中删除该条目。请参阅限制网页搜索和网页抓取的域名。
2026 年 10 月 6 日
- 我们在 Models API 中添加了
capabilities.server_tools。GET /v1/models和GET /v1/models/{model_id}现在会报告每个模型是否接受 Web 搜索和代码执行工具。要检查模型是否接受代码执行工具,请读取capabilities.server_tools.code_execution。顶层的capabilities.code_execution报告代码是否可以调用您请求中的其他工具。请参阅使用 Models API。
2026 年 10 月 5 日
- 我们在 Models API 中添加了
capabilities.thinking.types.disabled。GET /v1/models和GET /v1/models/{model_id}现在会报告每个模型是否接受用于关闭思考的thinking: {type: "disabled"}。请参阅使用 Models API。
2026 年 10 月 1 日
- 我们在 Models API 中添加了
line字段。GET /v1/models和GET /v1/models/{model_id}现在会返回每个模型所属的模型系列。例如,Claude Opus 4.5 和 Claude Opus 4.6 都报告为opus。使用line可以对模型进行分组,而无需解析其 ID。对于不属于任何系列的模型,line为null。请参阅使用 Models API。
2026 年 9 月 30 日
- 在 Python SDK 1.10.0、TypeScript SDK 0.130.0、C# SDK 12.52.0、Go SDK 1.77.0、Java SDK 2.67.0、PHP SDK 0.53.0、Ruby SDK 1.75.0 以及
antCLI 1.37.0 版本中,用于组织信息、成员、邀请、工作区、API 密钥、速率限制、服务账户、工作负载身份联合、客户管理的加密密钥和合规设置的 Admin API 方法已结束 beta:请在client.organization和ant organization下调用它们。这些版本也保留了client.beta.organization和ant beta:organization。 - 我们宣布弃用 Claude Sonnet 4.5 模型(
claude-sonnet-4-5-20250929),计划于 2026 年 11 月 30 日在 Claude API 上停用。我们建议迁移到 Claude Sonnet 5.5。更多信息请参阅模型弃用。
2026 年 9 月 28 日
- 我们推出了 Claude Sonnet 5.5(
claude-sonnet-5-5)。它可在 Claude API、Claude in Amazon Bedrock、Claude Platform on AWS、Claude on Google Cloud 和 Claude in Microsoft Foundry 上使用。有关其上下文窗口、输出限制和价格,请参阅 Claude Sonnet 5.5 模型页面。 - 为 Claude Sonnet 5 编写的代码在 Claude Sonnet 5.5 上可能会以五种方式出错。要关闭预先思考,请在
high或更低的 effort 下发送thinking: {"type": "between_tools"},而不是"disabled"。强制 "tool use"(工具使用)(tool_choice类型any和tool)会返回 400 错误。思考块与模型和对话绑定。在 Claude API 和 Google Cloud 上,不再接受较早的computer_20251124计算机使用工具。advisor 工具拒绝将 Claude Opus 4.8、Claude Opus 4.7 和 Claude Sonnet 5 作为顾问。有关每项变更,请参阅 Claude Sonnet 5.5 的新变化;有关变更前后的请求示例,请参阅迁移指南。有关特定于模型的提示模式,请参阅为 Claude Sonnet 5.5 编写提示。 - Claude Sonnet 5.5 生成的思考块仅在生成它们的账户或与其关联的账户中有效。当其他账户发送这些块之一时,API 会在模型看到之前丢弃该块,并且请求会成功。来自较早模型的块不受影响。请参阅保留的思考。
2026 年 9 月 24 日
- 对于
stop_details.category为"bio"、"frontier_llm"或"reasoning_extraction"且在任何输出之前发生的"refusals"(拒绝),我们将恢复计费,这些类别是我们测得误报量较低的类别。流式传输中途的拒绝此前已经计费。根据此变更计费的拒绝与任何其他请求一样收费,按运行该请求的模型的费率计算。其他类别中在任何输出之前发生的拒绝仍不计费,回退额度保持不变。此变更适用于所有平台。请参阅拒绝如何计费。 - Compliance API 本地会话端点已针对 Excel、PowerPoint、Word 和 Outlook 中的 Claude for Microsoft 365 会话(
product_surface值以office_agents开头)结束 beta 阶段。请参阅用户机器上的会话。 - Compliance API 的 Activity Feed 不再返回文件名、项目文档名称或 artifact 标题。文件、项目文档和 artifact 活动上的
filename和title字段现在始终为空或被省略,包括在此变更之前记录的活动。要通过活动上的 ID 查找名称或标题,请使用具有read:compliance_user_data范围的 Compliance Access Key。请参阅了解 Activity 对象。
2026 年 9 月 23 日
- "Cache diagnostics"(缓存诊断)已在 Claude API 上结束 beta 阶段,不再需要
cache-diagnosis-2026-04-07beta 标头。在 Messages 请求中包含diagnostics对象即可选择启用;仍发送该标头的请求照常工作。来自POST /v1/messages的响应现在始终包含diagnostics字段,当请求未包含diagnostics对象时,该字段为null。
2026 年 9 月 22 日
- 我们推出了 Claude Opus 5.5(
claude-opus-5-5),这是一款面向长时间运行的智能体编码和知识工作的模型。它默认具有 1M 令牌上下文窗口、128k 最大输出令牌,以及始终开启的"adaptive thinking"(自适应思考),价格为每 MTok $4 / $20 美元(Claude Opus 5 为 $5 / $25)。Claude Opus 5.5 可在 Claude API、Amazon Bedrock 中的 Claude、AWS 上的 Claude Platform、Google Cloud 上的 Claude 和 Microsoft Foundry 中的 Claude 上使用。有关功能、API 变更和迁移指南,请参阅 Claude Opus 5.5 的新功能。 - 在 Claude Opus 5.5 上,无法禁用思考:
thinking: {"type": "disabled"}和thinking: {"type": "enabled", ...}会返回 400 错误。请省略thinking字段,并使用 effort 参数控制思考深度。与 Claude Fable 5.1 一样,tool_choice类型any和tool也会返回 400 错误;请将auto与严格工具使用结合使用。在 Claude API 和 Google Cloud 上,此模型的计算机使用需要computer_toolset_20260801工具集,较早的computer_20251124工具会返回 400 错误;在 Amazon Bedrock 上,computer_20251124仍可继续使用。请参阅迁移指南。 - "Fast mode"(快速模式)(研究预览版)已在 Claude API 上可用于 Claude Opus 5.5。
- 现在可以在对话中途的系统消息中定义工具,该功能在 Claude API 上处于 beta 阶段,需使用
inline-tools-2026-09-15beta 标头。tool_addition块可以携带工具的完整定义(tool: {"type": "tool_definition", "definition": {...}}),因此您可以添加工具、更改其 schema,或将服务器工具迁移到较新版本,而无需编辑tools,也不会使"prompt cache"(提示缓存)失效。同一标头也涵盖按引用添加和移除工具。如果同时使用 MCP 连接器的mcp-client-2026-09-15beta 标头,定义可以是 MCP 工具集,并且响应会在mcp_tool_listing块中记录每个服务器获取到的工具列表,当您将该块发回时,它会固定该列表。
2026 年 9 月 18 日
- 对于缓存诊断,发送
cache-diagnosis-2026-04-07beta 标头的请求所对应的响应现在始终包含diagnostics字段。当请求未包含diagnostics对象时,该字段为null。此前,在这种情况下该字段会被省略。 - Compliance API 本地会话端点现在还会返回 Claude in Chrome 会话(
product_surface值为claude_in_chrome)的对话记录,该功能面向 Claude Enterprise 组织处于 beta 阶段,使用您现有的 Compliance Access Key 和read:compliance_user_data范围。请参阅用户机器上的会话。
2026 年 9 月 14 日
- Messages API 现在可以在 Claude API 上按需压缩对话,该功能处于 beta 阶段,需使用
compact-2026-09-04beta 标头。发送顶层compaction参数,API 会返回一个已签名的compaction块,用于总结您发送的消息。在后续请求中,请先发送该块,以代替这些消息。您可以选择何时压缩,请求可以在后台运行,并且您可以在摘要之后逐字保留最近的轮次。在支持保留思考的模型上,这些保留轮次中的思考可以保持有效。 - 使用
thinking-binding-controls-2026-08-01beta 标头时,input_transformations响应字段新增第二种条目类型thinking_mismatch_allowed。它指明在 API 不强制执行前缀检查的请求中未通过该检查的思考块:例如,在 Claude Fable 5.1 上,来自 2026 年 8 月 31 日之前创建的账户且未设置prefix_mismatch_behavior的请求。该块仍会原样到达模型。在选择启用强制执行之前,请记录这些条目,以便在生产流量中发现对历史记录的编辑。请参阅设置不匹配行为并读取input_transformations。
2026 年 9 月 10 日
- Claude Managed Agents 权限策略现在包含
auto:服务器会评估每个智能体或 MCP 工具调用,并运行它、拒绝它或暂停以等待您的批准。agent.tool_use和agent.mcp_tool_use事件会在evaluated_permission旁边的evaluation字段中报告每个调用的评估方式。请参阅使用auto让服务器评估每个调用。 antCLI 1.32.0 版本新增了ant beta:sessions connect,可将您的终端连接到 Claude Managed Agents 会话。您可以实时跟踪会话、发送消息,以及允许或拒绝正在等待批准的工具调用。传入--web可在本地提供 Claude Console 的会话查看器,并改为在其中打开会话。请参阅从终端连接到 Managed Agents 会话。
2026 年 9 月 9 日
- 对于缓存诊断,API 现在仅在请求包含
diagnostics对象时才存储该请求的指纹。仅发送cache-diagnosis-2026-04-07beta 标头的请求仍会被接受,但不会存储指纹。之后将previous_message_id指向该请求的轮次会报告previous_message_not_found。请在每个轮次中都包含diagnostics,并在第一个轮次中使用"previous_message_id": null。
2026 年 9 月 3 日
antCLI 1.30.0 版本新增了ant apply,可根据您仓库中的文件创建和更新智能体、环境、技能、记忆存储和部署。在文件中描述每个资源,运行ant apply,然后批准它打印的计划。提交它写入的claude-lock.json锁文件,以便之后在您的机器上或 CI 中运行时更新相同的资源,而不是创建新资源。请参阅使用 ant apply 以代码形式管理资源。- 按消息更改 effort 的功能(beta)现在也可在 Google Cloud 上用于 Claude Fable 5.1、Claude Mythos 5.1 和 Claude Opus 5,使用相同的
mid-conversation-output-config-2026-07-01beta 标头。
2026 年 9 月 1 日
- 我们推出了 Claude Fable 5.1(
claude-fable-5-1),它是 Claude Fable 5 的后继模型,适用于长时间运行的智能体编码、知识工作和研究;同时还为 Project Glasswing 参与者推出了 Claude Mythos 5.1(claude-mythos-5-1)。两款模型默认均支持 1M 令牌上下文窗口、128k 最大输出令牌以及始终开启的自适应思考,价格为每 MTok $10 / $50 美元,与 Claude Fable 5 相同,缓存读取价格降至每 MTok $0.25。Claude Fable 5.1 可在 Claude API、Amazon Bedrock 中的 Claude、AWS 上的 Claude Platform、Google Cloud 上的 Claude 和 Microsoft Foundry 中的 Claude 上使用。有关功能、API 变更和迁移指南,请参阅 Claude Fable 5.1 的新功能。 - Claude Fable 5.1 和 Claude Mythos 5.1 上的提示缓存读取费用为每百万令牌 $0.25 美元:为基础输入价格的 0.025 倍,而其他模型为 0.1 倍。缓存写入价格保持不变。请参阅提示缓存定价。
- 在 Claude Fable 5.1 和 Claude Mythos 5.1 上,不支持
tool_choice类型any和tool,使用时会返回 400 错误。auto和none保持不变。要保证工具输入符合 schema,请使用严格工具使用或"structured outputs"(结构化输出)。 - Claude Fable 5.1 和 Claude Mythos 5.1 生成的思考块仅对生成它们的模型或更新的模型保留:较早的模型无法读取它们,并且 API 会丢弃重放给较早模型的此类块。Claude Fable 5.1 接受来自 Claude Opus 5、Claude Fable 5、Claude Mythos 5 及更早 Claude 模型的思考块。在 Claude Fable 5.1 上,API 还会检查块之前的内容是否未发生变化:对于在 2026 年 8 月 31 日或之后创建的新账户,在
system提示、tools或较早的消息发生变化后重放此类块会返回 400 错误。使用thinking-binding-controls-2026-08-01beta 标头时,被丢弃的块会在input_transformations响应字段中报告,并且可以通过thinking.block_binding.prefix_mismatch_behavior选择拒绝还是丢弃历史记录已更改的块。请参阅保留的思考。 - 按消息更改 effort 的功能在 Claude API 上针对 Claude Fable 5.1、Claude Mythos 5.1 和 Claude Opus 5 处于 beta 阶段。在
messages中添加一条带有output_config.effort的role: "system"消息,即可更改后续轮次的 effort,同时保留提示缓存。请在请求中包含mid-conversation-output-config-2026-07-01beta 标头。请参阅按消息更改 effort。 - 轮次范围的系统消息处于 beta 阶段(
mid-conversation-system-clear-at-2026-08-21标头)。在对话中途的role: "system"消息上设置clear_at: "next_user_message",它将仅在当前轮次中呈现,之后保留在历史记录中且不消耗令牌。每轮提醒不会累积,也不会使提示缓存或后续思考块失效。 thinking.display接受第三个值"updates",该功能处于 beta 阶段(thinking-display-updates-2026-08-18标头)。推理内容返回时thinking字段为空,与"omitted"相同,而 Claude Fable 5.1、Claude Mythos 5.1 和 Claude Fable 5 在工具调用之间编写的简短进度更新会以文本形式返回,每次工具调用之前最多一个thinking块。请参阅工具调用之间的进度更新。- Claude Fable 5.1 和 Claude Mythos 5.1 生成的文本带有 Anthropic 的文本水印;当您在 Claude API 上通过 Files API 检索 Claude 通过代码执行工具生成的受支持图像、视频和音频文件时,这些文件带有 C2PA 内容凭证(Content Credentials)。标记无需对您的请求或响应处理进行任何更改。
- 与 Claude Fable 5 一样,这两款模型都需要 30 天数据保留,并且除非获得 Anthropic 明确授权,否则无法在"zero data retention"(零数据保留)下使用。请参阅特定于模型的数据保留要求。
- Admin API 的 Claude Enterprise 端点(用户管理和支出限制)、Claude Enterprise Analytics API 以及 Compliance API 的指南现在会显示
anthropic-version标头;与 Claude API 的其余部分一样,请在向这些端点发出的每个请求中发送该标头。请参阅 API 版本。
2026 年 8 月 27 日
- 在 Python SDK 1.2.0、TypeScript SDK 0.122.0、Go SDK 1.68.0、Java SDK 2.59.0、Ruby SDK 1.67.0 和 C# SDK 12.44.0 中,
client.beta.files和client.beta.skills不再发送files-api-2025-04-14和skills-2025-10-02beta 标头,并返回与client.files和client.skills相同的结构。随着此变更,client.beta.skills.delete()会删除 Skill 及其所有版本,并且 beta Messages 类型BetaSkill(容器 Skill 引用)已重命名为BetaContainerSkill。仍发送 beta 标头的请求将继续收到 beta 结构。请参阅从files-api-2025-04-14迁移和从skills-2025-10-02迁移。
- 您现在可以在 Claude Console 中创建个人密钥和服务账户密钥。它们以您或服务账户的身份运行,具有相同的权限,并在关联账户从组织中移除时停止工作。这使组织管理员能够更轻松地跟踪每个账户的使用情况,并确保密钥的使用是合法的。这些 API 密钥可以限定于特定工作区,也可以在管理端点上以及该账户有权访问的任何工作区中使用。工作区 API 密钥作为旧版选项仍受支持。有关更多信息,请参阅 API 密钥。
2026 年 8 月 26 日
- Compliance API 的会话端点已针对 Cowork 和 Claude Code 会话结束 beta。请参阅检索会话记录。
- Compliance API 的本地会话端点现在还会返回 Claude Science 会话(
product_surface值为claude_science)以及 Excel、PowerPoint、Word 和 Outlook 中的 Claude for Microsoft 365 会话(以office_agents开头的product_surface值)的记录,该功能面向 Claude Enterprise 组织提供 beta 版,使用您现有的 Compliance Access Key 和read:compliance_user_data范围即可。请参阅用户机器上的会话。 - Admin API 现在可在
antCLI 以及 Python、TypeScript、C#、Go、Java、PHP 和 Ruby SDK 中通过client.beta.organization使用。它们涵盖组织信息、成员、邀请、工作区和工作区成员、API 密钥、速率限制、服务账户、工作负载身份联合颁发者和规则,以及客户管理的加密密钥。使用量和成本报告以及 Claude Enterprise 用户管理和分析端点仍仅支持 curl。CLI 和 SDK 从ANTHROPIC_API_KEY读取 Admin API 密钥,或从ANTHROPIC_AUTH_TOKEN读取org:adminOAuth 令牌。
2026 年 8 月 20 日
- 我们发布了 Python SDK v1.0。SDK 的 HTTP 层从
httpx迁移到 httpx2,这是一个持续维护且与 API 兼容的分支:请使用httpx2构建自定义http_client、Timeout和传输对象(DefaultHttpxClient辅助工具保持不变);如果您依赖会修补httpx的追踪或模拟库,请在启动时调用httpx2.alias_httpx()。v1.0 需要 Python 3.10 或更高版本,并移除了长期弃用的接口,包括旧版 Text Completions API、Messages 方法上的temperature、top_p和top_k参数,以及工具运行器的客户端compaction_control。在异步客户端上,.with_raw_response结果现在需要await response.parse(),并且当未配置 AWS 区域时,AnthropicBedrock现在会引发错误,而不是默认使用us-east-1。有关每项变更及其前后代码片段,请参阅 v1 迁移指南。 - 计算机使用和"browser use"(浏览器使用)工具集(
computer_toolset_20260801和browser_toolset_20260801)现已在 Google Cloud 上可用于 Claude Fable 5、Claude Mythos 5、Claude Opus 5、Claude Sonnet 5 和 Claude Opus 4.8。请求使用与 Claude API 上相同的tools条目。
2026 年 8 月 19 日
- 计算机使用工具已在 Claude API 上结束 beta 阶段,以
computer_toolset_20260801工具集的形式提供:无需 beta 标头,支持批量操作(在一个轮次中执行多个操作),默认启用zoom,并可通过configs对每个成员进行配置。早期的 beta 版本仍然可用。升级现有集成会改变请求结构和工具处理方式;请参阅从computer_20251124迁移。 - 我们推出了浏览器使用工具(
browser_toolset_20260801),这是一个客户端工具集,用于驱动由您的应用程序托管的浏览器。它在浏览器视口内工作,而不是在整个桌面上工作,能够读取页面本身(其无障碍树、元素、表单和标签页),并在截图加点击控制的基础上,增加了元素引用、表单输入、标签页管理、下载报告以及可选启用的文件上传功能。 - 这两个工具集均可在 Claude API 上用于 Claude Fable 5、Claude Mythos 5、Claude Opus 5、Claude Sonnet 5 和 Claude Opus 4.8。
- Files API 已在 Claude API 上结束 beta 阶段。对
/v1/files端点的请求,以及引用已上传文件的 Messages API 请求,不再需要files-api-2025-04-14beta 标头。不带该标头发送的请求使用当前的响应格式:文件过期(上传文件时设置expires_in_seconds;文件对象会报告expires_at),以及在列出文件时使用page和next_page分页和ids[]筛选器。仍然发送 beta 标头的/v1/files请求可继续正常工作,并返回之前的响应格式。 要让现有集成不再使用该标头,请参阅从files-api-2025-04-14迁移。 - Agent Skills 和 Skills API(
/v1/skills)已在 Claude API 上结束 beta 阶段。请求不再需要skills-2025-10-02beta 标头,包括通过container参数加载 Skills 的 Messages API 请求。仍然发送该标头的请求可继续正常工作,不受影响。请参阅通过 API 使用 Agent Skills。 要让现有集成不再使用该标头,请参阅从skills-2025-10-02迁移。 - 面向 Claude Enterprise(claude.ai)组织的 Admin API 用户管理端点(成员、邀请、群组和自定义角色)已结束 beta 阶段。群组和自定义角色请求不再需要
anthropic-beta: ce-user-management-2026-07-13标头;仍然发送该标头的请求会照常被接受。请参阅用户管理。 - 您现在可以限制 Claude Managed Agents 智能体的
web_search和web_fetch工具可以访问哪些网站。在agent_toolset_20260401的configs数组中该工具的条目上设置allowed_domains或blocked_domains;web_fetch还接受max_content_tokens,web_search接受user_location。每个configs条目通过其name标识,并通过可选的type指定类型,仅传递name、enabled和permission_policy的请求可继续正常工作;在类型化 SDK 中,configs条目会成为按工具划分的类型。请参阅限制网页搜索和网页抓取的域名。 - 在自托管沙箱中运行的 Claude Managed Agents 会话现在可以挂载记忆存储。Python、TypeScript 和 Go SDK worker 会将每个挂载的存储下载到沙箱中其
mount_path所在位置,并将智能体所做的更改同步回存储。请参阅自托管沙箱中的记忆存储。 - Claude Console 中的会话查看器已重新设计,新增了时间线缩略图、按模型请求分组的对话记录,以及一个 Inspector 面板,用于查看会话详情和成本、原始事件、按工具统计的数据、已挂载的资源以及按线程划分的活动。请参阅 Console 可观测性。
2026 年 8 月 18 日
- Workbench 现在在 Claude Console 中更名为 playground。Playground 支持所有 Messages API 参数,并包含演示代码执行和网络搜索等 API 功能的模板。它会显示每次运行的完整 SDK 请求和 API 响应,帮助您理解 API 并基于它进行构建。有关更多信息,请参阅 Claude 帮助中心,或在 platform.claude.com/playground 上试用。
2026 年 8 月 11 日
- Compliance API 现在会返回在您用户的机器上运行的 Cowork 和 Claude Code 会话的对话记录,该功能面向 Claude Enterprise 组织处于 beta 阶段。
GET /v1/compliance/apps/sessions/local列出整个组织中的会话,GET /v1/compliance/apps/sessions/local/{session_id}检索单个会话的元数据,GET /v1/compliance/apps/sessions/local/{session_id}/messages返回其对话记录,所有这些都使用您现有的 Compliance Access Key 和read:compliance_user_data范围。请参阅用户机器上的会话。 - 我们已向 Claude API 添加了
anthropic-workspace-id响应标头。它包含请求的 API 密钥或访问令牌所解析到的工作区的 ID(带wrkspc_前缀),包括您组织的默认工作区(Default Workspace)。请参阅识别 API 响应背后的工作区。
2026 年 8 月 10 日
- Claude Sonnet 5 的推出价格(每 MTok $2 / $10)现已成为标准价格:此前计划于 2026 年 9 月 1 日上调至每 MTok $3 / $15 的调整将不会实施。请参阅定价。
2026 年 8 月 7 日
- 您现在可以为 Claude Managed Agents 会话设置预算:这是会话支出的硬性上限,按公开标价计算。达到预算的会话会以
budget_reached停止原因暂停,而不是发起新的模型请求;更改或移除预算会使其恢复。部署接受相同的预算,并将其应用于它们启动的每个会话。请参阅会话预算。 - 您现在可以为 Claude Managed Agents 会话配置顾问(advisor):一个能力至少与智能体自身模型相当的模型,会话的主线程可以在轮次中途向其咨询以获取战略指导。在智能体的多智能体名单中将其配置为
{"type": "advisor"}条目,并指定要咨询的model。请参阅为会话配置顾问。 - 您现在可以控制 Claude Managed Agents 智能体的模型推理在何处运行。在创建智能体时在
model对象中设置inference_geo,或为单个会话覆盖该设置。有关可用的地理区域和定价,请参阅数据驻留。 - Claude Managed Agents 会话现在可以从 GitHub 仓库加载技能。当会话挂载仓库时,其根目录
.claude/skills中的所有技能都会在会话开始时被自动发现,并在该会话中供智能体使用。
2026 年 8 月 5 日
- Inference hooks(推理钩子)现已面向 Claude Enterprise 组织推出 beta 版。将 Claude 指向您组织的 AI 安全服务器后,claude.ai、Cowork 和 Claude Code 中每个受管控的提示都会被暂缓,等待服务器给出允许或拒绝的裁决后再进行推理。请求经过签名,故障处理方式可配置,并且每次拒绝都会记录在合规 Activity Feed 中。请参阅推理钩子。
- 我们已停用 Claude Opus 4.1 模型(
claude-opus-4-1-20250805)。现在,Claude API 上对该模型的所有请求都将返回错误。我们建议升级到 Claude Opus 5。研究人员可以通过外部研究人员访问计划申请持续访问。
2026 年 8 月 3 日
- Compliance API 现在会返回在 claude.ai 网页版或移动端上启动的 Cowork 会话的对话记录,该功能面向 Claude Enterprise 组织处于 beta 阶段。
GET /v1/compliance/apps/sessions/remote列出会话,GET /v1/compliance/apps/sessions/remote/{session_id}/messages返回单个会话的对话记录,使用您现有的具有read:compliance_user_data范围的 Compliance Access Key。请参阅云端会话。
2026 年 8 月 1 日
2026 年 7 月 24 日
- 我们推出了 Claude Opus 5(
claude-opus-5),相比 Claude Opus 4.8 实现了跨越式提升。Claude Opus 5 支持 1M 令牌的 context window(上下文窗口)(既是默认值也是最大值)和 128k 最大输出令牌,并默认开启 thinking(思考)。其价格为每 MTok $5 / $25 美元,与 Claude Opus 4.8 定价相同。它可在 Claude API、Claude in Amazon Bedrock、Claude Platform on AWS、Claude on Google Cloud 和 Claude in Microsoft Foundry 上使用。有关新功能、行为变更和迁移指南,请参阅 Claude Opus 5 的新功能;有关完整规格,请参阅模型概览。 - 在 Claude Opus 5 上,仅当 effort 为
high或更低时才允许禁用思考:在 effort 为xhigh或max时使用thinking: {"type": "disabled"}会返回 400 错误。这是相对于 Claude Opus 4.8 的 breaking change(破坏性变更)。请参阅 Claude Opus 5 的新功能。 - Effort(努力程度)是引导 Claude Opus 5 的主要控制手段:该模型支持完整的级别阶梯(
low、medium、high、xhigh、max),其中max用于对能力要求极高的工作。 - "Mid-conversation tool changes"(对话中途工具变更)现已在 Claude Fable 5、Claude Mythos 5、Claude Opus 4.8 和 Claude Opus 5 上进入 beta 阶段:您可以在对话轮次之间添加或移除工具,同时保留提示缓存。请在请求中包含
mid-conversation-tool-changes-2026-07-01beta header(beta 标头)。 fallbacks参数现在支持"default"模式,该模式会按拒绝类别应用 Anthropic 推荐的回退模型。"Server-side fallback"(服务器端回退)目前处于 beta 阶段,"default"模式需要server-side-fallback-2026-07-01beta 标头。请参阅拒绝与回退。- 我们已移除 Claude Opus 4.7 的 fast mode(快速模式)。现在,使用
speed: "fast"向claude-opus-4-7发出的请求会返回错误。与 Claude Opus 4.6 不同,这些请求不会回退到标准速度。Claude Opus 4.7 本身仍可以标准速度使用。如需继续使用快速模式,请迁移到 Claude Opus 5 或 Claude Opus 4.8。在快速模式中了解更多信息。
2026 年 7 月 22 日
- 您现在可以在 Claude Managed Agents 智能体的模型配置中设置
effort级别。在创建智能体时,请在model对象中传入effort。有关各级别的作用,请参阅努力程度级别。 - Claude Managed Agents 的 webhooks 现在涵盖环境和 memory store(记忆存储)的生命周期,包括四种
environment.*事件类型和三种memory_store.*事件类型。您无需轮询即可响应环境和记忆存储的生命周期变化。请参阅订阅 webhooks 中的 Environment events(环境事件)和 Memory store events(记忆存储事件)选项卡。 - 创建 Claude Managed Agents 会话时,您现在可以使用初始事件为会话预置内容。请在
POST /v1/sessions上传入initial_events,其中最多可包含 50 个user.message和user.define_outcome事件。非空列表会在同一调用中启动智能体循环,因此您无需再单独发送 send-events 请求来开始工作。 - 在更新 Claude Managed Agents 智能体时,
version字段现在是可选的。提供该字段可实现乐观并发控制(不匹配时返回 409 错误),省略该字段则会无条件应用更新。请参阅更新语义。 - Claude Managed Agents 会话线程事件流现在支持 event deltas(事件增量)。
GET /v1/sessions/{session_id}/threads/{thread_id}/stream接受与会话级流相同的event_deltas[]查询参数,因此您可以在模型生成子智能体文本的同时预览该文本。每个连接只预览其正在读取的线程。请参阅预览会话线程事件。
2026 年 7 月 17 日
- Claude Console 中的旧版 Workbench(platform.claude.com/workbench)即将停用,访问将于 2026 年 8 月 17 日结束。更新后的 Workbench 不支持已保存的提示、变量和评估。您可以通过横幅或在 Organizational Settings(组织设置)下导出任何想要保留的数据。有关更多信息,请参阅 Claude 帮助中心的 How do I use the Workbench?。
- 用于生成、改进和模板化提示的实验性提示工具 API(
/v1/experimental/generate_prompt、/v1/experimental/improve_prompt和/v1/experimental/templatize_prompt)将于 2026 年 8 月 17 日随 Workbench 一同停用。移除后,对这些端点的请求将返回错误。
2026 年 7 月 15 日
- 对话中途系统消息可在 Claude API、Claude in Amazon Bedrock 和 Google Cloud 上的 Claude Fable 5、Claude Mythos 5 和 Claude Opus 4.8 中使用,无需 beta 标头。此条更正了之前的可用性说明。
2026 年 7 月 14 日
- 您现在可以使用 Admin API 管理 Claude Enterprise(claude.ai)组织中的人员。该功能以 beta 形式面向所有 Claude Enterprise 组织提供,支持以下操作:列出成员并按电子邮件地址查找成员、更改成员角色、移除成员、发送和撤回邀请、管理群组及其成员资格,以及读取自定义角色。群组和自定义角色请求需要
anthropic-beta: ce-user-management-2026-07-13beta 标头;成员和邀请请求则不需要 beta 标头。具有read:org_audit范围的 Admin API 密钥也可以调用所有用户管理GET端点。请参阅用户管理。
2026 年 7 月 10 日
- Dreams(研究预览版)现在支持 Claude Fable 5 和 Claude Sonnet 5。请参阅支持的模型。
- 我们扩充了 Access Transparency 文档中关于
cmek_preserve事件的内容,新增了一个筛选示例、一个示例事件负载以及两个保留原因代码(policy_violation_investigation、csae_report)。该文档现在还阐明:无论保留操作是由人工审核员还是自动化安全流水线发起的,都会写入保留事件。请参阅 CMEK 内容保留。
2026 年 7 月 8 日
- 现在,您在 Claude Console 中创建 API 密钥或 Admin API 密钥时可以设置过期时间。您可以选择预设值、自定义时长或 Never。对于有效期至少为 7 天的密钥,Anthropic 会在过期前向创建者发送电子邮件。现有密钥不受影响。Admin API 会在
expires_at字段中报告每个密钥的过期时间。请参阅身份验证。
2026 年 7 月 2 日
-
我们新增了
agent-memory-2026-07-22beta 标头,它会改变列出记忆(GET /v1/memory_stores/{memory_store_id}/memories)的行为,具体如下:- 结果以稳定的、由服务器定义的顺序返回,并忽略
order_by和order参数。 depth仅接受0、1或省略(其他值返回400错误)。path_prefix必须以/结尾,并匹配完整的路径段而非子字符串。
未使用该标头时签发的分页游标在使用该标头后无效,因此在采用该标头时请从第一页重新开始。在记忆存储端点上,
agent-memory-2026-07-22取代了managed-agents-2026-04-01;同时发送两者会返回400错误。2026 年 7 月 22 日起,managed-agents-2026-04-01标头也将采用相同的列表行为。请参阅 Beta 标头。 - 结果以稳定的、由服务器定义的顺序返回,并忽略
-
Python (0.116.0)、TypeScript (0.110.0)、Go (1.56.0)、Java (2.48.0)、Ruby (1.55.0)、PHP (0.36.0)、C# (12.35.0) 和 CLI (1.16.0) SDK 现在在所有记忆存储调用中发送
agent-memory-2026-07-22,而不是managed-agents-2026-04-01。如果您的代码在记忆存储调用中显式传入betas,请在该处将managed-agents-2026-04-01替换为agent-memory-2026-07-22,而不是添加第二个值。
2026 年 7 月 1 日
- 我们已恢复对 Claude Fable 5 和 Claude Mythos 5 的访问。有关更多信息,请参阅我们的声明。
2026 年 6 月 30 日
- 我们推出了 Claude Sonnet 5(
claude-sonnet-5),这是我们 Sonnet 模型系列的新一代产品,推广定价为每 MTok $2 / $10(已于 2026 年 8 月 10 日成为标准价格)。Claude Sonnet 5 支持 1M 令牌上下文窗口、128k 最大输出令牌,以及与 Claude Sonnet 4.6 相同的工具和平台功能,但 Priority Tier 除外,Claude Sonnet 5 不提供该功能。迁移时有三项行为变更:自适应思考现在默认开启;手动扩展思考(thinking: {type: "enabled", budget_tokens: N})已被移除,使用时会返回 400 错误(该功能在 Sonnet 4.6 上已被弃用);将采样参数(temperature、top_p、top_k)设置为非默认值会返回 400 错误。Claude Sonnet 5 还使用了新的分词器,对于相同文本会产生大约多 30% 的令牌。具体增幅取决于内容和工作负载形态。有关详细信息和迁移指南,请参阅 Claude Sonnet 5 的新功能。有关行为差异和特定于模型的提示模式,请参阅Claude Sonnet 5 提示指南。 - Claude Managed Agents 会话事件流现在支持事件增量。在
GET /v1/sessions/{session_id}/events/stream上使用event_deltas[]查询参数即可选择启用。event_start和event_delta事件会在完整的agent.message事件到达之前,在智能体消息文本生成时对其进行预览。 - Claude Managed Agents 的列出会话现在支持向后分页。
GET /v1/sessions会在返回next_page的同时返回prev_page游标;将其作为page参数传递即可返回上一页。请参阅分页。 - 创建 Claude Managed Agents 会话时,您现在可以为该会话覆盖智能体的配置。传递带有
type: "agent_with_overrides"的agent,即可为单个会话替换模型、系统提示、工具、MCP 服务器或技能。智能体本身保持不变。 - Claude Managed Agents 保管库现在支持在环境变量凭据(Environment variable 标签页)上设置
injection_location。它控制凭据的值在出站时被替换到智能体出站请求的标头、请求正文,还是两者之中。 - Claude Managed Agents 的 webhook 现在涵盖智能体、部署和部署运行的生命周期。您无需轮询即可对新发布的智能体版本、已暂停的部署或失败的计划运行做出响应。请参阅订阅 webhook 中的 Agent events、Deployment events 和 Deployment run events 标签页。
2026 年 6 月 29 日
- 我们已移除 Claude Opus 4.6 的快速模式。现在,使用
speed: "fast"向claude-opus-4-6发出的请求不再以快速模式运行,也不再按溢价计费:这些请求会以标准速度运行、按标准费率计费,且不会返回错误。响应中的usage.speed字段会报告实际使用的速度。如需继续使用快速模式,请迁移到 Claude Opus 4.8。在快速模式中了解更多信息。
2026 年 6 月 26 日
- 我们提高了整个 Claude API 的 rate limits(速率限制)。现在,Claude Sonnet 和 Claude Haiku 在每个使用层级上的速率限制都与 Claude Opus 一致,并且使用层级已合并为三个:Start、Build 和 Scale。大多数组织会升至更高层级,所有组织的限制都不会低于以前,且您无需采取任何操作。您可以在 Claude Console 中查看您的层级和当前限制。
2026 年 6 月 25 日
- 我们已弃用 Claude Opus 4.7 的快速模式,该功能将于 2026 年 7 月 24 日移除。移除后,使用
speed: "fast"向claude-opus-4-7发出的请求将返回错误。请迁移到 Claude Opus 4.8 的快速模式。在快速模式中了解更多信息。
2026 年 6 月 22 日
- MCP tunnels(研究预览版):管理 API 已从 Admin API 上的
/v1/organizations/tunnels迁移到 Claude API 上的/v1/tunnels。新接口使用anthropic-beta: mcp-tunnels-2026-06-22标头和workspace:manage_tunnelsWIF 范围。在迁移窗口期内,旧接口仍然可用。请参阅 Tunnels API 参考。
2026 年 6 月 18 日
- Python、TypeScript、Go、Java、Ruby、PHP 和 C# SDK 现在支持
code_execution_20260120。这是代码执行工具的一个版本,它增加了 REPL 状态持久化,也是使用程序化工具调用所需的最低版本。要采用该版本,请将工具的type设置为code_execution_20260120,无需 beta 标头。该版本可在 Claude Fable 5、Claude Mythos 5、Claude Opus 4.5 及更新版本,以及 Claude Sonnet 4.5 及更新版本上使用;请参阅代码执行工具的兼容性部分。
2026 年 6 月 15 日
- 我们已停用 Claude Sonnet 4 模型(
claude-sonnet-4-20250514)和 Claude Opus 4 模型(claude-opus-4-20250514)。现在,在 Claude API 上对这些模型的所有请求都将返回错误。我们建议分别升级到 Claude Sonnet 4.6 和 Claude Opus 4.8。研究人员可以通过 External Researcher Access Program 申请继续访问。
2026 年 6 月 11 日
- 代码执行工具现在支持
code_execution_20260521。该版本会在工具描述中说明每个单元格 90 秒的执行时间限制,以便 Claude 为长时间运行的单元格合理规划时间。无需 beta 标头。 - 网络搜索工具和网页抓取工具现在支持
web_search_20260318和web_fetch_20260318。这两个版本新增了response_inclusion参数,可在智能体工作流中从 API 响应里删除已使用的结果块。无需 beta 标头。
2026 年 6 月 10 日
GET /v1/environments/{id}/work端点现已在 Claude Platform on AWS 上可用,该端点用于列出自托管沙箱的待处理工作。有关授权该端点的GetEnvironment操作,请参阅 Claude Platform on AWS 的 IAM 操作。
2026 年 6 月 9 日
- 我们推出了 Claude Fable 5(
claude-fable-5),这是我们面向所有客户开放的能力最强的模型。同时,我们还为 Project Glasswing 参与者推出了 Claude Mythos 5(claude-mythos-5)。两个模型均默认支持 1M 令牌上下文窗口和 128k 最大输出令牌,并始终开启自适应思考。有关功能、API 变更和可用性,请参阅推出 Claude Fable 5 和 Claude Mythos 5。 - Claude Fable 5 和 Claude Mythos 5 使用随 Claude Opus 4.7 引入的分词器。与 Claude Opus 4.7 之前的模型相比,相同文本产生的令牌约多 30%,确切增幅取决于内容和工作负载形态。您可以使用带有
model: "claude-fable-5"的令牌计数 API 来衡量您的提示在新分词器下的令牌数。 - Claude Fable 5 会对请求运行安全分类器,并在响应生成期间持续运行。当分类器拒绝请求时,Messages API 会返回
stop_reason: "refusal"。如果请求在生成任何输出之前就被拒绝,您不会为其付费。您可以选择启用fallbacks参数,在另一个模型上重新运行被拒绝的请求,并按回退模型的费率计费。该参数在 Claude API 和 Claude Platform on AWS 上处于 beta 阶段,Message Batches API 不支持该参数。请参阅处理停止原因。 - 在 Claude Fable 5 上,拒绝响应中的
stop_details.category字段现在包含"reasoning_extraction"。当请求因违反 Anthropic 服务条款中关于逆向工程或复制模型输出的限制而被阻止时,会返回该值。现有的"cyber"和"bio"类别保持不变。无需 beta 标头。 - 在 Claude Fable 5 和 Claude Mythos 5 上,自适应思考是唯一的思考模式:不支持
thinking: {"type": "disabled"},也不支持手动扩展思考预算和助手预填充(两者都会返回 400 错误)。请参阅从 Claude Mythos Preview 迁移到 Claude Mythos 5。 - 在 Claude Fable 5 和 Claude Mythos 5 上,
thinking.display默认为"omitted",与 Claude Opus 4.8、Claude Opus 4.7 和 Claude Mythos Preview 相同。设置display: "summarized"即可接收可读的思考摘要。原始思维链永远不会返回;在同一模型上进行多轮对话时,请原样传回思考块。请参阅 Claude Fable 5 和 Claude Mythos 5 上的思考输出。 - Claude Fable 5 要求 30 天数据保留,不支持零数据保留。请参阅特定于模型的数据保留要求。
- Claude Managed Agents 现在支持计划部署,让您无需自行管理调度器即可按 cron 计划运行会话。
- Claude Managed Agents 保管库现在支持环境变量凭据。对于通过环境变量进行身份验证的 CLI、SDK 和其他服务,您可以借此将密钥安全地注入智能体的沙箱。
- Compliance API 的 Activity Feed(
GET /v1/compliance/activities)现已在 Claude Platform on AWS 上可用。有关授权该端点的ListComplianceActivities操作,请参阅 Claude Platform on AWS 的 IAM 操作。 session.thread_*webhook 事件现在包含session_thread_id字段,用于标识触发该事件的多智能体线程。- 我们发布了一个 beta 版 Swift 包,它将 Claude 作为服务器端
LanguageModel添加到 Apple 的 Foundation Models 框架中。在 iOS 27、macOS 27、visionOS 27 和 watchOS 27(beta)上,您可以通过与 Apple 设备端模型相同的LanguageModelSessionAPI 调用 Claude。
2026 年 6 月 5 日
- 我们宣布弃用 Claude Opus 4.1 模型(
claude-opus-4-1-20250805),该模型计划于 2026 年 8 月 5 日在 Claude API 上停用。我们建议迁移到 Claude Opus 4.8。在模型弃用中了解更多信息。
2026 年 6 月 2 日
- 顾问工具现在支持
max_tokens参数,用于限制顾问模型每次调用的输出。对于不需要完整长度顾问响应的工作负载,这可以降低延迟和输出令牌成本。请在顾问工具定义上设置tools[].max_tokens;请参阅限制顾问输出。 - 在 Claude API 上,如果请求在 Claude 未生成任何输出的情况下返回
stop_reason: "refusal",您将不再为该请求付费。有关如何检测和处理拒绝,请参阅流式传输拒绝。
2026 年 5 月 29 日
- Claude Managed Agents 的 webhooks、多智能体编排和自托管沙箱现已在 Claude Platform on AWS 上可用。有关新的 IAM 操作和
AnthropicSelfHostedEnvironmentAccess托管策略,请参阅 Claude Platform on AWS 的 IAM 操作。
2026 年 5 月 28 日
- 我们推出了 Claude Opus 4.8(),这是我们能力最强的模型。在 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上,Claude Opus 4.8 默认支持 1M 令牌上下文窗口和 128k 最大输出令牌,并提供与 Claude Opus 4.7 相同的工具和平台功能集。有关基线设置、功能和迁移指南,请参阅迁移指南。
- 我们推出了对话中途系统消息。在 Claude Opus 4.8 上,您可以在
messages数组中的用户轮次之后发送role: "system"消息(须遵守放置规则)。这样,在长时间运行的会话中更改指令时,仍可保留提示缓存命中。无需 beta 标头。 - 拒绝响应中的
stop_details字段现已公开记录。该字段返回一个category(cyber、bio或null)和一个人类可读的explanation,以便您的应用程序将不同类别的拒绝路由到相应的后续步骤。无需 beta 标头。 - 在 Claude Opus 4.8 上,effort 参数在所有平台(包括 Claude Code 和 Messages API)上均默认为
high。 - 在 Claude Opus 4.8 上,提示缓存的最小可缓存提示长度为 1,024 个令牌,低于 Claude Opus 4.7。
- 启用自适应思考后,Claude Opus 4.8 仅在某个轮次需要时才会触发推理。与相同 effort 级别下的 Claude Opus 4.7 相比,这减少了浪费的思考令牌。
- Claude Opus 4.8 支持高分辨率图像输入(长边最多 2576 像素),与 Claude Opus 4.7 相同。
- 任务预算现在支持 Claude Opus 4.8。
- 顾问工具现在支持 Claude Opus 4.8。
- 计算机使用现在支持 Claude Opus 4.8。
- Claude Opus 4.8 的快速模式以研究预览版形式提供,仅限 Claude API。
- 在 Claude Opus 4.8 上,将采样参数
temperature、top_p或top_k设置为非默认值会返回 400 错误,与 Claude Opus 4.7 相同。有关详细信息,请参阅迁移指南。 - 在 Claude Code 中,我们已将 Auto 模式扩展到更多用户,用于长时间运行的任务。请参阅 Claude Code 文档。
- 在 Claude Code 中,Max 计划用户现在在 Claude Opus 4.8 上默认使用快速模式。请参阅 Claude Code 文档。
- 在 Claude Code 中,Workflows 以研究预览版形式提供,让您可以定义和运行多步骤的智能体计划。请参阅 Claude Code 文档。
- 我们已弃用 Claude Opus 4.6 的快速模式,该功能将在本次发布后约 30 天移除。请迁移到 Claude Opus 4.8 或 Claude Opus 4.7 的快速模式。在快速模式中了解更多信息。
- 有关本次发布中 claude.ai、Cowork、Claude for Microsoft 365 和其他 Claude 应用的更新,请参阅 Claude 应用的发布说明。
2026 年 5 月 27 日
- Messages API 响应现在包含
usage.output_tokens_details.thinking_tokens,用于报告计费输出令牌中有多少属于扩展思考。使用 streaming(流式传输)时,该细分数据仅出现在最终的message_delta事件中。无需 beta 标头。
2026 年 5 月 19 日
- MCP tunnels 现已以研究预览版形式提供,让您可以连接到私有网络中的 MCP 服务器。
- Claude Managed Agents 现已提供自托管沙箱,作为在 Anthropic 基础设施中执行工具的替代方案。请参阅自托管沙箱。
- 借助 Claude Managed Agents,您现在可以更新与活动会话关联的智能体 MCP 服务器和工具配置。
- 借助 Claude Managed Agents,
agent_toolset和 MCP 工具产生的超过 100K 个字符(约 25K 个令牌)的大型输出现在会自动溢出到沙箱中的文件。模型会收到包含文件路径的截断预览,并可以从该文件读取完整内容。
2026 年 5 月 18 日
- 网络搜索工具现在会返回更丰富的 SEC 文件数据。这让金融研究智能体、财报分析和尽职调查工作流能够更轻松地以带引用的一手来源为依据。
2026 年 5 月 13 日
- 我们以公开 beta 形式推出了缓存诊断。在 Messages 请求中传入
diagnostics.previous_message_id后,API 会报告一个cache_miss_reason,说明提示缓存前缀在何处与上一轮次出现分歧。请在请求中包含cache-diagnosis-2026-04-07beta 标头。
2026 年 5 月 12 日
- 快速模式(研究预览版)现在支持 Claude Opus 4.7。设置
speed: "fast",并配合使用model: "claude-opus-4-7"和fast-mode-2026-02-01beta 标头,即可以溢价获得显著更快的输出令牌生成速度。其定价、速率限制和访问方式与 Opus 4.6 快速模式相同;感兴趣的客户请加入候补名单。
2026 年 5 月 11 日
- 我们推出了 Claude Platform on AWS,将 Claude API 引入可通过 AWS 访问的 Anthropic 托管基础设施,并支持 AWS 计费和 IAM 身份验证。您可以通过原生 AWS 端点访问完整的 Messages API、Files API、Message Batches API、Claude Managed Agents、Agent Skills、代码执行和工具使用功能。在 Claude Platform on AWS 中了解更多信息。
2026 年 5 月 6 日
- 多智能体编排和 Outcomes 现已在标准
managed-agents-2026-04-01beta 标头下进入公开 beta 阶段。 - Claude Managed Agents 保管库的凭据后台刷新功能现在支持
mcp_oauth凭据。请参阅使用保管库进行身份验证。 - Claude Managed Agents 现已支持 webhooks。Webhook 事件类型包括会话和保管库的生命周期事件。请参阅订阅 webhooks。
- Claude Managed Agents 现在支持更多筛选和排序选项:会话可以按状态筛选,事件可以按类型和创建时间筛选。
- Claude Managed Agents 的 Dreams 现已以研究预览版形式提供。Dream 会读取现有的记忆存储以及过去的会话记录,并生成一个重新组织后的输出记忆存储:合并重复项、替换过时条目,并提炼出新的见解。Dream 端点需要使用
dreaming-2026-04-21beta 标头才能访问。如需试用,请申请访问权限。
2026 年 5 月 4 日
- 我们推出了 Workload Identity Federation(工作负载身份联合)。您可以使用来自自有身份提供商(AWS IAM、Google Cloud、GitHub Actions、Kubernetes、Microsoft Entra ID、Okta、SPIFFE 等)的短期 OIDC 令牌,向 Claude API 验证工作负载身份,而无需使用长期有效的静态 API 密钥。在 Claude Console 中配置颁发者和联合规则后,SDK 会自动处理令牌交换和刷新。请参阅身份验证。
2026 年 4 月 30 日
- 我们已停用 Claude Sonnet 4.5 和 Claude Sonnet 4 的 1M 令牌上下文窗口 beta(
context-1m-2025-08-07)。该 beta 标头现在对这些模型不再起作用,超过标准 200k 令牌上下文窗口的请求会返回错误。如需使用 1M 上下文窗口,请迁移到 Claude Sonnet 4.6 或 Claude Opus 4.6。这两个模型以标准定价提供该功能,且无需 beta 标头。
2026 年 4 月 29 日
- 我们发布了 Claude API skill,这是一个开源的 Agent Skill。它为 Claude 提供最新的参考资料,帮助其使用 8 种语言基于 Messages API 和 Claude Managed Agents 进行构建。该技能已随 Claude Code 捆绑提供,也可在 Anthropic skills 仓库中获取。
2026 年 4 月 24 日
- 我们发布了 Rate Limits API,管理员可以通过它以编程方式查询为其组织和工作区配置的速率限制。
2026 年 4 月 23 日
- Claude Managed Agents 的记忆功能现已在标准
managed-agents-2026-04-01标头下进入公开 beta 阶段。有关完整的集成指南,请参阅使用智能体记忆。
2026 年 4 月 20 日
- 我们已停用 Claude Haiku 3 模型(
claude-3-haiku-20240307)。现在,对该模型的所有请求都将返回错误。我们建议升级到 Claude Haiku 4.5。
2026 年 4 月 16 日
- 我们推出了 Claude Opus 4.7,这是我们在复杂推理和智能体编码方面能力最强的模型,定价与 Opus 4.6 相同,为每 MTok $5 / $25。有关能力改进、新功能和更新后的分词器,请参阅 Claude Opus 4.7 的新功能。与 Opus 4.6 相比,Opus 4.7 包含 API 破坏性变更;升级前请参阅迁移指南。
- Claude in Amazon Bedrock 现已向所有 Amazon Bedrock 客户开放。Claude Opus 4.7 和 Claude Haiku 4.5 可通过 Bedrock 控制台自助使用,经由位于
/anthropic/v1/messages的 Messages API 端点访问,覆盖 27 个 AWS 区域,提供全球端点和区域端点。 - 我们在 Claude Opus 4.7 上推出了测试版的任务预算。您可以为完整的智能体循环(思考、工具调用、工具结果和输出)为 Claude 提供一个建议性的令牌预算,模型会看到一个实时倒计时,并据此确定工作优先级,在预算消耗时从容地完成任务。请在请求中包含
task-budgets-2026-03-13beta 标头。 - Claude Opus 4.7 支持高分辨率图像输入,将长边的最大图像分辨率从 1568 像素提高到 2576 像素,从而提升计算机使用、屏幕截图理解和文档分析方面的性能。高分辨率支持是自动启用的,无需 beta 标头;图像使用的图像令牌数量可能比之前的模型多出约 3 倍。
- 我们在 Claude Opus 4.7 上新增了
xhigheffort 级别。xhigh介于high和max之间,专为令牌预算达数百万的长时间运行(超过 30 分钟)的智能体和编码任务而调优。无需 beta 标头。
2026 年 4 月 14 日
- 我们宣布弃用 Claude Sonnet 4 模型(
claude-sonnet-4-20250514)和 Claude Opus 4 模型(claude-opus-4-20250514),计划于 2026 年 6 月 15 日在 Claude API 上停用。我们建议分别迁移到 Claude Sonnet 4.6 和 Claude Opus 4.8。请在模型弃用中了解更多信息。
2026 年 4 月 9 日
- 我们推出了公开测试版的 advisor 工具。将速度更快的执行者模型与智能程度更高的顾问模型配对,由顾问模型在生成过程中提供战略指导,使长周期智能体工作负载的质量接近顾问模型单独运行的水平,而大部分令牌生成则按执行者模型的费率计费。请在请求中包含 beta 标头
advisor-tool-2026-03-01。
2026 年 4 月 8 日
- 我们推出了公开测试版的 Claude Managed Agents,这是一个完全托管的智能体框架,用于将 Claude 作为自主智能体运行,具备安全沙箱、内置工具和服务器发送事件 "streaming"(流式传输)。您可以通过 API 创建智能体、配置容器并运行会话。所有端点都需要
managed-agents-2026-04-01beta 标头。请在 Claude Managed Agents 概述中了解更多信息。 - 我们推出了
antCLI,这是一个用于 Claude API 的命令行客户端,可实现与 Claude API 更快速的交互、与 Claude Code 的原生集成,以及在 YAML 文件中对 API 资源进行版本管理。请在 CLI 快速入门中了解更多信息。
2026 年 4 月 7 日
- 我们宣布 Claude Mythos Preview 作为 Project Glasswing 的一部分,以受限研究预览的形式提供,用于防御性网络安全工作。仅限受邀访问。
- Messages API 现已作为研究预览在 Amazon Bedrock 上提供。位于
/anthropic/v1/messages的全新 Claude in Amazon Bedrock 端点使用与第一方 Claude API 相同的请求结构,并运行在 AWS 托管的基础设施上,运营方零访问权限。目前在us-east-1中可用;请联系您的 Anthropic 客户经理申请访问权限。请在 Claude in Amazon Bedrock 中了解更多信息。
2026 年 3 月 30 日
- 我们已将 Claude Opus 4.6 和 Sonnet 4.6 在 Message Batches API 上的
max_tokens上限提高到 300k。请包含output-300k-2026-03-24beta 标头,以便为长篇内容、结构化数据和大型代码生成任务生成更长的单轮输出。 - 我们将于 2026 年 4 月 30 日停用 Claude Sonnet 4.5 和 Claude Sonnet 4 的 1M 令牌 "context window"(上下文窗口)测试版。在该日期之后,
context-1m-2025-08-07beta 标头将对这些模型不再生效,超出标准 200k 令牌上下文窗口的请求将返回错误。如需继续使用 1M 上下文窗口,请迁移到 Claude Sonnet 4.6 或 Claude Opus 4.6,它们以标准定价支持完整的 1M 令牌上下文窗口,且无需 beta 标头。
2026 年 3 月 18 日
- 我们在 Models API 中新增了模型能力字段。
GET /v1/models和GET /v1/models/{model_id}现在会返回max_input_tokens、max_tokens以及一个capabilities对象。您可以查询 API 来了解每个模型支持哪些功能。
2026 年 3 月 16 日
- 我们为 "extended thinking"(扩展思考)推出了
display字段,允许您在响应中省略思考内容,以实现更快的流式传输。设置thinking.display: "omitted"后,您将收到thinking字段为空的思考块,同时保留signature以确保多轮对话的连续性。计费方式不变。请在控制思考显示中了解更多信息。
2026 年 3 月 13 日
- Claude Opus 4.6 和 Sonnet 4.6 的 1M 令牌上下文窗口已结束测试,按标准定价提供。对于这些模型,超过 200k 令牌的请求会自动生效,无需 beta 标头。Claude Sonnet 4.5 和 Sonnet 4 的 1M 令牌上下文窗口仍处于测试阶段。
- 我们已取消所有受支持模型专用的 1M "rate limit"(速率限制)。您的标准账户限制现在适用于所有上下文长度。
- 使用 1M 令牌上下文窗口时,我们已将每个请求的媒体限制从 100 张图像或 PDF 页面提高到 600 张。
2026 年 2 月 19 日
- 我们为 Messages API 推出了自动缓存。只需在请求体中添加一个
cache_control字段,系统就会自动缓存最后一个可缓存的块,并随着对话增长向前移动缓存点。无需手动管理断点。可与现有的块级缓存控制配合使用,实现细粒度优化。在 Claude API 和 Microsoft Foundry(预览版)上可用。请在"prompt caching"(提示缓存)中了解更多信息。 - 我们已停用 Claude Sonnet 3.7 模型(
claude-3-7-sonnet-20250219)和 Claude Haiku 3.5 模型(claude-3-5-haiku-20241022)。所有对 Claude Sonnet 3.7 的请求现在都将返回错误。在 Claude API 上对 Claude Haiku 3.5 的请求现在将返回错误;该模型在 Amazon Bedrock 和 Google Cloud 上仍然可用。我们建议分别升级到 Claude Sonnet 4.6 和 Claude Haiku 4.5。研究人员可以通过外部研究人员访问计划申请持续访问权限。 - 我们宣布弃用 Claude Haiku 3 模型(
claude-3-haiku-20240307),计划于 2026 年 4 月 20 日停用。我们建议迁移到 Claude Haiku 4.5。请在模型弃用中了解更多信息。
2026 年 2 月 17 日
- 我们推出了 Claude Sonnet 4.6,这是我们最新的均衡型模型,兼具速度与智能,适用于日常任务。Sonnet 4.6 在消耗更少令牌的同时,提供了更出色的智能体搜索性能。Sonnet 4.6 支持扩展思考和 1M 令牌上下文窗口(测试版)。详情请参阅模型与定价。
- API 代码执行现在与网络搜索或网页获取一起使用时免费。沙箱化的代码执行可提升模型能力和令牌效率。有关单独使用的情况,请参阅定价详情。
- 网络搜索工具和程序化工具调用现已可用,无需 beta 标头。网络搜索和网页获取现在支持动态过滤,它使用代码执行在结果进入上下文窗口之前对其进行过滤,以获得更好的性能并降低令牌成本。
- 代码执行工具、网页获取工具、工具搜索工具、"tool use"(工具使用)示例和记忆工具不再需要 beta 标头。
2026 年 2 月 7 日
2026 年 2 月 5 日
- 我们推出了 Claude Opus 4.6,这是我们在复杂智能体任务和长周期工作方面最智能的模型。Opus 4.6 推荐使用自适应思考(
thinking: {type: "adaptive"});手动思考(带有budget_tokens的type: "enabled")已被弃用。Opus 4.6 不支持预填充助手消息。请在 Claude 4.6 的新功能中了解更多信息。 - effort 参数不再需要 beta 标头,并且现在支持 Claude Opus 4.6。在新模型上,effort 取代
budget_tokens来控制思考深度。 - 我们推出了测试版的压缩 API,提供服务器端上下文摘要功能,实现实际上无限长的对话。在 Opus 4.6 上可用。
- 我们引入了数据驻留控制,允许您通过
inference_geo参数指定模型推理的运行位置。对于 2026 年 2 月 1 日之后发布的模型,仅限美国的推理按 1.1 倍定价提供。 - 1M 令牌上下文窗口现已在 Claude Opus 4.6 上以测试版提供,此外 Sonnet 4.5 和 Sonnet 4 也支持。超过 200k 输入令牌的请求适用长上下文定价。
- 细粒度工具流式传输在任何模型或平台上都不再需要 beta 标头。
2026 年 1 月 29 日
- 结构化输出已在 Claude API 上针对 Claude Sonnet 4.5、Claude Opus 4.5 和 Claude Haiku 4.5 结束测试。此版本包括扩展的 schema 支持、改进的语法编译 "latency"(延迟),以及无需 beta 标头的简化集成路径。
output_format参数已移至output_config.format。现有测试版用户可以在过渡期内继续使用 beta 标头。结构化输出在 Amazon Bedrock 和 Microsoft Foundry 上仍处于公开测试阶段。
2026 年 1 月 12 日
console.anthropic.com现在会重定向到platform.claude.com。作为 Claude 品牌整合的一部分,Claude Console 已迁移到新地址。现有的书签和链接将通过自动重定向继续有效。更多详情,请参阅 2025 年 9 月 16 日的公告。
2026 年 1 月 5 日
- 我们已停用 Claude Opus 3 模型(
claude-3-opus-20240229)。所有对该模型的请求现在都将返回错误。我们建议升级到 Claude Opus 4.5,它以三分之一的成本提供显著提升的智能。研究人员可以通过外部研究人员访问计划申请在 API 上持续访问 Claude Opus 3。
2025 年 12 月 19 日
- 我们宣布弃用 Claude Haiku 3.5 模型。请在模型弃用中了解更多信息。
2025 年 12 月 4 日
- 结构化输出现已支持 Claude Haiku 4.5。
2025 年 11 月 24 日
- 我们推出了 Claude Opus 4.5,这是我们最智能的模型,将最强能力与实用性能相结合。非常适合复杂的专业任务、专业软件工程和高级智能体。它在视觉、编码和计算机使用方面实现了跨越式提升,且价格比之前的 Opus 模型更加亲民。请在模型概述中了解更多信息。
- 我们推出了公开测试版的程序化工具调用,允许 Claude 在代码执行中调用工具,以减少多工具工作流中的延迟和令牌使用量。
- 我们推出了公开测试版的工具搜索工具,使 Claude 能够从大型工具目录中按需动态发现和加载工具。
- 我们为 Claude Opus 4.5 推出了公开测试版的 effort 参数,允许您通过在响应的详尽程度与效率之间进行权衡来控制令牌使用量。
- 我们在 Python 和 TypeScript SDK 中新增了客户端压缩功能,在使用
tool_runner时通过摘要自动管理对话上下文。
2025 年 11 月 21 日
- 搜索结果内容块现已在 Amazon Bedrock 上可用,无需 beta 标头。请在搜索结果中了解更多信息。
2025 年 11 月 19 日
- 我们在 platform.claude.com/docs 推出了全新的文档平台。我们的文档现在与 Claude Console 并列,提供统一的开发者体验。之前位于 docs.claude.com 的文档站点将重定向到新位置。
2025 年 11 月 18 日
- 我们推出了 Claude in Microsoft Foundry,为 Azure 客户带来 Claude 模型,支持 Azure 计费和 OAuth 身份验证。您可以访问完整的 Messages API,包括扩展思考、提示缓存(5 分钟和 1 小时)、PDF 支持、Files API、Agent Skills 和工具使用。请在 Claude in Microsoft Foundry 中了解更多信息。
2025 年 11 月 14 日
- 我们推出了公开测试版的结构化输出,确保 Claude 的响应符合 schema。使用 JSON 输出获取结构化数据响应,或使用严格工具使用来获得经过验证的工具输入。适用于 Claude Sonnet 4.5 和 Claude Opus 4.1。如需启用,请使用 beta 标头
structured-outputs-2025-11-13。
2025 年 10 月 28 日
- 我们宣布弃用 Claude Sonnet 3.7 模型。请在模型弃用中了解更多信息。
- 我们已停用 Claude Sonnet 3.5 模型。所有对这些模型的请求现在都将返回错误。
- 我们扩展了上下文编辑功能,新增思考块清除(
clear_thinking_20251015),可自动管理思考块。请在上下文编辑中了解更多信息。
2025 年 10 月 16 日
- 我们推出了 Agent Skills(
skills-2025-10-02测试版),这是一种扩展 Claude 能力的新方式。Skills 是由指令、脚本和资源组成的有序文件夹,Claude 会动态加载它们来执行专业任务。首个版本包括:- Anthropic 托管的 Skills:用于处理 PowerPoint(.pptx)、Excel(.xlsx)、Word(.docx)和 PDF 文件的预构建 Skills
- 自定义 Skills:通过 Skills API(
/v1/skills端点)上传您自己的 Skills,以封装领域专业知识和组织工作流 - Skills 需要启用代码执行工具
- 请在 Agent Skills 和 API 参考中了解更多信息
2025 年 10 月 15 日
- 我们推出了 Claude Haiku 4.5,这是我们速度最快、最智能的 Haiku 模型,性能接近前沿水平。非常适合实时应用、大批量处理以及需要强大推理能力的成本敏感型部署。请在模型概述中了解更多信息。
2025 年 9 月 29 日
- 我们推出了 Claude Sonnet 4.5,这是我们用于复杂智能体和编码的最佳模型,在大多数任务中具有最高的智能水平。请在模型概述中了解更多信息。
- 我们为 Amazon Bedrock 和 Vertex AI 引入了全球端点定价。Claude API(1P)定价不受影响。
- 我们引入了新的停止原因
model_context_window_exceeded,允许您在不计算输入大小的情况下请求尽可能多的令牌。请在处理停止原因中了解更多信息。 - 我们推出了测试版的记忆工具,使 Claude 能够跨对话存储和查阅信息。请在记忆工具中了解更多信息。
- 我们推出了测试版的上下文编辑功能,提供自动管理对话上下文的策略。首个版本支持在接近令牌限制时清除较早的工具结果和调用。请在上下文编辑中了解更多信息。
2025 年 9 月 17 日
- 我们为 Python 和 TypeScript SDK 推出了测试版的工具辅助功能,通过类型安全的输入验证以及用于在对话中自动处理工具的工具运行器,简化了工具的创建和执行。详情请参阅 Python SDK 和 TypeScript SDK 的文档。
2025 年 9 月 16 日
- 我们已将开发者产品统一到 Claude 品牌之下。您会在我们的平台和文档中看到更新后的名称和 URL,但我们的开发者接口将保持不变。以下是一些值得注意的变化:
- Claude Console(console.anthropic.com)→ Claude Console(platform.claude.com)。在 2026 年 1 月 12 日之前,控制台可通过这两个 URL 访问。在该日期之后,console.anthropic.com 将自动重定向到 platform.claude.com。
- Anthropic Docs(docs.anthropic.com)→ Claude Docs(docs.claude.com)
- Anthropic 帮助中心(support.anthropic.com)→ Claude 帮助中心(support.claude.com)
- API 端点、标头、环境变量和 SDK 保持不变。您现有的集成无需任何更改即可继续工作。
2025 年 9 月 10 日
- 我们推出了测试版的网页获取工具,允许 Claude 从指定的网页和 PDF 文档中检索完整内容。请在网页获取工具中了解更多信息。
- 我们推出了 Claude Code Analytics API,使组织能够以编程方式访问 Claude Code 的每日汇总使用指标,包括生产力指标、工具使用统计和成本数据。
2025 年 9 月 8 日
- 我们发布了 C# SDK 的测试版。
2025 年 9 月 5 日
2025 年 9 月 3 日
- 我们推出了在客户端工具结果中支持可引用文档的功能。请在处理工具调用中了解更多信息。
2025 年 9 月 2 日
- 我们推出了公开测试版的 代码执行工具 v2,以支持 Bash 命令执行和直接文件操作(包括使用其他语言编写代码)的功能,取代了原先仅支持 Python 的工具。
2025 年 8 月 27 日
- 我们发布了 PHP SDK 的测试版。
2025 年 8 月 26 日
- 我们提高了 Claude API 上 Claude Sonnet 4 的 1M 令牌上下文窗口的速率限制。
- 1M 令牌上下文窗口现已在 Vertex AI 上可用。更多信息,请参阅 Vertex AI 上的 Claude。
2025 年 8 月 19 日
- 请求 ID 现在会直接包含在错误响应体中,与现有的
request-id标头并存。请在错误中了解更多信息。
2025 年 8 月 18 日
- 我们发布了 Usage & Cost API,允许管理员以编程方式监控其组织的使用情况和成本数据。
- 我们在 Admin API 中新增了一个用于检索组织信息的端点。详情请参阅组织信息 Admin API 参考。
2025 年 8 月 13 日
- 我们宣布弃用 Claude Sonnet 3.5 模型(
claude-3-5-sonnet-20240620和claude-3-5-sonnet-20241022)。这些模型将于 2025 年 10 月 28 日停用。我们建议迁移到 Claude Sonnet 4.5(claude-sonnet-4-5-20250929),以获得更好的性能和能力。请在模型弃用中了解更多信息。 - 提示缓存的 1 小时缓存时长不再需要 beta 标头。请在提示缓存中了解更多信息。
2025 年 8 月 12 日
- 我们在 Claude API 和 Amazon Bedrock 上为 Claude Sonnet 4 推出了 1M 令牌上下文窗口的测试版支持。
2025 年 8 月 11 日
- 由于 API 的加速限制,部分客户在 API 使用量急剧增加后可能会遇到 429(
rate_limit_error)错误。此前,在类似情况下会出现 529(overloaded_error)错误。
2025 年 8 月 8 日
- 搜索结果内容块已在 Claude API 和 Vertex AI 上结束测试。此功能为 "retrieval-augmented generation"(检索增强生成),即 RAG 应用提供带有正确来源归属的自然引用。不再需要 beta 标头
search-results-2025-06-09。请在搜索结果中了解更多信息。
2025 年 8 月 5 日
- 我们推出了 Claude Opus 4.1,这是 Claude Opus 4 的增量更新,具有增强的能力和性能改进。* 请在模型概述中了解更多信息。
*Opus 4.1 不允许同时指定 temperature 和 top_p 参数。请只使用其中一个。
2025 年 7 月 28 日
- 我们发布了
text_editor_20250728,这是一个更新的文本编辑器工具,修复了之前版本中的一些问题,并新增了一个可选的max_characters参数,允许您在查看大文件时控制截断长度。
2025 年 7 月 24 日
- 我们提高了 Claude API 上 Claude Opus 4 的速率限制,为您提供更多容量来使用 Claude 进行构建和扩展。对于适用使用层级 1-4 速率限制的客户,这些更改会立即应用到您的账户,无需任何操作。
2025 年 7 月 21 日
- 我们已停用 Claude 2.0、Claude 2.1 和 Claude Sonnet 3 模型。所有对这些模型的请求现在都将返回错误。请在模型弃用中了解更多信息。
2025 年 7 月 17 日
- 我们提高了 Claude API 上 Claude Sonnet 4 的速率限制,为您提供更多容量来使用 Claude 进行构建和扩展。对于适用使用层级 1-4 速率限制的客户,这些更改会立即应用到您的账户,无需任何操作。
2025 年 7 月 3 日
- 我们推出了测试版的搜索结果内容块,为 RAG 应用提供自然引用。工具现在可以返回带有正确来源归属的搜索结果,Claude 会在其响应中自动引用这些来源,引用质量与网络搜索相当。这消除了在自定义知识库应用中使用文档变通方案的需要。请在搜索结果中了解更多信息。如需启用此功能,请使用 beta 标头
search-results-2025-06-09。
2025 年 6 月 30 日
- 我们宣布弃用 Claude Opus 3 模型。请在模型弃用中了解更多信息。
2025 年 6 月 23 日
2025 年 6 月 11 日
- 我们推出了公开测试版的细粒度工具流式传输,该功能使 Claude 能够在不进行缓冲 / JSON 验证的情况下流式传输工具使用参数。如需启用细粒度工具流式传输,请使用 beta 标头
fine-grained-tool-streaming-2025-05-14。
2025 年 5 月 22 日
- 我们推出了 Claude Opus 4 和 Claude Sonnet 4,这是我们具备扩展思考能力的最新模型。请在模型概述中了解更多信息。
- Claude 4 模型中扩展思考的默认行为是返回 Claude 完整思考过程的摘要,完整的思考内容会被加密,并在
thinking块输出的signature字段中返回。 - 我们推出了公开测试版的交错思考,该功能使 Claude 能够在工具调用之间进行思考。如需启用交错思考,请使用 beta 标头
interleaved-thinking-2025-05-14。 - 我们推出了公开测试版的 Files API,使您能够上传文件,并在 Messages API 和代码执行工具中引用它们。
- 我们推出了公开测试版的代码执行工具,该工具使 Claude 能够在安全的沙箱环境中执行 Python 代码。
- 我们推出了公开测试版的 MCP 连接器,该功能允许您直接从 Messages API 连接到远程 MCP("Model Context Protocol",即 MCP)服务器。
- 为了提高回答质量并减少工具错误,我们已将 Messages API 中所有模型的
top_p核采样参数的默认值从 0.999 更改为 0.99。如需撤销此更改,请将top_p设置为 0.999。 此外,启用扩展思考时,您现在可以将top_p设置为 0.95 到 1 之间的值。 - 我们的 Go SDK 已从测试版升级为首个稳定版本。
- 我们在 Console 的使用情况页面中加入了分钟级和小时级的粒度,并在使用情况页面上显示 429 错误率。
2025 年 5 月 21 日
- 我们的 Ruby SDK 已从测试版升级为首个稳定版本。
2025 年 5 月 7 日
- 我们在 API 中推出了网络搜索工具,允许 Claude 从网络获取最新信息。请在网络搜索工具中了解更多信息。
2025 年 5 月 1 日
- 缓存控制现在必须直接在
tool_result和document.source的父级content块中指定。为了向后兼容,如果在tool_result.content或document.source.content的最后一个块上检测到缓存控制,它将被自动应用到父级块。在tool_result.content和document.source.content中的任何其他块上设置缓存控制将导致验证错误。
2025 年 4 月 9 日
- 我们发布了 Ruby SDK 的测试版。
2025 年 3 月 31 日
2025 年 2 月 27 日
- 我们在 Messages API 中为图像和 PDF 新增了 URL 源块。您现在可以直接通过 URL 引用图像和 PDF,而无需对其进行 base64 编码。请在视觉和 PDF 支持中了解更多信息。
- 我们在 Messages API 的
tool_choice参数中新增了对none选项的支持,该选项可阻止 Claude 调用任何工具。此外,在包含tool_use和tool_result块时,您不再需要提供任何tools。 - 我们推出了与 OpenAI 兼容的 API 端点,您只需在现有的 OpenAI 集成中更改 "API key"(API 密钥)、基础 URL 和模型名称,即可测试 Claude 模型。该兼容层支持核心的聊天补全功能。请在 OpenAI SDK 兼容性中了解更多信息。
2025 年 2 月 24 日
- 我们推出了 Claude Sonnet 3.7,这是我们迄今为止最智能的模型。Claude Sonnet 3.7 可以生成近乎即时的响应,也可以逐步展示其扩展思考过程。一个模型,两种思考方式。请在模型概述中了解所有 Claude 模型的更多信息。
- 我们为 Claude Haiku 3.5 新增了视觉支持,使该模型能够分析和理解图像。
- 我们发布了一种令牌高效的工具使用实现,提升了在 Claude 中使用工具时的整体性能。请在使用 Claude 进行工具使用中了解更多信息。
- 为了与 API 中的默认 temperature 保持一致,我们已将 Console 中新提示的默认 temperature 从 0 更改为 1。现有已保存的提示保持不变。
- 我们发布了工具的更新版本,将文本编辑工具和 bash 工具与计算机使用 "system prompt"(系统提示)解耦:
bash_20250124:功能与之前版本相同,但独立于计算机使用。不需要 beta 标头。text_editor_20250124:功能与之前版本相同,但独立于计算机使用。不需要 beta 标头。computer_20250124:更新后的计算机使用工具,新增了命令选项,包括 "hold_key"、"left_mouse_down"、"left_mouse_up"、"scroll"、"triple_click" 和 "wait"。此工具需要 "computer-use-2025-01-24" anthropic-beta 标头。 请在使用 Claude 进行工具使用中了解更多信息。
2025 年 2 月 10 日
- 我们在所有 API 响应中新增了
anthropic-organization-id响应标头。该标头提供与请求中所用 API 密钥关联的组织 ID。
2025年1月31日
- 我们已将 Java SDK 从 alpha 阶段升级到 beta 阶段。
2025年1月23日
- 我们在 API 中推出了"citations"(引用)功能,使 Claude 能够为信息提供来源归属。在引用中了解更多信息。
- 我们在 Messages API 中添加了对纯文本文档和自定义内容文档的支持。
2025年1月21日
- 我们宣布"deprecation"(弃用)Claude 2、Claude 2.1 和 Claude Sonnet 3 模型。在模型弃用中阅读更多信息。
2025年1月15日
- 我们更新了"prompt caching"(提示缓存),使其更易于使用。现在,当您设置"cache breakpoint"(缓存断点)时,我们将自动从您之前缓存的最长前缀中读取。
- 现在,您在使用工具时可以预先替 Claude 写好部分回复内容。
2025年1月10日
- 我们优化了对 Message Batches API 中的提示缓存的支持,以提高"cache hit rate"(缓存命中率)。
2024年12月19日
- 我们在 Message Batches API 中添加了对"delete endpoint"(删除端点)的支持。
2024年12月17日
以下功能现已在 Claude API 中可用,无需"beta header"(beta 标头):
- Models API:查询可用模型、验证模型 ID,并将"model aliases"(模型别名)解析为其规范模型 ID。
- Message Batches API:以标准 API 费用的 50% 异步处理大批量消息。
- Token counting API(令牌计数 API):在将消息发送给 Claude 之前计算其"token"(令牌)数量。
- Prompt Caching(提示缓存):通过缓存和重用提示内容,将成本降低多达 90%,并将"latency"(延迟)降低多达 80%。
- PDF support(PDF 支持):处理 PDF,以分析文档中的文本和视觉内容。
我们还发布了新的官方 SDK:
2024年12月4日
- 我们在 Developer Console 的 Usage(使用量)和 Cost(费用)页面上添加了按 API 密钥分组的功能。
- 我们在 Developer Console 的 API keys(API 密钥)页面上新增了 Last used at 和 Cost 两列,并支持按任意列排序。
2024年11月21日
- 我们发布了 Admin API,允许用户以编程方式管理其组织的资源。
2024年11月20日
- 我们更新了 Messages API 的"rate limit"(速率限制)。我们已将每分钟令牌数速率限制替换为新的每分钟输入令牌数和每分钟输出令牌数速率限制。在速率限制中阅读更多信息。
- 我们在 Workbench 中添加了对"tool use"(工具使用)的支持。
2024年11月13日
- 我们为所有 Claude Sonnet 3.5 模型添加了 PDF 支持。在 PDF 支持中阅读更多信息。
2024年11月6日
- 我们已停用 Claude 1 和 Instant 模型。在模型弃用中阅读更多信息。
2024年11月4日
- Claude Haiku 3.5 现已作为纯文本模型在 Claude API 上提供。
2024年11月1日
- 我们添加了 PDF 支持,可与新的 Claude Sonnet 3.5 配合使用。在 PDF 支持中阅读更多信息。
- 我们还添加了令牌计数功能,让您可以在将消息发送给 Claude 之前确定其中的令牌总数。在令牌计数中阅读更多信息。
2024年10月22日
- 我们在 API 中添加了 Anthropic 定义的"computer use"(计算机使用)工具,可与新的 Claude Sonnet 3.5 配合使用。在计算机使用工具中阅读更多信息。
- Claude Sonnet 3.5 是我们迄今为止最智能的模型,它刚刚完成升级,现已在 Claude API 上提供。在 Claude Sonnet 文档中阅读更多信息。
2024年10月8日
- Message Batches API 现已推出 beta 版。在 Claude API 中异步处理大批量查询,成本降低 50%。在"batch processing"(批处理)中阅读更多信息。
- 我们放宽了 Messages API 中对
user/assistant轮次顺序的限制。连续的user/assistant消息将被合并为一条消息,而不会报错,并且我们不再要求第一条输入消息必须是user消息。 - 我们已弃用 Build 和 Scale 计划,改为提供标准功能套件(以前称为 Build),以及可通过销售团队获得的附加功能。在我们的 API 定价信息中阅读更多信息。
2024年10月3日
- 我们添加了在 API 中禁用"parallel tool use"(并行工具使用)的功能。在
tool_choice字段中设置disable_parallel_tool_use: true,以确保 Claude 最多使用一个工具。在并行工具使用中阅读更多信息。
2024年9月10日
- 我们在 Developer Console 中添加了"Workspaces"(工作区)。工作区允许您设置自定义支出限制或速率限制、对 API 密钥进行分组、按项目跟踪使用情况,并通过用户角色控制访问权限。在我们的博客文章中阅读更多信息。
2024年9月4日
- 我们宣布弃用 Claude 1 模型。在模型弃用中阅读更多信息。
2024年8月22日
- 我们通过在 API 响应中返回"Cross-Origin Resource Sharing"(跨源资源共享),即 CORS 标头,添加了对在浏览器中使用 SDK 的支持。在 SDK 实例化时设置
dangerouslyAllowBrowser: true即可启用此功能。
2024年8月19日
- Claude Sonnet 3.5 上的 8,192 令牌输出已结束 beta 阶段,不再需要
max-tokens-3-5-sonnet-2024-07-15标头。
2024年8月14日
- 提示缓存现已作为 beta 功能在 Claude API 中提供。缓存并重用提示,可将延迟降低多达 80%,并将成本降低多达 90%。
2024年7月15日
- 使用新的
anthropic-beta: max-tokens-3-5-sonnet-2024-07-15标头,从 Claude Sonnet 3.5 生成长度最多为 8,192 个令牌的输出。
2024年7月9日
- 在 Developer Console 中使用 Claude 为您的提示自动生成"test cases"(测试用例)。
- 在 Developer Console 新的输出比较模式中并排比较不同提示的输出。
2024年6月27日
- 在 Developer Console 新的 Usage(使用量)和 Cost(费用)标签页中,查看按美元金额、令牌数量和 API 密钥细分的 API 使用情况和账单。
- 在 Developer Console 新的 Rate Limits(速率限制)标签页中查看您当前的 API 速率限制。
2024年6月20日
- Claude Sonnet 3.5 是我们迄今为止最智能的模型,现已在 Claude API、Amazon Bedrock 和 Vertex AI 上提供。
2024年5月30日
- 工具使用已在 Claude API、Amazon Bedrock 和 Vertex AI 上结束 beta 阶段,无需 beta 标头。
2024年5月10日
- 我们的"prompt generator"(提示生成器)工具现已在 Developer Console 中提供。Prompt Generator 让您可以轻松引导 Claude 生成针对您特定任务量身定制的高质量提示。在我们的博客文章中阅读更多信息。
Was this page helpful?