September 29, 2025 Product announcements

管理 Claude Developer Platform 上的上下文

介绍上下文编辑和 memory tool,帮助开发者构建更有效、能处理长时间任务的 Agent。

今天,我们在 Claude Developer Platform 上推出用于管理 Agent 上下文的新能力:上下文编辑和 memory tool。

借助我们的最新模型 Claude Sonnet 4.5,这些能力让开发者可以构建 AI Agent,以更高性能处理长时间运行的任务,同时不会撞上上下文限制,也不会丢失关键信息。

上下文窗口有限,但真实工作没有固定边界

当生产环境中的 Agent 处理更复杂的任务、产生更多工具结果时,它们往往会耗尽有效上下文窗口,让开发者不得不在裁剪 Agent 对话记录和牺牲性能之间做选择。上下文管理通过两种方式解决这个问题:帮助开发者确保只有相关数据留在上下文中,同时把有价值的洞察跨会话保存下来。

当接近 token 限制时,上下文编辑会自动从上下文窗口中清除过时的工具调用和结果。随着 Agent 执行任务并积累工具结果,上下文编辑会移除陈旧内容,同时保留对话流,从而有效延长 Agent 无需人工干预即可运行的时间。这也会提升模型的有效表现,因为 Claude 能只关注相关上下文。

memory tool 让 Claude 能通过基于文件的系统,在上下文窗口之外存储和查询信息。Claude 可以在你的基础设施中一个专用 memory 目录里创建、读取、更新和删除文件,并让这些文件跨对话持久保留。这使 Agent 能随时间建立知识库、跨会话维护项目状态,并引用以前学到的内容,而不必把所有信息都塞进上下文。

memory tool 完全通过工具调用在客户端运行。开发者负责管理存储后端,因此可以完全控制数据存放在哪里,以及如何持久化。

Claude Sonnet 4.5 通过内置上下文感知增强了这两项能力:它会在整个对话过程中跟踪可用 token,从而更有效地管理上下文。

这些更新结合起来,形成了一套提升 Agent 性能的系统:

• 自动从上下文中移除过时工具结果,从而支持更长对话

• 把关键信息保存到 memory 中,提高准确性,并把这些学习结果带到后续 Agent 会话中

构建长时间运行的 Agent

Claude Sonnet 4.5 是构建 Agent 的世界顶级模型。这些功能为长时间运行的 Agent 打开了新的可能性:处理整个代码库、分析数百份文档,或者维护大量工具交互历史。上下文管理建立在这一基础之上,确保 Agent 能高效利用扩展后的能力,同时处理任何固定限制之外的工作流。用例包括:

• 编码:上下文编辑会清理旧的文件读取和测试结果,而 memory 会保存调试洞察和架构决策,让 Agent 能在大型代码库上持续工作而不丢进度。

• 研究:memory 保存关键发现,上下文编辑移除旧搜索结果,从而构建随时间提升表现的知识库。

• 数据处理:Agent 把中间结果存入 memory,同时上下文编辑清除原始数据,用来处理原本会超过 token 限制的工作流。

上下文管理带来的性能提升

在一个 Agentic 搜索内部评估集上,我们测试了上下文管理如何改善 Agent 在复杂多步骤任务上的表现。结果显示收益显著:memory tool 与上下文编辑结合使用,相比基线性能提升 39%;单独使用上下文编辑也带来 29% 的提升。

在一项 100 轮网页搜索评估中,上下文编辑让 Agent 完成了原本会因上下文耗尽而失败的工作流,同时将 token 消耗减少了 84%。

开始使用

这些能力今天已在 Claude Developer Platform 上以公开测试版原生提供,也可在 Amazon Bedrock 和 Google Cloud 的 Vertex AI 中使用。你可以查看上下文编辑和 memory tool 的文档,或访问我们的 cookbook 了解更多。

Anthropic 与 CATAN GmbH 或 CATAN Studio 没有关联,也未获得其认可或赞助。CATAN 商标和游戏归 CATAN GmbH 所有。

来源:https://claude.com/blog/context-management