
이미지: Claude 릴리스노트
摘要
- Claude Managed Agents会话现在可以设置预算上限(hard cap)。预算耗尽后,会话将不再发起新请求,并以budget_reached状态暂停。
- 新增顾问模型功能,使代理主线程可以在执行过程中向能力更强的模型寻求战略建议。
- 推理执行地区控制以及基于GitHub仓库的技能自动加载功能也一并上线。
会话预算上限:防止成本超支的硬性上限
Claude Managed Agents会话现在可以设置预算上限。设定的金额是按公开列表价格(public list rates)计算的硬性上限,会话一旦达到该上限,就不会再发起新的模型请求,而是以budget_reached停止原因进入暂停状态。修改或移除预算设置后,会话将自动恢复。
部署(Deployments)层级也可以设置相同的预算,该部署所启动的每个会话都会应用相同的上限。详细内容可参见官方文档中的Session budgets部分。这项功能可直接用于防止长时间运行的代理工作流出现意外的成本激增。
顾问模型:执行过程中请求战略建议
新增了顾问(advisor)功能,使会话的主线程能够在执行过程中向另一个模型寻求战略建议。被指定为顾问的模型必须与代理自身模型同级或能力更强。设置方法是在代理的多代理名单(multi-agent roster)中添加{"type": "advisor"}条目,并指定用于提供建议的模型名称。
该功能可以在单一模型难以处理的复杂判断或规划阶段,插入更强模型的判断。顾问工具还可以通过max_tokens参数限制模型的输出长度,用于降低响应延迟和输出token成本。官方文档中的Give the session an advisor部分提供了具体的配置方法说明。
推理地区控制与GitHub技能自动加载
此次更新还包含直接控制模型推理执行地区的功能。在创建代理时,可以在模型对象中设置inference_geo,也可以针对单个会话对其进行覆盖(override)。可用地区及各地区费率可参见官方文档中的Data residency部分。这项功能对于有数据主权要求的企业环境而言意义重大。
基于GitHub仓库的技能自动加载功能也一并上线。当会话挂载某个仓库后,该仓库根目录下.claude/skills目录中的技能会在会话启动时被自动发现,并可在代理中直接使用,无需另行手动注册,仅凭仓库结构即可管理技能集。
此前更新背景:代理平台的快速扩张
在8月7日更新之前,Claude Managed Agents及整个平台已连续出现多项变化。8月5日,推理钩子(Inference hooks)向Claude Enterprise组织用户推出测试版;同一天,Claude Opus 4.1模型(claude-opus-4-1-20250805)被弃用,所有请求均返回错误。Anthropic建议用户升级至Claude Opus 5,研究人员可通过外部研究者访问计划(External Researcher Access Program)申请持续访问权限。
7月,Claude Opus 5(claude-opus-5)发布,支持100万token上下文窗口和128k最大输出token,价格为输入每百万token 5美元、输出每百万token 25美元,与Claude Opus 4.8相同。此外,Claude Sonnet 5(claude-sonnet-5)在2026年8月31日前适用入门价格,输入每百万token 2美元、输出每百万token 10美元,此后将调整为输入每百万token 3美元、输出每百万token 15美元。这两款模型均支持100万token上下文窗口和128k最大输出token。

