METAL for iPhone

AI 新闻, 现在用 App 阅读。

下载 METAL, 每天发现最新 AI 报道。

在 App Store 下载

iPhone 应用 · 免费下载

也可在 iPhone 的 App Store 中搜索 METAL AI Magazine。

METAL

Claude Managed Agents 推出动态工作流

Anthropic 在 Claude Managed Agents 中以公开测试版推出动态工作流。由主智能体编写的程序可在一次运行中分阶段调度多达 1000 个智能体,并汇总结果。

Claude Managed Agents 推出动态工作流

图片:@ClaudeDevs (X)(视频截图)

摘要

  • Anthropic 于 10 月 9 日以公开测试版发布 Claude Managed Agents 的动态工作流。
  • 服务器在后台执行智能体编写的程序,单次运行的上限为同时 64 个线程、累计 1000 个智能体、默认寿命 24 小时。
  • 运行本身不单独收费,智能体消耗的 token 按各模型费率计费;会话达到预算时,所有未结束的运行都会暂停。
Claude Managed Agents dynamic workflows are now available in public beta

Anthropic 在面向企业的托管智能体服务 Claude Managed Agents 中以公开测试版推出了动态工作流(dynamic workflows)。公司开发者账号 @ClaudeDevs 于 10 月 9 日在 X 上将其介绍为"一种新型的多智能体编排,为你最具雄心的工作负载而打造"。主智能体把计划写成程序,该计划分阶段调度多个智能体,最后汇总结果。这条帖子在不到一天内浏览量就超过 36 万次。

核心变化在于由谁来指挥工作。Anthropic 在平台文档中将工作流定义为"智能体为运行多个智能体并汇总它们的返回结果而编写的程序"。在原有的子智能体方式下,主智能体逐轮分派任务并亲自阅读报告。而在动态工作流中,由智能体编写的程序决定接下来运行哪些智能体,甚至为它们撰写提示词。每个智能体的结果返回给程序,而不是主智能体。服务器在后台将该程序作为一次工作流运行(workflow run)执行期间,主智能体可以继续与用户对话,也可以结束本轮。

一次运行分为阶段(phase)和智能体线程。阶段是带有名称的工作区段,例如"阅读合同",程序在每个阶段内同时启动多个智能体。每个智能体在各自的会话线程中工作,所有线程共享会话沙箱中的同一批文件。程序还可以让草稿反复修改直到通过审查,或单独处理失败的智能体。智能体既可以是工作流当场定义的内联智能体,也可以是开发者事先登记的智能体。内联智能体使用与会话智能体相同的模型,工具和 MCP 服务器则在会话智能体已有的范围内分配。

文档给出的示例是 300 份合同。当用户要求找出含有控制权变更条款的合同时,智能体会启动"阅读合同"和"核对结果"两个阶段的运行,运行结束后回答 300 份中有 41 份含有该条款。METAL 查看的 58 秒官方介绍视频也展示了同样的场景:智能体面对 300 份合同编写工作流,服务器在后台运行后返回汇总结果。

规模有明确的数字上限。一次运行中同时工作的线程最多 64 个,一次运行在整个生命周期内最多可启动 1000 个智能体,超出时运行以 thread_limit_error 结束。运行寿命默认 24 小时,智能体可以设定更短的时间。一个会话默认最多同时开启 10 个运行。只有会话主线程上的智能体才能启动运行,因此运行内部的智能体无法再嵌套开启新的运行。

成本结构也写在文档中。运行本身没有单独价格,其智能体消耗的 token 与会话中的其他 token 一样按各模型费率计费。会话达到预算时,所有未结束的运行都会暂停,提高或取消预算后会恢复运行。不过每个线程已经发出的模型请求会处理完毕,因此运行可能按工作线程数各超出一次请求的预算。据报道,Managed Agents 的运行费用按运行状态下每会话小时 0.08 美元计算,网页搜索每 1000 次 10 美元。文档还指出,运行以 completed 结束并不代表工作通过。失败的工作只能通过阅读各线程的事件来发现。

앤스로픽 플랫폼 문서의 워크플로 런 상한 표. 한 런의 동시 스레드 64개, 런 생애 에이전트 1000개, 기본 수명 24시간, 세션당 동시 런 10개와 각 상한에 닿았을 때의 동작

同名功能最早出现在 Claude Code 中。根据 Anthropic 的 Cookbook,在 Claude Code 的动态工作流中,Claude 编写 JavaScript 编排脚本并交给 Workflow 工具,本地运行时最多同时运行 16 个智能体,并将单次运行限制在 1000 个智能体。Cookbook 运行了一个将投资者报告草稿中的 10 项陈述与原始资料核对的示例,耗时 2.5 分钟、花费 3.29 美元,并在发现细微的引用差异后写道:"这种精确来自工作流的结构,而不是更聪明的模型。"此次公开测试版把这种方式从开发者的笔记本电脑搬到了 Anthropic 的服务器上。

开发者需要做的是在智能体定义的 multiagent 块中开启 workflows 设置。据报道,该功能通过 managed-agents-2026-04-01 测试版请求头和 multiagent_20261001 类型启用,在该类型下工作流和子智能体默认开启。何时启动运行仍由智能体判断,因此需要在提示词中写明在什么情况下使用运行。工作流代码本身对开发者不可见,需要向智能体请求才能查看。

METAL 此前曾报道三位创始人使用 Claude Managed Agents 的方法。此次公开测试版把单个会话能够调度的单位从几个智能体扩展到数百个。一次对话装不下的数百份文档审查由服务器上的程序分工承担,人则同时核对结果和账单。剩下的问题是,1000 个智能体给出的答案是否相应地比单个智能体更准确,以及由谁、用什么方法来衡量这种差距。

评论