
摘要
- Anthropic 用一段 2 分 11 秒的视频公开了内部值班工程师的一个夜晚。
- Claude Tag 扫过指标、部署记录和功能开关,约 15 分钟就锁定了原因。
- 合并和部署需要人批准,而它能触及的范围由频道决定,而不是由人决定。
深夜 11 点来了呼叫。告警说支付 API 的错误率超过了 2%,而值班工程师还什么都没做,AI 智能体 Claude Tag 就已经在挖原因了。这是 Anthropic 官方开发者账号 9 月 12 日发在 X 上那段 2 分 11 秒演示视频的第一个场景。工程师所做的全部,只是几天前说过一次:这个频道一有告警就开始排查。
这段视频展示的不是 AI 修好了故障的炫耀,而是一张权限开到哪里、又在哪里被切断的地图。Claude Tag 拉取指标、比对最近的部署、检查功能开关,但每到要合并代码或部署的那一刻,它都停在人的面前。该账号在帖子里写道:"当 Slack 里响起告警,Claude 会拉取指标、比对部署、检查开关。"并补充说,它找出可能的原因并提出修复方案,由团队批准并合并。那一句话里动词主语换手的位置,就是这个产品的设计。
在 METAL 通看的这段 2 分 11 秒视频里,时间线是这样走的。触发告警的条件是最近 5 分钟错误率超过 2%,屏幕上的当前值是 3.1%。Claude 大约 15 分钟后锁定了原因:错误从 10:58 起呈台阶式上升,就在那之前有一个功能开关被打开,而一个重发工作进程根本没有并发发送上限。
Claude 给出的修复方案是两个。一个是关掉开关,安全、不丢数据,但在有人来看之前功能会停着。另一个是给重发工作进程加上限、功能继续开着,Claude 推荐这一个,并建议从 16 开始。"有告警就排查"这条指令并不是临场说的,它作为一份常设文档被固定在那个频道里。
产品在这里停了一次。Claude 当时已经可以直接开拉取请求,但工程师事先设定成只提方案、由人来决定。于是它标记了工程师,问这样行不行,工程师用一行回答:加上限,功能保持开启。等这个回答到了,Claude 才切出一个分支、补上一个检查上限的测试,然后开了拉取请求。
屏幕上的拉取请求标题是给重发工作进程的并发发送加上限,其中增加 4 行、删除 1 行,三项检查通过。改动的值只有一个:从没有上限变成 16。视频说明,工程师亲自读了这点改动,批准并合并。
代码改动是四行。接下来,通常需要人睡前盯着曲线确认是否真的修好的那个位置,也由 Claude 接了过去。部署之后它继续盯了 10 分钟错误率,才判定已修复,并在关掉这次状况时留下一条给下次的备注:先查开关。
视频把它总结为:本来要翻遍仪表盘的一个小时,变成了 15 分钟和一次人的决定。工程师做出的判断只有一个,就是选哪个修复方案。排查和验证所花的时间转移走了,而承担责任的判断仍然留在人这一侧。
用律师的眼光看这套结构,核心在于权限并不挂在人身上。Anthropic 官方文档写道:"它能触及什么,取决于你所在的频道,而不是你是谁。"所以同一个人换了频道,可触及的范围就会变,而决定这个范围的人是 Claude 组织的所有者。文档还明确写道,Claude Tag 在起始状态下对外部系统没有任何访问权限。
所有者在配置时连接的那些服务构成一个访问集合,这个集合挂在工作区或频道上。配置的顺序是:在 Slack 里取得配对码把工作区配上,为 Claude 要工作的每个服务建账号并填入凭据,在 GitHub 仓库中挑出它可以触及的,设定每月支出上限,然后启用。文档写道,若要用于盯告警,需要 Datadog、Sentry 或 PagerDuty 这类监控连接。视频里那句"这些工具都是为这个频道连接到 Claude Tag 的自家工具",正好对得上。
Claude 留在频道里的回复下面,并排放着打开会话的链接、这次所用模型的名称,以及一个配置链接。文档解释说,点开那个配置链接可以看到管理员为该频道连接的外部服务清单,并指出组织共享频道的回复没有这个链接。它凭什么做判断,以及谁划定了那个范围,被放在了同一行里。
Claude 真正干活的地方不是用户的电脑。对话开始时会创建一个临时沙箱,用来存放代码和文件,对话安静下来后就被丢弃。而频道里发生的事会以清单的形式留在那段对话中,频道里的人都能看到。这意味着故障处理记录不是堆在某个人的工具里,而是堆在团队共同注视的地方。
钱怎么流动,也画了一条线。文档称,把 Claude 放进 Slack 本身不会产生按席位计费,频道和对话中所做的工作从组织所有者预先充入的使用余额中扣除。支出上限规定每个计费周期最多能动用这份余额的多少。私信则相反:它跑在发送者本人的 claude.ai 账号上,组织上限不适用,而所有者可以在整个组织范围内关闭私信。
可用的范围也很窄。Claude Tag 处于公开测试阶段,仅在 Team 和 Enterprise 方案、以及 Anthropic 第一方服务上运行。Free、Pro、Max 这类个人方案用不了,第三方部署也不行。频道里做的工作计费给组织而不是个人,而在那个频道里的任何人都可以马上把活交给它。
Anthropic 先把自家产品用在自家团队上,并不是新鲜事。METAL 曾报道过,在 Slack 里用的 Claude Tag 要进入 Claude Desktop。这段视频是这条线上最具体的一个场景,把公司内部真实运转的值班之夜原样拍了出来。未经批准就行动的智能体能干出什么,METAL 曾以公共仓库 RubyGems 事件梳理过,而这个产品之所以在合并和部署前面站一个人,原因就在那里。
这条帖子获得 191,415 次浏览、1,710 个赞、98 次转发和 91 条回复。该账号写道:"每一分钟都很宝贵,所以我们很喜欢它立刻就开始动手。"不过视频展示的是一次顺利的运行,并没有收录 Claude 判断错原因时会发生什么。文档之所以把频道权限和人工批准叠上好几层,原因正在这里。
这次演示的价值不在 15 分钟这个数字,而在这 15 分钟结束的位置。排查和观察可以整块交出去,只有合并代码和部署的那一刻必须留在人手里。把权限挂在频道而不是挂在人身上的设计守住了那条线,而线画在哪里,由所有者在设置界面决定。值班之夜里消失的不是判断,而是翻遍仪表盘的那一个小时。





评论