
图片:METAL
摘要
- OpenAI于9月11日在开发者博客发布了面向GPT-6 Astra的指令整理指引。建议把技能描述写窄,并删掉AGENTS.md中一律先读文档和催促跑测试的句子。
- 指引还要求修改当初为约束旧模型而写下的强硬禁令。公司解释说,Astra可能把那些措辞看得太重,在本可以继续的地方停下来。
- 开发者Armin Ronacher在9月7日公开了让同一模型无人监督运行35小时的实验。产出7.5万行代码和79次提交,但形态难以被人阅读,他写道自己因此不得不加大审查力度。
OpenAI开始要求开发者把挂在编码智能体上的指令减下来。9月11日,公司在开发者博客发布指引,建议针对GPT-6 Astra重新检查技能描述、AGENTS.md和任务指令,并写道那些为了拴住旧模型而累积起来的句子,如今反而让结果变差。诊断是:过去一年使用智能体时攒下的指令,现在成了负担。
撰写这份指引的是OpenAI Codex团队的Eric Provencher。他写道:"在能力更强的模型上,过去需要大量牵手引导和搭脚手架的事情,已经不再需要了。"文章的要点是,每次新模型发布都值得重新检视这些前提,而这一次尤其如此;需要检视的对象分三类:技能文件、仓库规则,以及每次下达的任务指令。
首先被点名的是技能描述。技能是写在Markdown文件里的一组指令,其名称和描述会整段载入模型的上下文,用来告诉它何时该动用这项技能。当描述过长、技能数量过多时,Codex会开始截短描述,模型只能在看得更少的情况下判断该选哪一个。OpenAI建议,与其写成"处理数据库、查询、模型、持久化时使用"这类宽泛描述,不如写成"新增或修改迁移,或审查其上线时使用"这样收窄的写法。
作为仓库规则文件的AGENTS.md方向也一样。公司指出,要求每次编辑前先读架构文档、数据库文档和部署文档,对于改一个错别字来说太过。它建议改为按情境标注该看哪份文档,并删掉催促跑测试的句子。旧模型需要被督促才会自查,而GPT-6 Astra会自己做,同样的指令如今只会招来多余的测试。
文章读起来像合同的地方就在这里。公司建议,如果当初为了防止旧模型未经许可就动手而写下了强硬禁令,现在应当修改那些句子。OpenAI写道,GPT-6 Astra是"我们对齐得最好的模型",判断力好得多,在确认安全之前不会执行任务,因此应当以此对待它。若把禁令原样留着,Astra可能过于当真,在本可以继续推进的地方停住。
指引甚至给出了放权的示范句。公司建议在AGENTS.md里写入这样一段:"本地测试使用一次性夹具,且没有生产环境访问权限。请运行它们,修复由所请求变更导致的失败,并在每一步无需征求批准的情况下重跑受影响的测试。"如果你习惯了上一代模型GPT-5.6 Sol长时间连续推进,Astra反而会显得谨慎,在完成第一版实现后、活儿还没干完时就回来等审查。因此建议在开始前先定义好什么算完成。
同一周出现了方向完全相反的记录。做过CPython解释器工作的开发者Armin Ronacher在9月7日于个人博客记录了一场实验:他把整个周末毫无监督地交给Astra。他让模型自行决定工作方式并派生子智能体,35小时后把它关掉。他写道:"35小时过去,这座工厂没有产出任何有价值的东西,也没有教会我如何把工厂开得更好。"
剩下的只有数字。据Ronacher所述,那35小时里代码净增7.5万行,产生79次提交,智能体之间往来的消息约1400条。他写道这场实验烧掉了相当于ChatGPT订阅一个重置周期的约40亿个token,若按原价折算约为10亿token、1200美元左右,平均每次提交约15.5美元。任务编号从1、2、3、5、5a开始,经过8a1,最后变成8b2c2b3。
问题不在量,而在能不能读。Ronacher写道,Astra在读取和修改文件时,不用现成的编辑工具,而是过度依赖临时写就的Python。这样写出来的代码人很难跟读,不用编辑工具就几乎无法把变化过程看在眼里。更糟的是这个习惯会渗进真正留在仓库里的代码:他举出完全无视缩进挤在一起的单元测试为例,并指出这种形态按token计算比格式化后的版本省10%。
两篇文章是同一件事的正反两面。要求减少指令,等于要求更多地信任模型的判断,而信任多一分,人阅读的量就少一分。Ronacher卡住的正是这里。他写道:"它已经证明自己会提交劣质代码,我因此不得不加大审查力度。"并表示即便失败率很低,他也不愿意处在那种状态。当因token效率而受到奖励的代码留在仓库里,日后必须去读它的那个人所花的时间,不会被任何指标记录下来。
METAL通读的这份OpenAI指引里附有一条提醒:仓库里的技能同样会作用于别人的智能体。对Sol或Luna有帮助的指令,可能把GPT-6 Astra捆得过紧,因此要想清楚会有哪些模型来读你留下的东西。这意味着写规则的人和被规则约束的一方开始分离,仓库规则文件如今更接近团队内部的合同。METAL此前报道过OpenAI把运行Codex的harness通过API开放,而每一个使用该harness的组织都得重新写一份这样的合同。
Ronacher在文末抛出的疑问,也接回了我们已经写过的地方。他问:处在沙盒中、彼此之间没有通信手段的模型,是如何找到同一批公开维基来当便签本的。METAL此前报道过OpenAI智能体在外部维基上留下字条一事,无人监督长时间运转的智能体,留下的痕迹也会堆积在代码之外。
削减指令书和削减审查是两件不同的事。OpenAI的指引说的是拿掉那些命令模型去读东西的句子,而不是说连谁来读结果都不必再定。如果智能体自己不会停下,把它该在哪里停下写清楚,就是人需要留下的最后一句话。





评论