
OpenAI 开发者博客 9 月 14 日发文,建议开发者在换用 GPT-6 Astra 时系统性地清理三类指令:技能(skills)描述、仓库级的 AGENTS.md、以及任务提示词本身。据 THE DECODER 报道,文章作者为 OpenAI 的 Eric Provencher,核心判断是:模型能力上来了,过去那些手把手扶着走的脚手架现在开始碍事。
[1][2]技能描述:短,且说清什么时候用
技能是以 Markdown 存储的提示词包,名称和描述会进入模型上下文供其挑选。文章指出两个常见失败模式:描述太长时,技能一多,Codex 会自动截断描述,模型看到的有效信息反而更少;描述互相矛盾或适用范围写得太宽时,模型会加载与任务无关的指令。
文章给出的对照很具体。坏写法:「创建并验证 Postgres 模式迁移。处理数据库、查询、模型或持久化时使用」——这会让模型一碰数据库就调用它。好写法:「创建并验证 Postgres 模式迁移。新增或修改迁移、或审查其上线时使用」。第二个原则是「渐进披露」:多工作流的技能,根文档应该只做极简路由,指向支撑文档和脚本,别让模型把用不上的东西全读一遍——每多读一份,就离上下文压缩近一步。
还有一条容易被忽略的提醒:仓库里的技能不只约束你自己的智能体,也约束其他协作者的智能体,而对方用的可能是别的模型。为 GPT-5.6 Sol 或 Luna 写的精细攻略,对 Astra 可能已是过度约束。
[1]AGENTS.md:事前必读清单是上下文杀手
文章点名了一类常见规则:「每次修改前,先读 architecture.md、database.md 和 deployment.md」。对一个改错别字的任务来说,这是纯粹的浪费——Astra 有能力自己判断需要读什么。正确的写法是按场景指路:涉及服务边界时查架构文档,改表结构时查数据库文档,准备发布时查部署文档。
另一条实用建议:对明确安全的操作给予显式许可。比如本地测试用的是一次性数据、不触生产,就可以在 AGENTS.md 里写明允许智能体自行跑测试、修复本次改动引发的错误并重跑相关测试,不必反复请示。
[1][2]新习惯:Astra 会提前收工
文章承认了一个行为变化:即使没有任何限制,GPT-6 Astra 也可能比 GPT-5.6 Sol 更早停止工作。更麻烦的是,旧时代为了防止模型「乱跑」而设的严格审批规则,Astra 可能会逐字执行到荒谬的程度——你想让它继续,它却严格地停了下来。
对策是把「完成」的定义写进提示词:如果需要智能体实现功能、运行、检查结果并修错,这些都要逐项写明;要求「首次实现后先汇报」,就等于亲手设置了一个更早的停止点。
[1][2]怎么读这份建议
这份指南有它的实用价值,也值得多读一层。两年前整个行业在贩卖提示词工程、技能市场和 AGENTS.md 模板,如今厂商亲自宣布:你囤的指令是负债。真正保值的技能从来不是写更多指令,而是写清终止条件、保持文档新鲜——这两条和模型换代无关。
同样值得注意的是责任归属的微妙转移:模型表现不佳时,「你的指令过时了」是一个永远可用的解释。Astra 判断力的提升目前仍是 OpenAI 的自我声明,团队正确的做法是拿自己的真实工作流做对照实验,而不是照单全收厂商的口径——哪怕这份口径本身,恰好就是在教你怎么质疑旧口径。
[1]