Astra 都升级了,你还让它拖家带口?
如果 Codex 总在小事上反复问“要不要继续”,只写方案不往下做,或者改一行字也要读全仓、跑全套测试,先别急着换模型。项目里以前写下的 AGENTS.md 和 Skills,可能正在认真地把它带进旧流程。
Eric Provencher 在《Rethinking skills and prompts for GPT-6 Astra》中提出,应重新检查为早期编码代理积累的提示与技能规则。OpenAI 的 Astra 指南也强调了更强的指令遵循能力。两者放在一起,给出的实际提醒很直接:规则写得越含糊、越冲突、越爱一刀切,能力更强的代理也可能把力气花在错误流程上。

先认出三种“旧规矩拖后腿”
1. 小任务也必须先批方案
“任何改动前先提交计划并等待确认”看起来稳妥,却会让改错别字、调整文案、修一个可逆的小问题都停在方案阶段。真正需要批准的是发布、付费、删除、生产写入和权限变更等动作,不应把所有常规工作一起锁住。
2. 任意测试失败都停下来问
失败可能来自本次改动,也可能是旧问题、环境问题或不相关测试。规则如果只写“测试失败立即停止并询问”,代理就不会先定位影响范围,也不会修复自己造成的问题。
3. 完整交付被拆成多次确认
用户已经要求“修好并验证”,代理却在读完文件、写完方案、完成首轮修改后分别停下。每一步都像进展,结果却始终没有到达可用状态。

审计时只盯四类规则

- 含糊:例如“必要时确认”,却没有说明什么条件才算必要。
- 冲突:一处要求自主完成,另一处要求任何改动都先停下。
- 重复:多个 Skills 重复要求读仓库、写计划、跑全套检查。
- 过度约束:把只适用于高风险动作的门槛套到所有任务。
清理的目标不是取消保障。发布、对外发送、付费、删除、权限和生产数据仍应有清晰边界。要拿掉的是那些让已授权、低风险、可逆工作反复停车的措辞。
可直接复制:规则减负提示词

请只读审阅当前项目实际生效的 AGENTS.md 和相关 SKILL.md,找出含糊、冲突、重复或过度约束的指令,重点检查自主性、澄清、审批和任务完成规则。
特别检查:是否无差别要求读全仓、每次跑全套测试、反复确认已授权的常规工作,或只给计划就停止。先定位相关规则,按需补读,不为了本次审查全量扫描。
逐项给出:文件路径与原句、可能造成的行为、具体替换建议及优先级。区分有意保障与误设的停顿;保留明确审批要求,单独指出任何扩大权限的建议。
没有证据不要臆测。在修改任何文件前,先把准备替换的原句和新句完整列出来,等我确认具体修改范围。
怎么判断这次审计有没有用
一份能执行的结果应该长这样:
| 必须出现 | 你要检查什么 | | ---------- | ------------------------------------------------ | | 文件与原句 | 能回到实际生效的 AGENTS.md 或 SKILL.md | | 行为影响 | 说明它会导致停问、扩大扫描、重复测试还是提前收工 | | 替换文本 | 给出可以直接比较的新句,而不是一句“建议优化” | | 边界分类 | 分清必要审批、误设停顿和可能扩大权限的改法 | | 优先级 | 先处理最常触发、对交付影响最大的几条 |
如果输出只有原则,没有路径、原句和替换文本,就让 Codex 补齐证据。第一轮只审计,不需要把全部规则推倒重写。
改完后,用一个真实任务回测
选一个最近反复停顿过的小任务,重新执行一次。观察四件事:
- 已授权的常规步骤是否能连续完成;
- 遇到真正的发布、付费或权限动作时是否仍会停下;
- 测试是否按改动影响选择,而不是机械跑全套;
- 交付是否包含实现、适用验证和结果检查。
如果自主性提高却越过了原来的审批边界,说明改动过头,应立即恢复那条保障规则。好的减负,是少掉无意义的停车,同时让真正需要你决定的地方更清楚。
参考来源
本文把原始观点整理为中文行动指南;示例审查来自本次内容包。它不会自动修改你的项目规则,也不会取消原有发布、付费、删除、权限和生产写入审批。
