Agent SOP

核心约定:全程你只在对话框说话,所有文件由 agent 建、agent 写。你从不手动开文件夹。
零基础最容易搞错的一件事:第 1 到第 7 步的所有指令,全部发在同一个 00-总控 对话里,一条接一条往下发,中间不要开新对话。只有到第 8 步才会新建别的对话。

指令发给谁 · 总表

指令发在哪个对话什么时候发
指令 1 立项00-总控这个对话的第一条消息
指令 2 调研00-总控 同一个对话它问完三轮、你答完之后
指令 3 出方案00-总控 同一个对话你接受调研结果之后
指令 4 闸门①自检00-总控 同一个对话它给出方案之后,你自己先别读
指令 5 打回00-总控 同一个对话自检表里有「不通过」时
指令 6 建目录00-总控 同一个对话六项自检全过之后
指令 7 生成启动指令00-总控 同一个对话目录建完、你确认完那 5 处之后
指令 8 开工新建的部门对话粘完《启动指令》之后的第二条消息
指令 9 闸门②自检同一个部门对话它交付产物之后
指令 10 补漏同一个部门对话自检发现有隐藏步骤时
指令 11 复盘00-总控一条链跑通之后
指令 12 派子 agent00-总控某部门跑通多次、要批量时
指令 13 重置出问题的那个对话本身同一问题拉扯超过 3 轮时
指令 14 每周沉淀00-总控每周固定一次

四条原则

不许动手先复述理解、列风险、提问,确认后才产出。第一轮改的成本是零
一条路走到底最窄的链从头跑通再加宽。各做一半 = 没有一条路能验证
3 次才固化做满 3 次且步骤不变才写 skill。提前写的是想象
对话可以丢,提示词不能丢对话是运行实例,提示词文件才是资产

五种东西的定位

东西是什么什么时候出现判据
部门一种产物 = 一个职能第 4 步方案里定输出物不同就必须是不同部门
插件 / 工具部门碰外部系统的手第 3 步调研就要定要读写外部文档、抓网页、发消息
分支同部门的不同方案随时我要同时保留两个结果吗
子 agent同部门的并行副本第 12 步扩展阶段已跑通 + 能自证对错 + 真要并行
skill同部门做熟了的固化第 3 次之后步骤已经不再变
关键顺序:插件在最前,子 agent 在最后。插件是能力前提——某个部门必须读外部文档而你没有连接器,那个部门根本建不起来。子 agent 是扩容手段——部门自己都没跑通,拆成三个并行只会同时错三份。

主流程(点开看指令)

附录

四个痛点 → 四个机制

你的痛点真正的根因机制在第几步
老说重复话约束散落在对话各处,它只记得最近几轮。你纠正一次,下轮又忘约束编号化。所有约束编号 C1、C2…,每轮输出前它必须原样贴回并逐条打勾。以后你只报编号第 0 步 + 第 3 步
AI 犯低级错误低级错几乎都是「它没回读」,不是「它不会」。一次性生成,从不检查自己强制自检 + 引用证据,再加一份会累积的低级错误清单,每次交付前逐条扫第 6 步 + 第 7 步
AI 不懂我要干嘛你给的是形容词,它需要的是样例。语言描述的歧义空间极大一个正例 + 一个反例。没有正例就让它造 3 个候选,你选 1 个当锚第 0 步 + 第 2 步
一直打太极任务大而模糊时,它的安全策略是给通用框架——听起来对,但没一句能用正向输出规则 + 可用占比自评。禁词是黑名单,追不上语义变体;改成规定形状,再让它自报「能直接复制走的内容占比」第 4 步
它问的问题我答不上来让人从零填空本身就是设计错误。你脑子里有判断力,但没有现成的表述它起草,你增删。你只填三项,其余由它替你拟草稿;它以后问你话一律给 2–4 个选项 + 推荐值第 0 步 + 第 1 步
整套 SOP 的核心是一张表:《本次口径》。它把散在对话里的约束固定成带编号的清单,每轮回带。有了它,你纠错从「再解释一遍我想要什么」变成「违反 C3,重做」——这是把重复劳动降到最低的唯一办法。
全程在同一个对话里完成。这是单任务,不建文件夹、不开部门、不做 skill。中途换对话,《本次口径》就丢了,你又要从头解释一遍。

主流程(点开看指令)

随时可用的四把刀

内容最后更新:2026-07-29