核心约定:全程你只在对话框说话,所有文件由 agent 建、agent 写。你从不手动开文件夹。
零基础最容易搞错的一件事:第 1 到第 7 步的所有指令,全部发在同一个 00-总控 对话里,一条接一条往下发,中间不要开新对话。只有到第 8 步才会新建别的对话。
指令发给谁 · 总表
| 指令 | 发在哪个对话 | 什么时候发 |
| 指令 1 立项 | 00-总控 | 这个对话的第一条消息 |
| 指令 2 调研 | 00-总控 同一个对话 | 它问完三轮、你答完之后 |
| 指令 3 出方案 | 00-总控 同一个对话 | 你接受调研结果之后 |
| 指令 4 闸门①自检 | 00-总控 同一个对话 | 它给出方案之后,你自己先别读 |
| 指令 5 打回 | 00-总控 同一个对话 | 自检表里有「不通过」时 |
| 指令 6 建目录 | 00-总控 同一个对话 | 六项自检全过之后 |
| 指令 7 生成启动指令 | 00-总控 同一个对话 | 目录建完、你确认完那 5 处之后 |
| 指令 8 开工 | 新建的部门对话 | 粘完《启动指令》之后的第二条消息 |
| 指令 9 闸门②自检 | 同一个部门对话 | 它交付产物之后 |
| 指令 10 补漏 | 同一个部门对话 | 自检发现有隐藏步骤时 |
| 指令 11 复盘 | 回 00-总控 | 一条链跑通之后 |
| 指令 12 派子 agent | 00-总控 | 某部门跑通多次、要批量时 |
| 指令 13 重置 | 出问题的那个对话本身 | 同一问题拉扯超过 3 轮时 |
| 指令 14 每周沉淀 | 00-总控 | 每周固定一次 |
四条原则
不许动手先复述理解、列风险、提问,确认后才产出。第一轮改的成本是零
一条路走到底最窄的链从头跑通再加宽。各做一半 = 没有一条路能验证
3 次才固化做满 3 次且步骤不变才写 skill。提前写的是想象
对话可以丢,提示词不能丢对话是运行实例,提示词文件才是资产
五种东西的定位
| 东西 | 是什么 | 什么时候出现 | 判据 |
| 部门 | 一种产物 = 一个职能 | 第 4 步方案里定 | 输出物不同就必须是不同部门 |
| 插件 / 工具 | 部门碰外部系统的手 | 第 3 步调研就要定 | 要读写外部文档、抓网页、发消息 |
| 分支 | 同部门的不同方案 | 随时 | 我要同时保留两个结果吗 |
| 子 agent | 同部门的并行副本 | 第 12 步扩展阶段 | 已跑通 + 能自证对错 + 真要并行 |
| skill | 同部门做熟了的固化 | 第 3 次之后 | 步骤已经不再变 |
关键顺序:插件在最前,子 agent 在最后。插件是能力前提——某个部门必须读外部文档而你没有连接器,那个部门根本建不起来。子 agent 是扩容手段——部门自己都没跑通,拆成三个并行只会同时错三份。
主流程(点开看指令)
附录
四个痛点 → 四个机制
| 你的痛点 | 真正的根因 | 机制 | 在第几步 |
| 老说重复话 | 约束散落在对话各处,它只记得最近几轮。你纠正一次,下轮又忘 | 约束编号化。所有约束编号 C1、C2…,每轮输出前它必须原样贴回并逐条打勾。以后你只报编号 | 第 0 步 + 第 3 步 |
| AI 犯低级错误 | 低级错几乎都是「它没回读」,不是「它不会」。一次性生成,从不检查自己 | 强制自检 + 引用证据,再加一份会累积的低级错误清单,每次交付前逐条扫 | 第 6 步 + 第 7 步 |
| AI 不懂我要干嘛 | 你给的是形容词,它需要的是样例。语言描述的歧义空间极大 | 一个正例 + 一个反例。没有正例就让它造 3 个候选,你选 1 个当锚 | 第 0 步 + 第 2 步 |
| 一直打太极 | 任务大而模糊时,它的安全策略是给通用框架——听起来对,但没一句能用 | 正向输出规则 + 可用占比自评。禁词是黑名单,追不上语义变体;改成规定形状,再让它自报「能直接复制走的内容占比」 | 第 4 步 |
| 它问的问题我答不上来 | 让人从零填空本身就是设计错误。你脑子里有判断力,但没有现成的表述 | 它起草,你增删。你只填三项,其余由它替你拟草稿;它以后问你话一律给 2–4 个选项 + 推荐值 | 第 0 步 + 第 1 步 |
整套 SOP 的核心是一张表:《本次口径》。它把散在对话里的约束固定成带编号的清单,每轮回带。有了它,你纠错从「再解释一遍我想要什么」变成「违反 C3,重做」——这是把重复劳动降到最低的唯一办法。
全程在同一个对话里完成。这是单任务,不建文件夹、不开部门、不做 skill。中途换对话,《本次口径》就丢了,你又要从头解释一遍。
主流程(点开看指令)
随时可用的四把刀