Agent SOP
核心约定:全程你只在对话框说话,所有文件由 agent 建、agent 写。你从不手动开文件夹。
零基础最容易搞错的一件事:第 1 到第 7 步的所有指令,全部发在同一个 00-总控 对话里,一条接一条往下发,中间不要开新对话。只有到第 8 步才会新建别的对话。
指令发给谁 · 总表
| 指令 | 发在哪个对话 | 什么时候发 |
| 指令 1 立项 | 00-总控 | 这个对话的第一条消息 |
| 指令 2 调研 | 00-总控 同一个对话 | 它问完三轮、你答完之后 |
| 指令 3 出方案 | 00-总控 同一个对话 | 你接受调研结果之后 |
| 指令 4 闸门①自检 | 00-总控 同一个对话 | 它给出方案之后,你自己先别读 |
| 指令 5 打回 | 00-总控 同一个对话 | 自检表里有「不通过」时 |
| 指令 6 建目录 | 00-总控 同一个对话 | 六项自检全过之后 |
| 指令 7 生成启动指令 | 00-总控 同一个对话 | 目录建完、你确认完那 5 处之后 |
| 指令 8 开工 | 新建的部门对话 | 粘完《启动指令》之后的第二条消息 |
| 指令 9 闸门②自检 | 同一个部门对话 | 它交付产物之后 |
| 指令 10 补漏 | 同一个部门对话 | 自检发现有隐藏步骤时 |
| 指令 11 复盘 | 回 00-总控 | 一条链跑通之后 |
| 指令 12 派子 agent | 00-总控 | 某部门跑通多次、要批量时 |
| 指令 13 重置 | 出问题的那个对话本身 | 同一问题拉扯超过 3 轮时 |
| 指令 14 每周沉淀 | 00-总控 | 每周固定一次 |
四条原则
不许动手先复述理解、列风险、提问,确认后才产出。第一轮改的成本是零
一条路走到底最窄的链从头跑通再加宽。各做一半 = 没有一条路能验证
3 次才固化做满 3 次且步骤不变才写 skill。提前写的是想象
对话可以丢,提示词不能丢对话是运行实例,提示词文件才是资产
五种东西的定位
| 东西 | 是什么 | 什么时候出现 | 判据 |
| 部门 | 一种产物 = 一个职能 | 第 4 步方案里定 | 输出物不同就必须是不同部门 |
| 插件 / 工具 | 部门碰外部系统的手 | 第 3 步调研就要定 | 要读写外部文档、抓网页、发消息 |
| 分支 | 同部门的不同方案 | 随时 | 我要同时保留两个结果吗 |
| 子 agent | 同部门的并行副本 | 第 12 步扩展阶段 | 已跑通 + 能自证对错 + 真要并行 |
| skill | 同部门做熟了的固化 | 第 3 次之后 | 步骤已经不再变 |
关键顺序:插件在最前,子 agent 在最后。插件是能力前提——某个部门必须读外部文档而你没有连接器,那个部门根本建不起来。子 agent 是扩容手段——部门自己都没跑通,拆成三个并行只会同时错三份。
主流程(点开看指令)
附录
四个痛点 → 四个机制
| 你的痛点 | 真正的根因 | 机制 | 在第几步 |
| 老说重复话 | 约束散落在对话各处,它只记得最近几轮。你纠正一次,下轮又忘 | 约束编号化。所有约束编号 C1、C2…,每轮输出前它必须原样贴回并逐条打勾。以后你只报编号 | 第 0 步 + 第 3 步 |
| AI 犯低级错误 | 低级错几乎都是「它没回读」,不是「它不会」。一次性生成,从不检查自己 | 强制自检 + 引用证据,再加一份会累积的低级错误清单,每次交付前逐条扫 | 第 6 步 + 第 7 步 |
| AI 不懂我要干嘛 | 你给的是形容词,它需要的是样例。语言描述的歧义空间极大 | 一个正例 + 一个反例。没有正例就让它造 3 个候选,你选 1 个当锚 | 第 0 步 + 第 2 步 |
| 一直打太极 | 任务大而模糊时,它的安全策略是给通用框架——听起来对,但没一句能用 | 正向输出规则 + 可用占比自评。禁词是黑名单,追不上语义变体;改成规定形状,再让它自报「能直接复制走的内容占比」 | 第 4 步 |
| 它问的问题我答不上来 | 让人从零填空本身就是设计错误。你脑子里有判断力,但没有现成的表述 | 它起草,你增删。你只填三项,其余由它替你拟草稿;它以后问你话一律给 2–4 个选项 + 推荐值 | 第 0 步 + 第 1 步 |
整套 SOP 的核心是一张表:《本次口径》。它把散在对话里的约束固定成带编号的清单,每轮回带。有了它,你纠错从「再解释一遍我想要什么」变成「违反 C3,重做」——这是把重复劳动降到最低的唯一办法。
全程在同一个对话里完成。这是单任务,不建文件夹、不开部门、不做 skill。中途换对话,《本次口径》就丢了,你又要从头解释一遍。
主流程(点开看指令)
随时可用的四把刀
C 版 = B 版的全部机制,但流程从 10 步降到 1 步。做法不是删内容,而是把「你要记得发的步骤」改写成「它自动执行的规则」。B 版有的每一样,下面的对照表逐条列出它在 C 版的哪一条。
开场指令很长,但那是给 AI 读的,你只需要复制一次。第一条消息是唯一一次全新的上下文,它决定了后面每一轮的表现。宁可第一条长,也不要后面反复补规则。
第一步 · 发这一条(整个任务只发一次)
覆盖对照表:B 版的每一样在 C 版哪里
| B 版的机制 | 在 C 版的位置 | 谁来触发 |
| 第 0 步 · 三项必填 + 它替你起草 | 开场指令 · 第二件 | 你发一次 |
| 第 0 步 · 查有没有现成的(五类) | 开场指令 · 第一件 | 它主动做 |
| 第 0 步 · 砍范围 / 20% 力气 80% 目的 | 开场指令 · 第一件 | 它主动做 |
| 第 0 步 · 流程守卫(口径没冻不许出活) | R5 末尾 | 它自己守 |
| 第 1 步 · 改草稿、选选项 | R4 + R1 导航 | 它带着你 |
| 第 2 步 · 造锚(3 个候选样本) | 开场指令 · 第二件末尾 | 你说不对时它自动给 |
| 第 3 步 · 冻结口径(两级 / 来源可追溯 / 冲突指出 / 每 3 段复核) | R5 完整保留 | 它自动出表 |
| 第 4 步 · 任务类型分流(执行型 / 探索型) | R7 | 它自己判断 |
| 第 4 步 · 输出规则 + 可用占比自评 | R7 | 它每段自评 |
| 第 5 步 · 分段交付(4 条判据 / 先给计划 / 超 5 段提醒拆任务) | R8 完整保留 | 它自动分段 |
| 第 6 步 · 反向自检(自我举报 / 引用证据 / 存疑 / 查流程漏洞) | R9 完整保留 | 每段自动做 |
| 第 7 步 · 低级错误清单 | R10 | 它自动记,不用你发指令 |
| 第 8 步 · 最终验收 + 段间漂移检查 | R11 | 做完自动执行 |
| 第 9 步 · 导出通用错误清单 | R11 末尾 | 验收后自动导出 |
| 刀 1 纠错 | 卡 4 | 你发 |
| 刀 2 急停 | 卡 5 | 你发 |
| 刀 3 重置 | 卡 6 + R12 主动提醒 | 它先提醒,你发 |
| 刀 4 止损 | 卡 7 + R12 主动提醒 | 它先提醒,你发 |
| C 版新增 · 每次告诉你下一句发什么 | R1 | 它每次都写 |
| C 版新增 · 树状工作图 | R6 | 它自动更新 |
| C 版新增 · 一句话说清这轮完成了什么 | R2 ① | 它每次都写 |
| C 版新增 · 换对话不丢记忆 | 卡 2 | 你发 |
你会看到的回复长这样
【这轮做完了什么】
起草了 5 条约束(C1–C5),查到 2 个现成模板可以直接用
【产物】
...(正文内容)
本段我能直接被复制走使用的内容占比约 88%
【我不确定的】
1. 开头用不用第一人称?推荐:用。A 用 / B 不用
【口径自检】
C1 已遵守 · C2 已遵守 · C3 本轮不涉及 ...
【工作图】
任务:把 8 月选题做成 3 版脚本
├─ ✓ 口径已冻结(C1–C7)
├─ ✓ 分段计划(共 4 段)
├─ ▶ 第 1 段:开头钩子 ← 现在在这
├─ ○ 第 2 段:主体演示
└─ ○ 最终验收
【下一步】
请从上面 3 个选项里选一个,直接回数字。选不出来就发:"你定"
每一次回复都长这样,你永远知道三件事:它刚做完什么、现在走到哪、下一句该发什么。
如果哪次漏了【下一步】,直接回一句「你违反了 R1」。
七张救急卡(卡住时用)
交接到新对话:为什么要分两份
| 交接什么 | 怎么给 | 为什么 |
| 规则 + 口径表 + 错误清单 + 工作图 + 下一步 | 粘贴在正文里 | 必须字字被读到。粘在正文的内容 100% 进它脑子 |
| 已完成的产物(脚本正文、表格、稿子) | 存成文件上传 | 体量大,查得到就够,不占开场篇幅 |
不能全用文件。上传的附件 AI 不一定会完整读完——很多工具是「用到哪查哪」。产物这样没问题;但规则只被读进去一半等于没有规则,它可能读到了 R5 却漏掉 R1,于是又不告诉你下一步了。
这一页是给「以后接手的 AI」看的,不是给你看的。换 Claude 账号、或者换成别的 AI 工具时,把下面那条启动指令粘给它,它就能安全地接着改这个网站。你自己只需要记住三步:连文件夹 → 新开对话 → 粘启动指令。
换账号三步
| 第几步 | 你做什么 | 做完的样子 |
| 1 | 在新账号里,把桌面的 sop总指令大全 文件夹连接进去 | 它能看到里面有一个 SOP.html |
| 2 | 新开一个对话(不要用旧对话) | 空白对话 |
| 3 | 粘贴下面的《启动指令》,发送 | 它会先读文件、复述禁区、提 3 个问题,然后等你下指令 |
启动指令
这套东西的三个部分,分别在哪
| 部分 | 在哪 | 谁能改 |
| 内容(你看到的所有 SOP 文字) | /Users/kaka/Desktop/sop总指令大全/SOP.html | 你和 AI |
| 自动发布管道(保存后 60 秒上线) | 后台服务 + Cloudflare,已配置好 | 谁都不要碰 |
| 入口(程序坞里的 SOP 网站) | /Users/kaka/Applications/ 里的两个 app | 谁都不要碰 |
只有第一行是可以改的。后两行任何 AI 都不该碰——碰了会跟后台自动同步打架,网站可能直接停更。启动指令里已经把这两条写成禁区了。
内容写作规范(新增内容时的标准)
| 规矩 | 为什么 |
| 每张卡五样俱全:发给谁 / 零基础操作建议 / 可复制指令 / 通过条件 / 易犯的错 | 缺任何一样,你用的时候都会卡住 |
| 指令必须整段复制就能用 | 要求你自己组织语言 = 又回到从零写 |
| 凡是要你回答的,一律给 2–4 个选项 + 推荐值 | 你脑子里有判断力,但没有现成的表述。指认比创作容易一个数量级 |
| 简化只能靠「把你要记得发的步骤,改写成 AI 自动执行的规则」 | 靠删机制求简化不叫简化,叫缩水 |
已有的设计决定,不许被当成缺陷改掉
| 设计 | 原因 |
| Tab A 和 B 是原版,永久保留不动 | 你要拿它们做对比验证 |
| 口径表一级硬约束最多 7 条 | 超过 7 条,人和模型都会开始失焦、机械打勾 |
| 自检必须是「反向举报」而不是自证清白 | 让被测者写自己的测试报告,在工程上是无效的 |
| 交接时规则粘贴正文、产物才用文件 | 附件不保证被完整读取。规则只读一半 = 没有规则 |
| skill 做满 3 次才固化 | 两个样本分不清「规律」和「巧合」 |
| 开场指令故意很长 | 第一条消息是唯一一次全新上下文。宁可第一条长,也不要后面反复补规则 |
改完必须验证
内容最后更新:2026-07-29 · 已加入 D 维护说明 · 通用交接卡