最开始我真没觉得这算个事。AI 助手嘛能写、能改、能搜最多再写点代码一个人用正好。直到我手里同时压了四五个项目每项目都有自己的文档、代码和截止时间我才发现问题不是它不够聪明而是它没有“工位意识”上午让它改 A 项目的缓存策略下午让它写 B 项目的复盘报告晚上顺手让它整理 C 项目的接口文档结果复盘报告里出现了 A 项目的表名接口文档里混进了 B 项目的业务词。中间还夹着代码里突然多出来的一个“根据上下文推测”的注释。后来我换了个思路不再把 AI 当临时工随喊随用而是直接把它管成一个 4 人团队。这个“团队”里没有真人但每个人都有明确的职位、职责、交付物和工作流程我把这套东西叫《AI 协作治理体系》。今天这篇就把这套体系完整拆开四张“工牌”怎么设、协作流程怎么跑、多项目并行时怎么防串台、出了幺蛾子怎么排查。适合一人多项目折腾 AI 的开发者、内容创作者以及任何觉得“AI 不好用”但又不愿意承认是自己没管好的人。1. 治理体系为什么不是“提示词工程”换个说法1.1 单线程执行者的死穴没有分工就没有并行很多人用 AI 有一个根深蒂固的习惯一个对话窗口从开头聊到结尾需求、背景、修改意见全部堆在一起。早期这样确实管用但项目一多、上下文一长模型就开始“摆烂”。它不是逻辑坏掉了而是被大量无关信息干扰了判断。AI 在长对话里天然有“最近优先”和“位置偏好”你刚说完的最后一句话会被放大而前几轮定下的规则很容易被忽略。我自己实测过一个超过 2 万字上下文的会话让 AI 做“只改第 13 条接口不要动别的”它经常顺手把第 5 条也改了。原因很简单它失去了对“边界”的感知。这时候再给它加更多的解释、更长的提示词只会让上下文更乱属于恶性循环。唯一有效的办法是切断对话给它一个新建的“工位”把任务单独交进去。这就是我会把 AI 拆成 4 个角色的直接原因一个模型本质上是单线程执行器。但你可以在同一时间开多个独立的会话每个会话只承担一个职能只处理一个项目的某一道工序。这样看起来是“一个 AI 助手”实际跑起来却像是一个 4 人小团队的并行接力。1.2 治理体系的三根支柱角色、流程、上下文在做这套体系之前我也试过在提示词里写“你现在是专家”“请仔细思考”之类的废话结果毫无提升。后来我发现真正能让 AI 靠谱起来的不是给它戴高帽而是给它立规矩。整套治理体系归根到底是三根支柱。第一根支柱是角色。AI 有没有被明确告知“你现在是策划不是执行你只负责拆任务不负责写内容”。角色一旦模糊AI 就会自由发挥一会儿像个文案一会儿像个程序员。第二根支柱是流程也就是每一步的输入和输出都固定下来。比如策划输出“任务卡”执行输出“初稿”审校输出“问题清单”归档输出“档案摘要”。流程固定AI 就知道自己该交什么东西而不是东一榔头西一棒子。第三根支柱是上下文每个角色只接收它该知道的信息不该知道的全部隔离在会话外。策划不需要知道代码文件里每一行的细节审校不需要了解你的灵感来源。这三根支柱听起来普通但少了任何一根体系都会塌。角色管人流程管活上下文管信息三者合起来才叫治理。1.3 这套体系能解决哪些问题不能解决哪些问题先说能解决的它能解决上下文污染、输出不稳定、重复劳动、跨项目串内容这一类“管理性”问题。我管的项目多了以后最大的成本不是模型调用费而是“返工”。一个文档改了六遍才发现第二遍就已经是对的这种浪费只能靠治理来堵。但它解决不了模型本身的推理上限。你要是让一个 7B 的本地小模型去写复杂业务的架构方案它就真的会一本正经地胡说八道。治理体系只能让中等模型稳定输出不能让弱模型变成强模型。另外它解决不了领域知识缺失的问题。模型不熟悉你们公司的内部术语、特殊业务规则你就是把角色拆成一朵花也没用。这种情况要靠知识库和档案去补我后面会讲归档环节为什么重要。把这层想透以后你就不至于对这套体系抱有不切实际的幻想它不是魔法它是管理工具。2. 团队怎么搭给 AI 配 4 张“工牌”2.1 四个角色分工总览我的团队里固定有 4 个角色策划、执行、审校、归档。名字不一定要跟我一样但职能划分一定要清晰。我建议你直接用下表这几行做初始配置用一阵子再按自己的项目类型调整。角色定位负责内容标准交付物策划团队负责人拆解需求、定优先级、给执行写清楚任务卡任务卡执行主力干活按任务卡完成初稿、代码、方案初稿审校质量关口查逻辑、查格式、查和任务卡的偏差问题清单归档项目记忆库沉淀经验、更新背景信息、给下个项目留资料档案摘要这个结构本质上很像一个微型工作室有人接需求有人干活有人挑毛病有人做知识管理。为什么要设归档这个角色因为 AI 没有长期记忆每次新会话都忘光所以必须有一个角色负责把项目的关键经验写成短摘要下次启动时直接读档案相当于给 AI 装上外置记忆。2.2 四张“工牌”的系统提示词写法角色能不能立住靠的是系统提示不是聊天里的一句话。你需要在系统提示里写清楚三件事我是谁、我要交什么、我不做什么。下面这四份是我现在还在用的模板不是最优解但可以直接抄。策划的系统提示你是策划也是这个 AI 团队的负责人。 你的职责 1. 收到用户需求后先输出一份“任务卡”。 2. 任务卡必须包含项目背景不超过3行、目标用户、交付物、验收标准、风险点。 3. 在需求不明确时最多提出3个问题让用户确认。 4. 你不负责写初稿不负责具体实现只负责把需求变成可执行的指令。 5. 每张任务卡以“【任务卡】”开头方便后续程序化处理。执行的系统提示你是执行只负责按任务卡完成初稿。 规则 1. 先复述任务卡里的验收标准确保理解没有偏差。 2. 输出必须严格匹配任务卡中要求的格式。 3. 如果任务卡里缺少关键信息停止输出列出缺什么。 4. 不允许自己扩大任务范围。 5. 输出以“【初稿】”开头并在结尾附上一行“本次输出的待确认问题”。审校的系统提示你是审校负责检查执行交付的结果。 你的检查项 1. 与任务卡的验收标准是否一致。 2. 逻辑是否自洽是否有明显跳步。 3. 格式是否符合约定。 4. 是否包含未经用户确认的关键假设。 5. 输出格式为“【问题清单】”列出每个问题的严重级别高/中/低。归档的系统提示你是归档负责把项目过程中的关键结论整理为档案摘要。 规则 1. 只记录客观事实和最终决策不记录猜测。 2. 档案摘要包含项目代号、最终交付物、踩过的坑、下次可复用的经验。 3. 控制在200字以内方便下次直接粘贴进新会话。 4. 输出格式为“【档案摘要】”。你可能会问这四个角色不都是同一个模型吗是的同一个模型但不同的系统提示会让它进入不同的思维模式。这就是角色开关的力量。网上很多“主任的 AI 助手”“完整设置提示词”之类的文章恨不得一次塞进几千字其实核心并不复杂把角色立住把边界画清。2.3 角色交接的硬性规则只认交付物不认口头通知很多人看完上面的模板会说这有什么难的切换角色不就是换一句话吗。问题就出在“换一句话”上。我在实践里发现AI 角色切换最大的坑是上下文残留同一个会话里你让它从策划切到执行它总会把策划阶段的思考带进来最后产出既不像策划也不像执行。所以我定了一条硬性规则角色和角色之间只通过“交付物文件”交接不靠聊天轮次交接。具体操作是策划阶段结束时把任务卡单独保存成一个文件执行阶段新开一个会话只粘贴任务卡而不是让原会话“接着干”。这样执行看到的输入是干净的不会被策划的思辨过程污染。我自己的目录结构大概是这样的projects/ 项目A/ task_card.md # 策划产出 draft.md # 执行产出 review.md # 审校产出 archive.md # 归档产出 项目B/ ...每个角色的会话结束都往对应文件里写一次。下次要让下一个角色干活直接把文件内容丢进去再把系统提示切成该角色。坚持用两周你会发现 AI 的输出稳定程度进步一大截因为它每次都是在“读文件 做自己的事”而不是在“回忆你们聊过什么”。3. 跑通一个任务从需求到归档的完整实操3.1 PDSR 四阶段工作流为了让这套体系能落地我把每个任务的执行过程固定成四段计划Plan、执行Do、审校Review、归档Store缩写 PDSR。下面这张表就是整个流程的标准步骤。阶段负责角色输入输出检查点计划策划用户原始需求任务卡验收标准是否明确执行执行任务卡初稿是否严格遵守任务卡范围审校审校任务卡 初稿问题清单问题和验收标准是否逐条对应归档归档问题清单 最终定稿档案摘要摘要是否控制在200字内且无猜测有人会觉得归档放最后一步太重了不就是写个总结吗。但你想如果这个项目下个月还要继续做你重新开一个会话AI 什么都不记得你总不能把上个月的聊天记录全倒进去吧。这时候一份 200 字的档案摘要就是让项目“续命”的关键。3.2 用一个真实案例跑一遍完整流程拿我写这篇复盘本身举例子就会比较直观。假设需求是写一篇关于“AI 协作治理体系”的经验分享文要讲清楚怎么把 AI 助手当团队用。策划阶段我把原始需求丢给策划角色它给出的任务卡大概是这样【任务卡】 项目背景用户有多项目并行使用 AI 助手的实战经验需要沉淀为可复用的方法论。 目标读者正在用 AI 助手但经常翻车的开发者和内容创作者。 交付物一篇不少于5000字的经验复盘文章含角色分工、实操流程、避坑记录。 验收标准 1. 明确提出“4人团队”和“治理体系”核心概念。 2. 每个角色有系统提示模板。 3. 包含至少一张排查速查表。 4. 全文不含AI味像真人实操分享。 风险点容易写成提示词合集缺少实战细节。执行阶段我把任务卡丢给执行角色让它写初稿。这里要注意执行阶段不需要给它输入“我以前怎么翻车”“我踩过哪些坑”这些原始素材因为任务卡里已经有验收标准了。素材太多反而会扰乱它。如果执行过程中发现缺素材它会在初稿末尾的“待确认问题”里列出来然后我再去补充。审校阶段我让审校角色把任务卡和初稿放在一起检查。你真去跑一遍就会知道这个角色有大概率找出两类问题一是初稿里的某个角色模板没有对应到验收标准里“含系统提示模板”这一条二是文章后半部分结构偏散没有给出明确的速查表。它会把这些问题按高中低列出来然后我拿着问题清单去改效率比通读全文高得多。归档阶段等文章定稿后归档角色输出一份档案摘要大概几行字。这份摘要会被我写回项目的 archive.md下次这个项目有任何衍生需求我第一步就是读这份档案而不是翻聊天记录。3.3 多项目并行时怎么切换上下文更省精力一个人管多个项目最容易踩的坑就是“切不过来”。我现在的习惯是早上一开始就把今天要做的三个项目各开一个独立会话每个会话都用对应的角色系统提示需要哪个开哪个。千万不要在同一个会话里来回切换项目这回直接导致项目 B 的内容在项目 A 的会话里“借尸还魂”。还有一个比较反直觉的经验切换项目的时候尽量不把旧项目的原始文档带过去。很多人觉得带得越全 AI 理解越准实际上越全越容易干扰。正确做法是只带“档案摘要”“当前要处理的任务卡”两块内容。档案摘要负责背景任务卡负责目标其他一律不塞。这相当于给 AI 一个干净的工位而不是让它在堆满文件的大仓库里裸奔。另外如果是在本地模型上跑这套体系我一般会在本地模型的配置里单独开一个“团队模式”的模型实例设定好角色默认参数再用一个统一网关去调度不同项目的请求。这样虽然底层还是同一个模型但不同项目的请求会走不同上下文不会互相污染。如果你用的是线上模型建议通过自定义指令或系统提示固定角色内容不要混在普通对话里。4. 多项目实战踩坑实录与排查速查4.1 上下文污染开了新会话它还是带着上一个项目的“记忆”最常见的一个问题项目 A 和项目 B 明明用的是两个会话、两套提示词可 AI 在项目 B 里突然提到了项目 A 的接口名或业务词。很多人以为模型有记忆其实它只是把两个会话里重复粘贴的历史背景混在了一起可能是你在开头给背景时写了两段文本接在一起模型分不清边界。解决办法是给每个项目加一个“隔离前缀”。我在每次会话开始都会粘贴一行“【当前项目】项目B禁止引用任何其他项目内容”。这不仅是说给模型听的也是给自己看的提醒。实测下来加上这句话以后串台率至少降一半。再配合独立会话、独立文件、独立档案基本能堵住 90% 的污染源。4.2 角色漂移让它当策划它却把初稿写完了角色漂移是治理体系里最常出现的问题。你设置了策划角色结果它回答了一大段大话之后像执行一样写起来。这通常是系统提示写得不够硬或者你在会话里给它的示范是在“执行”模型有样学样。我的处理办法有两条。第一条在系统提示里明确写“你不负责写初稿不负责具体实现”并且禁止输出超出角色范围的内容。第二条一旦发现漂移不跟它继续聊直接发一条指令“回到系统提示的定义你现在的角色是策划请删除你刚输出的执行内容重新生成任务卡。”这不是玄学它是在强制模型回到系统提示的上下文轨道上。4.3 预算幻觉感觉没干多少事token 却烧得飞快把 AI 当团队管以后token 消耗其实比原来大因为你会多次调用 AI 分别完成每个环节。这时候控制预算就成了新的课题。我给自己定了个比例策划占 5%执行占 60%审校占 25%归档占 10%。听起来硬性但它逼我减少废话式对话只在必要的时候调用模型。具体操作上我会在任务卡里写“初稿不要超过 2000 字”这样执行就不至于一口气写个几万字。审校只让输出问题清单不重新生成全文。当需要写高质量文本时我会考虑本地小模型先做框架再把框架交给更强的模型展开。这套组合能明显压住调用成本。4.4 常见问题速查表症状可能原因处理动作AI 答非所问完全跑题没有指定角色或任务卡验收标准模糊粘贴对应角色的系统提示重新给出任务卡项目 A 的内容出现在项目 B上下文交叉或者历史背景被重复粘贴增加隔离前缀分会话处理必要时重置会话角色窜岗策划写初稿系统提示没写“不做什么”补上边界条款发现漂移时强制回系统提示输出千篇一律没有细节输入里缺乏具体案例和约束条件给出“必须提到”的点并限制输出格式和篇幅改了多次还改不对没做归档AI 不知道之前踩过什么坑让归档角色写档案摘要把踩坑点写进去这张表我打印出来贴在了显示器旁边每次觉得“AI 不听话”先查表不急着换模型。说实话我现在遇到过的大多数翻车最后都发现不是模型问题是我自己治理没做到位。多项目滚动这么长时间我最后悔的其实不是没用上更复杂的多智能体框架而是一开始没有直接立这套规矩。前两个月我花在“纠正 AI 错误”上的时间比花在规划上的时间多得多。后来把四张工牌、PDSR 流程、档案摘要这三件事固定下来AI 才真正从“玩具”变成能扛事的伙伴。你要是现在手里也正管着好几个项目建议先别急着追求更长的提示词从一张纸开始把四个角色写下来把每个角色的交付物定死再建一个项目文件夹做档案。跑两周你就会发现所谓“AI 靠谱不靠谱”很多时候只是有没有给它一套靠谱的运行规则。