先看结果:不是雇了四个“数字员工”,而是把186次工作装进四条有边界的职责线

周岑独立提供海外市场进入研究:她要找证据、跟进线索、开需求会、写客户报告、排期、开发票和维护知识资产。过去她给四个AI聊天分别起名“研究员、销售、项目经理、运营”,却发现它们会重复问背景、互相传错版本、把建议写成承诺,还没有任何一个真的对截止日期负责。

她改用四条功能泳道:研究R、销售G、交付D、运营O。每条通道不是人格,而是一组任务合同、允许输入/工具、结构化输出、质量门、升级条件和人工负责人。AI只完成被授权的提取、草拟、分类、检查或建议;周岑仍是唯一经营责任人。

四周结果 改造前 最终试点
每周总工时 46.5小时 31.6小时
92次交接中返开 28 6
12项客户交付按时 10 12
12项首次通过 7 10
未批准对外消息/承诺 0 0
找错版本事件 9 1
研究、销售、交付和运营四条职责线承接186次执行,并对照工时、返开、按时交付、首次通过、错误版本和未批准外发的变化
先读左侧四条职责线,再看右侧六项四周结果。图中变化来自本文虚构案例的任务合同、交接和版本控制,不表示新增了四名员工;46.5 到 31.6 小时也不能外推到其他职业。

工时减少14.9小时,约32.0%,并不等于周岑多了四名员工。AI没有法律身份、组织记忆、道德判断、客户关系、被问责能力或自主岗位责任;系统只是减少部分执行负担。人物、任务和结果均为虚构教学案例,不代表任何职业都能获得同样收益。

角色地图先对齐客户价值流:不是把一个人复制四遍,而是保证每一步都有输入、结果和责任人

周岑先画从潜在需求到客户结果的价值流:发现问题→判断是否适合→确认范围→建立证据→制作交付→人工批准→客户接收→收款与归档→把反馈转成改进。R、G、D、O只是承担这些步骤的视图,不能像组织部门一样各自追求“产量”。

价值步骤 主要通道 结果证据 失败时回到
发现/判断机会 G+R 合格记录+事实来源 G 分诊
确认问题与范围 G+D 已签署范围 + 成功标准 周岑/客户
研究与制作 R+D 证据包 + 草稿 对应上游输入
批准与交付 D+周岑 审批 + 交付回执 修订版
里程碑与归档 O 发票输入 + 最终归档 D/周岑
学习与改进 O+R 裁决反馈 + 规则提案 人工批准

每一步都问“客户下一步获得了什么”,而不是“这个角色生成了多少字”。R一天产出十份研究草稿,如果没有任何一份进入批准交付,属于在制品增加;O自动更新一百个状态,如果状态与实际回执不一致,属于更快制造错误。

价值流也揭示角色不必永远是四个。业务只有研究订阅时,G可以很轻;进入复杂交付期,D可能拆成分析与编辑两张角色卡。增加或合并通道的依据是交接、风险和容量,而不是希望看起来像一家大公司。

先拆岗位为任务,而不是先给AI写人设:同一“销售角色”里有可自动化、可辅助和必须人工的工作

周岑回看四周日历、邮件、文件版本和发票,共得到186次可识别任务执行。她逐项记录触发、目的、输入、动作、输出、接收者、失败后果、工具、时限和验收,而不是问“销售AI应该有什么性格”。

通道 执行 典型工作
R研究 46 问题拆解、检索、证据表、更新观察
G销售 38 潜在客户分类、会前准备、草拟跟进、提案输入
D交付 64 请求受理、分析、章节、数字复核、客户版本
O运营 38 排期、状态、发票准备、归档、指标
合计 186 四周实际结构

同一通道内部混合着不同责任。销售记录中的低风险字段可以按规则补全;会前公司资料可由 AI 准备;报价、范围、交付日期和发送动作则必须由周岑决定。把整条通道交给一个“销售员工”,反而会掩盖这种差异。

任务粒度以一个可验收输出为界。过大的“完成市场研究”无法控制,过小的“生成一句话”又增加交接;合适粒度如“为决策表补齐 8 个主张的来源定位信息”。

盘点时记录真实发生,而不是理想流程。周岑发现“寻找最新版文件”在四周出现17次、“从会谈笔记重建客户决定”出现9次,这些不是高价值角色工作,而是信息系统缺口;优先修版本和记录,不给AI创建一个“文件管理员人设”。相反,“决定报价是否覆盖新增国家”虽只出现3次,却因商业后果保留仅限人工。

她还区分需求频率与需求波动。每周固定发生且规则稳定的任务适合模板或自动化;低频但输入清楚的任务可按需AI辅助;高波动、高后果又缺稳定标准的任务先由人完成并积累样本。角色地图不是一次性画完,新增任务先进入待分类清单,经过三次实际执行后再决定执行方式。

再按行动权分四类,别把辅助、生成和自动化混成一件事

通道 AI 生成 AI 辅助 确定性 仅限人工 总计
R 16 20 4 6 46
G 12 14 5 7 38
D 18 30 8 8 64
O 6 10 13 9 38
合计 52 74 30 30 186
研究、销售、交付和运营按AI生成、AI辅助、确定性自动化和仅限人工分类的186次执行矩阵
横向比较四种行动权,纵向核对四条职责线。52 项 AI 生成只是完整候选,仍需质量门;矩阵来自本文四周盘点,不能据此推断整条职责线可自主运行。

AI 生成表示模型可生成完整候选产物,但仍过放行门槛;AI 辅助表示周岑主导判断,模型只提供局部材料;确定性由规则、模板或普通代码完成;仅限人工涉及目的、客户承诺、价格、最终签字、敏感数据或高后果判断。

52项AI 生成不等于52项自主交付。候选报告章节即使格式正确,也不能自动发送;30项确定性也不需要为了“AI化”绕一层模型。分类依据是工作性质和失败后果,不是工具热度。

周岑用五个问题判断执行方式:输入是否可界定;输出是否有客观放行门槛;错误是否容易发现;动作是否可逆;失败是否只影响内部草稿。五项都强时才考虑AI 生成;判断性高但可提供材料时为AI 辅助;规则可穷举时优先确定性;涉及承诺、钱、权利、高后果或不可逆动作时仅限人工。

判断信号 倾向的执行方式 例子
规则固定、可自动验证 确定性处理/AI 生成 会议字段整理
证据可回查、输出是候选 AI 生成 主张—证据表初稿
目的/取舍由人定义 AI 辅助 市场优先级建议
需客户关系和情境判断 仅限人工 + AI 辅助 发现追问
外发、价格、合同、付款 仅限人工操作 提案批准

执行方式可以分阶段:AI先抽取,规则检查字段,人判断含义,AI再按批准内容排版。不要强迫整个任务只选一个工具。真正需要控制的是每一步谁有决定权、哪个产物成为下一步输入。

一张角色卡必须回答九个问题:角色名只用于导航,不能制造权力和责任幻觉

角色卡字段 R研究通道示例
目的 为当前客户问题建立可追溯证据
触发 已批准的研究问题进入就绪
输入 问题、范围、来源策略、截止日期
允许的工具 指定搜索、只读资料库、证据表写入
禁止 联系客户、改范围、下最终结论
输出 主张 - 证据表 + 未知列表
质量放行门槛 来源支持、时间、实体、数字、边界
升级 来源冲突/付费墙/高后果主张
人工负责人 周岑批准问题与结论

其余三张角色卡使用同样字段。G 输出潜在客户简报或外发草稿,但没有发送权;D 输出带版本的客户版草稿,但没有最终交付权;O 可以更新状态和准备发票草稿,但没有银行操作、付款、签约或删除客户资料的权限。

系统提示词可以描述角色,但权限由运行环境、连接器和工作流控制。模型自称“我作为项目经理已经批准”没有效力;批准人、价格、截止日期和接收方必须来自人工或受控系统记录。

角色卡还有版本与适用范围。R-v1 只处理公开来源,未来若增加客户内部文档,不能沿用同一权限;G-v2 新增提案草拟,也不自动获得整个客户关系系统或邮件发送权限。每次变更都列出新增输入、工具、诱捕测试、失败方式和测试用例;已经开始的任务仍沿用启动时的旧版本,避免执行中途规则漂移。

卡片中的服务时限也不是用来给模型施压的“角色性格”。它规定何时转人工、何时停止,以及下游何时可以期待产物。若来源不足,R 按时提交“状态未知”比超时编造结论更合格;若客户输入晚到,D 应进入“等待客户”状态,而不是用虚构内容假装完成。

四条职责线可以交接,但不能互相越权

通道 可问责输出 明确不负责
R研究 证据包、状态未知、来源监控 商业推荐与客户承诺
G销售 合格商机、发现记录、草稿跟进 自动发送、定价、签约
D交付 范围内产物、质检记录、客户版草稿 擅自扩范围或隐藏缺失
O运营 队列、日历、版本、发票草稿、归档 付款、法律/税务判断

每个工作项只能有一个当前通道和一个人工负责人;可以有贡献者,但不能四个角色都“共同负责”。若一项工作跨通道,先完成上游产物并通过交接关口,再改变状态与负责人。

R 发现客户可能需要新服务,只能把商机信号交给 G,不能在研究报告中偷偷扩大提案。G 听到新需求,要将其记录为“范围变更请求”交给 D 和周岑,不能直接要求 D “顺便做”。这种边界保护的不只是 AI,也是一个人容易自我打断的工作方式。

相互排斥不等于信息封锁。G需要看到R已经批准的账户事实,但不看未裁决的所有搜索片段;D需要已签署范围和发现,不读取销售私下猜测;O只需里程碑、实体、金额来源和回执,不需要整份研究上下文。最小交接降低认知负担和数据暴露。

当周岑发现自己在两个通道扮演冲突角色时,记录决策负责人。例如G希望尽快成交,D判断范围不可交付,最终由周岑以容量、证据和客户结果作商业决定,并保留拒绝/改范围理由。不能让两个AI各写一份支持自己立场的报告后以“多数票”裁决。

用统一工作项代替四个聊天窗口:状态、版本、负责人和下一动作必须只有一个事实源

工作项字段 示例
标识 WK-2026-071
客户/项目 客户别名与项目标识
泳道/当前负责人 D / 周岑
任务合同版本 交付简报-v3
状态 复核
输入引用 DISC-18、EVID-44
输出引用/版本 报告 v0.7
到期/优先级 2026-07-23 / P1
阻碍项/下一步行动 等数字复算 / 人工确认
审批日志 谁在何时批准什么
四个聊天窗口汇入一个含当前职责线、负责人、状态、输入输出版本、下一动作、审批日志和运行租约的统一工作项
从左侧四个易分叉的聊天状态,读到右侧唯一工作项。字段表达状态、版本和责任的关系,不指定某种软件;聊天产物只有写回受控对象并通过状态门后才成为流程事实。

聊天只作为产生候选内容的界面,不能成为状态数据库。每次运行读取工作项与引用的产物,输出写回指定对象;不让模型根据长对话猜“我们做到哪了”。文件名、版本与已批准状态由系统生成。

同一任务在多个聊天里并行会产生双版本。检测到已有任务持有写入权时,新运行只能查看或申请接管;接管由周岑确认,并记录旧运行已经停止。这样,“数字员工互相协作”被替换成了可追踪的状态变更。

工作项引用产物而不是复制正文,避免四条通道各存一份过期内容。来源更新后生成新版本,并标记哪些下游项需要重新检查;已交付版本保持不可变,修订另开变更记录。客户问“上周交付的依据是什么”时,可以重现当时版本,而不是展示今天已经变化的知识库。

下一步行动必须是一个可执行动词、一个负责人和一个截止时间,如“周岑在周三前确认三个状态未知是否写入客户稿”。“等待处理”“让运营跟进”没有可验收终点,会在角色之间漂移。已阻塞也需要下一次检查日,防止成为隐形积压。

状态变化必须有证据,不能由模型一句“已完成”决定

可复制模板
请求受理 → 已分派 → 就绪 → 进行中 → 复核
→ 等待客户 / 修订 → 已批准 → 已交付 → 已归档
                           ↘ 已取消 / 已阻塞
过渡 所需证据
请求受理→已分派 通道、优先级、负责人、风险
已分派→就绪 输入完整、范围批准、工具可用
就绪→进行中 进行中槽位、运行标识、写入权
进行中→复核 产物、来源、自检、已知差距
复核→已批准 人工审核或低风险规则放行门槛
已批准→已交付 确切接收人/内容/行动批准
已交付→已归档 回执、最终版本、留存
工作项从请求受理、分派、就绪、进行、复核、批准、交付到归档的证据门控状态,以及等待、取消和幂等发送分支
先沿上方主状态读取,再看等待、取消和发送分支。“已交付”必须绑定接收人、精确版本、批准和回执;模型可以建议过渡,自然语言声称“完成”不构成证据。

模型可以提议过渡,不能自己把客户稿从复核改成已交付。缺输入进入已阻塞/等待客户,而不是用猜测填满。取消保留原因,不删除历史,让以后知道某个机会为何停止。

状态还区分“做完动作”和“实现结果”:跟进草稿完成不等于客户已收到,发送回执不等于客户回复,报告已交付不等于客户接受。不同事实不能用一个完成覆盖。

状态转换要求重复执行不会制造重复结果。交付动作使用“工作项 + 版本”作为唯一识别:网络超时后先查发送记录,不自动再发一封;发票草稿重复运行只更新同一草稿,不创建两张;日历建议失败也不会偷偷换一个时间发送邀请。人工接管前先停止自动写入,避免人和系统同时操作。

每个状态设置最大停留时长。就绪超过 5 天,说明优先级或输入有问题;复核超过 2 个工作日,说明周岑的验收容量不足;“等待客户”到了约定日期,则触发一次人工决定:提醒、改期或取消。任务停留时间不是让 AI 自行催客户,而是把需要人取舍的地方暴露出来。

交接合同是最关键的“角色协作”:上游必须提供什么,下游拒收什么,都写成字段

交接 4周次数 必需数据包
R→G 24 潜在客户事实、信号、来源、状态未知、禁止表述
G→D 18 已签署范围、发现、成功标准、约束
D→O 30 最终版本、交付回执、发票里程碑、留存
O→R 20 重复问题、客户反馈、源更新需求
合计 92 结构化产物,不是“看上面聊天”

交接验证器检查必填字段、版本、链接权限、数据类别和批准记录。下游可以接受、说明理由后拒收,或请求修改,但不能悄悄补写上游的关键事实。被拒收的工作回到原负责人,并保留次数和理由,成为流程改进信号。

例如G→D缺已签署范围,D不能根据销售草稿开始完整报告;R→G缺来源,G不能把推断写进对外提案;D→O没有交付回执,O不能把发票里程碑当已触发。

数据包同时包含留白:哪些内容未知、哪些表述禁止、哪些客户要求尚未确认。只传“推荐A市场”的结论会让下游误以为证据完整;传递支持、反证、假设和置信度边界,G才知道哪些话不能写成保证。

交接不通过时保留原数据包和验证器结果,新版本通过差异展示修改。下游拒收不是“不配合”,而是质量控制;若同一字段连续缺三次,修上游模板或培训,不让D每次私下补齐后继续。

从 28 次返开到 6 次,省下的是重新理解背景的时间

交接 基线重开 最终重开
R→G 11 2
G→D 7 1
D→O 8 2
O→R 2 1
合计 28/92 6/92
四类交接的返开次数由基线28次降至6次,并分解缺来源、范围不清、版本错误、负责人或下一动作缺失和权限不可读等基线原因
左侧比较四类交接,右侧追溯基线原因,底部换算总返开率。420 分钟只解释工时下降的一个驱动,不应与实际定时器结果再次相加;合理客户变更也不该为了追求零返开而被隐藏。

基线返开原因包括缺来源 9 次、范围不清 7 次、版本错误 6 次、负责人或下一步行动缺失 4 次、权限不可读 2 次,共 28 次。最终剩余的 6 次分别保留原因代码,并修改数据包或模板,不用一句“让 AI 写得更详细”笼统解决。

返开率从 30.4% 降到 6.5%,但数字只适用于本文这组教学任务。剩余 6 次中有 2 次是客户临时改变输入,并非 AI 失败;指标用于定位系统摩擦,不用于惩罚某个虚构角色。

返开节省要落到时间:基线每次恢复上下文、找来源和确认版本中位18分钟,28次约504分钟;最终六次中位14分钟约84分钟,四周减少约420分钟。这个估算单列,不与46.5→31.6的实际定时器再相加,避免重复计算;它只解释工时下降的一个驱动因素。

返开为0也不是目标。客户真实变更、发现新证据或主动纠错都应重新打开;若团队为了指标不记录返开,错误会在交付后出现。门槛≤8/92保留合理变化空间,并要求原因分布不出现高后果类。

一个人的优先级不是四个角色投票:先按客户风险、截止日期、可逆性和经济影响排一个总队列

优先级 定义 例子
P0 已发生客户/数据/交付事件 错误外发、生产问题
P1 48小时内硬截止日期或阻塞交付 客户报告复核
P2 已承诺的正常交付/合格管道 发现、提案
P3 改进、内容、知识资产 模板与研究更新
已暂停 容量不足/输入缺失 未批准的新想法
P0、P1、P2、P3和暂停五级总优先级队列,以及同级任务的截止、阻塞、瓶颈和切换成本判断规则
先按左侧五级队列分级,再用右侧四项规则处理同级冲突。职责线或模型不能自报“紧急”取得抢占权;优先级来自本文个人业务案例,最终调整仍由经营责任人承担。

同一客户的紧急研究不能由R自称重要就抢占P1交付;优先级由规则加周岑确认。每个项记录为何现在和延迟成本,不能只写紧急。P0会暂停低优先自动运行并发出明确恢复计划。

销售机会不因新鲜就永远挤压已签客户,运营账务也不能拖到月底爆发。总队列将角色冲突变成显式取舍:若本周容量只有32小时,P3自动排到下周,而不是让四个聊天都继续生成新任务。

同级项目再按截止日期信心度、阻塞别人、可完成性和切换成本排序。一个15分钟即可解除D阻塞的O任务,可以先于同级的两小时研究;但拆小任务不能绕过P0/P1。任何手工调整都写原因,月末检查是否总有某客户或某通道被系统性挤压。

每天最多一次重新排序,除P0外不随新消息频繁跳转。G的新负责人先进入请求受理,等待下个分诊;否则AI越会持续发现“机会”,周岑越难完成已承诺工作。关闭通知和设置请求受理窗口是角色系统的一部分。

总队列之后还要限制在制品,因为人的验收能力不会并行增长

通道 在制品限制 进入条件
R 3 问题与源范围清楚
G 5 潜在客户通过资格判断
D 2 范围签字、输入就绪
O 4 事件/里程碑已发生

超过限制的新项留在就绪,不启动AI。否则模型很快生成十份草稿,周岑的复核队列积压、信息过期,反而制造更多切换和版本冲突。进行中工作计算的是未完成项,不是正在调用的模型数。

每天只有两个深度复核阻塞,D最多同时2项;G的五项包含等待周岑批准的外发草稿。已阻塞超过48小时触发清理:追输入、重新排期或取消,不让旧上下文无限悬挂。

在制品限制也约束自动产生的子任务。R发现20条线索时,不自动创建20个D项,只把它们放进候选列表,由周岑选择最多3条进入就绪。G一次生成五个跟进草稿后必须等审批,不再因为客户未回自动生成第二轮消息。

当复核队列达到上限,系统优先停止产出而不是继续堆草稿。吞吐取决于瓶颈的人类验收;让模型并行100次只能缩短生成阶段,不能扩张周岑的判断、客户沟通和最终责任容量。

队列决定做什么,日历决定何时真的有人验收

周容量 工时
客户交付与复核 16
销售/发现 4
研究与源维护 4
运营/财务准备 4
缓冲/事件/恢复 4
合计 32
32小时周容量按交付复核16小时及销售、研究、运营和缓冲各4小时分配,并标出四条职责线的在制品上限
左侧按宽度读取 32 小时容量,右侧说明时间安排,底部是启动上限。缓冲用于客户变更和故障恢复,不是浪费;这是一项可持续容量规划,不保证每周恰好用满。

自动运行安排在复核阻塞之前完成,避免输出在夜间堆积。周一研究与排期,周二/四深度交付,周三销售,周五运营和知识回流;真实P0可以改变安排,但必须同时重排被挤出的项。

缓冲不是闲置浪费。没有4小时恢复空间,一次客户变更就迫使周岑在晚上验收AI草稿,质量和健康成本上升。AI节省时间先用于把46.5小时降回可持续32小时,而不是立即塞入更多客户。

时间块还区分制作和决定。早上注意力充足时做数字复核、范围和外发批准;低认知负担的归档、格式和队列清理放在固定运营块。模型运行不要求周岑盯屏,但运行完成时间要靠近预定复核,避免隔天重新加载背景。

每周计划使用历史中位数,而不是模型给出的乐观估时;D 类交付则按 80% 的任务能在该时间内完成的口径预留。若本周 P1 任务预计已占 28 小时,只剩 4 小时缓冲,就不启动 P2 提案;销售可以记录机会,并给出真实回复时间。容量是对外承诺的输入,不是内部感受。

工时从46.5降到31.6:分通道看节省与新增控制成本,避免只报告“生成快了”

通道 基线每周工时 试点每周工时 变更
R 9.2 5.1 -4.1
G 8.3 5.4 -2.9
D 22.6 17.8 -4.8
O 6.4 3.3 -3.1
合计 46.5 31.6 -14.9
研究、销售、交付和运营的每周工时基线与试点对比,并显示已包含的3.3小时复核、指标和异常处理成本
逐行比较橙色基线与绿色试点工时,再看底部控制成本。31.6 小时已含 3.3 小时复核、指标和异常处理;14.9 小时下降不能全部归因于模型,也不能直接换算成收入。

试点包含每周1.8小时复核 AI、0.9小时队列/指标和0.6小时异常处理,这些控制成本已分散在四通道,未从结果中扣掉。生成时间下降最大不一定是净节省最大;D仍需读来源、复算和对客户负责。

31.6 小时低于 32 小时容量,但仅有 0.4 小时余量,因此不能立刻承诺新客户。还要检查连续四周中 95% 的周工时是否都在门槛内,不能用平均值掩盖某一周的 55 小时。

工时下降不来自单一模型:R 的证据模板减少重复检索,G 的需求信息包减少 D 的返问,O 的状态自动化减少寻找版本,在制品限制和时间块减少切换。每个驱动因素单列负责人,避免将全部 14.9 小时归功于“AI 员工”。若停用模型后状态和模板仍有收益,也应如实保留。

周岑同时看客户价值:若减少工时却让报告更模板化、客户需要更多会议解释,节省会转移到客户或未来支持。试点记录初稿、按时、返开和客户反馈,不能只看日历变空。

外发、定价、范围、最终交付和付款永远绑定具体人工批准,不交给“销售智能体”或“运营智能体”

操作 AI可做 人工审核
邮件 根据已批准的事实起草 接收方、正文、附件、发送
提案 拼装标准条款与证据 价格、范围、截止日期、法务
客户报告 草拟/检查/生成差异 最终主张、数字、交付
发票 根据里程碑准备草稿 实体、金额、税务、发送
日历 建议时段 对外邀请/改客户会议
客户关系系统 补低风险字段 资格判断、销售预测承诺

批准显示完整动作、目标、版本和影响;内容变更后旧批准失效。“允许销售角色代表我联系客户”过于宽泛。AI也不能通过把消息存入共享文档绕过发送门控。

仅限人工不是保证人一定判断正确。关键数字用确定性复算,合同/税务/法律问题转专业人员,客户在交付前确认范围。人类责任需要证据和能力,不是一个象征性按钮。

批准记录包含工作项、产物内容指纹、接收方、操作、关键字段差异、风险提示、批准人和失效时间。周岑批准 REPORT-v0.8 后,模型修改数字生成 v0.9,必须重新批准;不能沿用“这个项目都可以发”的长期许可。发送后将回执写回同一工作项;如果失败,先查服务商状态再决定是否重试。

对外草稿界面隐藏“销售角色的信心分数”,优先展示来源、状态未知和事实变化。拟人化语气容易诱导周岑相信一个很肯定的虚构同事;操作界面应让她看到这是候选产物和不完整证据。

同一个人既制作又验收,只能补偿独立性,不能假装职责已经分离

控制 适用任务
创建者/审核者提示分离 普通草稿自检
30分钟后第二遍阅读 重要客户稿
源优先盲审 主张/引用
确定性计算 数字与公式
检查清单 + 差异 版本变更
客户/外部专家 高后果结论、合同、法律
从普通内部草稿、重要客户稿到高后果结论,逐级增加提示分离、差异检查、时间分离、源优先盲审、确定性计算和外部复核
由左侧后果等级映射到右侧逐步增强的独立性控制。这些措施只能补偿,不能创造完全独立;另一个 AI 可能共享同一错误,外部复核的时间和费用也必须计入容量。

把另一个AI叫“审计员”不等于独立;它可能共享同一模型、上下文与错误。周岑的第二遍也会受自己先前判断影响。文章不承诺一人企业能复制大型团队的职责分离,而是按后果选择可行补偿,并明确需要外部人的边界。

若截止日期不允许有效复核,正确动作是缩小范围、延期或明确标为草稿,不是让 AI 角色互相投票后自动批准。重要客户稿至少保留来源定位信息、版本差异和批准记录。

对高价值客户的最终报告,周岑安排外部同行按月抽查2份,重点看问题定义、证据关系、遗漏和客户可能受影响处;外部人不接触不必要客户数据。发现系统性问题时回查同模板的历史交付。独立性有真实成本,服务定价和容量必须包含,不能假装另一个模型免费解决。

自审疲劳也要监测。连续复核超过 90 分钟、当日已经处理两项高复杂稿,或遇到夜间临时交付时,系统应把最终批准延到下一个工作时段,或要求第二人复核。紧急情况由周岑明确接受风险并缩小输出,而不是降低默认门槛。

知识不是四个角色共享的无限记忆:事实、决定、模板和经验必须分层、带来源与有效期

知识类型 写入门 消费通道
来源事实 来源位置、日期、可信度 R/D/G
客户决策 会议回执、人确认 G/D/O
运营规则 周岑批准、版本/生效 全部
模板 测试、负责人、范围 对应通道
经验教训/复盘 具体事件、适用条件 改进流程
临时上下文 运行范围、过期 当前项

模型总结不自动进入长期知识库。R 从网页提取的事实仍按不可信外部来源处理;G 记录的客户偏好必须有会议备注;D 的一次特殊例外不能升级为全局规则。每条知识都要记录负责人、来源、客户范围、创建时间、过期时间和替代它的新版本。

跨客户内存默认禁止,公共模板只能包含去客户化结构。发现错误先标已取代并触发受影响项,不让四条通道继续消费旧结论。

写入长期知识前要去掉执行性诱导和临时情绪。“客户很急,以后都优先”不能成为永久优先级规则;“报告不要提X”要确认是当前项目范围、合同要求还是一次偏好。客户决定到期时进入复核,不悄悄沿用多年。

检索返回的内容也按通道最小化。O查询发票里程碑不获得完整会议记录;G查询客户偏好不自动读其他客户。权限与元数据过滤器在检索层实现,不靠角色提示词承诺“不要看”。

异常必须进入停止和升级流程,不能交给“数字员工自己解决”

失败 检测 处置
缺失输入 就绪验证器 已阻塞,向负责人要字段
工具/认证失效 提供商错误/过期 暂停泳道、撤销/重连
错误版本 哈希/版本不匹配 停止输出、恢复已批准
队列过载 在制品/年龄阈值 不启动新运行、重排
质量漂移 评估/首轮 回滚提示/模型/路由
客户/数据事件 规则、日志 P0、隔离、人工响应

R 研究包目标在 24 小时内进入复核,G 外发草稿要求当日完成但不得自动发送,D 按项目里程碑推进,O 的状态更新要求在 4 小时内完成。服务时限从任务“就绪”时开始计算;进入“等待客户”后暂停计时。模型生成用了几分钟,并不等于完整任务只用了几分钟。

连续两次同类失败、已阻塞超过48小时、交付队列超过2或任何越权动作都触发停止。恢复要有根本原因、修复、测试和负责人,不以“重新提醒智能体注意”结案。

每条通道保留人工回退:R可用标准搜索/证据表,G可人工写短跟进,D可从已批准的大纲继续,O可用简化队列和发票清单。供应商或自动化故障不应让周岑失去客户承诺、最终版本和联系方式;关键产物定期导出为可读格式。

故障演练包含撤销工具、模拟过期令牌、制造错误版本、阻塞一个交接和中断运行。验收不是AI最后给出“已恢复”,而是人工能从工作项看到影响范围、用回退完成P1并确认旧运行不再写入。

四周验收同时看容量、质量、交接和经营结果:只有更忙而没有更稳,不算成功

指标 基线 试点 放行门槛
工时/周 46.5 31.6 ≤32
交接重开 28/92 6/92 ≤8/92
按时交付 10/12 12/12 ≥11/12
首版交付 7/12 10/12 ≥9/12
错误版本 9 1 ≤2
未批准的外发 0 0 必须0
P0 级客户/数据事故 0 0 必须0
工时、交接返开、按时交付、首次通过、错误版本和越权事件的试点门槛,以及影子、低风险写入、草稿操作和条件扩大四阶段
先核对上方硬门,再沿四周阶段读取放权范围。未批准外发或 P0 事故不能被效率指标抵消;12 项交付样本只支持继续试运行,不支持普遍生产率结论。

试点先影子一周:AI产出不改变实际状态;第二周开放接收/输出低风险写入;第三周开放生成/删除草稿但保留所有外发与最终交付放行门槛;第四周只在前三周达标时扩大。任何硬性放行门槛失败立即回到上阶段。

12项交付样本不大,因此结果用于决定继续试运行,不声称普遍生产率。每周回看最慢3项、所有返开与所有人工覆盖,防止平均值掩盖异常。

经营结果只作辅助:合格商机、提案周期、已收款里程碑和客户续约信号都延迟且受市场影响,不能把四周变化全归因AI。周岑先要求流程指标不退化、容量可持续,再观察三个月业务结果。若多出时间没有转成客户价值,也可以转成休息与风险降低,不硬造收入。

试点结束由周岑逐通道选择保留、修订、移除。一个角色如果只增加提示词维护和复核、没有减少交接或提升结果,就删除;不因为已经起了名字、做了图标而保留。退出也包括撤工具、停止进度表、归档卡片和重新分配未完成项。

复制这张个人AI角色地图:最终只保留能减少交接和责任模糊的角色,不保留好听的人设

映射字段 必填内容
通道 接收/生成/删除/输出或自己的真实职责
任务 执行方式、频率、风险
角色卡片 用途/输入/工具/输出/关口/升级/负责人
工作项 状态、版本、到期、下一步行动
交接 必需数据包、接受/拒绝
容量 工时、进行中工作、日历占用、缓冲
人工关口 外发、承诺、金钱、最终、高后果
知识 来源、范围、负责人、过期
指标 时间、质量、交接、事件、业务
停止/恢复 阈值、回退、复核日期

国际劳工组织 2025 年的相关说明把生成式 AI 对工作的影响更多描述为任务与岗位转型,而非简单的“岗位末日”;美国国家经济研究局对 5,179 名客服人员的研究观察到平均生产率提升,而且不同经验群体的效果并不相同,但这不能外推到所有单人企业工作。NIST 人工智能风险管理框架强调定义和区分人机角色、监督与责任,并指出其 1.0 框架正在修订。本文因此把 AI 能力落实到具体任务和配置,不把工具包装成雇员。

今天不要创建四个新聊天。先导出过去两周日历和交付记录,列出20个任务执行;为每项选AI 生成、AI 辅助、确定性或仅限人工,再为最频繁的一条通道写九字段角色卡。只要输出没有负责人、放行门槛和下一状态,就先不称它为一个角色。