先看结果:不是雇了四个“数字员工”,而是把186次工作装进四条有边界的职责线
周岑独立提供海外市场进入研究:她要找证据、跟进线索、开需求会、写客户报告、排期、开发票和维护知识资产。过去她给四个AI聊天分别起名“研究员、销售、项目经理、运营”,却发现它们会重复问背景、互相传错版本、把建议写成承诺,还没有任何一个真的对截止日期负责。
她改用四条功能泳道:研究R、销售G、交付D、运营O。每条通道不是人格,而是一组任务合同、允许输入/工具、结构化输出、质量门、升级条件和人工负责人。AI只完成被授权的提取、草拟、分类、检查或建议;周岑仍是唯一经营责任人。
| 四周结果 | 改造前 | 最终试点 |
|---|---|---|
| 每周总工时 | 46.5小时 | 31.6小时 |
| 92次交接中返开 | 28 | 6 |
| 12项客户交付按时 | 10 | 12 |
| 12项首次通过 | 7 | 10 |
| 未批准对外消息/承诺 | 0 | 0 |
| 找错版本事件 | 9 | 1 |
工时减少14.9小时,约32.0%,并不等于周岑多了四名员工。AI没有法律身份、组织记忆、道德判断、客户关系、被问责能力或自主岗位责任;系统只是减少部分执行负担。人物、任务和结果均为虚构教学案例,不代表任何职业都能获得同样收益。
角色地图先对齐客户价值流:不是把一个人复制四遍,而是保证每一步都有输入、结果和责任人
周岑先画从潜在需求到客户结果的价值流:发现问题→判断是否适合→确认范围→建立证据→制作交付→人工批准→客户接收→收款与归档→把反馈转成改进。R、G、D、O只是承担这些步骤的视图,不能像组织部门一样各自追求“产量”。
| 价值步骤 | 主要通道 | 结果证据 | 失败时回到 |
|---|---|---|---|
| 发现/判断机会 | G+R | 合格记录+事实来源 | G 分诊 |
| 确认问题与范围 | G+D | 已签署范围 + 成功标准 | 周岑/客户 |
| 研究与制作 | R+D | 证据包 + 草稿 | 对应上游输入 |
| 批准与交付 | D+周岑 | 审批 + 交付回执 | 修订版 |
| 里程碑与归档 | O | 发票输入 + 最终归档 | D/周岑 |
| 学习与改进 | O+R | 裁决反馈 + 规则提案 | 人工批准 |
每一步都问“客户下一步获得了什么”,而不是“这个角色生成了多少字”。R一天产出十份研究草稿,如果没有任何一份进入批准交付,属于在制品增加;O自动更新一百个状态,如果状态与实际回执不一致,属于更快制造错误。
价值流也揭示角色不必永远是四个。业务只有研究订阅时,G可以很轻;进入复杂交付期,D可能拆成分析与编辑两张角色卡。增加或合并通道的依据是交接、风险和容量,而不是希望看起来像一家大公司。
先拆岗位为任务,而不是先给AI写人设:同一“销售角色”里有可自动化、可辅助和必须人工的工作
周岑回看四周日历、邮件、文件版本和发票,共得到186次可识别任务执行。她逐项记录触发、目的、输入、动作、输出、接收者、失败后果、工具、时限和验收,而不是问“销售AI应该有什么性格”。
| 通道 | 执行 | 典型工作 |
|---|---|---|
| R研究 | 46 | 问题拆解、检索、证据表、更新观察 |
| G销售 | 38 | 潜在客户分类、会前准备、草拟跟进、提案输入 |
| D交付 | 64 | 请求受理、分析、章节、数字复核、客户版本 |
| O运营 | 38 | 排期、状态、发票准备、归档、指标 |
| 合计 | 186 | 四周实际结构 |
同一通道内部混合着不同责任。销售记录中的低风险字段可以按规则补全;会前公司资料可由 AI 准备;报价、范围、交付日期和发送动作则必须由周岑决定。把整条通道交给一个“销售员工”,反而会掩盖这种差异。
任务粒度以一个可验收输出为界。过大的“完成市场研究”无法控制,过小的“生成一句话”又增加交接;合适粒度如“为决策表补齐 8 个主张的来源定位信息”。
盘点时记录真实发生,而不是理想流程。周岑发现“寻找最新版文件”在四周出现17次、“从会谈笔记重建客户决定”出现9次,这些不是高价值角色工作,而是信息系统缺口;优先修版本和记录,不给AI创建一个“文件管理员人设”。相反,“决定报价是否覆盖新增国家”虽只出现3次,却因商业后果保留仅限人工。
她还区分需求频率与需求波动。每周固定发生且规则稳定的任务适合模板或自动化;低频但输入清楚的任务可按需AI辅助;高波动、高后果又缺稳定标准的任务先由人完成并积累样本。角色地图不是一次性画完,新增任务先进入待分类清单,经过三次实际执行后再决定执行方式。
再按行动权分四类,别把辅助、生成和自动化混成一件事
| 通道 | AI 生成 | AI 辅助 | 确定性 | 仅限人工 | 总计 |
|---|---|---|---|---|---|
| R | 16 | 20 | 4 | 6 | 46 |
| G | 12 | 14 | 5 | 7 | 38 |
| D | 18 | 30 | 8 | 8 | 64 |
| O | 6 | 10 | 13 | 9 | 38 |
| 合计 | 52 | 74 | 30 | 30 | 186 |
AI 生成表示模型可生成完整候选产物,但仍过放行门槛;AI 辅助表示周岑主导判断,模型只提供局部材料;确定性由规则、模板或普通代码完成;仅限人工涉及目的、客户承诺、价格、最终签字、敏感数据或高后果判断。
52项AI 生成不等于52项自主交付。候选报告章节即使格式正确,也不能自动发送;30项确定性也不需要为了“AI化”绕一层模型。分类依据是工作性质和失败后果,不是工具热度。
周岑用五个问题判断执行方式:输入是否可界定;输出是否有客观放行门槛;错误是否容易发现;动作是否可逆;失败是否只影响内部草稿。五项都强时才考虑AI 生成;判断性高但可提供材料时为AI 辅助;规则可穷举时优先确定性;涉及承诺、钱、权利、高后果或不可逆动作时仅限人工。
| 判断信号 | 倾向的执行方式 | 例子 |
|---|---|---|
| 规则固定、可自动验证 | 确定性处理/AI 生成 | 会议字段整理 |
| 证据可回查、输出是候选 | AI 生成 | 主张—证据表初稿 |
| 目的/取舍由人定义 | AI 辅助 | 市场优先级建议 |
| 需客户关系和情境判断 | 仅限人工 + AI 辅助 | 发现追问 |
| 外发、价格、合同、付款 | 仅限人工操作 | 提案批准 |
执行方式可以分阶段:AI先抽取,规则检查字段,人判断含义,AI再按批准内容排版。不要强迫整个任务只选一个工具。真正需要控制的是每一步谁有决定权、哪个产物成为下一步输入。
一张角色卡必须回答九个问题:角色名只用于导航,不能制造权力和责任幻觉
| 角色卡字段 | R研究通道示例 |
|---|---|
| 目的 | 为当前客户问题建立可追溯证据 |
| 触发 | 已批准的研究问题进入就绪 |
| 输入 | 问题、范围、来源策略、截止日期 |
| 允许的工具 | 指定搜索、只读资料库、证据表写入 |
| 禁止 | 联系客户、改范围、下最终结论 |
| 输出 | 主张 - 证据表 + 未知列表 |
| 质量放行门槛 | 来源支持、时间、实体、数字、边界 |
| 升级 | 来源冲突/付费墙/高后果主张 |
| 人工负责人 | 周岑批准问题与结论 |
其余三张角色卡使用同样字段。G 输出潜在客户简报或外发草稿,但没有发送权;D 输出带版本的客户版草稿,但没有最终交付权;O 可以更新状态和准备发票草稿,但没有银行操作、付款、签约或删除客户资料的权限。
系统提示词可以描述角色,但权限由运行环境、连接器和工作流控制。模型自称“我作为项目经理已经批准”没有效力;批准人、价格、截止日期和接收方必须来自人工或受控系统记录。
角色卡还有版本与适用范围。R-v1 只处理公开来源,未来若增加客户内部文档,不能沿用同一权限;G-v2 新增提案草拟,也不自动获得整个客户关系系统或邮件发送权限。每次变更都列出新增输入、工具、诱捕测试、失败方式和测试用例;已经开始的任务仍沿用启动时的旧版本,避免执行中途规则漂移。
卡片中的服务时限也不是用来给模型施压的“角色性格”。它规定何时转人工、何时停止,以及下游何时可以期待产物。若来源不足,R 按时提交“状态未知”比超时编造结论更合格;若客户输入晚到,D 应进入“等待客户”状态,而不是用虚构内容假装完成。
四条职责线可以交接,但不能互相越权
| 通道 | 可问责输出 | 明确不负责 |
|---|---|---|
| R研究 | 证据包、状态未知、来源监控 | 商业推荐与客户承诺 |
| G销售 | 合格商机、发现记录、草稿跟进 | 自动发送、定价、签约 |
| D交付 | 范围内产物、质检记录、客户版草稿 | 擅自扩范围或隐藏缺失 |
| O运营 | 队列、日历、版本、发票草稿、归档 | 付款、法律/税务判断 |
每个工作项只能有一个当前通道和一个人工负责人;可以有贡献者,但不能四个角色都“共同负责”。若一项工作跨通道,先完成上游产物并通过交接关口,再改变状态与负责人。
R 发现客户可能需要新服务,只能把商机信号交给 G,不能在研究报告中偷偷扩大提案。G 听到新需求,要将其记录为“范围变更请求”交给 D 和周岑,不能直接要求 D “顺便做”。这种边界保护的不只是 AI,也是一个人容易自我打断的工作方式。
相互排斥不等于信息封锁。G需要看到R已经批准的账户事实,但不看未裁决的所有搜索片段;D需要已签署范围和发现,不读取销售私下猜测;O只需里程碑、实体、金额来源和回执,不需要整份研究上下文。最小交接降低认知负担和数据暴露。
当周岑发现自己在两个通道扮演冲突角色时,记录决策负责人。例如G希望尽快成交,D判断范围不可交付,最终由周岑以容量、证据和客户结果作商业决定,并保留拒绝/改范围理由。不能让两个AI各写一份支持自己立场的报告后以“多数票”裁决。
用统一工作项代替四个聊天窗口:状态、版本、负责人和下一动作必须只有一个事实源
| 工作项字段 | 示例 |
|---|---|
| 标识 | WK-2026-071 |
| 客户/项目 | 客户别名与项目标识 |
| 泳道/当前负责人 | D / 周岑 |
| 任务合同版本 | 交付简报-v3 |
| 状态 | 复核 |
| 输入引用 | DISC-18、EVID-44 |
| 输出引用/版本 | 报告 v0.7 |
| 到期/优先级 | 2026-07-23 / P1 |
| 阻碍项/下一步行动 | 等数字复算 / 人工确认 |
| 审批日志 | 谁在何时批准什么 |
聊天只作为产生候选内容的界面,不能成为状态数据库。每次运行读取工作项与引用的产物,输出写回指定对象;不让模型根据长对话猜“我们做到哪了”。文件名、版本与已批准状态由系统生成。
同一任务在多个聊天里并行会产生双版本。检测到已有任务持有写入权时,新运行只能查看或申请接管;接管由周岑确认,并记录旧运行已经停止。这样,“数字员工互相协作”被替换成了可追踪的状态变更。
工作项引用产物而不是复制正文,避免四条通道各存一份过期内容。来源更新后生成新版本,并标记哪些下游项需要重新检查;已交付版本保持不可变,修订另开变更记录。客户问“上周交付的依据是什么”时,可以重现当时版本,而不是展示今天已经变化的知识库。
下一步行动必须是一个可执行动词、一个负责人和一个截止时间,如“周岑在周三前确认三个状态未知是否写入客户稿”。“等待处理”“让运营跟进”没有可验收终点,会在角色之间漂移。已阻塞也需要下一次检查日,防止成为隐形积压。
状态变化必须有证据,不能由模型一句“已完成”决定
请求受理 → 已分派 → 就绪 → 进行中 → 复核
→ 等待客户 / 修订 → 已批准 → 已交付 → 已归档
↘ 已取消 / 已阻塞
| 过渡 | 所需证据 |
|---|---|
| 请求受理→已分派 | 通道、优先级、负责人、风险 |
| 已分派→就绪 | 输入完整、范围批准、工具可用 |
| 就绪→进行中 | 进行中槽位、运行标识、写入权 |
| 进行中→复核 | 产物、来源、自检、已知差距 |
| 复核→已批准 | 人工审核或低风险规则放行门槛 |
| 已批准→已交付 | 确切接收人/内容/行动批准 |
| 已交付→已归档 | 回执、最终版本、留存 |
模型可以提议过渡,不能自己把客户稿从复核改成已交付。缺输入进入已阻塞/等待客户,而不是用猜测填满。取消保留原因,不删除历史,让以后知道某个机会为何停止。
状态还区分“做完动作”和“实现结果”:跟进草稿完成不等于客户已收到,发送回执不等于客户回复,报告已交付不等于客户接受。不同事实不能用一个完成覆盖。
状态转换要求重复执行不会制造重复结果。交付动作使用“工作项 + 版本”作为唯一识别:网络超时后先查发送记录,不自动再发一封;发票草稿重复运行只更新同一草稿,不创建两张;日历建议失败也不会偷偷换一个时间发送邀请。人工接管前先停止自动写入,避免人和系统同时操作。
每个状态设置最大停留时长。就绪超过 5 天,说明优先级或输入有问题;复核超过 2 个工作日,说明周岑的验收容量不足;“等待客户”到了约定日期,则触发一次人工决定:提醒、改期或取消。任务停留时间不是让 AI 自行催客户,而是把需要人取舍的地方暴露出来。
交接合同是最关键的“角色协作”:上游必须提供什么,下游拒收什么,都写成字段
| 交接 | 4周次数 | 必需数据包 |
|---|---|---|
| R→G | 24 | 潜在客户事实、信号、来源、状态未知、禁止表述 |
| G→D | 18 | 已签署范围、发现、成功标准、约束 |
| D→O | 30 | 最终版本、交付回执、发票里程碑、留存 |
| O→R | 20 | 重复问题、客户反馈、源更新需求 |
| 合计 | 92 | 结构化产物,不是“看上面聊天” |
交接验证器检查必填字段、版本、链接权限、数据类别和批准记录。下游可以接受、说明理由后拒收,或请求修改,但不能悄悄补写上游的关键事实。被拒收的工作回到原负责人,并保留次数和理由,成为流程改进信号。
例如G→D缺已签署范围,D不能根据销售草稿开始完整报告;R→G缺来源,G不能把推断写进对外提案;D→O没有交付回执,O不能把发票里程碑当已触发。
数据包同时包含留白:哪些内容未知、哪些表述禁止、哪些客户要求尚未确认。只传“推荐A市场”的结论会让下游误以为证据完整;传递支持、反证、假设和置信度边界,G才知道哪些话不能写成保证。
交接不通过时保留原数据包和验证器结果,新版本通过差异展示修改。下游拒收不是“不配合”,而是质量控制;若同一字段连续缺三次,修上游模板或培训,不让D每次私下补齐后继续。
从 28 次返开到 6 次,省下的是重新理解背景的时间
| 交接 | 基线重开 | 最终重开 |
|---|---|---|
| R→G | 11 | 2 |
| G→D | 7 | 1 |
| D→O | 8 | 2 |
| O→R | 2 | 1 |
| 合计 | 28/92 | 6/92 |
基线返开原因包括缺来源 9 次、范围不清 7 次、版本错误 6 次、负责人或下一步行动缺失 4 次、权限不可读 2 次,共 28 次。最终剩余的 6 次分别保留原因代码,并修改数据包或模板,不用一句“让 AI 写得更详细”笼统解决。
返开率从 30.4% 降到 6.5%,但数字只适用于本文这组教学任务。剩余 6 次中有 2 次是客户临时改变输入,并非 AI 失败;指标用于定位系统摩擦,不用于惩罚某个虚构角色。
返开节省要落到时间:基线每次恢复上下文、找来源和确认版本中位18分钟,28次约504分钟;最终六次中位14分钟约84分钟,四周减少约420分钟。这个估算单列,不与46.5→31.6的实际定时器再相加,避免重复计算;它只解释工时下降的一个驱动因素。
返开为0也不是目标。客户真实变更、发现新证据或主动纠错都应重新打开;若团队为了指标不记录返开,错误会在交付后出现。门槛≤8/92保留合理变化空间,并要求原因分布不出现高后果类。
一个人的优先级不是四个角色投票:先按客户风险、截止日期、可逆性和经济影响排一个总队列
| 优先级 | 定义 | 例子 |
|---|---|---|
| P0 | 已发生客户/数据/交付事件 | 错误外发、生产问题 |
| P1 | 48小时内硬截止日期或阻塞交付 | 客户报告复核 |
| P2 | 已承诺的正常交付/合格管道 | 发现、提案 |
| P3 | 改进、内容、知识资产 | 模板与研究更新 |
| 已暂停 | 容量不足/输入缺失 | 未批准的新想法 |
同一客户的紧急研究不能由R自称重要就抢占P1交付;优先级由规则加周岑确认。每个项记录为何现在和延迟成本,不能只写紧急。P0会暂停低优先自动运行并发出明确恢复计划。
销售机会不因新鲜就永远挤压已签客户,运营账务也不能拖到月底爆发。总队列将角色冲突变成显式取舍:若本周容量只有32小时,P3自动排到下周,而不是让四个聊天都继续生成新任务。
同级项目再按截止日期信心度、阻塞别人、可完成性和切换成本排序。一个15分钟即可解除D阻塞的O任务,可以先于同级的两小时研究;但拆小任务不能绕过P0/P1。任何手工调整都写原因,月末检查是否总有某客户或某通道被系统性挤压。
每天最多一次重新排序,除P0外不随新消息频繁跳转。G的新负责人先进入请求受理,等待下个分诊;否则AI越会持续发现“机会”,周岑越难完成已承诺工作。关闭通知和设置请求受理窗口是角色系统的一部分。
总队列之后还要限制在制品,因为人的验收能力不会并行增长
| 通道 | 在制品限制 | 进入条件 |
|---|---|---|
| R | 3 | 问题与源范围清楚 |
| G | 5 | 潜在客户通过资格判断 |
| D | 2 | 范围签字、输入就绪 |
| O | 4 | 事件/里程碑已发生 |
超过限制的新项留在就绪,不启动AI。否则模型很快生成十份草稿,周岑的复核队列积压、信息过期,反而制造更多切换和版本冲突。进行中工作计算的是未完成项,不是正在调用的模型数。
每天只有两个深度复核阻塞,D最多同时2项;G的五项包含等待周岑批准的外发草稿。已阻塞超过48小时触发清理:追输入、重新排期或取消,不让旧上下文无限悬挂。
在制品限制也约束自动产生的子任务。R发现20条线索时,不自动创建20个D项,只把它们放进候选列表,由周岑选择最多3条进入就绪。G一次生成五个跟进草稿后必须等审批,不再因为客户未回自动生成第二轮消息。
当复核队列达到上限,系统优先停止产出而不是继续堆草稿。吞吐取决于瓶颈的人类验收;让模型并行100次只能缩短生成阶段,不能扩张周岑的判断、客户沟通和最终责任容量。
队列决定做什么,日历决定何时真的有人验收
| 周容量 | 工时 |
|---|---|
| 客户交付与复核 | 16 |
| 销售/发现 | 4 |
| 研究与源维护 | 4 |
| 运营/财务准备 | 4 |
| 缓冲/事件/恢复 | 4 |
| 合计 | 32 |
自动运行安排在复核阻塞之前完成,避免输出在夜间堆积。周一研究与排期,周二/四深度交付,周三销售,周五运营和知识回流;真实P0可以改变安排,但必须同时重排被挤出的项。
缓冲不是闲置浪费。没有4小时恢复空间,一次客户变更就迫使周岑在晚上验收AI草稿,质量和健康成本上升。AI节省时间先用于把46.5小时降回可持续32小时,而不是立即塞入更多客户。
时间块还区分制作和决定。早上注意力充足时做数字复核、范围和外发批准;低认知负担的归档、格式和队列清理放在固定运营块。模型运行不要求周岑盯屏,但运行完成时间要靠近预定复核,避免隔天重新加载背景。
每周计划使用历史中位数,而不是模型给出的乐观估时;D 类交付则按 80% 的任务能在该时间内完成的口径预留。若本周 P1 任务预计已占 28 小时,只剩 4 小时缓冲,就不启动 P2 提案;销售可以记录机会,并给出真实回复时间。容量是对外承诺的输入,不是内部感受。
工时从46.5降到31.6:分通道看节省与新增控制成本,避免只报告“生成快了”
| 通道 | 基线每周工时 | 试点每周工时 | 变更 |
|---|---|---|---|
| R | 9.2 | 5.1 | -4.1 |
| G | 8.3 | 5.4 | -2.9 |
| D | 22.6 | 17.8 | -4.8 |
| O | 6.4 | 3.3 | -3.1 |
| 合计 | 46.5 | 31.6 | -14.9 |
试点包含每周1.8小时复核 AI、0.9小时队列/指标和0.6小时异常处理,这些控制成本已分散在四通道,未从结果中扣掉。生成时间下降最大不一定是净节省最大;D仍需读来源、复算和对客户负责。
31.6 小时低于 32 小时容量,但仅有 0.4 小时余量,因此不能立刻承诺新客户。还要检查连续四周中 95% 的周工时是否都在门槛内,不能用平均值掩盖某一周的 55 小时。
工时下降不来自单一模型:R 的证据模板减少重复检索,G 的需求信息包减少 D 的返问,O 的状态自动化减少寻找版本,在制品限制和时间块减少切换。每个驱动因素单列负责人,避免将全部 14.9 小时归功于“AI 员工”。若停用模型后状态和模板仍有收益,也应如实保留。
周岑同时看客户价值:若减少工时却让报告更模板化、客户需要更多会议解释,节省会转移到客户或未来支持。试点记录初稿、按时、返开和客户反馈,不能只看日历变空。
外发、定价、范围、最终交付和付款永远绑定具体人工批准,不交给“销售智能体”或“运营智能体”
| 操作 | AI可做 | 人工审核 |
|---|---|---|
| 邮件 | 根据已批准的事实起草 | 接收方、正文、附件、发送 |
| 提案 | 拼装标准条款与证据 | 价格、范围、截止日期、法务 |
| 客户报告 | 草拟/检查/生成差异 | 最终主张、数字、交付 |
| 发票 | 根据里程碑准备草稿 | 实体、金额、税务、发送 |
| 日历 | 建议时段 | 对外邀请/改客户会议 |
| 客户关系系统 | 补低风险字段 | 资格判断、销售预测承诺 |
批准显示完整动作、目标、版本和影响;内容变更后旧批准失效。“允许销售角色代表我联系客户”过于宽泛。AI也不能通过把消息存入共享文档绕过发送门控。
仅限人工不是保证人一定判断正确。关键数字用确定性复算,合同/税务/法律问题转专业人员,客户在交付前确认范围。人类责任需要证据和能力,不是一个象征性按钮。
批准记录包含工作项、产物内容指纹、接收方、操作、关键字段差异、风险提示、批准人和失效时间。周岑批准 REPORT-v0.8 后,模型修改数字生成 v0.9,必须重新批准;不能沿用“这个项目都可以发”的长期许可。发送后将回执写回同一工作项;如果失败,先查服务商状态再决定是否重试。
对外草稿界面隐藏“销售角色的信心分数”,优先展示来源、状态未知和事实变化。拟人化语气容易诱导周岑相信一个很肯定的虚构同事;操作界面应让她看到这是候选产物和不完整证据。
同一个人既制作又验收,只能补偿独立性,不能假装职责已经分离
| 控制 | 适用任务 |
|---|---|
| 创建者/审核者提示分离 | 普通草稿自检 |
| 30分钟后第二遍阅读 | 重要客户稿 |
| 源优先盲审 | 主张/引用 |
| 确定性计算 | 数字与公式 |
| 检查清单 + 差异 | 版本变更 |
| 客户/外部专家 | 高后果结论、合同、法律 |
把另一个AI叫“审计员”不等于独立;它可能共享同一模型、上下文与错误。周岑的第二遍也会受自己先前判断影响。文章不承诺一人企业能复制大型团队的职责分离,而是按后果选择可行补偿,并明确需要外部人的边界。
若截止日期不允许有效复核,正确动作是缩小范围、延期或明确标为草稿,不是让 AI 角色互相投票后自动批准。重要客户稿至少保留来源定位信息、版本差异和批准记录。
对高价值客户的最终报告,周岑安排外部同行按月抽查2份,重点看问题定义、证据关系、遗漏和客户可能受影响处;外部人不接触不必要客户数据。发现系统性问题时回查同模板的历史交付。独立性有真实成本,服务定价和容量必须包含,不能假装另一个模型免费解决。
自审疲劳也要监测。连续复核超过 90 分钟、当日已经处理两项高复杂稿,或遇到夜间临时交付时,系统应把最终批准延到下一个工作时段,或要求第二人复核。紧急情况由周岑明确接受风险并缩小输出,而不是降低默认门槛。
知识不是四个角色共享的无限记忆:事实、决定、模板和经验必须分层、带来源与有效期
| 知识类型 | 写入门 | 消费通道 |
|---|---|---|
| 来源事实 | 来源位置、日期、可信度 | R/D/G |
| 客户决策 | 会议回执、人确认 | G/D/O |
| 运营规则 | 周岑批准、版本/生效 | 全部 |
| 模板 | 测试、负责人、范围 | 对应通道 |
| 经验教训/复盘 | 具体事件、适用条件 | 改进流程 |
| 临时上下文 | 运行范围、过期 | 当前项 |
模型总结不自动进入长期知识库。R 从网页提取的事实仍按不可信外部来源处理;G 记录的客户偏好必须有会议备注;D 的一次特殊例外不能升级为全局规则。每条知识都要记录负责人、来源、客户范围、创建时间、过期时间和替代它的新版本。
跨客户内存默认禁止,公共模板只能包含去客户化结构。发现错误先标已取代并触发受影响项,不让四条通道继续消费旧结论。
写入长期知识前要去掉执行性诱导和临时情绪。“客户很急,以后都优先”不能成为永久优先级规则;“报告不要提X”要确认是当前项目范围、合同要求还是一次偏好。客户决定到期时进入复核,不悄悄沿用多年。
检索返回的内容也按通道最小化。O查询发票里程碑不获得完整会议记录;G查询客户偏好不自动读其他客户。权限与元数据过滤器在检索层实现,不靠角色提示词承诺“不要看”。
异常必须进入停止和升级流程,不能交给“数字员工自己解决”
| 失败 | 检测 | 处置 |
|---|---|---|
| 缺失输入 | 就绪验证器 | 已阻塞,向负责人要字段 |
| 工具/认证失效 | 提供商错误/过期 | 暂停泳道、撤销/重连 |
| 错误版本 | 哈希/版本不匹配 | 停止输出、恢复已批准 |
| 队列过载 | 在制品/年龄阈值 | 不启动新运行、重排 |
| 质量漂移 | 评估/首轮 | 回滚提示/模型/路由 |
| 客户/数据事件 | 规则、日志 | P0、隔离、人工响应 |
R 研究包目标在 24 小时内进入复核,G 外发草稿要求当日完成但不得自动发送,D 按项目里程碑推进,O 的状态更新要求在 4 小时内完成。服务时限从任务“就绪”时开始计算;进入“等待客户”后暂停计时。模型生成用了几分钟,并不等于完整任务只用了几分钟。
连续两次同类失败、已阻塞超过48小时、交付队列超过2或任何越权动作都触发停止。恢复要有根本原因、修复、测试和负责人,不以“重新提醒智能体注意”结案。
每条通道保留人工回退:R可用标准搜索/证据表,G可人工写短跟进,D可从已批准的大纲继续,O可用简化队列和发票清单。供应商或自动化故障不应让周岑失去客户承诺、最终版本和联系方式;关键产物定期导出为可读格式。
故障演练包含撤销工具、模拟过期令牌、制造错误版本、阻塞一个交接和中断运行。验收不是AI最后给出“已恢复”,而是人工能从工作项看到影响范围、用回退完成P1并确认旧运行不再写入。
四周验收同时看容量、质量、交接和经营结果:只有更忙而没有更稳,不算成功
| 指标 | 基线 | 试点 | 放行门槛 |
|---|---|---|---|
| 工时/周 | 46.5 | 31.6 | ≤32 |
| 交接重开 | 28/92 | 6/92 | ≤8/92 |
| 按时交付 | 10/12 | 12/12 | ≥11/12 |
| 首版交付 | 7/12 | 10/12 | ≥9/12 |
| 错误版本 | 9 | 1 | ≤2 |
| 未批准的外发 | 0 | 0 | 必须0 |
| P0 级客户/数据事故 | 0 | 0 | 必须0 |
试点先影子一周:AI产出不改变实际状态;第二周开放接收/输出低风险写入;第三周开放生成/删除草稿但保留所有外发与最终交付放行门槛;第四周只在前三周达标时扩大。任何硬性放行门槛失败立即回到上阶段。
12项交付样本不大,因此结果用于决定继续试运行,不声称普遍生产率。每周回看最慢3项、所有返开与所有人工覆盖,防止平均值掩盖异常。
经营结果只作辅助:合格商机、提案周期、已收款里程碑和客户续约信号都延迟且受市场影响,不能把四周变化全归因AI。周岑先要求流程指标不退化、容量可持续,再观察三个月业务结果。若多出时间没有转成客户价值,也可以转成休息与风险降低,不硬造收入。
试点结束由周岑逐通道选择保留、修订、移除。一个角色如果只增加提示词维护和复核、没有减少交接或提升结果,就删除;不因为已经起了名字、做了图标而保留。退出也包括撤工具、停止进度表、归档卡片和重新分配未完成项。
复制这张个人AI角色地图:最终只保留能减少交接和责任模糊的角色,不保留好听的人设
| 映射字段 | 必填内容 |
|---|---|
| 通道 | 接收/生成/删除/输出或自己的真实职责 |
| 任务 | 执行方式、频率、风险 |
| 角色卡片 | 用途/输入/工具/输出/关口/升级/负责人 |
| 工作项 | 状态、版本、到期、下一步行动 |
| 交接 | 必需数据包、接受/拒绝 |
| 容量 | 工时、进行中工作、日历占用、缓冲 |
| 人工关口 | 外发、承诺、金钱、最终、高后果 |
| 知识 | 来源、范围、负责人、过期 |
| 指标 | 时间、质量、交接、事件、业务 |
| 停止/恢复 | 阈值、回退、复核日期 |
国际劳工组织 2025 年的相关说明把生成式 AI 对工作的影响更多描述为任务与岗位转型,而非简单的“岗位末日”;美国国家经济研究局对 5,179 名客服人员的研究观察到平均生产率提升,而且不同经验群体的效果并不相同,但这不能外推到所有单人企业工作。NIST 人工智能风险管理框架强调定义和区分人机角色、监督与责任,并指出其 1.0 框架正在修订。本文因此把 AI 能力落实到具体任务和配置,不把工具包装成雇员。
- ILO:Generative AI at work—job transformation
- NBER:Generative AI at Work
- NIST AI RMF Core
- NIST:AI Risk Management and Human-AI Interaction
- NIST:Descriptions of AI Actor Tasks
今天不要创建四个新聊天。先导出过去两周日历和交付记录,列出20个任务执行;为每项选AI 生成、AI 辅助、确定性或仅限人工,再为最频繁的一条通道写九字段角色卡。只要输出没有负责人、放行门槛和下一状态,就先不称它为一个角色。