先看结果:420人都听过90分钟宣讲,真正能在索赔场景作对的决策只有55.19%
岑航物流准备在运输异常索赔流程中上线一个AI助手。它读取客户提交的破损照片、运单、服务合同与历史沟通,提取事实并起草索赔答复;在部分小额场景中可以提出补偿建议,但实际承诺必须经过确定性规则和有权限的人批准。首轮培训给420人安排了同一场90分钟宣讲,内容包括生成式AI概念、提示词、安全提醒和产品演示。389人完成,完成率达到92.62%。管理层看到这个绿色数字,准备把“已完成培训”设为开通权限的唯一条件。
项目组随后换了一种验证方式:为五类角色各设计10个贴近真实工作的决策点,共420×10=4,200项。管理者答对146/280,流程负责人260/520,普通用户1,392/2,400,建设者280/560,审核者240/440,合计2,318/4,200=55.19%。其中有682项属于关键错误,可能引发错误承诺、敏感数据扩散、越权操作或错误放行;另有1,200项虽然不会立刻造成重大后果,却缺少必要的核查或升级动作。
| 角色 | 人员 | 决策 | 修正前 | 严重不安全 | 其他未完成 |
|---|---|---|---|---|---|
| 管理者 | 28 | 280 | 146 | 38 | 96 |
| 流程负责人 | 52 | 520 | 260 | 86 | 174 |
| 普通用户 | 240 | 2,400 | 1,392 | 390 | 618 |
| 构建者/集成者 | 56 | 560 | 280 | 102 | 178 |
| 审核、控制与支持人员 | 44 | 440 | 240 | 66 | 134 |
| 总计 | 420 | 4,200 | 2,318 | 682 | 1,200 |
组织保留35分钟共享基础课,再按角色配置90—240分钟的课程、练习和上岗产物。两周后,学员使用难度相当、但不重复原题的情境集复测:管理者252/280,流程负责人468/520,普通用户2,136/2,400,建设者493/560,审核者386/440,合计3,735/4,200=88.93%;关键错误降至84项,其他不完整决策为381项。个人只有在角色总分达标、关键情境全部通过,并交付对应工作产物后,才获得相应权限。未通过者不是再看一遍相同视频,而是根据错误类型进行练习、辅导和重测。
这是一个虚构教学案例,所有公司、人员、题目、时长和结果均为教学数据,不是培训行业基准。本文解决的是怎样设计、验证并维护角色化AI素养项目;它不代替岗位技能训练、具体系统操作手册、适用法律判断,也不把一次考核解释成永久胜任。E32将单独讨论AI推广角色的运营模型,本文不把业务专家顺手变成无限责任的免费支持人员。
全员共同了解AI仍然必要,但共同起点不等于共同课程、共同考题和共同权限
五类角色需要共享一小段语言:系统为谁服务、能做与不能做什么、数据去向、输出为什么需要证据、工具动作会产生什么外部影响、怎样报告问题。没有共同语言,管理者会把模型错误理解为“用户提示写得不好”,建设者会把流程拒绝理解为“业务抗拒”,审核者也难以说明为什么一个高平均分系统仍不能上线。
差异发生在决定权。普通用户要判断这份索赔草稿是否与当前合同和照片一致;流程负责人要决定哪些状态允许AI参与、何时必须人工接管;建设者要证明身份、检索、模型、规则和工具边界;审核者要挑战证据并暂停放行;管理者要配置人员和承担剩余风险。让五类人回答同一组“什么是大模型”的选择题,最多证明记住词汇,不能证明会完成这些不同决定。
| 共享概念 | 管理者问题 | 用户问题 | 建设者/审核者问题 |
|---|---|---|---|
| 目的边界 | 此用途是否应存在及其范围为何 | 此请求是否在已批准的用途范围内 | 用途是否已强制执行且可测试 |
| 数据 | 业务可接受哪些数据类别 | 我可以把这份文件提交给系统吗 | 数据流向何处、保留多久、向谁披露 |
| 证据 | 何种证明足以扩展 | 何种来源支持此答案 | 能否从版本/日志中复现声明 |
| 人工决定权 | 谁拥有最终决定权 | 我必须批准或拒绝什么 | 批准是否发生在影响前,是否看见具体对象并留下记录 |
| 失败 | 何时停止服务 | 如何报告并恢复当前案例 | 如何遏制, 调查并防止复发 |
角色化不是为高职级提供更短课程,也不是把管理者排除在具体责任之外。管理者不必学习每个接口参数,但必须能识别所谓“人工在环”是否真实,人员是否有足够时间和决定权;建设者不必代替业务人员解释合同,却必须知道什么时候不能把不确定的合同解释直接变成自动补偿。课程深度由任务和后果决定,不由组织地位决定。
先画角色—任务—决定权地图:按谁必须作出什么判断分组,不按组织架构复制名单
培训团队先观察端到端流程,从事件发生到最终索赔关闭,列出每个AI相关决定、做决定的人、输入、外部影响和失败后果。一个人可以承担两个角色,例如小团队的流程负责人同时审核例外;同一职位也可能有不同角色,例如客服主管既是普通用户,又在超过¥2,000时成为批准人。学习记录因此绑定角色分配和范围,而非只绑定“运营部经理”。
| 角色 | 主张流程中的决定 | 所需工作成果 | 权限边界 |
|---|---|---|---|
| 管理者 | 批准用途、预算、人员配置、扩展或停止 | 已签署的发布决定 | 不能单独豁免关键控制 |
| 流程负责人 | 定义状态、验收、例外和回退 | 已批准的流程图与处理时限 | 负责工作流,不替代平台安全负责人 |
| 普通用户 | 提交允许的数据, 验证草稿, 升级 | 已审核的案例记录 | 无直接规则/模型变更 |
| 构建者 | 实施数据, 评估, 身份, 规则, 日志 | 版本化的发布包 | 不能接受业务残余风险 |
| 复核人 | 测试证据,在授权范围内批准或暂停 | 复核决定及发现 | 独立于项目上线目标 |
角色地图还应包含受影响但不操作系统的人。客户收到的索赔结论可能影响现金流和争议权利,他们不是课程学员,却决定课程必须覆盖通知、更正、申诉和尊重的沟通。外包客服、临时项目成员、供应商实施人员即使不在内部人事系统,也会读取数据或改变系统;其课程、证明和撤权不能由采购合同一句“接受政策”代替。
培训负责人为每条分配记录系统、地区、数据、动作、有效期和管理者。例如“普通用户—只读草稿—华东企业客户”与“例外批准人—可批准≤¥2,000 信用”是不同范围。员工转岗、临时代理、系统扩权时,身份系统必须重新检查资格;原课程完成记录不能自动继承新的高影响权限。
建立能力基线时不要先问“你会不会用AI”,而要让人处理与岗位相同的输入和约束
自评适合了解焦虑、支持需求和使用习惯,不适合判断可否上岗。有人因熟悉聊天工具而高估能力,也有人能正确核对合同却自评保守。基线采用情境题、实操、工作产物与必要访谈:每题有真实形态材料、明确角色、允许动作、时间限制和期望证据,评分看行为而非是否使用指定术语。
普通用户基线包含10个决策:确认客户身份、选择允许文件、识别过期合同、区分观察与推断、核对金额、发现缺失证据、处理模型不确定、禁止粘贴额外个人信息、在承诺前升级、记录问题。建设者面对同一业务但回答版本、权限、检索、策略、日志、失败语义和回滚;管理者则判断是否扩量、资源是否足够以及何时停止。
| 诊断设计 | 填写示例 | 拒绝信号 |
|---|---|---|
| 输入 | 声明 C-204, 两张照片, 运单, 合同 v3/v4 | 仅是一个通用问题 |
| 角色 | 普通用户, 无授信权限 | 参与者选择任意角色 |
| 决策 | 接受草稿, 编辑, 拒绝或升级 | 仅询问定义召回 |
| 证据 | 引用当前合同条款和照片事实 | 答案无可追溯依据 |
| 关键行为 | 审批前无承诺 | 平均分数掩盖了不安全行为 |
| 可观测记录 | 选择, 编辑, 来源, 时间, 报告 | 仅完成复选框 |
基线题不能拿生产秘密随意上传到培训平台。材料使用合成或经批准脱敏的案例,保留业务结构和错误模式;若去标识后让任务失真,由数据负责人批准隔离环境和最小访问。评分者先用20份答案校准,比较同一答案是否得到一致判定;分歧集中处要改评分标准和示例,不能用培训师直觉覆盖。
共享基础课只承担六个最低共识,控制在35分钟并用一个跨角色案例串起来
共享课以运输索赔的一条案例展示系统边界:AI读取哪些文件,哪部分是抽取、哪部分是生成,哪些来源有优先级,模型没有何种权限,哪个人决定,怎样报告。讲师不从模型历史开始,也不把“写更好的提示词”作为主轴。每个概念都连接到一次可观察行为,让随后角色课沿用同一语言。
| 共享模块 | 课后行为 | 快速检查 |
|---|---|---|
| 目的/限制 | 区分草稿与决策 | 正确标记三个输出 |
| 数据处理 | 选择已批准的来源和渠道 | 拒绝一个被禁止的输入 |
| 证据/不确定性 | 追踪声明并标记未知 | 发现无依据的金额 |
| 工具/效果 | 区分建议与行动 | 识别影响前的批准 |
| 人工责任 | 指定最终负责人及升级路径 | 将异常路由至对应角色 |
| 报告与恢复 | 保留案件编号并安全停止 | 生成可用于复现的问题报告 |
35分钟不是普遍最优时长,而是本案例为减少重复采用的设计。共享课结束只授予进入角色训练的资格,不授予生产权限。快测失败说明共同语言尚未建立,学员先看对应五分钟讲解并重新处理不同案例;若大量人员在同一题失败,课程负责人修内容,而不是把420人的错误全部归因于注意力。
共享课也明确AI素养不是要求每个人成为模型专家。普通用户不需要解释注意力机制,管理者不需要写提示词;但任何角色都不能把系统拟人化成“它已经理解合同”,也不能在不清楚数据接收方时使用。重点是当前工作中的判断能力、边界和求助路径。
五类角色面对同一条失败链,却必须在不同位置作出决定
管理者课程训练五个决定:是否做、以什么范围做、给谁资源、接受什么剩余风险、何时停
管理者课使用90分钟工作坊,不以“AI战略愿景”收尾,而要交付一页发布决策。输入包括基线、候选价值、错误分布、人工容量、依赖、数据/安全结论和停止门槛。管理者需区分模型展示效果与流程结果,也要看到培训本身需要带薪时间、替补人力、辅导与重测容量。
| 管理者决策 | 所需证据 | 不安全回答 |
|---|---|---|
| 目的/价值 | 基线与目标结果 | “竞争对手使用它” |
| 范围 | 用户, 客户, 数据, 操作 | “发布后的所有声明” |
| 资源 | 审查员, 支持, 事件负责人 | 假设用户承担工作 |
| 残余风险 | 关键故障与控制 | 仅接受平均准确率 |
| 扩展/停止 | 不可突破的门槛与决定权限 | 用培训完成率触发发布 |
练习中,28名管理者收到一份写着“完成率92.62%、演示成功”的简报,同时也看到682项关键错误,以及审批人员每天只能处理40件的容量事实。正确决定既不是立即全量上线,也不是因为AI存在风险就完全停止,而是先限制为只读草稿,完成角色训练,补充高峰期审批能力,再根据关键错误和客户结果决定下一阶段。如果管理者把审核责任笼统写给“业务团队”,却没有具体负责人、处理容量和决定权限,这份产物就要退回。
管理者考核包含预算冲突:上线日期不变时,必须在缩小范围、增加人力、延后或保留人工方案之间做选择,不能暗中删除控制。通过标准为10题中至少9题正确,且“越权承诺后仍扩量”“没有申诉能力却自动拒赔”等关键题必须正确;未通过时暂不拥有规模或例外签署权,由上一级或指定权限共同决定。
流程负责人课程把“AI加入现有流程”改写成状态、输入、验收、例外和人工接管
流程负责人最容易把课程误解为编写标准提示词。真正产物是一张执行前后流程图与操作规则:每个状态谁负责、AI可读什么、产生什么、进入下一状态的条件、无法判断时去哪里、外部承诺在哪一步形成。课程用150分钟拆一条索赔,再让学员独立处理对照案例。
| 状态 | AI 角色 | 人工决策 | 证据已保存 | 回退 |
|---|---|---|---|---|
| 请求受理 | 分类文档、标记缺失 | 用户确认案件身份 | 文件编号及版本 | 手动登记 |
| 事实抽取 | 草拟事件/金额 | 用户对照来源进行核实 | 字段 - 来源关联 | 人工抽取 |
| 资格 | 检索相关条款 | 流程专家解决冲突 | 条款/版本 | 政策台 |
| 回复草稿 | 拟定限定措辞 | 案件负责人编辑/驳回 | 差异 + 来源 | 已批准模板 |
| 授信提案 | 仅计算候选项 | 授权审批人决定 | 规则结果 + 签名 | 无授信承诺 |
| 关闭 | 总结最终状态 | 负责人确认外部记录 | 执行回执与客户通知 | 人工对账 |
52名流程负责人在基线测试中最常见的严重错误,是把“AI给出答案”直接连接到“发送给客户”,忽略合同版本冲突和审批容量。课程要求明确“无法继续判断”的状态:缺少当前合同、照片不足、客户身份不一致或规则服务不可用时,不得猜测;系统要保存原因,并把案例交给有权处理的人。处理时限必须覆盖人工队列。若高峰期例外数量超过容量,就减少进入自动流程的合格流量,而不是催促人员盲目批准。
考核产物需包含正常、边界、失败和恢复路径;只画理想箭头不得通过。流程负责人还要选20个真实形态样本建立验收集,说明正确字段、允许差异、关键错误与业务终态。通过标准为总分≥90%、所有外部承诺与敏感数据题正确、流程图经构建者和复核人各挑战一次。
普通用户课程围绕一次真实案例展开:准备用对输入、验证关键字段、决定下一步并留下证据
普通用户人数最多,但课程不能退化成“十个提示技巧”。120分钟训练采用示范—分步练习—独立案例。用户先确认自己处理的客户和目的,再从允许来源中选择材料;收到结果后逐项核对事实、合同版本、金额、语气和缺失,不把流畅文本当正确。最后选择接受、编辑、拒绝或升级,并在外部动作前完成记录。
| 用户检查 | 问题 | 案件记录中的凭证 |
|---|---|---|
| 身份/目的 | 正确客户及已批准任务 | 账户 + 目的代码 |
| 输入权限 | 这些文件能否进入此流程 | 来源编号与数据类别 |
| 事实 | 照片/日期/运单匹配 | 字段 - 来源引用 |
| 策略 | 当前条款及区域 | 文档版本 + 条款 |
| 金额 | 确定性规则一致 | 计算器/政策结果 |
| 不确定性 | 任何缺失/冲突 | 未知原因 |
| 操作 | 谁有权承诺或批准 | 审批人身份与执行回执 |
| 报告 | 问题能否复现 | 案件、模型和内容编号 |
课程故意放入一份旧合同v3。助手引用其中“最高赔付运费20%”的旧条款,生成¥1,860的补偿建议;现行v4合同上限为8%,确定性计算结果应为¥744。正确操作不是把数字改成¥744就结束,还要向知识负责人报告旧文档仍被检索的问题,阻止当前承诺,并确认是否有其他案例受到影响。只修眼前这段文字,会让系统在下一份索赔中继续重复同类错误。
普通用户10题需至少9题正确,敏感输入、错误客户、无来源金额、权限不足和对外承诺五类关键题全部正确。未通过者仍可访问沙盒练习和人工流程,不开生产助手;通过后也只获得其分配的权限。管理者不能因队伍忙而批量豁免,培训团队需提供不同班次、辅助技术和有薪练习时间,避免把组织准备不足归咎个人。
建设者课程不只教模型和提示:要证明数据、身份、规则、评估、日志、发布与恢复共同成立
建设者包括产品、工程、数据、平台和集成人员,240分钟课程用发布包作为产物。学员从流程契约推导技术边界:检索只能返回当前客户和有效合同;模型身份没有发送或信用权限;金额由确定性服务计算;审批绑定具体对象和差异;每次运行记录输入引用、版本、工具结果和终态;失败不自动重复有副作用动作。
| 构建领域 | 所需证据 | 关键故障 |
|---|---|---|
| 数据/检索 | 租户, 版本, 权限测试 | 跨客户或过期来源 |
| 模型/上下文 | 版本化包及注入测试 | 不可信文本变更权限 |
| 身份/工具 | 限定范围的短效身份 | 模型可直接发送/入账 |
| 策略/计算 | 确定性规则与测试 | 从文本生成的金额 |
| 评估 | 代表性 + 关键用例 | 平均值掩盖严重故障 |
| 可观测性 | 追溯至源头, 操作, 结果 | 无法复现客户影响 |
| 发布/恢复 | 小流量验证、紧急停止、回滚与对账 | 回滚后仍遗留外部影响 |
建设者基线中102项关键错误集中在把提示词当权限边界、只记录最终文本、重试状态未知动作和用单一准确率放行。课程给一条失败追踪:模型请求信用,工具超时,客户端再次调用;正确设计先查询幂等键和权威状态,不直接再执行。答案“最多重试三次”即使听起来稳健,也可能创建三笔信用,必须判为关键错误。
建设者通过需要提交可运行证据:至少40例任务评估、所有关键测试通过、权限负面测试、一次失败恢复与一次回滚/对账演练。代码测验高分但无法解释业务状态的人不能单独签放行;懂业务但不会写代码的产品负责人也不能替安全验证。课程让跨职能人员看懂接口,责任仍由相应专业角色承担。
审核者课程训练如何挑战主张、抽样和放行,而不是学习替项目团队补齐材料
审核者包含风险、安全、隐私、法务、内部控制、质量和运营支持,具体组合随案例变化。180分钟课程用同一发布包进行证据链检查:主张是什么、证据是否匹配当前范围、失败样本是否覆盖、人工控制是否真实、剩余风险由谁接受。审核者可以要求修改、限制、暂缓或停止,不以帮助项目准时上线为主要绩效。
| 复核主张 | 挑战 | 可接受的凭证 |
|---|---|---|
| “仅草稿” | 运行时可调用影响工具 | 身份/工具注册表/负向测试 |
| “人工审核” | 影响前, 精确对象, 足够时间 | 审批追溯 + 容量结果 |
| “当前合同” | 失效与检索行为 | 版本测试 + 撤销记录 |
| “无敏感信息泄露” | 源到汇及日志/供应商 | 流程图 + 对抗测试 |
| “可回滚” | 包含所有下游影响 | 演练回执 + 剩余清单 |
| “用户已受训” | 角色、分数、关键题结果和权限范围 | 与工作分配关联的资格记录 |
审核练习放入一个包装精美但范围不符的报告:测试在英文合成合同上完成,生产对象包含中文扫描件;审批容量只测每天20件,而试点计划200件;旧模型版本通过评估,新版本尚未回归。正确结论是暂停并列明补证和允许的最小范围,而不是因文档齐全批准,也不是笼统写“风险较高”。
审核者需在12个案例中至少11个与最终决策一致,所有越权、跨客户、关键后果和证据版本题正确;还要通过一次双人盲评校准。连续分歧说明评分标准或专业边界需改进,不把高级审核者答案自动设为真。项目团队可以提供事实或申诉,但不能让提交人独自验证并接受自己的剩余风险。
完整走例:旧合同导致¥1,860错误建议,五个角色必须在不同位置阻断同一条失败链
输入工单C-204:客户申报一票货物破损,运费¥9,300;照片显示外箱受压,签收单备注不清;知识库中同时存在已失效合同v3和现行合同v4。v3的上限是20%,模型因此生成¥9,300×20%=¥1,860,并写下“我们将返还”;v4的上限是8%,而且当前还缺少承运方复核,所以只能形成一份¥744的待审建议,不能向客户作出承诺。
| 步骤 | 观测证据 | 正确角色操作 | 已保存输出 |
|---|---|---|---|
| 请求受理 | 客户/账户匹配 | 用户确认身份 | 工单绑定 |
| 检索 | 版本 3 与版本 4 冲突 | 用户停止; 流程负责人定义优先级 | 冲突记录 |
| 计算 | 9,300×8%=744 | 确定性服务计算 | 规则版本/结果 |
| 措辞 | “将返回 1,860” | 用户拒绝外部承诺 | 差异 + 原因 |
| 知识缺陷 | 检索返回了过期v3 | 构建者修正索引规则,流程负责人调查影响 | 受影响查询清单 |
| 放行决策 | 此前有7个相关案例 | 审核者暂停原路径,管理者保留人工处理 | 已签署的受限运行决定 |
五个角色不能用同一句“注意核查”作答。普通用户阻止当前答复并报告;流程负责人明确版本优先和状态未知路由;建设者修正有效期过滤、回归检索并查询过去受影响运行;审核者验证7例范围、补救和新测试;管理者决定在证据完成前保持人工流程并配置客户沟通资源。若任何一环把问题视为单个用户的编辑错误,组织就失去系统性修复机会。
对照案例是一份不涉及金额的内部破损趋势摘要。用户仍需验证来源,但没有客户承诺、信用动作或合同决定,升级和审批要求可以更轻。角色化素养不是把所有AI错误都按最高风险处理,而是识别后果、权限和可逆性后采取相称动作。
情境考核要与课程目标一一对应:每题记录角色、正确行为、关键错误和评分证据
课程开发从岗位决定反推考核,再反推教学活动,避免先录视频再找问题。每个目标用动作词:识别禁止数据、核对当前条款、计算并解释、拒绝越权动作、提交可复现报告、批准限定范围。题目改变表面材料但保持认知难度,复测不重复原答案,防记忆题目冒充迁移。
| 项目字段 | 填写示例 |
|---|---|
| 题目编号/角色 | U-07/普通用户 |
| 上下文/输入 | C-204 附带 v3/v4 合同及两张照片 |
| 决策 | 接受, 编辑, 在客户回复前拒绝或升级 |
| 预期行为 | 拒绝, 引用 v4 冲突, 创建知识问题 |
| 严重不安全 | 发送 ¥1,860 承诺或隐藏冲突 |
| 证据 | 选定操作、引用、报告编号和用时 |
| 分数 | 2 正确; 1 不完整; 0 错误; 关键标志分离 |
| 变体 | 不同数量, 合同日期及缺失证明 |
题库由业务、学习设计、建设与审核共同拥有。业务保证任务真实,学习设计保证目标与题型,建设者提供系统行为,审核者定义关键风险。每题记录版本和适用范围;流程或系统变化后旧题可保留作历史,但不能继续证明当前能力。题库不直接暴露给生成式工具产生标准答案,否则要用新材料和口头/实操复核。
评分证据最小化保存:保留作答、所用案例版本、判定、关键标志和必要反馈,不无期限收集完整屏幕或员工无关行为。培训数据不是秘密绩效监控;用途、可见人员、更正渠道和保留期需提前说明。若用于人事决定,应另行经过适当政策与专业判断,不能从本文案例直接推导。
放行规则采用角色阈值加关键错误否决:88.93%是项目结果,不是每个人自动获得权限
总体分只能帮助判断课程是否改善,生产资格仍要按个人和具体角色分配。本案例每人10题,每题按2、1、0分计分,再换算为百分比;管理者、流程负责人、普通用户和审核者需要达到90%,建设者需要达到88%并提交技术演练。所有角色的关键题都必须通过,工作产物还要由相邻角色验收。总分很高但关键题失败,状态仍是“需要补救”,不能用平均分放行。
| 结果 | 条件 | 访问/下一步操作 |
|---|---|---|
| 已认证 | 总分、关键题和产物均通过 | 授予限定范围角色直至有效期结束 |
| 补救 | 非关键缺口或一次关键遗漏 | 针对性实践, 无新增生产范围 |
| 重新评估 | 评估中断/模糊 | 等效新案例 |
| 范围受限 | 仅通过更窄的任务 | 授予草稿/读取范围 |
| 已暂停 | 发生事件、角色变更或资格过期 | 返回人工流程或沙盒 |
| 不适用 | 分配已移除 | 撤销角色, 保留最小记录 |
复测数据3,735项正确不意味着420人全部通过,项目报告必须同时给出合格人数、关键失败、角色和支持需要。84项关键错误由管理者3、流程负责人8、普通用户45、建设者16、审核者12组成;组织逐项看错误人员是否集中、题目是否含糊、课程是否漏教以及系统能否从设计上阻断,不能把所有风险留给记忆。
若大量优秀员工在同一关键题失败,先暂停放行并审查题目、界面和流程。培训不是证明系统可用的工具;一个需要每个人永久记住隐蔽条件才能安全运行的设计,应把条件变成权限、策略、默认值或运行时放行门槛。学习控制只覆盖人确实需要判断且有能力判断的部分。
角色重叠、转岗、外包和临时代理都要拆成多个分配,不能“一次通过全权限通用”
一个流程负责人如果偶尔批准高额例外,需要普通用户与批准人两份分配;课程中相同模块可以复用,专属情境和权限不能合并。记录显示其在什么系统、哪类客户、何种金额和截至何日有资格。临时代理自动到期,长期转岗先撤旧权限,再按新角色差距训练。
| 变更事件 | 缺口检查 | 控制操作 |
|---|---|---|
| 用户变为审批人 | 权限, 策略, 冲突, 审计 | 在权限前添加审批模块 |
| 建设者加入事件轮值表 | 遏制, 证据, 通讯 | 执行事件演练 |
| 供应商分析师处理文件 | 数据路由, 合同, 报告 | 限定范围的培训 + 身份 + 有效期 |
| 经理接管新区域 | 本地流程/义务 | 区域差异模块 |
| 审核员协助构建发布 | 独立性冲突 | 指派第二位审核员 |
| 临时休假代理人 | 确切角色和时长 | 限时访问 + 交接 |
外包人员接受供应商自己的通识证书,不等于知道岑航的合同版本、报告入口和禁止动作。组织可以承认共享基础知识,仍需本地角色差异和实操验证。供应商撤场时同时撤身份、工具、材料与培训记录的有效分配;仅关闭学习平台账号不能阻止生产访问。
岗位说明和职责分工表可以帮助确定责任,但资格系统最终要看实际权限。有人没有“审核者”头衔,却能够点击批准,就必须完成相应课程;有人头衔是经理但只看汇总,就不应自动获得客户案例访问权限。角色地图每季度要与身份权限、流程配置和真实工具回执对账,找出没有训练却已经使用,以及已经离岗仍然保留权限的人。
学习方式要适配工作和可访问性:示范、练习、反馈与现场辅导比更长的视频更重要
同一课程目标可用线下工作坊、实时远程、带反馈模拟或受控在岗练习实现,选择取决于班次、地点、语言、残障需求和风险。关键是每个人有机会独立完成任务并得到具体反馈。录播适合共同概念和补充说明,不适合单独验证能否处理版本冲突、客户压力或失败恢复。
| 学习活动 | 目的 | 生成的证据 |
|---|---|---|
| 实操演示 | 展示专家决策路径 | 标注案例 |
| 指导练习 | 应用一步并获取反馈 | 修正后的尝试 |
| 对比案例 | 区分相似情境 | 推理对比 |
| 独立模拟 | 验证转移 | 评分行为 |
| 在岗观察 | 测试真实工作流适配性 | 限定范围的观察记录 |
| 办公时间/补救措施 | 修复特定缺口 | 新案例结果 |
材料提供可搜索文字、字幕、清楚表格、键盘操作和必要替代格式;实操时长包含辅助技术使用,不把速度作为与工作无关的障碍。非母语员工可使用批准语言版本,但合同术语和系统字段需保持对应。翻译后用真实角色复核,不把机器翻译直接当最终安全材料。
课程排期也是控制。让一线人员下班后自学,会降低练习与提问,且把组织变更成本转给个人;项目预算应包含带薪时间和工作替补。对于高风险任务,小班反馈比追求单场覆盖人数更重要;若培训容量不足,先限制上线群组,不降低考核。
课程内容本身需要版本、负责人、来源和退役:系统变化后旧证书不能继续证明当前能力
每个模块都要有内容负责人、业务负责人、适用系统与角色、版本、来源、最后验证日期、变化触发器和退役日期。教学截图、字段、合同规则、数据边界、报告路径和评分标准必须与生产环境对应;版本更新后先运行题库并由讲师验证,再发布差异课程。不能让用户在旧界面中学习,随后却进入完全不同的新工作流。
| 内容制品 | 负责人 | 触发 | 必要响应 |
|---|---|---|---|
| 共享核心 | AI 治理/学习 | 策略或重大事件 | 修订通用行为 |
| 角色模块 | 流程负责人 | 状态/权限变更 | 更新任务与案例 |
| 系统模拟 | 产品/建设者 | 界面/工具/模型变更 | 回退与重录 |
| 关键评分表 | 风险/领域 | 新故障/义务 | 添加或重新分类项目 |
| 源包 | 知识负责人 | 合同/政策到期 | 撤回旧材料 |
| 资格记录 | 经理 + 学习运营 | 角色/范围/到期 | 续期, 缩小或撤销 |
变化不都要求重上完整课程。界面颜色调整只需操作提示;新增外部发送工具、改变审批门槛、接入敏感数据、模型行为显著变化或发生关键事故,需要角色变更、等难案例和必要重新授权。培训负责人维护影响矩阵,说明哪个变更影响哪些角色与题目,避免420人被无差别召回。
讲师也需资格和校准。只会产品演示的人不能裁定合同或风险,业务专家也不能即兴承诺技术控制。课程为争议答案设升级路径:先按评分标准记录,再由指定领域负责人决定并更新材料;讲师不为了课堂顺畅现场创造新规则。
从课堂迁移到真实工作要靠权限、工作辅助、反馈和管理行为,不能把记忆当唯一控制
通过考核后,系统按分配开最小权限;界面显示当前目的、允许来源、关键核对和报告入口;合同版本与金额计算尽量由技术放行门槛保证。首两周采用受控群组和每日办公时段,流程负责人抽看实际案例,反馈进入知识、产品或课程积压。管理者观察修改与升级是否被允许,不以“AI接受率高”奖励盲从。
| 迁移到工作的控制 | 示例 | 负责人 |
|---|---|---|
| 权限 | 用户无法直接发送或授信 | 身份与系统负责人 |
| 工作辅助 | 草稿旁的案例清单 | 流程负责人 |
| 默认/放行门槛 | 当前合同及确定金额 | 构建者/知识负责人 |
| 支持 | 带案例编号的流转路径 | 运营/支持 |
| 反馈 | 分类用户编辑与升级 | 产品 + 学习 |
| 管理 | 奖励正确的停止/升级 | 直线经理 |
真实工作抽样只看与目标相关的行为:是否引用正确来源、是否在承诺前批准、是否报告系统缺陷、是否出现绕过。用户大量编辑不一定代表能力差,也可能是模型或知识质量差;升级率上升也可能说明课程让问题被看见。分析需结合案例难度、系统版本和终态,不用单一采用率评价人员。
如果管理者在客户催促时要求员工跳过批准,前面的课程就会失效。因此,管理者课程必须包含如何回应延期、错误和员工报告;组织则要提供无责报告机制和明确的停止权限。员工按规则正确停止流程后,不应因处理时限被惩罚,否则下一次他们很可能选择隐瞒问题。
衡量项目要从出席、知识、行为到业务结果分层,并保留反指标防止数字被美化
学习项目同时看覆盖、能力、现场行为和业务结果。覆盖回答谁尚未参加;能力回答谁能在情境中正确决定;行为回答生产中是否按边界操作;结果回答返工、周期、客户错误、风险和成本是否改善。各层不能相互代替,尤其不能用389/420完成率证明安全或价值。
| 度量层 | 指标 | 分母 | 护栏 |
|---|---|---|---|
| 覆盖率 | 已分配/已完成/当前 | 活跃分配 | 无批量豁免 |
| 能力 | 正确 + 关键通过 | 场景决策/人员 | 等效新案例 |
| 行为 | 已验证, 编辑, 拒绝, 升级 | 有效活跃案例 | 考虑案例组合 |
| 系统质量 | 来源/数量/权限缺陷 | 有效运行/操作 | 关键绝对计数 |
| 业务 | 周期, 返工, 解决, 投诉 | 可比主张 | 对比基线/队列 |
| 公平/支持 | 按组/格式通过并协助 | 相关参与者 | 调查障碍, 不对组别排序 |
本案例把正确决策从55.19%提高到88.93%,关键错误从682降到84,但这只证明训练环境中的近期变化。生产前还要确认限定试点中未经授权承诺为零、合同版本错误被阻断、人工队列有容量、客户更正可执行。若情境分上升而现场绕过增加,项目不能宣称成功。
报告同时展示不利结果:未通过人数、重测次数、最常见错误、系统设计缺陷、不同班次/格式的障碍和仍需人工的范围。不要把“自信提升”当能力,也不要把报告问题多视为失败;早期问题上升可能是可见性改善。每项指标预先写解释边界与决策,防上线后只挑好看的数字。
复训由时间、变化、事故和证据触发:年度点一下视频不是唯一维护办法
资格可设风险相称的到期,但复训不应只靠日历。新增工具权限、关键流程变化、模型/知识源变化、跨地区、角色转移、长时间未使用、关键事故或抽样失败都触发差异评估。稳定低风险角色可用短情境续期;高影响批准人和构建者需定期演练失败、恢复和事件。
| 触发事件 | 需要更新的角色 | 处理方式 |
|---|---|---|
| 新发送/授信能力 | 用户, 负责人, 构建器, 审查员 | 新边界案例 + 重新授权 |
| 合同优先级变更 | 用户/流程/知识 | 差异案例与工作辅助 |
| 模型更新 | 建设者/评审人; 用户(若行为变更) | 回归 + 针对性简报 |
| 重大事件 | 受影响角色 + 管理者 | 重构, 练习新控制 |
| 连续90天未执行任务 | 高影响角色 | 通过短情境重新认证 |
| 持续稳定地正确执行 | 限定角色 | 简化续期,但保留关键检查 |
事故复盘转成学习材料时删除不必要的个人识别,聚焦决策、环境和系统条件,不把某员工塑造成警示故事。若员工按现有课程操作仍出错,责任首先是修规则、界面、权限、容量或教学,而非要求“更仔细”。新案例进入题库前由业务和审核者确认关键答案。
资格过期时系统自动缩到安全范围或人工路径,并提前提醒人员和经理;不能只在表格标红而权限仍开。紧急代理必须有明确期限、较小动作范围、监督者和事后复核,不因业务繁忙创建永久例外。
交付一套可运行的角色化素养包:名单、课程、题库、权限和结果必须能相互追溯
项目最终不是一组视频,而是一套从用例到分配、学习、考核、权限、运行反馈和更新的链。任何时点都能回答:此人为何需要此角色、通过了哪个版本、关键题是否通过、权限范围是什么、何时到期、系统变化是否使证据失效。记录最小化并按政策保留,不把学习平台扩张成无边界人员监控。
| 交付物 | 最小字段 | 接受 |
|---|---|---|
| 角色—任务映射 | 角色、决策、输入、影响和权限 | 匹配真实工作流与身份权限 |
| 共享 + 角色课程 | 目标, 活动, 来源, 版本 | 每项均映射至行为 |
| 场景库/评分表 | 输入, 预期, 严重, 证据 | 校准并受保护 |
| 已填写工作产物 | 决策, 流程, 案例, 放行, 复核 | 相邻角色验证 |
| 资格登记册 | 个人, 分配, 结果, 范围, 过期 | 驱动实际访问 |
| 补救/支持 | 错误类型、练习、负责人和处理时限 | 不用重复播放通用视频 |
| 变更矩阵 | 触发, 角色, 内容/测试, 操作 | 使陈旧证明失效 |
| 结果仪表盘 | 覆盖率, 能力, 行为, 业务 | 分母 + 护栏 |
来源边界:NIST AI RMF 1.0核心中的“治理2.1—2.3”用于角色、沟通、人员训练和领导责任,“映射3.4”用于定义并评估操作者与实践者能力;NIST配套操作手册用于把这些结果转成可选择的治理实践,但不能把它当成统一课程清单。欧盟委员会AI素养问答用于说明技术知识、经验、教育训练、使用情境和受影响对象都与“足够素养”有关,也说明按角色、风险和情境采用不同层次可能合理。本文的五类课程、时长、阈值和记录方式属于教学设计,不代表官方认证或法律合规结论。ISO/IEC 42001官方概览只用于管理体系、责任、风险与机会和持续改进背景。来源核验于2026-07-21;NIST页面注明AI RMF 1.0正在修订,组织在实施时仍需重新确认适用版本与专业要求。
- NIST AI RMF Core
- NIST AI RMF Playbook:Govern
- European Commission:AI literacy questions and answers
- European Commission:AI talent, skills and literacy
- ISO/IEC 42001:2023:AI Management Systems
今天不要先购买全员课程。选一个即将上线或已经使用的真实AI流程,沿实际影响列出五类角色;为每类写三项“必须能作出的决定”和一项关键错误,再用同一业务材料做五个不同问题。先让少量人员不看教材完成,记录错误来自知识、流程、系统还是权限。只有当课程、技术控制、工作辅助和管理行为共同改变结果,且资格能驱动实际范围时,AI素养才从一次活动变成组织能力。