先看结果:四份文件都由同一个 AI 生成,激活率却出现了 80.7%、81%、82% 和 519 人
独立产品顾问周澄受托总结一项为期 12 周的新用户引导试点。她要交付 14 页评估报告、一份分析工作簿、10 页汇报演示和 4 幅图表。第一轮,她把同一批文件分别交给四个 AI 对话:一个写报告,一个做表格,一个做演示,一个生成图。四份成品单独看都很顺,放在一起却互相矛盾:报告写 518/642=80.7%,演示写“约 82%”,柱状图标签是 519,工作簿里还有未排除测试账号后得到的 526。
问题不在于哪一份文字写得不够好,而在于四个对话各自重新取数、计算和舍入。周澄没有再发一句“请统一口径”,而是把交付重建成一条事实生产线。最终冻结版包含 642 名受邀用户、525 名在 14 天内激活的用户、451 名完成关键工作流的用户和 74 次人工升级。报告显示 81.8%,演示按批准规则显示 82%,并在讲者备注中保留 525/642;图表从同一精确值生成,工作簿则保留分子、分母和公式。
| 产物 | 旧流程问题 | 新流程依据 | 最终验证 |
|---|---|---|---|
| 14 页报告 | 手工贴数,脚注版本不明 | 主张登记表与事实编号 | 27 个数字主张全可追溯 |
| 分析工作簿 | 混有测试账号 | 标准表+公式 | 6 批合计与明细一致 |
| 10 页演示 | 为简洁自行四舍五入 | 显示规则与讲者备注 | 12 个指标与报告同源 |
| 4 幅图 | 标签被模型猜写 | 图表规范与数据提取 | 11 个数据点逐点比对 |
本文是虚构教学案例,数字只用于演示生产方法,不代表任何产品或行业基准。它处理的是跨格式事实一致性,不替代统计方法、无障碍设计、品牌、隐私、版权或专业结论审查;若材料涉及人员、健康、财务、客户权益或公开统计,应提高数据和发布审批门槛。
“同一套事实”不是四份文件放在同一文件夹,而是每项主张只有一个受控来源
“单一事实来源”很容易被误解为“所有人只能编辑一个巨大工作簿”。真正的目标是:同一项业务事实只有一个权威定义和一个当前批准值,其他产物引用它,而不是重新录入。原始事件、清洗表、指标、文字主张和最终文件仍然是不同实体,只是它们之间的关系可以追踪。
| 层 | 例子 | 可否人工直接改数字 |
|---|---|---|
| 来源 | 事件导出_2026-07-08.csv | 否,原件只读 |
| 标准数据 | 批次成员、激活事件 | 只经规则重建 |
| 事实 | F-ACT-14D=525/642 | 只改公式/来源后重算 |
| 主张 | “14 天激活率为 81.8%” | 文字可审,数值引用事实 |
| 交付视图 | 报告、工作簿、演示文稿、图表 | 不在视图内纠正事实 |
| 发布包 | 交付 v1.2 清单 | 冻结后不可覆盖 |
四份文件可以采用不同表达:报告保留一位小数,演示显示整数,图表突出人数,工作簿保留明细。这些是事先声明的显示转换,不是四个不同事实。如果演示中的 82% 无法追到 525/642 和舍入规则,它仍然只是一个孤立数字。
判断两处数字是否属于“同一个事实”,要看事实身份,而不是文本是否相似。F-ACT-14D 由人群、事件、窗口、过滤器、计算方法和数据截止时间共同确定;其中任一项改变,就应创建新事实或新版本,不能沿用旧编号。“任意时间激活率”和“14 天激活率”即使某次碰巧数值相等,也不应合并。相反,81.8%、82% 和 525 人只要引用同一个精确事实,并声明各自的显示规则,就可以安全共存。
周澄为每个产物设置允许转换清单:数值舍入、单位换算、排序、切片和文字压缩需要规则;修改分母、过滤器、时间窗、统计量或证据强度属于事实/主张变更,必须回到上游审批。这样审阅者不需要逐字比四份文件,只需验证每次差异属于哪类转换。
先写交付合同:四种产物为谁服务、回答什么问题、允许怎样简化
周澄在处理材料前,先把客户一句“做全套总结”拆成四份交付合同。报告供项目发起人审阅方法与结论;工作簿供分析人员复算;演示用于 20 分钟决策会;配图包括 3 张数据图和 1 张流程图,不能生成虚构人物,也不能暗示并不存在的客户结果。
| 产物 | 受众/任务 | 必含 | 允许简化 | 禁止 |
|---|---|---|---|---|
| 报告 PDF | 发起人决定是否扩展 | 方法、限制、9 项关键事实 | 正文一位小数 | 隐去不利批次 |
| 分析工作簿 | 复核者重算 | 标准数据、公式、检查 | 可用辅助表 | 粘贴固定汇总值 |
| 汇报演示 | 20 分钟会议 | 3 个决定、12 个指标 | 主画面整数 | 更换分母却不标注 |
| 图表文件 | 报告与演示复用 | 图表数据、短描述和长描述 | 视觉简化但标签准确 | AI 凭描述猜画数据 |
合同还规定,发布包必须同时包含四种产物、产物清单、来源说明和已知限制。客户即使临时只要演示,也不能绕开工作簿和事实检查;可以少交一个文件,不能省掉支撑结论的证据工作。
她也把验收对象写进合同。报告不是以“正好 14 页”验收,而是 9 项关键事实都有方法、限制和追踪记录;工作簿不是以“公式很多”验收,而是清空缓存后重算,全部检查仍然通过;演示不是以“好看”验收,而是 3 个决定请求都能追到事实与限定;图表不是以“高清”验收,而是数据点、标签、图例和替代文本都符合图表规范。如果客户要求在演示中删掉表现不利的批次,交付负责人应记录并拒绝这种误导性范围变化,不能把它当作普通视觉修改。
建来源清单并冻结快照:先解决版本、授权和缺口,再让 AI 读内容
原材料共有 9 项:事件导出 2 份、邀请名单 1 份、支持工单 1 份、调查结果 1 份、费用表 1 份、指标定义 1 份、试点方案与会议决定各 1 份。周澄为每项材料记录负责人、取得时间、时间范围、粒度、敏感度、授权、校验值和替代关系。
| 来源编号 | 名称 | 粒度/范围 | 当前版本 | 状态 |
|---|---|---|---|---|
| S01 | 邀请名单.csv | 每行一名用户;6 个批次 | 07-01 | 当前 |
| S02 | 早期激活.csv | 每行一个事件;截至 07-01 | 07-01 | 已取代 |
| S03 | 回溯激活.csv | 每行一个事件;截至 07-08 | 07-08 | 当前,替代 S02 |
| S04 | 工作流事件.csv | 每行一个工作流事件 | 07-08 | 当前 |
| S05 | 支持案例.csv | 每行一次升级 | 07-08 | 当前 |
| S06 | 调查结果.csv | 每行一份回复 | 07-06 | 当前 |
| S07 | 费用工作簿 | 每行一项批准成本 | 07-09 | 当前 |
原件进入只读目录,后续处理只使用副本。客户姓名、邮箱和自由文本不进入生成式工具,标准数据层只保留受控用户键、批次和必要事件。缺少指标定义时先询问负责人,不能让模型根据列名猜测“激活”究竟指登录、创建项目,还是完成关键动作。
S02 与 S03 看起来都是激活事件导出,却不能简单合并。负责人说明,S03 是覆盖到 7 月 8 日的完整重导出,并非只包含新增事件,因此它应当取代 S02。如果把两份文件追加,会把早期事件重复计算两次。来源表保存这一替代关系,并用事件编号唯一性和每日计数验证:S03 中已有的 796 个事件编号与 S02 一致,另外增加 7 个新编号;关键字段没有被静默改写。只有当新文件明确是增量变更时,处理规则才是追加并去重。
费用表采用另一种策略。7 月 9 日的文件是批准后的最终表,但其中 3 行公式单元格需要同时读取计算结果和公式文本。周澄把 19,200 的设置费用与 14,400 的运行费用分开写入标准成本表,并保留币种和含税口径。只收到截图或 PDF 时,不能把文字识别得到的数字直接标为已批准,应先向财务负责人索取可以复算的来源。
定义粒度、时间窗、分母和排除规则,避免同名指标实际回答不同问题
“激活”的批准定义是:收到邀请后的 14×24 小时内完成账户验证,并创建第一个工作区。分母是 6 个批次中的有效受邀用户,内部测试账号、已经撤回的邀请和重复邀请要先从分母中排除。关键工作流完成率则有两个都合法但含义不同的分母:相对于已激活用户的转化率,以及相对于全部受邀用户的端到端率,两者必须使用不同事实编号。
| 字段 | F-ACT-14D | F-WORK-ACT | F-WORK-INV |
|---|---|---|---|
| 分子 | 525 已激活 | 451 工作流已完成 | 451 工作流已完成 |
| 分母 | 642 有效受邀 | 525 已激活 | 642 有效受邀 |
| 窗口 | 邀请后 14 天 | 试点截止日 | 试点截止日 |
| 排除项 | 测试、已撤回、重复 | 没有合格激活则不进入 | 与受邀用户相同 |
| 价值 | 81.8% | 85.9% | 70.2% |
“完成率 86%”若不说分母,会在演示中看似积极,却无法支持端到端效果。每个百分比都必须与分子、分母、时间窗和过滤器成组移动。
定义表还要明确分析单元。激活按用户计算:同一用户即使有 4 次合格事件,也只计 1 人;支持升级按案例计算:同一用户可能有多次升级,所以 74 指 74 个案例,不是 74 名用户;调查按回复计算,本次只有 286 份答卷。AI 首轮把 74 个案例写成“74 名用户需要人工帮助”,这条主张被拒,因为数据没有证明存在 74 个不同用户。粒度错误往往比算术错误更隐蔽,四份文件一致复述,也不会让错误变成事实。
所有比例都要有一张分母资格表,每一行明确是否合格、排除原因、所属分母事实和生效日期。排除 5 个重复邀请时,要保留最终采用的邀请编号;4 个撤回者要有负责人提供的撤回事件;3 个测试账号来自经过批准的名单。如果排除依据只有模型判断“看起来像测试”,就保持待定,不能从分母中删除。
先生成标准数据,四种产物不再各自清洗一遍
标准数据层只做事实所需的最小转换:规范用户键;按邀请编号去重;应用已批准的排除表;把事件时间转换到同一时区;连接邀请与激活事件;选择每位用户最早的合格事件;再连接工作流、支持和调查数据。每一步都输出行数和拒绝原因。
| 步骤 | 输入行 | 接受 | 拒绝/合并 | 输出 |
|---|---|---|---|---|
| 邀请归一化 | 661 | 654 | 7 格式问题转人工 | 654 |
| 重复/已撤回/测试 | 654 | 642 | 5 4 个重复 +3 个已撤回 + 测试 | 642 |
| 激活事件 | 803 | 525 用户 | 211 超窗+67 重复事件 | 525 |
| 工作流事件 | 497 | 451 用户 | 46 非完成/重复 | 451 |
| 支持升级 | 74 | 74 案例 | 0 | 74 |
| 调查 | 286 | 286 响应 | 0 | 286 |
这里的“拒绝”不一定意味着数据本身有问题。超过 14 天窗口的激活仍可用于其他分析,只是不进入本项指标。拒绝表要保存来源行、适用规则、原因和处理状态,不能为了让总数好看就直接删除。
7 条格式有问题的邀请也不能静默丢弃:2 条缺少用户键,经负责人确认是导出测试行;3 条批次代码无法对应 C1—C6,经负责人确认是预演数据;2 条时间戳没有时区且无法确认。它们都不进入本次 654 条可判定邀请。最终 642 的形成链为:661 条原始记录−7 条未接受−5 条重复−4 条撤回−3 条测试=642。7 条记录的处置证据另行保存,其中 2 条未解决记录在补足证据后应触发新版本,而不是被永久删除。
标准数据表为每个输出行保存来源链和转换版本。随机抽取 12 名用户,从邀请、激活到工作流全链回查;再做反向检查,确认事实中的每名已激活用户都能回到一条合格邀请。正向和反向两种检查可以发现数据连接时意外丢行或一对多膨胀,单看总数则可能漏掉“错配后恰好抵消”的问题。
建事实登记表:每个可发布数字都有编号、公式、来源和负责人
事实表不是最后的汇总表,而是所有交付共用的接口。每行至少记录事实编号、标签、精确值、单位、分子、分母、时期、过滤器、公式、来源编号集、数据版本、负责人、复核状态和显示规则。
事实编号:F-ACT-14D
标签:14 天激活率
精确值:0.817757...
分子:525
分母:642
报告显示:81.8%
演示显示:82%
图表显示:525 人;副标题“642 名受邀用户中”
时期:C1—C6 批次;事件截至 2026-07-08
来源编号集:[S01, S03]
公式版本:metrics-v1.2
复核状态:已批准
负责人:周澄
事实状态只有草稿、已检查、已批准和已退休。AI 可以从标准数据生成草稿候选和差异说明,不能把自己计算的结果直接标为已批准。周澄复算关键值,并由客户负责人确认业务定义后,事实才能进入交付构建。
事实修订不能覆盖历史。F-ACT-14D v1.1 保存 518/642、来源 S02 和批准记录;v1.2 保存 525/642、来源 S03、变更原因“7 个延迟导出事件”和取代关系。“已退休”只表示不再用于新的发布包,不代表历史报告当时造假。如果定义也发生变化,例如窗口从 14 天改为 21 天,就另建 F-ACT-21D,不能继续沿用 v1.2,因为接收者需要区分数据回补和口径改变。
低风险描述值可以由一人复算,高影响结论则要采用第二条独立路径:一条从 6 个批次聚合相加得到 525,另一条从用户级合格标志计数也得到 525;两条路径不能只是复制同一张摘要表。费用率则先独立核对总成本和分母,再计算商。两条路径一致仍然不能证明定义正确,所以负责人对定义的批准是第三类证据。
把公式、舍入、单位和缺失值规则写成机器可检查的口径
525÷642=0.817757…;报告按四舍五入保留一位小数,显示为 81.8%,演示按同一规则显示整数 82%,图表主值为 525 人,并标明分母 642。三种显示不同,精确值、分子和分母却完全相同。费用为 19,200+14,400=33,600;每名激活用户成本为 33,600÷525=64.00,每名关键工作流完成用户成本为 33,600÷451=74.50。
| 规则编号 | 对象 | 规则 | 例子 |
|---|---|---|---|
| R01 | 比率/报告 | 百分比,1 小数 | 81.8% |
| R02 | 比率/演示 | 四舍五入为整数,备注保留精确值 | 82% |
| R03 | 资金 | 货币 +2 位小数 | 74.50 |
| R04 | 持续时间 | 中位数天数,1 小数 | 2.6 天 |
| R05 | 缺失 | 显示“未收集”,不得写 0 | — |
| R06 | 被抑制 | 小样本按负责人批准的规则合并 | 不显示单元值 |
零、缺失、不适用和因敏感性被抑制是四种不同状态。AI 若把空白转成 0,可能改变平均值;图表若丢掉缺失批次,必须在注释说明而不是把折线连接成连续事实。
公式层还要控制类型和精度:计数必须是非负整数;百分比的精确值要一直保留到显示阶段;货币必须在批准币种下计算;日期差统一使用批准时区和边界规则。报告不能先把 81.8% 写回工作簿再反算人数,图表也不能从已经舍入的 82% 反推分子。R01—R06 每条规则都准备正常、边界和错误样本,例如核对 0.805 在实际舍入工具中的行为,用真实结果锁定规则,而不是只依赖语言描述。
单位换算同样要进入规则。如果报告写“缩短 1.2 天”,演示写“约快 32%”,后者必须引用 (3.8−2.6)÷3.8=31.6%,并注明比较对象是“首次实现价值的中位时间”。不能把中位数差异说成每个用户都节省了 1.2 天。文字变短,不能让统计对象和证据强度一起消失。
用主张登记表约束文字结论的强度
“激活率达到 81.8%”是在描述事实;“试点使激活率提升”还需要可比较的基线或因果设计;“应全面推广”则需要额外判断成本、风险和容量。周澄为报告和演示中的每个重要句子记录主张编号、主张文本、支撑事实、限定条件、允许使用的产物和复核人。
| 主张编号 | 候选主张 | 支撑 | 处理 |
|---|---|---|---|
| C01 | 525/642 在 14 天内激活 | F-ACT-14D | 已批准 |
| C02 | 已激活者中 85.9% 完成关键工作流 | F-WORK-ACT | 已批准 |
| C03 | 新用户引导使激活率提升 18% | 没有可比对照 | 已拒绝 |
| C04 | 调查满意率为 76.2% | 218/286 | 已批准,限定为受访者 |
| C05 | 76.2% 的全部用户满意 | 调查仅覆盖 286 响应 | 已拒绝 |
| C06 | 扩展前先验证支持容量 | 74 升级+容量访谈 | 建议,非事实 |
事实登记表防止数字漂移,主张登记表防止语义漂移。AI 很容易把相关关系、观察结果或部分样本写成因果关系、总体结论或确定建议,所以两个表必须同时审查。
主张检查分成三个问题。第一,事实是否真的支持文字中的数量和范围;第二,是否遗漏会改变理解的限定条件;第三,建议是否把价值判断冒充成数据结论。C04 加上“答卷受访者中”以后可以通过;C05 即使 76.2% 计算正确,仍然失败。C06 可以由 74 个升级案例和容量访谈支持“先验证容量”这一行动建议,却不能写成“系统无法扩展”的既成事实。
周澄还让 AI 做反向挑战,为每条主张寻找最小反例。例如,C02 只要有一个批次的工作流时间戳晚于截止日,451 就会改变;C04 如果存在系统性不回复的人群,就不能外推到全部用户。反例不会自动否定主张,但会把限制放到正确位置。高影响主张必须由人阅读原始方法和样本,不能只接受模型给出的“支持充分”标签。
完整走例:从 7 条回补事件到报告一句话、演示标签和图表数据点
7 月 1 日的早期快照中有 518 名合格激活用户。7 月 8 日,系统负责人确认 7 条延迟导出的事件实际发生在各自的 14 天窗口内:C2 增加 1 人、C3 增加 2 人、C4 增加 1 人、C5 增加 2 人、C6 增加 1 人,总数因此变为 525。随后又确认其中 5 人完成关键工作流,使工作流完成人数从 446 变为 451。
| 群组 | 已受邀 | 激活 v1.1 | 回填 | 激活 v1.2 | 工作流 v1.2 |
|---|---|---|---|---|---|
| C1 | 100 | 78 | 0 | 78 | 67 |
| C2 | 104 | 81 | 1 | 82 | 70 |
| C3 | 108 | 86 | 2 | 88 | 76 |
| C4 | 106 | 87 | 1 | 88 | 75 |
| C5 | 112 | 93 | 2 | 95 | 82 |
| C6 | 112 | 93 | 1 | 94 | 81 |
| 总计 | 642 | 518 | 7 | 525 | 451 |
流水线把 F-ACT-14D 重算为 525/642=81.8%,并把依赖它的 C01、报告第 4 页、工作簿摘要、演示第 3 页和第 9 页、图 01 全部标为过时。重新构建后,报告写“525 名(81.8%)”,演示主画面写“82%”,备注保留“525/642;一位小数为 81.8%”;图表数据点为 525,长描述同时写出分母。更新不是在全文中搜索“80.7”,而是按依赖关系重建。
新增的 5 名工作流完成人员,并不必然与 7 名回补激活用户一一对应。周澄核对事件编号后确认,其中 5 人完成、2 人未完成。于是激活人数增加 7,工作流完成人数增加 5,F-WORK-ACT 从 446/518=86.1% 变为 451/525=85.9%;人数上升,条件转化率反而下降 0.2 个百分点。如果只在文字中搜索旧人数,很容易漏掉派生率方向的变化。报告因此不再写“完成转化保持 86.1%”;演示中的整数 86% 表面虽然没有变化,讲者备注和来源版本仍然必须更新。
整次变更留下一张追踪卡:S03 的 7 个新事件编号→标准数据中的 7 个合格激活标志→F-ACT v1.2 与 F-WORK-ACT v1.2→C01 与 C02 复审→五类产物节点重建→63 处数字出现位置检查。接收者看到 82% 时,可以逐层回到来源,而不需要知道生成时使用了什么提示词。
四种产物怎样使用同一事实
工作簿是可复算的分析表面,不是四种产物共同抄写的终点
工作簿包含说明、来源、排除项、批次成员、事件、事实、主张、图表数据和检查九类工作表。原始数据区和标准数据区锁定,人工说明写在独立列;摘要中的每个值都引用事实或公式,不能粘贴聊天结果。
| 检查编号 | 检查 | 期望/结果 |
|---|---|---|
| X01 | 受邀人群汇总 | 642=642,通过 |
| X02 | 激活汇总 | 525=525,通过 |
| X03 | 工作流≤激活 | 6/6 人群,通过 |
| X04 | 回复≤激活 | 286≤525,通过 |
| X05 | 成本构成 | 19,200+14,400=33,600 |
| X06 | 事实展示 | 精确→报告/演示文稿规则,通过 |
| X07 | 未知来源 ID | 0 |
| X08 | 发布中未批准的事实 | 0 |
如果交付工具支持链接对象,可以让演示中的图表连接工作簿;但链接可能因为路径、权限、平台或粘贴方式而断裂。Microsoft 当前支持文档区分链接对象、嵌入对象和未关联副本,并说明链接来源必须可用,网页端和桌面端能力也可能不同。因此,链接只是便利机制,不是事实治理;产物清单和发布前的值比较仍然必须存在。
工作簿打开时,不能依赖作者电脑上的隐藏外部路径。周澄在一个干净目录中测试所有公式、命名范围、透视缓存和链接,记录是否需要刷新;导出 PDF 前强制重算并保存。检查表不能只显示绿色图标,还要包含预期、实际、严重程度、最近运行时间和证据单元格。接收者修改标准表时,保护规则和数据验证会提示“请回到来源流水线”,避免把复核副本变成第二个权威来源。
不会写代码的读者,可以先用表格的命名区域、Power Query 或其他查询工具、受控公式完成同样逻辑。关键不在于使用哪种语言,而在于减少复制粘贴、保存来源版次,并让重算可以重复。如果手工步骤暂时无法消除,就把它写进构建日志:由谁、从哪里复制、粘到何处、怎样双人比对,以及上游变化后如何重做。
报告从已批准主张组装论证
报告大纲先写问题和证据位置,再生成文字。每个分析段都区分四种内容:观察引用已批准事实;解释说明可能含义;限制交代样本或方法边界;建议写出行动、负责人和验证办法。AI 不能把四者揉成一句肯定判断。
| 报告段落 | 填好示例 |
|---|---|
| 观察 | 6 批 642 名有效受邀者中,525 名在 14 天内激活(81.8%) |
| 解释 | 后三批激活率高于前三批,值得检查流程变化 |
| 限制 | 批次并非随机分配,不能把差异直接归因于新材料 |
| 建议 | 扩展前对 C5/C6 流程做 2 批受控复验,并监测升级容量 |
| 追踪 | F-ACT-14D、人群表、方法备注 M02 |
脚注不是装饰,它要指出来源快照、指标定义、排除规则,以及调查只代表受访者。报告审阅应先验证主张与事实,再修改语言;如果先润色,漂亮叙述反而会让口径错误更难被发现。
生成报告时,模板只接受经过批准的主张块,而不是整张原始表。每个主张块都包含标题、批准措辞、事实显示、限定条件、来源备注和图表编号。AI 可以调整段落衔接,但渲染后要精确核对事实绑定。如果模型删掉“受访者中”,或者把“相关”改成“导致”,主张检查器要把成稿与批准句义对照并转交人工;不能因为所有数字一致就发布。
表格也要按阅读任务裁剪。正文批次表显示 6 个批次和总计,附录提供字段定义与检查结果;不能把 642 行个人级数据嵌进报告。客户需要明细时,应另行交付受控数据文件,并重新评估最小化、访问和保留。多产物流程不是把所有数据复制到更多容器。
演示按决策压缩信息,但每次压缩都留下恢复精确信息的入口
10 页演示依次包含决定请求、试点范围、激活漏斗、批次变化、关键工作流、支持容量、调查结果、成本、风险与下一步。主画面只放支持该页结论的 1—3 个指标;精确分子和分母、事实编号、来源版次与限制放进讲者备注或附录。
| 幻灯片 | 主画面 | 备注中必须保留 | 禁止压缩 |
|---|---|---|---|
| 3 | 82% 14-日激活 | 525/642=81.8%,R02 | 改成“几乎全部” |
| 4 | 6 个批次柱状图 | 每批样本量与事件截止日 | 隐去最低批次 |
| 6 | 74 升级 | 14.1% 已激活的 | 写成 74 用户 |
| 7 | 76% 已满足 | 218/286 受访者 | 外推全部 525 人 |
| 8 | 每名完成人员成本 74.50 | 33,600/451 | 忽略设置成本 |
演示中的文字可以更短,却不能改变分母、时间窗或证据强度。若一页必须牺牲限定词才能塞下,应该减少结论,而不是把限定词藏到没人能找到的位置。
周澄为每页建立幻灯片合同,记录决策、主张编号集、视觉编号、允许的显示方式、讲者备注和口头说明。第 3 页只能表达 C01,不能顺手增加“优于行业”;第 7 页直接在标题中写“答卷受访者满意度”,不能把限定藏进备注。演练时让另一人只看投影画面复述理解;如果对方把 74 个案例误解为 74 名用户,页面就需要修改标签,不能责怪听众没有看脚注。
导出后还要再检查一次,因为字体替换、裁切、动画或 PDF 转换可能让分母、图例和来源消失。10 页演示逐页截图,与幻灯片合同对比;12 个指标的显示文本、精确值、单位和数据截止日都要存在。出现空白占位图或“更新数据”提示,视为构建失败。
配图分为数据图、解释图和装饰图,三类对事实的责任完全不同
3 张数据图分别展示激活漏斗、六个批次的激活情况和完成人员成本;1 张解释图展示“来源→标准数据→事实→产物”。数据图必须由图表数据渲染,AI 只能协助选择图形、颜色和注释,不能根据自然语言生成看似精确的柱高。解释图的节点和箭头来自批准流程,装饰图不得暗示真实参与者、客户品牌或量化结果。
| 图形编号 | 类型 | 数据/结构来源 | 文本替代 | 更新触发 |
|---|---|---|---|---|
| FIG01 | 漏斗 | F-INV、F-ACT、F-WORK | 短替代文本与完整数值表 | 三项中任一变化 |
| FIG02 | 人群柱状图 | 批次图表数据 | 趋势总结+6 行表 | 批次值变化 |
| FIG03 | 成本柱状图 | F-COST-ACT/WORK | 两值及公式 | 成本/人数变化 |
| FIG04 | 流程图 | 产物依赖规范 | 节点和方向描述 | 流程版本变化 |
W3C WAI 的复杂图片教程建议为图表、流程图等提供短描述与表达关键信息的长描述,并在周边文字概括图意;数据表还需要可识别的行列标题。这里把这些原则应用到 PDF、演示导出和网页版本,但具体格式的无障碍能力仍需在目标阅读器中测试。
图表规范比一句“画得专业”具体得多。FIG02 指定横轴为批次,纵轴为已激活/已邀请,刻度从 0 开始,系列显示比率,标签同时带人数,排序按 C1—C6,颜色不作为唯一编码,注释只标记经过来源验证的变更。渲染器读取 6 行图表数据,再提取实际 SVG 或演示图形中的 6 个数值进行比对;视觉审阅还要检查坐标轴、标签遮挡、对比度,以及是否用面积制造夸张。
AI 生成解释图之前,也必须先产出结构化节点表和关系表。如果图中自行增加“自动决策”节点,或者把复核人画成可选旁路,即使视觉漂亮也判失败。装饰图要记录生成来源、许可或使用条件和人工检查,但不能承担只能依靠图像理解的关键事实;任何图都不能输入未经授权的客户素材或可识别个人资料。
用产物清单把四份文件绑定到同一次发布
每次构建都生成产物清单,不能靠文件名猜版本。清单记录发布编号、来源快照、数据、公式和主张版本、产物路径、内容哈希值、生成时间、生成工具、所用事实、人工修改、复核人和状态。任何文件内容变化都必须产生新的哈希值;人工修改图表标题,也要先回写源模板再重建,不能只修最终演示文稿。
| 产物 | 所用事实 | 构建 | 类型与状态 |
|---|---|---|---|
| report-v1.2.pdf | 27 项已批准事实 | 模板 3.1 | 报告;已检查 |
| 分析工作簿 v1.2 | 标准数据及全部事实 | 工作簿 2.4 | 电子表格;已检查 |
| briefing-v1.2.pptx | 12 项事实及 7 条主张 | 幻灯片 1.8 | 演示文稿;已检查 |
| 图表 v1.2 压缩包 | 9 事实及流程规范 | 图表 2.2 | 图表;已检查 |
清单还要注明本次发布取代了 v1.1。旧文件移入明确标记的归档,分享链接切向完整的新发布包,而不是给客户一个包含“v1、最终、最终版 2、最新真的”混乱文件夹。
“人工修改”字段原则上应为空,或者只记录可复现的审批注释。发现 PDF 页码错位时,正确动作是修正报告模板并重建;直接在 PDF 编辑器中移动元素,会产生清单无法解释的分叉。如果交付期限迫使团队做一次不可自动化的修补,就要保存补丁说明、操作者、新旧内容哈希值和后续回源修正事项,并重新运行受影响页面的检查。
清单本身也要接受验证:每个列出的文件确实存在且哈希值匹配;每项所用事实都指向已批准版本;来源快照没有混用;每个产物的发布编号一致。压缩打包后,要从全新目录解压并打开,确认相对链接、字体和附件不是只能在作者电脑上使用。
构建顺序从数据到观点再到格式,避免后生成文件反过来污染事实
冻结来源
→ 验证并生成标准数据
→ 计算事实
→ 批准事实与主张
→ 构建工作簿和图表数据
→ 渲染报告、配图和演示
→ 跨产物一致性检查
→ 人工视觉与内容复核
→ 生成发布清单并交付
| 发布门槛 | 输入 | 发布证据 | 失败动作 |
|---|---|---|---|
| 数据 | 来源快照 | 计数/拒收/检查 | 停止计算 |
| 事实 | 标准表 | 公式重新计算 | 保持草稿 |
| 主张 | 已批准的事实 | 支持/资格评审 | 拒收/重写 |
| 渲染 | 模板及登记表 | 文件创建与哈希值 | 修模板后重建 |
| 一致性 | 4 种产物 | 数值、文本和图表测试 | 阻断整个发布包 |
| 可视化 | 渲染页面/幻灯片 | 已签署的检查表 | 回源修,不改导出件 |
报告、演示和图表不能互相作为来源。演示不能从报告 PDF 中再抄数字,图表不能从演示截图中提取数值,工作簿也不能接受报告作者手改的“最终数字”;它们都是事实层的同级输出。
做五类一致性检查:值相同只是第一层,分母、语义、图形和版本也要相同
| 测试集 | 样本数 | 检查 | v1.2 结果 |
|---|---|---|---|
| 数值 | 63 发生次数 | 精确/显示规则 | 63 通过 |
| 分母与单位 | 27 项主张 | 分母、分析单元、时期 | 27 通过 |
| 文本蕴含 | 18 项关键主张 | 事实是否足以支持 | 16 通过、2 已拒绝 |
| 图表 | 11 数据点 | 渲染规范与提取结果对比 | 11 通过 |
| 来源与过时状态 | 4 种产物 | 版本、哈希值、所用事实 | 4 通过 |
另外还要做视觉检查:图例颜色与标签对应;坐标轴没有因为截断而夸大差异;脚注可读;表格没有被分页切断;演示讲者备注仍在;PDF 链接有效;图片的短描述和长描述可以找到。自动抽数可能会发现 81.8 与 82 不同,只有读取显示规则后才能判断这是否属于允许的转换;没有规则支撑的差异一律失败。
如果交付是一份纯文字项目回顾,没有数据图或计算指标,仍可以用来源编号、主张编号和产物清单管理来源与版本,但不应强行建立 11 点图表检查。方法的稳定核心是“事实与视图分离、依赖可追踪”,检查数量应按交付风险调整。
数据修正时做影响分析和整包重发,不能只替换被客户指出的一页
7 条回补事件进入后,依赖图找到 1 个主事实、2 个派生比率、3 个成本率、4 个图表系列、5 个报告段落和 2 页演示受到影响。构建系统把四份 v1.1 产物全部标为过时;即使某张图舍入后的外观没有变化,也要重建并更新清单,因为来源版本已经改变。
| 影响类型 | 例子 | 动作 |
|---|---|---|
| 值已变更 | 518→525 | 重算并重渲染 |
| 显示未变更 | 旧版和新版都可能显示 82 | 仍更新备注、哈希值和版本 |
| 解释受影响 | 后三个批次趋势变化 | 重新审查主张 |
| 未受影响 | 调查 218/286 | 验证依赖后保留值 |
| 外部副本 | 客户下载过 v1.1 | 发送替换通知 |
替换通知要写清哪些文件被替换、为什么替换、主要数字发生了什么变化、结论是否改变,以及怎样识别和删除旧文件。静默覆盖共享链接,会让接收者无法判断手中的截图或附件是否已经过期。
失败边界:一致的错误仍然是错误,四份产物同源不能替代专业复核
如果激活定义本身错了,流水线只会更高效地把同一个错误传播到四处。因此周澄设置了停止条件:来源负责人不确认替代关系;行数或唯一键不闭合;关键事实仍是草稿;分母没有定义;主张缺少支撑;敏感小样本暴露;图形与数据点不一致;任一产物版本落后;或者交付后发现会改变决策的修正。
| 失败 | 发现证据 | 立即动作 | 人工责任 |
|---|---|---|---|
| 测试账号混入 | 排除项数量变化 | 冻结发布包并重建 | 数据负责人确认名单 |
| 因果夸大 | 主张没有对照证据 | 拒绝 C03 | 顾问修改结论 |
| 调查外推 | 把 286 写成 525 | 阻断报告与演示 | 复核人检查分母 |
| 旧图混入 | 图表清单仍是 v1.1 | 整包不交付 | 发布负责人清理 |
| 隐私泄露 | 出现自由文本或敏感小单元 | 停止、隔离并评估事件 | 隐私与安全专家 |
| 链接断裂 | 演示无法打开来源 | 用清单中的值检查并修复链接 | 技术协作者,不能现场改数 |
人工批准分成三类:数据负责人批准定义和排除项;分析复核人复算事实并检查主张;交付负责人检查渲染、受众和替换通知。一个人可以兼任多个角色,但必须分别留下三类结论,不能用一次“整体看过”掩盖不同责任。
复制这份交付控制包,并从一个真实数字的四处出现开始
读者可以先做轻量版本,不必立刻搭建代码系统。先建立六张表:来源清单、指标定义、事实登记表、主张登记表、产物映射和发布检查清单;为最重要的 10 个数字分配事实编号,在报告、表格、演示和图表中标注引用,再做一次人工交叉检查。
| 模板 | 最少字段 | 完成标准 |
|---|---|---|
| 来源清单 | 编号、版本、负责人、范围、哈希值 | 每个当前来源唯一 |
| 事实登记表 | 精确值、公式、时期、来源、状态 | 关键事实已批准 |
| 主张登记表 | 文本、事实、限定条件、复核人 | 没有缺少证据支持的主张 |
| 产物映射 | 文件、所用事实、构建、哈希值 | 四份产物可追踪 |
| 一致性日志 | 测试、预期、实际、动作 | 所有阻断项关闭 |
| 发布记录 | 编号、取代关系、复核人、通知 | 接收者能识别当前版本 |
本案例参考的公开资料包括:W3C PROV 概述对来源中实体、活动和执行者关系的说明;英国政府分析职能的 RAP 策略对相同数据与方法可重现、减少手工步骤、版本控制、质量保证,以及由一条流程产生多个产品的说明;Microsoft 当前关于链接、嵌入和未链接 Excel/PowerPoint 对象的文档;W3C WAI 关于复杂图像短描述、长描述和数据表标题关系的教程。RAP 文件面向政府分析,本案例只借用可复现和多产物原则,不把其组织要求写成 OPC 的通用合规义务;Microsoft 功能也应按自己的平台、版本和存储方式重新验证。
- W3C PROV Overview
- Government Analysis Function:RAP strategy
- Microsoft:Insert and update Excel data in PowerPoint
- Microsoft:Manage workbook links
- W3C WAI:Complex Images
- W3C WAI:Tables Tutorial
今天的起点不是让 AI 重新做四份文件,而是找出一个在四处出现的重要数字:写出它的分子、分母、时间窗、过滤器、来源版本、批准人和四种显示方式。只要其中一处不能回答“我从哪里来、为何这样显示、上游变化后谁会提醒我”,就先修事实链,再生成成品。