先看结果:四份文件都由同一个 AI 生成,激活率却出现了 80.7%、81%、82% 和 519 人

独立产品顾问周澄受托总结一项为期 12 周的新用户引导试点。她要交付 14 页评估报告、一份分析工作簿、10 页汇报演示和 4 幅图表。第一轮,她把同一批文件分别交给四个 AI 对话:一个写报告,一个做表格,一个做演示,一个生成图。四份成品单独看都很顺,放在一起却互相矛盾:报告写 518/642=80.7%,演示写“约 82%”,柱状图标签是 519,工作簿里还有未排除测试账号后得到的 526。

问题不在于哪一份文字写得不够好,而在于四个对话各自重新取数、计算和舍入。周澄没有再发一句“请统一口径”,而是把交付重建成一条事实生产线。最终冻结版包含 642 名受邀用户、525 名在 14 天内激活的用户、451 名完成关键工作流的用户和 74 次人工升级。报告显示 81.8%,演示按批准规则显示 82%,并在讲者备注中保留 525/642;图表从同一精确值生成,工作簿则保留分子、分母和公式。

产物 旧流程问题 新流程依据 最终验证
14 页报告 手工贴数,脚注版本不明 主张登记表与事实编号 27 个数字主张全可追溯
分析工作簿 混有测试账号 标准表+公式 6 批合计与明细一致
10 页演示 为简洁自行四舍五入 显示规则与讲者备注 12 个指标与报告同源
4 幅图 标签被模型猜写 图表规范与数据提取 11 个数据点逐点比对
左侧展示报告 518 除 642、工作簿 526、演示约 82%和图表 519 的漂移,右侧用 F-ACT-14D v1.2 的 525 除 642 生成报告 81.8%、演示 82%和图表 525 人
先看左侧四次独立加工怎样漂移,再沿箭头读取右侧一个事实身份的三种受控显示。81.8%、82%和 525 人只有在共同引用 525/642 及显示规则时才一致;文字接近或放在同一文件夹不能证明同源。

本文是虚构教学案例,数字只用于演示生产方法,不代表任何产品或行业基准。它处理的是跨格式事实一致性,不替代统计方法、无障碍设计、品牌、隐私、版权或专业结论审查;若材料涉及人员、健康、财务、客户权益或公开统计,应提高数据和发布审批门槛。

“同一套事实”不是四份文件放在同一文件夹,而是每项主张只有一个受控来源

“单一事实来源”很容易被误解为“所有人只能编辑一个巨大工作簿”。真正的目标是:同一项业务事实只有一个权威定义和一个当前批准值,其他产物引用它,而不是重新录入。原始事件、清洗表、指标、文字主张和最终文件仍然是不同实体,只是它们之间的关系可以追踪。

例子 可否人工直接改数字
来源 事件导出_2026-07-08.csv 否,原件只读
标准数据 批次成员、激活事件 只经规则重建
事实 F-ACT-14D=525/642 只改公式/来源后重算
主张 “14 天激活率为 81.8%” 文字可审,数值引用事实
交付视图 报告、工作簿、演示文稿、图表 不在视图内纠正事实
发布包 交付 v1.2 清单 冻结后不可覆盖

四份文件可以采用不同表达:报告保留一位小数,演示显示整数,图表突出人数,工作簿保留明细。这些是事先声明的显示转换,不是四个不同事实。如果演示中的 82% 无法追到 525/642 和舍入规则,它仍然只是一个孤立数字。

判断两处数字是否属于“同一个事实”,要看事实身份,而不是文本是否相似。F-ACT-14D 由人群、事件、窗口、过滤器、计算方法和数据截止时间共同确定;其中任一项改变,就应创建新事实或新版本,不能沿用旧编号。“任意时间激活率”和“14 天激活率”即使某次碰巧数值相等,也不应合并。相反,81.8%、82% 和 525 人只要引用同一个精确事实,并声明各自的显示规则,就可以安全共存。

周澄为每个产物设置允许转换清单:数值舍入、单位换算、排序、切片和文字压缩需要规则;修改分母、过滤器、时间窗、统计量或证据强度属于事实/主张变更,必须回到上游审批。这样审阅者不需要逐字比四份文件,只需验证每次差异属于哪类转换。

先写交付合同:四种产物为谁服务、回答什么问题、允许怎样简化

周澄在处理材料前,先把客户一句“做全套总结”拆成四份交付合同。报告供项目发起人审阅方法与结论;工作簿供分析人员复算;演示用于 20 分钟决策会;配图包括 3 张数据图和 1 张流程图,不能生成虚构人物,也不能暗示并不存在的客户结果。

产物 受众/任务 必含 允许简化 禁止
报告 PDF 发起人决定是否扩展 方法、限制、9 项关键事实 正文一位小数 隐去不利批次
分析工作簿 复核者重算 标准数据、公式、检查 可用辅助表 粘贴固定汇总值
汇报演示 20 分钟会议 3 个决定、12 个指标 主画面整数 更换分母却不标注
图表文件 报告与演示复用 图表数据、短描述和长描述 视觉简化但标签准确 AI 凭描述猜画数据
四行表格分别对照 14 页报告、分析工作簿、10 页演示和 4 幅图的任务、必须保留、允许简化与禁止行为
逐行比较四种产物的任务、必含信息、允许简化和不可越过的红线。合同规定本案例的用途与验收边界;少交某个文件不等于可以跳过支撑它的事实、工作簿和一致性检查。

合同还规定,发布包必须同时包含四种产物、产物清单、来源说明和已知限制。客户即使临时只要演示,也不能绕开工作簿和事实检查;可以少交一个文件,不能省掉支撑结论的证据工作。

她也把验收对象写进合同。报告不是以“正好 14 页”验收,而是 9 项关键事实都有方法、限制和追踪记录;工作簿不是以“公式很多”验收,而是清空缓存后重算,全部检查仍然通过;演示不是以“好看”验收,而是 3 个决定请求都能追到事实与限定;图表不是以“高清”验收,而是数据点、标签、图例和替代文本都符合图表规范。如果客户要求在演示中删掉表现不利的批次,交付负责人应记录并拒绝这种误导性范围变化,不能把它当作普通视觉修改。

建来源清单并冻结快照:先解决版本、授权和缺口,再让 AI 读内容

原材料共有 9 项:事件导出 2 份、邀请名单 1 份、支持工单 1 份、调查结果 1 份、费用表 1 份、指标定义 1 份、试点方案与会议决定各 1 份。周澄为每项材料记录负责人、取得时间、时间范围、粒度、敏感度、授权、校验值和替代关系。

来源编号 名称 粒度/范围 当前版本 状态
S01 邀请名单.csv 每行一名用户;6 个批次 07-01 当前
S02 早期激活.csv 每行一个事件;截至 07-01 07-01 已取代
S03 回溯激活.csv 每行一个事件;截至 07-08 07-08 当前,替代 S02
S04 工作流事件.csv 每行一个工作流事件 07-08 当前
S05 支持案例.csv 每行一次升级 07-08 当前
S06 调查结果.csv 每行一份回复 07-06 当前
S07 费用工作簿 每行一项批准成本 07-09 当前

原件进入只读目录,后续处理只使用副本。客户姓名、邮箱和自由文本不进入生成式工具,标准数据层只保留受控用户键、批次和必要事件。缺少指标定义时先询问负责人,不能让模型根据列名猜测“激活”究竟指登录、创建项目,还是完成关键动作。

S02 与 S03 看起来都是激活事件导出,却不能简单合并。负责人说明,S03 是覆盖到 7 月 8 日的完整重导出,并非只包含新增事件,因此它应当取代 S02。如果把两份文件追加,会把早期事件重复计算两次。来源表保存这一替代关系,并用事件编号唯一性和每日计数验证:S03 中已有的 796 个事件编号与 S02 一致,另外增加 7 个新编号;关键字段没有被静默改写。只有当新文件明确是增量变更时,处理规则才是追加并去重。

费用表采用另一种策略。7 月 9 日的文件是批准后的最终表,但其中 3 行公式单元格需要同时读取计算结果和公式文本。周澄把 19,200 的设置费用与 14,400 的运行费用分开写入标准成本表,并保留币种和含税口径。只收到截图或 PDF 时,不能把文字识别得到的数字直接标为已批准,应先向财务负责人索取可以复算的来源。

定义粒度、时间窗、分母和排除规则,避免同名指标实际回答不同问题

“激活”的批准定义是:收到邀请后的 14×24 小时内完成账户验证,并创建第一个工作区。分母是 6 个批次中的有效受邀用户,内部测试账号、已经撤回的邀请和重复邀请要先从分母中排除。关键工作流完成率则有两个都合法但含义不同的分母:相对于已激活用户的转化率,以及相对于全部受邀用户的端到端率,两者必须使用不同事实编号。

字段 F-ACT-14D F-WORK-ACT F-WORK-INV
分子 525 已激活 451 工作流已完成 451 工作流已完成
分母 642 有效受邀 525 已激活 642 有效受邀
窗口 邀请后 14 天 试点截止日 试点截止日
排除项 测试、已撤回、重复 没有合格激活则不进入 与受邀用户相同
价值 81.8% 85.9% 70.2%

“完成率 86%”若不说分母,会在演示中看似积极,却无法支持端到端效果。每个百分比都必须与分子、分母、时间窗和过滤器成组移动。

定义表还要明确分析单元。激活按用户计算:同一用户即使有 4 次合格事件,也只计 1 人;支持升级按案例计算:同一用户可能有多次升级,所以 74 指 74 个案例,不是 74 名用户;调查按回复计算,本次只有 286 份答卷。AI 首轮把 74 个案例写成“74 名用户需要人工帮助”,这条主张被拒,因为数据没有证明存在 74 个不同用户。粒度错误往往比算术错误更隐蔽,四份文件一致复述,也不会让错误变成事实。

所有比例都要有一张分母资格表,每一行明确是否合格、排除原因、所属分母事实和生效日期。排除 5 个重复邀请时,要保留最终采用的邀请编号;4 个撤回者要有负责人提供的撤回事件;3 个测试账号来自经过批准的名单。如果排除依据只有模型判断“看起来像测试”,就保持待定,不能从分母中删除。

先生成标准数据,四种产物不再各自清洗一遍

标准数据层只做事实所需的最小转换:规范用户键;按邀请编号去重;应用已批准的排除表;把事件时间转换到同一时区;连接邀请与激活事件;选择每位用户最早的合格事件;再连接工作流、支持和调查数据。每一步都输出行数和拒绝原因。

步骤 输入行 接受 拒绝/合并 输出
邀请归一化 661 654 7 格式问题转人工 654
重复/已撤回/测试 654 642 5 4 个重复 +3 个已撤回 + 测试 642
激活事件 803 525 用户 211 超窗+67 重复事件 525
工作流事件 497 451 用户 46 非完成/重复 451
支持升级 74 74 案例 0 74
调查 286 286 响应 0 286

这里的“拒绝”不一定意味着数据本身有问题。超过 14 天窗口的激活仍可用于其他分析,只是不进入本项指标。拒绝表要保存来源行、适用规则、原因和处理状态,不能为了让总数好看就直接删除。

7 条格式有问题的邀请也不能静默丢弃:2 条缺少用户键,经负责人确认是导出测试行;3 条批次代码无法对应 C1—C6,经负责人确认是预演数据;2 条时间戳没有时区且无法确认。它们都不进入本次 654 条可判定邀请。最终 642 的形成链为:661 条原始记录−7 条未接受−5 条重复−4 条撤回−3 条测试=642。7 条记录的处置证据另行保存,其中 2 条未解决记录在补足证据后应触发新版本,而不是被永久删除。

标准数据表为每个输出行保存来源链和转换版本。随机抽取 12 名用户,从邀请、激活到工作流全链回查;再做反向检查,确认事实中的每名已激活用户都能回到一条合格邀请。正向和反向两种检查可以发现数据连接时意外丢行或一对多膨胀,单看总数则可能漏掉“错配后恰好抵消”的问题。

建事实登记表:每个可发布数字都有编号、公式、来源和负责人

事实表不是最后的汇总表,而是所有交付共用的接口。每行至少记录事实编号、标签、精确值、单位、分子、分母、时期、过滤器、公式、来源编号集、数据版本、负责人、复核状态和显示规则。

可复制模板
事实编号:F-ACT-14D
标签:14 天激活率
精确值:0.817757...
分子:525
分母:642
报告显示:81.8%
演示显示:82%
图表显示:525 人;副标题“642 名受邀用户中”
时期:C1—C6 批次;事件截至 2026-07-08
来源编号集:[S01, S03]
公式版本:metrics-v1.2
复核状态:已批准
负责人:周澄

事实状态只有草稿、已检查、已批准和已退休。AI 可以从标准数据生成草稿候选和差异说明,不能把自己计算的结果直接标为已批准。周澄复算关键值,并由客户负责人确认业务定义后,事实才能进入交付构建。

事实修订不能覆盖历史。F-ACT-14D v1.1 保存 518/642、来源 S02 和批准记录;v1.2 保存 525/642、来源 S03、变更原因“7 个延迟导出事件”和取代关系。“已退休”只表示不再用于新的发布包,不代表历史报告当时造假。如果定义也发生变化,例如窗口从 14 天改为 21 天,就另建 F-ACT-21D,不能继续沿用 v1.2,因为接收者需要区分数据回补和口径改变。

低风险描述值可以由一人复算,高影响结论则要采用第二条独立路径:一条从 6 个批次聚合相加得到 525,另一条从用户级合格标志计数也得到 525;两条路径不能只是复制同一张摘要表。费用率则先独立核对总成本和分母,再计算商。两条路径一致仍然不能证明定义正确,所以负责人对定义的批准是第三类证据。

把公式、舍入、单位和缺失值规则写成机器可检查的口径

525÷642=0.817757…;报告按四舍五入保留一位小数,显示为 81.8%,演示按同一规则显示整数 82%,图表主值为 525 人,并标明分母 642。三种显示不同,精确值、分子和分母却完全相同。费用为 19,200+14,400=33,600;每名激活用户成本为 33,600÷525=64.00,每名关键工作流完成用户成本为 33,600÷451=74.50。

规则编号 对象 规则 例子
R01 比率/报告 百分比,1 小数 81.8%
R02 比率/演示 四舍五入为整数,备注保留精确值 82%
R03 资金 货币 +2 位小数 74.50
R04 持续时间 中位数天数,1 小数 2.6 天
R05 缺失 显示“未收集”,不得写 0
R06 被抑制 小样本按负责人批准的规则合并 不显示单元值
从 525 除 642 的精确权威事实向报告 81.8%、演示 82%和图表 525 人三种显示分流,下方对照禁止逆向计算与正确计算方向
从左侧精确事实向右生成三种显示,再看下方为什么不能从舍入值逆向计算。这些规则属于本案例;不同软件的边界舍入需用实际工具锁定,零、缺失、不适用和被抑制也不能混为一谈。

零、缺失、不适用和因敏感性被抑制是四种不同状态。AI 若把空白转成 0,可能改变平均值;图表若丢掉缺失批次,必须在注释说明而不是把折线连接成连续事实。

公式层还要控制类型和精度:计数必须是非负整数;百分比的精确值要一直保留到显示阶段;货币必须在批准币种下计算;日期差统一使用批准时区和边界规则。报告不能先把 81.8% 写回工作簿再反算人数,图表也不能从已经舍入的 82% 反推分子。R01—R06 每条规则都准备正常、边界和错误样本,例如核对 0.805 在实际舍入工具中的行为,用真实结果锁定规则,而不是只依赖语言描述。

单位换算同样要进入规则。如果报告写“缩短 1.2 天”,演示写“约快 32%”,后者必须引用 (3.8−2.6)÷3.8=31.6%,并注明比较对象是“首次实现价值的中位时间”。不能把中位数差异说成每个用户都节省了 1.2 天。文字变短,不能让统计对象和证据强度一起消失。

用主张登记表约束文字结论的强度

“激活率达到 81.8%”是在描述事实;“试点使激活率提升”还需要可比较的基线或因果设计;“应全面推广”则需要额外判断成本、风险和容量。周澄为报告和演示中的每个重要句子记录主张编号、主张文本、支撑事实、限定条件、允许使用的产物和复核人。

主张编号 候选主张 支撑 处理
C01 525/642 在 14 天内激活 F-ACT-14D 已批准
C02 已激活者中 85.9% 完成关键工作流 F-WORK-ACT 已批准
C03 新用户引导使激活率提升 18% 没有可比对照 已拒绝
C04 调查满意率为 76.2% 218/286 已批准,限定为受访者
C05 76.2% 的全部用户满意 调查仅覆盖 286 响应 已拒绝
C06 扩展前先验证支持容量 74 升级+容量访谈 建议,非事实
C01 到 C06 的候选文字、证据边界和批准拒绝状态表,下方从寻找最小反例走到事实蕴含范围、保留限定和价值判断分离的发布条件
逐行判断事实能支持到哪一种文字强度,再用底部反例检查限定是否会改变句义。登记表能暴露语义漂移,不能自动证明因果或建议合理;高影响主张仍需人工复核方法、样本和原始证据。

事实登记表防止数字漂移,主张登记表防止语义漂移。AI 很容易把相关关系、观察结果或部分样本写成因果关系、总体结论或确定建议,所以两个表必须同时审查。

主张检查分成三个问题。第一,事实是否真的支持文字中的数量和范围;第二,是否遗漏会改变理解的限定条件;第三,建议是否把价值判断冒充成数据结论。C04 加上“答卷受访者中”以后可以通过;C05 即使 76.2% 计算正确,仍然失败。C06 可以由 74 个升级案例和容量访谈支持“先验证容量”这一行动建议,却不能写成“系统无法扩展”的既成事实。

周澄还让 AI 做反向挑战,为每条主张寻找最小反例。例如,C02 只要有一个批次的工作流时间戳晚于截止日,451 就会改变;C04 如果存在系统性不回复的人群,就不能外推到全部用户。反例不会自动否定主张,但会把限制放到正确位置。高影响主张必须由人阅读原始方法和样本,不能只接受模型给出的“支持充分”标签。

完整走例:从 7 条回补事件到报告一句话、演示标签和图表数据点

7 月 1 日的早期快照中有 518 名合格激活用户。7 月 8 日,系统负责人确认 7 条延迟导出的事件实际发生在各自的 14 天窗口内:C2 增加 1 人、C3 增加 2 人、C4 增加 1 人、C5 增加 2 人、C6 增加 1 人,总数因此变为 525。随后又确认其中 5 人完成关键工作流,使工作流完成人数从 446 变为 451。

群组 已受邀 激活 v1.1 回填 激活 v1.2 工作流 v1.2
C1 100 78 0 78 67
C2 104 81 1 82 70
C3 108 86 2 88 76
C4 106 87 1 88 75
C5 112 93 2 95 82
C6 112 93 1 94 81
总计 642 518 7 525 451

流水线把 F-ACT-14D 重算为 525/642=81.8%,并把依赖它的 C01、报告第 4 页、工作簿摘要、演示第 3 页和第 9 页、图 01 全部标为过时。重新构建后,报告写“525 名(81.8%)”,演示主画面写“82%”,备注保留“525/642;一位小数为 81.8%”;图表数据点为 525,长描述同时写出分母。更新不是在全文中搜索“80.7”,而是按依赖关系重建。

新增的 5 名工作流完成人员,并不必然与 7 名回补激活用户一一对应。周澄核对事件编号后确认,其中 5 人完成、2 人未完成。于是激活人数增加 7,工作流完成人数增加 5,F-WORK-ACT 从 446/518=86.1% 变为 451/525=85.9%;人数上升,条件转化率反而下降 0.2 个百分点。如果只在文字中搜索旧人数,很容易漏掉派生率方向的变化。报告因此不再写“完成转化保持 86.1%”;演示中的整数 86% 表面虽然没有变化,讲者备注和来源版本仍然必须更新。

整次变更留下一张追踪卡:S03 的 7 个新事件编号→标准数据中的 7 个合格激活标志→F-ACT v1.2 与 F-WORK-ACT v1.2→C01 与 C02 复审→五类产物节点重建→63 处数字出现位置检查。接收者看到 82% 时,可以逐层回到来源,而不需要知道生成时使用了什么提示词。

四种产物怎样使用同一事实

工作簿是可复算的分析表面,不是四种产物共同抄写的终点

工作簿包含说明、来源、排除项、批次成员、事件、事实、主张、图表数据和检查九类工作表。原始数据区和标准数据区锁定,人工说明写在独立列;摘要中的每个值都引用事实或公式,不能粘贴聊天结果。

检查编号 检查 期望/结果
X01 受邀人群汇总 642=642,通过
X02 激活汇总 525=525,通过
X03 工作流≤激活 6/6 人群,通过
X04 回复≤激活 286≤525,通过
X05 成本构成 19,200+14,400=33,600
X06 事实展示 精确→报告/演示文稿规则,通过
X07 未知来源 ID 0
X08 发布中未批准的事实 0
左侧六类工作表从来源、排除、事件、事实主张、图表数据到检查,右侧并列生成报告、工作簿、演示和配图,底部阻断产物互相抄数
左侧是可复算工作表职责,右侧四份文件是事实层的同级输出,底部列出不能反向回写的路径。链接可以提高便利性,却会受路径、权限和平台影响;发布清单与值比较仍需独立存在。

如果交付工具支持链接对象,可以让演示中的图表连接工作簿;但链接可能因为路径、权限、平台或粘贴方式而断裂。Microsoft 当前支持文档区分链接对象、嵌入对象和未关联副本,并说明链接来源必须可用,网页端和桌面端能力也可能不同。因此,链接只是便利机制,不是事实治理;产物清单和发布前的值比较仍然必须存在。

工作簿打开时,不能依赖作者电脑上的隐藏外部路径。周澄在一个干净目录中测试所有公式、命名范围、透视缓存和链接,记录是否需要刷新;导出 PDF 前强制重算并保存。检查表不能只显示绿色图标,还要包含预期、实际、严重程度、最近运行时间和证据单元格。接收者修改标准表时,保护规则和数据验证会提示“请回到来源流水线”,避免把复核副本变成第二个权威来源。

不会写代码的读者,可以先用表格的命名区域、Power Query 或其他查询工具、受控公式完成同样逻辑。关键不在于使用哪种语言,而在于减少复制粘贴、保存来源版次,并让重算可以重复。如果手工步骤暂时无法消除,就把它写进构建日志:由谁、从哪里复制、粘到何处、怎样双人比对,以及上游变化后如何重做。

报告从已批准主张组装论证

报告大纲先写问题和证据位置,再生成文字。每个分析段都区分四种内容:观察引用已批准事实;解释说明可能含义;限制交代样本或方法边界;建议写出行动、负责人和验证办法。AI 不能把四者揉成一句肯定判断。

报告段落 填好示例
观察 6 批 642 名有效受邀者中,525 名在 14 天内激活(81.8%)
解释 后三批激活率高于前三批,值得检查流程变化
限制 批次并非随机分配,不能把差异直接归因于新材料
建议 扩展前对 C5/C6 流程做 2 批受控复验,并监测升级容量
追踪 F-ACT-14D、人群表、方法备注 M02

脚注不是装饰,它要指出来源快照、指标定义、排除规则,以及调查只代表受访者。报告审阅应先验证主张与事实,再修改语言;如果先润色,漂亮叙述反而会让口径错误更难被发现。

生成报告时,模板只接受经过批准的主张块,而不是整张原始表。每个主张块都包含标题、批准措辞、事实显示、限定条件、来源备注和图表编号。AI 可以调整段落衔接,但渲染后要精确核对事实绑定。如果模型删掉“受访者中”,或者把“相关”改成“导致”,主张检查器要把成稿与批准句义对照并转交人工;不能因为所有数字一致就发布。

表格也要按阅读任务裁剪。正文批次表显示 6 个批次和总计,附录提供字段定义与检查结果;不能把 642 行个人级数据嵌进报告。客户需要明细时,应另行交付受控数据文件,并重新评估最小化、访问和保留。多产物流程不是把所有数据复制到更多容器。

演示按决策压缩信息,但每次压缩都留下恢复精确信息的入口

10 页演示依次包含决定请求、试点范围、激活漏斗、批次变化、关键工作流、支持容量、调查结果、成本、风险与下一步。主画面只放支持该页结论的 1—3 个指标;精确分子和分母、事实编号、来源版次与限制放进讲者备注或附录。

幻灯片 主画面 备注中必须保留 禁止压缩
3 82% 14-日激活 525/642=81.8%,R02 改成“几乎全部”
4 6 个批次柱状图 每批样本量与事件截止日 隐去最低批次
6 74 升级 14.1% 已激活的 写成 74 用户
7 76% 已满足 218/286 受访者 外推全部 525 人
8 每名完成人员成本 74.50 33,600/451 忽略设置成本
表格把 82%激活、74 次升级、76%满意和 74.50 成本的主画面分别连接到备注精确值、正确限定和禁止压缩,底部展示导出后检查
从主画面向右恢复精确分母和限定,并核对最后一列哪些压缩会误导听众。备注是恢复入口,不是隐藏限定的借口;会改变理解的统计对象必须直接出现在主画面或标题。

演示中的文字可以更短,却不能改变分母、时间窗或证据强度。若一页必须牺牲限定词才能塞下,应该减少结论,而不是把限定词藏到没人能找到的位置。

周澄为每页建立幻灯片合同,记录决策、主张编号集、视觉编号、允许的显示方式、讲者备注和口头说明。第 3 页只能表达 C01,不能顺手增加“优于行业”;第 7 页直接在标题中写“答卷受访者满意度”,不能把限定藏进备注。演练时让另一人只看投影画面复述理解;如果对方把 74 个案例误解为 74 名用户,页面就需要修改标签,不能责怪听众没有看脚注。

导出后还要再检查一次,因为字体替换、裁切、动画或 PDF 转换可能让分母、图例和来源消失。10 页演示逐页截图,与幻灯片合同对比;12 个指标的显示文本、精确值、单位和数据截止日都要存在。出现空白占位图或“更新数据”提示,视为构建失败。

配图分为数据图、解释图和装饰图,三类对事实的责任完全不同

3 张数据图分别展示激活漏斗、六个批次的激活情况和完成人员成本;1 张解释图展示“来源→标准数据→事实→产物”。数据图必须由图表数据渲染,AI 只能协助选择图形、颜色和注释,不能根据自然语言生成看似精确的柱高。解释图的节点和箭头来自批准流程,装饰图不得暗示真实参与者、客户品牌或量化结果。

图形编号 类型 数据/结构来源 文本替代 更新触发
FIG01 漏斗 F-INV、F-ACT、F-WORK 短替代文本与完整数值表 三项中任一变化
FIG02 人群柱状图 批次图表数据 趋势总结+6 行表 批次值变化
FIG03 成本柱状图 F-COST-ACT/WORK 两值及公式 成本/人数变化
FIG04 流程图 产物依赖规范 节点和方向描述 流程版本变化
数据图、解释图和装饰图的允许来源、必须验证和失败例子对照,底部展示已批准事实到图表数据、图形与数值比对的生成方向
先比较三类图对来源与验证承担的不同责任,再沿底部读取数据图的单向生成链。AI 可以协助选图形、颜色和注释,不能凭文字生成看似精确的数据几何;无障碍还需在目标阅读器实测。

W3C WAI 的复杂图片教程建议为图表、流程图等提供短描述与表达关键信息的长描述,并在周边文字概括图意;数据表还需要可识别的行列标题。这里把这些原则应用到 PDF、演示导出和网页版本,但具体格式的无障碍能力仍需在目标阅读器中测试。

图表规范比一句“画得专业”具体得多。FIG02 指定横轴为批次,纵轴为已激活/已邀请,刻度从 0 开始,系列显示比率,标签同时带人数,排序按 C1—C6,颜色不作为唯一编码,注释只标记经过来源验证的变更。渲染器读取 6 行图表数据,再提取实际 SVG 或演示图形中的 6 个数值进行比对;视觉审阅还要检查坐标轴、标签遮挡、对比度,以及是否用面积制造夸张。

AI 生成解释图之前,也必须先产出结构化节点表和关系表。如果图中自行增加“自动决策”节点,或者把复核人画成可选旁路,即使视觉漂亮也判失败。装饰图要记录生成来源、许可或使用条件和人工检查,但不能承担只能依靠图像理解的关键事实;任何图都不能输入未经授权的客户素材或可识别个人资料。

用产物清单把四份文件绑定到同一次发布

每次构建都生成产物清单,不能靠文件名猜版本。清单记录发布编号、来源快照、数据、公式和主张版本、产物路径、内容哈希值、生成时间、生成工具、所用事实、人工修改、复核人和状态。任何文件内容变化都必须产生新的哈希值;人工修改图表标题,也要先回写源模板再重建,不能只修最终演示文稿。

产物 所用事实 构建 类型与状态
report-v1.2.pdf 27 项已批准事实 模板 3.1 报告;已检查
分析工作簿 v1.2 标准数据及全部事实 工作簿 2.4 电子表格;已检查
briefing-v1.2.pptx 12 项事实及 7 条主张 幻灯片 1.8 演示文稿;已检查
图表 v1.2 压缩包 9 事实及流程规范 图表 2.2 图表;已检查
左侧四份 v1.2 文件连接到包含发布编号、来源数据版本、公式主张版本、所用事实、SHA-256 和复核状态的发布回执,下方对照现场手改与回源重建
四份文件先汇入共同发布回执,再看底部为什么现场手改导出件会造成不可解释分叉。清单证明文件属于同一构建和事实版本,不证明上游定义正确;旧交付仍须明确归档、取代和通知。

清单还要注明本次发布取代了 v1.1。旧文件移入明确标记的归档,分享链接切向完整的新发布包,而不是给客户一个包含“v1、最终、最终版 2、最新真的”混乱文件夹。

“人工修改”字段原则上应为空,或者只记录可复现的审批注释。发现 PDF 页码错位时,正确动作是修正报告模板并重建;直接在 PDF 编辑器中移动元素,会产生清单无法解释的分叉。如果交付期限迫使团队做一次不可自动化的修补,就要保存补丁说明、操作者、新旧内容哈希值和后续回源修正事项,并重新运行受影响页面的检查。

清单本身也要接受验证:每个列出的文件确实存在且哈希值匹配;每项所用事实都指向已批准版本;来源快照没有混用;每个产物的发布编号一致。压缩打包后,要从全新目录解压并打开,确认相对链接、字体和附件不是只能在作者电脑上使用。

构建顺序从数据到观点再到格式,避免后生成文件反过来污染事实

可复制模板
冻结来源
  → 验证并生成标准数据
  → 计算事实
  → 批准事实与主张
  → 构建工作簿和图表数据
  → 渲染报告、配图和演示
  → 跨产物一致性检查
  → 人工视觉与内容复核
  → 生成发布清单并交付
发布门槛 输入 发布证据 失败动作
数据 来源快照 计数/拒收/检查 停止计算
事实 标准表 公式重新计算 保持草稿
主张 已批准的事实 支持/资格评审 拒收/重写
渲染 模板及登记表 文件创建与哈希值 修模板后重建
一致性 4 种产物 数值、文本和图表测试 阻断整个发布包
可视化 渲染页面/幻灯片 已签署的检查表 回源修,不改导出件

报告、演示和图表不能互相作为来源。演示不能从报告 PDF 中再抄数字,图表不能从演示截图中提取数值,工作簿也不能接受报告作者手改的“最终数字”;它们都是事实层的同级输出。

做五类一致性检查:值相同只是第一层,分母、语义、图形和版本也要相同

测试集 样本数 检查 v1.2 结果
数值 63 发生次数 精确/显示规则 63 通过
分母与单位 27 项主张 分母、分析单元、时期 27 通过
文本蕴含 18 项关键主张 事实是否足以支持 16 通过、2 已拒绝
图表 11 数据点 渲染规范与提取结果对比 11 通过
来源与过时状态 4 种产物 版本、哈希值、所用事实 4 通过
数值、分母单位、文本蕴含、图表、来源过时五类检查的样本、真正检查和 v1.2 结果表,下方补充人工视觉检查与整包发布
逐行检查值、统计对象、句义、图形和发布身份,最后加上底部人工视觉复核。检查数量按本案例风险设计,不是固定配额;纯文字交付可以没有图表门,但仍要保持事实与视图分离、来源和依赖可追踪。

另外还要做视觉检查:图例颜色与标签对应;坐标轴没有因为截断而夸大差异;脚注可读;表格没有被分页切断;演示讲者备注仍在;PDF 链接有效;图片的短描述和长描述可以找到。自动抽数可能会发现 81.8 与 82 不同,只有读取显示规则后才能判断这是否属于允许的转换;没有规则支撑的差异一律失败。

如果交付是一份纯文字项目回顾,没有数据图或计算指标,仍可以用来源编号、主张编号和产物清单管理来源与版本,但不应强行建立 11 点图表检查。方法的稳定核心是“事实与视图分离、依赖可追踪”,检查数量应按交付风险调整。

数据修正时做影响分析和整包重发,不能只替换被客户指出的一页

7 条回补事件进入后,依赖图找到 1 个主事实、2 个派生比率、3 个成本率、4 个图表系列、5 个报告段落和 2 页演示受到影响。构建系统把四份 v1.1 产物全部标为过时;即使某张图舍入后的外观没有变化,也要重建并更新清单,因为来源版本已经改变。

影响类型 例子 动作
值已变更 518→525 重算并重渲染
显示未变更 旧版和新版都可能显示 82 仍更新备注、哈希值和版本
解释受影响 后三个批次趋势变化 重新审查主张
未受影响 调查 218/286 验证依赖后保留值
外部副本 客户下载过 v1.1 发送替换通知

替换通知要写清哪些文件被替换、为什么替换、主要数字发生了什么变化、结论是否改变,以及怎样识别和删除旧文件。静默覆盖共享链接,会让接收者无法判断手中的截图或附件是否已经过期。

失败边界:一致的错误仍然是错误,四份产物同源不能替代专业复核

如果激活定义本身错了,流水线只会更高效地把同一个错误传播到四处。因此周澄设置了停止条件:来源负责人不确认替代关系;行数或唯一键不闭合;关键事实仍是草稿;分母没有定义;主张缺少支撑;敏感小样本暴露;图形与数据点不一致;任一产物版本落后;或者交付后发现会改变决策的修正。

失败 发现证据 立即动作 人工责任
测试账号混入 排除项数量变化 冻结发布包并重建 数据负责人确认名单
因果夸大 主张没有对照证据 拒绝 C03 顾问修改结论
调查外推 把 286 写成 525 阻断报告与演示 复核人检查分母
旧图混入 图表清单仍是 v1.1 整包不交付 发布负责人清理
隐私泄露 出现自由文本或敏感小单元 停止、隔离并评估事件 隐私与安全专家
链接断裂 演示无法打开来源 用清单中的值检查并修复链接 技术协作者,不能现场改数
错误激活定义或测试账号混入分母从上游同时污染报告、工作簿、演示和图表,下方并列数据负责人、分析复核人和交付负责人的审批责任
从左侧错误定义看它怎样同时污染四种产物,再用底部三类责任在源头阻断。同一个人可以兼任角色,但要分别留下结论;定义、隐私、版本或图形问题应冻结整包,不能只修被指出的一页。

人工批准分成三类:数据负责人批准定义和排除项;分析复核人复算事实并检查主张;交付负责人检查渲染、受众和替换通知。一个人可以兼任多个角色,但必须分别留下三类结论,不能用一次“整体看过”掩盖不同责任。

复制这份交付控制包,并从一个真实数字的四处出现开始

读者可以先做轻量版本,不必立刻搭建代码系统。先建立六张表:来源清单、指标定义、事实登记表、主张登记表、产物映射和发布检查清单;为最重要的 10 个数字分配事实编号,在报告、表格、演示和图表中标注引用,再做一次人工交叉检查。

模板 最少字段 完成标准
来源清单 编号、版本、负责人、范围、哈希值 每个当前来源唯一
事实登记表 精确值、公式、时期、来源、状态 关键事实已批准
主张登记表 文本、事实、限定条件、复核人 没有缺少证据支持的主张
产物映射 文件、所用事实、构建、哈希值 四份产物可追踪
一致性日志 测试、预期、实际、动作 所有阻断项关闭
发布记录 编号、取代关系、复核人、通知 接收者能识别当前版本

本案例参考的公开资料包括:W3C PROV 概述对来源中实体、活动和执行者关系的说明;英国政府分析职能的 RAP 策略对相同数据与方法可重现、减少手工步骤、版本控制、质量保证,以及由一条流程产生多个产品的说明;Microsoft 当前关于链接、嵌入和未链接 Excel/PowerPoint 对象的文档;W3C WAI 关于复杂图像短描述、长描述和数据表标题关系的教程。RAP 文件面向政府分析,本案例只借用可复现和多产物原则,不把其组织要求写成 OPC 的通用合规义务;Microsoft 功能也应按自己的平台、版本和存储方式重新验证。

今天的起点不是让 AI 重新做四份文件,而是找出一个在四处出现的重要数字:写出它的分子、分母、时间窗、过滤器、来源版本、批准人和四种显示方式。只要其中一处不能回答“我从哪里来、为何这样显示、上游变化后谁会提醒我”,就先修事实链,再生成成品。