先看结果:158万元模型账单背后,首年完全成本是1,807.2万元
澄庭物业集团有7,600名员工、240个园区,每年处理144万张报修工单。最初立项表只写“模型与接口158万元、预计节省1,200万元”,董事会以为这是一个轻量采购。项目组把流程、数据、应用、评估、人工、平台、运营、失败和变更放入同一范围后,首年完全成本变为1,807.2万元,其中设置成本342万元、运行成本1,465.2万元。
| 首年视图 | 金额 | 其所支持的决策 |
|---|---|---|
| 供应商与模型发票 | 158万元 | 仅用于词元、调用与速率优化 |
| 外部现金支付总额 | 536万元 | 资金与采购预算 |
| 已预算的内部人力 | 1,182万元 | 容量与优先级;不会自动变成现金节省 |
| 分摊与折旧 | 89.2万元 | 满载产品视图 |
| 满载首年总体拥有成本 | 1,807.2万元 | 继续、扩展或比较替代方案 |
| 基准范围内的人力与返工 | 2,227.2万元 | 反事实;不是完整服务成本 |
| 首年情境缺口 | 420万元 | 收益实现前的假设 |
AI覆盖80%,即115.2万张符合条件的工单,但每张仍需2.1分钟复核;其余28.8万张走原人工,57,600张AI草稿另需失败返工。三类人工共81,600小时、979.2万元,是模型发票的6.2倍。与185,600小时基线相比释放104,000小时,约相当于69.3个每年1,500生产小时的全职当量容量;它不是69个职位,也不是当年现金减少,必须有等待时间下降、避免招聘、增加覆盖或其他真实去向才形成价值。
三年情境总体拥有成本为4,986.7万元;按业务量每年增长10%的基线为7,372万元,差额为2,385.3万元。报告把它称为情境缺口,不称已实现节省:质量、采用率、供应商价格、人工时间、服务需求和容量再配置中任何一项偏离,都会改变结果。
公司、工单、费率、成本、处理时间、模型、预算和结果均为虚构教学案例,不代表真实客户、报价、会计政策或行业效率。真实资本化/费用化、税、折旧、劳动、合同、隐私、安全与财务处理须由组织的财务、法务、人力、采购和专业负责人决定。
本文只建立总成本账:总体拥有成本、预算、现金、单位成本、价值与投资回报率不能混成一个数字
总体拥有成本回答在明确范围与期间内,为建设、运行、变更和退场系统占用了哪些资源;预算是获批可花的额度;现金是对外实际付款;单位成本把成本除以有意义的单位;收益/价值是业务结果;投资回报率才比较增量价值与增量成本。它们互相关联,但分子、分母和时间不同。
| 术语 | 分子与分母 | 常见误用 |
|---|---|---|
| 供应商支出 | 发票现金 | 称为全部AI成本 |
| 满载总体拥有成本 | 随范围和时间变化的直接、分摊、内部与失败成本 | 与只含现金的替代方案比较 |
| 预算 | 按周期和负责人批准的金额 | 未花完就称为节省 |
| 每次调用或词元的成本 | 技术用量单位 | 把低单价当成业务效率 |
| 每张合格工单的成本 | 分摊成本÷合格终态 | 删除失败、重试或人工分母 |
| 释放容量 | 基准工时−未来工时 | 直接乘工资称现金收益 |
| 收益/投资回报率 | 可归因成果与增量成本对比 | 把预测当已实现 |
本篇范围从批准试点前的流程/资料准备开始,到三年运行和预估退场义务,不含整个物业客服、维修执行、备件与承包商成本。基线只含“工单初分流+该步骤返工”,未来也必须用同范围比较;若未来表加入现场维修收益,基线与归因方法同时扩展。
财务维护三张可以相互核对的表:现金视角服务资金与合同,全成本视角服务产品与架构决定,容量与价值视角服务业务。不能把三张表合成一个“AI节省率”:同一名员工的工资在现金上可能没有变化,在总体拥有成本上却有真实机会成本;在价值表上是否真的释放容量,还需要业务证据。
开账前先填一页范围检查表:任务版本、业务对象、起止日期、纳入组织、当前流程、未来流程、比较方案、价格币种/税、费率日期、资本/费用待财务判断、共享平台、人工角色、故障情境、变更和退场。每个排除项写理由,例如“现场维修执行不在本次分流总体拥有成本”,不能只留空;未来有人要求加入客户补偿时,范围记录会提示基线、未来和价值三边必须同时调整。
三张表使用同一个成本项目编号和期间连接。对外付款记录发票、合同和付款时点,内部时间记录角色、小时、完全费率和来源,共享项目记录分配规则与版本;容量表只引用已经验证减少的小时,不直接引用模型预测。这样董事会可以从1,807.2万元向下追到某项复核时间,而不是面对三套互不相认的数字。
先固定计量分母,再展开生命周期成本
一张工单、一次AI尝试和一次模型调用不是一回事
144万是去重后的业务工单。115.2万张符合条件的对象,可能因超时或结构修复产生121万次AI尝试;一次尝试包含检索、生成与验证,全年形成264万次供应商或模型调用。最终109.44万张获得合格AI草稿,57,600张经额外人工完成,28.8万张从一开始就走人工;全部144万张仍各有一个关闭状态。
| 计量器 | 年度计数 | 使用 | 不得暗示 |
|---|---|---|---|
| 业务工单 | 1,440,000 | 需求/成果分母 | 等于AI使用量 |
| 符合条件的工单 | 1,152,000 | 已批准的 AI 范围 | 自动合格 |
| AI 尝试 | 1,210,000 | 可靠性/重试/成本 | 独立业务价值 |
| 供应商与模型调用 | 2,640,000 | 发票对账 | 264万张工单 |
| 合格的初始 AI 路径 | 1,094,400 | 已接受的草稿分母 | 不需人工复核 |
| AI 失败/返工 | 57,600 | 失败成本/质量 | 从分母删除 |
| 全程人工 | 288,000 | 连续性/范围外成本 | AI失败 |
技术单位成本为158万元÷264万≈每次调用0.598元;每张业务工单的供应商模型成本为158万元÷144万≈1.097元;全成本运行成本为1,465.2万元÷144万≈每张已关闭工单10.175元。三个数字都正确,但回答的问题不同。只展示0.598元,会把人工、平台、失败和非AI工单藏掉。
重试归回原工单,人工修正不创建“第二个成功”;取消、转人工、重复、超出范围与超时都有状态。成本账簿使用工单编号、尝试编号、追踪编号、供应商请求编号和最终结果建立关联,不能靠时间近似把账单猜给业务对象。
成本树按生命周期与责任层展开
| 成本类别 | 示例 | 成本驱动因素与负责人 |
|---|---|---|
| 发现/处理 | 基线、任务合同、影响、工作流重新设计 | 研讨会/工时;业务/产品 |
| 数据/知识 | 库存、权限、清理、标签、摄入 | 源文档/变更;数据负责人 |
| 构建与集成 | 应用、网关、检索增强生成、身份、工具、状态与测试 | 功能与接口;工程负责人 |
| 模型与基础设施 | 调用与词元、计算、存储、网络和采购承诺 | 体量与形态;平台和供应商负责人 |
| 评估/保障 | 标准案例、审查员、红队、安全/隐私/法律 | 配置/变更/风险;评估/治理 |
| 人工操作 | 复核、编辑、例外、支持、人工回退 | 工单/分钟;业务运营 |
| 运行/可靠性 | 可观测性、值班人员、补丁、事件、灾难恢复 | 服务/站点/服务等级目标;运营 |
| 变更/退出 | 模型迁移、重新测试、培训、导出、删除/退役 | 变更/资产;产品/供应商 |
每项再标直接/共享、现金/内部、固定/可变、一次性/周期性、资本/费用处理(待财务确认)、已承诺/可避免和置信度。分类服务决策,不自行决定会计处理。例如内部工程时间不是发票,但对项目优先级是真实资源;已买提交短期可能不可避免,续约时又变成可避免。
总体拥有成本不加入无法说明因果的“品牌价值”等软数字;风险用预期/情景范围而不是伪精确。严重但罕见事件可列压力测试用例与保险/责任,不强行乘一个无依据概率。所有假设有负责人、来源日期、低/基础/高和触发更新条件。
一条填好的成本记录至少包含:成本编号、任务与环境、生命周期阶段、责任团队、供应商或内部角色、数量、单位、单价或费率、金额、现金或内部或共享、直接或共享、固定或变量、一次或持续、可避免日期、业务分母、资料来源、置信等级和审批人。例如“人工复核”不能只写483.84万元,而要保存115.2万张×2.1分钟×120元/小时、抽样窗口、角色组合和下一次复测日期。
账目还有状态:估算、已承诺、已计提、已开票、已支付、已分配、有争议的、已关闭。合同已签未开票不等于零,发票已付但负责人有争议也不能静默分摊;预测与实际并存,禁止用实际覆盖原预测。每次修正规则生成新版本,并在差异说明中指出是用量变化、价格变化还是计算方法变化。
基线和设置成本必须在运行前入账
基线只量同一项当前任务
抽样12周、36个园区、24,000张工单,当前初分流中位数为7.2分钟;全年144万×7.2÷60=172,800小时,按满载120元/小时计算为2,073.6万元。另有96,000张因分类、地址或优先级错误返工,平均8分钟,即12,800小时、153.6万元;合计185,600小时、2,227.2万元。
| 基线组件 | 体量/时间 | 年度工时 | 含分摊成本 |
|---|---|---|---|
| 初步分诊 | 144万张×7.2分钟 | 172,800 | 2,073.6万元 |
| 可归因的返工 | 96,000张×8分钟 | 12,800 | 153.6万元 |
| 范围限定总额 | — | 185,600 | 2,227.2万元 |
| 未定价质量 | 等待、95分位与按类别升级 | 单独测量 | 不强制计入金额 |
120元/小时包含薪酬、福利、排班与明确分摊,案例没有把这一费率当作真实组织标准。等待时间、首次解决率和紧急工单影响另作运营成果,只有在有可信货币后果时才计价值;不能为了提高投资回报率而随意给每分钟等待标价。
基线随业务量增长,不假设永远不变。三年反事实采用数量每年增长10%、单位分钟与费率不变:第1年2,227.2万元、第2年2,449.9万元、第3年2,694.9万元,共7,372万元。若流程本来会优化或工资与外包价格变化,反事实必须更新,不能把所有自然改进归给AI。
时间抽样避免只挑“处理顺利”的工单。24,000张按园区、工单类别、紧急度、班次、熟练度、语言、缺字段和返工切片;计时从进入可处理队列到完成初分流,等待外部信息另记,不把午休或系统停机粗暴归给人员。两名分析员独立复核200条事件日志,发现移动端切换页面的42秒曾被漏计,修正后才冻结7.2分钟基线。样本清单、排除原因和置信范围随基线版本保存。
返工96,000张来自同一错误定义:首次分流后因地点、类别或优先级被退回并产生额外处理;客户追加信息不是分流错误,现场维修失败也不在范围。若AI上线后改变状态名称,建立旧新映射并双算一个月,不能让“退回”改名“补充”就产生虚假改善。
设置阶段也会占用342万元
| 首年设置项 | 成本 | 交付物/退出证据 |
|---|---|---|
| 流程与数据发现 | 62万元 | 基线、任务与数据映射、负责人、清理账目 |
| 应用与集成 | 148万元 | 工作流状态、身份、检索增强生成、验证器与人工路径 |
| 安全、隐私与采购 | 36万元 | 威胁、数据、合同与退出验收 |
| 部署前评估 | 54万元 | 冻结集合、关键放行门、负载与降级报告 |
| 培训与变更设计 | 42万元 | 用户批次、支持、工作辅助、反馈与停止路由 |
| 总计 | 342万元 | 不假设每年原样重复 |
设置同时含现金承包商与内部时间,在现金/全分摊过渡中拆开。业务员工参加研讨会、领域专家标注、IAM/法务评审和数据负责人清理不是“顺便做”;记录小时、角色和被推迟工作,防止项目看似便宜却由各部门暗补。
数据修复不要全部算AI。只为本任务新增的地址映射、故障枚举与权限继承直接分配;本来就必须做的主数据项目按增量或共享规则;无法合理区分则公开假设。把多年数据债全塞进AI会错误拒绝项目,把它全算免费又会夸大回报。
概念验证代码若进入生产,安全、测试、可观测性和支持补强仍是设置/过渡成本。试用期免费API也保留实际用量按预计生产速率重估,不能用供应商信用证明运行速率。
148万元集成成本不是一个开发总包。工作分解记录中,工作流状态、防重复与人工路径39万元,身份、权限与审计26万元,检索与地址映射31万元,验证器与界面证据展示27万元,测试、发布与回滚25万元,合计148万元。某功能延期时只移动对应预算和收益前提,不能让总包数字掩盖“界面没有证据却仍要求2.1分钟审核”的因果。
设置交付要能退场:资料清单含负责人/版本/权限/删除,集成清单含接口/机密/依赖/回滚,培训清单含群组/时长/通过/支持,评估记录含案例/配置/结果。若项目在构建放行门槛停止,这些产物可支持人工流程修复或下一方案,而不是只剩不可运行的演示代码。
运行成本必须覆盖技术、人工、保障、异常和共享平台
158万元模型账单只是技术运行的一行
| 周期性技术 | 首年 | 成本驱动因素/控制 |
|---|---|---|
| 托管模型与供应商 | 158万元 | 264万次调用、输入与输出、缓存、重试与速率 |
| 检索、存储与网络 | 42万元 | 索引文档、查询、重新索引、出站与备份 |
| 网关、可观测性与平台 | 64万元 | 请求、追踪、留存与共享服务 |
| 支持与运维工具 | 下方人员成本中包含 | 席位、服务与服务目标 |
| 此处技术小计 | 264万元 | 不是完整运行成本 |
供应商账单与业务计量器逐月对账:模型、区域、版本、输入、输出、缓存、批量、折扣、税与汇率、失败与重试和未分配费用。264万次调用要能回到121万次尝试与144万张工单;差异可能来自供应商内部计费、健康检查、评估、重复或未知应用,不能按部门人数静默摊平。
检索增强生成的成本不只有向量库:资料连接器、解析与光学字符识别、分块与索引、权限同步、更新与删除、查询、重排序、缓存、备份和质量调查都要计入。一次错误配置每晚全量重新索引,会让存储与计算异常,即使模型词元不变;异常负责人需要同时看用量与任务结果。
提交/折扣用两种视图:发票按合同付款,经济单元按实际使用与未使用提交披露。为了让某任务看便宜而把未使用提交塞给中央预算不公平;为了证明本地便宜而把全部提交摊给一个任务也错误。续约前提交重新变成架构选择。
供应商对账使用一张月度检查表:发票调用与词元、网关记录、评估与生产与沙箱环境、成功与超时与重试、缓存与批处理、模型与版本与区域、税费与折扣逐项匹配。若发票有264万次调用而追踪只有251万次,13万次差异不能先按比例分摊;先查直连旧密钥、供应商重复计费、日志丢失与时区窗口,超过五个工作日仍未知才进入未分配并限制相关入口。
日志保留本身有成本和风险。普通成功只保留最少元数据/抽样内容,严重、权限、派单前验证器与事件完整记录;调试快照按案例授权和短期删除。为了降低存储账单不能删掉必要审计,为了可复现也不能无限保存客户描述;成本记录绑定日志策略版本,策略改变会同时触发安全与预测复核。
人工复核、例外和失败返工合计979.2万元
符合条件的工单为115.2万张。每份AI草稿必须在派单前核对地点、故障类别、紧急级、证据与承包范围,平均2.1分钟:115.2万×2.1÷60=40,320小时,按120元/小时计算为483.84万元。超出范围的28.8万张保持7.2分钟人工:34,560小时、414.72万元。5%即57,600张失败另需7分钟:6,720小时、80.64万元。合计81,600小时、979.2万元。
| 人工通道 | 公式 | 工时 | 成本 |
|---|---|---|---|
| AI强制复核 | 115.2万×2.1÷60 | 40,320 | 483.84万元 |
| 全程人工 | 28.8万×7.2÷60 | 34,560 | 414.72万元 |
| AI失败导致的额外返工 | 57,600×7÷60 | 6,720 | 80.64万元 |
| 总计 | — | 81,600 | 979.2万元 |
审核时间从UI事件与抽样工时研究取得,不让员工自报一个平均值;等待、并行任务与培训期分开。编辑分钟数随工单类别、区域、新手/熟手、模型版本切片,P50不能掩盖紧急类P95。若自动化把简单件拿走,人工剩余件更复杂,平均人工分钟上升不一定是人员效率下降。
失败成本保留第一次复核与额外7分钟,不能把人工修好后的工单标“AI成功”并删除重做。若错误到派单后才发现,还要加撤单、通知、承包商或客户影响;案例严重都在派单前拦截,因此没有虚构外部损失。
104,000小时释放=185,600−81,600。业务事先给它四个去向:45,000小时吸收预计量增长、30,000小时缩短高优先等待、18,000小时避免外包/招聘、11,000小时作为培训/波动余量。只有避免外包/招聘部分在发生且可归因后转现金收益;其余先报告容量结果。
人工队列还需算峰值而非只算年小时。年均81,600小时约每工作日326小时,但暴雨日工单可达平日3.4倍;如果复核人员只按均值排班,P95等待会恶化。运行记录按15分钟窗口保存到达、可用复核人、处理分钟、队列时长与升级数,E10再做完整容量设计;本篇至少把加班、临时外包与值班费放进高场景,不能靠员工无偿吸收峰值。
不同角色费率也不应一律按120元。普通分类、设施工程师和安全升级分别按实际角色组合计价;案例中的120元是加权教学费率,计算表保留构成。若AI把简单工单自动化后,剩余人工需要更资深角色,小时下降但费率可能上升;预测必须同时更新分钟与角色组合,不能只用旧均价。
评估、治理、培训和变更会持续发生
首年持续评估与变更成本为72万元,包含每月新增案例、领域复核、关键回退、模型、提示词、检索增强生成和验证器的变更测试,以及生产抽样与季度演练。部署前54万元评估费用与此分开;旧评估资产可以复用,但新区域、工单类别和模型版本仍会产生增量成本。
| 持续保障 | 节奏/触发 | 成本依据 |
|---|---|---|
| 任务质量样本 | 按类别/区域周统计 | 复核人工时/案例/分歧 |
| 关键回退 | 每次配置变更 | 运行调用/领域裁决 |
| 数据与权限测试 | 资料源、访问控制或结构变更 | 反向测试与数据负责人复核 |
| 安全/红队 | 季度 + 事件/变更 | 测试团队/修复/重测 |
| 负载/降级演练 | 季度 + 容量变更 | 环境/参与者/停机窗口 |
| 培训/支持刷新 | 新批次/错误模式 | 培训师/用户时间/材料/更新 |
治理成本不是按委员会数量计价值,而看产生的决策依据:谁批准范围、哪个风险被拒、例外何时到期、变更是否回滚、受影响人如何反馈。重复审批但不改变控制是浪费;关键负责人缺席却写“受管制的”是隐藏风险。
培训包括使用边界、复核依据、反馈/申诉、降级和人工,不只教按钮。培训时间是员工成本,支持工单是运维驱动因素;若界面让每人多花30秒找证据,1.152m规模下就是9,600小时,可能超过模型优化节省。
每次变更附一张变更成本卡:触发原因、受影响任务/配置/源/批次、需要重跑的样本、领域审核小时、模型调用、工程改动、并行期、培训、支持、回滚与旧版本退场。供应商把模型名保持不变但实际快照更新,同样可能产生这张卡;没有变更通知能力时在高场景增加连续金丝雀与调查成本。
评估产物本身也有维护状态。案例变陈旧、答案争议、资料权限撤回或生产新错误出现时,评估负责人更新或退役并留桥接;只计算首次标注费会低估持续成本。评分器若使用另一个模型,其调用、版本校准和人工抽查也进入评估账,不能当免费客观裁判。
故障、异常和低利用率要进入情境与储备
首年预留48万元,用于有范围的事件响应、紧急评估、数据与权限修复和业务连续演练,不代表一定支出,也不能随意消费。严重外部影响另列压力测试用例,不用无依据概率压成期望值;风险负责人决定保险、合同、控制或是否不做。
| 成本失效模式 | 领先信号 | 记录与行动 |
|---|---|---|
| 重试/上下文增长 | 尝试次数/工单、令牌、模式失败 | 异常 + 根本原因;失败不删账 |
| 人工复核偏差 | 分钟数/类别、编辑/拒绝 | 预测更新/工作流修复 |
| 陈旧/重复索引 | 重新索引/查询/存储、引用失败 | 停止作业/修复/源负责人 |
| 无人认领支持 | 平台外工单/工时 | 增加分配/服务负责人 |
| 未使用容量/提交 | 利用率/过期 | 披露沉没/可避免; 决策日调整规模 |
| 事件 | 受影响对象/人工/响应工时 | 案例账目/储备/压力场景 |
一次软件开发工具包缺陷让18,000张工单产生162,000次多余调用,单张工单的尝试次数和成本同时异常。断路器停止应用,团队修复防重复与重试;162,000次调用仍计入供应商成本与事件,不能移到“平台噪声”。若只看月度总账,业务量增长可能掩盖这一小类异常,所以检测按应用、任务、模型和错误分解。
低利用率也有负责人。评估环境常开、备用端点未演练、过期索引、闲置席位和本地储备分别处置;为连续性批准的储备不等同浪费,但必须有演练与过期。删资源前先确认记录、依赖和恢复,成本优化不能造成审计/业务中断。
异常处理记录包含检测时间、预期/实际、影响范围、负责人、临时控制、根因、成本分解、业务终态、永久修复、验证和关闭人。18,000 工单的重试事故不是只退供应商费用:还要计告警/排查/部署工时、额外复核、队列延迟和一次回归;若供应商返还信用,信用单列,不能倒删使用与可靠性事实。
储备与压力场景分开。48万元是预算中可控的响应与修复预留;“关键工单错误派单造成大范围损害”缺少可靠概率,就在风险表列最坏影响、现有控制、保险、合同与停止决定,不能塞进基础总体拥有成本中伪装精确。董事会可以因尾部风险拒绝项目,即使基准情形便宜。
直接、共享与未分配成本需要公开规则
| 成本 | 分配方法 | 原因/限制 |
|---|---|---|
| 模型调用 | 工单/应用/任务标签(直接) | 重试/评估分开,状态未知入队 |
| 检索/查询 | 尽可能直接查询源/任务 | 共享索引构建按变更/使用代理 |
| 网关/可观测性 | 基础中心 + 按尝试次数/追踪变量 | 内容保留类别影响成本 |
| 平台/值班 | 固定基础 + 事件/使用代理 | 不能全按令牌惩罚低量高风险任务 |
| 人工复核 | 工单×实际分钟数×角色费率 | 抽样置信度已披露 |
| 治理/评估 | 变更/风险/任务(直接 + 共享基础) | 新配置承担增量回归 |
| 提交/折扣 | 合同付款 + 使用分配(分开) | 未使用/折扣规则可见 |
分配层级为业务服务→应用/工作流→任务→环境→工单/尝试次数→成本中心。直接先分,共享按因果最接近代理,仍无法合理分配的保留未分配并有调查负责人;不要为了报表好看按人数或预算强塞。
分摊显示先运行两个月,让园区纠正负责人/标签和共享规则;分摊由财务决定,不能让收费激励团队改用个人账号或隐藏AI。共享平台的基础可中央资助,变量分摊显示;规则版本改变要桥接旧/新,否则单元趋势被会计方法伪造。
目标分配覆盖率 98%,不是价值KPI。若98%都按错误业务对象分配仍无用;每月抽样发票→提供商请求→追踪→尝试→工单→最终成果,验证链路。未分配超过2%或关键任务缺标签触发修复,不由网关猜标签。
64万元共享平台的分配示例:24万元身份与网关基础能力由中央产品池承担;26万元随尝试次数和追踪增长,按各任务有效尝试占比分配;10万元高保留审计只分给使用该策略的任务;4万元无法归因,进入调查队列。规则比“全部按词元”复杂,但能解释低量高风险任务为何承担审计、批量低风险任务为何承担变量流量。
新消费者加入时,共享固定成本的单位分摊会下降,不等于本任务工程优化;报表同时展示总共享池、分配驱动因素与本任务份额。某部门退出时份额上升,也不应马上指责其用量。分配变更记录把组织结构效应与真实技术效率分开。
三年总体拥有成本逐年重算量、人工、价格、变更和退出,不把首月运行速率乘36
| 三年期场景 | 年份 1 | 年份 2 | 年份 3 | 总计 |
|---|---|---|---|---|
| 基准限定成本 | 2,227.2万元 | 2,449.9万元 | 2,694.9万元 | 7,372.0万元 |
| AI设置与变更 | 342.0万元 | 85.0万元 | 95.0万元 | 522.0万元 |
| AI周期性运行 | 1,465.2万元 | 1,467.5万元 | 1,532.0万元 | 4,464.7万元 |
| AI满载总体拥有成本 | 1,807.2万元 | 1,552.5万元 | 1,627.0万元 | 4,986.7万元 |
| 情境缺口 | 420.0万元 | 897.4万元 | 1,067.9万元 | 2,385.3万元 |
第2年业务量158.4万张,符合条件126.72万张;复核降至1.8分钟,人工仍为7.2分钟,失败降为符合条件工单的3.5%,返工为6分钟,人工约965.6万元。模型用量增加10%、单位价格下降8%,158万元×1.10×0.92≈159.9万元;再加检索46万元、平台70万元、运维108万元、评估76万元、事件42万元,运行成本约1,467.5万元。
第3年业务量174.24万张,复核1.6分钟、人工7.2分钟、失败率3%且返工6分钟,人工约998.0万元;模型168万元、检索51万元、平台74万元、运维115万元、评估82万元、事件44万元,运行成本1,532万元。业务量增长使总成本上升,但单位成本可能改善,不能仅凭支出上升判定失败。
第3年95万元变更成本包含一次模型与检索迁移和退场准备,不是完整的最终退役现金;合同到期、数据导出与删除、记录保留、凭证撤销和人员重新分配另有范围。预测滚动更新,已经发生的设置成本属于沉没成本,但不意味着继续扩张必然正确。
第2年人工成本可逐式复算:126.72万×1.8÷60×120元=456.192万元;316,800×7.2÷60×120元=456.192万元;126.72万×3.5%×6÷60×120元=53.2224万元,合计965.6064万元。第3年为139.392万×1.6÷60×120元=446.0544万元,348,480×7.2÷60×120元=501.8112万元,139.392万×3%×6÷60×120元≈50.1811万元,合计约998.0467万元。
预测表不会为了对齐预算而提前四舍五入中间驱动因素;计算层保留原值,展示层用三位小数,因此明细和总计可能有1,000元以内的显示差。财务对账使用原始值并设置容忍范围,超过容忍才调查。每年数量、资格、分钟、失败、费率、模型单价、共享规则和变更清单都可替换,禁止把首年运行成本机械复制到后两年。
敏感性和预测偏差用于寻找决定翻转点
| 变量变更 | 首年影响 | 解释 |
|---|---|---|
| 模型价格下降30% | 减少47.4万元 | 仅占1,807.2万元总体拥有成本的2.6% |
| AI复核从2.1增至3.0分钟 | 增加17,280小时,即约207.4万元 | 界面、证据与质量占主导 |
| 符合比例从80%降至60% | 人工增加,AI用量减少;必须联动重算 | 无法保持模型账单与工时恒定 |
| 失败率从5%升至10% | 增加6,720小时,即约80.6万元,并增加调用 | 失败敏感性显著 |
| 数量下降40% | 固定设置与平台费用分摊到更少单元 | 现金与单位成本视图出现分歧 |
| 第2年模型迁移 | 增加评估、集成、培训与并行运行 | 不会被词元费率捕获 |
复核增加0.9分钟的计算为115.2万×0.9÷60=17,280小时,按120元/小时计算为207.36万元,远高于模型价格下降30%带来的47.4万元。优化顺序因此应先看证据可读性、错误类型与流程,而不是只谈提示词少几个词元。
合格下降时人工增加、模型调用减少、质量/价值范围也变,不能只在线性表改一格。团队用驱动模型联动数量×资格×尝试×调用×复核/失败分钟数×费率;低/基础/高分别保存相关假设,蒙特卡洛不是必需,透明因果比复杂随机数更重要。
盈亏平衡还需容量实现。即使三年情景缺口为正,如果104,000小时没人重新分配,现金只有外包/招聘避免部分;若业务量增长吸收容量,价值表现为不用新增人;若等待下降带来真实合同/满意度结果,另建归因。不得把三种同时全额相加。
驱动因素模型的空白模板只有九行:业务量、符合比例、每个符合对象的尝试次数、每次尝试的调用次数、合格率、复核分钟、人工分钟、失败分钟,以及各自费率或单价;填好示例后再连接固定设置、共享运行、变更和退出。每个驱动因素设低、基础、高三种情境和相关方向,例如上下文增长通常同时影响调用、延迟与复核,不能把它们当成互不相关的小格。
决策翻转点比“最可能值”更有用:复核达到约3.92分钟时,新增人工约419万元,会吃掉首年420万元情境缺口;模型单价即使降到零,最多直接改善158万元,仍不能补救更长的审核时间。产品团队因此把证据界面与错误切片列为首要控制,而不是只谈议价。
月度预测偏差必须解释驱动因素
| 月度基准预测 | 预测 | 已观测/已计提 | 差异原因 |
|---|---|---|---|
| 模型 | 13.17万元 | 15.54万元 | 上下文更长,加上重试循环 |
| 检索 | 3.50万元 | 4.90万元 | 重复重新索引和缓存未命中 |
| 平台 | 5.33万元 | 5.50万元 | 在范围内 |
| 运维与支持 | 8.50万元 | 11.80万元 | 新接入工单被低估 |
| 人工 | 81.60万元 | 101.40万元 | 复核实际2.57分钟,高于2.1分钟 |
| 持续评估 | 6.00万元 | 6.60万元 | 新增紧急类别 |
| 事件储备 | 4.00万元 | 4.00万元 | 已计提情境准备金 |
| 总计 | 122.10万元 | 149.74万元 | 增加27.64万元,即22.6% |
差异拆数量、单元价格、组合、尝试次数率、复核时长、一次性时机和分配方法。上下文增长是产品输入变化,重试是缺陷,支持是采用成本,三者负责人不同;不能统一要求“少用模型”。修复后预测向未来更新,原预算差仍保留,不重写历史制造准确。
阈值示例:月总差>10%、任何关键任务单位成本>20%、未分配>2%、复核分钟连续两周越门或提供商调用/工单突升即调查。自动硬性上限只阻止明确循环/未授权沙盒;不能在高后果工单处理中途因预算关掉人工或审计。
调查先保存差异记录,再行动:预期/实际、差额金额/比例、用量 - 价格 - 组合 - 重试 - 复核 - 分配分解、受影响业务对象、负责人、临时容量/队列、根因、预计恢复和预测变更。若观测上升来自计划中新增园区,标“正常但需调预测”;若来自重试循环,立即控制;若只是共享规则改变,重做桥接而不要求用户少用。
人工实际101.4万元对应的月复核时间约2.57分钟,只是聚合信号。进一步切片发现新上线园区为3.4分钟、成熟园区为2.2分钟,根因是地址证据藏在折叠区域;界面修复后重测,而不是把所有园区的复核指标压到同一数字。差异说明把修复成本和预期回收小时写入下一版预测。
用分阶段资金和单笔工单验证成本模型
分阶段审批把未知变成有上限的学习
| 资金关口 | 容量/范围 | 放行证据 | 停止/重新预测 |
|---|---|---|---|
| 发现 | 62万元 | 基线、任务、数据与负责人 | 没有可衡量任务或人工边界 |
| 构建与评估 | 增加238万元 | 配置、关键失败、负载与集成 | 质量、数据或行动门失败 |
| 5%小流量 | 月度上限35万元 | 单位成本、人工与支持实际值 | 复核、95分位或关键失败越门 |
| 受控25% | 累计上限120万元 | 分配、降级与价值使用 | 差异未解释或人工过载 |
| 有界生产 | 滚动季度预测 | 两个业务周期和负责人收益 | 重新预测、调整规模、保留或退出 |
上限包括外部现金与内部工时,不只发票。每个放行门槛预先写必须回答的问题、可逆产物和退场;发现复核时间是预测两倍时先修UI/质量/范围,不用“项目已投入很多”继续扩大。沉没成本与未来期望值分开。
储备有用途与释放权。事件储备不能拿来买新功能,用量储备不能掩盖重试缺陷,未用上限不自动滚入下期。预算负责人、产品、财务、工程与业务共同签重新预测,防止技术团队单方面用低账单宣布成功。
每个资金关口都有现金上限、内部小时上限、日历截止和可形成的资产清单。例如发现阶段除62万元外,最多占用业务、数据与法务3,200小时;超过时不能把员工时间藏起来,而应缩小范围或重新审批。放行门复核展示已花、已承诺、剩余、预测至完成与不可回收项,防止“预算还有”替代成果判断。
停止时做关闭记录:取消未签合同、关闭试用资源、归还数据副本、撤临时权限、保存必要基线/评估/决策、释放人员与剩余预算。下一项目可复用的是合法、版本清楚的模板和样本,不是带客户资料的任意快照。
一张工单怎样穿过整本成本账
工单 MT-2048来自地下车库,地址字段旧编码、描述“泵一直响,地面有水”,照片缺时间。本地规则判断为合格;检索返回泵房手册和历史工单,模型第一次把它标普通噪音。验证器发现“积水+泵”触发潜在升级,与模型类别冲突,草稿不进入派单;审核员查看原图/地址映射,7分钟后标为高优先排水检查。
ticket MT-2048 / one business object
baseline/data: old location code -> mapping lookup
attempt-1: retrieval 2 calls + generation 1 call -> provider/infra cost
validator: water+pump conflict -> AI fail, no dispatch
human: mandatory review + 7-minute failure rework -> labor cost
support: mapping defect ticket -> data/operations cost
outcome: high-priority manual disposition, single final state
follow-up: case enters critical regression; mapping source owner fixes version
no successful-looking rewrite deletes attempt-1 or its cost
| 账目条目 | 分配 | 原因 |
|---|---|---|
| 供应商3次调用 | MT-2048的第1次尝试 | 实际计费用量 |
| 检索与查询 | MT-2048的资料集合 | 任务直接变量 |
| 验证器与平台追踪 | 共享成本加尝试驱动 | 通用控制消耗 |
| 标准复核 | 工单×分钟×角色 | 强制人工环节 |
| 额外7分钟返工 | 故障类别 | 不按平均值摊消 |
| 映射缺陷支持 | 数据源负责人 + 任务 | 根本原因成本 |
| 新回归案例 | 持续评估 | 变更/故障预防 |
若只看最终高优先处置正确,系统会被记为成功;若只看模型第一次错误,又会忽略验证器/人工按设计保护了动作。成本与质量分别记录:AI 路径失败、系统在分派前捕获、业务结果手动完成。这样才能判断修模型、修地址数据、调验证器还是保持人工最划算。
MT-2048的成本卡不能凭教学金额假装精确,真实系统会把当月供应商单价分摊到3 调用,检索按查询/存储驱动,平台按尝试次数/追踪,人工按实际标准复核+7分钟失败返工,映射缺陷按源负责人工时,新增回归案例按评估变更记账。所有行指向同一工单但避免重复:标准复核已包含的分钟不能再作为失败全额计算。
案例关闭后一周检查修复效果:地址映射版本更新、同类200张影子案例无新冲突、模型调用/工单恢复、人工分钟下降且严重仍为0。只有这些记录齐全,映射支持动作才关闭;一次正确结果不是永久修复证据。
成本与价值必须使用一致分母并由固定节奏复核
| 结果 | 基线 | 目标/观测 | 变现规则 |
|---|---|---|---|
| 限定人工工时 | 185,600 | 81,600 场景 | 容量优先; 仅在实现时产生现金 |
| 高优先级95分位分诊时间 | 42分钟 | 目标18分钟 | 报告服务结果;只有证据充分时才货币化 |
| 可归因的返工 | 96,000张 | 目标低于55,000张 | 验证相同定义与样本 |
| 合格最终状态 | 现有流程 | 全部144万张均可追踪 | 不能删除故障与人工状态 |
| 外部承包商需求 | 计划招聘或外包 | 若已有记录则可验证避免 | 合同或预算变更时才成为现金收益 |
| 关键分派错误 | 基线与 AI 分别 | 零容忍 | 不可为降低成本而交易 |
价值负责人每项写反事实、测量窗口、数据源、混淆因素和现金/容量/风险类别。104,000小时不能同时算工资节省、避免招聘和新增业务收入;先分配去向,再只计可证明部分。等待下降可能受季节、人员和工单结构影响,用对照区域/时间与同类分层,不把全差额归AI。
总体拥有成本上升不必然失败:业务量增长且成本/合格工单下降、质量/SLO改善可能合理;总体拥有成本下降也不必然成功:靠减少复核、删除日志或把工作转给未计价员工会制造风险。复核同时看单元、结果、边界和绝对支出。
收益登记册逐项保存基线/反事实、目标、观测、对照或调整、开始/结束、责任人、现金/容量/风险类别、是否已进入其他收益和置信。18,000小时避免外包只有在原合同/招聘计划可见且确实取消时转现金;45,000小时吸收增长则用“未新增同等人员且SLO不降”证明,不再乘一次工资加入收益。
风险降低如严重派单错误从某值降为0,不强行货币化也能成为硬门;若组织有历史赔付/保险数据,可由风险/财务按同范围建立范围。没有证据时以事件率和最坏后果报告,避免成本表为了显得完整制造权威小数。
每月关账、每季重估、每次变更重开相关成本门
月度由财务与云成本运营对账发票和分配,平台解释用量、重试与采购承诺,业务解释数量、组合、复核与结果,产品更新预测与积压,安全与评估团队报告变更和事件。争议项保留未分配状态与置信度,不能在关账会上临时编一个比例。
| 节奏 | 问题 | 决策 |
|---|---|---|
| 周运营 | 呼叫/工单、不通过、复核队列、异常 | 停止循环/修复数据/支持 |
| 月度结账 | 现金/应计/分配/单位/差异 | 对账/重新预测/资金 |
| 季度产品复核 | 总体拥有成本、结果、容量、价值与变更 | 扩展、维持、重新设计或退出 |
| 合同里程碑 | 提交/速率/SLO/变更/导出 | 续订/重新谈判/替代 |
| 配置变更 | 评估/集成/培训/迁移成本 | 批准/金丝雀/回滚 |
| 年度规划 | 基线/反事实/人员/资产 | 投资组合优先级 |
单元定义和分配规则也有版本。若从成本/呼叫换成本/已关闭工单,历史趋势不能硬拼;用过渡期同时计算。人工费率变化、组织重组、共享平台扩消费者都保留生效日,防止报表变化被误读为工程优化。
月度关账包固定包含十二项:范围/版本、业务需求、质量/严重、人工分钟/队列、提供商对账、直接/共享/未分配、现金/应计、单位成本、预测偏差、异常/事件、容量/价值和待决变更。负责人先在会前签数据,会上只处理决定与争议,避免每月重新定义指标。
季度精读一批失败工单和一批正常工单,核成本记录是否与真实工作一致。若员工在表外用聊天工具补写、主管额外复核或数据团队手工改地址而没有计时,总体拥有成本发生“影子劳动”;修仪器化与流程,而不是责怪员工破坏漂亮单位成本。
退场与迁移是总体拥有成本尾部:最后一次调用停止后,成本和责任仍未结束
模型切换需要旧/新评估、适配器、双运行或分群组、培训、合同重叠、队列排空和回滚;知识源迁移需权限/版本/删除验证;退出需导出提示/配置/评估/用量/结果,撤凭证/租户/应用访问,按规则保留/删除内容与审计,关闭提交和支持。
| 退出项 | 成本/证据负责人 | 完成证明 |
|---|---|---|
| 业务连续性 | 产品/运营 | 手动/替代测试, 队列已关闭 |
| 数据/导出/删除 | 数据/供应商 | 导出验证/删除/保留记录 |
| 身份/凭证 | IAM/平台 | 撤销 + 负向访问测试 |
| 合同/提交 | 采购/财务 | 最终发票/终止/无自动续订 |
| 模型/索引/运行时 | 模型/数据/平台 | 注册表状态/缓存/索引已移除 |
| 记录 | 法律/安全/业务 | 所需证据可访问且已限定 |
| 人员/容量 | 管理层/人力资源 | 负责人/支持/值班重新分配 |
退役储备不必假装精确:列低/基础/高与触发,例如供应商是否提供批量导出、合同是否重叠、资料删除复杂度。只比较三年运行不计退出,会偏爱锁定更重的方案;反之把全公司归档成本都塞给一个任务也不公平。
退出后仍可能有残余费用:最低承诺到期、保留审计存储、合同争议、旧模型回归记录、员工转岗培训和备用人工临时加班。退役清单给每项负责人、预计/实际、可终止日和完成证据;只有凭证负向测试、账单归零/已知尾款、数据处置与业务连续性都通过,服务注册表才标已关闭。
交付一套能追溯每一元成本的材料
| 产物/模板 | 最低内容 |
|---|---|
| 总体拥有成本范围与基线 | 任务、周期、包含、排除、反事实与负责人 |
| 成本分类法与账目 | 生命周期、层级、直接、共享、现金、内部、固定与可变 |
| 计量字典 | 工单、尝试、调用、结果、状态和编号连接 |
| 人工时间研究 | 角色、任务、切片、分钟、费率、返工与置信度 |
| 分配策略 | 层级、标签、共享代理、未分配、折扣与版本 |
| 单位成本转换 | 从技术单位到业务单位,并带质量、人工与故障 |
| 三年驱动模型 | 数量、组合、价格、分钟、变更、退出及低中高情境 |
| 预测与差异 | 预期、实际、量价组合、根本原因与行动 |
| 异常与事件账目 | 检测、受影响对象、成本、修复与恢复 |
| 资金放行门 | 容量、内部工时、证据、停止与重新预测授权 |
| 收益登记册 | 反事实、现金、容量、风险、归因与防重复计算 |
| 迁移与退役 | 并行运行、导出、删除、撤销、合同与人员 |
FinOps框架的成本分配方法说明,可用账户、标签和派生元数据分配直接与共享费用,并要求共享规则透明;单位经济方法区分资源效率单位与业务单位,并逐步纳入满载成本;预测方法强调结合历史、计划变化和生命周期维护预测;异常管理则强调按细分类别发现、归因和处置异常。NIST人工智能风险管理框架操作手册讨论记录测试方法与表现、故障成本、持续领域反馈和独立测试等行动。本文据此把评估、失败和人工反馈纳入生命周期,但案例费率与门槛不是标准规定。所有来源核验于2026-07-21。
- FinOps Framework:Allocation
- FinOps Framework:Unit Economics
- FinOps Framework:Forecasting
- FinOps Framework:Anomaly Management
- FinOps Framework:Planning & Estimating
- NIST AIRC:AI RMF Playbook
今天选一个已定义任务,不从提供商计算器开始。先量业务对象、当前分钟/返工和单一最终结果;把设置、运行、人工、失败、变更、退出全部列入成本树,再建立工单→尝试→调用→结果的计量过渡。分别交付现金、满载和容量/价值三张表,用低/基础/高与阶段容量批准下一步。只有成本能复算、质量/边界不被削弱、释放容量有真实去向且差异有人处置时,才把试点扩大。