先看结果:不是把 AI 提示写长,而是让 60 条真实文本有了可重复裁决

独立 AI 运营顾问程微的品牌文档只有 6 个词:“专业、真诚、有温度、简洁、自信、友好。”同一份提案交给 3 个 AI 会话,分别写成咨询公司腔、社交媒体鸡汤和过度讨好客服。网站说“我们赋能企业释放潜力”,邮件说“亲亲别担心”,事故通知说“系统出现了一点小状况”,没有一种像她本人。

她从网站、提案、文章、客户邮件、上手说明、催款和事故记录中抽取 148 份材料,筛出 42 份“最像”、31 份“绝对不像”和 19 份高风险边界样本,重建为 4 条品牌声音原则、6 类情境语气、37 对正反例和 12 项编辑检查。

验收 旧形容词提示 新语言系统
60 条冻结测试通过 14/60=23% 52/60=87%
三位审阅者直接一致 26/60 48/60
重大事实强度漂移 9 0
事故文本淡化责任 4/6 0/6
催款邮件因“温暖”缺少动作 5/8 1/8
旧形容词提示与新语言系统在冻结测试、审阅一致、事实漂移、事故责任和催款动作上的对比
新系统的变化不只是“更像本人”,还包括事实、责任和行动都更稳定。五项同时覆盖正常和压力情境;数字来自一次教学冻结评测,不能推出品牌系统的通用效果,也不要求 8 条人工边界样本自动通过。

8 条未通过样本被有意保留为人工边界,没有为了凑出 100% 通过率继续堆规则。本文人物、材料和评测数字均为教学案例;公开指南只用于支持平实语言、品牌声音与情境语气的区分、用户需要和可访问性原则。

先分清品牌声音、情境语气、文字风格和事实约束

回答的问题 稳定程度 例子
品牌声音 我们如何判断、怎样对待读者 跨情境稳定 先说明边界,再给行动
情境语气 此刻读者处于什么状态,表达力度怎样变 随情境变化 事故时更直接、少幽默
文字风格 拼写、标点、术语与格式怎样统一 规则较稳定 数字、日期、标题格式
真实性约束 这句话可否被证据支持 每条主张单独判断 不把试点结果写成普遍效果
语音、语气、风格和真实性约束四层分别回答的问题、稳定程度及错误替代关系
四层分别回答不同问题,不能用“句子短”替代真诚,也不能用“听起来自信”越过事实边界。这是编辑责任的划分,不表示边界永远清晰;段落顺序若改变限定范围,仍需同时回到品牌声音检查和事实检查。

“短句”是文字风格或可读性选择,不自动产生真诚;“我们理解你的感受”可能语气温和,却未必有证据知道读者感受;“一定解决”听起来自信,但违反事实边界。

英国政府公开指南给出一个有用区分:品牌声音跨产品和服务保持一致,语气根据渠道和用户需要调整。程微借用了这套结构,但没有照搬政府机构的表达方式。

抽象词为什么失效:同一个“专业”至少有五种互相冲突的实现

AI 不知道“专业”对程微意味着什么,会从训练数据里选择常见代理:长句、被动语态、术语、保证感或咨询框架。五位同事可能也各自理解不同。

抽象词 可能实现 A 可能实现 B 对程微的冲突
专业 使用行业术语 把复杂事讲清楚 她选择清楚,必要术语再定义
真诚 分享个人感受 坦白证据与未知 她选择后者,不表演脆弱
有温度 多说请、谢谢、理解 减少读者不确定和额外劳动 她选择具体照顾
自信 不使用可能 明确建议及成立条件 她拒绝无条件保证
简洁 尽量短 删除不帮助行动的信息 风险边界不能为短而删
专业、真诚、有温度、自信和简洁的冲突实现、程微选择及禁止代理
同一个形容词可以导向完全相反的写法,真正有用的是明确选择哪种行为。这些裁决只定义本教学品牌,不能当成所有“专业”文本的统一标准;其他品牌必须用自己的材料重新分析。

形容词不是完全无用,可作为命名层;但每个词必须展开为行为、非行为、情境、正例、反例和检查问题。无法通过文本观察到的价值,不能直接控制生成。

从真实材料采样,不让创始人只挑自己记得的好句子

148 份材料覆盖 12 个月,并按渠道、风险和读者状态分层:

资料 数量 读者状态 高风险样本
研究文章/指南 28 主动学习 6
提案与服务页 26 比较与购买 8
上手与任务说明 24 首次行动 5
普通客户邮件 32 协作与等待 4
催款/拒绝/范围变更 20 可能防御 9
错误与事故沟通 18 焦虑或受损 18

她先独立标“保留、修订、拒绝”,再写理由,避免先发明原则后只找支持例。42 份保留材料并非全篇都好:每条例子精确到句子和语境;31 份反例也保留失败原因。

样本会记录结果,但不能把客户迅速回复自动归因于文风。回复可以帮助寻找候选材料,最终仍要看文本是否准确、可行动、尊重边界。没有回复的事故通知也可能值得保留,因为它完整说明了影响与处置。

用“为什么保留/拒绝”编码,找稳定判断而不是高频用词

初始编码有 29 个理由:先给结论、限定范围、展示计算、承认未知、明确负责人、替读者完成下一步、过度道歉、隐藏动作、抽象收益等。两轮合并成 9 个语言决策,其中 4 个成为品牌声音原则。

决策代码 保留样本 拒绝样本 判定
承诺前定界 31/42 3/31 核心原则
形容词前举证 28/42 5/31 核心原则
带负责人的行动 34/42 7/31 核心原则
尊重读者自主权 25/42 6/31 核心原则
短句 26/42 12/31 风格倾向,不是品牌声音原则
第一人称故事 8/42 5/31 情境性做法
148 份材料经过分析集合、29 个保留拒绝代码和 9 个语言决策收敛为四条核心语音原则
四条原则不是凭空想出的,它们都能解释保留样本与拒绝样本之间的稳定差异。42、31 和 19 是筛出的分析集合,不是互斥分区或质量比例;早期保留材料也不能自动成为品牌标准。

高频不自动成为原则。短句在保留与拒绝样本中都很常见,只能说明形式;“承诺前定界”却能解释销售、教学和事故中的同一种判断。

反例也有价值。3 条保留边界不足的样本提醒:早期材料标准曾不同,不能把创始人写过的每句话都称为品牌声音。

四条品牌声音原则要写清行为、目的和误区

品牌声音原则 可观察行为 目的 不是
先边界后承诺 写适用范围、未知与停止条件 让读者正确判断 处处加免责声明
用证据代替姿态 给数字、记录、例子和来源 建立可核验信任 每句都堆引用
给下一步也给责任人 动作、负责人、时间与失败分支 减少读者协调成本 强迫读者立即行动
尊重读者判断权 提供选项、取舍和拒绝路径 不以焦虑操纵 对所有选项中立
四条语音原则的可观察行为、目的、常见误解,以及真实性安全性优先的冲突顺序
原则之间冲突时,事实与安全先于“像不像品牌”。这套优先级用于程微案例的编辑裁决,不替代法律、行业或事故程序;风格一旦降低准确或阻断行动就必须让位。

原则之间可能冲突。事故通知为了速度先写影响与动作,完整证据稍后补;销售页为简洁不列全部方法,但关键限制不能藏到页脚。冲突由情境语气矩阵和优先级规则裁决。

程微把优先级固定为:真实性与安全性 > 读者行动 > 尊重 > 品牌独特性 > 优雅。若一句更“像品牌”却降低事实准确性或阻断行动,就必须放弃这种风格。

原则卡要包含正例、近似反例和失败解释

原则“先边界后承诺”的示例:

类型 文本 判定原因
正例 这套检查适合有人工复核的研究草稿;涉及医疗、法律或自动外发时,先停在人工审批 边界改变行动
近似反例 本文仅供参考,请根据实际情况酌情使用 有免责声明但无具体边界
反例 任何团队都能在一周内获得稳定结果 无范围与证据
过度执行 每一段都重复“可能、也许、不保证” 风险词替代清晰判断

近似反例最重要,因为 AI 容易学表面。它看到“边界”后会在每篇结尾加万能免责声明;规则应要求限制靠近受影响主张,并说明它怎样改变读者行动。

每张卡至少放入 3 对来自不同渠道的例子,也要提醒一种反向误用:有些操作说明不需要反复写不确定性,直接给步骤反而更尊重读者时间。

情境语气跟随读者状态,不跟随平台刻板印象

“社交媒体更活泼、邮件更亲切”太粗。即使都在邮件里,欢迎信、逾期提醒和安全事件也需要不同语气。程微用“读者状态 × 后果”建立矩阵:

情境 读者需要 节奏 情感力度 禁止
学习复杂方法 理解结构与边界 逐层、允许长 好奇但不煽动 夸张标题
比较服务 清楚范围、成本和取舍 直接、可扫描 自信且克制 制造错过焦虑
首次上手 完成第一步 短、一次一动作 鼓励但不幼态 连续庆祝
普通错误 知道发生什么与怎样恢复 结论在前 平静、负责 责怪用户
严重事故 影响、处置、更新时间 最短路径 严肃、无幽默 “小问题”淡化
催款/拒绝 金额、依据、选择与期限 明确、有退路 尊重但不含糊 过度道歉

语气变化不改变品牌声音。严重事故仍然要给证据和负责人,只是先给已经确认的影响;催款仍然尊重选择,但不会把付款日期藏在温暖寒暄后面。

每份文本先标明“使用情境”,AI 才能选择语气。只给一句“写得温暖一点”,会让模型把所有负面信息都写软。

她没有使用“活泼度 7 分”这种假精度,而是沿着 5 个可解释维度做选择:直接性、信息详略、情感表达、紧迫感和选择空间。严重事故的直接性与紧迫感高,情感修饰低,信息先少后多;学习文章需要较多详情、较低紧迫感和较大的选择空间。催款要求直接,但仍要给出协商付款日期的真实选择。

维度 选择依据
直接性 先给背景 先给决定/影响 读者是否需立即行动
详情 只给最小状态 展示证据与推理 风险、知识与时间
情感表达 中性 明确承认影响 读者是否受损且事实已知
紧迫感 无时限 明确期限和后果 延迟成本是否真实
选择空间 单一路径 多个可行选项 是否存在真实选择
学习、比较、上手、错误、事故和催款拒绝六类情境在直接性详情情感紧迫感与选择空间上的差异
同一个品牌在六类情境中会改变表达力度,但不会改变对事实和读者的基本态度。高低只是六类教学情境的编辑语言,不相加为语气评分;具体文本仍受事实、风险、渠道和读者研究约束。

这五个维度只是编辑讨论语言,不能相加成一个“语气分”。高紧迫感不等于使用大写和感叹号,高情感表达也不等于替读者命名感受;每个选择最终都要落到具体文字上。

“温度”是替读者减少不确定与劳动

旧错误信息:“哎呀,系统开了个小差~请稍后再试!”新文本:“文件没有上传。我们没有保存这次内容。请检查网络后重试;若仍失败,把错误编号 U-184 发给我。”后者没有可爱词,却更照顾读者。

有温度的动作 文本行为 无温度的替代
说明是否保存 “草稿已保留,可从第 3 步继续” “发生未知错误”
承担系统责任 “我们没有正确处理文件” “你的文件无效”
减少重复劳动 给错误编号和已知状态 要求重新描述全部过程
给现实选择 延期、分期、取消路径 只说“请尽快”
承认影响 “这会延迟今天的交付” “带来不便,敬请谅解”

礼貌词可以使用,但不能代替信息。连续写三个“非常抱歉”,却不交代影响、负责人和更新时间,是情绪表演,不是负责。

“自信”是让建议强度与证据匹配

程微建立 认知阶梯:

状态 允许动词 例句 禁止升级
观测 记录显示、在本样本中 12 个任务中 9 个在来源核验失败 “普遍如此”
已支持 证据支持、可以确认 当前设置下自动外发已关闭 “永远不会发送”
推断 更可能、最佳解释 版本混入更可能解释数字漂移 “证明是版本问题”
拟议 建议、优先考虑 建议先冻结输入再重跑 “必须这样做”
状态未知 尚未确认、需要补证 备份删除时间尚未确认 编造确定时间

自信表现为知道现在处在哪一层,敢给有条件的建议,也敢说“尚未确认”。删掉所有“可能”,会让品牌显得冒进;给每句话都加“也许”,又会让读者无法行动。

编辑需要检查“所有、保证、从不、一定、显著、证明、最佳”等强限定词。出现这些词时必须关联到具体主张及其证据;证据不足就缩小范围,不能换一个更有气势的同义词绕过。

“专业”先写对象、动作、数字和边界,再决定术语是否必要

旧提案:“我们将通过端到端智能化赋能贵司知识流程升级。”新提案:“先选 2 个每周重复、允许人工复核的研究任务;记录 20 次运行的总耗时、错误和返工,再决定是否自动化。”

抽象名词 追问 改写方向
效率提升 谁的哪段时间,基线是什么 总用时 34→24 分钟,含复核
质量优化 哪种错误、分母和验收 18/20 主张有直接来源
智能升级 哪个动作改了,谁批准 草稿生成后进入人工审批队列
无缝集成 失败、重试和回滚怎样处理 3 个接口、幂等键与失败队列
深度赋能 读者最终能做什么 管理员可暂停、导出并撤回

面对专业受众可以使用术语,但第一次出现时要确认双方理解相同。英国教育部的平实语言指南也强调,语言应适应用户需要和研究发现;确有必要使用专业术语时,应在首次出现时解释。

术语不是身份徽章。若用普通动词能更精确,就不用名词化表达增加距离。

销售文本要容得下“不适合你”

服务页旧句:“无论你处于哪个阶段,我们都能提供量身定制的 AI 解决方案。”新版本先列适合与不适合:有稳定重复任务、愿意记录基线、有明确人工负责人的客户适合;希望无人复核就自动发布、没有资料权限,或要求先承诺收益的项目暂不接受。

销售环节 品牌声音的具体行为 不做什么
标题 描述具体对象和结果 “引领未来”
证明 展示案例口径与限制 只报最好百分比
范围 写交付物、客户责任和不含项 用“全方位”隐藏
下一步 说明通话目的与退出路径 虚假稀缺倒计时
异议 回应证据与取舍 用焦虑压制疑问
拒绝 说明不匹配和替代路径 为成交承诺越界

“尊重读者判断权”在销售里最能被测试:文案是否允许读者得出“不买”仍是合理选择。只有赞美自己、不展示代价的所谓真诚无法验证。

商业主张仍受事实门禁约束。声称节省、效果、典型客户结果或客户评价时,品牌语言指南不能替代证据检查与适用的法律审查。

催款、拒绝和范围变更是压力测试

温暖写法常在需要明确时失效。旧催款:“温馨提醒一下,不知道你是否方便处理之前那张小小的发票呀?”读者不知道编号、金额、到期日和选项。

新版本:“发票 INV-204 金额 2,400 美元,已于 7 月 15 日到期。若已付款,请回复回执;若需要改付款日,请在 7 月 24 日前告诉我可行日期。否则我会从 7 月 25 日暂停下一阶段工作。”

检查 新文本
事实 编号、金额、到期日可核对
操作 付款、回执或提出新日期
选择 给真实协商路径
后果 暂停的时间和范围明确
尊重 不猜测动机,不羞辱

拒绝需求同样先写决定:“这次我不会把自动发送加入试点,因为当前没有撤回与审计证据。”再写原因、替代项和重审条件。把“不”藏在 4 段感谢之后,会增加双方劳动。

错误与事故沟通要按事实时钟更新

事故模板有 6 个字段:发生了什么、谁受影响、现在做什么、客户要做什么、已知/未知、下次更新时间。第一版允许不完整,但不允许空洞。

时间 已知 文本动作
09:10 发现 文件导出失败,范围未知 暂停导出,承诺 10:00 更新
09:42 定位 37 个任务受影响,原件未丢失 给受影响条件与临时路径
10:25 修复 新导出成功,旧链接仍失败 指示重新生成,不说“完全恢复”
14:00 验证 37/37 重建,日志保留 说明验证与剩余未知
次日复盘 缓存键冲突、监控漏报 发布根因、控制措施和负责人
从 09:10 发现到次日复盘的五次事故更新、当时已知事实与对应文本动作
事故通知不是一次写完:事实增加到哪一步,措辞强度才能跟到哪一步。37 个任务与时间点来自教学事故,不是通用响应时限,也不能推出同类故障都应当天解决。

“我们非常重视”没有信息;“小范围波动”在范围未知时是在淡化;“已全面解决”必须有验证口径。事故语气可以严肃,品牌声音仍然可以体贴:明确说明读者是否需要重做,不让他们猜。

若事实更新,旧通知保留时间线,不覆盖成仿佛一开始就知道。信任来自可见修正,不来自从不承认错误。

语汇表要同时保存允许、慎用、禁用和例外

表达 状态 原因 允许例外
赋能、颠覆、引领未来 禁用 无对象与可核验结果 引用并批评该表达
无缝、零风险、保证 证据门禁 绝对主张 真正形式化保证且有范围
我们理解你的感受 慎用 可能假装知道 对方已明确表达且随后给行动
只需、轻松、简单 慎用 低估读者成本 有测试数据与明确步骤
请注意、温馨提示 通常删除 信息层级应由标题和位置承担 法定或安全提示按专业要求
可能、建议、尚未确认 允许 表达证据状态 不得用来逃避结论

禁用表不是字符串替换器。“释放价值”换成“创造价值”依然空泛。自动检查发现问题词后,应要求编辑回答对象、动作、证据和范围,而不是自动替换同义词。

例外必须记录具体语境和批准人。法律文本、客户逐字引语和固定产品名称可能保留平时禁用的词,但发布界面可以补充解释。

正反例只改变一两个关键决策

一对训练样本只改变 1—2 个变量:

情境 反例 正例 变化
证据不足 这会显著提高效率 试点要记录总用时;目前还不能确认节省 强度与下一步
文件失败 你上传了错误格式 系统没有读出这个文件;请转为 PDF 或发编号 F-12 责任与恢复
提案范围 我们提供全流程支持 包含任务选择、20 次评测和交接;不含生产部署 对象与边界
催款 方便时帮忙处理 请在 7 月 24 日付款或回复新日期 动作与选择
拒绝 我们会内部评估 这次不做自动外发;删除演练通过后重审 决定与条件
证据不足、文件失败、提案范围、催款和拒绝五组反例正例,以及每组只改变的裁决变量
每组正反例只改变一两个变量,模型和编辑才知道究竟在判断什么。这些是教学样本,不是可直接复用的模板;最小差异提高可解释性,但不能保证模型学会,也不能保证适合所有渠道。

若正例同时变得更短、更具体、更礼貌,还换掉了事实,模型就不知道该学什么。样本库因此要记录“目标原则”和“改变项”,支持按原则检索。

同一原则要有多种句式,避免模型把“先说明一下”之类的开头误当成品牌标记。至少 30% 的样本应来自错误、拒绝、风险等压力情境,不能让这套指南只会处理顺利状态。

12 项编辑检查分硬门和软判断,不能平均成一个品牌分

检查 类型 失败动作
事实、数字、范围与证据一致 硬性 退回主张复核
安全、法律、权限边界完整 硬性 停止发布
情境与语气匹配 按后果升级 修正情境或重写
读者知道下一步或无需行动 硬性 补充行动状态
未责怪、操纵或假装理解 硬性 重写
4 条品牌声音原则不冲突 依情境决定软硬 记录裁决
抽象名词有对象和动作 软性 具体化
术语为受众所需且已解释 软性 定义或替换
开头直接进入当前任务 软性 删除背景套话
节奏符合复杂度 软性 调整句段
下一步与读者阶段匹配 软性 改为适当选择
禁用表达无未批准例外 硬性 删除或批准
十二项编辑检查分为硬门、按后果升级的情境门和记录修改理由的软判断
硬门失败就停止发布;情境门按后果升级;软判断则必须记录修改理由。三类检查不能横向平均。这套划分来自程微的教学系统,会随行业、渠道和风险变化;它不能替代专业的法律、安全或无障碍审查。

任一硬门失败,都不能用其他项目的高分抵消。软判断通过评论与修改记录完成,不计算“92 分像品牌”。事故通知是否直接是硬门,长文节奏则属于编辑判断。

每项检查都要带上证据范围,审阅者必须指出具体文字;“感觉不像”不能进入最终裁决。

审阅顺序与权限分开。主张负责人冻结“事实版本”和允许的表达强度;风险负责人处理安全、权限和事故边界;品牌编辑只在事实冻结后修改顺序、词汇、节奏与读者动作;发布负责人检查渠道、可访问性和回滚。一个人可以兼任多个角色,但回执仍要记录他何时以哪个角色做了什么判断。

变更 是否回事实检查 是否回品牌声音检查
换同义词但强度不变
把“本样本”删成一般结论
改数字、分母或时间窗
调整段落顺序 视是否改变限定范围
新增下一步或截止日 是,核查事实和商业边界
只修拼写 快速自动检查

这样,“最后润色”就不能越权改变承诺。任何需要重回事实检查的变更,都会使旧的品牌声音审批失效,因为限制词的位置和读者理解可能同时改变。

60 条冻结测试集覆盖正常和压力情境,先评估再改提示

测试集包含:文章 12 条、提案 10 条、上手说明 10 条、普通邮件 10 条、催款或拒绝 8 条、事故通知 6 条、混合边界 4 条。每条都给出事实、读者状态、必要行动、禁止主张和判定理由,而不只提供一份标准答案。

轮次 直接通过 可修订 硬门失败 主要问题
旧形容词提示 14 21 25 空泛、过度安慰、保证
加品牌声音原则 36 14 10 语气仍未分情境
加情境语气矩阵和正反例 49 8 3 催款动作与术语
最终 v1.0 52 8 0 8 条需人工情境判断
从旧形容词提示到最终版本的四轮冻结测试,直接通过逐步上升、硬门失败归零并保留八条人工边界
直接通过从 14 条升到 52 条时,硬门失败也从 25 条降到了 0 条。剩下 8 条是有意保留的人工边界,不是漏做自动化。通过率来自固定样本与三位教学审阅者,不能预测新渠道、新语言或更换模型后的结果。

“直接通过”的定义是所有硬门均通过,且三位审阅者中至少两位认为无需实质性的品牌声音修改。8 条边界样本允许人工决策,不为了自动化而覆盖罕见的高风险情况。

只有冻结测试集后才能调整提示。若看到失败就同时修改样本答案,回归评测就会变成表演。新渠道应先加入 5—10 条独立样本,再决定是否扩充规则。

审阅者分歧要回到原则定义,不能由创始人一句“我喜欢”终结

三位审阅者在最终轮有 48/60 条直接一致,另外 12 条存在分歧。每条分歧都要标明类型:事实强度、情境语气、读者动作、术语、节奏或个人偏好。

分歧 数量 处理
原则定义不清 4 改规则与近似反例,重测全部相关样本
对读者状态理解不同 3 补情境事实,不改品牌声音原则
专业术语是否必要 2 查目标读者研究
个人节奏偏好 2 允许变体,不扩大规则
安全边界 1 由风险负责人裁决,按硬门处理

创始人可以拥有品牌最终权,但裁决要写理由和适用范围。否则系统只是在预测她当日喜好,新编辑无法复现。

一致率也不是唯一目标。三人可能一致接受一条事实错误;事实门独立于品牌声音共识。高一致但错误的系统,比有记录的审慎分歧更危险。

给 AI 的不是品牌宣言,而是当前任务需要的最小情境包

可复制模板
任务:写一封范围变更拒绝邮件
事实:请求内容、合同范围、当前证据、可选替代、重审条件
读者状态:已经投入时间,可能失望;并非事故
品牌声音:先边界后承诺;证据代替姿态;行动有负责人;尊重选择
情境语气:直接、平静、不防御
参考样本:拒绝类正例 02、04;近似反例 03
禁止:暗示已经批准;“内部评估”;过度道歉;虚假紧迫
输出顺序:决定 → 原因 → 替代方案 → 重审条件

情境包只装入与当前任务相关的 2—4 对例子,不把 37 对样本全部塞进去。例子太多会冲淡硬边界,也增加模型模仿某句表面形式的机会。

模型输出还要列出“使用了哪些原则”“有哪些不确定性”“主张强度发生了什么变化”。它不能自报“符合品牌”就通过,仍要依照编辑检查与事实稿逐项比较。

自动检查只能抓可观察信号,不能替人判断是否尊重读者

可以自动发现的问题包括:禁用词、超长连续状态串、强限定词、被动动作没有负责人、连续 3 段使用同一结构、事故文本缺少更新时间、下一步过多、数字在版本间改变。不能自动确认的问题包括:道歉是否足够、幽默是否造成伤害、建议是否尊重读者,以及术语对特定受众是否真的必要。

规则编号 自动检查 级别 人工要回答的问题
L-01 “所有、保证、一定”没有关联具体主张 阻止 证据支持哪个范围
L-02 事故通知没有下次更新时间 阻止 读者何时再获信息
L-03 “请注意”+无具体动作 警告 标题和结构能否承担
L-04 3 个以上感叹号/表情 警告 情境允许吗
L-05 催款无金额/日期/选择 阻止 读者如何完成
L-06 “我们理解”无对方表达 警告 是否假装知道感受

自动检查命中不等于文本必然错误,例外必须记录原因和复核人。没有命中也不等于符合品牌,尤其是冷漠、操纵和逻辑跳跃,很难靠词表发现。

给品牌声音系统做版本管理,旧文本按差异回归

品牌声音系统 1.0 包含原则、情境语气矩阵、词库、示例、编辑检查、测试集和提示组装规则。修改任何一项都要生成变更日志,记录触发问题、证据、修改内容、受影响情境和回归结果。

变更事件 必须重测
新增“尊重读者判断权”原则 60 条全量,防止销售文本变得无结论
调整事故语气 6 条事故+4 条混合边界
禁用新词 搜索全部已发布资产,检查误伤
新增短信渠道 新建至少 8 条短文本样本,不沿用邮件判定
更换基础模型 60 条全量并比较硬门失败差异

旧内容不能批量自动重写。先审高风险、流量高、正在销售和即将复用的材料;稳定的历史文章可以在正常更新时处理。大规模改写可能改变事实、引用与搜索入口,品牌声音的改善不能覆盖这些成本。

每季度查看一次规则效用:过去 90 天从未影响裁决的规则可能只是装饰;频繁出现例外的规则可能定义过宽;同一种失败反复发生,则应修改生成时提供的情境信息或上游任务说明。

跨语言不是把中文原则卡机器翻成英文。直接性、称谓、道歉、法律固定语和句子节奏,在不同语言与地区中表现不同。应保留相同的原则和事实优先级,再为每种语言重新建立受众研究、正反例、术语表与测试集。译者可以改变实现方式,但不能改变“真实性与安全性 > 读者行动”的优先级。

程微先为英文建立 12 条小型回归样本:提案 3 条、上手说明 3 条、拒绝 2 条、催款 2 条、事故 2 条。中文正例只用于说明意图,不能作为英文自然表达的金标准;若英文为了礼貌增加条件句,审阅者要确认决定和期限仍然清楚。不同语言分别编号,例如“中文 1.0”“英文 0.3”;它们共享原则编号,但不共享自动通过结果。

无障碍也不是语气装饰。链接文字要说明目的,标题要传达任务,图片要有等价文本,错误不能只靠颜色区分,技术词首次出现时要解释。一个品牌如果依赖俏皮图像或隐喻才能让人理解,就没有真正把读者行动放在前面。

可以直接复制的品牌语言系统与发布回执

可复制模板
01-voice-principles.md
02-tone-situations.csv
03-positive-negative-examples.csv
04-lexicon-and-exceptions.csv
05-editorial-rubric.csv
06-frozen-eval-set.jsonl
07-prompt-assembler.md
08-lint-rules.yml
09-review-disagreements.csv
10-version-and-regression-log.md

发布回执保存材料编号、使用情境、品牌声音版本、事实版本、参考样本、自动检查结果、硬门结果、审阅人、例外、发布时间和回滚位置。事故沟通与商业主张还要链接独立的风险或主张复核。

资料核验于 2026-07-21,进一步阅读:

真实的品牌声音不是让每句话带上同一种口癖,而是在面对相同取舍时做出可预测的判断:有证据才增强主张,不知道就明确说尚未确认;读者受损时先交代影响和恢复方式,不用可爱语气淡化;需要成交时也展示不适合与退出;需要明确时不把“温暖”变成含糊。形容词可以留在封面,真正让系统运作的是例子、边界、测试和裁决记录。