风险提示的方法
更新于 2026-08-15 · 风险词表版本 2026-08-15c
风险提示是按一张有版本、有日期、公开可下载的词表做的逐词辅助检查。它不是合规判定,不是法律意见,也不代表任何平台的审核。
这一页写清楚三件事:怎么匹配的(这决定了它会漏什么)、词表从哪来(这决定了它可不可信)、怎么更新(这决定了它会不会过期)。
如果你只读一段,读"它不做什么"那一节。
它做什么
- 扫你自己写的东西:商品详情页文案、口播稿、字幕、发给达人的 brief
- 命中时给出:为什么有风险、建议改成什么、这类说法通常出现在哪
- 中英分开扫,并给出另一门语言里对应的说法
- 标注词表版本与更新日期,让你知道这张表是什么时候的
它不做什么
- 不替平台审核,也不预测审核结果——命中与否都不改变平台会怎么判
- 不构成法律意见,不替代你的法务
- 不做语义判断:换个同义词(把「燃脂」写成「热量消耗」)就绕过去了,这一层规则引擎补不完
- 不扫图片、视频画面与语音,只扫文字
- 不覆盖全部市场与全部品类:目前只有塑身 / 功能内衣这一类目做深了
第三条值得再说一遍:换个同义词就能绕过去。「燃脂」写成「热量消耗」它不响,但平台的人工与模型审核看的是这句话在承诺什么。所以这张表的正确用法是"提醒你在承诺什么",不是"过了就没事"。
怎么匹配的
| 语言 | 规则 | 为什么 | 举例 |
|---|---|---|---|
| 中文 | 子串匹配 | 中文没有词边界,任何位置出现都该拦 | 「立刻瘦」在「穿上立刻瘦五斤」里命中 |
| 英文 | 词边界 + 词形展开 | 裸子串会双向失效:既误报(cure 命中 secure)又漏报(词表写 prevents,卖家写 prevention 就漏) | 词表写 `prevents`,能拦住 prevent / prevention / preventing / prevented;`cure` 不会误伤 `secure` |
| 多词词条 | 词间允许空格 / 连字符 / 下划线 | 卖家写 vet-approved 和 vet approved 的概率一样大 | `medical grade` 能拦 medical-grade |
这一层规则扫描逻辑与产品里完全同源:站点上的免费检查器和产品导出的风险清单卡走的是同一份代码与同一张词表,不会出现"网站说没问题、产品说有问题"。
词表从哪来
- 公开的平台广告政策页。本轮打开并核实过的页面列在每一页的「来源」里,含各页自标的更新时间。查不到官方页的地方写"以平台当前政策为准",不编 URL、不编条款原文。
- 中国《广告法》里的绝对化用语与虚假宣传条款——这是中文详情页写法的源头,也是"为什么中文这么写"的解释。
- 我们扫过的商品文案样例里真实出现的写法。词表里的每一条都是有人真的写过的话,不是想象出来的违禁词。
词表没有经过律师审阅(条款草案第 2 节写明了这一点,以及为什么现在还没审)。
级别是怎么定的
| 级别 | 判据 | 典型例子 |
|---|---|---|
| 高风险 | 这句话承诺的事情服饰做不到,或者它把商品拉进另一套资质要求;且没有合理的无风险读法 | 「瘦五斤」「医用」「临床验证」 |
| 待核查 | 同一句话有两种读法,其中一种没有风险;判断依赖上下文 | 「立刻」("立刻发货"无风险)、「小两个码」(尺码建议无风险) |
我们刻意不设第三档"低风险"。三档会让人把"低风险"读成"没事",而这正是我们最不能给的判断。
按族组织,不按字母
词表分成七族,因为改掉一条常常会把同族的另一条写进去。真实的返工都发生在同一族里。
| 族 | 包含 | 最常出现在 |
|---|---|---|
| 量化减重与体型变化 | 9 | 商品详情页标题与卖点、口播第一句 |
| 燃脂、发汗与代谢 | 9 | 商品详情页卖点、主图上的文字 |
| 排毒与生理机制 | 4 | 商品详情页卖点、评论区回复 |
| 医疗、康复与器械 | 12 | 商品详情页参数区("医用级"最常出现在这里)、包装与吊牌 |
| 背书与实证 | 4 | 商品详情页信任模块、达人视频里的口述 |
| 即时性与绝对化 | 5 | 口播第一句、字幕 |
| 尺码与外观描述的灰区 | 2 | 尺码表说明、达人视频里的口述 |
| 药品化宣称(治疗与修复) | 0 | 商品详情页卖点、主图上的文字 |
| 影响皮肤结构或功能 | 0 | 商品详情页的成分解释段、达人视频里的原理讲解 |
| 医疗资质与等级错觉 | 0 | 商品标题、详情页信任模块 |
| 背书与实证 | 0 | 详情页信任模块、达人口述 |
| 安全性绝对化 | 0 | 商品标题、详情页卖点 |
| 即时性与绝对化 | 0 | 口播第一句、字幕 |
误报与漏报分别长什么样
| 类型 | 例子 | 我们怎么处理 |
|---|---|---|
| 误报 | 「立刻发货」命中「立刻」 | 标为"待核查"而不是"高风险",并在词条页写明这个坑 |
| 误报 | 「介于两码之间建议拍小一码」被读成效果宣称 | 同上;尺码族一律"待核查" |
| 漏报 | 「燃脂」改写成「热量消耗」 | 规则引擎补不完,只能靠人工扩表或将来的语义分类。这一条写在条款里,不藏 |
| 漏报 | 图片上的文字、语音说了但字幕没写 | 不在覆盖范围内。只扫文字 |
| 漏报 | 英文词表不检查中文文案,反之亦然 | 跨语言映射目前只做到"给出对应说法",还没做到互相兜底 |
误报比漏报更致命,因为它会让卖家删掉本来能用的话、并且不再信这个工具。所以我们对"能不能确定"要求很高:不确定的一律"待核查",判断留给你。
第二类目(美妆)的状态不一样
塑身衣的判据主要来自我们逐条打开过的平台广告政策页,所以它有逐词页面、有来源链接、有核实日期。美妆不同:它的判据来自监管,而本轮没能直接打开官方页(对方拒绝了本机的访问)。在这种状态下发几十页看起来权威的监管解读,正是这个站点批评别人的做法。
所以美妆的词表已经接进产品(检查器能扫、贴链接能出计划),但站点上只有一页状态页,把限定集中说清楚。解除条件也写在那一页上。
更新流程
- 每次改词表都升一次版本号(当前 2026-08-15c),并写进 /changelog。
- 每一份产出物(页面、导出的计划、风险清单卡、开放数据集)都标注它用的是哪个版本。
- 新增词条必须同时通过两类测试:在真实卖家写法的句子里命中,以及一整段合规文案零误报。
- 没有固定更新周期。政策变了就改,不为了显得勤快而灌水。
常见问题
为什么不用 AI 做语义判断?
当前版本刻意不调用任何模型,理由是可解释与确定性:同一段文案永远得到同一个结果,每一条都能追到词表里的哪一行。语义分类是明确的下一步,但它会带来新的问题——模型说"这句有风险"时,我们无法给出"为什么"和"改成什么",而那两样才是这个工具真正的价值。
词表能覆盖多少?
覆盖不了全部,也不该假装能。它覆盖的是最常见、最容易避免、也最贵的那一类——真实详情页里反复出现的那几十句话。
我可以贡献词条吗?
目前没有提交入口(站点是纯静态的,也不收集任何信息)。数据集是 CC BY 的,你可以 fork 一份自己维护。
为什么开放词表但不开放角度权重?
因为壁垒不在风险词表。风险词表开放出去只有好处:被引用、被核对、被指出错误。角度权重、钩子公式与卖点词库是类目 know-how,那部分不开放。