风险分级总览
| 等级 | 含义 | 处理动作 | 是否升级人工 |
|---|---|---|---|
| Critical | 绝对红线 | 自动拦截 + 拒绝 | 是(必经) |
| High | 高风险 | 打回修改 | 是(建议) |
| Medium | 中风险 | 提示人工复核 | 由人工定 |
| Low | 软性建议 | 进入报告「建议」段 | 否 |
绝对红线(Critical)
任一触发 = 自动 Fail,拒绝发布。 这些是平台合规与品牌底线,不容妥协。
| 红线项 | 触发示例 | 检测方式 |
|---|---|---|
| 出现竞品 | 「对比 X 品牌」「X 牌子也行」 | 关键词 + 竞品词库匹配 |
| 绝对化用语 | 「最」「第一」「国家级」「顶级」「全网最低」 | 关键词 + 模式匹配 |
| 医学/减肥/治病功效 | 「治疗」「减肥神药」「降三高」「预防疾病」 | 关键词 + 模型识别 |
| 未通过星图报备 | 脚本声明合作但无星图单号 | 结构化字段校验 |
| 抄袭 BF 大段复制 | 与品牌 brief 卖点话术完全一致段落 ≥ 50 字 | 文本相似度比对 |
高风险话术清单(High)
触发即打回修改。 不一定违规,但与品牌调性、平台规则冲突。
| 风险项 | 触发示例 | 处理动作 |
|---|---|---|
| 价格暗示违规 | 「直播间专属价」「拍下立减」未在小店透出 | 打回并提示走星图约定流程 |
| 对比贬低 | 「比 X 好吃多了」「完胜 X 品牌」 | 改写为「自我优势」表达 |
| 未授权代言 | 「诺梵 CEO 推荐」「诺梵 CEO 亲自说」 | 删除或改为品牌方授权表述 |
| 数据未标注 | 「销量第一」「全网 100 万好评」无来源 | 补标注来源或删除 |
| 未成年人代言/出镜 | 未成年单独出镜、口播产品 | 转人工复核是否符合品牌要求 |
| 医疗/孕产/过敏相关暗示 | 「孕妇可吃」「过敏体质放心」 | 删除并标注「配料以包装为准」 |
中风险清单(Medium)
提示人工复核。 模型不直接拦截,由人工判断。
| 风险项 | 触发示例 | 备注 |
|---|---|---|
| 模糊绝对化 | 「超好吃」「真的绝了」「天花板」 | 达人风格 vs 平台规则 trade-off |
| 情绪化承诺 | 「保证你回购」「吃完会开心一整天」 | 软性建议改写为体验描述 |
| 场景化竞品 | 「不输 X 牌子」「不输进口」 | 模糊对比也可能误伤 |
| 过度创新 | 「巧克力 + 辣椒」「巧克力蘸醋」 | 取决于品牌创新容忍度 |
低风险(软性建议)
直接写入报告「建议」段,不拦截。
| 建议项 | 说明 |
|---|---|
| 话术自然化 | 用达人自己的语言,避免照搬卖点话术 |
| 节日氛围布置 | 服装/背景/主题有节日感 |
| 分段对话式植入 | 符合星图新规的内容风格 |
| 真实反馈 | 口味提前试吃并给到真实感受 |
拦截流程
Step 1 脚本输入
└── 加载 brief + 规则库版本
Step 2 红线扫描
└── 关键词 + 模式匹配 + 相似度比对
└── 任一命中 → 直接进入 Step 4
Step 3 高/中风险模型识别
└── 语义模型跑全脚本
└── 命中项进入 Step 5
Step 4 红线拦截
└── 报告输出: 决策 = 拒绝
└── 标注: 拦截原因 + 位置(句/段)
└── 改写建议(仅供达人参考)
└── 强制升级人工
Step 5 风险分级输出
└── High → 报告标注: 决策 = 需修改 + 触发项
└── Medium → 报告标注: 需人工复核 + 建议
└── Low → 报告标注: 建议(不影响决策)
Step 6 报告生成 + 升级
└── 高风险自动升级到人工队列
└── 报告归档,决策可追溯应急处理
脚本通过预审并已发布后,若出现以下情况,AI 助手需配合人工进行应急响应:
| 触发事件 | AI 助手动作 | 人工动作 |
|---|---|---|
| 发布后限流 | 标记脚本版本与命中点,输出诊断 | 评估是否因话术触发平台限流 |
| 平台判定违规 | 提取违规字段位置 | 配合修改或重新发布 |
| 被举报下架 | 锁定脚本版本号、保留证据链 | 申诉或下架处置 |
| 达人私下修改未确认 | 触发版本对比报警 | 与达人 / 品牌方沟通 |
AI 助手的红线哲学:「宁可误报,不可漏报。」 红线一旦漏过就是品牌事故;误报最多是人工多花 1 分钟复核。Critical 红线一律不允许「降级处理」。
最后更新