违
违禁词检测与优化
作者:鹿Sir内容创作v1
把待发布文案按「法规合规层→平台规则层→内容质量层」三层结构做发布前质检,输出三栏对照问题清单(违规原句位置→违反条款→合规改法)、风险分级与发布判定,高危时附改后成稿。当用户需要在发布前检测违禁词、做广告法自查、排查平台限流词时使用。触发词:违禁词检测、内容审核、发布前合规检查、广告法自查。
下载量
352
点赞
88
价格
免费
技能文档
---
name: lingyi-forbidden-word-detect-optimize
title: 违禁词检测与优化
category: 内容创作
description: 把待发布文案按「法规合规层→平台规则层→内容质量层」三层结构做发布前质检,输出三栏对照问题清单(违规原句位置→违反条款→合规改法)、风险分级与发布判定,高危时附改后成稿。当用户需要在发布前检测违禁词、做广告法自查、排查平台限流词时使用。触发词:违禁词检测、内容审核、发布前合规检查、广告法自查。
---
# 违禁词检测+优化
## 目的
帮新媒体运营/内容编辑把一份待发布文案跑通一条发布前质检链路:**三层结构逐层扫描 → 逐条三栏问题清单 → 风险分级与发布判定 → 修改记录留痕**,产出一份违禁词检测+优化报告。
这不是「一个违禁词检测器」或「一段合规提示」,而是「先看清这份文案在法规、平台、内容三层各踩了哪些雷、每条雷触犯哪条规则、怎么改才合规、整体能不能发,再决定怎么改稿、要不要发」。可以把它看作发布前的结构化合规体检——把散在经验、对标稿、平台黑话里的感性合规判断,沉淀成逐条可追溯、可改稿、可复检的质检报告。
> 关于违禁词的立场:违禁词库本质是**开放集**——法律明文仅3个绝对化用语(国家级/最高级/最佳),其余都是平台/行业/地方条例引申扩张,《广告绝对化用语执法指南》明确未给完整清单,靠"含义相同或近似"+语境判断。所以本技能**不只做逐词比对**,而是判断"这个词在这个语境里是否真违规、属不属于6类合法例外、怎么改"。纯逐词比对会把"苹果是最好吃的水果"(个人口味主观感受)误杀成违禁,也会漏掉谐音/变体规避。
> 核心信念:合规靠**三层结构**分轻重,判断靠**上下文感知+白名单排除**不靠词库堆砌,改稿靠**三栏对照**(原句位置→违反条款→合规改法)可追溯,留痕靠**修改记录**呼应三审三校。三层结构按"法规合规层(高危必改,被市监局罚)→平台规则层(中危限流,被平台扣分)→内容质量层(低危降权,影响分发)"分清谁会罚你、罚多重。
| 环节 | 耗时 | 扣点 |
|------|------|------|
| **违禁词检测+优化** | 约 1–3 分钟 | 约 26 点(按 token 实扣;**首次成功读取结果时结算**) |
## 输入
**最佳搭配:** 待发布文案(标题+正文+话题标签+配图文案)+ 发布渠道(小红书/抖音/微信公众号/视频号)+ 行业(美妆/食品保健/医疗医美/金融理财/教育培训/酒类/母婴婴幼儿/房地产/普通商品)。
**也有用:** 是否商业推广(是→必查软广广告标记规则)、发布账号资质(医疗/金融/教育内容须持牌)。
调用时附带的所有内容——技能名后的文本、粘贴的上下文,或附加的 `ARGUMENTS:` 行——都视为已给出的回答。直接使用并跳过其已覆盖的部分,不要重复提问。
**手头没说行业?那也可以。** 技能会按普通商品通用法规层先查一遍(绝对化用语/虚假宣传/引证出处等通用红线),标"未指定行业,仅按通用规则查,特殊行业禁词请补行业后复检",后续用户补了行业再挂对应行业禁词子表复检。
**示例调用:** `帮我质检这篇小红书笔记能不能发:史上最神仙的敏感肌精华,7天淡斑立竿见影...#护肤 #美白`
### 输入字段与异常处理
| 字段 | 必填 | 异常处理(缺失/错误时怎么回) |
|---|---|---|
| 待发布文案 | 是 | 缺失→追问要质检的文案(标题+正文+标签);只给品名无正文→追问正文;仅话题标签→追问正文 |
| 发布渠道 | 是 | 缺失→追问4平台之一;给B站/微博/知乎/其他→走通用法规层并提示平台特有规则建议二次核验 |
| 行业 | 否 | 缺失→按普通商品通用法规层质检并提示补行业后复检;给行业→挂对应行业禁词子表 |
| 是否商业推广 | 否 | 是→必查软广/广告标记规则(蒲公英报备/标"广告");否→降级只查合规红线 |
| 发布账号资质 | 否 | 缺失→不假设;医疗/金融/教育内容→追问是否持牌,无牌提示资质性违规 |
收齐必填后进入「执行流程」提交;报告正文**不在本 skill 内拼装**,以服务端返回的 Markdown 为准。
### 质检口径(收齐后用于提交)
收齐后在心里对齐下列口径,再进入执行;缺必填项只追问一轮,不假设:
```markdown
### 质检口径
- 待发布文案:[标题+正文+话题标签+配图文案]
- 发布渠道:[小红书 / 抖音 / 微信公众号 / 视频号 / 其他]
- 行业:[美妆 / 食品保健 / 医疗医美 / 金融理财 / 教育培训 / 酒类 / 母婴婴幼儿 / 房地产 / 普通商品]
- 是否商业推广:[是 / 否](是→必查软广广告标记)
- 发布账号资质:[个人号 / 企业号 / 认证号 + 是否持行业牌照](医疗/金融/教育→追问持牌)
```
## 输出是什么
用户最终拿到服务端**已渲染好的** Markdown 质检报告(任务结果 `markdown` 字段 / 脚本 START–END 区间)。典型会包含:质检口径、三层总览、逐条三栏问题清单、质检结论与发布判定、修改记录留痕;高危时还可能附改后成稿。
发布判定由服务端按风险计数给出(高危≥1 建议修改后再发布;无高危有中危可发布·建议优化;全低危/零问题可发布)。
**skill 侧只做原样交付**:不得按本地模板重写、缩写、补全或二次润色报告。
## 它做什么 / 不做什么
### 三层风险结构(分清谁会罚你、罚多重)
```
法规合规层(高危·必改,被市监局罚钱)
广告法绝对化用语 / 虚假宣传 / 引证出处 / 各行业能说不能说 / 必标项缺失
平台规则层(中危·限流,被平台扣分限流)
平台特有禁词 / 软广广告标记 / 导流 / 诱导互动 / 同质化
内容质量层(低危·降权,影响分发不违规)
原创性 / 标题党 / 错别字 / 标点 / 数字一致性 / 引证出处
```
### 反模式(它不是什么)
- 不是违禁词检测器——不只过词库,要三层结构+上下文感知+三栏改法。
- 不是文案创作/改写代笔——只做质检语境下的合规改写:诊断给改法建议,高危时附改后成稿;非从零创作或风格改写。
- 不是账号/店铺违规诊断——只查单条文案,不查账号历史扣分状态。
- 不是图片/视频画面合规——只查文本,不查画面水印/医疗对比图/AI未标识等视觉项。
### 何时使用
- 文案发布前从零做一次合规自检
- 已被限流/警告后回溯找具体原因
- 跨平台分发前查适配差异(同一文案哪个平台会限流)
### 何时不要使用
- 要图片/视频画面合规——转短视频内容审核类技能
- 要文案创作/改写代笔——转内容创作类技能
- 要发布后舆情监测——转舆情类技能
## 技能工作流
本技能的**质检中间过程**(三层逐层扫描、异常场景判定、改后成稿等)在服务端完成:服务端按固定 SOP 产出结构化 JSON,再经统一渲染逻辑生成 Markdown,通过任务结果的 `markdown` 字段返回。
### 步骤1:获取 API Key
### 步骤2:收集质检信息
### 步骤3:扣点确认
### 步骤4:创建任务并短轮询
### 步骤5:交付质检报告
### 鉴权
1. 有 key → 继续
2. 没有 → 引导 <https://claw.lingyishuke.com/webapps/01claw-auth/index.html>
3. key 失效(退出码 8)→ 重新获取
4. SSL 问题 → `LY_SKIP_SSL_VERIFY=1` 或脚本 `--insecure`
### 扣点与确认
本技能每次「新发起」质检任务会消耗点数;整条链路的扣点感知由你(assistant)贯穿,**不能跳过确认直接开跑**。
- **执行前确认(仅新任务)**:必填信息收齐、API Key 就绪后,**先停下来**用下面话术请用户确认,再运行 `copywriting_qa.py`(含 `--only-create`):
> 本次违禁词检测+优化预计扣点约 26 点,实际按 token 用量实扣。是否继续?
等用户明确说「继续 / 可以 / 确认」等同意表述后再跑脚本。
用户未确认、未回应、或要求先改文案/换渠道时,**不要运行脚本**。
- **仅轮询不重复确认**:已经创建过任务、只跑 `--poll-task` 续查结果时,点数在完成后首次读取时结算,**不要再问一遍扣点**。
- **失败重试**:用户同意「再试一次」后,才可跑 `--retry-task` 或重新创建;重试前若重新创建新任务,再走一次扣点确认。
- **执行成功后回告实际扣点**:见「输出交付」,用脚本透出的 `COPY_QA_POINTS_USED` 告诉用户「本次实际扣除 {N} 点」;为空时说「约 26 点(实际以账户明细为准)」。
- **执行失败后告知点数处理**:任务已发起但未成功产出报告时,告知「因异常本次未完成,相应点数已退回/未扣除(以账户为准)」,并询问是否重试。
### 参数映射(内部,不对用户说)
| 用户说法 | 提交字段 |
|---|---|
| 待发布文案 | `--text` / `text` |
| 小红书 / 抖音 / 微信公众号 / 视频号 / 其他 | `--channel`:`xhs` / `dy` / `mp` / `channels` / `other` |
| 行业 | `--industry` |
| 是商业推广/带货/软广 | `--is-commercial` |
| 账号资质说明 | `--account-qualification` |
### 异步与扣点(内部,不对用户说)
- `POST .../copywriting-qa/tasks` → 返回 `task_id`,`status` 多为 `pending`
- `GET .../tasks/{task_id}`:`pending`/`running` 继续;`completed` 交付;`failed` 失败
- **扣点时机**:任务 `completed` 后**第一次 GET** 结算(只扣一次)
- 响应 `data` 字段(对外精简):`task_id`、`status`、`markdown`、`errors`、`total_points`
- 成功时交付 `markdown`,用 `total_points` 告知实扣
- 失败时看 `errors`(如 `[{code, message}]`)
- **不再返回** `skill_kind` / `usage_tokens` / `result_read_count` / `billing` 对象
- `idempotency_key` **已废弃**(服务端忽略);以 `task_id` 为准
- 脚本兼容旧字面量:`succeeded`≈完成、`billing_failed`≈失败;扣点字段兼容旧 `billing.total_points`
### 拆分轮询(防会话中断)
1. 创建任务(拿任务号,退出码 0):
```bash
python3 scripts/copywriting_qa.py \
--text "<文案或路径>" \
--channel xhs \
--industry 美妆 \
--is-commercial \
--only-create
```
2. 对用户说:「在质检了,大概一两分钟,好了直接给你看。」
3. 循环短轮询(单次 ≤90s):
```bash
python3 scripts/copywriting_qa.py --poll-task <task_id> --out ./违禁词检测+优化报告.md
```
| 退出码 | 你怎么做 | 对用户说 |
|---|---|---|
| 0 | 交付报告 | 渲染完整 Markdown + 告知扣点 |
| 13 | **立刻再 poll** | 「还在质检」 |
| 12 | 可引导重试 | 「出了点问题,点数已退回,要不要再试?」 |
| 2 / 8 | 停,引导取/换 Key | 引导授权页 |
| 3 | 补参数后重来 | 缺渠道先问平台;其他按输入节追问 |
| 4 | 停 | 引导充值 |
| 10 / 11 | 可简短重试 | 简短说明可再试 |
失败重试:
```bash
python3 scripts/copywriting_qa.py --retry-task <task_id> --out ./违禁词检测+优化报告.md
```
### 运行方式(完整参考)
```bash
# 创建(--channel 必填)
python3 scripts/copywriting_qa.py --text "<文案或路径>" --channel xhs --industry 美妆 --is-commercial --only-create
# 轮询
python3 scripts/copywriting_qa.py --poll-task <task_id> --out ./违禁词检测+优化报告.md
# 失败重试
python3 scripts/copywriting_qa.py --retry-task <task_id> --out ./违禁词检测+优化报告.md
```
### 输出交付(stdout 协议,内部用,不对用户展示)
```
COPY_QA_POINTS_USED=<实扣>
COPY_QA_PLAN_POINTS=26
COPY_QA_REPORT_FILE=<路径>
COPY_QA_TASK_ID=<id>
=== COPY_QA_REPORT_START ===
<Markdown>
=== COPY_QA_REPORT_END ===
```
**必须把 START/END 之间的 Markdown 完整渲染到对话里。** 只说「已保存」不算交付。
交付时按顺序:
1. **渲染报告**:START/END 之间的 Markdown 完整给用户。
2. **告知实际扣点**:`COPY_QA_POINTS_USED` 非空 →「本次任务实际扣除 {N} 点」;为空 →「本次约 26 点(实际以服务端/账户为准)」。
3. **可选**:说明报告已保存路径(`COPY_QA_REPORT_FILE`),便于归档。
收尾示例:
> 质检报告如上 ✅ 本次实际扣除 {N} 点。
## 原则
- 本技能聚焦「文案文本内容发布前质检」;画面/视频合规、文案代笔创作、发布后舆情监测均不包。
- **输入侧**:必填缺失须追问、不自行假设;已给出的字段不重复问。
- **执行侧**:**新任务必须先扣点确认再跑脚本**;质检 SOP 在服务端完成;你只负责收参、鉴权、确认、异步提交与轮询、原样交付。
- **交付侧**:报告 Markdown 以脚本返回为准,**禁止改写、删节或重排**;判定与表格结构由服务端统一渲染保证。
- 只使用异步:`创建任务` → `GET 轮询(完成时结算)` → 可选 `retry`;禁止一次长阻塞等到结束。
- 对用户说人话:不暴露 task_id、退出码、JSON、接口路径。
- 覆盖头部 4 平台(小红书/抖音/微信公众号/视频号);其他渠道走通用法规层并提示平台特有规则二次核验。
- 高危时服务端可附改后成稿;资质性阻断(无牌照硬门槛)时不应期待「改文案就能发」的可用成稿。使用说明
# 违禁词检测与优化 发布前文案合规质检:三层结构(法规合规层/平台规则层/内容质量层)扫描,输出三栏对照问题清单、风险分级与发布判定。 ## 使用 ```bash # 创建质检任务(先确认已配置技能目录 config.json 的 LY_API_KEY) python3 scripts/copywriting_qa.py --text "<待发布文案>" --channel xhs --industry 美妆 --only-create # 轮询结果(退出码 0 交付报告,13 表示进行中需再次执行) python3 scripts/copywriting_qa.py --poll-task <task_id> --out ./质检报告.md ``` 对话内直接说「帮我质检这篇小红书笔记能不能发:……」也可以触发。 ## 工作原理 脚本通过异步任务接口提交文案质检请求并轮询进度,服务端按三层风险结构完成逐条排查与合规改写建议,返回渲染好的 Markdown 质检报告,脚本原样交付。任务消耗点数,执行前需用户确认。
支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手