AI工具 Skill技能库 关于道场

抖音作品发布前自查助手:违禁词检测+播放量预测+存档管理

一人堂 |2026-08-30

抖音作品发布前的AI自动化检查工具,集违禁词扫描、AI标注核查、资质红线判断和播放量区间预测于一体。内置广告法违禁词库、引流词库、医疗/金融/法律/教育资质红线规则,基于粉丝量和赛道自动预测流量池层级,发布后自动存档记录回填真实数据持续校准模型。

抖音作品发布前自查助手:违禁词检测+播放量预测+存档管理

抖音作品发布前的AI自动化检查工具,对作品进行三重检查:①违规自查(违禁词/AI标注/资质红线)②播放量预测③自动存档管理。内置多级词库和预测模型,帮助创作者在发布前发现风险、优化内容、预测表现。

【适用场景】

- 写好抖音文案/口播稿后,发布前想快速自查有没有违禁词 - 不确定自己的内容是否触碰医疗/金融/法律/教育资质红线 - 想了解按当前粉丝量和内容质量,作品大概能获得多少播放量 - 需要对发布的作品做记录管理,回填真实数据来校准后续预测

核心能力:输入文案和账号元数据,输出结构化的违规自查报告、播放量预测区间、自动存档记录。

【操作步骤】

第一步:提供作品信息

必填: - 作品文案或口播文稿(含标题、字幕文字)

预测用元数据(缺少时使用默认值,并在报告中注明): - 账号当前粉丝量(缺失→询问或按0-1000保守估算) - 账号健康分(缺失→按95计算) - 视频时长(秒) - 画面比例(9:16/16:9/其他) - 赛道类型(缺失→默认AI知识科普) - 是否真人出镜 - 是否含AI生成内容 + 是否已双标注 - 信息密度(高/中/低) - 发布时段(可选)

> 若用户没有提及是否含AI生成内容,主动询问(AI标注是高频雷区)。

第二步:执行四重检查

AI按以下顺序读取规则文件并执行检查:

1. 白名单语境建立:读取`references/白名单_L3.md`,理解哪些词在特定语境下是安全的

2. 违禁词扫描:读取`references/违禁词库_L2.md`,扫描文案/字幕/标题中的: - 广告法违禁词 - 引流词 - 谐音/拼音/变体违禁词 - 每个疑似命中先过白名单语境层:白名单语境内不报或降为🟡级警告;否则定类别+严重度+安全替换词

3. AI标注与资质核查:读取`references/规则_AI标注与资质.md`: - AI双标注检查:发布端是否勾选 + 前5秒画面字幕是否≥3秒(缺一不可) - 资质红线检查:医疗/金融/法律/教育领域触碰即🔴高危 - 关联健康分扣分风险评估

4. 播放量预测:读取`references/预测模型.md`,按公式计算: ``` 预测区间 = 基准区间(粉丝量×赛道) × 质量系数 × 合规系数 ``` 输出:预测播放区间、流量池预判、表现短板提示

第三步:存档记录

将本次记录追加到`records/records.jsonl`(每行一个JSON对象),可用脚本:

```bash python skill/scripts/log_record.py "<json字符串>" ```

记录字段:作品标题/摘要、粉丝量、健康分、时长、比例、赛道、是否真人、是否含AI及是否标注、信息密度、命中违规摘要、预测区间、流量池预判。`real_views`等真实数据列留空,待回填真实播放量后可让预测越来越准。

第四步:输出三段式报告

第一段:📋 违规自查报告 - 命中清单表格:命中词/表达 | 类别 | 严重度🔴🟠🟡 | 安全替换 - AI标注检查:是否需标注、是否达标 - 资质红线:是否触碰医/金/法/教 - 白名单说明:列出「看着像违禁、此处安全」的词 - 总评:✅可发 / 🛠改完可发 / ⛔高风险勿发

第二段:📈 表现预测 - 预测播放区间:正常X-Y,优质可冲Z - 流量池预判:大概到哪级 + 卡点分析 - 短板提示:最该补的1-2项 - 声明:「此为基于规则与行业基准的估算,浮动大(±30%+),靠回填真实播放量逐步校准」

第三段:💾 存档确认 - 末尾一句:「已存档第N条到records.jsonl(回填真实播放量可让预测越来越准)」

【代码模板】

自查触发话术

``` 「帮我自查一下这条抖音」 「这条能发吗」 「查一下违禁词」 「预测这条抖音表现」 「抖音发布前检查」 ```

存档JSON字段模板

```json { "title": "作品标题", "abstract": "作品摘要/主要内容", "fans": 10000, "health_score": 95, "duration": 60, "aspect_ratio": "9:16", "category": "AI知识科普", "real_person": true, "has_ai_content": false, "ai_labeled": false, "info_density": "高", "violations": [], "predicted_views": "5000-8000", "flow_pool": "次级推荐池", "shortage": "开头3秒钩子不够强", "real_views": null, "timestamp": "2026-08-29T12:00:00Z" } ```

关键规则优先级

- 先白名单后违禁词:宁可多说一句「此处安全」,绝不误杀让用户瞎改 - 预测只给区间:永远带「估算/待校准」声明,不报精确数字 - 规则会过时:`references/`各文件头有整理日期,过时需更新原始数据源

【复盘要点】

1. 主动询问AI标注情况:用户没提是否含AI时,主动问一句避免踩坑 2. 预测留浮动空间:告知用户估算±30%浮动,回填真实数据是逐步校准 3. 高危违禁词优先处理:🔴高风险勿发的情况,先改违规再谈预测 4. 白名单语境防止误杀:某些词在特定语境下是安全的,不要机械扫红 5. 记录回填真实数据:真实播放量回填越多,预测越准确 6. 规则文件保持更新:关注各reference文件头的整理日期,过时需更新


来源:GitHub https://github.com/code-wahaha/traffic-compass