skill-risk-scanner · git:20260828.21694dd · 2026-08-28 · sha256 e30054b433f06bf7
skill-risk-scanner git:20260828.21694ddA
Immutable. This exact content is served forever at /api/v1/blob/e30054b433f06bf7.
--- name: skill-risk-scanner description: >- 内容原创度与版权风险评估:分析文案是否存在洗稿/搬运嫌疑,评估素材版权风险, 检查引用规范。基于 LLM 文本分析,不包含技术查重。 当用户说"查重"、"原创度"、"是不是抄的"、"版权风险"、"能不能用这张图"、 "音乐版权"、"原创检测"、"有没有侵权"、"素材版权"、"会不会被投诉"时触发。 和 skill-quality-gate 的区别:quality-gate 查敏感词和平台规则合规, risk-scanner 专注原创度和版权侵权风险。 layer: publish --- # 内容原创度与版权风险评估 > 基于 LLM 文本分析能力,评估内容的原创度风险和素材版权风险,输出定性风险报告与改进建议。 ## 能力边界声明 本 SKILL 基于 LLM 文本分析,**不包含**以下技术能力: - **不做技术查重** — 无法计算余弦相似度或精确重复率,需要 Copyleaks / Originality.ai 等外部 API - **不输出相似度分数** — 所有风险判断均为定性等级(低/中/高),不伪造百分比或小数 - **不做图片内容识别** — 无法读取 EXIF、检测水印、识别图片来源;图片风险评估基于用户提供的来源描述 - **不做音频指纹匹配** — 无法识别 BGM 曲目,基于用户标注的音乐来源进行风险判断 ## 与其他 SKILL 的区别 | SKILL | 定位 | 检查焦点 | |---|---|---| | **risk-scanner**(本 SKILL) | 原创度 + 版权风险 | 洗稿模式识别、素材版权风险、引用合规 | | skill-quality-gate | 平台合规 + 内容质量 | 敏感词、平台规则、广告法、绝对化用语、医疗违规 | | skill-publish-checklist | 完整性检查 | 有没有漏标题、漏封面 | ## 输入 | 参数 | 必填 | 说明 | |------|------|------| | 待检查文案 | 是 | 文案正文、脚本、长文原稿 | | 素材来源说明 | 否 | 用户描述图片/音频/视频的来源(如"图片来自 Unsplash"、"BGM 用的抖音自带音乐") | | 参考来源文本 | 否 | 原始参考文章的文本或 URL,用于对比改写充分度 | | 目标平台 | 否 | 发布平台名称,用于匹配平台版权规则 | ## 输出 Markdown 格式的风险评估报告,结构如下: ```markdown # 风险评估报告 ## 整体风险等级:🟢 低风险 / 🟡 中风险 / 🔴 高风险 ## 一、文本原创度评估 ### 洗稿模式扫描 - [扫描结果与具体发现] ### 内容独特性判断 - [是否包含个人经验/独家数据/原创观点] ### 引用规范检查 - [引用是否标注来源、数据是否注明出处] ## 二、素材版权风险(仅在用户提供素材来源描述时输出) ### 图片素材 - [基于用户描述的来源判断] ### 音频/BGM - [基于用户描述的来源判断] ## 三、品牌与商标风险 - [文案中提及的品牌名/商标的使用风险] ## 四、风险清单 ### 必须处理(阻塞发布) - [高风险项] ### 建议处理(不阻塞但有隐患) - [中风险项] ## 五、改进建议 - [针对每个风险项的具体操作建议] ``` 风险等级定义: - **低风险** — 内容有明显原创成分,引用规范,素材来源清晰 - **中风险** — 存在部分洗稿嫌疑或素材来源不明,建议修改后发布 - **高风险** — 有明显搬运/抄袭模式或版权侵权风险,不建议直接发布 ## 执行步骤 ### Step 1 — 确认输入与检查范围 1. 读取用户提供的待检查文案 2. 确认是否提供了素材来源说明(图片、音频、视频的来源描述) 3. 确认是否提供了参考来源文本(用于对比改写充分度) 4. 确认目标平台(用于匹配平台特有版权规则) 5. 未提供素材来源说明时,跳过素材版权评估模块,在报告中注明"用户未提供素材来源信息,无法评估素材版权风险" ### Step 2 — 文本洗稿模式扫描 逐段扫描文案,按 `references/washing-patterns.md`「一、洗稿模式识别」识别机械性同义替换、句式变换但论点复刻、段落搬运重排三类特征。对发现的每个特征引用具体段落文本并说明理由;未发现时明确说明"未检测到明显洗稿模式"。 ### Step 3 — 内容独特性评估 按 `references/washing-patterns.md`「二、内容独特性评估」判断文案是否包含个人经验、独家数据、原创观点、具体细节,并据此给出原创度较高/一般/低的结论。 ### Step 4 — 引用规范检查 按 `references/washing-patterns.md`「三、引用规范检查」核对观点引用、数据引用、截图引用的来源标注;若用户提供了参考来源文本,对比本文与来源的转述充分度(是否只换词不换意、是否加入自己的分析、是否改变结构和论证逻辑)。 ### Step 5 — 素材版权风险评估(基于用户描述) **仅在用户提供素材来源描述时执行此步骤。** 根据用户描述的素材来源,参照 `references/copyright-guide.md`「七、素材来源风险速查表」(图片 7.1 / 音频 BGM 7.2)判断风险等级,并对高风险素材推荐 `references/copyright-guide.md` 中的免费图库和音乐库替代来源。 ### Step 6 — 品牌与商标风险扫描 扫描文案中出现的品牌名、商标、产品名: 1. **竞品品牌提及** — 在推广内容中贬低竞品构成不正当竞争风险 2. **未授权使用品牌名** — 在标题/封面中突出使用他人品牌名可能构成商标侵权 3. **虚假关联暗示** — "XX 品牌推荐/XX 品牌同款"等未经授权的关联表述 4. 列出所有检测到的品牌名及其使用上下文,给出风险判断 ### Step 7 — 汇总风险报告 1. 汇总 Step 2-6 的所有发现 2. 确定整体风险等级(取所有维度中的最高风险等级) 3. 区分"必须处理"和"建议处理"两类风险: - **必须处理**:明显洗稿段落、高风险素材来源、未授权品牌使用 - **建议处理**:缺少引用标注、原创成分偏少、AI 生成标注缺失 4. 对每个风险项给出具体改进建议: - 洗稿段落 → 指出具体段落并给出改写方向(补充个人经验、换论证角度) - 来源不明素材 → 推荐具体的免费替代来源 - 引用缺失 → 指出应补充引用的具体位置 5. 输出完整 Markdown 格式风险报告 ## Profile 感知 **有 Profile 时:** - 读取 `platform` 字段,启用该平台的版权规则(参照 `references/copyright-guide.md`): - 小红书:AI 生成内容标注要求、图片搬运检测机制 - 抖音:BGM 版权限制、原声使用规范 - B站:转载标注规范、素材引用要求 - 公众号:原创声明规则、白名单转载机制 - 读取 `positioning` 字段,评估内容与账号定位的一致性(定位偏移本身不是版权风险,但在报告中提示) - 读取历史内容风格,判断本次内容是否与以往风格一致(风格突变可能暗示搬运) **无 Profile 时:** - 做通用原创度和版权检查,不做平台特化 - 在报告末尾附注:"如提供账号 Profile(含平台信息),可启用平台特有版权规则检查" ## 规则 1. **不伪造量化指标** — 禁止输出相似度百分比、原创度分数、匹配率等数值,所有判断用定性等级表达 2. **不声称技术查重能力** — 报告中不得暗示已进行数据库比对、向量检索或指纹匹配 3. **素材评估必须基于用户描述** — 用户未描述素材来源时,不猜测,明确标注"来源未提供,无法评估" 4. **发现必须引用原文** — 标记洗稿嫌疑时,必须引用具体文本段落,不做笼统判断 5. **建议必须可操作** — 每条改进建议必须告诉用户具体做什么(改哪段、换什么素材、补什么引用) 6. **诚实标注局限** — 报告末尾附注"本评估基于 LLM 文本分析,如需精确查重请使用 Copyleaks、Originality.ai 等专业工具" 7. 禁止使用破折号(em dash)