skill-risk-scanner · git:20260828.21694dd · 2026-08-28 · sha256 e30054b433f06bf7

skill-risk-scanner git:20260828.21694ddA

Immutable. This exact content is served forever at /api/v1/blob/e30054b433f06bf7.

---
name: skill-risk-scanner
description: >-
  内容原创度与版权风险评估:分析文案是否存在洗稿/搬运嫌疑,评估素材版权风险,
  检查引用规范。基于 LLM 文本分析,不包含技术查重。
  当用户说"查重"、"原创度"、"是不是抄的"、"版权风险"、"能不能用这张图"、
  "音乐版权"、"原创检测"、"有没有侵权"、"素材版权"、"会不会被投诉"时触发。
  和 skill-quality-gate 的区别:quality-gate 查敏感词和平台规则合规,
  risk-scanner 专注原创度和版权侵权风险。
layer: publish
---

# 内容原创度与版权风险评估

> 基于 LLM 文本分析能力,评估内容的原创度风险和素材版权风险,输出定性风险报告与改进建议。

## 能力边界声明

本 SKILL 基于 LLM 文本分析,**不包含**以下技术能力:

- **不做技术查重** — 无法计算余弦相似度或精确重复率,需要 Copyleaks / Originality.ai 等外部 API
- **不输出相似度分数** — 所有风险判断均为定性等级(低/中/高),不伪造百分比或小数
- **不做图片内容识别** — 无法读取 EXIF、检测水印、识别图片来源;图片风险评估基于用户提供的来源描述
- **不做音频指纹匹配** — 无法识别 BGM 曲目,基于用户标注的音乐来源进行风险判断

## 与其他 SKILL 的区别

| SKILL | 定位 | 检查焦点 |
|---|---|---|
| **risk-scanner**(本 SKILL) | 原创度 + 版权风险 | 洗稿模式识别、素材版权风险、引用合规 |
| skill-quality-gate | 平台合规 + 内容质量 | 敏感词、平台规则、广告法、绝对化用语、医疗违规 |
| skill-publish-checklist | 完整性检查 | 有没有漏标题、漏封面 |

## 输入

| 参数 | 必填 | 说明 |
|------|------|------|
| 待检查文案 | 是 | 文案正文、脚本、长文原稿 |
| 素材来源说明 | 否 | 用户描述图片/音频/视频的来源(如"图片来自 Unsplash"、"BGM 用的抖音自带音乐") |
| 参考来源文本 | 否 | 原始参考文章的文本或 URL,用于对比改写充分度 |
| 目标平台 | 否 | 发布平台名称,用于匹配平台版权规则 |

## 输出

Markdown 格式的风险评估报告,结构如下:

```markdown
# 风险评估报告

## 整体风险等级:🟢 低风险 / 🟡 中风险 / 🔴 高风险

## 一、文本原创度评估

### 洗稿模式扫描
- [扫描结果与具体发现]

### 内容独特性判断
- [是否包含个人经验/独家数据/原创观点]

### 引用规范检查
- [引用是否标注来源、数据是否注明出处]

## 二、素材版权风险(仅在用户提供素材来源描述时输出)

### 图片素材
- [基于用户描述的来源判断]

### 音频/BGM
- [基于用户描述的来源判断]

## 三、品牌与商标风险
- [文案中提及的品牌名/商标的使用风险]

## 四、风险清单

### 必须处理(阻塞发布)
- [高风险项]

### 建议处理(不阻塞但有隐患)
- [中风险项]

## 五、改进建议
- [针对每个风险项的具体操作建议]
```

风险等级定义:
- **低风险** — 内容有明显原创成分,引用规范,素材来源清晰
- **中风险** — 存在部分洗稿嫌疑或素材来源不明,建议修改后发布
- **高风险** — 有明显搬运/抄袭模式或版权侵权风险,不建议直接发布

## 执行步骤

### Step 1 — 确认输入与检查范围

1. 读取用户提供的待检查文案
2. 确认是否提供了素材来源说明(图片、音频、视频的来源描述)
3. 确认是否提供了参考来源文本(用于对比改写充分度)
4. 确认目标平台(用于匹配平台特有版权规则)
5. 未提供素材来源说明时,跳过素材版权评估模块,在报告中注明"用户未提供素材来源信息,无法评估素材版权风险"

### Step 2 — 文本洗稿模式扫描

逐段扫描文案,按 `references/washing-patterns.md`「一、洗稿模式识别」识别机械性同义替换、句式变换但论点复刻、段落搬运重排三类特征。对发现的每个特征引用具体段落文本并说明理由;未发现时明确说明"未检测到明显洗稿模式"。

### Step 3 — 内容独特性评估

按 `references/washing-patterns.md`「二、内容独特性评估」判断文案是否包含个人经验、独家数据、原创观点、具体细节,并据此给出原创度较高/一般/低的结论。

### Step 4 — 引用规范检查

按 `references/washing-patterns.md`「三、引用规范检查」核对观点引用、数据引用、截图引用的来源标注;若用户提供了参考来源文本,对比本文与来源的转述充分度(是否只换词不换意、是否加入自己的分析、是否改变结构和论证逻辑)。

### Step 5 — 素材版权风险评估(基于用户描述)

**仅在用户提供素材来源描述时执行此步骤。**

根据用户描述的素材来源,参照 `references/copyright-guide.md`「七、素材来源风险速查表」(图片 7.1 / 音频 BGM 7.2)判断风险等级,并对高风险素材推荐 `references/copyright-guide.md` 中的免费图库和音乐库替代来源。

### Step 6 — 品牌与商标风险扫描

扫描文案中出现的品牌名、商标、产品名:

1. **竞品品牌提及** — 在推广内容中贬低竞品构成不正当竞争风险
2. **未授权使用品牌名** — 在标题/封面中突出使用他人品牌名可能构成商标侵权
3. **虚假关联暗示** — "XX 品牌推荐/XX 品牌同款"等未经授权的关联表述
4. 列出所有检测到的品牌名及其使用上下文,给出风险判断

### Step 7 — 汇总风险报告

1. 汇总 Step 2-6 的所有发现
2. 确定整体风险等级(取所有维度中的最高风险等级)
3. 区分"必须处理"和"建议处理"两类风险:
   - **必须处理**:明显洗稿段落、高风险素材来源、未授权品牌使用
   - **建议处理**:缺少引用标注、原创成分偏少、AI 生成标注缺失
4. 对每个风险项给出具体改进建议:
   - 洗稿段落 → 指出具体段落并给出改写方向(补充个人经验、换论证角度)
   - 来源不明素材 → 推荐具体的免费替代来源
   - 引用缺失 → 指出应补充引用的具体位置
5. 输出完整 Markdown 格式风险报告

## Profile 感知

**有 Profile 时:**
- 读取 `platform` 字段,启用该平台的版权规则(参照 `references/copyright-guide.md`):
  - 小红书:AI 生成内容标注要求、图片搬运检测机制
  - 抖音:BGM 版权限制、原声使用规范
  - B站:转载标注规范、素材引用要求
  - 公众号:原创声明规则、白名单转载机制
- 读取 `positioning` 字段,评估内容与账号定位的一致性(定位偏移本身不是版权风险,但在报告中提示)
- 读取历史内容风格,判断本次内容是否与以往风格一致(风格突变可能暗示搬运)

**无 Profile 时:**
- 做通用原创度和版权检查,不做平台特化
- 在报告末尾附注:"如提供账号 Profile(含平台信息),可启用平台特有版权规则检查"

## 规则

1. **不伪造量化指标** — 禁止输出相似度百分比、原创度分数、匹配率等数值,所有判断用定性等级表达
2. **不声称技术查重能力** — 报告中不得暗示已进行数据库比对、向量检索或指纹匹配
3. **素材评估必须基于用户描述** — 用户未描述素材来源时,不猜测,明确标注"来源未提供,无法评估"
4. **发现必须引用原文** — 标记洗稿嫌疑时,必须引用具体文本段落,不做笼统判断
5. **建议必须可操作** — 每条改进建议必须告诉用户具体做什么(改哪段、换什么素材、补什么引用)
6. **诚实标注局限** — 报告末尾附注"本评估基于 LLM 文本分析,如需精确查重请使用 Copyleaks、Originality.ai 等专业工具"
7. 禁止使用破折号(em dash)