# AGENTS.md - 口播稿项目主文件

> 本文件是口播稿写作工作的最高权威参考。所有规则、铁律、约束、偏好均以此文件为准。
> SKILL.md（koubo-daily）为各Phase详细执行手册，与本文件配合使用。
> 最后更新：2026-07-13

---

## 零、项目边界声明（最高优先级·违反即事故）

**本文件只管理口播稿项目。公众号项目由 `wechat-article-system/AGENTS.md` 独立管理。**

- **口播稿** = `口播稿/koubo/` 目录 → 输出 `.txt` 脚本 → 走 `koubo_validate.py` + `koubo_quality_gate.py` 双门禁 → **绝不走公众号发布流水线**
- **公众号** = `wechat-article-system/` 目录 → 输出 `.md` + `.html` + `.docx` 三件套 → 走 `publish_pipeline.py` 推草稿箱

**工具链、交付物、验证流程完全独立，互不通用。**

**永久禁令**：口播稿文件（.txt）永远不能"推送到公众号草稿箱"——格式、工具、平台完全不同。

### 零·B 项目文件越界禁令（2026-07-14 用户强制·最高优先级·零容忍·根治疗法）

> 根因：此前仅在 AGENTS.md / MEMORY.md 文字层面声明"口播稿不能推公众号草稿箱"，但**没有代码层面的硬性拦截**。AI 在生成口播稿 .txt 后，因路径拼写错误或记忆混淆，可能把 `MMDD.txt` 写到 `wechat-article-system/output/`。等下次会话/用户清理时才被发现，污染已扩散。

**铁律（违反=直接 abort 整个流水线）**：

| #   | 禁令                                                                                                                         | 触发条件               | 拦截位置                                                               |
| --- | ---------------------------------------------------------------------------------------------------------------------------- | ---------------------- | ---------------------------------------------------------------------- |
| 1   | 公众号 `wechat-article-system/` 任何子目录**绝不允许**出现 `.txt` 后缀文件                                                   | 任何 `.txt` 出现       | `full_audit.py` C0 + `project_hygiene.py` check_cross_project_boundary |
| 2   | 公众号目录**绝不允许**出现口播稿 MMDD.txt 命名模式（`^\d{4}\.txt$`）                                                         | 文件名匹配 MMDD 模式   | 同上                                                                   |
| 3   | 公众号 `.md/.html/.docx` 内**绝不允许**出现口播稿特征词（`[置顶]`/`#科技`/`李总`/`咱就说`/`完播率`/`抖音`/`视频号` 等≥2 个） | 文本内容命中≥2个特征词 | `full_audit.py` C0                                                     |
| 4   | `publish_pipeline.py` 的 `--md` 入参**绝不允许**是 `.txt` 后缀                                                               | 入口参数校验           | `publish_pipeline.py` 入口守卫 sys.exit(1)                             |
| 5   | `publish_pipeline.py` 的 `--md` 入参**绝不允许**路径含 `口播稿` / `koubo/`                                                   | 路径包含口播稿目录     | 同上                                                                   |
| 6   | `publish_pipeline.py` 的 `--md` 入参**必须**在 `articles/` 目录（否则 WARN 提示）                                            | 不在 articles/ 目录    | 同上 WARN                                                              |
| 7   | 反向：口播稿 `koubo/` 任何子目录**绝不允许**出现 `.html` / `.docx` 公众号产物                                                | 任何 .html/.docx 出现  | `project_hygiene.py` check_cross_project_boundary                      |

**门禁状态（2026-07-14 已落地）**：

- `full_audit.py` C0 维度：递归扫描 `wechat-article-system/` 全树，发现任何 `.txt` / MMDD 模式 / 口播稿特征词→FAIL
- `project_hygiene.py` 双向边界检查：公众号目录无 .txt + 口播稿目录无 .html/.docx，任一命中即 FAIL
- `publish_pipeline.py` 入口守卫：`--md` 为 .txt / 路径含口播稿 → sys.exit(1)

**主动同步铁律**：今后任何"项目混淆"漏洞，必须追加到 `full_audit.py` C0 + `project_hygiene.py` check_cross_project_boundary + `publish_pipeline.py` 入口守卫 三处同步，不允许只改一处。

### 零·C 机器级边界硬门禁（2026-07-20 硬化·最高优先级·不可绕过·已实测）

> 零·B 是内容级双向卫生检查；本小节是**主力拦截**，在工具启动与文件落盘时即 fail-closed，不依赖 agent 记性。

核心脚本 `.workbuddy/project_boundary.py` + 共享锁 `.workbuddy/SESSION_DOMAIN`（格式 `domain|ISO时间`，锁超 24h 自动过期强制重 init）。四层防护：

1. **会话锁 init（强制仪式）**：处理任何请求前先
   `python .workbuddy/project_boundary.py init <koubo|wechat>` 写锁；未声明会话时跑任一口播稿/公众号流水线 → `sys.exit(3)` 拦截。
2. **工具自检**：9 个脚本启动即 `check_action(tool=本脚本)`，域不匹配直接 `sys.exit(3)`。覆盖 publish_pipeline/full_audit/export_csdn_md/build_gpt56_sol（公众号侧）+ koubo_validate/koubo_quality_gate/hot_topic_coverage_gate/archive_daily/project_hygiene（口播稿侧）。
3. **写前守卫 check_write**：所有交付物（.txt/.md/.html/.docx）真正落盘前 `check_write(path)`，拒绝跨域产物类型 + 跨项目目录写入；即使未声明会话也防御性拒绝把禁产物流进对方树。
4. **侦探兜底 scan_boundary.py**：会话结束跑 `python .workbuddy/scan_boundary.py`，发现 `.txt`/MMDD.txt/口播稿脚本落在公众号树、或 `.html`/`.docx`/公众号脚本落在口播稿树 → exit(1)，必须先清再交付。

**实测（2026-07-20 硬化后）**：边界逻辑 10/10 通过；koubo 锁下真实运行 `publish_pipeline.py` → exit 3 红条拦截；wechat 锁下真实运行 `koubo_validate.py` → exit 3 拦截；当前两树 `scan_boundary.py` → 0 残留 PASS。

**口播稿会话 NEVER 清单**：①绝不跑 publish_pipeline/full_audit/export_csdn_md/build_gpt56_sol、绝不生成 docx/html；②绝不 `cd` 进公众号目录执行命令；③绝不因上游摘要/上下文误标而覆盖 SESSION_DOMAIN 锁；④任何交付动作前必 `init`，写前必 `check --path`，会话结束必 `scan_boundary.py`。

### 零·C 完美收尾闭环铁律（2026-07-14 用户强制·零遗漏）

**用户说"没有任何后续建议" = 100% 已把所有规则沉淀到代码 + 文档**。任何"被动建议"（用户提出后才修）= 已失败，应主动提前固化。

**闭环标准（6 条全满足才算闭环）**：

1. 规则在 4 层防护代码中（入口守卫 + C0 + 双向 + pre-flight）
2. 规则在两个 AGENTS.md 中（双向镜像·最高优先级·零·B 节）
3. 规则在两个 MEMORY.md 中（项目 + 跨项目·可追溯）
4. pre-flight 脚本可自动检测该类问题
5. 全量验证 PASS（无 FAIL）
6. 当日日志记录证据

**写作前自检流程（每次 Write/Edit 前必走）**：

1. 默念 1 句"输出目录是哪个？"——口播稿写 koubo/Output/MMDD.txt，公众号写 articles/xxx.md
2. 跑 `python 口播稿/koubo/project_preflight.py check --path <目标路径> --title <标题> --digest <摘要>`
3. 返回 0 = PASS → 可以写
4. 返回 1 = FAIL → **立即修改**，绝不允许硬写
5. 写完后跑 `project_preflight.py scan` 做最终核验

---

## 一、账号基本信息

- **账号名**：智汇AI社区丨李总
- **抖音号**：35766294125
- **认证**：蓝V认证
- **地区**：吉林·长春
- **简介**：智汇AI教育，人工智能人才孵化基地
- **核心定位**：AI教育创始人视角——以"AI时代你怎么学、怎么用、怎么不掉坑"为主线，覆盖家长/职场人/创业者/学生多人群（教育≠只谈孩子，AI素养/职业转型/成人自学都算）
- **身份**：吉林省爱智汇人工智能科技有限公司**法人** / 智汇AI集团**创始人** / 智汇AI教育**创始人**（出镜主讲人"李总"）
- **用户**：运营AI/科技类自媒体短视频账号，每日产出**8篇口播稿（不可减少）**
- **口播稿文件存放**：`F:\BaiduSyncdisk\自媒体\口播稿\koubo\`

### 平台策略

- **主平台（双核心）**：视频号 + 抖音
- **辅平台**：小红书 + 快手
- 每篇稿子同时适配4平台，不拆开分配，但写法重心优先满足视频号和抖音的算法需求
- **反对账号做窄**，AI赛道已足够大不需拆细分方向
- **矩阵号**：8号各发1篇，不是1号发8篇
- **公众号与口播稿统一规则**：服务同一批人（普通人：家长/上班族/学生/副业者），选题统一规划，角度统一从"普通人怎么用/怎么避/怎么想"切入

---

## 二、铁律（违反=严重事故，零容忍）

### 2.1 热点采集铁律

- 选题**必须**来自WebSearch联网搜索的当天最新热点，**绝对禁止**凭记忆或训练数据选题
- 每次至少搜索3次，覆盖综合热点/事件型/政策型维度
- 候选列表必须在对话中展示，用户能看到搜了什么、选了什么、为什么选
- **24 小时新消息判定铁律（含"旧消息当天重发"排除规则·2026-07-20 用户强制·最高优先级）**：
  - 一条消息判定为"24 小时内的新消息"，**必须**满足：其**原始首次发布时间**落在"发布日 T+1 往前推 24 小时"窗口内。
  - **排除规则（明确·零容忍）**：凡**24 小时窗口之外已发布/已存在过的消息**，哪怕在当天被某账号/媒体**再次转发、二次推送、重发**，一律**不算**"24 小时内的新消息"，**不得据此选题**。判定"新"看的是**消息首次出现的原始时间**，不是"今天又看到"的转发时间。例：某模型 3 天前已发布，今天某大 V 又发解读/转发 → 该消息对 24h 新消息判定**无效**，不能选。
  - **判定流程**：选题前对候选消息用 WebSearch 核实**原始发布时间戳**（不只看今天热榜上的出现），确认首次公开时间确实在 24h 窗口内，才计入"新消息"候选池；不核实原始时间不许选题。
- 同等爆款潜力下今天 > 昨天 > 本周；不搜索不许选题，哪怕"觉得肯定是新的"也必须搜索确认时间。
- **T+1 发布时效铁律（2026-07-17 用户规则·选题时基校准）**：写稿日记为 T，**用户次日（T+1）才录制发布**，因此选题必须瞄准"发布当天（T+1）仍是第一手、仍在热度上升/持续期"的动态，而非只顾写稿当天已见顶的旧热点。具体：
  1. **优选"隔夜/凌晨海外一手源"**：OpenAI/Anthropic/Google/xAI/Meta 等常在北京时间深夜至凌晨发布，写稿日傍晚拉取到的这类最新动态，正好是 T+1 发布时的"今天刚出"，时效最佳——选题时对 `all_sources.py` 的一手源（x_official / media_intl / genai）优先做 T+1 视角判断。
  2. **规避"当天已过气"**：写稿当天已刷屏一整天的热点，到 T+1 可能已被新动态盖过，同等潜力下让位给"刚冒头、次日仍会发酵"的动态。
  3. **禁止预告未发生为既成事实**：可选"已确定 T+1 发生的日程型事件"（如已官宣的发布会/财报日），但**必须用将来时口径**（"明天/今天即将"），严禁把尚未发生的事写成已发生（延续 0709 事实核查铁律）。
  4. **时间词口径对齐发布日**：正文里的"今天/刚刚/昨天"以**发布日 T+1** 为基准写，不以写稿日 T 为基准，避免用户次日读出来时间错位。
- **模型发布热点专项扫描（2026-07-16 新增·漏抓根因修复）**：选题前**必须**额外拉取 aihot `category=ai-models`（近7天精选）并针对"大模型发布/更新"主题做至少 1 次 WebSearch。若 aihot 窗口内模型发布 ≥3 条（判定为「发布潮」）**或**用户在对话中点名了具体模型，**必须**在 8 篇中覆盖该主题（≥2 个不同模型发布实体），并围绕该集群切不同人群视角（职场人怎么用新模型/创业者怎么选型/副业者怎么省钱/政策怎么管），**不得为凑人群多样性而漏掉当日最热爆点**。
- **热点覆盖自检（Phase 0.7）为交付前硬门禁**：写作完成后必须跑 `hot_topic_coverage_gate.py`，FAIL 即阻断交付（详见 Phase 0.7）。严禁把公众号已覆盖的热点误当成口播稿已覆盖——口播稿覆盖以本文件 `Output/MMDD.txt` 实际内容为准。

#### 2.1.1 选题信源清单（2026-07-16 全网扩展·与公众号信源一致）

- **信源注册表 = `工具脚本/all_sources.py`**（全网 AI 热点信源，共 131 个、10 大类），口播稿与公众号共用同一份（物理复制至 `公众号/wechat-article-system/lib/all_sources.py`），信源逐条一致：
  - **X 官方账号（43个）**：复用公众号 `lib/x_sources.py` 同款注册表（一键发布信源，priority1 必查）
  - **国内大模型官方（22个）**：智谱/月之暗面/DeepSeek/MiniMax/阿里Qwen/百度/腾讯混元/字节/阶跃/百川/讯飞/商汤/快手可灵/昆仑天工/生数Vidu/上海AI实验室书生/智源/面壁/零一万物/硅基流动/宇树/智元机器人
  - **国际科技媒体（20个·含一手官网）**：OpenAI/Anthropic/DeepMind/Meta/xAI(Grok)/Thinking Machines/Microsoft/Mistral/Perplexity/Apple/NVIDIA/Cohere/AllenAI/Amazon Nova/IBM Granite + The Verge/TechCrunch 等
  - **国内科技媒体（7个）**：机器之心/量子位/智东西/新智元(公众号)/36氪/极客公园/爱范儿
  - **开发者社区（7个）**：Hacker News（API自动拉）/ Reddit r/LocalLLaMA·r/artificial·r/MachineLearning·r/singularity / CSDN（AI）/ 掘金（AI）（中文开发者社区，技术实操/大模型实战风向）
  - **论文预印本**：arXiv cs.AI/cs.CL/cs.CV（API自动拉）/ Papers with Code
  - **中文热榜（5个）**：微博热搜/知乎热榜/百度热搜/微信搜一搜/小红书（选题验证5步法指定信源 + AI工具种草风向）
  - **视频平台**：抖音/视频号/B站/YouTube（同赛道对标）
  - **生成式厂商（6个·图/视频/音乐）**：Midjourney/Runway/FLUX(BFL)/Suno/Luma/Stability AI（AI绘画·AI视频大流量话题）
  - **聚合 / 榜单 / 趋势（12个·最热信号）**：aihot（API）/ HF Trending Models（API）/ HF Daily Papers / GitHub Trending / LMArena / Artificial Analysis / Product Hunt / Ben's Bites / TLDR AI / MarkTechPost / aibase / Google Trends
- **自动拉取（脚本 urllib 直连）**：aihot + Hacker News + arXiv，由 `python 工具脚本/topic_pool.py` 一键生成（实跑 rc=0 验证通过）。
- **WebFetch 核查（Python 直连被 Cloudflare/登录墙挡）**：X官方/国内官方/媒体/中文热榜/视频平台，`topic_pool.py` 打印核查清单，选题时由 agent 用 WebFetch 补全。
- **对齐规则**：公众号 `lib/all_sources.py` 更新时须同步复制至口播稿 `工具脚本/all_sources.py`（同一份信源，手动对齐）；`x_sources.py` 已并入 all_sources 的 x_official 段，不再单独维护。
- **选题池机制**：每次选题前跑 `topic_pool.py` 生成 `Output/选题池_MMDD.md`，以真实拉取热点为准，**不写未核实型号**（0709 GLM-5.2 教训 + 0716 稿型号与真实发布偏差的复盘）。
- 原「模型发布热点专项扫描」在 aihot `ai-models` 基础上，扩展为「aihot 全分类精选 + X 官方动态 + 全网交叉」多源验证，避免漏抓当日最热集群。

### 2.1.2 选题拆解与写作流水线 SOP（2026-07-20 固化·回答"选题怎么选、稿怎么写"）

> 根因：用户两次追问"今天的选题库怎么选的、怎么写出的这些稿"。本小节把分散在 2.1 / 2.1.1 / 2.4 / 四、工作流全流程 / 12.4 的选题与写作规则，收敛成一套可复用、下次不用再问的 SOP。

**A. 选题拆解（先定 8 篇"写什么"）**

1. **时效闸门（前置·硬门槛）**：候选消息必须过「24 小时新消息判定铁律」（见 2.1 顶部）——旧闻、以及"旧消息当天重发/二次转发"一律进不了候选池（判定以**原始首次发布时间**为准）。
2. **发布潮锚定**：跑 `hot_topic_coverage_gate.py` 判定近 7 天模型发布是否 ≥3 条（发布潮）。是 → 8 篇须覆盖 ≥2 个不同模型发布实体；用户点名了模型 → 点名的必须全部出现。
3. **段内话题 + T+1 视角**：以本会话既定段内话题词为骨架（口播稿**无独立"选题库"工具**），写稿日 T 选题时按"发布日 T+1 仍第一手/仍发酵"挑优先级（隔夜海外一手源最佳，当天已刷屏过气的让位）。
4. **人群视角拆 8 篇**：把热点切到不重样视角——家长/职场人/创业者/学生/投资者/普通人/副业者/政策监管，传导链与结论不得雷同（选题查重铁律 2.4）。
5. **栏目铺排**：8 篇覆盖 ≥4 个栏目（热点快评≤3 / 实用干货≥1 / 智商税+翻车≥1），A1 放五维评分最高。
6. **五维评分（12.4）** 过滤：全员痛点≤2 淘汰，总分≥15 S 级必做。

**B. 写作流水线（再定"怎么写"）**

1. `project_boundary.py init koubo` 锁域（机器级防窜墙第一层）。
2. **联网核实真实数据**：每篇动笔前就选题 WebSearch/WebFetch 扒真实参数/价格/评测/落地数，灌成干货锚点（上一轮"全是口水话"根因=套话+编数，重写时以此根治）。
3. **约束优先写作法（2.8）**：动笔前算预算（字数475/"我"9/转折1/收藏≥5），写中 `koubo_live_check.py` 实时自查，写完即修。
4. **按硬门禁落笔**：字数470-490、"我"≥8、280-380 二次冲击（转折+冲击类型）、前3秒冲突（#25）、开头 8 族每族≤2（classify_opening）、禁口水话/自报家门（#22）/关注我收束（#26）/生造歧义词（#23）。
5. **双门禁迭代到全绿**：`koubo_quality_gate.py` + `koubo_validate.py` 跑通，FAIL 即修；`hot_topic_coverage_gate.py` 作为交付前硬门禁 FAIL=阻断。
6. **全量显示打点（6.2.4）**：`koubo_display.py` 全量贴对话框 → `--mark` 写检查点 → 再跑 validate 须"检查点已匹配✓ 全部通过"。
7. **边界扫描兜底（零·C.4）**：`scan_boundary.py` → 0 残留才可宣称完成。
8. **归档收尾（8.1）**：`archive_daily.py --finalize` + `--check` 返回 0。

**铁律**：本 SOP 与 2.1 / 2.1.1 / 2.4 / 四、工作流全流程 / 12.4 同源同义，冲突以本 SOP 与 2.1 顶部 24h 规则为准；凡新增选题/写作机制，须同步 AGENTS.md + SKILL.md + 项目 MEMORY.md + 当日日志。

### 2.2 事实核查铁律（Phase 0.6）

- 每篇稿件中涉及的**所有事实**（产品发布时间/定价/数据/公司行为/政策法规），**必须**联网核实后才能动笔
- 每篇至少搜索2次：一次核实事件真实性+时间，一次核实关键数据/定价
- 核查结果必须在对话中展示留痕
- 搜索不到的信息**不写**，用其他已核实信息替代
- **绝对不允许凭印象写事实**，搜索结果是唯一事实来源
- 核查通过后才允许开始写作

> **0709 A7血泪教训**：GLM-5.2定价和发布时间未经联网核实就写入稿件，用户录制发布后才发现事实有误，无法挽回。

### 2.2.1 Phase 0.7 热点覆盖自检（2026-07-16 新增·交付前硬门禁）

> **根因**：0715 八篇口播稿把 8 篇分散到「人群视角」（监管/端侧/机器人/编程/就业/月活/估值/企业AI），**零篇覆盖当日最热叙事「大模型密集发布」**——只因选题流程只强制泛 WebSearch，没有锚定当日最热集群的强制步骤，也没拉 aihot 的 `ai-models` 模型发布分类，更无覆盖自检门禁。用户点名 Kimi K3 / DeepSeek V4 / GLM-5.3 / MiniMax M3.1 / Claude Opus 5 / Gemini-3.5 Pro 等模型时，AI 竟误以为已覆盖（实为公众号覆盖，非口播稿）。本 Phase 永久杜绝此类漏抓。

**执行步骤（写作完成后、交付前必跑）**：

1. 运行 `python 工具脚本/hot_topic_coverage_gate.py Output/MMDD.txt`（若用户在对话中点名了具体模型，追加 `--extra-keywords "Kimi K3,DeepSeek V4,..."`）。
2. 脚本自动拉 aihot `ai-models`（近7天精选）+ 精选总览，判定是否「发布潮」（窗口内模型发布 ≥3 条）。
3. 判定规则：
   - 发布潮存在 **或** 用户点名了模型 → 8 篇必须提及 **≥2 个不同模型发布实体**（正则抽取），否则 FAIL。
   - 用户点名的具体模型 **必须全部出现**，缺一个即 FAIL（直接对应「用户点名的热点没写」投诉）。
4. **FAIL = 阻断交付**：必须补写/修改覆盖热点后重跑，直到 PASS。
5. 该门禁已接入 `pre_publish_check.py --all` 第 5/5 步，rc≠0 自动阻断发布。

**铁律**：绝不允许把公众号已覆盖的热点当成口播稿已覆盖；口播稿覆盖以 `Output/MMDD.txt` 实际正文为准。

### 2.2.2 流量增长双门禁（2026-07-16 新增·交付前硬门禁）

> **根因与目的**：用户确认 7/14–7/15 口播流量明显掉量，三大伤流量因素（开头死模板/漏抓热点/过度结构化）已修复；但"不差"≠"更好"——算法核心信号权重为 **完播率 > 评论/互动率 > 转发收藏 > 关注**。为此新增两道直接拉权重的硬门禁，并翻转旧的"禁 CTA"策略。

**① 门禁 #25 前3秒冲突强度（硬 FAIL）**：开头第一句（到第一个句号）必须含以下任一强钩子信号，直接拉前3秒完播率——

- 代价/损失/强动作：多花/白花/亏/赔/丢/裁/删/禁/坑/雷/炸/崩/抢/慌/吓/肉疼/烧钱/白搭/流钱/贵/省/涨/跌/封/停/卷/作废/废
- 反共识/戳破：都说/都以为/人人都/别信/别被/别迷信/其实没/根本不/戳破/真相/骗局/智商税/坑你/别再/醒醒/别只
- 身份刺痛：你(的)(手机/会员/账单/公司/钱/工资/主业)/普通人/创业者/副业/小白/新手
- 好奇缺口：为什么/凭什么/怎么做到/没想到/竟/居然/说实话/承认吧/你中招/你踩

**② 门禁 #26 结尾评论钩子（硬 FAIL）**：结尾末句必须抛**问题 / 二选一 / 你…互动邀请**，直接拉评论率（算法顶级权重）。允许信号：问号；或 `评论区/说说/聊聊/报个数`；或 `你选哪个/你站哪边/你服不服/认不认同/同不同意/你敢/你说是`；或 `你(用过/踩过/遇到/中招/花/亏/试过/选/站/服/认同/说是/猜/说呢/觉得/敢/发现/缺/中了/做过/换过/用对/用错/卡过/开过/退过)`。

- 注意避开 AI 腔生硬反问（难道不是吗/不是吗/对不对/是不是/你信吗/真的假的/怎么可能），由 #22 拦截。

**③ CTA 策略翻转（2026-07-16）**：旧的"禁问号结尾 / 禁评论区CTA"规则**已推翻**。评论/转发/收藏 互动引导现在**鼓励甚至必需**（拉评论率/转发率/收藏率）。`CTA_PATTERNS` 现仅保留真正的订阅/私信/导流类为硬 CTA（仍禁）：`点个关注/关注我/来找我/私信我/加我/下期/下集`。本文档旧处（3.2 / 6.2 / 6.2.9 等）"禁止问号结尾/禁止评论区"表述**一律以本门禁为准**，属过期表述。

- **2026-07-20 用户铁律·「关注我」类收束彻底废除**：口播稿**不再写**"关注我，XXXXX"这类结尾引导。原代码里对"关注我，XXXXX"的「标准收束豁免」已移除，`koubo_validate.py` 第8项 CTA残留 + 结尾CTA检查现在命中"关注我"即整篇 FAIL。结尾一律用评论钩子问句/金句/态度收束（见 #26），禁止任何形式的"关注我/点个关注"收束。

**④ 结尾句式多样性（2026-07-16 调整）**：`反问结尾` 因是评论钩子必选项，豁免 >3 上限；模板化由跨篇逐句去重（≥12字）兜底。其余结尾类型（比喻金句/行动式/感慨式/陈述收尾）仍 ≤3 篇防同质。

- 两门禁已写入 `koubo_validate.py`（#25/#26），随 `pre_publish_check.py --all` 自动执行，FAIL 即阻断交付。

### 2.3 瑕疵当场修复铁律

- 发现任何瑕疵必须**当场修复后交付**，禁止只列出问题等用户说"改"
- 初稿即终稿：交付物必须一次到位、优化到极致
- 不允许"先交粗稿再迭代"

### 2.4 选题查重铁律

- 对比维度不仅是标题/事件名，更要对比核心论点、传导链、结论是否雷同
- 即使事件不同，如果传导链和结论一样就是重复
- 绝对不允许跟之前写过的内容雷同

### 2.5 内容红线

- **严禁硬扯孩子**：可以谈教育，但不能每条都硬拐到"你家孩子怎么办"。教育≠孩子教育，AI素养教育/职业转型教育/成人自我提升都算教育
- **"孩子"出现次数8篇总计≥5次=人群固化，必须重写**
- 人群必须随机串换：家长/职场人/程序员/创业者/投资者/普通人/学生等
- **纯新闻播报型完全禁止**：只说"发生了什么"没有个人观点/方法/判断的不做
- **纯工具参数介绍型完全禁止**：芯片规格/模型参数/技术术语堆砌不做
- 每篇必须回答"So what?"——观众看完必须知道"这跟我有什么关系"+"我该怎么做/怎么想"
- **封面图禁止自动生成**（叠字/改图），构建脚本不含cover_gen代码，文章不需要封面图
- **多话题融合**：分别独立解读，禁止对比/PK结构

### 2.6 人设与真实感铁律（2026-07-11 用户强制·杜绝"假人设/编亲戚/无真实经历"）

> 根因：此前人设写成含糊的"AI培训学校老板/自媒体人"，且钩子模板自带"我同事用AI…"示例，
> 导致模型大量编造同事/表姐/亲戚/朋友当佐证，全文没有创始人真实经历，整体"假"。本铁律永久生效。

- **真实人设（最高权威）**：第一人称"我"= **李总**，即智汇AI教育创始人、智汇AI集团创始人、吉林省爱智汇人工智能科技有限公司法人。所有个人经历/观点/判断从这个真实身份出发，不借用任何虚构第三方。
- **禁止虚构社会关系佐证（零容忍）**：严禁编造"同事/表姐/亲戚/朋友/邻居/我妈我爸/我认识的XX医生/身边五个小朋友"等作为案例、社会证明、情感锚点。这是稿件"假"的最大来源，命中即打回。
  - 创始人唯一已确认亲属：**儿子（2岁半，2026-07，男孩）**。任何"我孩子/我儿子"引用须符合该事实（不得写成上学儿童）且源自`真实素材库.md`；父母/表姐/亲戚/同事/朋友等均未确认，**一律禁止编造**。
  - 唯一允许的"他人"指代：①公开可查的公众人物/公司行为（如奥特曼改口、MiniMax闫俊杰停薪）；②明确标注为"假设/举例"的虚拟场景（"假如你是个会计…"）；③**经用户本人确认**的真实案例（须先写入`真实素材库.md`）。
- **真实经历锚定**：每篇至少嵌入一段创始人真实经历（踩坑/失败/客户真实反馈/行业观察/创业转折），来源只能是`真实素材库.md`。无对应素材时，改用创始人对公开事件的真实判断+公开数据，绝不编亲戚凑数。
- **写稿联网检索真实案例（强制·2026-07-11 用户强制）**：每篇写作前，AI 须就选题**实时联网检索大量真实公开案例**（普通人靠AI逆袭/变现、AI翻车幻觉被坑、AI替代裁员、孩子用AI、银发族被割韭菜等五大类，检索模板见`公开真实案例库.md`），**深度分析后再落笔**，并以创始人（李总）视角引用（"我最近看到个真事…""这事我怎么看…""我们做AI教育的，见过太多这种…"），严禁把公开案例改写成虚构私人关系（表姐/同事/亲戚）。
  - 案例必须**可溯源**（带具体人物/公司/时间/来源），禁止杜撰细节；引用时只做真实判断与分析，不改事实。
  - 每次检索到的高质量案例，深度分析后**追加进`公开真实案例库.md`并附来源URL**，形成可复用素材库；写稿时优先复用库中案例，但仍须就时效性再检索刷新。
  - 用户原话："你自己应该写的时候实时去网上去找大量的这类真实的事情，然后自己深度分析后写进来。"——这是硬性工作流，不是可选项。
- **失败经历是核心资产**：真实失败/踩坑/错误判断比成功更有可信度。真实素材库须含创始人的创业失败、错误预判、客户翻车等硬核素材；AI生成的"完美无失误人设"一律视为假。
- **人称纪律**：讲自己用"我/我们智汇AI教育/我们团队/我公司"；讲观众用"你/你家/普通人"；严禁把"我"的社交圈写成虚构亲属同事。
- **公司全称纪律**：口播稿正文可自称"智汇AI教育创始人/李总"，不堆砌公司全称；公司全称"吉林省爱智汇人工智能科技有限公司"仅用于公众号文末"作者注"做GEO（正文禁用，避免CSDN广告判定）。
- **禁止商业名片式自报家门（2026-07-20 用户铁律·零容忍）**：口播稿正文**不得写**"我是做AI教育的李总/我是李总/我就是李总/我叫李总"等商业名片式自我介绍——这是AI模板腔，生硬且别扭（账号名已含"李总"，用户原话："我是做AI教育的李总 这种话怎么还能出现呢？"）。人设一律用"我办学/我带学员/我们做AI教育的"自然带出即可（与 8 篇统一口吻）。`koubo_validate.py` 已新增 **#22 硬门禁「生硬自报家门」**，命中即整篇打回（同语义通顺级，不阻断仅提示的 soft 项）。

### 2.7 禁生造/压缩导致歧义的词（2026-07-14 用户强制·零容忍·根绝复发）

> **根因（0714 A8 事故）**：稿件原写"深圳龙岗的AI龙老师"，把"深圳龙岗区发布的'龙老师'AI教育产品矩阵"压缩成"AI龙老师"——听者会以为"姓龙的老师"，完全偏离原意。缩写/压缩字节省力但**制造歧义即制造失真**。用户原话："这种问题不可以再发生 不可以这么压缩 请彻底杜绝！！"
>
> **机制**：① 生成阶段本禁令直接禁止；② `koubo_validate.py` 新增 #23「生造歧义词」硬门禁 + `koubo_live_check.py` `BANNED_AMBIG_COMP` 实时扫描 + `koubo_quality_gate.py` ⑫项检测，命中即整篇 FAIL，从结构上彻底杜绝。③ 跨稿词表（`TERM_CANONICAL_DICT`）强制统一专业产品/项目称谓，写法不允许多版本。

| 类别                     | 禁用表现                                                                         | 正确替代                                                                        |
| ------------------------ | -------------------------------------------------------------------------------- | ------------------------------------------------------------------------------- |
| **① 姓氏+职业压缩**      | "AI龙老师""AI张博士""AI王经理"（听者会以为"姓X的XX"）                            | 写明全称"深圳龙岗'龙老师'AI教育产品矩阵"或"复旦肖仰华教授的AI出题法"            |
| **② 公司/产品/项目称谓** | 把官方全称压缩成简称，导致语义漂移（如"阶跃"代"阶跃星辰"、"豆包"代"字节豆包"）   | 第一次出现写全称+简称（如"阶跃星辰（简称'阶跃'）"），后续可统一用简称           |
| **③ 数据/单位压缩**      | "差了一倍"（实际是73%）、"涨了3倍"（实际是涨了200%）、"多卖三万套订阅"（未核实） | 写具体数字："差了近五百个token，差率七成三""涨了2倍（即翻三倍）"                |
| **④ 行业术语生造**       | 把两个概念生硬拼成新词，读者看不懂（如"agent壳""智能体壳"已通过上下文勉强可解）  | 优先用既有术语；如必须生造，第一次出现要解释（"智能体壳=硬件只是智能体的载体"） |
| **⑤ 标题压缩歧义**       | 标题字数硬卡15-23字而省略关键信息，导致标题与正文表述不一致                      | 标题用读者能立即get的指代；如长度紧张可拆"分号/破折号"双段，禁砍关键限定词      |

**跨稿统一词表（`TERM_CANONICAL_DICT`）—— 与本铁律配套强制执行**：

| 类别             | 强制写法                                               | 禁止写法                                  |
| ---------------- | ------------------------------------------------------ | ----------------------------------------- |
| AI教育产品       | "深圳龙岗'龙老师'矩阵"或"龙老师AI教育产品矩阵"         | "AI龙老师""龙老师矩阵"                    |
| 阶跃星辰产品     | "STEPX Neo（阶跃星辰智能体手机）"或"阶跃星辰STEPX Neo" | "Neo手机""智能体手机"（仅指代自家产品时） |
| Anthropic Claude | "Claude Fable 5"或"Anthropic Fable 5"                  | "Fable 5模型"（简省掉厂商，听者不识）     |
| GPT              | "GPT"（通识英文缩写）                                  | "OpenAI GPT"每次冗余全称                  |
| 字节豆包         | "字节豆包"或"豆包"                                     | "豆包AI"（多此一举）                      |
| 裁员报告         | "挑战者公司（Challenger Gray & Christmas）报告"        | "挑战者报告"（读者不识）                  |
| 数据百分比       | "差率X%"或"高出X%"                                     | "差了一倍""翻倍"（口语模糊=失真）         |
| 时间日期         | "7月13日"或"2026年7月13日"                             | "7.13"（小数点歧义）                      |

**检测机制（三处同步）**：

- `koubo_validate.py` 新增 #23 项 `生造歧义词` 检查：
  - 标题/正文含"AI+单字姓氏+职业"模式（"AI龙老师""AI张博士"等）
  - 含跨稿词表 `TERM_CANONICAL_DICT` 内的禁写写法
  - 含未在脚本常量中定义的产品/项目名（每篇新出现的项目/产品名，写作时须登记到 `TERM_CANONICAL_DICT`）
- `koubo_live_check.py` 新增 `BANNED_AMBIG_COMP` 列表实时扫
- `koubo_quality_gate.py` 新增 ⑫项「跨稿词表一致性」

**生成阶段禁令**：写作时一旦发现"想写简称"念头，强制回答三个问题——① 听者能否第一秒知道指谁？② 是否会与既有产品/人名/品牌混淆？③ 全文是否一致？任一回答"否"= 写全称或重命名。

**新项目/产品/事件出现时强制登记**：每篇新增的"产品/项目/事件"全名，写作完毕后**必须**追加到 `koubo_validate.py` 的 `TERM_CANONICAL_DICT`（含全称、唯一推荐简称、禁用别名），下篇起校验脚本会强制统一。

**【2026-07-14 v1.1 改造】统一权威源**：BANNED_AMBIG_COMP / TERM_CANONICAL_DICT 已从各脚本迁出，统一在 `koubo_terms.py` 定义并 export。三脚本（koubo_validate.py / koubo_live_check.py / koubo_quality_gate.py）+ 双扫描器（scan_ambig.py / scan_canonical.py）必须 `from koubo_terms import ...`，禁止重复定义。新增词条只需改 `koubo_terms.py` 一处。

**【2026-07-14 v1.1】案例库（实际反例+正例对照，写作时人工参考）**：

#### 案例 #1 — 0714 A8（事故起源）

- ❌ "AI龙老师" → 听者第一反应"姓龙的老师"
- ✅ "深圳龙岗'龙老师'AI教育产品矩阵" → 一听就懂
- 规则：姓氏+职业压缩，听者会以为"姓X的XX"

#### 案例 #2 — 0709 A3 标题

- ❌ "AI博士年薪却涨到了六百万" → "姓AI的博士"？
- ✅ "AI研究方向博士年薪却涨到了六百万" → 一听就懂
- 规则：把"研究方向"或"细分领域"显化

#### 案例 #3 — 0704 A3 正文

- ❌ "这次效率直接翻了三倍" → 原来 3 倍（涨 200%）还是涨了 3 倍（涨 300%）？
- ✅ "这次效率直接提升了两百个百分点" → 无歧义
- 规则：模糊倍数一律改写为具体百分数

#### 案例 #4 — 0708 A2 正文

- ❌ "有些场景差了一倍" → 对手的两倍？不到对手的一半？
- ✅ "有些场景的得分只有对手的一半不到，差距接近一百个百分点" → 零歧义
- 规则：用具体数字+对比基准说明

#### 案例 #5 — 0713 A4 标题

- ❌ "复旦教授这招让我看完坐不住了" → 哪个复旦教授？
- ✅ "复旦肖仰华教授这招让我看完坐不住了" → 锁定具体人
- 规则：正文讲的是某人时，标题必须点出名字

#### 案例 #6 — 0714 A7 标题

- ❌ "字节图像编辑模型上线设计师慌了" → 哪个产品？
- ✅ "字节Seedream 5.0 Pro,有人慌了" → 一听就懂
- 规则：标题用产品官方全名，不用描述性类目词

#### 案例 #7 — 0705 A4 正文

- ❌ "这个赛道至少还能再涨五倍" → 涨 5 倍（涨 500%）还是涨到 5 倍（涨 400%）？
- ✅ "这个赛道按当前增速还能再翻几番，未来几年的增长空间至少有四倍" → 拆解为"翻几番"+"至少四倍"
- 规则：模糊倍数用"翻几番"或具体百分数

#### 案例 #8 — 0707 A6 正文

- ❌ "效率比人工高一倍" → 人工的两倍（高 100%）还是高出一倍（高出 100% 变 200%）？
- ✅ "效率是人工的近两倍" → 简单明确
- 规则：用"是X的N倍"或"高出X%"等无歧义表达

#### 案例 #9 — 0709 A1 正文

- ❌ "产能翻了一倍多" → 100%？150%？
- ✅ "产能提升了百分之一百多，比之前多产了一倍以上" → 具体区间
- 规则：模糊倍数用百分数区间表达

#### 案例 #10 — 0702 A7 正文

- ❌ "用AI做报表比以前快三倍" → 听者不知道具体数字
- ✅ "用AI做报表，效率直接提升了两百个百分点" → 用百分数
- 规则：可量化的对比一律用具体百分数

> **写作流程**：
>
> 1. 写完一段，回看本案例库 5 个案例，确保新内容不属于其中任一类
> 2. 跑 `python scan_ambig.py 0714.txt` 实时扫描
> 3. 命中即改，不要尝试绕过（脚本是底线，案例库是上层防线）

### 2.8 约束优先写作法（v2026-07-12 新增·杜绝迭代返工）

> **教训**：0712写作从V1到Vn迭代20+轮，根源是"写完才验→失败→修→再验"。从今天起，采用"先算预算→写中实时自查→写完一次性过"的模式。

**写作前必设预算（每篇5秒算完）**：

| 约束项                | 目标                    | 工具                  |
| --------------------- | ----------------------- | --------------------- |
| 字数                  | **475**（留15字缓冲）   | `koubo_live_check.py` |
| "我"次数              | **9**（留1个冗余）      | 同上                  |
| 句子长度              | **≤35字**               | 同上                  |
| 280-380转折词         | **≥1个**，8篇用不同类型 | 同上                  |
| 教练词                | **≥1个**                | 同上                  |
| 收藏分                | **每篇≥4，均分≥5**      | 同上                  |
| 转折/其实/我自己/真正 | **各不超过跨篇上限**    | `--quick` 模式        |

**写作中实时自检**（写完每篇立刻跑）：

```bash
python koubo_live_check.py "正文内容..."
```

✗ 即修，不等8篇写完回头改。

**写作后一次性验证**（8篇全绿才进双门禁）：

```bash
python 工具脚本/koubo_live_check.py --all Output/MMDD.txt    # 先自查
python 工具脚本/koubo_live_check.py --quick Output/MMDD.txt  # 再跨篇
python 工具脚本/koubo_quality_gate.py Output/MMDD.txt         # Gate①
python 工具脚本/koubo_validate.py Output/MMDD.txt             # Gate②
```

**核心阈值速查**（全部与 `koubo_validate.py` 一致）：

- 字数 470-490 | 句子 ≤42硬FAIL/≤33软WARN | "我" ≥8
- 转折白名单含"不过/然而/其实/但/却/原来/结果/没想到"等28词，**不含"可"**
- 收藏5维每维0-2分，关键词："步骤/方法/成本/避坑/工具/框架/法则/铁律"
- "但"≤5篇 / "其实"≤5次 / "我自己"≤2次 / "真正"≤3次 / 感慨式结尾≤3篇

---

## 三、永久禁令（任何稿件中出现=直接打回）

### 3.1 永久禁用表达

| 禁用表达               | 禁用原因                       |
| ---------------------- | ------------------------------ |
| "而且我告诉你，"       | 姿态是上位者教育下位者，太说教 |
| "而且我跟你说，"       | 语气不礼貌，居高临下说教感     |
| "写到这里手心都是汗的" | 太假                           |

### 3.2 永久禁用结尾模式

- **列举式结尾**：任何"三条/三样/三件事/三个+冒号+一、二、三列举"形式，太机械太AI
- **订阅/私信/导流CTA（仅此类仍禁）**："点个关注""关注我""来找我""私信我""加我""下期""下集"——见 2.2.2 CTA策略翻转
- **评论区/转发/收藏互动引导现已允许并鼓励**（"评论区报个数""你选哪个""说说你的看法"等），是 2026-07-16 新增的结尾评论钩子门禁（#26）的合规落地方式，不再判为CTA残留
- 结尾必须是自然语句、态度金句、情感收束或反问（反问结尾豁免多样性上限，见 12.2）

### 3.3 永久禁用开头模式

- 纯信息播报："XX公司发布了XX"、"据了解，XX政策规定XX"
- 新闻播报腔："近日"、"据了解"、"据报道"开头
- 结论先行：第一句就把核心结论说完了
- 英文品牌名开头（普通人听不懂）
- 慢热故事铺垫（无冲击）

### 3.4 抖音平台安全红线（触犯=限流/封号）

| 红线类型   | 敏感词/行为                              | 后果      |
| ---------- | ---------------------------------------- | --------- |
| 绝对化用语 | 最、第一、全网首创、独家、首选           | 限流      |
| 诱导互动   | 不转不是中国人、不转封号、转给X个人      | 限流      |
| 夸大虚假   | 保证赚钱、稳赚不赔                       | 封号      |
| 人身攻击   | 穷人、富人、阶层固化、男女对立           | 限流      |
| 医疗健康   | 治病、治愈、偏方                         | 封号      |
| 金融投资   | 收益率、保本、荐股                       | 限流/封号 |
| 限流敏感词 | 免费、白嫖、赚钱、副业、暴富、内幕、揭秘 | 限流      |

> 注意：写AI+赚钱/副业类选题时，必须规避"免费""白嫖""赚钱""暴富"等词，用"省成本""提效""降门槛"等替代。

### 3.5 正文自然度永久禁令（2026-07-11 用户铁律：彻底杜绝三类病句 + 2026-07-12 四条新规则）

> **根因**：0711 篇8 出现三句典型病句——"那我们教AI平台到底该学什么？"（语义错乱）、"最关键就一点：…"（空头论点，承诺单一论点却没立住）、"…学了之后拿来干什么，难道不是吗？"（AI腔生硬反问收尾）。校验脚本原 18 项未覆盖这三类，故漏出。
> **机制**：① 生成阶段本禁令直接禁止；② `koubo_validate.py` 新增 #20/#21/#22 三道硬门禁，命中即整篇打回，从结构上彻底杜绝。

| 禁令               | 禁用表现                                                                               | 正确替代                                                                       |
| ------------------ | -------------------------------------------------------------------------------------- | ------------------------------------------------------------------------------ |
| **① 语义错乱句**   | 动宾/偏正错配、无主悬空、读不通的短语（如"教AI平台""用AI平台到底该学什么"）            | 主语/谓语/宾语必须齐备且搭配合理；"让孩子用AI学点什么"而非"教AI平台"           |
| **② 空头论点**     | "最关键就一点/关键就一条/说白了就一句"等承诺单一论点，但后文直接跳到行动、未先立住论点 | 承诺词后必须紧跟一个明确判断句（是/在于/比…重要/本质），再接行动引导           |
| **③ AI腔收尾反问** | 正文结尾生硬反问："难道不是吗？""不是吗？""对吧？""是吧？""你说呢？"                   | 结尾用自然陈述/态度金句/行动引导，禁止生硬反问（置顶评论本就禁反问，正文同理） |

- 任何稿件正文出现以上任一类 = 直接打回重写（与置顶评论反问禁令同级别）
- 种子黑名单见 `koubo_validate.py` 的 `BANNED_GARBLED` / `HOLLOW_POINT_ANCHORS` / `AI_RHETORIC_END_PATTERNS`，今后出现新的读不通句式，**必须追加到对应常量**，保持门禁持续有效
- **虚构社会关系检查（0711 终轮 23:51 强化·彻底杜绝）**：`koubo_validate.py` 与 `koubo_quality_gate.py` 的虚构检测**均已去掉 `break`**——命中即逐条报出全部虚构，不再只报第一条（避免「修一条漏一条」复发，0711 曾因 `break` 漏报 A7「我认识一个影像科医生/我认识的人里」与 A4「好几个同事」）；朗读门禁 ⑦ **额外扫描 `[置顶]` 文本**，置顶藏虚构也逃不掉。新增虚构句式同样追加到 `FAKE_THIRD_PATTERNS`（含 `模糊量词` 规则：好几个/几个/一些/那些 + 同事朋友家长等均属虚构社交圈，禁止）。

#### 2026-07-12 四条新规则（用户强制·杜绝模板化/同质化）

> **背景**：0712 8篇口播稿经20+轮迭代后，暴露出开头模板化（篇篇"太X了/吓一跳"起手）、结构同质化（篇篇"新闻→分析→我做AI教育→建议清单"流水线）、结尾清单化（篇篇"三步法/三点建议"收尾）、标签与内容不匹配（标签写AI工具但正文全讲裁员）四类系统性问题。以下四条规则已硬编码到 `koubo_validate.py`、`koubo_quality_gate.py`、`koubo_live_check.py` 三重门禁。

| #     | 规则                              | 禁止表现                                                               | 检测机制                                                                   | 正确做法                                                                                          |
| ----- | --------------------------------- | ---------------------------------------------------------------------- | -------------------------------------------------------------------------- | ------------------------------------------------------------------------------------------------- |
| **④** | 开头多样化                        | "太可怕了/太吓人了/吓我一跳/炸锅了/出大事了/太离谱了"等模板化起手      | `BANNED_TEMPLATE_OPENINGS`（validate+gate+live_check 三处同步）            | 每篇用不同情绪钩子类型起手：提问式/数据直击/个人忏悔/直面威胁/现象开场/事件导引/对比叙事/行业诊断 |
| **⑤** | 结构各异                          | "新闻播报→分析→我做AI教育→建议清单"同一流水线套8篇                     | `PIPELINE_MARKERS` 检测三要素同时命中（news_start+edu_anchor+list_advice） | 每篇设计不同叙事结构：悬念递进/对比展开/故事开场/诊断式/递推式/反转式/清单融入式/金句锚定式       |
| **⑥** | 建议自然融入                      | 结尾"建议三步/记住三点/给你三条/做到三条/牢记三条"等清单式收尾         | `SOFT_LIST_ENDING` 正则（validate+gate+live_check 三处同步）               | 建议拆散融入正文各段，在叙事中自然带出"你不妨先XX""你试试XX"，结尾用金句/态度/留白收束            |
| **⑦** | AI味零容忍（2026-07-13 用户强制） | 机械列举排比/硬数字轰炸/AI腔套话/八股结构/伪权威引用/空洞强调/转折堆积 | `AI_TASTE_PATTERNS`（quality_gate.py ⑪项 + live_check.py ⑪项，命中即FAIL） | 用自然口语化叙述替代机械套路；具体见下方 3.6 AI味检测禁令                                         |

### 3.6 AI味检测禁令（2026-07-13 用户强制·AI味=0才可交付）

> **根因**：0713 终版检测发现大量"先X再Y最后Z"机械排比、"三个/三条"硬数字集中轰炸、"问题来了"八股过渡等典型AI生成套路。用户明确指出"重点不是三个，而是列举排比形式太AI味了"。

**铁律**：以下任何模式命中 = 直接FAIL，禁止交付。

| 类别               | 禁止表现                                                                               | 正确做法                                           |
| ------------------ | -------------------------------------------------------------------------------------- | -------------------------------------------------- |
| **机械列举排比**   | "先X再Y最后Z"、"第一第二第三"、"一、二、三"顿号序列                                    | 用自然叙述替代，如"我习惯先啃论文再顺手读两段源码" |
| **硬数字集中轰炸** | "三个/三条/三件事/三个指标/三个环节"集中出现                                           | 改用"多场景/几个/几件/这几个环节"                  |
| **AI腔套话**       | "值得注意的是"/"不难发现"/"不可否认"/"总而言之"/"综上所述"/"从XX角度来看"/"随着XX发展" | 删除套话，改为直接判断或自然表达                   |
| **八股文结构**     | "问题来了"/"答案是"/"这意味着"/"这说明了"                                              | 用自然过渡或直接陈述替代                           |
| **伪权威引用**     | "研究表明"/"专家指出"/"据统计"（无具体来源）                                           | 给出具体出处，或改为"我见过/我统计过/数据显示"     |
| **空洞强调**       | "至关重要"/"不可或缺"/"具有重要XX"                                                     | 用具体判断替代，如"方向比热闹重要"                 |
| **转折堆积**       | 三重以上"但是"堆积在同一段                                                             | 精简为一次转折，或改用"然而/不过/可"交替           |

**检测机制**：`koubo_quality_gate.py` ⑪项 + `koubo_live_check.py` ⑪项 `AI_TASTE_PATTERNS`，命中即FAIL，0容忍。写作阶段 live_check 实时 flagged，终检 quality_gate 再验一次。
**生成阶段禁令**：写作时一旦发现自己想写上述套路，立即换一种自然说法。这些模式是AI生成文本的典型指纹，必须彻底从稿件中消失。

### 3.7 模板化判断词禁令（2026-07-15 用户强制·跨篇≥3篇即FAIL）

> **根因**：0715 稿用户指出"文案里怎么都是 我判断 这三个字呢 每篇都是 大量的在用"——8篇中7篇用同一"我判断"做下判断开头，是典型模板化硬伤，AI味重、读感重复，用户明确反感。

**铁律**：同一"我X"判断类开头词（如"我判断"）禁止在 ≥3 篇文章中重复使用。每篇下判断必须用不同说法。

| 错例（禁用）       | 正确（每篇换一种）                                                                      |
| ------------------ | --------------------------------------------------------------------------------------- |
| 我判断…（7篇复用） | 我看下来 / 我琢磨着 / 我估摸着 / 我看得清 / 我认定 / 我心里有数 / 我发现 / 我越想越觉得 |

**约束细节**：

- 替换时**必须保留"我"字**（否则部分篇"我"次数会从 8 掉到 7，触发 validate 硬 FAIL）
- 替换后字数仍须在 470–490（A6/A8 已顶满，替换词不得加长，如"我认定"后不加逗号）
- 跨篇逐句去重、跨篇高频表达仍需各自≤2次

**检测机制**：`koubo_validate.py` 的 `CROSS_ARTICLE_PHRASES` 已含 `'我判断'`，跨篇≥3篇出现即"跨篇高频表达"超标 → FAIL（已反向测试验证：注入3处即报"1个超标: 我判断(3篇)"）。今后新增任何同类模板判断词，追加进 `CROSS_ARTICLE_PHRASES` 即可自动拦截。

---

| **⑦** | 标签与内容一致 | 话题词标签与正文实际内容不匹配（如标签写#AI工具推荐但正文全讲裁员） | `标签内容一致` 逐篇检查（validate 跨篇验证，全覆盖8篇） | 话题词必须准确反映正文主题；写完检查标签与内容是否匹配 |

- 四条规则的检测常量已同步到 `koubo_validate.py`（BANNED_OPENINGS扩展+SOFT_LIST_ENDING+PIPELINE_MARKERS+标签内容一致检查项）、`koubo_quality_gate.py`（⑧⑨⑩⑪四道检测）、`koubo_live_check.py`（template_opening+soft_list_ending+pipeline_structure+ai_taste_hits四处实时反馈）
- 今后任何新的模板化开头/软清单句式/流水线结构，必须追加到对应常量，保持门禁持续有效
- **主动同步铁律（2026-07-11 23:55 用户强制·最高优先级）**：发现门禁/脚本/规则的任何漏洞或可优化点，**必须在本轮内主动、一次性同步**到所有相关文件——脚本本体（`koubo_validate.py`/`koubo_quality_gate.py`/`project_hygiene.py`）+ 本 AGENTS.md + `koubo-workflow/SKILL.md` + 项目长期记忆（`F:\BaiduSyncdisk\自媒体\.workbuddy\memory\MEMORY.md`）+ 当日日志——并**立即跑门禁验证**，**不等用户提醒、不拖到下一轮**。`koubo-workflow/SKILL.md` 是本工作流的技能定义，凡 AGENTS.md 新增的硬禁令/门禁机制，须同步在 SKILL.md 显式声明，二者不得脱节。改完用一句话告知用户"已同步至 X/Y/Z 并验证通过"。反例（已发生·须杜绝）：0711 双门禁硬化本应发现即做，却因被动等待用户两次提醒（"记住""更新好了吗"）才补。

---

## 四、工作流全流程

```
热点采集(≥3次WebSearch + aihot ai-models模型发布专项扫描) → 选题查重(读存档+读近3天正文)
→ 五维评分(全员痛点×4+反转×3+转发×1.5+弹药×1+金句×0.5)
→ Phase 0排版预检(11项核对)
→ Phase 0.5拆解式学习(选对标爆款→还原公式→解释机制→迁移写出,不做不许动笔)
→ Phase 0.6事实核查(每篇≥2次WebSearch)
→ Phase 1初稿写作(自然口语化优先；3句钩子/收尾金句/观点密度≥4/自我诊断结尾/双线设计 均于2026-07-16降级为可选，不再强制，避免模板化伤完播)
→ Phase 2技术验证(Python脚本)
→ Phase 3逻辑连贯性检查(三种逻辑病)
→ Phase 4跨篇去重(高频表达扫描)
→ Phase 5收藏价值终审(5维评分,≥18分/篇)
→ Phase 0.7热点覆盖自检(hot_topic_coverage_gate.py,漏抓当日高热热点→阻断交付)
→ 交付(文件+对话全文显示)
→ 归档收尾(archive_daily.py --finalize：当日MMDD.txt并入 历史稿/历史口播稿汇编.txt，并清空Output)
→ 归档校验(archive_daily.py --check 必须返回0；返回非0=工作流未完成，立即重跑finalize)
```

### Phase 0.5 拆解式学习（2026-07-14 新增·基于爆款拆解方法论·写作前必做）

> **方法论来源**：深度学习两篇爆款拆解文章（余十万·封面提问→正文回答+观点密度；口播脚本逐句公式化拆解），提炼为"还原公式→解释机制→迁移写出"三步法。
> **铁律**：不做拆解不许动笔（与"不搜索不许选题"同级）。拆解卡片在对话留痕。

**4步执行**：

1. **选对标**：从选题存档/已发布记忆中，选1条同类型爆款（播放/点赞最高）
2. **还原公式**：逐句拆解对标的钩子/段落/结尾，还原成公式
3. **解释机制**：每个公式写明"为什么有效"（心理机制）
4. **迁移写出**：把公式套入当天选题，写出自己的版本

**交付物**：写作前在对话中展示"拆解卡片"（对标原文+公式+机制+迁移版本）
**验证**：迁移版本与对标原文的公共子串<12字（避免抄袭）
**素材沉淀**：每次拆解的高质量公式，追加进`素材库.md`的"开头钩子库/收尾金句库"

每个Phase的详细规则见SKILL.md（koubo-daily skill），此处只列铁律和约束。

---

## 五、技术约束硬指标（每篇必验）

| 指标           | 要求                                                                                                                                                                                                                            |
| -------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- |
| 正文字数       | 470-490字（Python len(body)）                                                                                                                                                                                                   |
| 二次冲击位     | 280-380字之间，必须有自然转折/揭示                                                                                                                                                                                              |
| 热点锚点       | 前150字内必须出现具体数字或时间词                                                                                                                                                                                               |
| "我"字数       | ≥8次/篇                                                                                                                                                                                                                         |
| 说白了         | ≤1次/8篇总计                                                                                                                                                                                                                    |
| 真正           | ≤3次/8篇总计                                                                                                                                                                                                                    |
| 很多人         | ≤2次/8篇总计                                                                                                                                                                                                                    |
| 孩子           | <5次/8篇总计（≥5次=人群固化，必须重写）                                                                                                                                                                                         |
| 开头句式多样性 | 8种开头族（你直戳式/数字冲击式/场景代入式/惊叹疑问式/反共识式/时效播报式/身份自述式/其他自由式），每族每天≤2篇；由 koubo_validate.py classify_opening 硬门禁执行（>2即FAIL）；字面"今天用X分钟+最后一个/九成"模板判为"死模板"族 |
| 结尾类型       | 3种轮换，每种每天≤3次                                                                                                                                                                                                           |
| 转折表达       | 每篇不同，禁止跨篇复用同一句式                                                                                                                                                                                                  |
| 句子长度       | **每句话不得超过35个字**，必须在标点处断开                                                                                                                                                                                      |
| 观点密度       | **2026-07-16 降级为可选（非强制）**：鼓励每段带新观点提升收获感，但不再强制≥4个；写作以自然口语为先，避免为凑观点数逼出模板（伤完播）                                                                                           |
| 开头3句钩子    | **可选软技巧（非强制）**：仅作多样性补充，且不得套用"今天用X分钟+最后一个/九成"死模板；强制规则见"开头句式多样性"行（8族≤2/天，koubo_validate.py classify_opening 硬门禁）                                                      |
| 段落收尾金句   | **2026-07-16 降级为可选（非强制）**：金句可自然带出，不再强制每篇≥2种；避免每段硬塞金句导致生硬                                                                                                                                 |
| 结尾自我诊断   | **2026-07-16 降级为可选（非强制）**：软引导可用可不用，结尾以自然收束为准，不再强制"你对照/你想想"套路                                                                                                                          |

### 跨篇去重规则

- 任何短语/表达模式在8篇中出现≤2次
- 包括但不限于："我专门""我自己""你现在""我发现""我查了""我认识""说实话""身边""朋友""意外"
- 扫描范围≥30个高频表达

### 教练穿插要求

- 每篇中间至少1处教练句："你现在可以XX""你试试XX"
- 大约每200字穿插一次，让观众是参与者不是旁观者
- 每篇至少1个具体可执行动作

### 朗读友好规则

- **英文词限制**：常见常规英文词、基础英文词、AI圈常用词（如AI、CEO、API、App、OK、VIP、IPO、Token、Agent、Bug、Demo、web、data、model、train、dataset、token、embed、vector、llm、rag、inference、deploy、sdk、ui、ux、frontend、backend、repo、git、docker、k8s、aws、gcp、azure、json、xml、yaml、csv、md、txt、pdf、png、jpg、jpeg、gif、svg、mp4、mp3、zip、linux、unix、bash、shell、script、command、terminal、ide、vscode等）可直接保留，不标WARN。禁止生僻英文（M3、MSA、TPS、Codex等），必须翻译成中文或括号标注读音
- **数字读法**：百分比读"百分之"，小数点读"零点"，金额数据用汉字+阿拉伯数字混合
- K2.7、GPT-4、Anthropic、OpenAI、Claude、Gemini等属常见词，口播直接读

---

## 六、排版与结构规则

### 6.1 栏目制

- A8（第8篇）**固定为AI+教育**主题
- A1选爆款评分最高的选题（五维总分最高）
- A1-A7按爆款潜力评分从高到低排列
- 5个栏目：热点快评/智商税/实用干货/行业真相/翻车现场

**栏目分配规则**：

- 每天8篇必须覆盖**至少4个不同栏目**
- 热点快评：最多3篇/天（防止变成纯新闻号）
- 实用干货：至少1篇/天（收藏率核心来源）
- 智商税/翻车现场：合计至少1篇/天（互动率核心来源）
- A1-A7各自对应哪个栏目，在选题评分阶段确定，交付时标注
- （2026-07-17 修正：上述「4类齐全」约束针对**批量(≥4篇)**；单篇/少篇(`len(articles)<4`)时该检查降级为 WARN，不计入交付门禁 real_fail——栏目多样性是跨篇统计，单篇无法凑齐属设计性误报。`koubo_validate.py` 已同步此逻辑。）

### 6.2 交付格式

- 文件路径：`F:\BaiduSyncdisk\自媒体\口播稿\koubo\Output\MMDD.txt`
- 对话中**全文显示8篇**供用户复制，不能只写文件
- 每篇结构：爆款标题 → 四层话题词 → 正文
- 不显示"标题""话题词"等标签文字，直接输出内容
- （2026-07-16 起不再生成置顶评论：用户确认其对流量无作用，已取消；正文后不再附[置顶]行）
- **不需要短版**，只有长版
- 每篇内部格式：标题一行、话题词一行、正文一段，行间空行分隔
- 篇与篇之间用分隔线分隔
- 对话框内只展示：标题+话题词+正文。不展示转发语/拍摄提示/情绪标注等幕后分析

### 6.2.2 当篇评估检测数据（2026-07-13 用户强制）

- 每篇口播稿后面**必须紧跟该篇的完整评估检测数据**，不得省略
- 数据来源：`koubo_live_check.py` / `koubo_quality_gate.py` / `koubo_validate.py` 输出
- 至少包含：字数、句子数、单句最长、标点占比、"我"次数、280-380转折词、AI味检测项、收藏分、门禁状态（PASS/FAIL）
- 篇与篇之间用分隔线分隔，正文结束后空一行，再放检测数据块

### 6.2.0 置顶评论钩子（⚠️2026-07-16 已取消·用户命令：置顶评论对流量无作用，今后不再生成）

**作用**：发布后由创作者置顶在评论区第一条，用一句话点燃评论区，刺激互动数据（评论率是2026抖音第三大权重）。

**底层原理**：人回复评论只有一个原因——**认知张力**。读到一句话后心里产生"不对""凭什么""真的吗""我也是"的冲动，不回复就难受。置顶评论的唯一目标就是制造这种张力。

**3种互动驱动**（认知张力的3种具体触发，每条评论至少命中1种）：

| 驱动                   | 心理机制                               | 示例                                         |
| ---------------------- | -------------------------------------- | -------------------------------------------- |
| **被冒犯**（身份防御） | 观众的职业/选择/身份被质疑，忍不住反驳 | "承认吧，你每天重复的那些活儿，AI真的能干"   |
| **被看见**（群体共鸣） | "我也是！"的冲动，不吐不快             | "我花三千八买的AI课，教的跟百度首页一模一样" |
| **被吓到**（认知冲击） | 信息超出预期，必须表达震惊             | "产量占了百分之九十五，播放量只有百分之四"   |

**陈述句铁律**：置顶评论一律用陈述句/感叹句/省略句，禁止用疑问句。陈述句制造"被动张力"（观众自己想反驳），疑问句制造"主动索取"（求回复=低质）。"这事99%的人想反了"比"你知道吗？"强十倍。

**格式**：`[置顶]` + 评论正文（10-45字），一行写完

#### 10种钩子类型（对应10种心理触发，每天覆盖≥5种，每种≤2次/8篇）

| #   | 类型           | 触发心理             | 机制                                         | 示例                                                                     |
| --- | -------------- | -------------------- | -------------------------------------------- | ------------------------------------------------------------------------ |
| 1   | **信息缺口型** | 好奇心（必须知道）   | 故意只说一半，留一个"为什么"让人追问         | "最该慌的不是程序员，是另一个谁都没想到"                                 |
| 2   | **身份戳心型** | 身份防御/共鸣        | 精准戳中某个群体的痛点或骄傲                 | "做了十年会计的人看完这条都沉默了"                                       |
| 3   | **打赌预言型** | 不服气（想反驳）     | 带具体时间+数字的预判，让人想打赌            | "赌一包辣条，明年三月这个功能全国下架"                                   |
| 4   | **自爆共鸣型** | 群体认同（我也是）   | 承认自己踩过坑/犯过错，引发"我也是"          | "去年花三千八买了个AI课，教的全是百度能搜到的"                           |
| 5   | **唱反转型**   | 纠正冲动（不对！）   | 故意说出反直觉/反共识的判断                  | "说实话这个政策利好的根本不是普通人"                                     |
| 6   | **个人数据型** | 质疑/验证冲动        | 用自身经历给出一个具体数据，让人想质疑或验证 | "我团队六个人学AI三个月，四个已经转岗了"                                 |
| 7   | **灵魂拷问型** | 自我审视（被戳到）   | 一句话让人不得不审视自己，陈述句不是问句     | "承认吧，大部分人说学AI其实就是买了个课没打开过"                         |
| 8   | **内行揭秘型** | 求知欲（快告诉我）   | 以业内身份说一个外行不知道的真相             | "做了八年AI培训，说一个行业内心照"                                       |
| 9   | **反差炸弹型** | 认知失调（怎么可能） | 两个不该放一起的事实并排放                   | "我当年做AI教育踩的第一个坑：以为把工具讲明白就行，结果学员根本用不起来" |
| 10  | **预言打脸型** | 看热闹（等着瞧）     | 预判接下来会发生什么，制造期待感             | "等着看吧，三个月内必有一堆人出来道歉"                                   |

#### 4种高级技巧（叠加使用效果翻倍）

| 技巧              | 说明                                     | 示例对比                            |
| ----------------- | ---------------------------------------- | ----------------------------------- |
| **① 具体化**      | 用具体数字+具体人物替代笼统表达          | ❌"很多人" → ✅"我团队六个人里四个" |
| **② 省略号/留白** | 话只说一半，用省略号制造信息缺口         | "但真正让我害怕的不是这个……"        |
| **③ 反共识立场**  | 故意站到大家预期的反面                   | 视频说AI好 → 评论说"但代价没人提"   |
| **④ 身份锚定**    | 用身份（业内人/过来人/受害者）增加可信度 | "做了八年培训"比"我觉得"更有冲击力  |

#### 质量自检标准（写完每条评论默念这5条）

| 维度             | 通过标准                           | 不通过标准                     |
| ---------------- | ---------------------------------- | ------------------------------ |
| **不回复就难受** | 读完有"不对""真的吗""我也是"的冲动 | 读完觉得"哦""嗯""好"然后划走   |
| **不可预测**     | 不是观众能猜到的话                 | "AI发展真快""时代变了"这种废话 |
| **有争议空间**   | 至少有30%的人会不同意              | 所有人都会点头的废话           |
| **具体可感**     | 有数字/有人物/有场景               | 纯观点无锚点                   |
| **不求人**       | 不靠问句/不靠CTA/不靠emoji         | "你觉得呢？""说说看"           |

#### 铁律

- **（本节已作废·2026-07-16 用户命令：置顶评论对流量无作用，今后不再生成，整节规则停用）**
- 下方细则（582起，含"禁CTA词/禁问号结尾/评论区告诉我=低质CTA"等反模式行）均为**作废前的旧策略**；2026-07-16 CTA策略翻转后，评论/转发/收藏互动引导改为鼓励甚至必需（见 2.2.2），不要再按本节"禁问号/禁评论区"行执行。
- 禁止笼统/无观点/无锚点（"AI发展真快""时代变了""未来已来"）
- 8篇钩子类型不可全部相同，至少覆盖5种
- 置顶评论**不是口播内容**，是发布后单独粘贴到评论区的
- **跨篇禁止句式雷同**：前5个字不能相同，结构不能重复
- **3+2+2+1节奏配比**（8篇置顶评论的理想分布）：3条"你"戳人（身份拷问/灵魂拷问） + 2条"我"自爆（自爆共鸣/个人数据） + 2条反差数据（反差炸弹） + 1条省略号留白（信息缺口）。避免8篇全是同一视角导致审美疲劳
- **禁止与标题雷同**：置顶评论不能复述标题内容，必须补充视频没说到的新角度/新信息

#### 反模式黑名单（出现任何一条=打回重写）

| 反模式         | 为什么烂                          | 正确替代                                                     |
| -------------- | --------------------------------- | ------------------------------------------------------------ |
| "你觉得呢？"   | 最懒的互动诱导，观众已经免疫      | 用陈述句制造张力："我觉得大部分人撑不过三个月"               |
| "评论区告诉我" | 平台算法已识别为低质CTA           | 用身份戳心："做会计的看完这条应该坐不住了"                   |
| "AI发展真快"   | 零信息量零争议，谁看了都不回      | 用具体数据："六个月前觉得不可能的事今天已经实现了"           |
| 纯emoji堆砌    | 零内容价值                        | 用文字表达态度                                               |
| 反问句结尾     | "难道不是吗？"——太弱              | 直接下判断："这事99%的人想反了"                              |
| 与视频内容重复 | 观众刚看完，不需要你再说一遍      | 补充视频没说的信息/给一个新角度                              |
| 与标题雷同     | 标题已经说过的信息重复一遍=零增量 | 标题说"十二万部打不过"→评论说"产量95%播放量4%"（新角度数据） |

### 6.2.1 标题规则

- 标题字数：15-23字
- 必须为4种情绪类型之一：画面式/扎心式/数字冲突/悬念缺口
- **禁止纯信息型标题**（如"Kimi发布新模型"）
- 必须包含至少1个：数字/动词/悬念词/名人/冲突点

### 6.2.2 二次冲击内容类型

每篇280-380字区间的二次冲击必须植入以下4种之一：

- **价格反转**：前后价格对比制造认知颠覆
- **隐藏信息**：揭示观众不知道的隐藏真相
- **认知翻转**：颠覆观众原有认知
- **行动差距**：揭示"会做的人"和"不会做的人"之间的差距

### 6.2.3 显示纪律（2026-07-13 用户强制）

- **必须每次有修改或生成后，在对话框内完整按 6.2 格式显示全文**，不得只写文件不显示
- 显示必须严格遵循 6.2 格式：标题一行、话题词一行、正文一段，篇间分隔线
- **禁止**：反复多次显示同一内容、只显示部分内容、添加标签文字、改变格式、附带幕后分析
- 违反显示纪律 = 严重工作失误，用户有权要求立即停止

### 6.2.4 全量显示机器检查点（2026-07-20 用户铁律·彻底杜绝"改完只贴改动部分"）

- **根因**：历史上多次出现"只把改动的那 1 篇贴给对话框、漏掉其余篇"的违规。纯靠记忆不可靠，故做成机器检查点。
- **机制**：`koubo_validate.py` 内置 `显示纪律(全量显示)` 硬检查——比对"被验证段内容 sha"与".workbuddy/koubo_display_hash"中已标记显示的 sha，**不一致 = 硬 FAIL，直接阻断"全部通过"**，迫使 agent 改完必先全量显示再交付。
- **强制流程（每次修改/生成口播稿后必须严格执行）**：
  1. `python 工具脚本/koubo_display.py 历史稿/历史口播稿汇编.txt` → 打印段内全部 N 篇（6.2 格式 + 每篇【评估检测】）
  2. 把上方输出**完整粘贴至对话框**（禁代码块、禁只贴改动篇）
  3. `python 工具脚本/koubo_display.py --mark` → 写检查点
  4. 再跑 `koubo_validate.py` → 必须出现 `显示纪律(全量显示) | 全量显示检查点已匹配✓` 且 `全部通过`，否则禁止宣称完成
- **禁止**：跳过 `--mark` 就宣称"已显示完成"；用临时片段替代全量；只显示被修改的篇。

### 6.2.7 开头3句钩子公式（2026-07-14 新增·2026-07-16 降级为"可选软技巧"）

> **方法论来源**：深度学习口播爆款拆解文章，提炼"3句钩子锁完播"公式。初衷是补第一句之后的完播承诺+锁钩，但**2026-07-16 用户实测发现：8篇全部套用此公式导致开头高度同质化、话术固定、生硬**，直接违背"开头句式多样性"硬指标。故降级为可选技巧。

**定位：可选，非强制。** 8篇中最多 2 篇可使用此公式变体，且必须改写、不得照搬下方字面模板。

**⚠️ 死模板红线（koubo_validate.py classify_opening 硬门禁，命中即 FAIL）**：

- 第2句出现 `今天用X分钟`（X=两/三/…分钟）且第3句出现 `最后一个/最狠/最关键 + 九成/八成/十有八九/都中过` 的组合 → 判定为"死模板(今天用X分钟+最后一个/九成)"族。
- 该族任意一篇出现即计入跨篇统计，单一族 >2 篇 = 整组 FAIL。8篇若都套用此字面模板 → 必 FAIL。

| 句序                        | 公式（参考，非照搬）                                     | 机制                                                                                 | 示例（已脱模板）                            |
| --------------------------- | -------------------------------------------------------- | ------------------------------------------------------------------------------------ | ------------------------------------------- |
| 第1句·身份背书句（8-15字）  | `[时间/年限]+[AI领域]+[踩坑/代价/经历]`                  | 用"踩过坑"拉近距离，不用"我是专家"仰视感                                             | "我做AI教育五年，踩过无数坑"                |
| 第2句·完播承诺句（12-20字） | `[今天]+[时间承诺]+[目标人群]+[内容承诺]+[严重程度]`     | "1分钟/一分半"=完播预期（视频实际=1.5分钟，严禁写两/三分钟以上）；"致命/要命"=紧迫感 | "今天用1分钟告诉你，普通人用AI最容易踩的坑" |
| 第3句·完播锁钩句（10-15字） | `最后一个/最狠的一条+[百分比/具象]+的人+[都中过/都犯过]` | 锁完播率                                                                             | "最后一个，九成人都在犯"                    |

**与现有规则的关系（2026-07-16 厘清）**：

- **强制规则是"开头句式多样性"**（技术约束硬指标第434行 / 12.2 第913行）：8种开头族（你直戳式/数字冲击式/场景代入式/惊叹疑问式/反共识式/时效播报式/身份自述式/其他自由式），每族每天 ≤2 篇，由 `koubo_validate.py` 的 `classify_opening` 硬门禁执行（>2 即 FAIL）。
- 本 6.2.7 公式只是 8 族中的"可选钩子"之一，**不得作为统一开头**。要套用时必须改写措辞、变换结构，且当天使用篇数 ≤2，否则必触发死模板 FAIL。
- 第1句的情绪触发词（开头第一分句 ≤15字含情绪词）仍强制，与多样性规则叠加、不冲突。
- **禁用**：3句中出现CTA词（点关注/评论区）、问号结尾、机械列举；照搬"今天用X分钟…最后一个/九成人"字面模板。

### 6.2.8 段落收尾金句公式（2026-07-14 新增·2026-07-16 降级为"可选"·非强制）

> **方法论来源**：口播爆款拆解文章指出"骨架本身不是亮点，亮点在每段的收尾金句"。现有规则只管"二次冲击位"单点，不管段落节奏，导致多数段落收尾平铺直叙。

**定位：2026-07-16 降级为可选，非强制。** 金句可自然带出，但不再要求每篇≥2种或强制段段命中。原公式仅作参考：

| 类型               | 公式                                               | 机制                                    | 示例                                             |
| ------------------ | -------------------------------------------------- | --------------------------------------- | ------------------------------------------------ |
| **A·概念反转式**   | `[被美化的概念]不是[正面标签]，是[负面本质的揭示]` | 把常识底牌翻出来，触发"被戳到"+分享欲   | "完美主义不是高标准，是不敢开始的借口"           |
| **B·类比画面式**   | `你知道这等于什么吗？等于[具象化的危险/荒谬场景]`  | 抽象行为→具象画面，大脑瞬间理解荒谬性   | "等于闭着眼睛开车"                               |
| **C·数据落差式**   | `[行为投入的大数字]+[结果落差的小数字]`            | 10倍以上落差直观感受代价                | "发了100条，互动不到10条"                        |
| **D·反共识判断式** | `[大众共识]——[你的反共识判断]`                     | 故意站到预期反面，触发"不对!"的纠正冲动 | "都说AI抢饭碗——该慌的不是丢工作，是你还不会用AI" |

**要求**：

- 鼓励每篇带多种类型，不再强制≥2种（避免雷同靠自然表达，不靠硬指标）
- 8篇中4种类型均匀分布（每种≥4次/8篇）
- 金句必须落在段末，不在段中
- 与现有"二次冲击位280-380字"结合：该位置的收尾金句优先用类型A或C（冲击最强）
- **禁用**：机械列举排比（"先X再Y最后Z"）、硬数字轰炸（"三个/三条"集中出现）——与3.6 AI味检测禁令一致

### 6.2.9 结尾自我诊断引导（2026-07-14 新增·2026-07-16 降级为"可选"·非强制）

> **方法论来源**：口播爆款拆解文章的"结尾互动钩子两层"——让互动变成自我验证，不是在要评论。撰写时（2026-07-14）规则还禁CTA，仅说"用金句/留白收束"；**2026-07-16 CTA策略翻转后，评论/转发/收藏互动引导改为鼓励甚至必需（见 2.2.2 #26），本节的软引导与 #26 问号/二选一 是互补两套合规方式**。

**定位：2026-07-16 降级为可选，非强制。** 软引导可用可不用，结尾以自然收束为准：

**公式**：`[行动引导]+[自我诊断锚点]+[态度金句收束]`

| 类型       | 公式                     | 机制                       | 示例                                   |
| ---------- | ------------------------ | -------------------------- | -------------------------------------- |
| **对照式** | `你对照一下，你中了几条` | 观众自我验证，不是在要评论 | "你对照下本地AI工具，有几条全开权限的" |
| **自问式** | `你想想，自己踩过几个`   | 触发自我审视               | "你琢磨下，囤的课真打开过几个"         |
| **预言式** | `等着看吧，三个月内____` | 制造期待，观众想回来验证   | "等着看吧，半年内你一定会遇到这事"     |

**与现有规则的关系**：

- **CTA策略翻转（2026-07-16）**：评论/转发/收藏 等互动引导现已允许并鼓励；仅"订阅/私信/导流类"（点个关注/关注我/来找我/私信我/加我/下期/下集）仍为硬CTA（3.2永久禁令）
- 6.2.9 软引导（"你对照/你想想/等着看"）与 #26 结尾评论钩子（问号/二选一/你…互动）是互补两套合规方式，都合法
- 必须搭配态度金句收束，不能只留自我诊断就结束
- 8篇中3种类型轮换，每种≤3次
- **问号结尾/问句式互动现已鼓励**（是 #26 评论钩子门禁的必选项，不再禁用）；模板化由跨篇逐句去重（≥12字公共子串）兜底，不靠禁问号硬限

### 6.3 四层话题词

| 层级  | 作用       | 示例                    |
| ----- | ---------- | ----------------------- |
| 第1层 | 高热基本盘 | #科技 #互联网 #商业     |
| 第2层 | 内容强相关 | #AI取代工作 #AI工具推荐 |
| 第3层 | 搜索意图   | #普通人怎么用AI #职场AI |
| 第4层 | 热点品牌词 | #豆包 #可灵AI #DeepSeek |

禁止使用：#知识科普、单独#ai、#抖音、#推荐、#热门

**数量硬规则（2026-07-16 用户规则）**：每篇话题词 **4 个**（四层各 1；第4层最多放 2 个品牌词时不超 5）。偏离 4 即 WARN/FAIL——门禁 `koubo_validate.py` #27「话题词数量」：`count==4` PASS；`count==5` WARN（允许的第4层2品牌词例外，需人工确认）；`count<4` 或 `count>5` FAIL。八篇须统一工整（抖音仅前 2 个变蓝链，4 或 5 不影响曝光逻辑，但数量不一致伤品牌工整度）。

### 6.4 多平台通用写法（v2.6）

- 每篇同时适配4平台，不拆开分配，写法重心优先满足视频号和抖音
- 开头：情绪钩子+戳"你"（前3秒抓住视频号社交推荐+抖音完播）
- 中间：朋友叙事+教练穿插
- 结尾：三层合一（行动指令+转发动机+态度金句）
- 大白话优先，禁止说教，禁止学术腔/官方腔

### 6.5 视频号转发心理学（写法底层依据）

视频号是关系链传播，转发率决定生死。内容必须让用户觉得"转发=有面子"。

**转发三大心理（青岛理工大学研究）：**

- 表明立场（74.9%）：转发是为了表明自己的关注领域
- 表明态度（74.1%）：转发是为了表明自己的立场
- 表征身份品味（60.1%）：转发是为了展示身份和品味——**这是最后一道关卡**，觉得"有失品味"就忍住不转

**三种面子动机：**

- 认知面子："我转发说明我懂行"
- 关心面子："转发给朋友是关心他"
- 品位面子："转发这个显得我有层次"

**写法要求：**

- ✅ 正向赋能："能刷到这条的家长，说明你已经比大多数人先走一步了"
- ❌ 负面恐吓："你的孩子正在被AI淘汰"（丢面子，用户忍住不转）

### 6.6 爆款标题公式（从TOP3播放数据提取）

| 公式                 | 示例                                         | 适用场景 |
| -------------------- | -------------------------------------------- | -------- |
| 蹭热点+名人效应+悬念 | 特朗普访华：AI大佬的生死局                   | 重大事件 |
| 揭秘感+真相          | Google和OpenAI不会告诉你的AI教育真相         | 行业揭秘 |
| 竞争对比+悬念        | AI编程四方大战：阿里、Anthropic谁能赢        | 行业动态 |
| 身份认同+结果暗示    | 能看懂这条的家长，孩子已经在AI时代领先一步了 | 认知升级 |

**高播放共性**：蹭热点 + 名人效应 + 争议性 + 个人视角 + 揭秘感 + 可转发金句
**低播放共性**：纯工具介绍 + 缺观点 + 缺个人元素 + 结构同质化

---

## 七、内容风格规范

### 7.1 整体要求

- 自然口语化，带点东北味，像聊天一样
- 时长控制在一分半（约1.5分钟，文案470-490字）；开头钩子S2的"用X分钟"必须写"1分钟"或"一分半"，严禁写"两分钟/三分钟"等超过实际时长的表述
- 不要格式标记（不用写【开场】等）
- 干货为主，有个人观点和深度分析

### 7.2 东北味表达规范

核心特点：亲切、直接、带点幽默、像街坊聊天。短句为主，一句一个意思；重要观点前停顿加重语气。

**10种标记词轮换池**（池内通用≤2次/8篇；高频词另有限频见下）：

1. 咱就说 2. 说白了 3. 你想想 4. 你品品 5. 你琢磨琢磨
2. 咱唠唠 7. 你寻思寻思 8. 可不是嘛 9. 你猜怎么着 10. 你说说

**去模板化限频**（8篇内，比池通用≤2更严格）：

- "说白了"/"咱就说"/"你品品"/"咱唠唠"/"你想想"/"这事儿我琢磨"：各≤1次
- "你猜怎么着"：≤2次
- "很多人觉得/以为/认为XX"：≤2次
- "对普通X而言/来说"：≤3次，且不连续2篇
- "很多人没看懂/没想到/注意的是"：**完全禁用（0次）**

**禁用低端标记词**："咱就这么说"/"嘎嘎香"/"咱东北话讲"/"拉倒吧"
**禁用句式**："这才是X"/"也包括那些做X的，也能沾光"
**要避免**：过于书面化（"综上所述""由此可见"）、官方腔（"笔者认为"）、网络流行语（"绝绝子""yyds""家人们"）、过度东北话（"咋地""干哈呢"太刻意反而假）

### 7.3 个人元素要求

- 每篇开头3-10秒处必须有"我/我们/我们学校/我的学员"的具体场景
- 找不到个人素材就换选题，不要硬写
- 热点只占开头30%，后面70%必须是分析和判断
- 禁止10个"以前...现在..."排比，全文最多2个对比
- 每篇必须有1个认知冲突点，从个人经历中自然浮现
- 信息密度必须高，每句话必须有新信息或新认知，不能有废话

### 7.4 内容类型配比

| 类型     | 占比 | 核心指标      |
| -------- | ---- | ------------- |
| 实操教程 | 40%  | 收藏率        |
| 热点解读 | 25%  | 完播率+播放量 |
| 认知观点 | 20%  | 评论率        |
| 情感共鸣 | 15%  | 转发率        |

### 7.5 信息来源优先级

| 优先级 | 来源类型                                                                     |
| ------ | ---------------------------------------------------------------------------- |
| 最高   | 国外官方信源（openai.com/anthropic.com/blog.google.com等）+ 创始人/高管X账号 |
| 高     | 国外权威科技媒体（TechCrunch/The Verge/Wired/MIT Tech Review）               |
| 中等   | 国内科技媒体（量子位/机器之心/36氪）——仅作线索，必须去官网验证               |
| 低     | 社交媒体/论坛（微博/知乎/小红书）——仅作热点感知，不直接使用                  |

### 7.6 配图规则

- 配图必须ImageSearch搜真实新闻图，搜索词精准匹配事件
- **禁止ImageGen生成图片**
- **禁止旧图复用**（每次必须新搜）
- 下载后Pillow统一转RGB+JPEG

### 7.7 观点密度与情绪线设计（2026-07-14 新增·2026-07-16 降级为"可选"·非强制）

> **方法论来源**：余十万爆款拆解文章核心洞察——"新观点越多，观众收获感越多，点赞动机越强"。现有规则有"信息密度高"但没说"每段一个新观点"的硬要求，导致稿件多为叙事推进而非观点递进。

**定位：2026-07-16 降级为可选，非强制。** 鼓励每段带新观点提升收获感，但不再强制≥4个，避免为凑数逼出模板：

**观点密度要求**：

- 每篇470-490字，鼓励带多个新观点（原≥4个硬指标已降级为可选，不强制）
- 观点必须层层递进（观点1→观点2→观点3→结论），禁止平行罗列
- 每个观点必须对应一个"观众收获感"（新知识/新判断/新方法）
- 纯叙事推进不算观点（叙事是为观点服务的载体）

**双线写作法**（写作时同步设计两条线）：

| 线     | 内容                   | 验证方法                                 |
| ------ | ---------------------- | ---------------------------------------- |
| 内容线 | 每段说什么（原文）     | 朗读通顺                                 |
| 情绪线 | 每段观众此刻心里想什么 | 写作时默念"观众读完这句心里反应是______" |

**情绪线设计模板**（写作前必填）：

| 段落     | 内容线（我说什么） | 情绪线（观众想什么） | 收获感（新观点） |
| -------- | ------------------ | -------------------- | ---------------- |
| 开头钩子 | 抛出悬念/冲突      | "真的吗？有多严重？" | —                |
| 第1段    | 观点1+佐证         | "好像是这么回事"     | 新判断1          |
| 第2段    | 观点2+佐证         | "戳中我了"           | 新判断2          |
| 第3段    | 观点3+佐证         | "原来是这样！"       | 新判断3          |
| 结尾     | 总结+行动          | "学到了，得试试"     | 新方法           |

**验证**：每篇写作后，检查"情绪线"那一列——如果出现"哦""嗯""好"等平淡反应=该段重写。

**与现有规则的关系**：

- 强化现有"信息密度高"规则：从"每句有新信息"升级到"每段有新观点"
- 与3.5正文自然度禁令一致：观点递进≠机械列举，需用自然叙述承载
- 与6.2.8段落收尾金句结合：每个观点段以金句收尾，强化收获感

---

## 八、用户偏好与沟通风格

### 8.1 工作方式

- 直接高效，agent自主决策直接执行，不列选项，做完给结果
- 待办批量全部处理，不逐项确认
- "继续深度优化"=挖更深不是简单收尾，一次到位
- 口播稿归档是**工作流收尾的硬步骤（不可跳过）**，与"发布完了/今天文章发完了"等任何用户指令**无关**（那是公众号项目规则，口播稿严禁继承）：定稿五门禁全绿（含 Phase 0.7 热点覆盖自检）+ 对话全文显示后，agent **必须**运行 `archive_daily.py --finalize` 把当日 `MMDD.txt` 并入 `历史稿/历史口播稿汇编.txt` 并清空 `Output/`；紧接着运行 `archive_daily.py --check`，**返回0才算归档完成**，返回非0=工作流未完成、立即重跑 finalize。**严禁**把"当日稿留 Output、下次再归"当完成（这是已发生过的漏归档根因：脚本默认只移非当日稿，跑默认模式会误报"跳过今日稿"让人以为已归档）。**不**建后台定时任务——归档在工作流内一步到位。
- 反馈"不行/太差"指情感质量不达标，非技术检查；不接受"检查全过"作为质量论证
- **拒绝发布后复盘/数据分析功能**；优化集中在写作过程

### 8.2 内容标准

- 开头必须情绪触发，信息播报型开头直接拒绝重写
- 必须结合当天最新热点，通用话题会被拒绝
- 每天内容不可重复雷同
- 反感"事后诸葛亮"——问题必须在写作流程中发现修复
- 初稿即终稿，不允许"先交粗稿再迭代"

### 8.3 孩子场景规则

- 儿子，2岁半（2026-07），男孩，聪明
- 涉及孩子场景**必须基于"2岁半男孩"实际**（刚会说话/认字/模仿）
- **禁止编造不符年龄行为**

### 8.4 文件偏好

- DOCX输出放项目自身output目录，不复制到C盘工作区
- 排版不要分割线/边框/装饰符号（◆━等），设计感靠背景色卡片/排版层级/字号对比
- 公司全称"吉林省爱智汇人工智能科技有限公司"：口播稿正文可自称"智汇AI教育创始人/李总"；公众号正文禁用公司全称（触发CSDN广告判定），只用"智汇AI"；公司全称仅用于公众号文末"作者注"做GEO
- GEO品牌植入放文末"作者注"以作者身份，不放正文

---

## 九、逻辑三病（写作后必检）

| 病名         | 表现                                           | 修法                             |
| ------------ | ---------------------------------------------- | -------------------------------- |
| 同件事说两遍 | 同一事件/观点换说法重复出现                    | 第二次出现处替换为新信息或新角度 |
| 转折词接不上 | 转折词暗示的逻辑关系与前后文实际关系不匹配     | 换匹配前后文逻辑关系的转折表达   |
| 单点冗余     | 两个相邻句子表达同一个意思，删掉任一句文意不变 | 合并或删除冗余句                 |

---

## 十、教训记录

### 0709 GLM-5.2事故

- **问题**：凭记忆选了已发布多时的GLM-5.2作为选题，且定价/免费等信息有误
- **后果**：用户已录制发布，无法挽回
- **根因**：无热点采集步骤、无事实核查步骤
- **修复**：新增Phase 0热点采集铁律 + Phase 0.6事实核查铁律

### 0709 "我跟你说"问题

- **问题**：多篇稿件中出现"而且我跟你说"，语气居高临下
- **修复**：加入永久禁令，用"更要命的是""最让人不安的是"等自然转折替代

### 0708 初稿超长翻车

- **问题**：8篇中6篇初稿超长（520-556字），冲击位偏前（155-247）
- **修复**：新增结构预算+锚定冲击位写法，先定冲击位再写前后文

### 0711 篇8三句病句 + 修订版误删

- **问题1**：0711 篇8 出现三类典型病句——"那我们教AI平台到底该学什么？"（语义错乱）、"最关键就一点：…"（空头论点，承诺单一论点却没立住）、"…学了之后拿来干什么，难道不是吗？"（AI腔生硬反问收尾）。原校验 18 项未覆盖这三类，故漏出。
- **修复1**：`koubo_validate.py` 新增 #20语义通顺 / #21论点立住 / #22结尾自然 三道硬门禁（命中即整篇打回），并在 AGENTS.md 3.5 立永久禁令、十二验证标准补三行。
- **问题2（次生·已纠正误诊）**：先前误判 `0711_修订版.txt` 被 `project_hygiene.py` "误删"，并据该误判把其加入 13.2 白名单、重建该文件。经复核，删除 `0711_修订版.txt` 实际符合用户"别留两个混淆"铁律（`0711.txt` 为唯一权威稿），**该白名单豁免是错误追加，须撤销**。
- **修复2（纠正）**：撤销 13.2 的 `MMDD_修订版.txt` 豁免；确认 `0711.txt` 为唯一定稿，修订版类中间文件一律按卫生检查删除，不豁免（详见 13.2 修正）。
- **固化**：今后任何读不通的句式，必须追加进校验脚本对应常量（BANNED_GARBLED / HOLLOW_POINT_ANCHORS / AI_RHETORIC_END_PATTERNS），保持门禁持续有效。

### 历史教训汇总

- **内容同质化**：用同一个结构套所有内容→每个选题单独设计结构
- **中国国情**：Homeschool在中国不可能→所有内容必须考虑中国实际
- **导流油腻**："来找我""私信我"→彻底废除，改为价值收束+自然留白
- **视频号心理**：用"炸锅了""出大事了"等low词→必须让用户觉得"转发=有面子"
- **假设焦虑**："别焦虑""别担心"→不要假设用户有焦虑，用平等分享姿态
- **结尾重复**："你品品""是不是这么个道理"→结尾多样化、自然、不重复
- **信息混乱**：800年前的旧东西当新热点→24小时新鲜度铁律
- **凭印象写**：没确定的事不能说→搜索结果是唯一事实来源

---

## 十一、文件索引

| 文件                    | 路径                                                           | 状态     | 用途                                                                                                                                                                                 |
| ----------------------- | -------------------------------------------------------------- | -------- | ------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------ |
| **AGENTS.md（本文件）** | koubo/AGENTS.md                                                | ✅活跃   | 最高权威参考，所有规则汇总                                                                                                                                                           |
| SKILL.md                | （历史路径 ~/.qoderworkcn/skills/koubo-daily/SKILL.md 已失效） | ⚠️已整合 | 原详细工作流Phase定义已整合进本AGENTS.md（Phase 0/0.5/0.6/1-5）；trae环境下无独立SKILL.md，以AGENTS.md为唯一权威                                                                     |
| 素材库                  | koubo/素材库.md                                                | ✅活跃   | 金句库/类比库/数据弹药/案例库/开头钩子库/转折表达库/东北味记录（动态维护）                                                                                                           |
| 验证脚本                | koubo/工具脚本/koubo_validate.py                               | ✅活跃   | 全量验证脚本：18项逐篇检查+跨篇去重+栏目分配+抖音安全，`python 工具脚本/koubo_validate.py Output/MMDD.txt`                                                                           |
| 卫生检查                | koubo/工具脚本/project_hygiene.py                              | ✅活跃   | 项目卫生验证：目录白名单+缓存+散落文件+废弃模块，`python 工具脚本/project_hygiene.py`                                                                                                |
| 选题存档                | koubo/选题存档.md                                              | ✅活跃   | 历史选题记录，用于查重                                                                                                                                                               |
| 每日稿件                | koubo/Output/MMDD.txt                                          | ✅活跃   | 当天交付的口播稿                                                                                                                                                                     |
| 已发布内容记忆          | koubo/已发布内容记忆.json                                      | ✅活跃   | v3.1精简版：published数组(仅title+date，选题查重)+image_registry(配图防重复)+unique_angle_library+rejected_topics                                                                    |
| README                  | koubo/README.md                                                | ✅活跃   | 目录结构说明                                                                                                                                                                         |
| 旧项目归档文件          | 已整合迁出                                                     | 📦已迁移 | 账号定位记忆/发布日志/运营文档×3/改版方案/交付/skills/json_reference_data 于2026-07-14整合至公众号项目（_archive/、output/archive/ 及用户级 skills），口播稿根目录不再保留跨项目杂物 |

---

## 十二、验证标准

端到端验证：Python脚本跑通全部技术约束 + 跨篇去重扫描 + 收藏价值终审评分表 + 对话中展示所有验证结果。

### 12.1 技术约束验证（逐项通过，任一FAIL=整篇打回）

| 检查项         | 通过标准                                                                                                                                         |
| -------------- | ------------------------------------------------------------------------------------------------------------------------------------------------ |
| 字数           | 470-490字                                                                                                                                        |
| 标题字数       | 15-23字                                                                                                                                          |
| 标题情绪类型   | 画面式/扎心式/数字冲突/悬念缺口 四选一                                                                                                           |
| 开头第一分句   | ≤15字且含情绪触发词（33种：你/谁/还/竟/已/刚/不/没/就/才/只/又/被/全/最/太/空/一/整/大/多/爆/猛/吓/抢/暴涨/暴跌/崩/炸/疯/卷等）                  |
| 开头类型       | 扎心式/禁果式/画面式/数字冲突 四选一                                                                                                             |
| 二次冲击       | 位于280-380字区间，4类型之一                                                                                                                     |
| "我"出现次数   | 每篇≥8                                                                                                                                           |
| "孩子"出现次数 | 8篇总计≤4                                                                                                                                        |
| "说白了"       | 8篇≤1次                                                                                                                                          |
| "很多人"       | 8篇≤2次                                                                                                                                          |
| "真正"         | 8篇≤3次                                                                                                                                          |
| CTA残留        | 0次（仅禁订阅/私信/导流类："点个关注""关注我""来找我""私信我""加我""下期""下集"；评论区/转发/收藏互动引导现已允许并鼓励，见 2.2.2）              |
| 教练穿插       | 每篇≥1处行动引导（先别/自己去/动手试/赶紧/自查/先学会等22种模式）                                                                                |
| 东北味标记词   | 10词轮换，每种≤2次，"你品品"/"你琢磨琢磨"≤1次                                                                                                    |
| 禁用表达       | "而且我告诉你"/"写到这里手心都是汗的"=0次                                                                                                        |
| 结尾重复       | 8篇结尾不得共用同一句式或模板                                                                                                                    |
| 句子长度       | 全文单句≤35字                                                                                                                                    |
| 英文词         | 常见常规英文词/基础英文词/AI圈常用词可直接保留（详见7.2朗读友好规则），生僻英文必须翻译                                                          |
| 热点时效       | 选题事件的**原始首次发布时间**须在 24 小时内（见 2.1「24 小时新消息判定铁律」）；**旧消息当天重发/二次转发不计入"24h 新消息"**，据此选题一律无效 |
| 置顶评论       | （已取消·2026-07-16 用户命令：不再生成，门禁改为可选）                                                                                           |

### 12.2 跨篇去重验证

- 8篇标题/事件/核心论点/传导链/结论不得雷同
- **跨篇逐句去重**：任意两篇正文≥12字公共子串=不通过（语义雷同检测）
- **跨天去重**：与前一天MMDD.txt标题≥8字公共子串=不通过
- 高频表达扫描：同一短语出现≥3次=不通过
- 开头句式多样性：8种句式族轮换（你直戳式/数字冲击式/场景代入式/惊叹疑问式/反共识式/时效播报式/身份自述式/其他自由式），单一族>2篇=不通过（由 koubo_validate.py classify_opening 硬门禁执行；字面"今天用X分钟+最后一个/九成"模板判为死模板族，>2篇即整组 FAIL）
- 结尾句式多样性：5种类型（比喻金句/行动式/感慨式/陈述收尾/反问），单一类型>3篇=不通过；**但反问结尾因是评论钩子必选项（见 2.2.2 #26），豁免>3上限**，模板化由跨篇逐句去重（≥12字公共子串）兜底
- **语义通顺**（#20）：无动宾/偏正错配、无主悬空、无读不通短语（BANNED_GARBLED + 正则）
- **论点立住**（#21）："最关键就一点"等承诺词后，必须紧跟明确判断句，不得直接跳行动
- **结尾自然**（#22）：正文结尾禁止"难道不是吗/不是吗/对吧/是吧/你说呢"等生硬反问
- **A8=AI+教育**：A8的标签或正文前200字必须含教育关键词（研学/学习/培训/家长/孩子等）

### 12.3 收藏价值终审——内容价值维度（与SKILL.md Phase 5互补）

> SKILL.md Phase 5评分衡量**写作质量**（开头钩子/个人锚点/结尾收束/跨篇独立性），本节衡量**收藏内容价值**（有无值得截图保存的干货）。两套评分独立打分，必须同时通过。
>
> | 维度              | 分值 | 评分标准               |
> | ----------------- | ---- | ---------------------- |
> | 步骤清单/操作指南 | 0-3  | 有无具体可执行的步骤   |
> | 价格/数据对比     | 0-2  | 有无让人截图保存的数字 |
> | 工具/资源推荐     | 0-2  | 有无具体可用的工具名   |
> | 避坑指南/判断框架 | 0-2  | 有无帮读者做决策的框架 |
> | 方法论/思维模型   | 0-1  | 有无可迁移的思维方法   |

**通过标准**：每篇≥6分，8篇平均≥8分。低于6分的篇必须重写收藏钩子。

### 12.4 爆款五维选题评分

| 维度     | 权重 | 说明                                 |
| -------- | ---- | ------------------------------------ |
| 全员痛点 | ×4   | 所有人都会遇到的痛点，最大权重因子   |
| 反转空间 | ×3   | 能制造"竟然是这样"的反转             |
| 具象转发 | ×1.5 | 有具体的转发对象（"转给我老婆看看"） |
| 数据弹药 | ×1   | 有让人想截图的数据                   |
| 态度金句 | ×0.5 | 有让人想截图发朋友圈的金句           |

**选题铁律**：全员痛点≤2直接淘汰，总分≥15=S级必做，12-14=A级，<12=B级需优化。

标准：**完美细致完整毫无遗漏**。

---

## 十三、项目卫生规则（每次会话结束必执行）

> **教训**：2026-07-10清理时发现30项垃圾文件（24.3MB），含过期缓存、未删build脚本、废弃lib模块、散落截图、node_modules等，长期积累无人清理。

### 13.1 禁止残留项（出现即违规）

| 类型           | 具体说明                                             |
| -------------- | ---------------------------------------------------- |
| `__pycache__/` | Python字节缓存，会话结束时必须删除                   |
| 根目录散落文件 | 临时JSON/补丁脚本/截图等必须当场清理，不留到下次     |
| 过期API缓存    | aihot_sel.json/aihot_today.json等热点数据用完即删    |
| 废弃skill/项目 | 不再使用的skill目录或子项目直接删除或归档到调试备份/ |

### 13.2 口播稿目录结构白名单（2026-07-14 重构）

koubo/ 标准目录结构：

- `Output/` ← 当日输出的口播稿 `MMDD.txt`（如 0714.txt），唯一权威定稿；`MMDD_修订版.txt` 等中间稿按卫生检查删除，**不豁免**
- `历史稿/` ← 历史口播稿汇编（历史口播稿汇编.txt 单文件，按 # MMDD 分段，由 archive_daily.py 每日追加）
- `工具脚本/` ← 全部门禁/工具脚本：koubo_validate.py / koubo_quality_gate.py / koubo_live_check.py / koubo_terms.py / pre_publish_check.py / project_hygiene.py / project_preflight.py / scan_ambig.py / scan_canonical.py / archive_daily.py / pre-commit.template
- `素材库/` ← 素材库.md / 真实素材库.md / 公开真实案例库.md / 选题存档.md / 已发布内容记忆.json
- `调试备份/` ← 一次性调试产物（歧义排查等），可删
- `AGENTS.md` / `README.md` ← 规则与说明，留根目录
- **目录边界铁律**：口播稿 `.txt` 只出现在 `Output/`（当日）与 `历史稿/`（归档单文件），严禁出现在 `工具脚本/` `素材库/` `调试备份/` 等其他目录

### 13.3 验证

`python project_hygiene.py` 检查两个项目的目录结构白名单，任一FAIL必须当场修复。
