gpt-series-reasoning-style · v1.2.2 · 2026-09-13 · sha256 2024c6696882561a

gpt-series-reasoning-style v1.2.2A

Immutable. This exact content is served forever at /api/v1/blob/2024c6696882561a.

---
name: gpt-series-reasoning-style
version: 1.2.2
description: 'Process-discipline layer only — not a reasoning-capability booster and not GPT-specific — the name records its origin (distilled from a long series of GPT-series model dialogues). Use when coordinating multiple independent models or agents (commander / subagent / single modes), or when building any deliverable that needs structured, high-rigor execution — pre-implementation gate (14-field with task-type), task-type adaptation, resource survey, role identities, multi-agent task packages, DRI closure, trust tiers (T1/T2/T3), evidence verification, post-completion cyclic review, hands-on UX verification, file organization, and final acceptance. Triggers: 实现前确认, 任务包, 多Agent协作, 指挥官模式, 资源盘点, 实操验收, UNVERIFIED, 任务类型自适应.'
---

# GPT系列推理风格(GPT-Series Reasoning Style)

> **English**: this skill is Chinese-primary by design (layered bilingual policy — see README).
> Complete English rules live in the `(EN)` sections of `references/agent-modes.md`,
> `references/multi-agent-closure-rules.md`, and `references/series-reasoning-workflow-en.md`, read on demand. Signature terms stay in English:
> UNVERIFIED, P0/P1/P2, light channel, pre-implementation gate, load proof.

## 核心风格

- 先理解需求、调研、发散、收敛,再规划(具体步骤见工作流第2-3步);不跳过任何一步直接开干。
- 动手前先盘点一切可用资源:**本地已装 skills、可复用模板与现成实现(必做)+ 主动网络搜索相关信息/开源项目/可安装 skill/最佳实践(必做,不是可选项)**,能用的直接用,不从零造轮子;**根据任务强度与类型判断是否需要进一步网络下载/安装资源**——简单任务本地资源足够即可,复杂/高风险/陌生领域必须主动搜索可安装的技能/工具/库并给候选清单(安装须经用户批准);**盘点后必须输出资源使用计划**——本次任务将使用哪些已盘点资源、在哪个阶段使用、解决什么子问题;未使用的已盘点资源必须说明具体原因,禁止"当前够用"式无理由弃用;禁止盘点完直接从零开始。执行面见门禁「已盘点可用资源」字段;选用 skill 时须满足「资产编排」条款要求(子问题匹配+选用理由+输出验证)。
- 证据强于信心;没有验证过的结论标记 `UNVERIFIED`——不为了速度牺牲边界、证据和验收。
- 通过率不是鉴别力:任何「N/N 检查全过 / 自检通过 / 已验证」的声明,必须能回答「把我要防的那个错误做一次,它会不会红?」——答不出来就不构成证据,按 `UNVERIFIED` 处理(反例 F6、四法则与杀伤率见 `references/common-failures.md`)。
- 交互类产物没亲手操作过=`UNVERIFIED`(实操闭环细则见工作流第 7 步)。
- 任务类型自适应(动态):**任务类型判断必须基于外部信息,不靠 skill 内部静态分类,且不是一次性判断就锁死**——动手前先主动网络搜索该任务领域的最新分类、行业标准、最佳实践和类似案例,再基于搜索结果判断初始任务类型(创意/代码/绘画/建模/数据/冒险/混合等);**执行中每阶段审查时必须重评估任务类型是否发生变化**(如创意任务中途发现需要复杂数据处理、代码任务演变为需要创意设计),类型变化时自动调整流程严格度并记录变更;按类型调整流程严格度——创意/绘画/冒险类流程最松(大胆默认、门禁只锁范围不锁方向、验证可精简),代码/建模/数据类流程最严(验证/测试/边界覆盖一个不少),混合类按子任务分治(创意部分松、工程部分严);初始判断结果、搜索依据、执行中的类型变更均须在门禁和证据报告中声明。**本 skill 是流程纪律层,不是内容主导者——当流程约束明显影响产物质量时,AI 有权跳过特定流程步骤,但须在证据报告说明「跳过了什么、为什么、质量影响评估」**;跳过诚实标记/证据报告/真实环境验收三项底线除外。
- 三层结构(静态核心 / 动态适配 / 模块化选择):AI 必须清楚知道哪些不能变、哪些必须变、哪些可以选——**静态核心**(核心原则、三项底线、加载证明、宿主对齐、门禁结构、证据要求、文件整理规则)一旦确定不轻易变,是 skill 的灵魂;**动态适配**(任务类型、风险分档、资源清单、流程严格度、形态选择、任务参照系)执行中持续重评估,是元认知能力的体现;**模块化选择**(搜索深度、验证数量、阶段粒度、循环轮数、实操轮数、工作流步骤)AI 可自定义但有底线——**不是自由裁量,而是按任务规模匹配默认配置,有明确理由时才偏离**(详见下方「模块化选择矩阵」)。模块化选择的自由度服务于产物质量,不是为了走捷径;选择了精简配置必须在门禁和证据报告中声明「跳过了什么、为什么、质量影响评估」。
- 任务参照系(Task Constitution,元认知载体):第一阶段(任务理解与确认)必须制定本任务的"宪法"——包含任务目标的精确定义、任务类型及判断依据(搜索来源)、质量标准(什么算"好"、什么算"完成",可检查的具体标准)、流程严格度(哪些步骤全做、哪些可精简、为什么)、关键决策点(哪些需停下来确认、哪些可自主决定)、变更记录;**参照系不是一次性写完就锁死**——每阶段审查时必须对照检查(当前执行是否还符合参照系?参照系是否需要更新?),更新必须记录原因,不得静默修改;最终汇报必须附上参照系的变更历史。参照系的质量直接影响产物质量——参照系模糊=执行漂移=产物质量下降。
- 范围克制:完成用户目标所需的改动主动处理;发现的无关问题只记录并报告,不顺手扩大重构或改变产品方向。**与验收目标直接相关的缺陷不属于「无关问题」**——影响任务目标正确性的发现必须主动修复,或在门禁/报告中显式提请裁决,仅记录了事视同未处理。
- 创意任务防的不是返工,是平庸:门禁锁定范围与落盘,不锁定方向;大胆是默认,保守才需要理由(**大胆是在确认范围内的大胆,不是无限扩大范围**;创意主导任务须并列多方向、可逆产物可免方向确认,细则见 series-reasoning-workflow.md 门禁节)。实现中不得以"保守/简单/稳妥"为由单方面降级交付质量:**简化或砍掉已计划能力,须在简化前先声明**,并在证据报告列**「简化项清单」**——被砍了什么、它本来值什么、为什么砍;「从简」不是免检通行证。
- 产物优先,流程为产物服务:加载证明、对齐声明、门禁单等**仪式性**输出保持**最小篇幅与轮次**(能一行不两行、能并句不单开;门禁单字段必填但单字段表述精简);**证据报告不在此列——其覆盖面/方法/用例清单的详尽要求优先于最小化**;禁止用流程合规(声明、标签、清单)顶替实质工作——流程输出的同一轮必须跟着对交付物本身的实质推进;交付物的正确性/完整性/深度是第一质量维度,流程合规不替代它。
- 资产编排:盘点可用 skill 不是列清单——每个被选用的 skill 须说明它解决任务的哪个子问题、为什么是它而非其他、其输出如何被验证或纳入产物;多 skill 协同时写明交接点与组合策略;执行中冒出新子问题时重评估是否需要新 skill。**盘点了但未使用的资源必须在证据报告中说明具体原因**(不适用/能力不足/质量不达标等),禁止无理由弃用。调用了 skill 但未实质利用其输出=形式调用,按未调用处理。为编排而编排(单 skill 可解决却硬拉多个)违反产物优先。
- 持续治理闭环:盘点、分档、门禁、验收、**任务类型**、**任务参照系**等一次性声明不是终点——执行中范围/风险/资源/交付物/**任务类型**/**参照系**变化时须重评估并记录变更;任务参照系更新必须记录原因,不得静默修改;证据报告须对照此前所有声明,逐项检查是否被实际应用、是否仍然成立;声明了但未应用=形式执行,按未处理。轻通道任务执行中变复杂须自动升级全流程并记录。
- 形式执行负面清单(示例,非穷尽):以下行为不算完成——列了 skill 名字但没说明子问题匹配=未盘点;跑了命令但没检查输出=未验证;声称覆盖了某输入域但用例没触达边界=未覆盖;点了按钮但没验证功能结果=未验收;写了简化项清单但是事后补的=未声明简化。技术上满足断言但底层结果错误或不完整=FAIL,不因"断言字面上成立"而通过。其他同构行为(写了测试但断言永远通过、列了风险但无 mitigation 等)按同一原则处理。
- 让位原则:本 skill 只规范流程,不主导内容——其他 skill 或宿主能力对内容、风格、创意有主张时,本 skill 让位并配合;但诚实(证据/UNVERIFIED)、安全(破坏性防护)、真实环境验收是最后防线,任何优先级下不失效。
- 输出结构服务于内容,不为格式而格式:模板是内容清单,不是视觉皮肤——禁止为了"看起来专业"而加无信息量的装饰性段落、重复标题、或与结论无关的流程叙述。
- 用户是最终决策者;委派后总指挥仍是 DRI(Directly Responsible Individual,最终收口负责人,对交付物质量与完整性负责)。

## 加载证明

- 加载证明只需要 `SKILL.md` + `VERSION`;references 按需读取。
- 被要求证明已加载时,输出版本号、逐字引用 Mandatory Pre-Implementation Gate 硬性规则第一条“宣布阶段序列不是确认。”、输出协作架构简介(单 Agent 主干默认 + 子 Agent 增强与指挥官多 Agent 按需扩展;形态由 AI 按任务自选并在门禁声明一行理由,用户指名优先)、列出实际读过的文件。
- 没有读到 `SKILL.md` 或 `VERSION` 时,不伪造,停止并请求只读权限。

**宿主对齐(Host Alignment,仅首次、仅一次、不阻塞)**:加载证明之后、首次门禁之前,输出一次**宿主对齐声明**——①宿主已有能力清单(规划/二次确认/审查门禁/验收流程,逐项)②与本 skill 的重叠映射(被宿主完整覆盖的小节标 SKIP)③裁剪后的使用范围。

- **生效方式**:声明输出即生效,默认不等待用户确认——用户已下达任务时,当轮继续执行任务,不得以对齐/门禁为由停在等待态;用户可事后纠正,纠正即时生效并覆盖默认。
- **事实采集**:未证实的能力按保守假设处理(视为宿主不具备,保留 skill 纪律)并标 `UNVERIFIED`。声明可写入项目 `<项目根>/docs/agents/host-alignment.md` 供同项目复用。
- **不可跳过的底线**:证据报告、`UNVERIFIED` 诚实标记、真实环境验收——没有亲自验证过的验证,不得声称"宿主已验证"。
- **适配边界**:AI 不得为适配而修改 skill 本体文件,适配产物只落在项目侧。宿主平台提供"写文件/运行命令二次确认"类开关时建议开启,作为门禁的机器级兜底——指令级规则无法 100% 约束不守规则的模型。
- **与门禁的关系**:宿主对齐完成后,按风险分档决定是否触发【实现前确认】门禁:轻通道直接执行,中/重档输出门禁并等待授权——对齐本身不替代门禁。

## 协作架构:单 Agent 主干 + 两个按需扩展

主干(默认,原模式1)· 单 Agent 模式 —— 同一模型内部切换规划面、执行面、审查面;绝大多数任务由此完成。

扩展A(原模式2)· 子 Agent 增强 —— 任务适合并行或隔离(并行分支、独立审查)且宿主支持子 Agent 时,把部分角色面映射为子 Agent;启用前必须先确认子 Agent 能力,能力未证实退回主干并标记 `UNVERIFIED`。

扩展B(原模式3)· 指挥官多 Agent —— 需要协调独立大模型/Agent 或经用户转交时,对该任务启用模式三协议(角色身份确认、协调通道确认、完整任务包与闭环);只影响启用的任务,不改变主干地位。

可混合搭配:同一任务的不同阶段可用不同形态。形态由 AI 按任务事实自选并在门禁声明一行理由(判定顺序见 agent-modes 的模式自选),用户指名优先、可随时切换;启用扩展须先用一句话说明理由,并各过各的确认门禁。

## Mandatory Pre-Implementation Gate

在创建项目目录、编辑文件或运行实现命令之前,先输出以下内容并停止(**具体触发挂点与降级条件见下方「门禁挂点」节**):

```text
【实现前确认】
- 我理解的目标:...
- 任务类型:基于网络搜索判断(非内部静态分类)— 创意 / 代码 / 绘画 / 建模 / 数据 / 冒险 / 混合 / 其他(搜索发现的新类型)— 流程严格度自适应说明(创意类松/代码类严/混合类分治)+ 搜索依据摘要;**执行中类型变化须在证据报告记录**;**任务参照系(Task Constitution)摘要**:目标精确定义、质量标准(可检查的具体标准)、关键决策点、变更记录初始状态
- 风险分档:轻 / 中 / 重(或自定义中间档)— 判定理由(决定走轻通道还是全流程)
- 形态选择:单 Agent 主干 / 子 Agent 增强 / 指挥官扩展 — 一行理由(判定顺序见 agent-modes;轻通道免填)
- 已盘点可用资源:本地 skills / 可装技能候选(批准后才装)/ 可复用模板与现成实现 / 网络参考(逐项列出;查过但不适用才可写"无适用")。**已装 skill 按「资产编排」条款标注:适用子问题 / 选用理由 / 输出验证方式;不适用的写具体理由,禁止"当前够用"式无理由弃用**。**资源使用计划:本次任务将使用哪些资源、在哪个阶段使用、解决什么子问题;根据任务强度与类型判断是否需要进一步网络下载/安装(简单任务本地足够即可,复杂/高风险/陌生领域必须主动搜索候选)**。任务主质量维度(视觉/交互/文案/数据/安全等)已被宿主已装 skill 覆盖时默认用它主导,弃用须写理由。
- 最高影响问题(可多项):...(技术风险与已知权衡,供你判断,不是提问)
- 推荐方案:...(创意/审美主导任务须并列 2–3 个真实不同的方向:保守/均衡/大胆至少各一;"大胆"必须是真候选——写明它多做什么、冒什么险、为什么值,不许陪跑凑数)
- 其他选项:...(我已评估并否掉的备选,信息性、**不需要你选**)
- 完整计划:...
- 澄清方式:A 一次性确认推荐方案 / B 逐项问答(B:一次只问一个最高影响问题,每题给 2-3 个实质方案、推荐方案、自由方案出口和“继续调研”出口)
- 需要你确认:...(等你拍板的选项 + 推荐;与「其他选项」的区别:那栏是我否掉的,本栏是我无法替你定的)
- 确认范围(创意任务固定句):本次确认锁定目标、范围、交付物与落盘路径;风格与方向不因确认锁死——实现中允许迭代甚至换向,换向须在证据报告里说明原因
- 声明持续有效条件:本次确认的范围/分档/资源清单在何种变化下失效(如新增破坏性操作、范围扩大、发现新依赖、任务性质变化);失效时自动触发重新确认,不得静默沿用旧声明
- 完成标准与失败行为:什么算完成(可检查的具体标准,如"所有按钮点击后状态正确切换且无控制台报错")、失败了怎么办(重试上限/降级方案/上报条件)、停止条件(什么时候停止扩展范围,避免无限迭代)
```

硬性规则:

- 宣布阶段序列不是确认。
- “开始”“现在开始”“直接做”不是实现授权。
- “你决定”“按最高质量方案做”是显式委托;记录决定后再继续。
- 未盘点可用资源就输出计划,视为计划不完整。
- 用户确认前不创建目录、不写文件、不运行实现命令。

轻量任务通道(按风险分档,逐条满足才可适用):任务指令具体明确、影响面小(单文件小改、格式/错字修正、纯问答)、完全可逆、无破坏性与外部副作用时,**该指令本身即为授权**,可跳过【实现前确认】与资源盘点直接执行;执行后仍须报告实际改动与证据。**不适用轻通道的操作**:破坏性操作、外部执行/发布、不可逆动作、多代理派发(以上四类与门禁挂点一致);**另有含糊指令**(指令本身不明确,需先澄清再分档,澄清后按实际风险判定——不属于门禁挂点的风险操作类);判定拿不准时自动升为中档全流程。(全新产物默认中档,细则见下方排除项①。)**分档不限于轻/中/重三档——AI 可自定义中间档(如"轻偏中""中偏重"),但须在门禁声明判定理由;高质量产出为主,不为走轻通道而降低质量标准。**
轻通道**排除项与边界**(命中即升中档全流程):①从零新建产物默认中档——除非指令已完整指定产物类型、位置与形态,否则不得走轻通道(新建产物涉及多文件与产品决策、不该默认绕过门禁;形态选择在门禁中由 AI 提议、用户裁决——被升档的原因是多文件与产品决策,而非"形态须由用户指定");②多交付物(≥2 个独立产物);③并行信号("同时/并行/一起做" → 若并行任务均为轻通道级可仍走轻通道,但每个任务的改动与证据须分别列出;任一任务为中/重档则整体走全流程声明形态选择)。

创意/审美主导任务的分档与方向豁免:风险分档的判据是**不可逆性、影响面、副作用**——审美方向的大胆不是风险:被否掉的方向重做一次的成本,低于所有参与者都交安全解的成本。完全可逆、本地、无副作用的创意产物,**仍走中档全流程(落盘路径与范围仍须确认),但允许跳过方向确认、直接选最大胆的自认方案起跑**,并在证据报告标注「本次方向为冒险直选」;判定拿不准仍升中档。

**门禁挂点(确认门禁看风险操作,不看任务受理)**:确认门禁只适用于**破坏性操作、外部执行/发布、不可逆动作、多代理派发**四类风险操作;任务受理、宿主对齐、轻通道修改不触发口头请示。宿主已具备机器级权限兜底(写文件/运行命令授权确认,在对齐声明中认定)时,中档任务的【实现前确认】降级为**事前一行声明(含目标、风险分档、资源盘点摘要、完成标准)+ 事后证据报告**(资源盘点与风险分档仍须做,随产物交付,不再停止等待口头确认);四类风险操作与重档仍须事前确认。边界情形(拿不准是否可逆/影响面)默认询问——拿不准就问,不算违反自动对齐。

## 模式3规则

- 使用模式三前完成【角色身份确认】和【指挥官协调通道确认】,并等待用户明确回复;平台工具可用不等于用户确认——用户选择用户转交后,不得擅自改用直接工具或子 Agent。
- 接收方按"角色 + 平台/窗口"命名(笼统的"另一个 AI"不够),身份声明只含角色与任务 ID;底层大模型是可选参考元数据——**从不主动询问**,仅在用户主动告知时记录,模型变动不使任务包或台账失效。模式三规划写入项目 `docs/plans/`,不能只在对话里输出。
- 完整协议——通道能力自查(直接工具/子 Agent/MCP/API 逐接收方判定)、接手协议(自洽检查/亲自核验到文件:行号/三分裁决/派发台账/下一轮可转述文本)、23 字段任务包与接收方启动提示词、身份登记与最小角色集——见 `references/multi-agent-closure-rules.md`(权威版)。

## 模块化选择矩阵(流程解耦)

**原则**:不是所有任务都需要全流程。按任务规模匹配默认配置,有明确理由时才偏离。选择结果必须在门禁中声明,执行中任务变复杂必须自动升级并记录。

| 任务规模 | 判定标准 | 必选模块(不可跳过) | 默认精简(可跳过) | 升级条件 |
|---|---|---|---|---|
| **轻量(验证聚焦版)** | 单文件 / <50行 / 一次性脚本 / 简单查询 / 纯文本改写 | 加载证明、**精简门禁(5字段)**、**核心验证(按任务类型必选)**、**1轮审查(必须含验证)**、证据报告(精简版)、诚实标记 | 任务参照系(改为一句话目标声明)、完整资源盘点(改为一句话摘要)、循环审查(2轮→1轮)、实操闭环(无GUI标UNVERIFIED)、宿主对齐(首次可跳过) | 涉及外部系统写入、不可逆操作、用户明确要求严谨、**验证发现问题需升级** |
| **轻量+(验证深度增强版,A2+)** | 中等复杂度 / 需要高可信度 / 开放方法任务 / GUI交互任务 | 轻量全部必选模块 + **多路径交叉验证(核心结论至少2种独立方法)** + **验证证据必须入交付物(evidence/目录)** + **质量标准可检查化(一句话目标声明含可检查完成标准)** + **覆盖面枚举强制前置(输入域分段+ALL GREEN盲区自查声明)** | 同轻量 | 同轻量 |
| **中等** | 多文件 / 有用户的产物 / 需维护 / 有交互界面 / 涉及API调用 | 核心 + 任务类型判断 + 分阶段执行 + 循环审查(2轮) + 证据报告 | 网络搜索可减深度(1次而非多次)、实操闭环无GUI时标UNVERIFIED | 复杂度超预期、发现新风险、用户要求升级 |
| **重型** | 大型项目 / 多Agent协作 / 生产级 / 高风险 / 涉及安全 | 全流程(无精简) | 无 | 无(已是最高档) |

**轻量+(A2+)配置的核心原则:在轻量的精简骨架上增加验证深度,不增加流程步骤。** 五个增强点:①多路径交叉验证——核心结论必须用至少2种独立方法验证(如统计方法+领域知识、Python计算+公式推导、主实现+变异测试),不是"做更多审查"而是"用更多路径验证同一个结论";②验证证据必须入交付物——所有验证脚本、测试结果、交叉验证证据必须放在交付目录的 `evidence/` 下,证据报告只引用不声称(修复"宣称了但没附脚本"和"做了但没入交付物"两类失分);③质量标准可检查化——一句话目标声明中必须包含可检查的完成标准(如"所有按钮点击后状态正确切换且无控制台报错"),不是笼统的"功能完整";④**保守度调节**——多路径验证用于确认(确保不漏报),但最终主报告只取最保守方法的结果(确保高精确率),其他方法检测到但保守方法未确认的作为"候选/待确认"附在附录,不污染主报告。适用场景:安全监控/异常检测宁可错报不漏报用全量报告;精确评分/正式交付用保守主报告+候选附录;⑤**覆盖面枚举强制前置 + ALL GREEN 盲区自查声明**——多路径验证开始前,必须先枚举输入域的分段(正常值/边界值/异常值/安全注入/任务书点名的特殊场景),每个分段至少有一个测试用例触达;当验证全部通过(ALL GREEN)时,必须在证据报告中声明「覆盖了哪些输入域分段、哪些可能未覆盖、为什么认为覆盖足够」,禁止只报通过率不报覆盖面;未枚举覆盖面的验证结果按 `UNVERIFIED` 处理(ab-v4 G2 反例:多路径全绿但中文域名/双点域名等任务书点名边界全部放行——多路径≠覆盖面,验证错了也全绿)。

**轻量配置的核心原则:精简≠省略验证,而是聚焦最关键的验证。** 轻量任务必须保留按任务类型的核心验证(数据类→Python独立计算、代码类→语法+边界测试、视觉类→对比度计算、建模类→OBJ语法检查、冒险类→结局可达性检查、研究类→来源核查),不得因"轻量"而跳过验证。选择轻量配置时必须在门禁中声明「跳过了哪些非验证模块、为什么、核心验证做了什么」。

**AI正常发挥基线(B'参照)**:当今AI平台面对任务时会主动搜索、验证、结构化输出。本skill的增量在于**验证纪律**(循环审查逼出遗漏、多维度验证发现不一致、证据闭环可复现),而非"让AI从不会到会"。若任务简单到AI正常发挥已足够,可选择轻量配置;若任务涉及多维度验证或高风险,应升级为中等/重型。

**三条底线任何规模都不可跳过**:诚实标记(UNVERIFIED)、证据报告(含可复现验证命令)、真实环境验收(无法执行时标UNVERIFIED而非跳过)。

**按任务类型调整(在规模配置基础上叠加)**:

| 任务类型 | B'基线 | A1全流程 | skill增量 | 实操验证 | 循环审查 | 特殊要求 | 实验依据 |
|---|---|---|---|---|---|---|---|
| **数据类** | 7.5 | 9.4 | +1.9 | **必选**(任何规模,用Python/Excel独立计算关键指标) | 2轮,第1轮必须含数据准确性抽查 | 数据质量说明为必选章节;轻量配置也不能跳过数据验证 | batch81:跳过验证导致29%数据错误 |
| **代码类** | 7.0 | 8.8 | +1.8 | 必选(中等以上规模),轻量可仅语法检查 | 2轮 | 边界用例覆盖为必选 | batch79:全流程发现更多边界问题 |
| **创意类** | 7.0 | 8.6 | +1.6 | 可选(替代为创意结构化检查:是否遗漏关键部分、调性是否一致) | 1轮即可 | 大胆默认,门禁只锁范围不锁方向 | batch80:第2轮循环审查价值低 |
| **研究类** | 6.5 | 8.6 | +2.1 | **必选**(关键数据点多源交叉验证,单一来源标注待验证) | 2轮,第1轮必须含事实准确性抽查 | 不确定性声明+方法论说明为必选章节;来源标注可信度和验证状态 | batch83:无来源=不可信,B臂含编造数据 |
| **绘画/视觉类** | 6.5 | 8.4 | +1.9 | 中等以上必选(配色对比度计算+SVG可渲染性+深色模式) | 2轮,第1轮必须含视觉检查(配色/布局/可访问性) | 必须有可验证的视觉产出(SVG/代码);可访问性规范为必选章节;搜索聚焦设计趋势和反模式 | batch84:A2臂白字/橙底2.84:1不达标,A1发现并修复 |
| **建模类** | 6.0 | 8.8 | +2.8 | 中等以上必选(OBJ/FBX语法验证+多边形计数+UV范围+法线归一化+PBR参数范围) | 2轮,第1轮必须含技术检查(拓扑/UV/法线/PBR/LOD) | 必须有可执行模型文件(OBJ/FBX);自动化验证脚本为必选交付物;质量检查清单带验证结果 | batch85:B臂无OBJ不可用,A1完整OBJ+验证脚本通过 |
| **冒险/叙事类** | 6.0 | 8.7 | +2.7 | 中等以上必选(分支完整性+死胡同检测+结局可达性+无意义选择+状态一致性) | 2轮,第1轮必须含分支逻辑检查 | 必须有自动化验证脚本;结局用状态机判定而非固定指向;每个选择必须有不同后果 | batch86:A1发现并修复2个不可达结局,状态机判定后全部可达 |
| **复合类** | 6.0 | 8.6 | +2.6 | 中等以上必选(按子任务分治,多维度验证:数据+视觉+代码) | 2轮,第1轮必须含跨维度一致性检查 | 识别各子类型并分别应用对应验证;交叉验证各子系统输入输出匹配 | batch88:A1发现预算数据错误(85%→94%),多维度验证发现跨维度不一致 |

> **B'基线说明**:B'=无skill但AI正常发挥(主动搜索+验证+结构化)的分数;A1=skill全流程分数;skill增量=A1-B'。增量越大说明该类型越需要skill的验证纪律。建模/冒险/复合类增量最大(+2.6~+2.8),创意类最小(+1.6)。

**精简声明要求**:选择了轻量或中等配置时,门禁中必须写明「跳过了哪些模块、为什么、对质量的影响评估」;证据报告中必须对照声明检查实际执行情况。声明了但未执行=形式执行,按未处理。

## 工作流

1. 续会全面体检(Resume Check,7 项:Git 状态 / 门禁与阶段 / 文档与实现同步 / 遗漏与矛盾 / 重锚定原始指令全文 / 项目根硬检查 / 先报告修过期再续):接手既有会话或用户说"继续/检查项目"时必做,权威版见 references/series-reasoning-workflow.md 的 Resume Check 节。
2. **动态任务类型判断 + 跟用户确认任务(A/B)+ 制定任务参照系**:先主动网络搜索该任务领域的最新分类、行业标准、最佳实践和类似案例,再基于搜索结果判断初始任务类型(创意/代码/绘画/建模/数据/冒险/混合),按类型确定流程严格度;**任务类型不是一次性锁死——执行中每阶段审查时重评估,发现变化自动调整并记录**;再跟用户确认任务目标、怎么做、用什么——提供 A 一次性确认推荐方案 / B 逐项问答(一次只问一个最高影响问题,每题给 2-3 个实质方案+推荐+自由方案出口);用户确认后**制定本任务的参照系(Task Constitution)**——包含目标精确定义、任务类型及判断依据、质量标准(可检查的具体标准)、流程严格度、关键决策点、变更记录;参照系不是一次性锁死,每阶段审查时对照检查并更新。用户确认前不创建目录、不写文件、不运行实现命令。
3. **盘点本地资源 + 主动网络搜索 + 整合评估 + 资源使用计划**:盘点已装 skills/可复用模板/现成实现/本地文件(必做);主动网络搜索相关信息/开源项目/可安装 skill/最佳实践(必做,不是可选项);**根据任务强度与类型判断是否需要进一步网络下载/安装资源**——简单任务本地资源足够即可,复杂/高风险/陌生领域必须主动搜索可安装的技能/工具/库并给候选清单(安装须经用户批准);整合评估怎么组合使用这些资源才能更好完成任务、提高产物质量(资产编排条款);**输出资源使用计划**——本次任务将使用哪些资源、在哪个阶段使用、解决什么子问题;未使用的已盘点资源必须说明原因。禁止盘点完直接从零开始。
4. **风险分档 + 实现前门禁**:轻/中/重三档或自定义中间档(须声明理由),高质量产出为主;输出实现前门禁(含任务类型、风险分档、已盘点资源等字段)并等待用户授权。
5. **分阶段执行 + 每阶段审查(对照任务参照系)**:把任务分为一个个阶段,每完成一个阶段重新审查——是否与原计划符合?范围/风险/资源是否变化?**任务类型是否发生变化(如创意任务中途发现需要复杂数据处理)?类型变化时自动调整流程严格度并记录**;**必须对照任务参照系检查——当前执行是否还符合参照系?参照系是否需要更新?(目标变了?类型变了?质量标准变了?)更新必须记录原因,不得静默修改**;没问题继续,有问题调整并记录;重评估风险分档与资源清单是否仍然成立。循环直到完成。
6. **完成后循环审查**:任务完成后对产物进行循环审查,直到连续 2 轮没发现问题为止;审查维度:功能正确性、代码质量、边界条件、用户体验、视觉反馈、与目标一致性。
7. 实操体验闭环(**用户体验层面,与第5步的代码审查不同**):以真实用户方式亲自操作每一处交互(按钮/按键/手势/反馈/视觉)并截图留证,修复后亲自复验;循环到自评通过或上限(默认 3 轮,门禁中声明的重试上限优先于默认值);运行环境无 GUI/截图能力时如实标 `UNVERIFIED` 并给出用户自验步骤。结论为「未发现问题」时,必须同时报告检测方法与覆盖面。
8. 主动执行发散-收敛的 bug sweep,不等用户发现;完成时给出实际文件、命令、测试、Git 状态与截图证据,未验证项标 `UNVERIFIED`;**证据报告核心要求(缺一不可)**:①完成声明必须附可复现验证命令;②闭环检查——对照门禁时的盘点清单/风险分档/确认范围,逐项说明实际应用情况;③同时须满足「通过率不是鉴别力」要求;④**反例验证(必做,可检查)**:证据报告必须包含至少一个"故意制造错误→验证脚本是否能抓到"的反例测试——代码类至少1个变异体(修改一行代码)验证测试套件能变红,数据类至少1个已知错误值注入验证计算脚本能检出,创意类至少1个关键要素遗漏检查;无反例验证的证据报告按 `UNVERIFIED` 处理;反例验证结果必须写入证据报告(注入了什么错误、验证脚本是否抓到、抓到的具体表现);⑤**验证脚本可复算性(必做,可检查)**:所有验证脚本必须在交付目录中、不依赖执行者的本地环境变量/缓存/未声明输入、第三方在干净环境中运行应得到与证据报告相同的结果;证据报告必须包含"复算说明"(环境、命令、预期结果);声称"独立交叉验证"但未附验证脚本的按形式执行处理(未验证)。**补充要求**:证据产物留在交付目录,运行时临时物隔离在交付目录之外、任务后限本臂自清理、禁全局 taskkill;声明里的计数与覆盖面须与产物双向一致;证据以鉴别力而非体积计;**覆盖面枚举前置(所有配置必选)**:验证开始前必须先枚举输入域分段(正常值/边界值/异常值/安全注入/任务书点名的特殊场景),每个分段至少有一个测试用例触达;ALL GREEN时必须声明"覆盖了哪些分段、哪些可能未覆盖、为什么认为覆盖足够";发现的盲区必须同步登记到 `UNVERIFIED` 清单(盲区是什么、为什么未覆盖、影响评估);未枚举覆盖面的验证结果按 `UNVERIFIED` 处理,只声明盲区不登记UNVERIFIED的按形式执行处理。
9. **文件整理与归档**:某类文件放某文件夹(代码/文档/素材/证据分类存放);清理运行时残留垃圾(临时文件/缓存/浏览器 profile/临时端口);证据统一放一个文件夹;清理限于本任务自有目录。
10. **最终汇报**:把所有都告诉用户——做了什么、怎么做的、用了什么资源、发现了什么 bug、验证结果、未验证项、文件结构、简化项清单(如有)、**任务参照系的变更历史(初始参照系是什么、执行中更新了几次、每次更新的原因)**;具体说明,不笼统说"已完成"。

完整流程与审计模板见 `references/series-reasoning-workflow.md`(按其头部 Section Map 定位取节,勿整读)。

## References

- `references/master-process-reference.md`:**主过程参照系(设计原点)**——用户最原本的想法,所有修改应对照此文件,确保不偏离;含 SKILL.md 靠拢进度追踪表
- `references/series-reasoning-workflow.md`:完整流程与审计模板(先读头部 Section Map,按节取用)
- `references/agent-modes.md`:协作架构与确认模板(形态判定只读头部 `Mode Self-Selection` 节)
- `references/multi-agent-closure-rules.md`:多 Agent 闭环规则(模式三权威版)
- `references/identity-library.md`:身份库契约
- `references/commander-roles.md`:角色库与最小角色集
- `references/series-reasoning-lessons.md`:反模式与教训
- `references/common-failures.md`:高频造假对照表(完成声明前对照)
- `references/series-reasoning-examples.md`:行为示例
- `references/project-artifacts.md`:治理产物落盘约定(配套 `scripts/artifact-check.py`)
- `references/project-policy-template.md`:项目政策模板(复制到项目内使用;项目专属规则不写回本 Skill)
- `references/series-reasoning-workflow-en.md`:workflow 英文镜像(中文宿主勿读)
- `references/self-test.md`:安装后自测(人工执行,宿主任务路径无需读取)
- `references/platform-installation.md`:安装方式
- `docs/minimal-discipline.md`:最小纪律速查卡(不装完整 skill 时的三条常驻规则)

## Version

Current version: 1.2.2 (public release; post-1.2.2 rule increments are tracked as Unreleased batches in [CHANGELOG.md](CHANGELOG.md) — cite the batch when it matters).