DESIGN.md@read-the-room · git:20260911.36c9cb8 · 2026-09-11 · sha256 176fe020c58b3170

DESIGN.md@read-the-room git:20260911.36c9cb8A

Immutable. This exact content is served forever at /api/v1/blob/176fe020c58b3170.

# 决策简报

> 读这一页就够做判断。要看执行细节再去读同名文件本身。
> 全部内容约 110 KB / 15 个文件,但**日常判断路径只加载 3 个**(证据阶梯 + 透镜 + 话术),其余按需。
> **文件数和总量本身是这套设计的失败模式之一**(见文末)——它是因为被反复加固才长到这个体量的。

## 它是什么

三句话:

1. 把**原话和可观察行为**(L1/L2)与**用户的感受和推测**(L3/L4)分开存放,后者不许支撑任何行动建议。
2. 判断卡在哪,只问三件事:他**想要什么**、他**能不能定**、他**怕什么**。卡点 = 最低的那一环。
3. 信息不够时,**不硬给判断**——给一句探针 + 一个临时判断 + "这个答案会怎样改变结论"。

其余所有内容(证据门槛、五个透镜、三类话术、档案维护、有效期、索引)都是这三条的展开或执行细则。

## 三个承重设计决定

### 决定零:memory 不是记录,是预测—校准循环

**这是整套东西里最重要的一条,也是"越用越准"的唯一来源。**

记录不会自己变成更准的建议。所以每一层记忆都必须服务于**下一次判断**,而不是存档:

| 机制 | 解决什么 | 生效前提 |
|---|---|---|
| 档案三区(事实 / 模式 / 视图)+ 双时相 | 这个人越用越准 | 重复使用 |
| **预测链闭环**(下注 → 对答案 → 修正) | 判断**被检验**,而不是只说一遍 | 每次都写可检验的预测 |
| **规律库**(跨对象,按处境索引) | **新客户第一次**就有质量 | 3 个对象以上 |
| **校准账本**(统计用户自己) | 拦住他在某类人身上的系统性误读 | 5 次预测以上 |

**关键判断:只有前两层的话,第 10 个客户仍然在从零开始——只是档案更多了。"更准"来自跨对象与自我校验,不来自档案数量。**

两条防退化规则:**晋升门槛**(同一模式 3 次才可预测,跨对象 2 次才可迁移,不到门槛不许写成"他就是这样的人");**启用阈值**(复杂度按使用量生长:1–2 次接触只建轻档,第 5 次才启用规律库与校准账本——空模板只会让人不打开它)。

### 决定一:L3/L4 不许支撑行动

用户的感受和标签("他没兴趣""他挺敷衍")**不是证据**。只有原话和行为是。

**为什么重要:** 这是整套东西唯一不可替代的机制。没有它,AI 只会把用户的情绪复述一遍并加一层包装——用户会觉得很爽,然后继续犯同一个错。

**如果推翻它:** 这个 skill 就退化成"帮你想话术的陪聊",不建议保留任何其他部分。

### 决定二:三环定位 + 排除法

判断卡在"想要什么 / 能不能定 / 怕什么"的哪一环,必须能解释为什么不是另外两环。

**为什么重要:** 定错层是最贵的错误,而且动作完全相反——把"不能定"当"不想要"会白让价;把"怕"当"不想要"会越加价值他越怕。

**如果推翻它:** 换成任何等价的定位框架都可以,但不能没有定位——直接跳到"给话术"就是猜。

### 决定三:缺口变提问,而不是变结论

材料残缺时,把"我还不知道什么"变成一句**问流程、不问意愿**的探针,并写清答案会怎样改变结论。

**为什么重要:** 残缺是常态(用户往往只有模糊记忆)。这一条决定了 skill 在信息不足时是**有用**还是**危险**。

**如果推翻它:** 那它只能处理材料充分的场景,也就是最不需要它的场景。

## 我不确定的三件事

1. **落盘值不值。** 写了对象档案、索引、有效期、淘汰区这一整套跨轮维护。它让第 5 轮比第 1 轮准,但要求用户真的重复使用。**如果试用一次就丢,这套维护机制全是负担**——那就砍到只留决策卡。
2. **话术的边界在哪。** 我给的是"可直接复制粘贴的原话"。优势是能直接用,风险是语气对不上用户本人(他可能更直接、更客气、或更年轻),照念会别扭。**可能需要改成"骨架 + 语气变量"。**
3. **分量控制会不会失守。** 协议里写了"材料不足时只给短判断,不要铺满模板",但没有机制保证它执行。这是我最担心的失败模式:**输出一份漂亮但没人看的报告。**

## 需要你判断的(四选)

| # | 问题 | 如果你说"不对" |
|---|---|---|
| 1 | 三环这个定位框架,符合你实际做判断的方式吗? | 换框架——这是骨架,最该先改 |
| 2 | 落盘+跨轮维护,你是真的会重复用,还是只是一次性咨询? | 砍掉档案维护与索引,只留单次决策卡 |
| 3 | 话术该给"原话"还是"骨架+语气变量"? | 改 `references/compose.md` 的交付形态 |
| 4 | 这份 skill 的**输出分量**,你希望多长? | 改 SKILL.md 阶段 4 的分量规则 |

## 唯一真正要紧的风险

**这套东西被做成了 15 个文件 / 110 KB / 7 个阶段,最可能的结局是:你看完觉得有道理,然后一次都没用过。**

分量本身就是它失败的方式。而且更值得警惕的是**它的生长方向**:最近一轮对抗性审查发现,我做的六处修补**全部是新增,没有一处删除或合并**——一个宣称"分量就是失败方式"的设计,在被审查时继续变长了。这本身就是设计缺陷的证据。

所以下一步不该再加东西,而应该**砍**:拿一个真实残局跑一次,看哪几份文件根本没被读、哪些段落没有改变结论——然后删掉它们。

在没有跑过之前,任何新增的机制都是在给一个未验证的假设加复杂度。