DESIGN.md@read-the-room · git:20260911.36c9cb8 · 2026-09-11 · sha256 176fe020c58b3170
DESIGN.md@read-the-room git:20260911.36c9cb8A
Immutable. This exact content is served forever at /api/v1/blob/176fe020c58b3170.
# 决策简报 > 读这一页就够做判断。要看执行细节再去读同名文件本身。 > 全部内容约 110 KB / 15 个文件,但**日常判断路径只加载 3 个**(证据阶梯 + 透镜 + 话术),其余按需。 > **文件数和总量本身是这套设计的失败模式之一**(见文末)——它是因为被反复加固才长到这个体量的。 ## 它是什么 三句话: 1. 把**原话和可观察行为**(L1/L2)与**用户的感受和推测**(L3/L4)分开存放,后者不许支撑任何行动建议。 2. 判断卡在哪,只问三件事:他**想要什么**、他**能不能定**、他**怕什么**。卡点 = 最低的那一环。 3. 信息不够时,**不硬给判断**——给一句探针 + 一个临时判断 + "这个答案会怎样改变结论"。 其余所有内容(证据门槛、五个透镜、三类话术、档案维护、有效期、索引)都是这三条的展开或执行细则。 ## 三个承重设计决定 ### 决定零:memory 不是记录,是预测—校准循环 **这是整套东西里最重要的一条,也是"越用越准"的唯一来源。** 记录不会自己变成更准的建议。所以每一层记忆都必须服务于**下一次判断**,而不是存档: | 机制 | 解决什么 | 生效前提 | |---|---|---| | 档案三区(事实 / 模式 / 视图)+ 双时相 | 这个人越用越准 | 重复使用 | | **预测链闭环**(下注 → 对答案 → 修正) | 判断**被检验**,而不是只说一遍 | 每次都写可检验的预测 | | **规律库**(跨对象,按处境索引) | **新客户第一次**就有质量 | 3 个对象以上 | | **校准账本**(统计用户自己) | 拦住他在某类人身上的系统性误读 | 5 次预测以上 | **关键判断:只有前两层的话,第 10 个客户仍然在从零开始——只是档案更多了。"更准"来自跨对象与自我校验,不来自档案数量。** 两条防退化规则:**晋升门槛**(同一模式 3 次才可预测,跨对象 2 次才可迁移,不到门槛不许写成"他就是这样的人");**启用阈值**(复杂度按使用量生长:1–2 次接触只建轻档,第 5 次才启用规律库与校准账本——空模板只会让人不打开它)。 ### 决定一:L3/L4 不许支撑行动 用户的感受和标签("他没兴趣""他挺敷衍")**不是证据**。只有原话和行为是。 **为什么重要:** 这是整套东西唯一不可替代的机制。没有它,AI 只会把用户的情绪复述一遍并加一层包装——用户会觉得很爽,然后继续犯同一个错。 **如果推翻它:** 这个 skill 就退化成"帮你想话术的陪聊",不建议保留任何其他部分。 ### 决定二:三环定位 + 排除法 判断卡在"想要什么 / 能不能定 / 怕什么"的哪一环,必须能解释为什么不是另外两环。 **为什么重要:** 定错层是最贵的错误,而且动作完全相反——把"不能定"当"不想要"会白让价;把"怕"当"不想要"会越加价值他越怕。 **如果推翻它:** 换成任何等价的定位框架都可以,但不能没有定位——直接跳到"给话术"就是猜。 ### 决定三:缺口变提问,而不是变结论 材料残缺时,把"我还不知道什么"变成一句**问流程、不问意愿**的探针,并写清答案会怎样改变结论。 **为什么重要:** 残缺是常态(用户往往只有模糊记忆)。这一条决定了 skill 在信息不足时是**有用**还是**危险**。 **如果推翻它:** 那它只能处理材料充分的场景,也就是最不需要它的场景。 ## 我不确定的三件事 1. **落盘值不值。** 写了对象档案、索引、有效期、淘汰区这一整套跨轮维护。它让第 5 轮比第 1 轮准,但要求用户真的重复使用。**如果试用一次就丢,这套维护机制全是负担**——那就砍到只留决策卡。 2. **话术的边界在哪。** 我给的是"可直接复制粘贴的原话"。优势是能直接用,风险是语气对不上用户本人(他可能更直接、更客气、或更年轻),照念会别扭。**可能需要改成"骨架 + 语气变量"。** 3. **分量控制会不会失守。** 协议里写了"材料不足时只给短判断,不要铺满模板",但没有机制保证它执行。这是我最担心的失败模式:**输出一份漂亮但没人看的报告。** ## 需要你判断的(四选) | # | 问题 | 如果你说"不对" | |---|---|---| | 1 | 三环这个定位框架,符合你实际做判断的方式吗? | 换框架——这是骨架,最该先改 | | 2 | 落盘+跨轮维护,你是真的会重复用,还是只是一次性咨询? | 砍掉档案维护与索引,只留单次决策卡 | | 3 | 话术该给"原话"还是"骨架+语气变量"? | 改 `references/compose.md` 的交付形态 | | 4 | 这份 skill 的**输出分量**,你希望多长? | 改 SKILL.md 阶段 4 的分量规则 | ## 唯一真正要紧的风险 **这套东西被做成了 15 个文件 / 110 KB / 7 个阶段,最可能的结局是:你看完觉得有道理,然后一次都没用过。** 分量本身就是它失败的方式。而且更值得警惕的是**它的生长方向**:最近一轮对抗性审查发现,我做的六处修补**全部是新增,没有一处删除或合并**——一个宣称"分量就是失败方式"的设计,在被审查时继续变长了。这本身就是设计缺陷的证据。 所以下一步不该再加东西,而应该**砍**:拿一个真实残局跑一次,看哪几份文件根本没被读、哪些段落没有改变结论——然后删掉它们。 在没有跑过之前,任何新增的机制都是在给一个未验证的假设加复杂度。