ontology-constraint-and-knowledge-injection · git:20260829.7b0e120 · 2026-08-29 · sha256 0ccdf900c038d898

ontology-constraint-and-knowledge-injection git:20260829.7b0e120A

Immutable. This exact content is served forever at /api/v1/blob/0ccdf900c038d898.

---
name: ontology-constraint-and-knowledge-injection
description: |
  用于要决定本体知识写进Prompt、走RAG还是微调、规则型任务需要提高可解释性和一致性,用户出现“Prompt RAG 微调怎么选”“本体怎么注入大模型”或 knowledge injection, prompt vs RAG vs fine-tuning, ontology constraint 等信号时调用。不适用于还没有定义要加载的最小知识范围。
metadata:
  tags: "embedding, prompt, fine-tuning, synthetic-data, decision-framework, enterprise-ai, ontology-driven"
  related-skills: "intent-driven-minimal-ontology-loading:depends-on"
---

# 本体约束与知识注入策略选择

## 方法骨架

- 根据风险、问题清晰度、知识稳定性和运行成本选择本体约束与注入路径。
- 少量高风险规则优先显式注入,让模型看到明确结构、阈值和限制。
- 大量文档和模糊表达采用向量召回,再用图查询校验关系与规则。
- 高频、稳定、规模足够的任务可评估指令微调或本体生成合成数据。
- 只有Prompt无法满足一致性、延迟或成本目标时才升级训练路径。
- 任何路径都要绑定真实事实、版本和外部验证,防止错误本体放大偏差。

## 触发场景

### 用户会在什么情境下需要这个 Skill

1. 要决定本体知识写进Prompt、走RAG还是微调
2. 规则型任务需要提高可解释性和一致性
3. 图检索、向量检索和训练方案之间需要权衡

### 语言信号

- “Prompt RAG 微调怎么选”
- “本体怎么注入大模型”
- “图检索和向量检索各用在哪”
- 英文信号:knowledge injection, prompt vs RAG vs fine-tuning, ontology constraint

### 与相邻 Skill 的区分

- 与 `intent-driven-minimal-ontology-loading`:最小加载先决定知识范围;本 skill 决定知识进入模型的技术路径和约束强度。
- 与 `fact-reason-goal-explainable-decision`:本 skill 提供模型所需知识;事实事理目标负责组织具体决策。

## 执行步骤

Skill 激活后按以下顺序执行:

1. **刻画任务**
   - 动作:评估风险、问题清晰度、知识规模、稳定性、时效、频次、延迟和可解释要求。
   - 完成标准:每个维度有证据和等级。

2. **确定约束强度**
   - 动作:低容错、规则明确任务采用强显式约束;探索任务采用候选检索与软约束。
   - 完成标准:约束强度与业务风险一致。

3. **选择注入路径**
   - 动作:默认Prompt/上下文;文档规模大时图向量混合RAG;稳定高频且Prompt不足时评估微调;数据稀缺时谨慎使用合成数据。
   - 完成标准:选择理由、成本和升级条件明确。

4. **绑定事实与版本**
   - 动作:所有规则和知识关联来源、版本、适用范围和实时事实。
   - 完成标准:过期或无来源知识不会进入确定性输出。

5. **设计对比验证**
   - 动作:用同一测试集比较准确性、一致性、可解释性、延迟、成本和风险。
   - 完成标准:只有新增路径达到门槛且无关键退化时升级。

### 固定输出

最终结果至少包含:输入与假设、逐步判断、证据与来源、未决项、风险边界、建议动作、完成标准。涉及项目适配时,将方法假设与项目事实分栏表达。

## 使用边界

### 不要在以下情况使用

- 还没有定义要加载的最小知识范围
- 把微调当作实时事实更新机制
- 错误或未经验证的本体用于批量生成训练数据

### 常见失败模式

- **用通用逻辑直接驱动自主决策**:概率推理替代了企业决策逻辑,执行工具又把语言偏差转化成了现实状态变更。
- **在低容错场景接受概率性幻觉**:概率生成与业务正确性目标不一致,且下游系统把文本结果当作可信决策依据。
- **把文档检索等同于可执行知识**:向量相似性提供相关片段,却不能保证业务关系、方向、约束和动作条件完整呈现。
- **纯人工符号建模或纯神经生成走向单边极端**:单一技术范式无法同时覆盖语义抽象效率、业务约束、泛化能力和可解释性。
- **一次性加载全量本体和超长上下文**:有限上下文被低相关知识占据,关键规则的有效权重下降,冲突信息增加概率性选择空间。

### 使用折扣与复核要求

- 当前公开证据缺少不同注入路径的大规模对照实验,实际选型必须用本地数据和成本测试。
- 大模型生成形式结构无法直接证明业务语义正确,生产使用需保留专家确认、工具校验、真实用例和审计记录。

## 相关 Skills

- `depends-on` → `intent-driven-minimal-ontology-loading`;最小加载先决定知识范围;本 skill 决定知识进入模型的技术路径和约束强度。

## 审计信息

- **验证通过**:V1 ✓ / V2 ✓ / V3 ✓
- **测试通过率**:100%(6/6,独立 sub-agent 盲测;详见 test-results.md)
- **首次公开版本**:2026-08-21
- **来源说明**:方法框架受《本体驱动的 AI 数据管理》启发;仓库不包含原书正文。