---
name: ontology-constraint-and-knowledge-injection
description: |
  用于要决定本体知识写进Prompt、走RAG还是微调、规则型任务需要提高可解释性和一致性，用户出现“Prompt RAG 微调怎么选”“本体怎么注入大模型”或 knowledge injection, prompt vs RAG vs fine-tuning, ontology constraint 等信号时调用。不适用于还没有定义要加载的最小知识范围。
metadata:
  tags:
    - embedding
    - prompt
    - fine-tuning
    - synthetic-data
    - decision-framework
    - enterprise-ai
    - ontology-driven
  related_skills:
    - slug: intent-driven-minimal-ontology-loading
      relation: depends-on
---

# 本体约束与知识注入策略选择

## 方法骨架

- 根据风险、问题清晰度、知识稳定性和运行成本选择本体约束与注入路径。
- 少量高风险规则优先显式注入，让模型看到明确结构、阈值和限制。
- 大量文档和模糊表达采用向量召回，再用图查询校验关系与规则。
- 高频、稳定、规模足够的任务可评估指令微调或本体生成合成数据。
- 只有Prompt无法满足一致性、延迟或成本目标时才升级训练路径。
- 任何路径都要绑定真实事实、版本和外部验证，防止错误本体放大偏差。

## 触发场景

### 用户会在什么情境下需要这个 Skill

1. 要决定本体知识写进Prompt、走RAG还是微调
2. 规则型任务需要提高可解释性和一致性
3. 图检索、向量检索和训练方案之间需要权衡

### 语言信号

- “Prompt RAG 微调怎么选”
- “本体怎么注入大模型”
- “图检索和向量检索各用在哪”
- 英文信号：knowledge injection, prompt vs RAG vs fine-tuning, ontology constraint

### 与相邻 Skill 的区分

- 与 `intent-driven-minimal-ontology-loading`：最小加载先决定知识范围；本 skill 决定知识进入模型的技术路径和约束强度。
- 与 `fact-reason-goal-explainable-decision`：本 skill 提供模型所需知识；事实事理目标负责组织具体决策。

## 执行步骤

Skill 激活后按以下顺序执行：

1. **刻画任务**
   - 动作：评估风险、问题清晰度、知识规模、稳定性、时效、频次、延迟和可解释要求。
   - 完成标准：每个维度有证据和等级。

2. **确定约束强度**
   - 动作：低容错、规则明确任务采用强显式约束；探索任务采用候选检索与软约束。
   - 完成标准：约束强度与业务风险一致。

3. **选择注入路径**
   - 动作：默认Prompt/上下文；文档规模大时图向量混合RAG；稳定高频且Prompt不足时评估微调；数据稀缺时谨慎使用合成数据。
   - 完成标准：选择理由、成本和升级条件明确。

4. **绑定事实与版本**
   - 动作：所有规则和知识关联来源、版本、适用范围和实时事实。
   - 完成标准：过期或无来源知识不会进入确定性输出。

5. **设计对比验证**
   - 动作：用同一测试集比较准确性、一致性、可解释性、延迟、成本和风险。
   - 完成标准：只有新增路径达到门槛且无关键退化时升级。

### 固定输出

最终结果至少包含：输入与假设、逐步判断、证据与来源、未决项、风险边界、建议动作、完成标准。涉及项目适配时，将方法假设与项目事实分栏表达。

## 使用边界

### 不要在以下情况使用

- 还没有定义要加载的最小知识范围
- 把微调当作实时事实更新机制
- 错误或未经验证的本体用于批量生成训练数据

### 常见失败模式

- **用通用逻辑直接驱动自主决策**：概率推理替代了企业决策逻辑，执行工具又把语言偏差转化成了现实状态变更。
- **在低容错场景接受概率性幻觉**：概率生成与业务正确性目标不一致，且下游系统把文本结果当作可信决策依据。
- **把文档检索等同于可执行知识**：向量相似性提供相关片段，却不能保证业务关系、方向、约束和动作条件完整呈现。
- **纯人工符号建模或纯神经生成走向单边极端**：单一技术范式无法同时覆盖语义抽象效率、业务约束、泛化能力和可解释性。
- **一次性加载全量本体和超长上下文**：有限上下文被低相关知识占据，关键规则的有效权重下降，冲突信息增加概率性选择空间。

### 使用折扣与复核要求

- 当前公开证据缺少不同注入路径的大规模对照实验，实际选型必须用本地数据和成本测试。
- 大模型生成形式结构无法直接证明业务语义正确，生产使用需保留专家确认、工具校验、真实用例和审计记录。

## 相关 Skills

- `depends-on` → `intent-driven-minimal-ontology-loading`；最小加载先决定知识范围；本 skill 决定知识进入模型的技术路径和约束强度。

## 审计信息

- **验证通过**：V1 ✓ / V2 ✓ / V3 ✓
- **测试通过率**：100%（6/6，独立 sub-agent 盲测；详见 test-results.md）
- **首次公开版本**：2026-08-21
- **来源说明**：方法框架受《本体驱动的 AI 数据管理》启发；仓库不包含原书正文。
