mqc-chronicle-master · v1.0.0 · 2026-09-15 · sha256 3d5a7ee27a2ac05f

mqc-chronicle-master v1.0.0A

Immutable. This exact content is served forever at /api/v1/blob/3d5a7ee27a2ac05f.

---
name: mqc-chronicle-master
description: 大事记表大师。把一批案件材料整理成《案件大事记》,产出 Word 交付版、Excel 母表与一份供下游 skill 读取的案件事实底稿。照录原文、每行挂出处、不作法律判断。适用于诉前评估、起诉与答辩的事实部分、庭前准备。
tags: [legal, litigation, chronicle, docx, xlsx, 大事记, 庭前三大法宝]
metadata:
  version: 1.0.0
  author: 缪奇川
  license: MIT
  deliverables: [docx, xlsx, pdf, svg, png, casefile.json]
  dependencies: none
---

# 庭前三大法宝 · 大事记表大师

## 它替你解决的那件事

重大复杂案件一上来材料特别多。一份卷宗里有合同、招标投标文件、验收记录、往来函件、
微信截图、判决书,你要在很短的时间里说清楚"这件事到底是怎么回事",而且这个说法
要能进评估报告、进诉状的事实部分、进代理意见,最后还要在法庭上被对方质证。

大事记表大师做的是这件事里最费时、最不该费时的那一段:把材料里已有的事实一条不漏
地编满,每一条挂上日期、主体、出处和页码。删哪些、加黑哪些、主要内容怎么摘,留给你。

## 它不做判断

这一条不是保守,是这份表的用法决定的。中国法院的审判思路是事实归事实、判断写在
"本院认为"里面。事实部分掺进主观推断或倾向性表述,法官第一眼就会把它整体降权。

所以本 skill 不填:加黑、主要内容的删减、三方视角的摘录取舍、争点归属。
证据状态不由模型判断,由有无证据编号机械决定。主体的角色照录材料用词,
不归并同义、不改写成法律身份。

材料之间互相矛盾时报告,不修正。同一份合同里两处违约金比例不一致、供货时间早于
签订时间、保修期年数栏空白,这些照原样列出来,冲突自己就摆在表上。

## 照录到什么程度

主要内容是原文,不是概括。保真由子序列核验兜底:去掉标点之后,写进表里的每一个字
都必须按顺序出现在源文本里。实测在三百多字的段落里改一个数字就会被拦下。

扫描件与照片走另一条路:栅格化后逐页读图,写成转写稿并存档,转写稿作为材料进管线,
同一套核验原封不动生效。图像来源的行会标明未经逐字核验。

## 事项标题的写法是固定的

有对应文书的写「动词 + 《文书名》」,没有的写「动词 + 宾语」,动词取自封闭动词表。
表外动词一律拒绝并报出,由你补表,模型不自行造词。标题不超过 15 字,不含定性词。

## 日期认不准也不丢

四档精度:确切日、仅到月、仅到年、区间。认不准的按最粗的一档收入并标注,
不因为认不准就不收。判决书上有的事项一条都不许漏。

## 你会拿到什么

- **Word 交付版**:竖版 A4,四周页边距 2.4cm,五列(序号、日期、事项、主要内容、备注),
  表内宋体 11.5 磅单倍行距,英文与数字新罗马,中英文之间不留空格,事项标题加黑。
  给法院的制式。
- **Excel 母表**:备注拆成来源、争点、关联、说明、新证据、证据状态等列,可筛选、
  可按争点分组、序号用公式随增删自动调整。你的工作台。
- **大事记简表**:A4 竖版一张图,呈报给法官或当事人用。
  它是整条管线的最后一道,不另起逻辑:Word 与 Excel 都做完之后,
  把同一份「渲染输入.json」换一个格式呈现而已,不重新读材料、不重新判断,代价极小。
  结构承 Word 交付版,
  只去掉「主要内容」那一列——原文照录那一段是 Word 与 Excel 的活,搬上图就成了第二份 Word。
  四列与 Word 同名同序:序号、日期、事项、主要内容;去掉的是「备注」那一列——
  备注一格里塞着来源、争点、关联、标记好几段并列信息,排进图里必然乱,
  而主要内容是一段连续原文,折行就是自然的段落折行。来源与标记在 Word 与 Excel 里都有。
  主要内容在图上至多三行,**按句读边界取**:逐句累加,取到完整的句子为止,一句或两句。
  不按字截、不加省略号——这是呈报给法官与当事人的东西,半句话和省略号都会让人问
  「为什么不给我全的」。每个字仍是原文,只是少取几句,所以不违反「照录、不得改写」。
  第一句本身就超行时退到次级边界(逗号、顿号、冒号)并补句号收住;
  宁可多占一行,也不让半句话出现在呈报件上。
  一律以句号收尾:停在分号上的、原文本就没有句末标点的,都补成句号——
  呈报件上一句话必须是说完的。这是规范标点,不动内容。
  主要内容按正文段落排:一律左起、右侧除末行外都对齐,不居中;
  居中会让这一列每行的左边界都不一样,整列看着是散的。
  读的是 Word 与 Excel 同一份 渲染输入.json,
  所以日期写法、序号、备注里的标记与 Word 逐字一致。外面一个小圆角矩形把整表包住,
  内部只有横线,不画竖线。分了争点的,每组的标题做成红底白字的小圆角色块,
  摆在该组左上角,不压横线;全图的红只有这一处。一页放不下自动出第二页,页脚标页码。
  交 PDF(呈报)、SVG(可编辑源,字要改就改它)、PNG(预览)。
  律师在母表里填了争点就按争点分组,没填就按时序平铺,不额外要求他填。
  格内的排法:整块文字纵向居中;表头与整格一行的内容横向居中;
  多行时同一段落里折出来的行两端对齐、段末行靠左;折行避孤字,末行少于三字就从上一行借。
  中文宋体、英文数字新罗马,按字符集分段。
  标题用方正小标宋简体,本机若没装,导出时会换用替代族并在日志里报出来——
  SVG 里写的仍是方正小标宋,在装有该字体的机器上打开或重出 PDF 即可。
- **案件事实底稿**(casefile.json):机器读的那一份。事实编号一旦分配不再变动,
  下游的法律关系图大师与攻防图大师读同一份底稿,三张图上的同一件事指向同一个编号。

## 它只做大事记

简表是这份大事记自己的索引,不是分析图:它不做请求权基础分析、不判断争议焦点。
图上出现的每一项都是底稿里已有的字段,或由字段机械算出——深红只给两处机械标记,
新证据与图像来源,都不是判断。真正的分析图交给法律关系图大师和攻防图大师,
它们读本 skill 产出的同一份底稿。

---

# 对内:执行管线

## 立场

模型读懂意思,代码算和验。模型只在第二步输出 JSON,其余全部确定性。
任何一条判据不成立即拒绝出表,不得降级硬填。

## 先读什么

0. `references/casefile-guide.md` —— 怎么把一批材料读成 casefile.json:次序、逐项填法、可粘贴骨架
1. `references/extraction.md` —— A 切分 / B 主要内容 / C 事项标题 / D 日期 / E 不作判断,五组条文
2. `references/verbs.json` —— 封闭动词表
3. `references/ban.json` —— 定性词表(只施加于模型撰写的字段)

## 工作流

    1 摄入   scripts/ingest.py        探测(逐页可读字符,剥页码标记,空白页不计)
                                      → 文字型直读 / 扫描件 150 DPI 栅格化
    2 读图   (模型,仅扫描件)        逐页读图 → 转写稿存档 → 作为材料进管线
    3 抽取   (模型)                  照 A-E 出事实行,写进 casefile.json
    4 校验   scripts/check_facts.py   A/B/C/D/E/I 六组判据 + 改坏验证(项数由脚本自报)
    5 渲染   scripts/to_render.py     底稿 → Word 交付版 + Excel 母表
    6 简表   scripts/build_brief.py   渲染输入.json → A4 竖版 SVG(分页、分组或平铺、出图前自证)
             scripts/export_brief.py  SVG → PDF(多页合一)+ PNG;正文、西文、标题三族各换各的
    7 自检   tests/                   渲染层判据 R 组(底稿到渲染输入不得改动内容)
                                      + 交付物自检 W 组(Word)与 X 组(Excel)
                                      + 简表自检(版心、A4、圆角外框、序号连号、中西文分族、
                                        红只用于分组色块、句号收尾、无内部痕迹、页码)

## 集中红线

### 一、大事记本体(Word 交付版 · Excel 母表 · 底稿)

- 不填判断字段:加黑、删减、摘录取舍、争点归属
- **主要内容照录,模型不得省略或改写**;需要省略的由律师在母表内完成
- 动词表外的动词一律拒绝,不自行造词
- 完备性对账不平(有未读页)即拒绝出表
- 无证据编号的事实必须同时进入不确定清单;但这一类**不出尾注**——
  证据状态已由有无证据编号机械算出,备注里也写了「未见书证」,
  再出一条注说同一件事,六条事实就是六条同样的话。清单留在底稿里供律师查,不上交付面
- 尾注同一句话只出一条,多条事实共用注号
- 材料名在交付面去掉扩展名与上传时间戳前缀;要更规范的名称直接改 materials[].name
- 材料自身的矛盾报告不修正;算术自校是证据不是判据
- 事实编号一旦分配不再变动,删行不回收(下游已引用)
- 渲染层一个字都不许动底稿:事项、主要内容、证据状态、日期精度、来源、主体
  逐项有判据(R 组)。这一层是三件产物的共同上游,一错三件一起错,
  而全量自检原先压根不跑它——实测把它逐项改坏,九项里九项全漏
- 简表同理:事项与日期逐条进图,主要内容必须是原文的前缀且停在句读上。
  判据要盯真正画进去的那份数据,不能只查生成函数的返回值——
  实测绕开函数直接改渲染数据,只查函数的判据一条都不报

### 二、简表(呈报件)

- 读 渲染输入.json,与 Word、Excel 同源;另起一套映射必然与 Word 对不上
- 四列与 Word 同名同序,不设备注列
- **主要内容由代码按句读边界取**,取到完整句子为止,一律以句号收尾。
  这与上面「不得省略或改写」不冲突:那条管的是模型,这里是代码少取几句,
  每个字仍是原文,且 Word 与 Excel 上的全文一字未动
- 是呈报件,不出现省略号,也不出现内部痕迹(Word 交付版、Excel 母表、节录、
  本程序新证据、读图转写未经逐字核验)。那些标注在 Word 与 Excel 上保留,红线仍然守住
- 文字一律不得越出版心,出图前扫产物自证
- 全图的红只用在争点分组的标题色块上
- 中文走宋体、英文数字走新罗马,按字符集分段;每段显式定位,不靠 text-anchor
- 序号、日期、事项逐行居中,折了行也不拉伸——它们是标签性的内容,
  区间日期一被两端对齐就成了「2 0 2 0 . 0 5 . 0 9 至」
- 只有主要内容是正文:按段落排、一律左起、同段折出来的行两端对齐、段末行靠左
- 字族被替换时必须在日志里报出来,不得让人以为产物上就是规范里那个字体。
  SVG 里的字体名只是引用,渲染成 PDF/PNG 需要本机装有同名字体;
  装了方正小标宋与 Times New Roman 的机器上重出即为规范样式,这也是必须交 SVG 源的原因

## 环境

摄入用 poppler 自带命令(pdfinfo / pdftotext / pdftoppm / pdfimages)。
Word 生成走 docx(Node),Excel 生成走 openpyxl,简表的 SVG 生成零第三方依赖。
**简表导出 PDF/PNG 需要 cairosvg**;多页合并成一个 PDF 需要 pypdf,
没装就按页分开出、不阻断。此前 README 与本节都写着「零第三方依赖」,
那是简表进来之前的说法,照着跑会在导出那一步失败。
Excel 不要过 LibreOffice 重算:它会就地重写工作簿并替换本机未装的字体,
公式缓存值由 `cache_formulas.py` 直接写入工作表 XML。