通用助手 编辑复核

文档事实抽取与待核验清单

把长文、合同或产品资料拆成有出处的事实、冲突和未知项,适合交接与研究准备。

场景:资料阅读、知识整理与事实核对输出:事实表 + 来源索引 + 待核验清单更新于 2026-08-03

复制后替换变量

保留结构,先填真实信息,再把结果交给模型运行。

你是一名重视证据链的资料分析助理。请只根据输入材料抽取事实,不要补写材料之外的背景或结论。

请按以下结构输出:
1. 一句话说明本次资料要解决的问题;
2. 事实表:事实、原文依据、适用范围、时间;
3. 冲突项:不同材料说法不一致的地方;
4. 未知与待核验:列出缺少的字段和建议核验来源;
5. 给 {{reader}} 的下一步动作。

规则:将事实、推断、观点分开;没有原文位置就标记“来源缺失”;涉及价格、版本、法规和时间变化的信息必须写明采集日期。

研究问题:{{question}}
输入材料:{{materials}}
读者:{{reader}}
输出长度:{{length}}

使用说明

  1. 先用少量材料试跑,确认事实表的来源字段能回到原文,再扩大资料范围。
  2. 把冲突和未知保留下来,不要为了让摘要完整而强行补齐。

适用判断

适合这些情况

  • 文档里散落着需要提取的事实,人工找容易漏。
  • 要建立结构化记录,方便后续检索。
  • 需要标出哪些信息需要进一步核实。

换个做法更好

  • 你要的是整篇文档的摘要:用《研究资料结构化摘要》。
  • 文档很短:直接读。
  • 文档包含敏感信息:先脱敏再处理。

常见翻车与修正

  • 模型补全了文档里没写明的信息,比如推算出的日期。

    要求所有字段严格来自原文,推算的一律留空并在备注里说明可推算的依据。

  • 同一事实在文档不同位置表述不一致,模型只取了一处。

    要求发现冲突时全部列出并标注位置,不要自行选择哪个正确。

  • 抽取的内容里带了个人身份信息。

    在输入前先脱敏,或明确要求跳过姓名、联系方式、证件号这类字段并标注「已跳过敏感字段」。

怎么判断输出合格

  1. 所有字段来自原文,没有推算填补。
  2. 文档内部的冲突信息全部列出,未自行取舍。
  3. 敏感信息没有被抽取进结果。
  4. 每条事实都带原文位置,可回查。

使用边界

  • 合同、内部纪要和未公开材料贴进去前先删掉当事人姓名、联系方式和金额明细。
  • 抽出来的「事实」只是原文的转述,模型会把推论写成断言;每条要回到原文对位置核过才能引用。