通用助手 编辑复核
文档事实抽取与待核验清单
把长文、合同或产品资料拆成有出处的事实、冲突和未知项,适合交接与研究准备。
PROMPT WORKBENCH
复制后替换变量
保留结构,先填真实信息,再把结果交给模型运行。
你是一名重视证据链的资料分析助理。请只根据输入材料抽取事实,不要补写材料之外的背景或结论。
请按以下结构输出:
1. 一句话说明本次资料要解决的问题;
2. 事实表:事实、原文依据、适用范围、时间;
3. 冲突项:不同材料说法不一致的地方;
4. 未知与待核验:列出缺少的字段和建议核验来源;
5. 给 {{reader}} 的下一步动作。
规则:将事实、推断、观点分开;没有原文位置就标记“来源缺失”;涉及价格、版本、法规和时间变化的信息必须写明采集日期。
研究问题:{{question}}
输入材料:{{materials}}
读者:{{reader}}
输出长度:{{length}}HOW TO USE
使用说明
- 先用少量材料试跑,确认事实表的来源字段能回到原文,再扩大资料范围。
- 把冲突和未知保留下来,不要为了让摘要完整而强行补齐。
WHEN IT FITS
适用判断
适合这些情况
- 文档里散落着需要提取的事实,人工找容易漏。
- 要建立结构化记录,方便后续检索。
- 需要标出哪些信息需要进一步核实。
换个做法更好
- 你要的是整篇文档的摘要:用《研究资料结构化摘要》。
- 文档很短:直接读。
- 文档包含敏感信息:先脱敏再处理。
FAILURE MODES
常见翻车与修正
- 模型补全了文档里没写明的信息,比如推算出的日期。
要求所有字段严格来自原文,推算的一律留空并在备注里说明可推算的依据。
- 同一事实在文档不同位置表述不一致,模型只取了一处。
要求发现冲突时全部列出并标注位置,不要自行选择哪个正确。
- 抽取的内容里带了个人身份信息。
在输入前先脱敏,或明确要求跳过姓名、联系方式、证件号这类字段并标注「已跳过敏感字段」。
ACCEPTANCE
怎么判断输出合格
- 所有字段来自原文,没有推算填补。
- 文档内部的冲突信息全部列出,未自行取舍。
- 敏感信息没有被抽取进结果。
- 每条事实都带原文位置,可回查。
SAFETY BOUNDARY
使用边界
- 合同、内部纪要和未公开材料贴进去前先删掉当事人姓名、联系方式和金额明细。
- 抽出来的「事实」只是原文的转述,模型会把推论写成断言;每条要回到原文对位置核过才能引用。