从证据记录生成可复核内容
建议用时:25 分钟(含练习)
学习目标
能够要求 AI 只依据给定材料写作,并逐条核对引用、推断和缺口。
本节产出
一篇带证据映射的短文或研究简报
核心知识:先建立主张与证据的对应
主张—证据表
要求 AI“只依据材料写作”是有用的任务约束,但不能保证输出绝不补写。模型仍可能把常识、推测和来源内容混合。因此需要一个可以检查的中间结构:主张—证据表。先明确准备说什么、哪份材料支持、支持到什么程度,再组织正文。
主张是读者可能当作事实接受的陈述。证据可以是官方文档、研究结果、可复现观察或其他适合该问题的材料。引用的存在并不等于支持关系成立:一个链接谈到同一主题,却可能完全没有证明相邻那句话。
图中的反向核查从正文出发,防止写作过程中悄悄增加新的事实。可以把每个关键句标为直接支持、有限支持、推断或无证据,再决定保留、改写、补充研究或删除。
案例:把三条材料写成研究简报
假设练习资料 S1 说明某工具支持导出 Markdown,S2 是一次十份文档的导出记录,S3 说明部分嵌入内容需要额外处理。下面三句看起来相近,证据强度却不同。
| 候选句 | 证据判断 | 更合适的表达 |
|---|---|---|
| 工具支持 Markdown 导出 | S1 直接支持 | 保留并链接对应说明 |
| 所有文档都能无损导出 | 三份材料均不足,S3 还有限制 | 删除“所有”和“无损”,补限制 |
| 这次十份文档中九份无需修正 | 需要 S2 有明确记录 | 限定为本次观察,不推广 |
“大多数用户都能节省一半时间”即使听起来合理,也不能从一次十份文档的记录推出。若没有用户样本、对照方法和时间数据,就应删除,或改成待验证假设。流畅的句子不能弥补缺失的证据。
推断也可以有价值
研究并不只能重复来源。你可以结合多个事实提出推断,但要说明推理所依赖的前提和不确定性。例如“由于嵌入内容需要额外处理,包含大量嵌入的文档可能需要更多人工检查”。这是一项有理由的判断,仍不能冒充已测量的效率结果。
把观点与事实分开也能改善写作。可以明确说“本课程建议先用小样本验证迁移效果”,这是教学建议;接着解释它如何帮助发现兼容问题。无需给每个原创练习步骤伪装一个权威来源,但技术事实和外部数据必须核对。
引用放在读者需要的位置
链接应靠近它支持的主张,并使用能说明内容的标题。一个段落包含多个不同来源的事实时,应拆分或分别标注,避免读者不知道哪个链接对应哪句话。引用列表可以提供延伸阅读,但不能替代正文中的证据关系。
同时检查链接是否公开可用、是否指向原始页面、页面是否真的包含所需信息。搜索结果摘要、私人附件标题或失效链接都不足以形成稳定的公开核验入口。资料只能部分访问时,应说明实际阅读范围,不能声称读过全文。
反向核查的具体步骤
先找数字、时间、功能、比较和因果句,这些地方最容易产生事实性错误。逐句打开对应证据,检查对象、日期、范围和条件是否一致。再检查图表:图中的箭头可能暗示因果,表格中的空白可能被误读为没有功能,示意图应说明它只是概念或案例。
最后删除无法支持的夸大词,并保留真正影响理解的限制。限制不需要堆成冗长免责声明,而应融入相应结论,例如“在本次样例中”“适用于所核对版本”“这一点尚未测量”。
动手练习
- 为案例写五条候选主张,标注证据编号与支持程度。
- 生成一段短文,再从正文反查是否出现表中没有的新事实。
- 找出一句推断,写清前提、结论和需要进一步验证的地方。
参考答案与推演
合格简报可以说明支持的导出格式、本次观察和嵌入内容限制,不能宣称所有文档无损或所有用户提高效率。若正文突然出现“行业领先”,主张表没有对应证据,就应删除或补充真正适合的比较研究。
推断句可以讨论哪些文档更值得检查,但不能虚构检查时间。反向核查完成后,应留下事实与证据映射,使另一人能够复核重要结论,而不必猜测作者用了哪份资料。
完成检查
- 关键事实有明确且相邻的支持来源。
- 引用支持具体主张,而不只是主题相关。
- 推断、建议与未知项表达清楚。
- 正文与图表都经过反向核查。
参考与来源
- W3C:PROV Overview:理解产物与来源之间的追踪关系。
- NIST:Artificial Intelligence Risk Management Framework:了解评估与管理 AI 输出风险的整体框架。
从证据记录生成可复核内容
3 道题 · 及格分 60 分