研究

逐条检查主张的证据状态

把每项原子主张映射到证据、反证、来源质量和校准后的状态

8 分钟准备已测试:ChatGPT复核日期: 2026-08-28
1

补充你的背景

你填写的内容只保留在当前浏览器中,AILesson 提示语不会将其发送给模型或服务器。

2

生成的提示语

未填写的字段会保留为占位符,你仍然可以复制后自行编辑

请对照所提供资料,逐条检查每项主张的证据状态。

主张或文档:
[claims]

带编号、日期、作者、方法和段落的来源:
[evidence]

用途、状态标签、质量规则、时效性和举证责任:
[standard]

把复合句拆成原子主张,保留准确范围、情态、比较、时间和归属。每项返回:类型、支持来源、反对来源、证据直接性、来源质量与独立性、时效性、总体/指标适配、限制,以及仅按所提供标签规则给出的校准状态。区分“未提供证据”与“有证据表明不存在”。不得把同一底层来源的重复报道视为独立佐证,不得从相关推断因果,也不得让摘要、标题、意见或供应商主张超越其证据。标记循环引用和来源冲突。最后提供夸大主张的修订措辞、缺失证据优先级,以及针对该用途应删除的主张。
默认保护隐私提示语在浏览器本地组装。除非所在组织明确允许,否则不要把机密信息提交给任何 AI 服务。

从输入到成果

实际案例

看看具体背景如何通过这条配方转化为可使用的成果

实际输入

待检查主张
C1:四天工作制试点使生产率提高 20%,并改善了所有员工的幸福感。C2:它没有造成任何客户服务下降。C3:大多数组织无需增加人员即可采用。
证据资料
S1(2025 公司报告):一家 80 人软件公司把 12 周自愿试点期间自报完成任务与上一季度比较;报告 +20%;季节性工作量变化;无对照组。幸福感调查:80 人中 61 人回答,49 人报告改善,8 人无变化,4 人变差。S2(2025 公司支持看板):中位响应时间试点前 3.9 小时,期间 4.1 小时;目标≤4 小时;未提供投诉数。S3、S4 为新闻文章,均只复述 S1,没有新数据。S5(2024 跨行业调查摘要):38 个组织报告不同人员变化;无法获得完整方法;摘要未报告采用可行性。
证据标准与用途
用于公开指南文章。标签:支持、部分支持、无支持、反驳、不明确。因果措辞需要可信比较;“所有/大多数”需要总体证据。公司报告可支持该试点观察,不能支持推广。证据截至 2025 年 12 月 31 日。

示例输出

C1a“试点提高生产率”|因果|S1 报告自报完成任务 +20%|无独立来源;上一季度比较、季节变化、自愿试点、无对照|只能作为观察得到部分支持,不能证明因果。修订:“公司报告其 12 周试点期间自报完成任务比上一季度多 20%;该设计无法确立因果。”S3/S4 非独立来源。 C1b“改善所有员工幸福感”|全称|S1:61 名受访者中 49 改善、8 不变、4 变差;19 未答卷|反驳。修订:“61 名调查受访者中有 49 人报告改善。” C2a“无客户服务下降”|全称/不存在|S2 显示中位响应 3.9→4.1 小时,超过≤4 小时目标;其他服务指标缺失|目标层面被反驳,作为全称陈述无支持。修订:“中位响应从 3.9 增至 4.1 小时;未报告其他服务影响。” C3“大多数组织无需增加人员即可采用”|推广|S5 提到人员变化不一,但无可行性结果|无支持。获得完整的多组织人员证据前应从公开指南删除。

优先缺口:S1 定义/原始任务分布、可比对照/季节分析、完整服务指标,以及 S5 完整方法/结果。

为什么有效

  1. 1

    原子主张可以防止证据状态混合的句子获得一个误导标签。

  2. 2

    来源独立性和适配检查可以防止用引用数量替代证据强度。

检查结果

  • 每个复合陈述是否在不改变范围或确定性的情况下拆分?

  • 支持、反对、不存在证据和证据缺失是否得到区分?

  • 每个状态是否考虑来源质量、独立性、时效和总体适配?

更多探索方式

这条配方出现在哪里

继续完成任务