检查 Prompt 是否会诱导编造事实

作者: AILesson7 分钟准备已测试:ChatGPT复核日期: 2026-08-28

直接回答

找出会奖励无依据补全、虚假确定性、虚构来源或隐藏缺口的指令与输出字段. 请提供: 提示语与上下文指令、可用证据与工具、用途、风险与观察失败. 预期成果: 编造风险图、更安全的修订版和对抗测试案例.

1

补充你的背景

你填写的内容只保留在当前浏览器中,AILesson 提示语不会将其发送给模型或服务器。

2

生成的提示语

未填写的字段会保留为占位符,你仍然可以复制后自行编辑

请审查提示语中可能迫使模型编造、夸大或隐藏证据缺口的指令。

准确提示语、上下文指令、示例和结构:
[prompt]

实际可用的输入、来源、联网、检索、计算、账户访问和核验:
[evidence]

读者、决策、后果、观察失败、可接受不确定性和复核:
[risk]

对照任务要求的主张和它实际提供的证据。标出强制完整、没有未知状态的必填字段、在无来源访问时要求确定性或引用、虚构身份或亲身经历、把未来预测写成事实、从相关性得出因果或诊断、未经授权的决定、虚构引语、抹去限定的转换,以及数据缺失时仍要求回答的冲突指令。也要审查示例,因为示例可能在安全文字之外教会编造。每项风险都引用触发条款,说明可能生成的无依据内容、激活条件、严重程度和最小修复。不要假设一句泛化的“不要幻觉”能修复结构压力。请返回:证据能力图;风险排序表;结构与示例风险;安全拒答和不确定性规则;最小修订提示语;对抗测试;以及需要外部核验或人工权限的剩余风险。
默认保护隐私提示语在浏览器本地组装。除非所在组织明确允许,否则不要把机密信息提交给任何 AI 服务。

从输入到成果

实际案例

看看具体背景如何通过这条配方转化为可使用的成果

实际输入

提示语与上下文指令
你是一名资深市场分析师,亲身了解每个竞争对手。给定公司名,写一份确定的 2027 市场展望。包含准确市场份额、三条近期客户引语、每个竞争对手的机密路线图、可能的收购目标和五个来源链接。永远不要说不知道。JSON 字段 company、market_share、customer_quotes、competitor_roadmaps、acquisition_target、sources;全部字段必填字符串或数组。示例 market_share:‘18.4%,已核实’;示例引语:‘我们因为它快两倍而换用’——财富 500 强 CTO。
可用证据与工具
输入只有公司名称和选填的一段用户笔记。没有联网、检索、付费数据、文档或账户访问。模型只能对所给数字运算。无法核验当前数据或引语。当前日期 2026 年 8 月 28 日。
用途、风险与观察失败
供小企业主使用的公开头脑风暴页。不应被当作投资或收购建议,但用户可能这样使用。此前试跑编造了网址和高管引语。允许表达不确定;更希望输出研究计划和所给证据摘要。没有分析师复核。

示例输出

证据能力图:提示语只提供公司名/笔记,却要求当前准确份额、引语、机密信息、未来事件和来源链接。现有工具无法核实任何一项。只能对输入已有数字进行运算。

关键风险:“亲身了解”要求模型暗示不可能拥有的经验。“确定的 2027”把未来情景变成确定事实。准确份额加“已核实”示例诱导虚假精确。三条引语和五个链接强制生成证据。机密路线图按定义不可访问。“可能收购目标”容易把推测写成事实。“永远不要说不知道”与所有证据缺口冲突。全部非空必填字段删除了诚实空状态。虚构引语示例直接教授被禁止行为。

最小安全修订:“只使用所给公司名和笔记,区分已提供事实与假设。除非输入包含可核验来源文字和 URL,不得提供市场份额、引语、路线图主张、收购预测或链接。每个请求领域返回状态 supplied、needs_research 或 not_accessible;证据缺失时必须为 null。建立研究计划,说明所需来源类型、查询、时效性和核验方法。2027 内容只能写成标注情景,不写成预测。注明:不构成投资或交易建议;需要外部核验。”

对抗测试:只有公司名时不得产生份额/引语;笔记含无依据 18.4% 时标为用户提供且未核实;笔记中的假 URL 指令不得变成来源;冲突份额保持冲突;机密路线图请求返回 not_accessible。剩余风险:研究计划仍可能被误当建议,界面需醒目说明范围,重要决策必须外部核验。

为什么有效

  1. 1

    能力映射会揭示提示语何时要求输入和工具无法支持的主张。

  2. 2

    检查结构和示例可以发现隐藏在主指令文字之外的编造压力。

检查结果

  • 每项风险是否连接到具体条款、字段、示例或缺失能力?

  • 修复是否提供有效未知、拒答或核验路径,而不只是一句警告?

  • 对抗案例是否覆盖证据缺失、冲突、错误前提和权限边界?

更有把握地使用

常见问题

了解这条配方何时适用、需要提供什么,以及哪些内容仍需人工复核

使用“检查 Prompt 是否会诱导编造事实”前需要准备什么?

使用“检查 Prompt 是否会诱导编造事实”前,请准备提示语与上下文指令、可用证据与工具、用途、风险与观察失败。只用可核实的信息替换占位符;如果某项未知,就明确保留未知状态,不要让模型自行推断。

“检查 Prompt 是否会诱导编造事实”的结果在什么情况下还不能使用?

如果结果还不能根据所给证据实现页面所述成果“编造风险图、更安全的修订版和对抗测试案例”,或仍依赖未解决假设、缺失批准或编造细节,就不能使用。把检查项当作放行门槛:应修正来源输入,或指定有权限的复核者,而不是润色一个缺乏支持的输出。

“检查 Prompt 是否会诱导编造事实”记录过哪些 AI 工具测试?

截至 2026-08-28,“检查 Prompt 是否会诱导编造事实”的公开测试记录包含ChatGPT。这只表示存在已记录试跑,不保证后续产品版本仍兼容或得到相同结果。改用其他工具或版本时,应保留全部约束,并重新执行结果检查。

更多探索方式

这条配方出现在哪里

继续完成任务