← 提示词

提示词模板

AI 幻觉怎么解决:7 个让 AI 少胡编乱造的提示词

每个 AI 助手都会时不时信心十足地说出不实的内容。这个问题关不掉,但你可以让它少得多,也更容易被发现。下面七个提示词来自 Anthropic 官方指南,以及严谨的研究者常用的核查方法。

简短回答

AI 幻觉无法完全消除,但可以大幅减少:允许它说“我不知道”,让它先引用你提供的资料再回答,让它为每条说法给出依据,否则删掉,重要的内容再请另一个 AI 核查。最后,关键事实要自己核实。

1. 允许它说“我不知道”

AI 助手的设计目标是尽量帮上忙,所以它们宁可猜,也不愿承认自己不知道。Anthropic 指出,只要允许它表达不确定,就“能大幅减少错误信息”。在任何事实类问题后面加上这一句:

如果你对其中任何部分没有把握,或者你无法获得相关信息,就在那部分直接说“我不知道”,不要猜。

2. 让它先引用原文,再回答

当你给 AI 一份文件(合同、条款、报告)时,让它先摘出原文中的相关句子,再只根据这些句子回答。这样答案就紧扣真实文本,而不是凭它的记忆。

这是文件:[粘贴]。第 1 步:从文件中逐字摘录能回答我问题的句子。我的问题是:[问题]。给这些句子编号。如果没有,就说“未找到相关引文。”第 2 步:只用这些引文回答我的问题,并按编号注明依据。不要使用文件以外的知识。

3. 每条说法都要有依据,否则删掉

它写完之后,让它对照你提供的材料逐条核查自己的说法。凡是找不到依据的,一律删掉。

检查你上一个回答。对每一条事实性说法,给出我文件中支持它的原文引句。如果找不到支持的引句,就删掉这条说法,并在原位置标注[已删除]。

4. 让它自查:标出每个事实的来源

这是严谨的研究者常用的习惯,适用于任何话题。它迫使 AI 把读到的和自己假设的分开,并指出最薄弱的地方。

请自查你的回答:1. 列出每一条事实性说法,并逐条标注:[来自我的文件] / [官方来源] / [新闻或二手来源] / [你的推断或猜测]。2. 指出最可能出错的 3 条说法,并具体告诉我每条该怎么核实。3. 检查你是否回答了我问题的每个部分,且没有自相矛盾。不合格的地方请改正。

5. 问它有多大把握,以及什么会改变结论

AI 给出的把握数字并不是真正的概率,所以别把“0.8”当成 80%。但这样问会让它标出不可靠的部分;第二个问题才是真正有用的:它告诉你该去找什么证据。

最后写明:你对这个回答的把握程度(低 / 中 / 高)、主要的注意事项,以及什么新信息会改变你的结论。

6. 换一个 AI,听听第二意见

不同的 AI 助手会犯不同的错,所以它们意见不一致就是有用的警报。把同一个事实问题分别问两个助手,例如 ChatGPT 和 Claude,或者能用 Google 搜索核对的 Gemini,然后仔细检查它们说法不一致的地方。Anthropic 对单个助手也建议同样的做法:把同一个提示词多运行几次再比较,前后不一致就是警示信号。

要让一个 AI 评判另一个 AI 的回答,把那个回答连同下面这段一起粘贴进去:

对于我的问题“[问题]”,另一个 AI 助手给出了这个回答:[粘贴回答] 1. 你同意哪些地方?为什么?2. 你不同意哪些地方?请给出具体的反对理由和证据。3. 它遗漏了什么?4. 给出你自己的最佳回答,并标出我应该再核实的说法。

一个一个地问,不要同时看好几个回答:最后再把它们并排比较,更容易发现真正的分歧。

7. 让它教你,再反过来考你

学习新东西时,“教完再考”的对话能暴露双方的知识漏洞:你的和 AI 的。它基于费曼学习法:用简单的话讲清楚、找出漏洞、再完善。

用大白话教我[主题],就当我只有 14 岁。然后问我 3 个问题,检查我是否听懂了。纠正我的回答,并指出你自己的讲解中,哪些地方专家可能有不同意见,或者你自己也没把握。

提示词解决不了的问题

这些技巧建立在我们提示词指南里的四个基本写法之上。如果你在研究公司或投资,请看用 AI 研究股票的提示词(不让它替你选股)。

资料来源:Anthropic:减少幻觉 · Anthropic:提示词最佳实践 · 沃顿商学院(Wharton):“一步一步思考”

快速问答

能彻底消除 AI 幻觉吗?

不能。Anthropic 自己的指南也说,这些技巧能减少幻觉,但“无法完全消除”,并提醒你关键信息一定要自己核实,尤其是在做重大决定时。

AI 为什么会胡编乱造?

AI 助手写出的是听起来最像正确答案的内容。它不知道的时候,一个自信的猜测听起来照样像真的,于是就被当成事实说了出来。遇到近期事件、精确数字、引语和冷门话题,这种情况会更严重。

让 AI 给出来源,就能避免幻觉吗?

有帮助,但 AI 也会编造来源。让它引用所依据的原句,然后点开链接,确认那句话真的在里面。

哪个 AI 幻觉最少?

每次模型更新都会变,也没有哪一项测试能下定论。更稳妥的习惯是:把同一个事实问题问两个不同的助手,核查它们说法不一致的地方。

“一步一步思考”能减少幻觉吗?

对如今的“思考型”模型来说并不可靠:研究发现它几乎不提高准确率,还会让回答变慢。允许它说“我不知道”、要求它引用原文,效果更好。

继续学习