AI摘要可能改写你的记忆
生成式AI正在进入高风险领域:警察部门如今可以根据执法记录仪的视频或音频自动生成报告;AI也出现在招聘和医疗中。它会出错。在一个见诸报道的案例中,一份AI生成的警方报告声称一名警员变成了青蛙——原来它捕捉到了背景中正在播放的电影《公主与青蛙》的声音。
通常的保障措施是由人来核查输出结果。但人的记忆同样不可靠。
一个已有近50年历史的效应
1978年,心理学家伊丽莎白·洛夫特斯(Elizabeth Loftus)证明,在事件之后获得的信息可以改变我们对它的记忆,这就是误导信息效应(misinformation effect)。在她的经典实验中,受试者观看了一起发生在路口的车祸,路口要么有停车标志,要么有让行标志;随后他们阅读一段写错标志的文字——许多人因此记错了。甚至仅仅一个动词(用“猛撞”而不是“撞上”)就能改变人们对车速的记忆。
美国乔治城大学和华盛顿大学的Mattea Sim、Yael Eiger和Tadayoshi Kohno提出了一个问题:AI摘要是否也会产生同样的效果?
第一步:AI摘要有多准确?
他们选取了洛夫特斯研究的一项现代重复实验中的两段25秒动画视频:一辆红色汽车驶到一个设有停车或让行标志的路口,右转,撞上一名行人,行人倒地后又站起来,司机随后下车。他们请ChatGPT-5.5和Gemini 2.5 Flash-Lite撰写事实性、中立、不少于300词且包含“所有重要内容”的摘要——共20份。
- 每一份摘要都有错误:每份7至21处,篇幅约305词。
- 平均而言,51.6%的核心细节缺失。
- 20份摘要中有19份漏掉了碰撞本身——而这恰恰是最重要的事件。
- 60%的摘要添加了视频中并不存在的细节,比如虚构的行人或车辆。有一份摘要甚至声称“没有其他人物或车辆与场景直接发生互动”。
- 错误每次都不一样:汽车在一份摘要里右转,在另一份里却左转。
第二步:它会改变人们的记忆吗?
美国的328名参与者观看了其中一段视频。一到两天后,他们阅读了一份由ChatGPT撰写、共21句话的摘要。摘要里写的交通标志要么正确,要么错误。一些人被告知摘要由AI撰写,另一些人则被告知由专业的人工转录员撰写——文本完全相同。随后进行记忆测试。
- 读到正确摘要的人中,**83.6%**记得正确的标志。
- 读到误导性摘要的人中,只有**44.8%**记得。
- 无论人们以为摘要出自AI(46.3%正确)还是人(43.4%),结果都没有差别。
- 对AI的信任程度和使用AI的频率,都没有造成显著差异。

回忆起正确交通标志的参与者比例:读到正确摘要后约为80%,读到误导性摘要后不足50%——无论摘要被标注为AI还是人工撰写。——图1,Sim、Eiger和Kohno(2026),arXiv:2609.28820。
参与者确实记得视频本身:96.6%的人正确回忆起事故发生在白天,而摘要中并没有这一细节。奇怪的是,“人工”摘要被评为更清晰,尽管它与AI摘要一字不差。
只有“人在回路中”还不够
作者的结论是,本应纠正AI的人,反而可能因AI的错误而记忆被改变——而这一过程中没有任何人怀有恶意。在警务这样长期以来就对目击者记忆存在担忧的领域,他们质疑是否应该使用AI。这项工作的简化版本发表在AAAI/ACM人工智能、伦理与社会会议(2026年10月)的论文集中。
局限
两段简单的动画视频、一个提示词和20份摘要;在线测试了单一类型的误导细节。展示给参与者的摘要是从多次尝试中挑选出来的,并为准确起见做了少量编辑。
