
纽约,9月24日——“你的数据库是石器时代的。”纽约媒体人葛晨在与谷歌人工智能助手Gemini Flash的一段对话中这样回应。葛晨正通过几家国际研究所的数据和数款AI模型做“出席联大女性领导人数量、年龄和影响力”的研究。此前,他指出日本现任首相是高市早苗,是女首相,为什么未被Gemini统计到。但Gemini接连回答“日本尚未产生过女性首相”“高市早苗并未出任日本首相”。
葛晨提供的对话截图显示,Gemini最初是在回答一项涉及联合国大会女性领导人的统计问题时,称日本首相不应计入女性政府首脑。受到质疑后,它没有立即核查现任首相,反而援引2024年自民党总裁选举:高市早苗当年在决选中败给石破茂。葛晨再次提醒它“少了整整两年”,Gemini仍坚持日本从未有过女性内阁总理大臣,并进一步列出2024年的选举经过,为错误结论作解释。
直到葛晨发来高市早苗的资料链接,Gemini才改口,承认高市早苗于2025年10月就任日本首相,并为此前的错误道歉。随后,面对“为什么你的记忆停留在2024年”的追问,它提出了训练资料滞后、未主动检索等可能原因。这些是Gemini在对话中的自我解释,不能据此认定谷歌已经查明该次错误的技术原因。
事实并不难核实。日本首相官邸记录,高市早苗于2025年10月21日获指名为日本第104任首相;官邸2026年9月的内阁名单仍列她为首相。美国白宫在9月22日发布的联合国大会活动照片说明中,也称她为“日本首相高市早苗”。
这段对话引人注意的,不只是一个过时答案,而是AI在用户明确指出错误后,继续用旧资料构造出一套看似完整的论证。对依赖AI整理当天新闻、人物名单和国际会议资料的编辑来说,流畅而笃定的回答仍须回到当日的官方记录核对。
目前,这些截图记录的是一名用户与Gemini Flash的一次对话。它足以呈现此次错误及纠正过程,尚不足以说明其他用户会得到相同回答。
葛晨事后分析,“概念自动补全”很可能是这次错误的机制之一。
Gemini后来关于“训练记忆停在2024年”自我诊断也不能直接当作技术结论。谷歌自己的帮助文件提醒,Gemini可能连“自己如何工作、如何取得新信息”都解释不准确。它先沿着2024年旧事实,补出了一套2026年错误答案;被质疑时又补上更多细节,直到官方证据摆在面前才改口。
这次错误可能与大语言模型的生成方式有关。模型会依据问题、对话上下文和已有知识,逐步生成看起来连贯的回答。高市早苗在2024年自民党总裁选举中败给石破茂,这是真实的旧事实;但到了2026年,它已不足以回答“谁是日本现任首相”。从对话截图看,Gemini不仅沿用旧结论,在用户提醒后还补充选票和国会指名等细节,令错误回答显得更加可信。
另一种可能是,Gemini在最初回答及受到质疑时,没有有效检索并采用最新的权威资料;也可能检索到了资料,却未正确处理新旧信息之间的冲突。截图无法显示其内部检索过程,因此不能断定具体是哪一步出了问题。付费墙也不是此次错误的充分解释:日本首相官邸和美国白宫均有免费公开的资料,足以核实高市早苗的身份。
这给使用AI查新闻的人提了一个醒:回答流畅、细节丰富,甚至附有链接,都不等于结论已经核实。尤其涉及现任官员、选举结果和正在举行的国际会议时,应查看来源的发布日期,并以政府公告、会议文件等原始资料核对。用户指出错误后,AI仍可能继续为原答案寻找理由;它后来对自身错误成因的解释,同样需要谨慎看待。
附本文涉及Gemini错误的对话截图——








