C
发布于 2026/09/03 · 阅读 2

EY加拿大网络安全报告被指大量引用为AI幻觉生成

  • #AI幻觉
  • #网络安全
  • #报告造假
  • #Hacker News
  • #gptzero.me
EY加拿大网络安全报告被指大量引用为AI幻觉生成

GPTZero调查·独家

追查幻觉

安永(EY)加拿大发布了一份关于忠诚度计划安全措施的网络安全报告。我们追查了每一处引用,发现大部分都是幻觉生成的。

查看调查

调查团队:Om Ogale, Paul Esau, Alex Cui

2026年5月14日

今年早些时候,GPTZero的一位工程师创造了术语“vibe citing”(氛围引用),用来描述大语言模型幻觉意外生成虚假参考文献的现象。事实证明,创建和核查引用的麻烦导致许多研究人员、咨询顾问、律师和公职人员开始拥抱这种“氛围”(如果你懂我们的意思)。

这些“皈依者”中包括一份2025年安永报告的作者,报告名为《攻击点:揭示忠诚度系统中的网络威胁与欺诈》。这份报告充斥着虚假引用和不准确的说法,正在出现在报纸、博客文章和AI搜索摘要中,污染人类研究人员和AI代理所依赖的数据。

GPTZero从2025年开始使用我们的“幻觉检查”工具来针对这种氛围引用,我们曾用该工具进一步调查了一份政府出版物、两份不同的德勤报告,以及像NeurIPS和ICLR这样的顶级机器学习和人工智能会议。过去几个月,我们建立了一个自动化的管道,通过查找和扫描主要咨询公司的公开报告来搜索氛围引用。我们的发现表明,氛围引用的流行已经具有地方性,即便在主要玩家中也是如此。

我们不会一次性发布所有结果,而是将一次聚焦一份报告。这种方法既能防止单个例子被忽视,又能让我们说明氛围引用对研究质量和公众信任的负面影响。

多伦多EY大厦——从GPTZero办公室所见

菜单:安永(EY)

安永是全球“四大”咨询公司之一,通过全球150个办事处为政府和私营实体提供会计和咨询服务。加拿大成员事务所(EY Canada)每年向加拿大政府提供价值数百万美元的服务。

2025年底,EY Canada发布了一份44页的网络安全报告,名为《攻击点:揭示忠诚度系统中的网络威胁与欺诈》。虽然报告署名为三名员工(两名合伙人、一名高级经理),但文档是一个由氛围引用、错误归属、虚假统计数据和AI生成文本拼凑而成的集合。

封面——EY《攻击点》报告

为什么氛围如此糟糕

EY Canada的报告没有使用脚注或常规的学术引用。相反,它直接在文中引用来源,和/或将其包含在资源表(第41-43页)中。该表提供了所有来源的标题、描述和URL,某些情况还包含出版商和日期。几乎所有的URL都是失效或伪造的,超过一半的标题与真实来源不符。

GPTZero对氛围引用有非常具体的定义,因为误报可能带来声誉成本(对我们和报告作者都是如此)。我们的一位团队成员手动验证了幻觉检查的结果以确保其准确性。

0% 幻觉?实际27个引用中大部分幻觉,AI扫描显示72% AI文本

(示例表格略)

在我们以前对学术会议投稿的分析中,我们发现许多作者主要使用AI来生成和格式化参考文献,导致论文整体AI文本分数较低但存在氛围引用。

然而,在《攻击点》中很难找到人类的痕迹——甚至比找到一篇人类写的LinkedIn帖子还难。文本不仅被扫描出是AI生成的,还充满了常见的LLM错误,如虚假统计数据、错误归属和内部矛盾。

报告第4页:执行摘要中的大胆声明,声称全球忠诚度积分市场规模为2000亿美元,其中30-50%的积分未被使用。

报告第42页:一个伪造的福布斯引用,支持2000亿美元全球市场的说法。

报告第10页:矛盾的说法——2000亿美元现在变成了未赎回忠诚度积分的估值,而非全球所有积分的总价值。既然作者已声称高达50%的积分未赎回,这个新统计数字要求全球市场价值至少4000亿美元。

报告第43页:第二个伪造引用:麦肯锡。几行之下,一份伪造的麦肯锡公司报告为后一种说法(全球未赎回积分价值2000亿美元)提供了证据。两个虚构的引用,两个不兼容的数字。

我们追查这个麦肯锡引用的来源,发现它源于六个月前Financial IT发布的一篇不起眼的金融科技博客文章。

Financial IT第1页:六个月前,英国金融科技杂志Financial IT上的一篇博客文章声称“每年有超过2000亿美元的积分闲置”。措辞几乎与EY报告相同。

Financial IT第3页:该博客的资料来源部分引用了“麦肯锡公司:忠诚度经济学报告(2022)”——一份不存在的报告。这个捏造的引用逐字出现在EY报告的参考文献表中,将低级博客中发明的来源洗白成四大出版物。

报告中一些最可疑的说法甚至根本没有引用。

报告第6页:作者声称72%的客户忠诚度项目报告过盗窃或欺诈。这个事实归因于加拿大支付处理商Paystone在2019年的一篇文章。

报告第11页:然而,同一统计数字被归于不同的来源——数字欺诈预防公司Forter发布的“NRF 2020总结”。这两个来源都未包含在报告的参考表中。事实上,虽然该统计数字同时出现在Paystone和Forter的页面上,但原始来源似乎是2017年Ipsos的一项调查。

矛盾的引用、低质量的来源和过时的统计数据都是AI垃圾内容的迹象。

报告第6页:作者声称自2019年以来忠诚度计划欺诈攻击增加了89%。

报告第11页:然而,这个89%的增长被限制在单一年份(2018年至2019年),该统计数字归因于特定来源:Forter欺诈攻击指数。令人惊讶的是,这个来源既存在又部分证实了第二个版本的说法。然而,像EY报告中使用的许多来源一样,它已经严重过时。糟糕的统计数字改写也是AI垃圾内容的迹象。

为什么氛围很重要

很难衡量EY报告的公众影响。《攻击点》似乎在加拿大没有引起太大波澜;然而,它最近被《堪培拉时报》的一篇文章引用,该文章被联合供稿给澳大利亚60多家报纸。它也可能通过客户简报、内部演示和其他不在公共领域的专有媒体传播。但氛围引用不仅欺骗读者或企业受众——它们还有另一个更阴险的影响。

将报告在线发布本质上是一种将数据注入互联网知识池的行为。当报告包含虚假信息(无论是氛围引用还是虚假声明)时,它可能会“毒化水源”,误导未来的研究人员,特别是当报告由知名咨询公司发布并托管在高流量网站上时。

这种风险因AI“深度研究”工具的出现而加剧,这些工具在选择来源时依赖与人类不同的信号,因此更容易受到数据毒化的影响。

虚假信息毒化水源并误导未来的研究人员,尤其是当由知名咨询公司发布时。Claude、ChatGPT和Perplexity都从EY有缺陷的报告中提取了幻觉内容。

“检测忠诚度欺诈的平均时间是多少?”

结论

GPTZero正在追查氛围(引用)

我们过去几个月的研究证明,氛围引用对研究人员、学者、咨询顾问以及(坦白说)任何通过搜索网络从数字池中饮水的人来说都是一个清晰而现实的危险。我们的幻觉检查工具是我们应对这一威胁的答案:一种无需手动检查每个引用就能识别氛围引用和幻觉的方法。它已经被用于筛选IJCAI、ICLR和ICSE等顶级学术会议的投稿。

现在比以往任何时候都更疯狂的是,仅凭信仰接受引用——即使是来自像安永这样信誉良好的来源。

尝试GPTZero的幻觉检查,或联系GPTZero团队。

2 阅读0 评论0 点赞

评论

登录 / 注册即可发布评论!
暂无评论,成为第一个发表评论的用户吧。