德勤AI造假丑闻:160万美元买来的虚假引用
已更新:6月17日

咨询行业完全依赖于对专业知识的认知。政府和财富 500 强公司向 Deloitte 等公司支付高昂费用,不仅是为了人力,更是为了确保所获得的建议是基于严谨、经过验证的数据。最近在加拿大,这种认知受到了沉重打击。一场围绕纽芬兰与拉布拉多省 Deloitte AI 捏造 事件的争议,揭开了现代咨询报告实际制作过程的神秘面纱,揭示了一个看起来不像专家分析,而更像自动化猜测的过程。
这不仅仅是几个错误的脚注。该丑闻凸显了“四大”服务的高昂成本与 AI 集成中偷工减料的现实之间日益增长的摩擦。当一份价值 160 万美元的报告中包含了根本不存在的论文引用,且作者也从未写过这些论文时, 它迫使人们重新评估客户到底在为什么而付费。
纽芬兰 Deloitte AI 捏造事件的机制

该事件的核心是纽芬兰与拉布拉多省政府委托的一份用于评估其医疗协议的报告。该项目的价格约为 160 万加元。人们期望得到的是一份深入、经过详尽研究并能指导公共政策的文件。
而政府收到的是一份被 Deloitte 咨询报告虚假引用。 当地媒体,特别是 The Independent,指出该报告引用了完全由算法虚构的学术论文。它将研究成果归功于真实的学者,但经联系后,这些学者确认他们从未写过此类内容。
这是 generative AI academic hallucinations(生成式 AI 学术幻觉)的一个教科书级案例。像 ChatGPT 这样的大语言模型(LLMs)是预测引擎,而非知识库。当被要求用来源支持某个论点时,它们经常会构造听起来煞有介事的标题,并将其归于该领域的作者。在未经训练的人看来,这像是学术研究;但对于任何核查来源的人来说,这就是虚构小说。
Deloitte 对 Deloitte AI fabrication 指控的回应耐人寻味。他们承认了错误,但试图对这一失败进行辩解。一位发言人声称,AI 并未被用于撰写报告的核心内容,而是被用来“协助”生成引用文献。
这种辩护实际上让情况变得更糟。引文的存在是为了证明作者已经阅读、理解并综合了外部研究。如果 AI 生成 了引文且引文是伪造的,这便证实了人类作者从未阅读过原始资料。你不能引用一篇你没读过的论文。使用 AI 生成参考文献目录,本质上是承认研究过程本身被跳过了。
生成式 AI 学术幻觉与“人类环节”

这次 Deloitte AI research assistance controversy 是一个质量控制失败的典型案例。我们不断被告知,在工作场所使用 AI 是安全的,因为存在“人类环节(human in the loop)”。在这种情况下,处于该环节中的人类每小时计费数百美元,却未能进行基本的 Google Scholar 搜索来验证其支持证据的真实性。
这种现象的技术术语是“幻觉”,但在合同语境下,这近乎于失职。当一家公司声称利用“proprietary AI tools”或尖端技术来交付价值时,客户认为这意味着更好的数据处理或预测分析。他们不会想到这意味着让聊天机器人编造一份参考文献目录,好让报告看起来更具权威性。
这反映了专业服务领域一个危险的过渡期。各家公司正争先恐后地采用 AI 来减少产出交付物所需的时间,从而有效地扩大利润空间。然而,他们仍维持着 AI 时代之前的计费结构。其结果被网络社区戏称为“手工烂活(artisanal slop)”——价格昂贵、量身定制的文档,内部却充斥着自动生成的、未经核实的填充内容。
“四大”咨询行业潜规则
针对此次 Deloitte AI fabrication 事件的反应,特别是在 Reddit 等平台上的讨论,丝毫不令人感到震惊。业内人士和前顾问将其视为“四大”商业模式下的必然结果。
分析 Newfoundland government health report scandal 的讨论帖迅速转向了 四大咨询行业潜规则。愤世嫉俗者的共识是,研究的准确性往往次于报告的首要功能:提供“空中掩护”(air cover)。
“空中掩护”是企业俚语,意指责任保护。高管或政府官员通常很清楚自己想做什么——削减资金、重组部门或调整战略。然而,单方面采取行动是有风险的。如果失败,高管就会被解雇。通过向 Deloitte 支付 160 万美元,他们买的不是新想法,而是一个盾牌。如果计划失败,他们可以指着文件夹说:“我们遵循了专家的建议。”
从这个角度来看,报告的内容远不如封面上的 logo 重要。Deloitte AI 捏造事件之所以成为问题,并不是因为建议不好(尽管可能确实不好),而是因为显而易见的错误让盾牌产生了裂痕。由虚假引用构成的盾牌无法保护政客免受公众监督。
评论人士将这些公司的内容生成过程描述为信息的“人体蜈蚣”——回收旧的幻灯片、重新包装通用的见解,而现在,则利用 AI 来填补空白。其目标是产出一份看起来足够充实、能证明账单合理性的交付物。严谨的学术标准往往只是表象。
从澳大利亚到加拿大:一种行为模式

很难将 Deloitte AI fabrication 新闻仅仅视为涉及一名懒惰初级员工的孤立事件。它符合某种模式。就在加拿大丑闻发生前几周,Deloitte Australia 也面临了几乎完全相同的情况。
在澳大利亚的案例中,该公司被发现使用 AI 为政府报告生成内容,导致了类似的错误。他们被迫退还了部分费用。这种重复发生表明存在系统性问题。全球咨询公司正在 推动 AI 采用 这种压力自上而下地激进传导。领导层希望向股东展示他们是“AI 优先”的。这种压力层层传递给工作过度的团队,导致他们在紧迫的截止日期前利用这些工具偷工减料。
这起 Newfoundland 政府健康报告丑闻和澳大利亚的事件表明,这些公司可能缺乏内部保障机制来监管自身的自动化行为。他们向客户推销 AI 治理的承诺,却无法治理好自己内部的使用情况。
“手工废料”的未来
的影响 Deloitte AI fabrication 不仅仅局限于负面的公关形象。它直击管理咨询价值主张的核心。
如果咨询公司的产出与客户通过每月 20 美元的 LLM 订阅生成的回复毫无区别,那么数百万美元费用的合理性就荡然无存了。历史性的辩护理由是人类的专业知识——即聪明的人在进行合成与验证的艰苦工作。
当公司利用 AI 来伪造这种合成过程时,他们实际上是在自动化自己的过时进程。他们正在生产“slop”(垃圾填充内容),却收取着手工定制的价格。客户愿意为“空中掩护”买单,但他们不会为尴尬买单。
纽芬兰政府表示,他们正在与 Deloitte 合作“修正”该报告。但一旦对方法论的信任破裂,该报告对于政策制定而言基本上就毫无用处了。每一个数据点、每一项建议和每一个结论现在都值得怀疑。如果引用是虚构的,那么数据分析是否也是幻觉产生的?
为了让这个行业在这次转型中生存下来,“人机回环”(human in the loop)不能仅仅是一个橡皮图章。它需要重新转向可验证的事实。在此之前,Deloitte AI fabrication 的故事可能会继续浮现,不断削弱让这些公司得以存在的声望。
常见问题解答:Deloitte 与 AI 研究争议

1. 什么是纽芬兰的 Deloitte AI 造假丑闻?
Deloitte 受聘为纽芬兰与拉布拉多省政府撰写一份健康协议报告。据发现,该报告中包含了一些并不存在的学术论文引用,或者将论文归属于错误的作者,这是一种被称为 AI 幻觉的常见错误。
2. Deloitte 如何回应虚假引用指控?
Deloitte 承认了错误,但声称他们没有使用 AI 来撰写报告正文。他们表示 AI 仅用于辅助生成引用,这一辩解遭到了广泛批评,因为核实引用是研究诚信的核心部分。
3. 什么是生成式 AI 学术幻觉?
当 AI 模型(如 ChatGPT)为了满足用户的提示词而编造事实时,就会发生这种情况。在学术语境下,AI 会创建听起来很真实的标题、期刊名称和在现实世界中并不存在的作者名单。
4. Deloitte 此前是否面临过类似的 AI 争议?
是的。就在加拿大事件发生前不久,Deloitte Australia 也卷入了一场类似的丑闻:一份政府报告中由 AI 生成的内容被发现存在缺陷,导致该公司退还了部分项目费用。
5. 为什么批评者将咨询报告称为“空中掩护 (Air Cover)”?
“空中掩护”是指聘请顾问来验证管理层已经做出的决定的做法。该报告起到了保险的作用;如果决策失误,领导层可以将责任归咎于顾问的建议,而不是他们自己的判断。
6. 关于 AI,咨询行业“四大 (Big 4)”有哪些潜规则?
虽然各公司公开宣扬严格的 AI 治理,但行业内部人士暗示,潜规则是使用任何必要的工具来满足紧迫的截止日期并实现利润最大化,这往往导致对 AI 输出内容的质量控制不足。
7. 纽芬兰政府是否因这份有缺陷的报告获得了退款?
根据最初的报道,政府正与 Deloitte 合作纠正错误。在类似的澳大利亚案例中,公司发放了部分退款,但纽芬兰项目的具体财务影响取决于正在进行的合同谈判。



