毕马威AI报告被撤回背后的讽刺
2025 年 10 月,毕马威英国发布了一份名为《在智能体 AI 时代重新定义卓越》的报告。它声称,多家全球顶级机构已经在用 AI 做决策。UBS 用它筛选投资标的,英国国家医疗服务体系(NHS)靠它读影像报告,瑞士联邦铁路用它调度列车,伦敦交通局则用它优化地铁运营。每一处都言之凿凿,每一处都像模像样。
但报告发布八个月后,GPTZero 的创始人爱德华·田(Edward Tian)随手翻了几页,发现事情不太对劲。
他用自己公司的 AI 检测工具扫了一遍,结果触目惊心:报告中多处引用的案例和数据,根本无法追溯源头。更严重的是,那些被点名表扬的机构,纷纷站出来说,我们没干过这事儿。
UBS 明确告诉媒体,毕马威从未就报告中有关 UBS 的内容联系过他们,所述内容”不准确”。NHS 的发言人更直接:这份报告”包含关于 NHS 的误导性陈述”。瑞士联邦铁路和伦敦交通局也先后否认了报告中提及的 AI 应用案例。
这不是某一句引文出了偏差,而是整段整段的论述建立在看似合理、实则虚构的事实基础之上。
换句话说,毕马威引以为傲的 AI 洞察力报告,本身就被 AI”幻觉”摆了一道。
咨询公司的 AI 报告,反被 AI 坑了

毕马威在报告中大谈”智能体 AI”将如何重塑商业卓越标准,核心论点是:那些率先拥抱 AI 代理的企业,正在获得显著的竞争优势。为了支撑这个论点,报告列举了大量”行业实践案例”。
问题在于,这些案例中有相当一部分看起来像是大语言模型自己编出来的。
GPTZero 的检测发现,报告中存在典型的 AI 生成文本特征:模糊的引用、似是而非的数据、无法验证的具体数字。爱德华·田在接受采访时表示,当他看到报告中那些过于”完美”的行业案例时,直觉告诉他这不对劲。“AI 写的东西往往太’典型’了,典型到现实世界根本不会发生。”
毕马威事后发表声明,称已撤回该报告,并承诺彻查此事。声明中还提到,报告撰写过程中使用了 AI 辅助工具,但强调有一套”人工审核流程”。只是从结果来看,这套流程显然没能挡住那些虚构的案例。
这个声明本身就更耐人寻味了:一家全球顶级咨询公司,一边写报告教企业怎么用 AI,一边自己的 AI 报告出了 AI 幻觉。教游泳的教练,自己先呛了水。
一个已经炸过一遍的雷,还是没躲开

如果说毕马威只是偶尔翻车,那看客们或许会宽容一些。但问题在于,这不是第一次了。
就在几个月前,另一家四大会计师事务所安永(EY)也撤回了一份报告,原因同样是 AI 生成的虚假脚注。那份报告中的参考文献看起来专业、完整、格式规范,但仔细一查,引用的论文和作者根本不存在。全是大模型”脑补”出来的。
两家四大所,两份 AI 相关的报告,出了同一个问题。这不是偶然,这是一个行业性的警示信号。
咨询公司对 AI 工具的热情可以理解。生成式 AI 能大幅提升报告撰写效率,快速产出看起来专业的内容,这在竞争激烈的咨询行业里是巨大的诱惑。但效率的代价是准确性的牺牲,尤其是当 AI 生成的错误被”包装”成专业文献时,审核难度远远高于人工撰写的文本。
毕马威的声明里说会”加强审核流程”,这听起来像标准公关话术。真正的问题不在于审核流程够不够严,而在于:当一家机构自己都搞不清 AI 编的内容和真实内容的边界时,它凭什么指导客户用 AI 做决策?
撤回的是一份报告,暴露的是一种盲区

这件事最讽刺的地方,不是毕马威犯了错,而是它犯的错恰好跟自己报告的主题高度重合。
毕马威那份被撤回的报告,核心卖点是什么?是”帮助企业在 AI 时代建立竞争优势”。结果报告本身就是一个反面教材,没有用对 AI、没有审好 AI、没有管住 AI。如果毕马威的客户按照报告里那些”最佳实践”去部署 AI 系统,后果不堪设想。
更深层的问题是信任成本。咨询公司的核心资产是专业信誉。一份报告的撤回,损失的不只是几十万的撰写成本,更是客户对其判断力的信任。当客户发现,连四大所都无法有效验证 AI 输出的准确性,他们凭什么相信那些关于”AI 转型”的建议?
爱德华·田在接受采访时说了一句值得玩味的话:“如果毕马威这样级别的机构都会因为 AI 幻觉而出错,那普通人面对 AI 生成的信息时,几乎没有防御能力。”
行业需要建立新的验证标准。咨询公司、律所、金融机构这些高度依赖专业判断的行业,正站在一个尴尬的十字路口:AI 带来的效率提升是实打实的,但 AI 带来的信誉风险也是实打实的。如何在这两者之间找到平衡,才是那句”重新定义卓越”的真正含义。
来源:TechCrunch
