近日,AI检测机构GPTZero团队对普华永道(PwC)发布的研究报告开展了一次“AI体检”。
检测结果显示,2024年至2026年间,普华永道中东分支机构(PwC Middle East)陆续发布的4份研究报告中充斥着大量“AI幻觉”,包括虚构概念、错误引用及编造参考文献等,其中一份报告被检测工具判定为100%由AI生成。
普华永道并非孤例。在此之前,“四大”会计事务所中的另外三家——德勤、安永及毕马威——在其发布的研究报告中亦被检出过类似的“AI幻觉”问题。
随着生成式AI加速渗透知识生产领域,向来依凭专业判断与严谨性立足的咨询行业,正面临一场前所未有的信誉考验。
普华永道一份研究报告被测出100%由AI生成
在GPTZero检测的4份普华永道中东的研究报告中,《治理变革》(Transforming Governance)问题最为突出。
检测显示,这份发表于2025年2月的报告存在明显AI生成特征,若剔除参考文献等末尾内容,正文部分由AI生成的概率竟达到100%。
整份报告围绕一个名为“Citizen Pulse”(公民脉搏)的治理框架展开论述。但是,GPTZero检测发现,“公民脉搏”这一概念从未出现在这份报告之外的公开资料、报道以及文献中。然而,普华永道的报告却宣称,丹麦、沙特阿拉伯、美国和澳大利亚政府正在利用“公民脉搏”这一理念改善公共服务。
普华永道报告称,丹麦公共机构利用“公民脉搏”数据提升公共服务,并将丹麦政府公共服务门户网站Borger.dk作为引用来源。但实际上,该网站并未提及“公民脉搏”。
报告还称,沙特公共机构利用“公民脉搏”推动公共服务改革,并引用了沙特“2030愿景”官方网站作为依据。但在该网站页面上未发现能够支持这一说法的证据。
《每日经济新闻》记者随后通过搜索引擎以及多款AI大模型的搜索功能,未检索到关于“公民脉搏”这一概念的公开信息。
此外,普华永道报告“AI幻觉”问题还体现在虚构参考文献、引用错误等方面。
GPTZero检测发现,《治理变革》中的17条参考文献中,仅有10条与正文脚注相对应,其余引用存在编号缺失、对应关系混乱等情况,甚至有两条参考文献直接被判定为虚构。
在参考文献列表中,《治理变革》报告表示引用了《麻省理工科技评论》题为《政府服务中的人工智能》(Artificial Intelligence in Government Services),以及世界经济论坛题为《第四次工业革命:智慧城市与人工智能应用》(The Fourth Industrial Revolution: Smart Cities and AI Applications)两篇文章,但GPTZero检测发现,这两篇文章并不存在。每经记者通过搜索引擎以及多款AI大模型检索后,同样没有查找到相关文章。
此外,普华永道中东的这份研究报告还存在正文论述与引用来源之间缺乏对应关系,不少参考文献仅链接至相关网站首页,无法直接支撑正文中的具体内容。
普华永道多份报告出现明显错误,检测称发布前未经过人工充分核查
《治理变革》并非唯一存在严重“AI幻觉”问题的报告。
GPTZero检测发现,普华永道中东的另外三份研究报告中,同样出现了正文论述与引用来源不符、统计数据误读以及案例无法由参考文献支撑等问题。
例如,《塑造海合会国家交通出行格局》(Shaping the GCC Mobility Landscape)一文混淆了国际能源署报告中的两项不同指标,把中国电动汽车累计销量误写为公共充电桩数量。GPTZero表示,这类对网页图表或可视化数据的误读,是AI生成内容中较为典型的错误。该报告正文部分完全由AI生成的概率高达82%。
另外,《构建具有网络韧性的电动出行生态系统》(Building a Cyber-Resilient eMobility Ecosystem)报告声称引用学术论文和媒体报道,但却呈现参考文献中并不存在的统计数据。
GPTZero还指出,该报告一处参考文献链接中包含“utm_source=chatgpt.com”参数,并据此认为该链接由ChatGPT生成。
GPTZero认为,该报告正文完全由AI生成的概率达60%。
《代理式AI:生成式AI的新前沿》(Agentic AI – The New Frontier in GenAI)报告则出现了正文结论与引用内容不符、引用时间晚于报告发布时间等情况。该报告正文部分完全由AI生成的概率达50%。
GPTZero总结称,普华永道中东报告中错误的密集程度充分表明,这些报告在发布前并未经过充分人工核查。
针对GPTZero对报告的检测结果,每经记者向普华永道发去采访请求,截至发稿未得到回应。
普华永道中东7月29日向英国媒体回应称,公司“高度重视已发布研究内容的准确性”,目前正对相关报告中的“少量支持性引用”进行更新。公司设有适用于研究和内容开发的质量控制流程,并强调相关流程符合其“负责任AI”原则。不过,对于相关错误如何产生,以及涉事报告是否使用生成式AI参与撰写,公司未作进一步说明。
从德勤退款10万澳元到毕马威撤稿:“四大”专业报告均遭遇“AI幻觉”风波
普华永道并非首家因研究报告中的AI“幻觉”受到质疑的四大会计师事务所。
此前,GPTZero已陆续对德勤(Deloitte)、安永(Ernst & Young,EY)、毕马威(KPMG)发布的多份研究进行检测,并指出这些报告普遍存在虚构参考文献、正文论述与引用来源不符、统计数据错误引用等问题。
最早引发广泛关注的是德勤澳大利亚(Deloitte Australia)2025年7月的一份政府咨询报告。
该报告源于一项价值44万澳元的政府合同。有学者发现,该报告引用了一本并不存在的著作。澳大利亚媒体进一步核查发现,报告中还存在大量虚构案例、错误引用和不存在的参考文献。随后,澳大利亚政府内部审查发现这份报告有超过50处可疑引用。最终,德勤更新了报告,并向澳大利亚政府退还9.8万澳元。
随后,GPTZero又从中识别出30余处引用问题,其中19处被判定为“幻觉引用”。
2026年5月,安永加拿大(EY Canada)发布的网络安全报告《攻击点:揭示忠诚度体系中的网络威胁与欺诈》(Points of Attack: Uncovering Cyber Threats and Fraud in Loyalty Systems)也因类似问题被撤回。
今年6月,GPTZero又针对毕马威的报告《全面体验:代理式AI时代重新定义卓越》(Total Experience: Redefining Excellence in the Age of Agentic AI)进行检测。结果显示,这份报告共包含45条参考文献,其中仅5条能够准确对应真实来源。
事件曝光后,多家被毕马威报告列为案例的机构公开否认相关内容。
瑞银集团(UBS)、英国国家医疗服务体系(National Health Service,NHS)、瑞士联邦铁路公司(Swiss Federal Railways,SBB)以及伦敦交通局(Transport for London,TfL)均表示,相关报告中关于其使用代理式AI的描述并不准确或具有误导性。随后,毕马威撤下了相关报告,并启动内部调查。