澳大利亚政府用以论证禁止青少年使用社交媒体的关键文件,竟充斥着指向不存在学术研究的引用。我的分析揭示了一个系统性问题:这份由英国机构Age Check Certification Scheme(ACCS)以348万澳元(约250万美元)编制的报告,其参考文献中至少存在六处严重违规——从虚构的DOI到倒填日期的文章。

测试覆盖了48家供应商的60多项解决方案,最终这份约千页、共十卷的文件于2025年8月提交给政府。时任通信部长安妮卡·威尔斯当时表示,数据证实存在“多种有效的年龄验证工具”。针对16岁以下用户的禁令于2025年12月10日正式生效——如今其合法性已岌岌可危。

六处引用,瓦解论证根基

问题集中在关于前沿发展的章节,作者在此引用了学术文献。最先指出这些不符之处的是向参议院委员会(该委员会正在审议关于加强禁令的修正案)提交意见的作者。我的核查发现了四类错误:虚构的DOI、指向无关研究的引用、不存在的“作者-期刊-年份”组合,以及引用正确但内容被歪曲的情况。

例如,一篇文章标注为2025年3月,实际发表于7月。另一条指向Weber et al. 2011的引用则无处可寻——既不在所标注的期刊中,也不在莫纳什大学的研究里。这些并非偶然的笔误,而是生成式模型留下的系统性痕迹。

元数据中的ChatGPT:从否认到承认

ACCS的代表起初坚决否认使用人工智能,声称每条引用都经过人工核查。然而,当在四条引用的元数据中发现ChatGPT的直接标记后,其立场不得不软化。该机构承认,神经网络为追求简洁重写了部分片段,但坚称研究和最终文本均未借助聊天机器人完成。

更甚者,ACCS声称ChatGPT元数据本身就足以构成使用AI的通知。这是一个危险的先例:如果文件中的标记被视为披露,那么真实性核查便沦为形式。该机构转交给媒体的修正版参考文献列表又暴露了年份、作者和期刊名称方面的新出入。

“少量错误”还是信任危机?

基础设施与通信部表示正在研究这些指控,而参议院听证会上的官员则复述了ACCS的说法:引用据称是在发布后“损坏”的。第一助理秘书莎拉·范登布鲁克承认,该部门并未核实这一说法,认为核查“过于繁琐”。部门坚持认为,这只是26页参考文献中的“少量错误”。

澳大利亚国立大学教授克里斯蒂安·道尼警告:虚假引用会导致错误决策,并侵蚀对机构的信任。独立参议员法蒂玛·佩曼要求道歉并退还资金,并提醒人们注意Deloitte的先例——该公司于2025年10月因一份含AI错误的报告退还了部分款项。

我的结论:此事件不仅是技术故障,更是时代症状——内容生成的速度已超越对其真实性的责任担当。如果政府基于“幻觉”文件做出监管决策,我们就有可能在流沙上立法。与承包商的合同必须包含对未经核实使用AI的严厉制裁,否则每出现一份此类报告,公众对机构的信任就会被进一步稀释。