AI润色竟造假?揭秘报告背后的文献骗局
本文详细解析澳大利亚社媒禁令技术评估报告中,因使用ChatGPT润色而引发的虚假文献引用争议,帮助技术及政策从业者理解AI幻觉带来的公信力风险。
一份旨在为澳大利亚社交媒体禁令提供技术依据的报告,竟然因为“AI成分”太重而深陷信任危机。由于报告中出现了大量虚假的学术引用,这一事件引发了关于AI在政府决策中应用的广泛争议。

近期,澳大利亚政府正致力于通过立法手段限制未成年人使用社交媒体,以应对日益严峻的互联网安全挑战。为了确保政策制定的科学性,政府投入了巨额资金,斥资 348万澳元 开展了针对“未成年人社交媒体年龄验证”的专项技术评估工作。这份报告被寄予厚望,旨在为后续的监管措施提供权威的技术支撑。
然而,这份报告在发布后却意外陷入了舆论风波。争议的转折点在于,负责相关工作的英国机构 ACCS 承认,在报告的编写过程中,曾使用 ChatGPT 对文本内容进行了语言润色。这一承认迅速引发了公众与技术专家的广泛质疑:当人工智能被引入严肃的政府决策支持文档时,报告内容的严谨性与真实性该如何得到保障?这一事件也为后续报告中出现的文献引用问题埋下了伏笔。
一旦这种“幻觉”现象进入学术或政策引用领域,其产生的连锁反应将是灾难性的。通过对该报告的深入核查,研究人员发现其中充斥着大量逻辑不通的虚假文献。具体表现为:部分DOI链接完全失效,无法打开;有些链接虽然可以跳转,但指向的研究内容与报告讨论的主题完全风马牛不相及;更有甚者,会出现作者姓名与期刊名称完全“张冠李戴”的情况。这种凭空编造学术实体的行为,正是生成式AI在处理高度严谨的事实性信息时最典型的失控表现。
更令人担忧的是,这种错误并未随着后续的修正工作得到有效解决。在ACCS随后提交的勘误清单中,依然暴露出极其低级的编辑失误。例如,部分文献的署名作者依然存在错位,甚至连文献发表的年份也出现了错误。这反映出一个严峻的问题:如果缺乏专业人员对AI生成的文本进行深度的人工校验,单纯依赖自动化工具进行“纠错”,不仅无法挽回报告的公信力,反而可能因错误的二次加工而进一步加剧信息的混乱。
这种因缺乏人工校验而导致的“幻觉”错误,其影响范围早已超出了简单的文档编辑范畴,正逐渐演变成对行政决策科学性的根本挑战。
从行业角度看,这并非孤立事件。例如,咨询巨头德勤(Deloitte)此前就曾面临严峻挑战:由于交付了一份包含AI虚构内容的报告,最终被要求退还高达44万澳元的合同款。这一案例清晰地表明,当AI生成的错误内容渗透进专业咨询或政府外包项目中时,其后果不仅涉及商业信誉的损失,更可能触发严肃的法律与经济责任。
更深层次的风险在于,政策的制定必须建立在严谨的事实基础之上。一旦决策过程依赖于伪造或失实的文献引用,整个决策逻辑就会产生根本性的扭曲。这不仅会使政策本身失去科学依据,更会直接损害公众对政府机构及专业评估机构的信任。在高度敏感的政策领域,这种由于技术滥用引发的公信力危机,其代价往往是难以估量的。
CopyRight 2025 www.bzxz.net All Rights Reserved
本网站所展示的内容均由用户自行上传发布,本站仅提供信息存储服务。若您认为其中内容侵犯了您的合法权益,请及时联系我们处理,我们将在核实后尽快删除相关内容。