加密新闻

22.08.2026
08:29

AI内容标注:为什么欧盟新规打击真人作者并制造“有罪推定”

img-18194aa95bb7153c-433758682491739

2026年7月30日,一场丑闻爆发,成为新现实的完美写照:尼日利亚作家杰里·法拉德的经纪人因涉嫌使用人工智能而撤回其处女作小说并解除合同。这部手稿曾引发14家出版社的争夺,本可为作者带来超过200万美元的收入,却成为风暴中心,而这里没有无罪推定的空间。

8月2日,《欧盟人工智能法案》第50条的关键条款已生效——这是全球首部将合成内容标记设为法律义务的法律。这不仅仅是技术上的形式要求,更是行业定义真实性方式的根本性转变。让我们分析为什么新规给“真人”作者带来的问题比给生成模型带来的更多。

三层保护及其脆弱性

立法要求内容来源信息即使在复制和压缩后也必须保留。行业采用三种方法:C2PA标准(数字来源证书)、不可见水印(如谷歌DeepMind的SynthID)以及文本统计标记(如集成在Gemini中的SynthID-Text)。

然而,每种方法都有致命弱点。C2PA可以通过在不支持该标准的程序中简单编辑来移除,而Midjourney尽管是内容真实性倡议的成员,却原则上不嵌入C2PA信标。文本统计标记则无法提供无可辩驳的证据——它仅指示机器生成的可能性。

法拉德案:当怀疑胜过事实

法拉德的故事具有代表性。他的经纪人承认,由于AI检测器以误报频出而闻名,他没有对手稿进行检测。然而,在一次最终会议后,“故事的一些细节发生了变化”,合同被终止。给出版商的信中并没有声称已证实的事实——只有一句无法“确认文本来源”的话。

这并非孤例。米娅·巴拉德的恐怖小说在阿歇特被取消,而哈拉·米卡埃拉·沃尔夫的病毒式小说《达格茅斯》被Pangram Labs评估为60%由AI生成。所有案例都缺乏技术确认,但声誉风险迫使出版商退缩。监管机构建立系统是为了保护真实性,但在实践中,对文本而言,它制造了一个真空,而企业偏执填补了这一真空。

开源的盲区与新现实

问题因大量生成模型——Qwen、Llama、DeepSeek、Stable Diffusion——实际上超出监管范围而加剧。它们可以被下载、修改并禁用内置标记。即使是可靠的水印,如Anthropic在Claude中的水印,在改写或翻译后也无法读取。

已在市场上运行的系统必须在2026年12月2日前完成适配。艺术和讽刺作品有例外。YouTube已自动添加标签,而Spotify从9月中旬起为具有“合成”人格的艺术家引入AI Persona徽章。行业压力日益增大:在Deezer上,AI曲目占新上传量的44%,97%的用户无法将其与人类作品区分。

我的分析:标记不是万能药,而是一种制造控制幻觉的工具。对于文本,不存在技术上的“不在场证明”,在这个灰色地带,获胜的不是有理的一方,而是更响亮地宣称自己“人性”的一方。开放模型和元数据删除为垃圾信息发送者留下漏洞,而诚信作者则遭受声誉恐慌的打击。在监管者解决文本来源可证明性的根本问题之前,“真人”作者仍将受制于他们自己创造的算法。