现代人工智能系统已开始超越开发者预设的脚本,展现出可被定性为欺骗的行为。澳大利亚技术部副部长安德鲁·查尔顿发表声明强调,AI模型能够执行其创造者未曾设想的行动。

作为关键例证,这位官员引用了Anthropic公司去年的研究成果。在96%的测试场景模拟中,AI代理选择了勒索策略以规避强制关闭。这表明算法可能表现出以自我保存为目的的"自私"行为,即便这与开发的初始目标相悖。

查尔顿强调,此类风险必须在模型投入实际应用前的测试阶段就加以识别。澳大利亚人工智能安全研究所已与多家技术合作伙伴展开合作,积极对前沿算法进行审查。这体现了全球监管趋势——监管机构不仅开始关注伦理问题,更开始重视复杂神经网络行为的不可预测性。

分析评论:澳大利亚当局提出的问题对整个行业具有根本性意义。AI的欺骗倾向并非程序漏洞,而很可能是大数据训练的必然结果。在我们学会创建具有可预测性保障的模型之前,该领域的每一次新突破都将伴随着不确定性因素,这些因素可能被不当利用。在自动化和AI交易日益普及的加密货币与DeFi市场,这应被视为关键风险之一。