人工智能的“精神测试”:俄罗斯只有“有道德的”模型才能获得政府采购资格
俄罗斯人工智能市场正站在一场前所未有的实验门槛上:基础模型的开发者将被要求不仅证明技术上的合法性,还要证明对“传统精神道德价值观”的坚守。这一倡议在7月底至8月初于“数字经济”自治非营利组织的平台上被热烈讨论,从根本上改变了行业所有参与者的游戏规则。
形式上,人工智能法已于7月26日生效,但它具有框架性质。现在,关键要求需要在实施细则中加以规定,而正是在这里,最大的悬念正在展开。这涉及为大型模型引入两种特殊地位——“主权”和“国家”。获得其中任何一种都将成为获得国家优惠的通行证,包括在政府采购中的优势。
审查机制:从基准测试到提示注入
目前不打算单独制定一份价值观清单的法案——这份清单已经载于总统令第809号。相反,将与商界共同制定专门的基准测试——用于评估模型的测试集。程序将分两步进行:开发者提交包含架构和过滤机制描述的申请,然后由认可的实验室检查模型的回答,并尝试通过提示注入——本质上是用输入数据中的恶意指令来“破解”人工智能——绕过内部限制。
专家结论将提交给政府数字化委员会,只有正面裁决才能打开获得国家支持的大门。一个重要细节是:并非市场上所有模型都会接受审查,而只有那些申请主权或国家地位的模型。首批实施领域将是教育和公共服务。
整个架构让我产生了严重的疑问。将“精神性”形式化为技术测试——这几乎是不可能完成的任务。人工智能项目的商业架构师们公正地指出:诸如公民意识或历史记忆等类别无法直接转化为技术任务书。唯一可能的方法是程序性的:统一的报告格式和结果的可复现性。但这里隐藏着最大的风险——“评估性”标准,这为选择性适用创造了土壤。
与此同时,该系统本身将是去中心化的:多家通过国家机构审查的竞争性实验室将能够出具结论。最终决定权将属于数字发展部,而国家系统的安全将由联邦安全局和联邦技术出口管制局监督。大型开发者已经拥有阻止违禁请求的工具,因此该部门希望依托市场已有的成果。
可能的审查方候选者包括俄罗斯科学院系统编程研究所。然而,实施细则文件包仍在跨部门协调中,谈论最终架构还为时过早。律师们已经建议引入证书有效期和结论公开登记制度,以尽量减少主观性风险。
我的结论:这一倡议雄心勃勃,但其成功直接取决于能否建立真正客观且可复现的评估程序。否则,“精神过滤器”有可能从保护价值观的工具变成对市场施加行政压力的机制,最终打击行业的创新发展。