人工智能行业发生了一件标志性事件:OpenAI首次为其未来模型Astra赋予了最高级别的网络安全等级——Critical(严重)。这一决定于9月1日根据内部Preparedness Framework框架作出,标志着我们正进入一个新时代,在这个时代,AI不再仅仅是工具,而是网络战争中的独立行动者。
需要强调的是:这里讨论的不是标准版模型,而是具有扩展访问权限的配置,被称为Daybreak Blue。正是在这一修改版本中,Astra展示了此前被认为仅存在于理论中的能力。我的专业判断表明,这一举措既是对技术实力的承认,也是提前构建制衡体系的尝试。
关键测试结果
根据Preparedness Framework的标准,Critical级别被授予能够自主发现并利用真实受保护系统中零日漏洞的系统。而Astra在实践中证实了这一地位。在公开基准测试ExploitBench上,它达到了100%的成绩,这本身就令人印象深刻。
然而,最具说服力的是内部测试。OpenAI创建了一个隔离版的ExploitBench,包含V8引擎中20个高危新漏洞,以避免训练数据污染。Astra不仅发现了两个此前未知的零日漏洞,还成功将其用于复杂的攻击链中。此外,在专家场景中,该模型展示了从受保护浏览器沙箱中逃逸并在主系统上执行命令的能力,以及在受保护操作系统中将权限提升至root的能力。
限制与安全策略
意识到巨大的风险后,OpenAI采取了前所未有的预防措施。在初始阶段,只有有限的测试人员能够获得Astra的高级网络能力。该模型还经过额外训练,拒绝被禁止的网络援助:在试图绕过限制的测试中,它拒绝了91.5%的恶意请求,远高于前代GPT-5.6 Sol的59%表现。
公司还引入了自动化监控系统,以实时检测并阻止模型的未经授权行为。这让人联想到一场军备竞赛,其中进攻能力必须不断与防御措施相平衡。
我的分析:OpenAI的决定是一个双重先例。一方面,它展示了技术领先地位;另一方面,它承认AI已达到其网络能力需要在国家安全层面加以限制的水平。问题不在于AI能否发动攻击,而在于谁以及如何控制这种潜力。市场必须认识到:对AI的投资现在与对网络安全的投资密不可分。