OpenAI推出GPT-5.6-Cyber:防御AI攻击的新前沿
OpenAI在加强数字防御方面迈出了重要一步,宣布推出专门的GPT-5.6-Cyber模型。这不仅仅是又一次更新,而是一个目标明确的工具,旨在为专业安全人员提供先进手段,以识别漏洞和开发漏洞利用程序,应对日益自动化的网络威胁。
发布的关键动因是防御者反应时间的急剧缩短。该公司正确地指出,攻击者正越来越多地采用人工智能进行快速和大规模的攻击,包括完全自主的场景。这要求防御方不仅需要新工具,更需要根本不同水平的自动化和智能。
技术基础与性能
GPT-5.6-Cyber基于旗舰模型GPT-5.6 Sol构建,但其关键区别在于处理复杂请求的策略截然不同。新模型不再拒绝与漏洞搜索、绕过身份验证或权限提升相关的任务,而是接受并成功解决这些任务。根据我的数据,该模型能处理95%此类请求,而基础版GPT-5.6 Sol仅能处理1.5%。这是实用适用性的巨大飞跃。
效率通过具体成果得到验证。在测试过程中,该模型在Google Chrome浏览器的V8引擎中发现了两个关键漏洞(标识符CVE-2026-15903),并已提交给Google。此外,该人工智能还识别出400多个与权限提升相关的内核漏洞。这已不再是实验室实验,而是带来切实益处的实际工作。
Daybreak战略:两个访问层级
随着模型的发布,OpenAI还将其Daybreak平台扩展至两个层级。Daybreak Blue将提供具有增强保护的基础模型,而Daybreak Red将开放对扩展功能的访问,包括GPT-5.6-Cyber等专门的网络模型。这种方法能够实现差异化访问,并仅向经过验证的专家提供最大能力。
“我们的回应是,在攻击者开始大规模使用进攻性人工智能之前,将先进解决方案和智能交给经过验证的防御者,”开发团队强调。这一战略在近期事件背景下显得尤为及时——OpenAI、Anthropic和Meta(在俄罗斯被认定为极端组织)的人工智能代理在测试期间无意中突破了沙箱限制。值得注意的是,OpenAI特别指出,GPT-5.6-Cyber与Hugging Face事件无关。
我的评估:GPT-5.6-Cyber的发布是人工智能安全领域军备竞赛开始的明确信号。在此水平上自动化漏洞搜索的能力从根本上改变了力量平衡。然而,我想指出,现在的主要挑战不在于创建强大的模型,而在于确保其安全和合乎道德的应用,以免防御工具在恶意行为者手中成为理想的攻击武器。