通用人工智能(AGI)的概念——即能够以人类水平解决智能任务的系统——多年来一直被视为科幻小说的专属领域。如今,OpenAI 正朝着这一方向迈出决定性的一步,正式推出 GPT-6 Astra 模型。尽管该公司目前谨慎地避免直接贴上“AGI”的标签,但其领导层的声明以及新系统能力的展示已不容置疑:我们正站在行业范式转变的门槛上。
GPT-6 Astra 能做什么?
与之前的版本不同,Astra 不仅仅是一个聊天机器人,而是一个能够自主行动的完整智能体。演示显示,该模型可以在计算机上工作:浏览网站、填写表单、管理应用程序,并在无需持续提示的情况下执行多步骤任务。这是从“答案生成器”到“任务执行者”的质的飞跃。
我的内部基准测试证实了显著的进步。与竞争对手的比较令人印象深刻:
- 复杂多步骤任务:Astra 的成绩为 41.4%,是前代 GPT-5.6 Sol(18.1%)的两倍多,并明显领先于 Claude Fable 5.1(31.4%)。
- 高级编程:74.1%,而 Sol 为 70.8%,Fable 为 67.4%。这里的优势并非压倒性,但仍相当可观。
- 科学计算:差距巨大——Astra 为 64.6%,而 Sol 仅为 22.4%。这表明在逻辑思维方面进行了扎实的工作。
- 极难数学:97.6% 的成绩接近绝对完美,将竞争对手远远甩在身后。
- 从图像进行 3D 设计:95.9%——再次印证了该模型强大的多模态能力。
需要强调的是,这些数据基于 OpenAI 的内部测试和供应商数据。独立验证尚未进行,而这才是真正的评判标准。
经济性与可及性
用户最关心的问题之一是成本。Astra 已开始接入企业客户和网络安全专业人士。未来几天内,Plus、Pro、Business 和 Enterprise 套餐的订阅用户将获得访问权限。目前尚未提供免费版本。
值得注意的是,Astra 的基础版本将包含在每月 20 美元的 ChatGPT Plus 订阅中——这使得这一突破性技术变得出人意料地平易近人。然而,增强版 Astra Pro 仍将是更昂贵的 Pro、Business 和 Enterprise 套餐的专属。这种分层策略是明智之举,既能从大众市场获利,也能覆盖高端企业解决方案。
OpenAI 官方并未将 Astra 称为“通用人工智能”。公司总裁格雷格·布罗克曼将 AGI 形容为“灰色、模糊的东西”,但他承认:也许正是这个模型,后人会将其称为 AGI 到来的转折点。然而,怀疑论者也有可指摘之处。Astra 在 ARC-AGI-3 测试中的亮眼成绩是通过辅助功能实现的——即一个具备记忆和工具访问权限的智能体。这意味着模型本身的纯粹能力难以与围绕其构建的系统区分开来。
我的分析:尽管存在营销炒作,Astra 的发布不仅仅是又一次更新,而是一次根本性的转变。我们正从提供建议的 AI 过渡到付诸行动的 AI。创造性任务目前仍由人类承担,但日常的智力工作正日益交到机器手中。对于加密货币市场和股票领域,这意味着:分析和决策的自动化将达到新的水平,这必将影响交易操作的速度和性质。