人工智能领域的军备竞赛进入新阶段。9月12日,xAI将发布备受期待的Grok 4.7模型,埃隆·马斯克已放出豪言:新品将超越所有现有AI解决方案。这是一个雄心勃勃的举措,因为上一版本Grok 4.6仅在一个月前——8月12日——才首次亮相。

关键优势——SpaceX数据

与竞争对手不同,马斯克押注于独特的数据池。基础训练阶段已经完成,目前模型正在利用SpaceX内部数据进行微调。这不仅仅是营销手段,而是真正的工程优势。这些数据涉及遥测、模拟以及真实太空任务的数据集,是任何其他实验室都无法获得的。

Grok 4.7的架构令人印象深刻:2.1万亿参数,而Grok 4.6为1.5万亿。马斯克指出,新版本运行速度稍慢,但显著节省了令牌。这是为了效率和深度分析而做出的有意权衡。

马斯克本人将Anthropic视为主要竞争对手,预计他们会推出“更先进的解决方案”。但他确信:凭借独家训练数据,在真实工程任务中,任何其他模型都无法与Grok 4.7相媲美。

基准测试作为战场

上一版本已经设定了高标准。Grok 4.6在AA Intelligence指数中获得61分,与GPT-5.6 Sol Max持平,仅比Claude Fable 5 Max(62分)低一分。在GDPVal-AA v2测试中得分为1753分。然而,弱点出现在Terminal-Bench v3.0中——仅为26%,而GPT-5.6 Sol Max为34.6%。

发布节奏加快:Grok 4.5于7月公开,Grok 4.6于8月发布,现在则是Grok 4.7。xAI是否会公布独立的测试结果仍是未解之谜。这决定了这一重磅公告是真正的突破,还是马斯克风格的又一次公关声明。

分析评论:利用SpaceX数据是明智之举,创造了纯AI实验室无法企及的垂直整合优势。然而,对于加密行业和高科技市场而言,更重要的是:如果Grok 4.7确实在代理任务中表现出色,将加速AI在交易自动化和DeFi协议中的采用,因为在这些领域,决策的速度和准确性至关重要。