谷歌改变方向:为什么DeepMind选择世界模型而非排名竞赛
当OpenAI和Anthropic竞相开发能够递归自我改进的人工智能时,Google DeepMind却押注于另一条赛道——能够理解现实物理规律的“世界模型”(World Models)。从表面上看,差异几乎难以察觉:Google仍在发布模型并持续盈利。但若仔细观察独立排行榜上的排名,便会发现一个明显趋势:这家科技巨头正有意识地退出“原始算力”的竞赛。
Gemini 3.6 Flash:押注速度与价格,而非领先地位
7月21日,Gemini 3.6 Flash模型正式发布。其核心亮点在于速度和成本,而非极致性能。据Google数据,新版本生成的token数量比上一代减少17%,这直接降低了响应成本。然而,在Artificial Analysis排行榜上,该模型仅位列第十。所有领先的开发者排名均在其之上。
Google并未停止优化。该公司已启动未来Gemini 4最大规模的训练,而更庞大的Gemini 3.5 Pro版本目前正在合作伙伴中进行测试。但首席执行官桑达尔·皮查伊已将发展路线图与个人智能体(personal agents)的演进挂钩,而非排行榜上的名次。投资者的反应更为激烈:6月份,在两位顶尖研究员跳槽至竞争对手后,Alphabet股价下跌了6%。
DeepMind面临的风险
世界模型是一种能够学习环境物理规律的人工智能:包括重力、运动、因果关系。该算法预测空间中的事件发展,而不仅仅是选择词语。DeepMind公开宣称了这一方向:在其官网上,Genie 3和Gemini Robotics均被归类于世界模型和具身智能(embodied AI)板块。
5月份,该实验室扩展了Project Genie项目,将其与街景视图(Street View)整合,并推出了SIMA 2——一个通过与虚拟3D世界交互进行学习的智能体。
OpenAI和Anthropic则选择了截然不同的策略。这些团队专注于系统的递归自我改进。实际上,这项技术允许人工智能自主设计下一代算法。产品启动新的开发周期,从而创造出更强大的解决方案。
分析师阿尔贝托·罗梅罗推测,Google是有意放弃参与这场竞赛:“哈萨比斯押注的是另一条路——能够理解和模拟真实世界的世界模型,而不仅仅是预测下一个token。”不过,Google并未发表此类声明。
为何竞争对手联合创始人认为DeepMind是“例外”
几个月前,一位竞争对手的代表表达了最为批判性的观点。Anthropic联合创始人杰克·克拉克于5月4日发表了一篇关于人工智能未来的文章。他评估,到2028年底,人工智能能够自主管理研究过程的概率为60%。到2027年,这一概率为30%。
随后,克拉克提出疑问:哪些实验室真正在朝着这个目标前进?据他所说,DeepMind“在三巨头中看起来最为克制”。克制意味着谨慎。克拉克的论据基于DeepMind自身的文件,特别是2025年发表的一篇关于人工智能安全问题的文章。
Anthropic则更为大胆。关于递归自我改进的研究表明,到2026年5月,Claude编写了公司产品中超过80%的代码。而在2025年2月之前,这一比例几乎为零。该公司已经记录到人工智能创造更先进人工智能的案例:在一个测试周期内,他们的模型在4月份将性能提升了52倍。一年前,这一增幅仅为2.9倍。相比之下,经验丰富的工程师需要四到八个小时才能实现四倍的性能提升。
为何不能断言Google完全退出了人工智能竞赛
有两个重要因素与这一假设相矛盾:
- Google在机器学习研究测试中保持领先地位。
- 该系统在全球市场上展现出高用户活跃度。
基准测试MLE-Bench评估模型自主创建人工智能架构的能力。2月份,Gemini 3以64.4%的成绩位居榜首。随后在7月份,3.6 Flash版本获得了63.9%的分数。即将退出市场的公司通常不会领跑此类排行榜。
此外,这家科技巨头仍保持着巨大的覆盖范围。桑达尔·皮查伊表示,Gemini应用的月活跃用户已达到9.5亿人。
Google能否承受延迟
长期以来,搜索广告收入弥补了实验性支出,使DeepMind能够从容不迫地开展工作。然而,Alphabet的最新财报显示,其财务缓冲正在缩减。
2024年第二季度,该公司营收达到1198亿美元,同比增长24%。根据7月22日发布的财报,仅搜索广告一项就贡献了633亿美元。但支出也在增长。三个月内,Alphabet投入449亿美元用于数据中心建设和设备采购——几乎是去年同期的两倍。
结果,自由现金流为负58.6亿美元。3月份这一指标为正值101亿美元。前一年12月则为246亿美元。为了弥补缺口,Alphabet发行了496亿美元的股票,并获得了203亿美元的贷款。长期债务在半年内从465亿美元增至982亿美元。
与联合人工智能开发相关的支出项目造成了57.9亿美元的亏损——而一年前为33.7亿美元。因此,当前的观望策略正让公司付出越来越高的代价。
未来30天需要关注的重点
- Gemini 3.5 Pro是否会发布,以及该模型在测试中取得何种排名。
- DeepMind是否会公布Gemini 4世界模型的新数据。
- Alphabet的现金流能否在9月份恢复正值。
- 德米斯·哈萨比斯是否会就自我学习技术阐明明确立场。
Gemini 4的发布将成为公司战略的决定性时刻。如果世界模型的方法被证明是成功的,那么当前的放缓将是一次精准的计算。即将发布的财务报告将揭示Alphabet在这场技术竞赛中资源的真实边界。
专家观点:Google并非在失败——而是在改变游戏规则。当竞争对手将数十亿美元投入递归自我改进时,DeepMind正在对理解物理世界进行长期押注。如果世界模型真的成为下一个突破,Google当前的“克制”可能会转化为战略优势。然而,市场和投资者要求的是当下的成果——Alphabet必须证明其道路并非死胡同。