人工智能速度竞赛:谷歌与OpenAI为开发者推出新解决方案

8月13日,一场双重发布为生成式AI的发展指明了新方向。谷歌发布了Gemini 3.7 Flash模型,而OpenAI则为其GPT-5.6 Sol推出了Ultrafast模式。两家公司显然都将重点放在速度和效率上,这对于代码相关任务和自主AI代理至关重要。
Gemini 3.7 Flash的新特性
谷歌将Gemini 3.7 Flash定位为编程和业务流程自动化的主力工具。开发人员声称在多阶段规划、指令遵循准确性和代码生成质量方面有显著改进。同时,公司采取了激进举措:使用成本较上一版本初始价格降低了一半。这使得该模型对大规模生产负载极具吸引力。

Flash系列最初被设计为响应速度与质量同等重要的场景解决方案。这包括编码、AI代理工作以及任何涉及对模型进行多次连续调用的任务。提醒一下,7月份发布的Gemini 3.6 Flash定价为每百万输入token 1.5美元,每百万输出token 7.5美元。当时公司还报告称,新模型比其前代产品少消耗17%的输出token。
然而,在这些发布背后,旗舰版Gemini 3.5 Pro的问题仍悬而未决。该模型至今尚未公开发布,开发人员仅与选定合作伙伴进行测试。具体的发布时间仍不明朗,这为市场增添了悬念。
OpenAI如何加速GPT-5.6 Sol
OpenAI则为其GPT-5.6 Sol推出了Ultrafast模式。公布的指标令人印象深刻:运行速度比标准模式快达14倍,每秒可生成多达750个输出token。这种加速的秘诀在于使用了Cerebras的基础设施,该公司专注于超快AI芯片。
在初始阶段,Ultrafast将通过API向有限客户群体开放。这是合理的步骤:OpenAI需要测试负载并扩展计算能力。随着算力的增长,访问权限将向更广泛的受众开放。每秒750个token的指标早在6月GPT-5.6发布时就曾被提及。当时开发人员警告说,基于Cerebras的加速版本将分阶段部署。
在此背景下,还应提及SpaceXAI 8月份发布的Grok 4.6,该版本侧重于长期代理任务和编程。在“快速”模型细分市场中的竞争正在加剧,这对市场来说是个好消息。
我的分析:这两项发布都印证了2026年的关键趋势——焦点从“智能”模型转向“快速且廉价”的模型。对于Web3开发者和DeFi协议而言,这意味着运营成本降低,并有机会创建更复杂的实时运行的代理。Gemini 3.7 Flash价格减半不仅仅是营销手段,而是直接试图抢占企业级开发市场份额,在该领域中每token的价格往往是决定性因素。