速度竞赛:谷歌与OpenAI推出新一代编程与智能体AI解决方案

8月13日,科技巨头几乎同时更新了各自的AI产品线。谷歌发布了Gemini 3.7 Flash,而OpenAI则宣布了GPT-5.6 Sol的Ultrafast模式。这两项开发都瞄准了同一个细分市场——与代码生成和AI代理工作相关的高速任务执行。这并非巧合,而是向市场发出的明确信号:性能和延迟之战正进入新阶段。
Gemini 3.7 Flash的新特性
谷歌将Gemini 3.7 Flash定位为编程和业务流程自动化的主力工具。该公司声称在多阶段规划、指令遵循和代码生成质量方面有显著改进。值得注意的是,该模型的使用成本相比上一版本上市之初的价格已降低一半。
Flash系列历来是为响应速度至关重要而不仅仅是深度至关重要的场景而设计的。这包括编码、自主代理的工作以及需要多次连续调用神经网络的场景。7月,谷歌发布了Gemini 3.6 Flash,价格为每100万输入令牌1.5美元,每100万输出令牌7.5美元。该模型在输出令牌使用效率上比3.5 Flash高出17%。
然而,旗舰版Gemini 3.5 Pro至今尚未公开发布。目前,开发者正在与有限的合作伙伴进行测试,确切的发布时间仍不得而知。这增添了悬念:虽然谷歌专注于预算模型的速度,但高端市场仍未得到更新。
OpenAI如何加速GPT-5.6 Sol
OpenAI则走了硬件加速的路线。GPT-5.6 Sol的新Ultrafast模式运行速度比标准模式快14倍,每秒可输出多达750个令牌。这是通过使用Cerebras的基础设施——专为大型语言模型优化的专用芯片——实现的。
在推出之初,Ultrafast仅通过API向有限数量的客户开放。OpenAI计划随着计算能力的增强逐步扩大访问范围。该公司在6月宣布GPT-5.6时就已经提到了每秒750个令牌的指标,并警告说加速版本最初不会对所有人开放。
提醒一下,8月SpaceXAI还推出了Grok 4.6——一款专注于长期代理任务和编程的旗舰模型。这一细分市场的竞争正变得越来越激烈。
我的分析:我们正在目睹行业的一个根本性转变——竞争正从单纯的回答质量转向推理速度和成本。Gemini 3.7 Flash价格减半是对开源模型压力的直接回应,而每秒令牌数的竞赛则是试图占领实时市场,在那里AI代理将以实时模式执行交易和编写代码。未来几个月,我们将看到API价格更加激进的降价竞争。