速度竞赛:谷歌与OpenAI推出新一代人工智能解决方案

人工智能市场持续动荡:8月13日,两大科技巨头同时推出了针对同一细分领域的更新——面向开发者和AI代理的超快速任务处理。谷歌发布了Gemini 3.7 Flash,而OpenAI则宣布为其旗舰模型GPT-5.6 Sol推出Ultrafast模式。这不仅仅是进化,更是一个明确的信号,表明行业正朝着速度和效率的方向发展,而不仅仅是原始算力。
Gemini 3.7 Flash的新特性
谷歌将Gemini 3.7 Flash定位为编程和业务流程自动化的主力工具。关键改进涉及多阶段规划、精确遵循指令和代码生成。然而,最引人注目的是价格:该公司宣布使用成本较上一版本的首发价降低了一半。这是一个激进的举措,考虑到Flash系列本就面向响应速度至关重要的场景:编码、代理工作以及需要多次连续调用模型的任务。
提醒一下,7月份发布的Gemini 3.6 Flash定价为每100万输入token 1.5美元,每100万输出token 7.5美元。当时公司还报告称,新模型比3.5 Flash减少了17%的输出token消耗。与此同时,许多人期待的旗舰版Gemini 3.5 Pro仍未公开发布——开发者仍在与合作伙伴进行测试,发布时间表依然不明朗。
OpenAI如何加速GPT-5.6 Sol
OpenAI做出了对称但侧重点不同的回应。据该公司称,GPT-5.6 Sol的Ultrafast模式可将生成速度提升至每秒750个输出token——比标准模式快达14倍。秘诀在于使用了专注于超高速计算的Cerebras基础设施。然而,在启动阶段,只有有限的客户能通过API获得Ultrafast访问权限,OpenAI承诺随着计算能力的提升逐步扩大访问范围。
每秒750个token的指标并不新鲜——早在6月份GPT-5.6发布时就已提及。当时也已明确Sol将在Cerebras上运行,但附带逐步接入用户的说明。现在这一计划开始落地。在此背景下,还应提及SpaceXAI在8月发布的Grok 4.6——一款专注于长期代理任务和编程的模型。竞争已白热化。
我的分析:这两项公告都印证了“小而快”模型的趋势,这些模型能够实时运行。谷歌的降价和OpenAI的极致速度是解决同一问题的两种不同路径:让AI能够支持大规模自动化。短期内,谁能提供更好的价格与响应延迟平衡,谁就能胜出,尤其是在代理解决方案领域,每多一毫秒的延迟都意味着金钱的损失。