加密新闻

14.08.2026
08:10

速度竞赛:谷歌与OpenAI推出新一代AI解决方案

机器人之战,AI 战斗

8月13日,人工智能市场遭遇双重打击:谷歌发布了Gemini 3.7 Flash模型,而OpenAI则推出了GPT-5.6 Sol的革命性Ultrafast模式。这两项开发都瞄准了关键领域——与编程和自主AI代理相关的高速任务执行。

Gemini 3.7 Flash:押注效率与成本节约

谷歌的新模型定位为企业部门和开发者的“主力军”。关键改进涉及多阶段规划、精确遵循指令和代码生成。然而,最引人入胜的方面是价格的急剧下降:使用成本相比上一版本价格减半。

Flash系列传统上覆盖延迟至关重要的场景:包括编码、代理管道以及需要多次连续调用模型的任务。提醒一下,7月份发布的Gemini 3.6 Flash定价为每百万输入令牌1.5美元,每百万输出令牌7.5美元。当时,公司还报告称,与3.5 Flash相比,输出令牌消耗减少了17%。

值得注意的是,旗舰版Gemini 3.5 Pro目前仍处于与合作伙伴的封闭测试阶段,其公开发布时间表仍不明朗。这造成了有趣的失衡:谷歌显然押注于大众市场,而非高端模型。

OpenAI Ultrafast:基于Cerebras每秒750个令牌

OpenAI以自身的王牌回应——GPT-5.6 Sol的Ultrafast模式。宣称的性能令人印象深刻:相比标准版本最高加速14倍,每秒生成多达750个输出令牌。技术基础是专门从事巨型硅晶圆的Cerebras基础设施。

在启动阶段,通过API访问Ultrafast的将仅限于一小部分客户。这是一个深思熟虑的举措:OpenAI将分阶段增加计算能力,逐步接入新用户。值得注意的是,每秒750个令牌的数字在6月份的GPT-5.6公告中就已出现,但当时公司警告称,对加速版本的访问将不均衡。

竞争背景因SpaceXAI 8月份发布的Grok 4.6而加剧,该版本专注于长期代理场景和交互式应用。

我的分析:我们正在目睹竞争格局的巨变——从答案质量转向获取答案的速度。谷歌Flash模型的降价和OpenAI激进的超快模式,是开源模型压力的直接结果。然而,每秒750个令牌不仅仅是营销:这样的性能为实时代理开辟了道路,它们能够与用户互动而无需明显延迟。问题只在于,Cerebras能否足够快地扩展以普及这项技术,还是超高速仍将只是少数企业客户的特权。