Perplexity为其本地AI代理Perplexity Computer推出了新型编排模型的研究版本。该系统基于GLM 5.2——中国公司Z.ai(原智谱AI)的开源模型,该模型经过专门微调,适用于Computer的代理环境。
不牺牲质量的经济性
新架构的核心优势在于大幅降低成本。正如Perplexity所指出的,经过适配的GLM 5.2在性能上"接近前沿水平",而成本仅为使用Opus的0.344倍。这并非完全取代顶级模型,而是一种混合方案:GLM 5.2承担大部分请求,必要时通过内置的顾问工具将复杂任务传递给更强大的模型。
Perplexity首席执行官阿拉温德·斯里尼瓦斯强调,在与顾问工具配合使用时,该系统性能达到Opus 4.8的水平,但成本显著降低。这使得该方案对商业用途尤其具有吸引力,因为每一次查询都至关重要。
技术细节与地缘政治背景
GLM 5.2拥有约7440亿个参数,采用MIT许可证发布,允许开发者自由下载、修改和微调模型,不受封闭API常见的限制。Perplexity将适配版本部署在美国自有基础设施上,从而减少对外部API的依赖,并对后训练、路由和任务执行层拥有完全控制权。
这一方法在地缘政治紧张背景下尤为引人关注。Z.ai自2025年1月起被列入美国实体清单,但Perplexity使用该模型并非作为政治工具,而是作为其代理系统的经济层。目标是在不完全放弃前沿模型的前提下降低运行成本。此前,该公司已对DeepSeek R1采用类似策略,发布了适配版本R1-1776。
下一步计划?
Perplexity Computer作为代理系统运行,协调超过19个模型。适配后的GLM 5.2将成为大多数任务的低成本基础层。该公司表示,下一步将对Nemotron 3 Ultra进行后训练——这是另一款用于Computer的开源模型。新系统的完整基准测试结果预计将在未来几周内公布。
专家评论:Perplexity此举是开源模型开始在AI代理领域取代昂贵专有解决方案的鲜明例证。带有任务升级机制的混合架构不仅是节约成本,更是一种新范式——效率通过智能负载分配实现,而非单纯追求原始计算能力。如果基准测试证实所宣称的性能,我们将看到其他参与者纷纷效仿此类解决方案。