Perplexity团队为其本地代理Perplexity Computer发布了新型编排模型的研究版本。该系统基于中国Z.ai(原智谱AI)的开源模型GLM 5.2,并经过后训练以适配Computer代理环境。其核心特性在于混合架构:GLM 5.2承担主要查询处理任务,当达到自身能力上限时,会将任务升级至Opus等更强大的模型。

接近前沿解决方案的效率

Perplexity声称,微调后的GLM 5.2版本展现出接近旗舰模型的性能,但成本仅为使用Opus的0.344倍。配合"顾问"工具(用于判断升级时机的专用组件),该系统能以Opus 4.8的水平运行,同时大幅降低开销。这不是简单的替代,而是智能资源分配:用低成本基础层处理常规任务,仅在复杂场景下启用重型模型。

技术细节与架构

GLM 5.2是一款拥有约7440亿参数的开源模型,采用MIT许可证发布。这使Perplexity能够完全自由地进行微调和商业使用,不受闭源API的典型限制。Perplexity Computer代理系统协调着超过19个模型的工作,而适配后的GLM成为大多数任务的经济基础。关键组件是顾问工具,它分析查询复杂度并决定何时需要调用更高性能的模型。

地缘政治背景与战略

值得注意的是,Perplexity使用了中国模型,但将适配版本部署在美国自有基础设施上。这降低了对第三方API的依赖,并使其能完全控制后训练、路由和执行层。自2025年1月起,Z.ai已被列入美国实体清单,但Perplexity通过使用模型的开源权重规避了限制。此前该公司曾采用类似方法处理DeepSeek R1,发布了去除审查的适配版本R1-1776。在GLM 5.2案例中,重点完全转向经济效率,而非政治中立化。

专家结论

Perplexity此举是开源模型成为构建混合型、高性价比代理系统基础的典型案例。我认为"低成本基础层+旗舰模型升级"策略是AI代理的未来,尤其是在顶级模型成本居高不下的背景下。下一步将是适配Nemotron 3 Ultra,这将进一步巩固Perplexity在自主代理竞赛中的地位。