Perplexity为其代理平台Perplexity Computer推出了新型编排模型的研究预览版。该模型基于Z.ai公司开放的中国模型GLM 5.2,经过额外的后训练以适配代理环境。这并非普通的AI发布,而是一个经过深思熟虑的举措,旨在降低运营成本的同时保持质量。
核心创新在于混合架构。GLM 5.2负责处理大部分常规查询,当达到自身能力极限时,会自动将任务转交给更强大的顾问模型。据Perplexity数据,这种组合在性能上可媲美Opus 4.8,而成本仅为基准模型的0.344倍。在分毫必争的行业中,这构成了显著的竞争优势。
该系统已以研究预览形式开放。公司承诺将在未来几周内公布完整的基准测试结果。需要明确的是:这并非要完全取代顶级模型。GLM 5.2是一个经济高效的基础层,能够在Perplexity Computer框架内实现19个模型之间的负载分配。
地缘政治层面同样值得关注。Perplexity使用了Z.ai公司的中国开放模型,该模型自2025年1月起被列入美国实体清单。但该公司将适配版本部署在美国本土基础设施上,完全掌控后训练和路由层。这降低了对外部API的依赖,并实现了对任务执行的完全控制。此前Perplexity已对DeepSeek R1采用类似策略,发布了去除审查限制的适配版本R1-1776。
GLM 5.2包含约7440亿参数,采用MIT许可证发布,允许开发者自由修改。Perplexity表示下一步将对Nemotron 3 Ultra进行后训练——这是另一款用于Computer的开放模型。
专家观点:Perplexity展现了构建代理系统的成熟思路。该公司并未完全依赖昂贵的专有模型,而是巧妙地将开放解决方案作为经济基础,同时保留对关键层的控制权。这不仅是成本节约,更是对API供应商的战略独立,为代理计算在实体领域的规模化应用奠定了基础。