Perplexity为其本地AI代理Perplexity Computer推出了新编排模型的研究版本。该模型是中国智谱AI(Z.ai,原Zhipu AI)旗下GLM 5.2的适配版本,经过微调后可在Computer代理环境中运行。这并非简单的模型集成,而是一项可能彻底改变AI代理经济格局的战略举措。
公司核心声明:该模型在性能接近前沿水平的同时,成本仅为Claude Opus的0.344倍。但不应将其视为直接替代方案。实际采用的是混合架构:GLM 5.2承担大部分查询任务,当达到其能力上限时,会接入更强大的"顾问"模型。据Perplexity首席执行官阿拉温德·斯里尼瓦斯透露,在该顾问模型的配合下,系统性能可达Opus 4.8水平,而成本却大幅降低。
Perplexity Computer作为代理系统运行,在多个AI模型间分配任务。该产品协调管理超过19个模型,适配版GLM 5.2旨在成为大多数任务的低成本基础层。核心组件是顾问工具(advisor tool),用于判断何时需要将任务升级至更强大的模型。这不仅是优化,更是构建多层架构——每个层级各司其职,兼顾能力与成本。
GLM 5.2是采用MIT许可证的开源模型,拥有约7440亿参数。这赋予开发者充分的微调和商业使用自由,不受闭源API的典型限制。值得注意的是,尽管智谱AI自2025年1月起被列入美国实体清单,但Perplexity将适配版本部署在美国自有基础设施上。此举降低了对第三方API的依赖,使公司能完全掌控后处理、路由和任务执行层。
该公司此前已对DeepSeek R1采用类似策略,推出移除中国审查相关拒绝机制的R1-1776适配版。但在GLM 5.2案例中,重点从政治中立转向纯粹的经济效益——该模型被用作代理系统的经济层。Perplexity表示下一步将对Nemotron 3 Ultra进行后训练,表明其正系统性地构建自有模型栈。
Cryptalist分析评论: Perplexity此举堪称务实工程的典范。他们并未追逐"最佳"模型,而是构建混合系统,让低成本但性能足够的模型承担80-90%的任务以节省资源。这或将成为行业标准:未来不属于单一模型,而属于懂得何时为"高端服务"付费、何时节省成本的智能编排系统。对于每笔交易和计算资源都需精打细算的加密与区块链项目而言,这种路径正是通向可扩展去中心化AI代理的捷径。