DeepSeek向Anthropic发起挑战:开放Harness及最终版V4 Pro,并推出新定价方案

中国实验室DeepSeek再次重塑AI开发市场格局,一次性推出了两款重要产品。这分别是用于创建AI代理的开放环境Harness v0.1,以及旗舰模型V4 Pro的最终版本。这不仅仅是增量更新,而是一项战略举措,旨在与Anthropic生态系统及其广受欢迎的工具Claude Code直接竞争。
Harness:代理开发的新理念
关键创新在于以MIT许可证发布的Harness框架。与传统方法中模型仅生成代码片段不同,Harness作为LLM之上的一个完整的“薄层”运作,赋予代理自主与代码库、终端和外部服务交互的能力。这一架构决策将模型从被动生成器转变为主动执行者,能够构建长而复杂的操作链。
需要强调的是,Harness并非定位为高度专业化的工具,而是一个极简且灵活的框架。开发者可以将自己的模型接入其中,并针对特定工作流程进行适配。据我所知,正是这一环境被用于在公开基准测试中对V4 Pro的代理能力进行内部测试,这表明公司对自身框架的高度信任。
V4 Pro:押注代理能力与兼容性
DeepSeek V4 Pro的最终发布标志着性能上的重大飞跃。该模型原生支持OpenAI Responses API,并与Codex集成,使其对于已使用OpenAI基础设施的团队来说几乎是无缝替代。灵活的三模式推理系统(low、high、max)允许开发者根据任务在速度和分析深度之间取得平衡。
公布的测试结果令人印象深刻:Terminal Bench 2.1得分87.9,DeepSWE得分62.7,Toolathlon-Verified得分74.1。这些数字表明,DeepSeek不仅在追赶,而且在代理AI领域某些方面已超越西方竞争对手,尤其是考虑到其开源性。
定价政策调整
伴随此次发布,DeepSeek宣布转向采用高峰和非高峰时段的动态定价模式。实际上,这意味着在最大负载时段成本将翻倍,该政策将于8月16日起生效。尽管如此,与OpenAI和Anthropic的报价相比,价格仍极具吸引力,使DeepSeek保持高性能模型最实惠提供商的地位。
我的分析:发布Harness远比表面看起来更为精妙。DeepSeek不仅仅是在创建Claude Code的替代品,而是在V4 Pro周围构建一个完整的生态系统。开源代码和与OpenAI API的兼容性是强大的催化剂,能促使寻求摆脱特定供应商依赖的开发者迁移。从长远来看,正是“模型+开放代理环境”的组合可能成为DeepSeek争夺开发者心智和预算的关键优势,尤其是在对Big Tech封闭政策和定价日益不满的背景下。