以R1和V4等先进模型闻名的中国AI初创公司DeepSeek,正朝着垂直整合迈出果断一步。据我所知,该公司已投入约一年时间研发自有处理器,专用于推理阶段——即模型执行而非训练环节。考虑到当前地缘政治现实及美国出口限制,这是一项具有战略意义的举措。
该研发项目尚处于初期阶段。DeepSeek正积极与芯片设计、代工生产及存储领域的外部合作伙伴展开协作。近几个月来,该公司以非公开方式招募芯片设计工程师,这证实了其意图的严肃性。尽管DeepSeek尚未发布官方声明,但内部消息显示该项目已进入与关键供应商积极磋商的阶段。
此举直接源于对英伟达和华为的依赖。此前DeepSeek曾使用英伟达H800训练R1模型,但随后将重心转向华为昇腾芯片,并为其适配了V4和V4-Flash模型。然而,自研硬件不仅能赋予公司独立性,还可针对独特算法优化架构,这对降低成本、提升性能至关重要。
这一动向正值推理解决方案需求激增与出口管制趋严之际。DeepSeek创始人梁文锋早在2024年就将芯片限制列为主要挑战之一。如今该公司正试图自主解决该问题,与OpenAI、博通、Anthropic、阿里巴巴及百度等巨头一同加入自建AI基础设施的竞赛。
然而项目成功并非板上钉钉。竞争异常激烈,需要巨额投资,且接触先进海外代工厂的渠道受限。尽管如此,DeepSeek已展现出创新能力——其开发的自主编程工具Code Harness,正对Anthropic的Claude Code和OpenAI的Codex构成挑战。若该公司能突破技术与物流壁垒,或将彻底改变AI芯片市场的力量格局。
分析结论:打造自研芯片对DeepSeek而言是合乎逻辑但风险并存的一步。成功不仅取决于工程人才,更取决于规避制裁限制的能力。若项目落地,DeepSeek将成为少数能在推理领域与英伟达平起平坐的参与者。这一事件可能触发AI基础设施领域新一轮去中心化浪潮。