阿里巴巴纪录:开源模型Qwen下载量突破30亿次

中国科技巨头阿里巴巴达到了一个令人瞩目的里程碑:其开源AI模型系列Qwen在过去半年中的累计下载量已超过30亿次。这一数据彰显了市场对中国神经网络模型的巨大需求,并标志着全球开源人工智能力量平衡的重要转变。
截至目前,该公司已公开发布超过460个模型,第三方开发者基于这些模型创建了约30万个衍生解决方案。这使得Qwen生态系统成为行业内规模最大、发展最活跃的生态系统之一。
Hugging Face数据:生态系统中的主导地位
在阿里巴巴发布声明之前,Hugging Face平台发布的分析揭示了这一成功的本质。今年前七个月,Qwen模型被下载了20.5亿次,衍生仓库数量达到151,448个。相比之下,其最接近的美国竞争对手——谷歌——同期表现则逊色得多:衍生仓库82,506个,下载量4.18亿次。Meta的模型更是落后,下载量仅为2.27亿次。
需要强调的是,Hugging Face的统计数据仅涵盖其自身生态系统内的活动,不包括API请求和私有企业部署。因此,Qwen的实际传播规模可能更高。
特别值得关注的是本地部署领域(GGUF转换)。在此方面,Qwen同样稳居领先地位:每月下载量3960万次,而Gemma为2080万次,Llama为750万次。值得注意的是,在平台上28,531个Qwen GGUF构建中,仅有54个由阿里巴巴自己创建——其余均由活跃的社区生成,这证实了这些模型已深度融入全球开发者的日常工作中。
成功秘诀:规模化战略与开放性
Qwen的优势地位源于三个关键因素:模型系列的定期更新、覆盖所有规模的前所未有的广度——从参数不足10亿的紧凑版本到庞大的Qwen3.8-Max(2.4万亿参数)——以及Apache 2.0许可证,该许可证消除了对修改和商业使用的所有限制。
模型系列的广泛性成为决定性因素。根据Hugging Face的数据,参数少于10亿的模型占平台历史总下载量的83%,而巨型神经网络(超过1000亿参数)的占比仅为1%。专注于大型LLM的实验室正在落败:Moonshot AI几乎不发布小于700亿参数的模型,一年仅积累了3700万次下载——约为Qwen的五十五分之一。
开源AI的地缘政治
该报告还记录了力量平衡的转移。今年几乎每个月,来自中国最大的开源模型在规模上都超过所有美国发布。中国模型的上限在7540亿至2.78万亿参数之间波动,而美国竞争对手在七个月中有五个月的上限未超过1300亿。
关键差异在于许可政策。在中国,59%的参数超过200亿的模型以Apache 2.0发布,22%以MIT发布,且没有任何一个对商业应用有限制。美国开发者的情况则相反:仅有29%采用开源许可,41%采用专有条款,30%完全没有指定许可证。值得注意的是,在美国,新开源模型数量最多的并非AI实验室,而是芯片制造商——AMD和Nvidia,各自发布了超过200个仓库。
我的评论:阿里巴巴的战略是抢占开源AI市场的经典范例。通过押注可及性和灵活性,该公司不仅增加了下载量,还在为全球开发者塑造事实标准。美国实验室常常将其最佳成果隐藏在专有许可之后,它们将不得不重新审视自己的战略,否则可能在这场竞赛中彻底失去主动权。