(文/赖家琪 编辑/吕栋)
在日前发布的最新一期《开放模型现状:2026年夏季观察》报告中,全球知名人工智能(AI)开源社区“抱抱脸”(Hugging Face)发现,中国AI企业在开放模型领域快速崛起,部分模型正成为美国千亿级参数大模型的重要底座。
Hugging Face对1月至8月初在其平台上发布的开放模型进行了分析。分析显示,在此期间,该平台上的公共模型仓库数量从243万个增至296万个,其中最引人注目的变化是中国AI企业在开放模型领域的快速崛起。
“在2026年的几乎每个月,中国实验室发布的最大、性能最高的开源模型都超过了美国实验室发布的模型。”报告称,中国团队开源模型的月度最大参数规模介于7540亿至2.78万亿之间,相比之下,美国团队在过去7个月中有5个月公开的模型最大规模都低于1300亿参数。
Hugging Face
报告特别提到,月之暗面、MiniMax、小米和智谱几乎不再发布参数规模低于700亿的模型,小米和美团今年均发布了参数规模超过1万亿的模型,而就在一年前,它们在开放权重模型领域还并没有广为人知。
Hugging Face认为,这一变化一方面是因为单纯打造大模型本身已经不再构成明显差异化优势,另一方面则得益于社区量化技术的发展,使得大型模型在发布后仅需数天便能够在本地运行,从而为这种“大模型优先”的策略创造了条件。
与此同时,腾讯、阿里巴巴的通义千问大模型则采取了另一种模式,从参数规模不足10亿的小模型一直覆盖到超大规模模型。
Hugging Face将这两类路线分别概括为不同的商业策略:前者,即专注于大型模型的企业,主要瞄准模型排行榜和API需求;后者则希望打造开发者默认使用的“模型家族”。
从总下载量来看,两种策略的差异十分明显。月之暗面模型下载量为3700万次,而覆盖不同参数规模的Qwen模型下载量达到20.45亿次,约为前者的55倍。
美国企业方面,美国超威半导体公司(AMD)和英伟达是今年发布新开放模型数量最多的公司,两家公司发布的模型均超过200个。
尽管美国企业也推出了参数规模超过1000亿的大模型,例如英伟达新一代开源大模型Nemotron 3 Ultra,但Hugging Face注意到,一些美国开发的模型实际上是以中国模型为底座,或者利用了中国实验室公开的研究成果,比如思维机器实验室的Inkling(952B)。
在模型许可证方面,中国团队同样表现出相对较高的开放程度。
报告统计,今年发布的、参数规模超过200亿的178个中国模型中,59%采用Apache 2.0许可证,22%采用MIT许可证(两者核心区别在于Apache 2.0增加了明确的专利授权以及对修改文件的声明要求,而MIT则极其短小精悍、几乎没有限制)。DeepSeek和智谱甚至以MIT许可证公开了参数规模在7000亿至1.65万亿之间的大模型。
相比之下,美国同等模型的授权方式更加分散,仅有29%采用Apache或MIT许可证,41%采用自定义条款,另有30%没有注明许可证。
Hugging Face认为,开放模型带来的商业收益并不主要来自许可证收费,而是来自API、云服务、硬件以及平台等业务。智谱和kimi的估值表明,有效的开源战略也能在社区中获得广泛的认可和增长机会。
报告还单列一节特别指出,Qwen正逐渐成为开源社区“事实上的基础模型”。目前,Hugging Face Hub上基于Qwen开发的衍生模型超过15.14万个,是Meta全部模型衍生品数量的2.6倍,若仅比较Llama相关模型,Qwen的衍生模型数量甚至达到其4.7倍。
Hugging Face
2026年前7个月,Qwen衍生模型每天增加约180至210个。这表明其普及并非仅由单个模型的发布所驱动,而已事实上成为开发者在微调和部署时的默认工作流的一部分。
Hugging Face认为,这一结果得益于Qwen团队定期发布新模型、覆盖广泛的参数规模,以及Apache 2.0许可证带来的较低使用门槛。
而拥有广泛的模型家族和应用普及程度非常重要,这有助于在开发者、模型发布方和未来用户之间形成良性反馈循环,能嵌入基础设施并成为生态系统一部分的模型,最终可能找到一条具有商业可行性的成功路径。
上一篇:AI玩上头了?集体保持Q弹
下一篇:顶尖 AI 人才,不敢结婚