中国AI开源领域迅速发展,助推美国大模型基础架构

2026-08-17 1527

中国的人工智能行业在开源模型的竞争中迅速崛起,成为美国大型模型的核心基础。在最新发布的《开放模型现状:2026年夏季观察》报告中,全球知名的开源社区“抱抱脸”(Hugging Face)指出,预计到2026年,中国实验室发布的表现最佳的开源模型在数量和参数规模上,将超越美国实验室。报告分析了1月至8月初在其平台上发布的开放模型数据,发现该平台的公共模型数量从243万个激增至296万个,中国企业在这一领域显示出强劲的增长势头。

about image

报告中提到,中国团队的开源模型在2026年的每个月都将展示出高参数规模,达到7540亿至2.78万亿。而相比之下,美国团队在过去半年的时间里,5个月的模型最大参数都低于1300亿。更进一步,模型发布者如月之暗面、MiniMax、小米和智谱几乎停止了低于700亿参数规模的模型发布,其中小米和美团在今年发布的参数规模均超过1万亿,显示出其在开源领域的新崛起。

about image

这一转变的原因,一方面在于单纯的模型规模已经不足以形成明显差异,另一方面得益于社区在量化技术上的进展,这使得一个大型模型在发布后只需数天便可在本地部署,从而为“大模型优先”策略打下基础。同时,腾讯和阿里巴巴的通义千问大模型则采用了从小模型到超大模型的多层次策略,Hugging Face将这分为两种商业路径。

从下载量的表现来看,两者的差异明显。月之暗面模型的下载量为3700万次,而Qwen模型的下载量高达20.45亿次,几乎是前者的55倍。在美国,AMD和英伟达是发布新开放模型最活跃的企业,尽管他们推出的部分模型参数规模超越1000亿,但有些其实是基于中国模型的底层成果。

在模型的开源许可方面,中国团队表现出了较高的开放性。今年发布的178个参数规模超过200亿的中国模型中,有59%采用Apache 2.0许可证,22%采用MIT许可证,相较之下,美国的相同模型则较为分散,多数使用自定义许可。有鉴于此,Hugging Face指出,开放模型的商业利益主要来源于API、云服务和硬件,而非授权费用。

about image

报告特别提到,Qwen正逐渐成为开源社区的“事实基础模型”。基于Qwen开发的衍生模型数量超过15.14万个,显著高于Meta的所有模型衍生品。Qwen的普及速度也很快,每天增加的衍生模型数量在180到210之间,这显示出它在开发者群体中的广泛接受度。Hugging Face认为,这一现象与Qwen团队定期更新模型、覆盖多种参数规模以及更低的使用门槛密切相关,最终将促进开发者生态系统的良性循环。

推荐产品