AI大模型

开源模型生态剧变:华为0天适配,小模型成新宠

Hugging Face最近搞了个开源生态半年分析,结果挺有意思。开发者基于Qwen创建的衍生模型已经超过15.1万个,远甩其他系列一条街。Qwen直接成了开放模型生态的领跑者。说白了,这个数字说明开源社区很认可Qwen的架构,也反映出中国开源模型在全球的吸引力正在快速上升。

8月14日,小红书发布了开源多模态大模型dots3-note preview。华为当天就宣布,昇腾Atlas 800 A3和Atlas 900 A3 SuperPoD已经完成全量适配。这个模型采用MoE架构,总参数2800亿,但激活参数只有160亿,支持文本、图片和音频输入。华为通过vLLM Ascend开源推理引擎,加了通信优化、MoE算子融合和MTP投机解码,大幅降低了Token生成延迟,提升了推理吞吐。这种“发布即0 Day适配”的节奏,说白了,展现了中国芯片与模型生态的紧密协同能力。

不过,开源模型的热点已经变了,从大模型转向了小模型。过去7个月,1000亿参数以上的开源模型下载量只占1%,倒是几十亿到百亿参数的小模型抢走了大部分机会。实际上,美国开源社区甚至开始向中国“抄作业”,Qwen、dots3这些系列成了全球开发者的重点关注对象。小模型在推理成本、部署灵活性上更有优势,正在成为企业AI落地的实用选择。

海外开发者社区也在不断挖掘小模型的极限,比如Qwen3.8-27B,从模型能力到工程优化都被持续“榨干”。这种社区驱动的优化让小模型的能力不断进化,部分任务上甚至能媲美大模型。说白了,开源模型生态正在从“拼参数”转向“拼实用”,更注重实际落地效果。