AI大模型

中国开源AI模型火出圈:Qwen衍生超15万,华为昇腾秒适配

最近中国开源AI在海外确实火得离谱。看Hugging Face的最新数据就知道了,基于Qwen搞出来的衍生模型已经超过15.1万个,老大哥的位置坐得稳稳的。海外那帮开发者也够拼的,拿着Qwen3.8-27B疯狂折腾,从底层能力到工程细节,基本上快被榨干了。说白了,这模型确实好用。

硬件这边华为昇腾也没闲着。8月14日小红书刚甩出那个2800亿参数的MoE多模态大模型dots3-note preview,当天昇腾的Atlas 800 A3和Atlas 900 A3 SuperPoD就搞定了全量适配。速度够快吧?实际上,这套基于vLLM Ascend推理引擎的方案,不仅能吃下文本、图片和音频多模态输入,还硬塞进去了通信优化、MoE算子融合和MTP投机解码,就是为了把延迟死死压下去。

更有意思的事在后面。过去7个月,连美国开源圈都开始跟中国“抄作业”了。那些动辄千亿参数的巨无霸,下载量才占1%,大家真正拿来跑的其实是小模型。中国团队早把这事儿看透了,走实用主义路线不搞花架子,效果明摆着。

所以你看,从Qwen衍生生态的全面爆发,到华为硬件那种0 Day级别的适配速度,再到老外们凑热闹般积极参与,中国开源AI算是彻底跑通了正向循环。道理很简单,东西够硬,态度够敞亮,开发者自己就会找上门来。