开源模型这周挺热闹。小米、华为、英伟达几乎同时出手,方向一点不撞:一个拼网页开发,一个把训练全链路代码交出来,一个专攻语音识别。开源阵营的比拼,现在落到谁能解决具体问题上。
小米的MiMo-V2.6-Pro在Arena.ai的Code Arena: WebDev测评里首次亮相就冲进总榜前十,MIT许可证开源权重模型里排到前三。早期自动评估拿到1628分,和Claude Fable5(High)打平。这是个全模态模型,网页开发这种硬指标上能和闭源第一梯队掰手腕。开源模型的代码能力,追赶的阶段算是过去了。
华为走的是另一条路。openPangu-2.0把预训练、SFT和后训练RL代码整套开源上线,等于把"怎么做"也一起交出去了。盘古是华为的开源AI模型品牌,主打昇腾原生训练与推理,目的很直接:让业界有一套能照着用的昇腾实践参考。
英伟达盯上了语音。9月27日发布的Nemotron3Diarization只有约1亿参数,免费开放权重,专门做语音分割与聚类。它能实时判断任意时刻是谁在说话,最多支持8人同时发声。在VoiceArena v1基准上错误率14.72%,拿下第一,比第二名高出一大截。
三条路线各有各的算盘。小米证明开源能打性能榜,华为在补工具链和生态,英伟达用轻量模型切细分场景。开发者能直接上手的东西,确实变多了。