AI大模型

大模型赛道风云再起:字节重组、讯飞发新、推理飙升3倍

最近大模型圈可谓是一天一个样。字节这边的动静不小,Seed部门迎来大换血。预训练数据、强化学习还有模型后训练全被打散重组,新拉起四个一级部门,直接向吴永辉汇报。说白了,就是要把事儿管得更细。现在预训练数据这块由李成刚统一操盘,把文本、编程、视觉、语音这些团队全揉一块,专门去喂新Omni模型。B端和C端的模型能力也干脆拆开来搞。看这架势,字节是铁了心要在多模态和落地应用上两头狂奔了。

科大讯飞那边也放了大招。在业绩说明会上人家交了底:基于全国产算力的新主力通用大模型,定在今年1024开发者节正式发,8月底先拿个阶段性版本让大家摸摸底。纯国产算力这块又上了一个台阶,推进速度确实不含糊。

推理效率这块最近也挺闹腾。Liquid AI拉上Hugging Face甩出了一套LFM2.5 DSpark草稿模型系列,一共三款,从1.2B到8B-A1B不等。实际上,他们玩的是投机解码那套,硬是在不掉质量的前提下,把GPU端推理速度最高拉高了3.18倍。端侧设备的反应也跟着快了不少。另外有篇论文弄了个Pandora's AI Model Routing Box,搞了个路由分配机制,让不同模型各自干自己擅长的事,硬生生把异构系统的整体效率拽了上去。搞来搞去,大家其实都在想方设法压低使用成本。

对了,还有个神秘兮兮的“牛来”大模型这两天突然刷屏。来路不明,但靠着限时免费愣是吸引了一大波人。可见这市场已经卷成什么样了。回过头看,从巨头内部调兵遣将,到新秀排队发模型,再到变着法儿抠推理性能,大家都在拼命往实用化上冲。谁能让大模型最快落地变现,谁就能先吃到肉。