最近大模型赛道又卷起来了。字节和讯飞动作不断。字节Seed部门刚搞完一波大调整,新设了四个一级部门,把预训练数据、强化学习和后训练资源全捏到一块儿,B端和C端产品直接分家。说白了,这波折腾主要为了撑起新Omni模型,李成刚带队统管文本、编程等多模态数据。另一边,科大讯飞也放话了,今年1024开发者节要正式掏出基于全国产算力的主力通用大模型。8月底先放个阶段性版本给大家尝鲜。
架构重组的同时,推理效率也在狂飙。Liquid AI跟Hugging Face联手推出LFM2.5系列DSpark草稿模型,涵盖1.2B到8B三款。实际上,这模型用了全新的投机解码路径。输出质量没掉,GPU端推理速度却最高飙升3.18倍,连端侧设备都明显快了不少。学术界也没闲着,多模型异构系统开始靠路由分配查询来提效。问题直接甩给最擅长的专家模型,质量和效率双拉满。
大厂在底层死磕,市面上也不缺黑马。最近一个神秘的“牛来”大模型直接刷屏,主打限时免费,搅起了一波试用热潮。从字节重构组织、讯飞押注国产算力突围,再到推理提速和多模型路由,这行业早就不玩单纯拼参数那套了。现在大家拼落地,拼成本,拼效率。谁能让AI又快又便宜地跑起来,谁才算真赢了。