AI大模型

大模型行业洗牌:字节重构、智谱反思、讯飞出新

字节跳动大模型部门Seed刚搞完组织架构调整,预训练、强化学习和Agent研发全给重构了。新拉了四个一级部门,Pretrain Data由李成刚挑头,把文本、编程、视觉、语音这些数据团队全捏合在一起,说白了就是给Omni模型铺路。可另一边呢?智谱首席科学家唐杰直接摊牌,承认千亿参数路线“走了弯路”。这还不是最惨的,股价两个月狂跌六成,8000亿市值说没就没。两家一进一退,实际上摆明了一件事:大厂们早就憋不住搞参数竞赛了,现在全在往实用落地上卷。

科大讯飞那边也没闲着,官宣要在1024开发者节甩出基于全国产算力的全新主力大模型。8月底先放个阶段性版本探探路,节奏抠得很死,直接对标主流能力。国外也爆出新活,Liquid AI拉上Hugging Face整出了LFM2.5 DSpark草稿模型系列。用的是投机解码路子,质量一点没掉,GPU端推理速度最高硬拉了3.18倍。连端侧设备都明显快了不少。大家现在不拼别的,推理效率成了新焦点。

更有意思的是,一个叫“Ox Alpha”的神秘模型直接突袭了OpenRouter。输入输出全免费,性能传闻已经超过了Fable 5。全网都在猜背后是智谱还是小米在操盘。信息虽然有限,但这套“免费+高性能”的打法够狠,指不定就要把定价格局搅个底朝天。大模型这赛道变数还大着呢。巨头们忙着调架构、思路线,新模型和效率突破还在往外冒。洗牌远没结束,好戏还在后头。