AI行业

大模型圈又卷了:字节重构团队,神秘Ox Alpha免费突袭

字节跳动Seed部门刚完成大换血,一口气新设了四个一级部门,全部向吴永辉汇报。李成刚这回是全面接盘——文本、编程、视觉、语音,所有预训练数据团队都归他管,专门给新Omni模型供血。B端和C端的产品模型能力直接拆开了,强化学习和后训练的资源也全部打通,这手笔不小。科大讯飞那边也没闲着,官宣10月24日开发者节要发布基于全国产算力的主力通用大模型,8月底先放个阶段性版本让大家试水,节奏安排得明明白白。

国内大厂在憋大招,神秘力量直接搞突袭。一个叫“Ox Alpha”的神秘模型悄悄上了OpenRouter,输入输出价格全写零,全网都在猜背后是智谱还是小米。说实话,这种多模型混战局面对路由技术反而是好事。arXiv最新论文提了个AI模型路由盒的思路——把查询直接扔给最擅长的那个专家模型,质量和效率都能大幅提升,唯一的毛病就是价值评估有点烧钱。说白了,这种异构AI系统才是未来降低推理成本的关键路径。

光拼参数大小已经没用了,推理速度才是硬通货。Liquid AI和Hugging Face联手甩出LFM2.5 DSpark草稿模型,一共三款:1.2B、2.6B、8B-A1B。用了全新的投机解码路径,输出质量一点不掉,GPU端推理最高飙升3.18倍。端侧设备也能明显加速,这对落地应用来说太香了。实际上大模型这仗打到现在,早就不是单纯卷参数了,拼的是组织架构、推理效率,还有实打实的落地成本。