字节跳动的大模型部门Seed最近动了大手术,新成立了四个一级部门,现在全归吴永辉管。底下人也换了分工。李成刚带着的Pretrain Data团队,把文本、写代码的、视觉、语音这些预训练数据全揉一块儿去了,专门给新的Omni模型喂料。B端和C端的产品模型这次彻底分开跑,强化学习跟后训练的资源也重新捏合到了一起。实际上,不光是字节在折腾组织架构。科大讯飞紧跟着放话,说2026年的1024开发者节要掏出基于全国产算力的主力通用大模型,8月底就能先出个体验版让大家尝鲜。国内这些大模型玩家,现在从内部排兵布阵到往外推产品,竞争的油门已经踩到底了。
光算力强还不够,推理效率现在成了大家抢破头的新战场。Liquid AI和Hugging Face一块儿甩出了LFM2.5 DSpark草稿模型,参数分了1.2B、2.6B和8B-A1B三档。这玩意儿用了投机解码技术,质量不打折,GPU端的推理速度最多能飙3.18倍。连手机这种端侧设备跑起来都明显轻快了。Pandora那边则弄了个AI模型路由盒,说白了,就是根据算算成本和价值,在多模型系统里自动派活儿,谁的性价比高就让谁上。调用大模型这事变得更聪明也更省钱了。这一波技术革新,等于直接把部署门槛给踹下去了,开发者偷着乐的功夫就省了不少事。
价格战自然也没落下。OpenAI直接发话了,未来三个月里,GPT-5.6 Sol的API和Credit价格全砍掉两成以上。如今大模型圈子的较量,早就过了光比谁参数大的阶段。现在拼的是排兵布阵的效率、推理跑得多快,还有调用一次得花几个钱。全方位死磕,行业的洗牌期,真的是说来就来了。