AI大模型

大模型卷疯了:GPT要吞掉一切上下文,国产模型杀疯了

大模型卷疯了:GPT要吞掉一切上下文,国产模型杀疯了

OpenAI的奥特曼又放狠话了。他说半年内,GPT的上下文能覆盖你的一切。这话首先吓到的是创业公司CEO们——说白了,如果模型连上下文都全包了,很多中间层创业项目可能直接归零。实际上,学术界也在认真研究跨会话的上下文状态交接问题,这说明"无限上下文"不只是嘴炮,而是正在发生的技术趋势。

国内大模型也没闲着。阿里千问平台上线了Qwen-Audio-3.0系列语音模型,一口气拿下Artificial Analysis七月榜单的语音识别、实时交互和语音合成三项第一。智谱则精准狙击DeepSeek,八项跑分赢了七项。但两条自进化路线,谁笑到最后还不好说。实际上,国产模型之间的竞争已经进入贴身肉搏阶段。

另一边,企业用户对大模型成本越来越敏感。他们甚至直言,对主流AI实验室不抱期望。说白了,服务商Writer推出旗舰模型Palmyra X6,基于开源模型GLM-5.2后训练变体,直接把企业基础任务的Token成本砍掉一半。AI"越用越贵"的痛点,终于有人正面回应了。

现在的格局很清楚了:OpenAI往"全能上下文"方向猛冲,国产模型在多模态和跑分上拼命追赶,而企业侧开始用开源方案把成本压下来。大模型竞赛已经从"谁更强"变成"谁更强还更便宜"。说白了,2024下半年只会更卷。