AI Agent大乱斗:基座、运行时与入口之争
AI技术

AI Agent大乱斗:基座、运行时与入口之争

智能体赛道现在打得火热,而且不是在一个维度打——基座模型、运行时、用户入口,三条战线同时开火。

阿里刚开源了Qwen-UI-Agent,主打"真机多模态"。这不是在模拟环境里刷分,而是直接上手操作手机、电脑、网页和深度搜索。MobileWorld移动端测试拿了82.1%,把一众主流模型甩在身后,综合性能全面超越行业旗舰。阿里押注的是Agent的"大脑"——能不能在真实设备上干活才是硬实力,模拟测试里的高分已经不够看了。

OpenAI走的是另一条路。继"黑鲸"之后,他们开放了Harness,直奔Agent运行时。模型再强,也得有靠谱的运行环境来调度执行。运行时就是Agent的"操作系统",谁占了这层位置,谁就卡住生态咽喉。Agent时代,运行时和入口的竞争一样关键,OpenAI显然不想把这块拱手让人。

Rabbit则从用户侧切入,做了个"所有Agents的Agent"。他们的观点很扎心:Agent普及的关键不是再加十个能力,而是让用户少理解十个概念。用户不关心你背后跑了多少模型、调了什么API,要的就是一个能干活的入口,越简单越好。

三条战线拼到一起,结论很直接:基座决定能力上限,运行时决定执行下限,入口决定能不能真正普及。谁先把这三块拼图凑齐,谁就能吃下最大的蛋糕。