智能体技术正迎来密集突破,多个方向同时起跳。阿里刚开源了GUI智能体基座模型Qwen-UI-Agent,覆盖移动端、电脑端和网页端,在MobileWorld测试中拿下82.1%高分,综合性能直接超越行业旗舰。另一边,browser-use项目也在让网站对AI智能体开放,在线任务自动化变得更简单。
操作能力只是基础,学习人类行为才是关键。有研究从被动记录的截图和键鼠操作中提取任务模型,把日常工作的流程变成可审计、可复用的符号化表达。旅行行为研究也用上了三智能体工作流,把数据采集和预测建模打通,不再各干各的。
更狠的是智能体开始尝试改进自己。AI4AI-Bench专门评估LLM智能体在算法设计中的递归自我改进能力,核心问题是:AI能不能改进训练算法本身,让下一代系统继承优势?这条路径一旦走通,智能体的进化速度可能彻底失控。
从网页操作、真机控制到自我改进,智能体正从执行工具向自主进化体跃迁。真机多模态基座解决落地问题,行为建模提供学习路径,递归改进打开指数级提升的可能。2025年,智能体大概率成为AI竞争的主战场。