AI智能体最近在多个方向都有新进展。说白了,从浏览器自动化到真实设备操作,从数据收集到自我改进,一系列新成果展示了智能体的巨大潜力。这些进展让智能体离大规模应用更近一步。
browser-use让AI智能体直接操作网站,自动填表、点击、导航。实际上,研究人员还从真实操作痕迹中提取任务模型,让智能体学会人类工作方式。这些模型可审计、可复用,帮助智能体理解复杂流程。两者结合,智能体就能主动规划任务,不再只是被动执行。
数据收集方面,三智能体工作流把主动采集和建模整合到一起,效率更高。AI4AI-Bench这个基准测试,专门测试递归自我改进,看智能体能不能自己优化算法。这种自我进化能力,说白了,就是智能体持续进步的关键。这些研究给自动驾驶、城市计算等场景打下了技术基础。
实际上,阿里巴巴开源了Qwen-UI-Agent,一个真机多模态基座模型,覆盖手机、电脑、网页,还能深度搜索。它突破了模拟测试的限制,在真实设备上表现出色,MobileWorld测试中拿到82.1%的高分,领先多个主流模型。说白了,这标志着智能体从模拟环境走向真实世界,能在复杂真实设备上无缝操作了。智能体正在快速融入日常工作和生活,成为真正的数字助手。