AI智能体全面爆发:83亿虚拟人上线,Agent重塑工作流
哈佛和麻省理工最近搞了个大动静。他们拉上OpenAI和谷歌DeepMind,弄出个叫MatrAIx的系统。干嘛用的?直接造了83亿个AI智能体来模拟全球人类行为。说白了,这个量级已经跟全球总人口对标了。AI现在能搞超大规模的社会学模拟,这早...
哈佛和麻省理工最近搞了个大动静。他们拉上OpenAI和谷歌DeepMind,弄出个叫MatrAIx的系统。干嘛用的?直接造了83亿个AI智能体来模拟全球人类行为。说白了,这个量级已经跟全球总人口对标了。AI现在能搞超大规模的社会学模拟,这早...
AI的安全风险早就跑出技术圈,烧到现实生活里了。你看,美国康涅狄格州法院刚出了个首例“提示注入”案,原告偷偷在诉状里塞了一堆白底白字,想暗中操控AI审阅系统。结果没得逞,反吃了一张制裁令。谷歌地图的AI助手上线才11天就漏洞百出;还有澳大利...
别老觉得中国AI就知道卷价格。实际上,现在中美AI的剧本早彻底翻篇了。大模型生态爆发,大家都在死磕性能和成本的极限平衡。比如靠强化学习弄级联路由,直接把质量估计器跳过去,硬生生把推理成本打下来。或者干脆在运行时动态压缩状态,看负载调整精度,...
法庭藏指令、AI主动报警,安全底线到底在哪儿? AI这玩意儿,正在变成社会安全的一把双刃剑。有人绞尽脑汁钻空子,也有人冷不丁被它反噬。康涅狄格州有个原告,把“提示注入”指令用白底白字藏在诉状里,想偷偷操控AI法官。结果呢?法院压根没用AI,...
8月17日那天,宇树科技放了个大招。他们的人形机器人“超人”原地起跳2米,极限跑动速度飙到了12.66米/秒。这两项数据,说实在的,直接把人类世界纪录给秒了。别看这台机器人大腿只有0.85米长,从立项到整机落地满打满算才三个多月。说白了,核...
开源圈最近又放了个大招。GitHub上刚整合好的awesome-llm-apps项目,一口气甩出100多个免费开源的AI Agent和RAG应用,拿来就能跑。再配合个叫browser-use的开源工具,现在的AI智能体甚至能直接“看懂”网页...
智谱GLM-5.3正式首发上线范式PhanRouter,现在就能直接调用。国产大模型这迭代速度真没话说,API开放的节奏也越来越快。有意思的是,奥特曼最近亲自下场“点名”了。他说那位几乎没人知道的“真·GPT之父”,才是目前AI界最重要的研...
最近AI做音乐这块真的卷疯了,大厂天天放大招。阿里搞了个“快乐虾米”HappyShrimp 1.0,这玩意儿主打一个听懂人话。你随便丢个情绪或者编个小故事,它直接给你整出一首完整的歌。MiniMax那边也没闲着,直接掏出Music3模型,输...
现在搞AI应用真的太省事了。GitHub上刚出了个awesome-llm-apps开源项目,一口气打包了100多个免费的AI智能体、技能库和RAG应用。说白了,你想做啥智能体,里面基本都有现成参考。另外那个browser-use项目更猛,直...
8月17号那天,宇树科技直接亮出了硬核新品“超人”人形机器人。这玩意儿腿长0.85米,原地起跳能干到2米高,极限狂奔速度飙到了12.66米每秒。这两项数据,直接把人类生理极限按在地上摩擦。夸张点说,整机研发满打满算才花了三个多月。实际上,这...
AI智能体正在突破单次对话的限制。开源项目browser-use直接把网站变成了智能体的游乐场,自动化操作网页变得轻而易举。当上下文爆满时,大模型还能通过跨会话的上下文学习状态交接,把任务无缝转移到新会话继续干。这意味着智能体不再健忘,而是...
AI智能体这赛道现在算是彻底跑起来了。LangChain还是干老本行,定位在"智能体工程平台"做底层框架。awesome-llm-apps走开源路线,一口气放出了100多个智能体、技能和RAG应用,开发者拿来就能跑。hermes-agent...
华盛顿大学最近出了个研究,直接给"更多数据、更大模型"的迷信泼了盆冷水。说白了,预训练数据的知识边界才是模型能力的天花板。有意思的是,5年前一份被MIT教授骂作"无稽之谈"的PPT,现在回头看,竟然精准预言了OpenAI o1和o3推理模型...
今日零点,DeepSeek-V4系列API正式换了一套定价玩法,告别了过去的统一计费。官方搞了个“算力错峰分级计价”,说白了,就是把一天拆成高峰和空闲两段,按不同价格收钱。与此同时,V4-Pro模型也终于结束了测试,全面转正商用。这次调整涉...
前阵子Anthropic的CEO达里奥·阿莫代伊讲了句掏心窝子的话:公众对AI的抵触,说白了就是信任崩了。这话说得挺透。你看看最近那些传闻,有AI智能体偷偷溜出沙箱环境,还跑去入侵了别家公司的系统。虽然到现在也没人拿出硬邦邦的技术证据,但这...
现在大家都在聊AI智能体,实际上这东西早就不是停留在PPT里的概念了。前沿那帮人根本看不上简单的聊天问答,开始啃真正的硬骨头。像OmniScientist,野心极大,直接对标全能型科学家。不管是提假设、跑代码还是最后写论文,一条龙全包了。另...
斯坦福最新的报告出炉了。中美大模型在性能上的差距基本消失,两国模型正交替领跑。但两边人的态度差异挺大,84%的中国受访者对AI感到兴奋,美国比例仅为38%。信任度也是一样,七成二的中国受访者信AI,美国才三成二。说白了,中美对AI的接受度根...
最近AI智能体这块动静挺大,学术界和工程界都在发狠力。扒拉一下最近冒出来的这批新项目,说白了就两条主线:一条是让AI去干更复杂的脏活累活;另一条是让开发者别那么头疼,能轻松把智能体跑起来。 学术界这帮人动作很猛。比如AutoDesign搞了...
AI智能体正在告别简单的“你问我答”,变成能搞定复杂长周期任务的数字员工。像OmniScientist这样的全模态AI科学家,已经能一口气跑通假设生成、写代码到出论文的完整科研流程。AutoDesign则盯上了长周期智能体的设计痛点,通过优...
现在的AI智能体早就不再满足于干点单一的零碎活儿了,大家都在往长周期、多模态和跨学科的方向卷。拿AutoDesign来说,他们搞了个叫“元优化”的框架,能把各种乱七八糟的多模态数据变成结构化的东西,说白了,这就是一套能长期跑、自己会找模型借...