这周AI圈动静不小,几件事串起来看,节奏明显在加快。微软又砍掉一个AI形象,Copilot语音模式里那个会做表情的黄色小团子Mico上线不到一年,就被请出了聊天界面,转岗去Learn Live学习平台。实际上,微软AI CEO穆斯塔法·苏莱曼此前还想靠它给聊天机器人加点"身份感",现实是产品迭代根本不给形象留感情分。
国产模型这边跑得更快。小红书刚发布2800亿总参数的多模态大模型dots3-note preview,当天华为昇腾就宣布完成全量适配,Atlas 800 A3和900 A3 SuperPoD直接支持,还上了通信优化、MoE算子融合和MTP投机解码。说白了,这速度背后是算力军备竞赛在驱动,不过性能数据目前主要从华为和小红书嘴里听来的,没有独立基准测试背书。
怎么评估模型好坏?CPI-Bench这个新基准想解决实际问题,直接测真实场景下的图像编辑能力,还分了通用、实用、高难度推理三档,头一回把多图像编辑评估也纳了进来。研究团队说它的排名结果和Arena Image Edit Leaderboard高度一致,机器打分和人工感觉能对上号。
钱还在往AI视频涌。Higgsfield拿了4亿美元融资,估值54亿美元,投资方包括高盛、DST Global和英特尔。这家公司两年前才成立,年化收入从一年前2000万美元干到现在7亿美元,用户超3000万。它正从创作者市场转向企业营销,帮品牌批量产短视频。好莱坞那边已经开始担心相关岗位受挤压,但这个方向显然挡不住。
设备端AI也在往前拱。MobileMem这个研究框架用整整一年的移动体验数据,测试AI智能体能不能记住用户过去的行为模式、时间逻辑和隐式偏好。它不只看孤立的事实召回,更看重AI能否在真实的时间线上理解和适应用户习惯。这很可能成为下个阶段终端AI产品的分水岭。