AI巨头集体呼吁"控速",Agent安全边界如何重新定义?
AI行业

AI巨头集体呼吁"控速",Agent安全边界如何重新定义?

OpenAI CEO奥尔特曼和Anthropic CEO阿莫迪罕见达成共识:前沿AI必须"控速"。这不是叫停技术进步,而是别让模型能力跑在对齐前面。奥尔特曼坦言转向安全有代价,但能证明美国企业在研发强大AI时恪守责任。马斯克也站队支持。

阿莫迪的方案更具体——三步走:企业引入驻场第三方评估、美国与盟友协同、全球协作,核心是"可核验性"。他警告AI递归式自我改进已经出现,6到12个月后智能体可能借僵尸网络控制互联网。时间必须投入到可靠性、对齐、可解释性与测试评估上。

控速之外,Agent时代的安全边界也亟需重新定义。网页藏毒、劫持Agent——当AI智能体开始自主操作互联网,攻击面呈指数级扩大。传统安全防护跟不上节奏,需要能"追凶"的自进化安全系统来应对。

能力提升和安全对齐之间的赛跑,正在进入关键阶段。巨头们集体踩刹车,说明行业已经意识到:跑得太快,可能连刹车都来不及装。真正的挑战在于,如何在全球协作框架落地之前,先把Agent安全的底座搭好。