☰
AMD 82 亿美元买下李飞飞的世界模型:当 Agent 开始操作物理世界,安全的游戏规则变了
2026/10/1 21:04:01 网站建设 项目流程

9 月 28 日,AMD 官宣了一笔让不少人意外的收购:以约 82 亿美元(约合人民币 550 亿元)全股票收购 World Labs——由「AI 教母」李飞飞 2024 年联合创办、专注空间智能与世界模型的研究实验室。交易预计年底前完成,李飞飞本人将加入 AMD,出任执行副总裁兼首席科学家,直接向苏姿丰汇报。

一家芯片公司,花 82 亿美元买一家 70 人规模、成立才两年的模型实验室,图什么?苏姿丰的说法很直白:「你对整个端到端流程了解得越深入,就越能构建出更好的系统。」AMD 买的不是产品,是对下一代 AI 负载的理解权——而 World Labs 手里握着的,正是被普遍视为大模型之后下一个主战场的东西:世界模型。

一、世界模型:让 AI 从「读懂文字」到「看懂空间」

大语言模型解决的是符号世界的问题:写文章、编代码、做推理。但物理世界不是由 token 组成的——机器人要抓取一个杯子,需要理解它的三维形状、材质、重量和空间关系;自动驾驶要预判行人的轨迹,需要在脑内「推演」接下来几秒的场景变化。

这就是世界模型要干的事:让 AI 在内部建立一个对现实世界的可推演模型,从「感知」走向「理解与行动」。World Labs 的路线很清晰——首个产品 Marble 能从文本、图像、视频生成可漫游、可编辑的持久化 3D 世界;今年 9 月又发布了面向空间智能的全模态世界模型 Atlas;同时通过收购 SceniX 布局机器人仿真训练,打通「真实到仿真再到真实」(R2S2R)的训练闭环。

英伟达有 Cosmos,谷歌有 Genie,如今 AMD 通过收购直接拿到了入场券。巨头们的共识已经形成:AI 的下一站不在对话框里,在三维世界里。

二、对 Agent 意味着什么:能力半径的一次质变

如果说今天的 Computer-Use Agent 是「在屏幕上点鼠标」,那世界模型加持下的 Agent 是「在空间里做决策」。能力跃迁体现在三个层面:

从像素到空间。现在的 GUI Agent 靠截图识别按钮位置,本质还是二维模式匹配;世界模型让 Agent 理解三维结构和物理规律,能预判「我这么做之后环境会怎样变化」。

从数字到物理。结合机器人仿真训练,Agent 的操作对象从软件界面扩展到机械臂、无人车、无人机——AI 的动作第一次可以直接改变物理世界。

从执行到预演。Agent 可以在内部世界里先把动作「演练」一遍再执行,规划能力大幅增强。

这当然是激动人心的进步。但做过 Agent 安全的人会立刻意识到:风险半径跟着能力半径一起扩大了。

三、新挑战:当「删库」变成最轻微的事故

过去我们讨论 Agent 安全,最坏情况无非是删了数据库、发错了邮件——损失虽大,多数还能回滚。世界模型时代的 Agent 安全,要面对几个全新的挑战:

挑战一:不可逆性升级。数字世界的误操作可以撤销、可以回滚;物理世界的误操作不行。机械臂挥错了方向、无人车误判了障碍,没有 Ctrl+Z。风险分级的尺度必须重新定义——同样一个动作,发生在屏幕上和发生在物理空间,危险等级完全不同。

挑战二:注入攻击面从文本扩展到多模态。以前的提示注入藏在网页文字、邮件正文里;世界模型的输入是图像、视频、全景图——恶意指令可以藏在一帧画面、一个物体纹理、一段视频里。Agent「看」到的世界本身,成了攻击载体。

挑战三:仿真环境成为新的攻击面。Agent 在仿真世界里训练、评测、预演,再迁移到真实世界。如果仿真环境被投毒——比如训练场景里埋入错误的物理规律或恶意行为模式——污染会顺着 sim-to-real 的管道直接进入物理世界,而且极难排查。

挑战四:预演能力的双刃剑。能「在脑内演练」的 Agent,也意味着它能推演绕过防护的路径。防护机制如果只盯着单步动作,Agent 完全可以通过多步无害动作的组合达成危险目标——跨步关联分析从「加分项」变成了「必需项」。

四、我们的准备:防线建在模型之外,与模型演进解耦

面对这些变化,AIHCC 的判断是:模型能力怎么涨,安全的底层逻辑不变——不能指望模型自觉,防线必须建在模型之外。这也是我们一路做下来的核心架构原则:检测与防护层和被防护的模型完全解耦,模型换成语言模型、世界模型还是未来的什么模型,防线照常工作。

围绕世界模型时代的新风险,我们主要在三个方向上推进:一是风险分级体系从数字动作向物理动作延伸,让「这个操作该不该拦」的判断能覆盖到空间与具身场景;二是评测先行,针对多模态注入、仿真环境异常等新攻击面扩展检测与评测能力;三是坚持平台适配用户,无论 Agent 跑在什么模型、什么框架、什么形态的环境上,安全接入的门槛只降不升。

具体的技术路线AIHCC 会陆续通过产品更新和大家见面。可以透露的是,已有的动作风险检测、注入防护、审计回放等能力,都将在同一套架构下平滑覆盖新的场景。

写在最后

AMD 这 82 亿美元,本质上是给「AI 将走出屏幕」下的注。当 Agent 的操作对象从像素变成物理世界,安全就不再是产品上线前的检查项,而是整个行业能不能走下去的前提条件。世界模型让 AI 学会了理解空间,AIHCC 的工作是确保它在空间里走的每一步,都不越界。

参考来源:AMD 官网新闻稿及中国电子报、券商中国等对本次收购的报道;World Labs 官方博客(Marble / Atlas / R2S2R)。

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询