一张图,生成一个世界真实到仿真:机器人训练的新燃料数字展厅迎来一键建模时代
![]()
当大多数人还在用AI生成一张漂亮的图,李飞飞创办的World Labs已经让AI直接生成一整个可以走进去的3D世界。这个叫Atlas的多模态世界模型,可能比你想的更靠近普通人的屏幕,也更靠近你身边的数字展厅。
Atlas的核心能力,是把一张普通的二维图片,重建为像素级精确的三维世界。它不仅能生成图像和视频,还能输出可以进入、可以漫游的3D场景,单张图片即可生成最长1分钟、1440p分辨率的视频。换句话说,你给AI一张照片,它还给你一个能平移、能转视角的空间,而不是一张定格的画面。
这背后是World Labs一直在推进的路线:让AI理解物体的真实几何和空间关系,而不是只学表面的像素分布。过去3D内容生产极度依赖人工建模和扫描,成本高、周期长;Atlas这种从单图到世界的路径,等于把三维内容的门槛砍掉了一大截。
Atlas打通的是一条真实到仿真(Real to Sim)的路径。对机器人公司来说,这意味着可以用真实世界的照片快速生成大量训练场景,让机器人在虚拟环境里先练成千上万次,再回到现实。过去这类仿真素材要靠工程师手工搭建,现在一张图就能批量产出,训练效率的杠杆被显著放大。
更关键的是精度。World Labs强调的是像素级准确,这意味着生成的空间能和实际物理尺度对齐,机器人走到门口不会穿墙,抓取物体的距离也不会算错。对需要落地到工厂、仓库、家庭的实体智能来说,这种可计算的3D世界,比好看的渲染图有用得多。
![]()
把视角拉回我们身边的数字展厅。传统沉浸式展览要做一套可交互的3D场景,往往要建模团队花几周时间,从扫描、建模到灯光调试,成本动辄数十万。Atlas这类世界模型如果出现,策展方上传一张实景照片或一张概念图,就能先得到一个可漫游的雏形,再在此基础上细化。建模成本和时间,很可能被直接打崩。
对中小型展馆、文旅景区来说,这是实打实的红利。以前玩不起大空间VR的项目,现在用更低的成本就能做出可进入的虚拟展陈,把文物、遗址、城市记忆变成游客能走进去的空间。当然,AI生成不等于最终交付,艺术调性和叙事逻辑仍要靠人把控,但它确实把从想法到样间的路,铺平了一大半。
世界模型会不会让3D设计师失业,还是把他们的产能放大十倍?这场从单图到世界的革命,你更看好哪一边?欢迎在评论区聊聊。
【信源】腾讯研究院AI速递 | 9月3日李飞飞World Labs发布多模态世界模型Atlas | 2026-09-03;百度热搜 | 李飞飞World Labs Atlas世界模型 | 2026-09-03
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.