李飞飞发布世界模型重大更新:单GPU实时生成3D场景

当业界巨头还在忙于采购显卡、扩充算力来支持他们的Sora 2视频生成模型时,李飞飞的The World Labs实验室正在用另一种思路重新定义现实。他们仅用一张显卡,就构建出了可供探索的数字世界。团队刚刚发布了一项名为RTFM的创新技术,这套实时世界生成模型正在突破想象力的边界。
与传统图像生成工具不同,RTFM不仅能从单张图片生成可供自由漫步的3D场景,更重要的是实现了在单个H100 GPU上的流畅运行,真正做到了实时生成与交互。
目前,RTFM研究预览版已经开放体验,并提供了可实际操作的Demo演示。
RTFM体验地址:https://rtfm.worldlabs.ai/
令人惊喜的是,这个Demo被命名为FRAMEBOY——结合复古风格的界面设计,瞬间唤起了我们对经典Game Boy游戏机的时代记忆。
眼前这个光影交错、反射细节丰富且实时变化的世界,某种程度上不正是我们儿时梦想中的游戏场景吗?
超越静态生成,实现动态交互
RTFM的核心突破在于能够实时生成可供用户交互的视频内容。系统从一张静态图片起步,通过实时渲染技术构建出完整的3D探索场景。
与传统模型相比,RTFM能够学习并呈现出极其复杂逼真的视觉效果。无论是光滑大理石地面的倒影细节、阳光照射下物体的自然阴影,还是透过玻璃看到的景象,模型都能精准地模拟出真实世界的视觉效果。
RTFM不依赖传统的图形学编程,而是让模型通过对海量视频数据进行端到端学习,持续优化生成的视觉效果。
支撑这一能力的,是RTFM设计团队提出的三大核心原则。
效率优先:将未来拉近现实
计算需求始终是世界模型发展的主要瓶颈。无论是像Sora这样的AI生成视频,还是Google尚未正式上线的Genie 3,都意味着巨大的算力挑战。
相关研究表明,要实时生成4K 60fps的交互视频流,AI模型每秒需要处理的tokens数量约等于一本《哈利·波特》的文字总量。
而在超过一小时的交互过程中,要保持生成内容的连贯性,需要处理的上下文将超过1亿个token。这对当前的计算基础设施而言,既不够现实,也难以承受。
李飞飞团队的目标是"在今天的硬件上,运行明天的模型,并提供最高保真度的预览体验。"
通过对架构、模型蒸馏和推理过程的极致优化,以及整个系统的重新设计,RTFM成功实现了仅使用单个H100 GPU就能进行交互式帧率推理,实现实时生成。
可扩展性:从视频模型到世界模型
传统3D引擎依赖三角网格、高斯点云和体素渲染等显式结构,完全基于复杂的计算机图形学知识。每个物体都需要建模、上材质、打光、烘焙阴影。这与我们之前介绍的混元3D世界采用的方法类似,它们主打的是实现3D全管道的生成效果。
The World Labs选择了完全不同的技术路线。RTFM不会构建任何显式的3D模型,而是使用了类似Sora的"自回归扩散Transformer"架构,直接从视频帧序列中学习世界规律。
举例来说,模型不再需要知道"这是一堵墙"或"那是一盏灯",而是通过成千上万段视频的学习,理解什么是"空间感",学会从输入的2D图像序列中预测出下一个新的视角画面。
与生成3D资产的路线不同,RTFM能够更好地利用不断增长的数据和算力,从而实现无限扩展。
持久性:让世界保持一致
大部分视频生成模型存在一个天然缺陷——它们没有记忆。即便现在的Sora能一次性生成25秒的震撼画面,但视频生成结束后,世界就终结了,无法提供持续的交互体验。
如果要记住所有场景,计算负担势必随着探索的深入而无限累积。
RTFM尝试解决的正是让生成的世界具备持续存在的能力。它引入了一个名为"空间记忆"的机制,为生成的每一帧画面都赋予了在3D空间中的精确"姿态"。
在生成新画面时,模型会采用一种"上下文杂耍"的技术,只调用新画面附近位置的帧作为参考,而非全局内容。
这使得RTFM能够让我们反复进入这个世界,离开再回来,而不会增加计算负担。
目前,RTFM的Demo体验时间只有3分钟,时限过后它还是会忘记这个世界。我在那个Demo里面拖动左右两个摇杆玩了很久,想起李飞飞之前说过,空间智能应该是AGI的下一个方向。
未来是否真的有机会,让现实世界与虚拟世界之间产生明确的联系,当前世界模型需要加载的内容还有太多。
毕竟,即便单个H100 GPU售价也大约在25000美元以上。但是当算力的价格下降,当算法再快一点;我们或许能看到,真正意义上的世界模型"大更新"照进现实的那一天。
AI原生产品日报频道具 前科免责声明
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
吉利星愿6.58万起上市,重塑A0级新能源标杆
上市一年累计销量突破40万辆,今年9月单月销量超过5万辆,若说A0级新能源小车正逐步走入主流视野,那么吉利星愿无疑已成为这一细分市场中的现象级产品。近期,吉利星愿迎来新一轮升级,共推出6款新版本车型
红魔×鸣潮联名新机1月登场:2026年震撼发布
感谢热心网友風見暉一、肖战割割提供的线索。2025年10月17日,红魔游戏手机正式宣布将再度携手鸣潮推出联名产品,此次合作主题为“鸣潮 X 红魔”,新品预计于2026年1月与公众见面,值得期待。此前
特斯拉Model Y长续航版25年交付 享3年免息与万元补贴
特斯拉于今日宣布,Model Y L车型的预计交付时间已更新至2025年12月,即日起下订有望在年底前完成提车。在10月31日(含)前通过引荐奖励活动下单的用户,可获得8000元车漆选装礼金。同时,
庄知彦十年回归,主导真·三国无双系列革新起源
自真·三国无双系列问世以来,庄知彦便始终是这一系列的核心人物,深度参与了每一部作品的开发与塑造。2014年真·三国无双7发布后,他选择离开团队,转而投身新的创作方向。十年之后,他以真·三国无双:起源
Win11任务栏更新:Copilot将取代传统搜索框
微软宣布Windows 11将进行一次重要升级,任务栏上的搜索框将逐步被Copilot聊天框替代。此举旨在将任务栏转变为一个更具活力的操作中心,帮助用户以更高效的方式完成日常任务,提升整体使用体验。
相关攻略
热门教程
更多- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程



















