李飞飞发布世界模型重大更新:单GPU实时生成3D场景
当业界巨头还在忙于采购显卡、扩充算力来支持他们的Sora 2视频生成模型时,李飞飞的The World Labs实验室正在用另一种思路重新定义现实。他们仅用一张显卡,就构建出了可供探索的数字世界。团队刚刚发布了一项名为RTFM的创新技术,这套实时世界生成模型正在突破想象力的边界。
与传统图像生成工具不同,RTFM不仅能从单张图片生成可供自由漫步的3D场景,更重要的是实现了在单个H100 GPU上的流畅运行,真正做到了实时生成与交互。
目前,RTFM研究预览版已经开放体验,并提供了可实际操作的Demo演示。

RTFM体验地址:https://rtfm.worldlabs.ai/
令人惊喜的是,这个Demo被命名为FRAMEBOY——结合复古风格的界面设计,瞬间唤起了我们对经典Game Boy游戏机的时代记忆。
眼前这个光影交错、反射细节丰富且实时变化的世界,某种程度上不正是我们儿时梦想中的游戏场景吗?
超越静态生成,实现动态交互
RTFM的核心突破在于能够实时生成可供用户交互的视频内容。系统从一张静态图片起步,通过实时渲染技术构建出完整的3D探索场景。
与传统模型相比,RTFM能够学习并呈现出极其复杂逼真的视觉效果。无论是光滑大理石地面的倒影细节、阳光照射下物体的自然阴影,还是透过玻璃看到的景象,模型都能精准地模拟出真实世界的视觉效果。
RTFM不依赖传统的图形学编程,而是让模型通过对海量视频数据进行端到端学习,持续优化生成的视觉效果。

支撑这一能力的,是RTFM设计团队提出的三大核心原则。
效率优先:将未来拉近现实
计算需求始终是世界模型发展的主要瓶颈。无论是像Sora这样的AI生成视频,还是Google尚未正式上线的Genie 3,都意味着巨大的算力挑战。
相关研究表明,要实时生成4K 60fps的交互视频流,AI模型每秒需要处理的tokens数量约等于一本《哈利·波特》的文字总量。
而在超过一小时的交互过程中,要保持生成内容的连贯性,需要处理的上下文将超过1亿个token。这对当前的计算基础设施而言,既不够现实,也难以承受。
李飞飞团队的目标是"在今天的硬件上,运行明天的模型,并提供最高保真度的预览体验。"
通过对架构、模型蒸馏和推理过程的极致优化,以及整个系统的重新设计,RTFM成功实现了仅使用单个H100 GPU就能进行交互式帧率推理,实现实时生成。
可扩展性:从视频模型到世界模型
传统3D引擎依赖三角网格、高斯点云和体素渲染等显式结构,完全基于复杂的计算机图形学知识。每个物体都需要建模、上材质、打光、烘焙阴影。这与我们之前介绍的混元3D世界采用的方法类似,它们主打的是实现3D全管道的生成效果。
The World Labs选择了完全不同的技术路线。RTFM不会构建任何显式的3D模型,而是使用了类似Sora的"自回归扩散Transformer"架构,直接从视频帧序列中学习世界规律。
举例来说,模型不再需要知道"这是一堵墙"或"那是一盏灯",而是通过成千上万段视频的学习,理解什么是"空间感",学会从输入的2D图像序列中预测出下一个新的视角画面。
与生成3D资产的路线不同,RTFM能够更好地利用不断增长的数据和算力,从而实现无限扩展。
持久性:让世界保持一致
大部分视频生成模型存在一个天然缺陷——它们没有记忆。即便现在的Sora能一次性生成25秒的震撼画面,但视频生成结束后,世界就终结了,无法提供持续的交互体验。
如果要记住所有场景,计算负担势必随着探索的深入而无限累积。
RTFM尝试解决的正是让生成的世界具备持续存在的能力。它引入了一个名为"空间记忆"的机制,为生成的每一帧画面都赋予了在3D空间中的精确"姿态"。
在生成新画面时,模型会采用一种"上下文杂耍"的技术,只调用新画面附近位置的帧作为参考,而非全局内容。
这使得RTFM能够让我们反复进入这个世界,离开再回来,而不会增加计算负担。
目前,RTFM的Demo体验时间只有3分钟,时限过后它还是会忘记这个世界。我在那个Demo里面拖动左右两个摇杆玩了很久,想起李飞飞之前说过,空间智能应该是AGI的下一个方向。
未来是否真的有机会,让现实世界与虚拟世界之间产生明确的联系,当前世界模型需要加载的内容还有太多。
毕竟,即便单个H100 GPU售价也大约在25000美元以上。但是当算力的价格下降,当算法再快一点;我们或许能看到,真正意义上的世界模型"大更新"照进现实的那一天。
AI原生产品日报频道具 前科
游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。
同类文章
DeepSeek宣布永久降价 梁文锋大幅让利远超市场预期
DeepSeek宣布其Pro模型API优惠将转为永久降价,调用成本大幅降低至原价的四分之一。同时,公司正进行高达500亿元的首轮融资,创始人梁文锋个人计划出资200亿元以强化控制权。降价与巨额融资相结合,旨在降低行业门槛、构建生态,并支撑其长期开源与AGI战略,展现了公司的长期主义视野。
国产600公斤推力涡扇发动机首飞成功 中国心实现自研突破
5月23日,搭载国产F406涡扇发动机的气象无人机首飞成功。该发动机推力600公斤级,由我国自主研制,拥有完整知识产权,实现了中小推力高端涡扇发动机的自主可控。其具备高空高速稳定运行能力,填补了国内相关技术空白,将为无人机及低空经济发展提供可靠动力支撑。
小米米家空调巨省电Pro大1.5匹价格降至1868元
2026年3月6日,备受期待的小米米家巨省电 Pro 空调 2026 款正式上市销售。作为新品,其大1 5匹型号的官方首发定价为2499元,性价比优势显著。 恰逢京东618年中购物节,这款新上市的空调迎来了绝佳的入手时机。消费者通过叠加平台提供的促销优惠与政府发放的节能补贴,最终到手价格可以做到更具
国产600公斤推力涡扇发动机成功完成首次飞行
5月23日,我国自主研制的600公斤推力级F406涡扇发动机成功完成首次飞行试验。发动机驱动气象无人机平稳飞行并安全返航,各项参数稳定。此次试飞标志着我国在中小推力高端涡扇发动机领域实现了自主可控与国产化突破,该发动机将为低空经济和无人体系提供关键动力支撑。
国产600公斤推力涡扇发动机首飞成功核心技术自主研制
5月23日,我国自主研制的600公斤推力级F406涡扇发动机成功完成首次飞行试验。该发动机以双发配置驱动一架先进气象无人机,全程工作平稳,安全返航。此次试飞标志着我国在中小推力高端涡扇发动机领域实现自主可控与国产化,将为低空经济与无人体系发展提供可靠动力。
- 日榜
- 周榜
- 月榜
1
2
3
4
5
6
7
8
9
10
相关攻略
2015-03-10 11:25
2015-03-10 11:05
2021-08-04 13:30
2015-03-10 11:22
2015-03-10 12:39
2022-05-16 18:57
2025-05-23 13:43
2025-05-23 14:01
热门教程
- 游戏攻略
- 安卓教程
- 苹果教程
- 电脑教程
热门话题

