世界模型
世界模型想补的不是表达能力,而是预测能力:下一步会发生什么,我这么动下去会有什么后果。
世界模型和视频生成常被混为一谈,判别标准其实简单:视频生成只要每帧看起来对,世界模型还得让状态随时间一致——物体不会凭空消失,转一圈回来还是那个房间。目前落地分两条线,一条做可交互实时生成,一条做原生 3D 重建,前者更接近可玩的世界,后者更接近可训练的环境。
世界模型想补的不是表达能力,而是预测能力:下一步会发生什么,我这么动下去会有什么后果。
2026 年 8 月 31 日,Runway 在官方研究页发布 Solaris,称它是新一代“界面世界模型”(Interface World Model)系列的首个模型。它尝试跳过传统软件从设计稿到代码实现的转换过程,直接逐帧生成应用或网站的视觉界面,并让画面随着点击、拖拽和自然语言指令连续变化。 ...
世界模型这个概念最近重新变热,不只是学术圈在讲,做智能体、自动驾驶、机器人和视频生成的人也都在提。所谓世界模型,核心不是让 AI 多会说话,而是让它对环境、状态变化、因果关系和下一步会发生什么,形成一种可预测的内部表示。换句话说,它想解决的是“AI 会不会理解世界”这个更深层的问题。 大语言模型擅长...
一、摘要 LingBot-World 是 Robbyant 开源的“世界模型/世界模拟器”,思路源自视频生成:给定输入图像与文本提示,可生成具有动态一致性的长视频序列,并强调可控与可交互。项目定位为具身智能基础栈的一部分,面向机器人学习、游戏内容与交互式生成等场景,提供代码与模型权重,协议为 Apa...
HunyuanWorld-Voyager开源:AI驱动的原生3D重建与超长程世界模型 HunyuanWorld-Voyager正式开源,被称为首个超长程世界模型,支持原生3D重建与视频生成融合。它在WorldScore榜单位列前茅,具备Direct 3D Output与3D Memory等创新能力,...