核心论文与里程碑¶
最后更新: 2026-04-17 | 按时间线 + 按主题双索引
奠基期 (1990-2017)¶
-
1990 Dyna Architecture (Richard Sutton) — MBRL 奠基, 在学习的环境模型中做规划
-
2013 Playing Atari with Deep RL (Mnih et al., DeepMind) — DQN 开启深度 RL 时代
-
2014 Auto-Encoding Variational Bayes (Kingma & Welling, ICLR) — VAE + ELBO + 重参数化
-
2015 Deep Predictive Coding Networks (Lotter et al.) — 预测编码用于视频预测
关键突破期 (2018-2022)¶
-
2018 World Models (Ha & Schmidhuber, NeurIPS) — VAE+MDN-RNN+Controller, "在梦中训练"
-
2019 PlaNet (Hafner et al., DeepMind) — RSSM, 纯基于模型的规划
-
2020 Dream to Control: Dreamer V1 (Hafner, ICLR) — Actor-Critic 潜在空间想象训练
-
2020 DDPM (Ho et al., NeurIPS) — 去噪扩散开创
-
2021 Dreamer V2 (Hafner, ICLR) — 离散表征, Atari 首次人类水平
-
2022 Emergent World Representations (Li et al., ICLR 2023) — Othello-GPT 涌现世界表征
-
2022 MineDojo (Fan et al.) — Minecraft 开放世界基准
-
2022 A Path Towards Autonomous Machine Intelligence (LeCun) — JEPA 框架蓝图
-
2022 Flow Matching for Generative Modeling (Lipman, ICLR 2023) — OT 视角简化扩散
爆发期 (2023)¶
-
2023 Dreamer V3 (Hafner, Nature) — 单配置 150+ 任务, Symlog+Two-Hot
-
2023 I-JEPA (Assran et al., CVPR) — 首个 JEPA 图像模型, ViT-H 线性探测 79.3%
-
2023 TD-MPC2 (Hansen, ICLR 2024) — 317M 跨 80 任务无解码器世界模型
-
2023 GAIA-1 (Wayve) — 首个自动驾驶生成式世界模型
-
2023 3D Gaussian Splatting (Kerbl, SIGGRAPH) — 3D 场景表示革命
-
2023 Language Models Represent Space and Time (Gurnee & Tegmark, ICLR 2024) — Llama-2 空间/时间神经元
-
2023 Emergent Linear Representations (Nanda, BlackboxNLP) — OthelloGPT 线性探针 99.5%
-
2023 GraphCast (DeepMind, Science) — 图神经网络全球天气预报
-
2023 Pangu-Weather (Nature) — 3D 变换器超越数值预报
Sora 冲击与扩展 (2024)¶
-
2024.02 Sora (OpenAI) — "Video Generation as World Simulators"
-
2024.02 Genie (DeepMind) — 首个可交互环境生成, LAM 无监督动作学习
-
2024.05 DIAMOND (EPFL, NeurIPS Spotlight) — 扩散世界模型, EDM n=3 步, Atari SOTA
-
2024.06 V-JEPA (Meta) — 视频 JEPA
-
2024.07 OthelloGPT: Bag of Heuristics (MATS 6.0, LessWrong) — 局部规则集合批评
-
2024.08 GameNGen (Google, ICLR 2025) — 神经网络 DOOM 引擎, PSNR 29.43
-
2024.10 Oasis (Decart) — DiT + Diffusion Forcing Minecraft
-
2024.10 π₀ (Physical Intelligence) — 首个通用机器人 VLA, Flow Matching
-
2024.10 EMMA (Waymo) — Gemini 端到端 AD, CoT +6.7%
-
2024.12 Genie 2 (DeepMind) — 单图→3D 交互世界
-
2024.12 Sora 公开发布 (OpenAI) — Storyboard 界面
商业化元年 (2025)¶
-
2025.01 NVIDIA Cosmos (arXiv:2501.03575) — 世界基础模型平台, 10^8 clips
-
2025.01 NVIDIA GR00T N1 (GTC) — 首个开源人形机器人基础模型
-
2025.02 Physical Intelligence 开源 π₀ — GitHub: openpi
-
2025.03 GAIA-2 (Wayve, arXiv:2503.20523) — 8.4B, Flow Matching 多视角
-
2025.05 Manhattan 导航实验 (arXiv:2505.20874) — LLM 空间认知 R²=1.00
-
2025.06 V-JEPA 2 (Meta, arXiv:2506.09985) — 1.2B, 100万+ 小时
-
2025.07 Skild AI 首次公开演示 — 通用机器人大脑
-
2025.08 Genie 3 (DeepMind) — 24fps 720p 实时交互通用世界模型
-
2025.09 Sora 2 (OpenAI) — 物理合规性大幅提升
-
2025.10 Dreamer V4 (arXiv:2509.24527) — 2B Transformer, 纯离线 Minecraft Diamond
-
2025.10 Alpamayo-R1 (NVIDIA, arXiv:2511.00088) — 首个开源推理 VLA
-
2025.11 World Labs Marble (Fei-Fei Li) — 首个商用世界模型
-
2025.11 LeJEPA (arXiv:2511.08544) — SIGReg 理论基础
-
2025.11 GEN-0 (Generalist AI) — 首次验证具身 Scaling Law, 270Kh
-
2025.12 LeCun 离开 Meta → AMI Labs — 世界模型商业化
-
2025.12 GAIA-3 (Wayve) — 15B, 9 国 3 大洲
-
2025.12 Cosmos-Reason2 (NVIDIA) — 物理常识推理 + 长链思维
-
2025.12 Helix 02 (Figure AI) — 61 步连续操作 VLA
2026 前沿¶
-
2026.01 Genie 3 公开发布 (DeepMind)
-
2026.01 Skild AI $1.4B (SoftBank/NVIDIA, 估值 $14B)
-
2026.01 WorldBench (arXiv:2601.21282) — 概念级物理评估
-
2026.02 Waymo World Model — 基于 Genie 3 适配, 5000万英里
-
2026.02 Runway GWM-1 — 3D 虚拟环境世界模型, $315M 融资
-
2026.03 AMI Labs $10.3B 种子轮 (LeCun, 估值 $45B)
-
2026.03 LeWorldModel (arXiv:2603.19312) — 端到端 JEPA, SIGReg
-
2026.03 Revisiting Othello WM (ICLR 2025) — 7 模型 99% grounding
-
2026.04 GEN-1 (Generalist AI) — 数据效率版, GEN-0 的 1/10 数据
按主题索引¶
世界模型架构¶
- World Models 2018 / Dreamer V1-V4 / TD-MPC2 / IRIS
JEPA 家族¶
- JEPA 2022 / I-JEPA 2023 / V-JEPA 2024 / V-JEPA 2 2025 / LeJEPA 2025 / LeWM 2026
扩散/Flow 世界模型¶
- DDPM 2020 / Flow Matching 2022 / Sora 2024 / DIAMOND 2024 / Cosmos 2025
交互式环境¶
- Genie 1-3 / GameNGen / Oasis / Dreamer V4 Minecraft
自动驾驶¶
- GAIA-½/3 / EMMA / Waymo WM / Alpamayo-R1 / Cosmos Transfer
机器人基础模型¶
- RT-2 / Octo / π₀ / OpenVLA / GR00T N1 / Helix / Gemini Robotics / GEN-0/1
LLM 世界模型之争¶
- Othello-GPT 2022 / Nanda 2023 / MATS 6.0 2024 / ICLR 2025 七模型 / Manhattan 2025 / Space&Time 2024
评估基准¶
- WorldBench / WorldScore / PhysBench / WorldModelBench
数学基础¶
- VAE 2014 / Score Matching 2005 / DSM 2011 / Flow Matching 2022 / IB 2000 / MPPI 2016
参考¶
-
各论文 arXiv ID 见文中标注
-
完整引用索引见 02.6 数据来源引用章节
↑ 上级 · World Model