WorldPlay2: Extending Real-Time Interactive World Models in Control and Horizon
cs.CV
Submitted: 2026-09-28
Updated: 2026-09-28
Code: https://github.com/madebyollin/taehv
Project page: https://worldplay2.github.io
Terminology
Sources
- Cosmos 3: Omnimodal World Models for Physical AI
- Qwen3-VL Technical Report
- Flex Attention: A Programming Model for Generating Optimized Attention Kernels
- Infinite Worlds with Versatile Interactions
- AnyFlow: Any-Step Video Diffusion Model with On-Policy Flow Map Distillation
- Matrix-game 2.0: An open-source, real-time, and streaming interactive world model
- RELIC: Interactive Video World Model with Long-Horizon Memory
- ViPE: Video Pose Engine for 3D Geometric Perception
- ABot-World-0: Infinite Interactive World Rollout on a Single Desktop GPU
- Hunyuan-GameCraft: High-dynamic Interactive Game Video Generation with Hybrid History Condition
- Yume: An Interactive World Generation Model
- Parallel Decoding Distillation for Fast Image and Video Generation
- Hunyuan-GameCraft-2: Instruction-following Interactive Game World Model
- AlayaWorld: Interactive Long-Horizon World Modeling -- Full Technical Report
- DreamX-World 1.0: A General-Purpose Interactive World Model
- Gemini: A Family of Highly Capable Multimodal Models
- Evaluating Gemini Robotics Policies in a Veo World Simulator
- INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling
- Advancing Open-source World Models
- HunyuanWorld 1.0: Generating Immersive, Explorable, and Interactive 3D Worlds from Words or Pixels
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models