Dexterous Tactile World Model
cs.CV, cs.LG, cs.RO
Submitted: 2026-09-28
Updated: 2026-09-28
Project page: https://adonis-galaxy.github.io/dtwm-project-page/1
Terminology
Sources
- Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets
- Visuo-Tactile World Models
- ViTacWorld: Scaling Visuo-Tactile World Models for Contact-Rich Robot Manipulation
- OpenLongTail: Generative Scaling of Long-Tail Driving Data
- Blind Dexterous Grasping via Real2Sim2Real Tactile Policy Learning
- FeelWorld: Visuo-Tactile World Model for Hierarchical Contact Prediction and Planning
- Cosmos World Foundation Model Platform for Physical AI
- Decoupling Vision, Language, and Action for Efficient Multi-Task Robot Policies
- Artificial Foveated Perception for Mitigating Shortcut Learning in Robotic Foundation Models
- Wan: Open and Advanced Large-Scale Video Generative Models
- IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models
- Coffee: Controllable Diffusion Fine-tuning
- ContactWorld: What Representations Matter for Vision-Tactile Latent World Models in Contact-Rich Manipulation
- TouchAnything: A Dataset and Framework for Bimanual Tactile Estimation from Egocentric Video
- TouchWorld: A Predictive and Reactive Tactile Foundation Model for Dexterous Manipulation
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models