HapticWAM: Distilling Imagined Touch into a World-Action Model without Inference-Time Tactile Sensing
cs.RO
Submitted: 2026-09-20
Updated: 2026-09-20
Project page: https://advanced-robotic-manipulation.github.io/websites/hapticwam/Abstract
Terminology
Sources
- RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control
- $\pi_0$: A Vision-Language-Action Flow Model for General Robot Control
- $\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization
- Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization
- $N_0$-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens
- HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing
- Cosmos World Foundation Model Platform for Physical AI
- World Action Models are Zero-shot Policies
- World-Value-Action Model: Implicit Planning for Vision-Language-Action Systems
- Towards Predictive, Aligned, and Scalable Robot Learning
- Fast-WAM: Do World Action Models Need Test-time Future Imagination?
- Dream-Tac: A Unified Tactile World Action Model for Contact-Rich Robot Manipulation
- Tactile-WAM: Touch-Aware World Action Model with Tactile Asymmetric Attention
- $N_0$-TWAM: Scaling Tactile-Native World-Action Model for Contact-Rich Manipulation
- Being-H0.7: A Latent World-Action Model from Egocentric Videos
- VT-WAM: Visual-Tactile World Action Model for Contact-Rich Manipulation
- TacForeSight: Force-Guided Tactile World Model for Contact-Rich Manipulation
- FlowTouch: View-Invariant Visuo-Tactile Prediction
Related papers
- FMT x: An Efficient and Asymptotically Optimal Extension of the Fast Marching Tree for Dynamic Replanning
- MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving
- RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies
- HRDexDB: A 4D Dexterous Grasping Dataset Across Human and Multiple Robot Embodiments
- APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies
- Fine-tuning is Not Enough: A Parallel Framework for Collaborative Imitation and Reinforcement Learning in End-to-end Autonomous Driving