VT-Bridge: Bridging Pretrained Foundation VLAs to VTLAs via Lightweight Residual Adaptation
cs.RO
Submitted: 2026-09-18
Updated: 2026-09-18
Terminology
Sources
- $\pi_0$: A Vision-Language-Action Flow Model for General Robot Control
- Fine-Tuning Vision-Language-Action Models: Optimizing Speed and Success
- HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model
- GR00T N1: An Open Foundation Model for Generalist Humanoid Robots
- T-Rex: Tactile-Reactive Dexterous Manipulation
- FAVLA: A Force-Adaptive Fast-Slow VLA model for Contact-Rich Robotic Manipulation
- CRAFT: Adapting VLA Models to Contact-rich Manipulation via Force-aware Curriculum Fine-tuning
- Never Too Late for Force: Accelerating VLA Post-Training with Reactive Force Injection
- UniTacVLA: Unified Tactile Understanding and Prediction in Vision Language Action Models
- VTLA: Vision-Tactile-Language-Action Model with Preference Learning for Insertion Manipulation
- CompliantVLA-adaptor: VLM-Guided Variable Impedance Action for Safe Contact-Rich Manipulation
- HapticVLA: Contact-Rich Manipulation via Vision-Language-Action Model without Inference-Time Tactile Sensing
- OmniVTLA: Vision-Tactile-Language-Action Models with Semantic-Aligned Tactile Sensing
- TacMamba: A Tactile History Compression Adapter Bridging Fast Reflexes and Slow VLA Reasoning
- TacVLA: Contact-Aware Tactile Fusion for Robust Vision-Language-Action Manipulation
- Tactile-VLA: Unlocking Vision-Language-Action Model's Physical Knowledge for Tactile Generalization
- REASSEMBLE: A Multimodal Dataset for Contact-rich Robotic Assembly and Disassembly
- SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics
- Reactive Diffusion Policy: Slow-Fast Visual-Tactile Policy Learning for Contact-Rich Manipulation
Related papers
- FMT x: An Efficient and Asymptotically Optimal Extension of the Fast Marching Tree for Dynamic Replanning
- MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving
- RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies
- HRDexDB: A 4D Dexterous Grasping Dataset Across Human and Multiple Robot Embodiments
- APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies
- Fine-tuning is Not Enough: A Parallel Framework for Collaborative Imitation and Reinforcement Learning in End-to-end Autonomous Driving