VLM-MPPI: Grounding Natural Language in Behaviorally Diverse Trajectories for Aerial Navigation
cs.RO
Submitted: 2026-09-16
Updated: 2026-09-16
Terminology
Sources
- PaLM-E: An Embodied Multimodal Language Model
- Rethinking Reference Trajectories in Agile Drone Racing: A Unified Reference-Free Model-Based Controller via MPPI
- PA-MPPI: Perception-Aware Model Predictive Path Integral Control for Quadrotor Navigation in Unknown Environments
- AERO-MPPI: Anchor-Guided Ensemble Trajectory Optimization for Agile Mapless Drone Navigation
- GPT-4 Technical Report
- Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- CLIP-Nav: Using CLIP for Zero-Shot Vision-and-Language Navigation
- Language as Cost: Proactive Hazard Mapping using VLM for Robot Navigation
- UAV-VLPA*: A Vision-Language-Path-Action System for Optimal Route Generation on a Large Scales
- ComposableNav: Instruction-Following Navigation in Dynamic Environments via Composable Diffusion
- VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models
Related papers
- FMT x: An Efficient and Asymptotically Optimal Extension of the Fast Marching Tree for Dynamic Replanning
- MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving
- RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies
- HRDexDB: A 4D Dexterous Grasping Dataset Across Human and Multiple Robot Embodiments
- APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies
- Fine-tuning is Not Enough: A Parallel Framework for Collaborative Imitation and Reinforcement Learning in End-to-end Autonomous Driving