Skill-Space Shooting for Autonomous Robot Policy Improvement
cs.RO, cs.AI, cs.LG
Submitted: 2026-09-29
Updated: 2026-09-29
Terminology
Sources
- UniIntervene: Agentic Intervention for Efficient Real-World Reinforcement Learning
- To Err is Robotic: Rapid Value-Based Trial-and-Error during Deployment
- Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities
- Reset-Free Reinforcement Learning via Multi-Task Learning: Learning Dexterous Manipulation Behaviors without Human Intervention
- ReCoVLA: VLM-Guided Reward Compilation for Failure Recovery in Vision-Language-Action Policies
- RaC: Robot Learning for Long-Horizon Tasks by Scaling Recovery and Correction
- Recover, Discover, Plan: Learning Skills and Concepts from Robot Failures
- RoboClaw: An Agentic Framework for Scalable Long-Horizon Robotic Tasks
- FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models
- ASPIRE: Agentic /Skills Discovery for Robotics
- Human-in-the-Loop Imitation Learning using Remote Teleoperation
- $\pi^{*}_{0.6}$: a VLA That Learns From Experience
- ValueFormer: A Causal Transformer Value Function with Stage-Aware Labels for Semi-Autonomous Vision-Language-Action Policies
- Critic in the Loop: A Tri-System VLA Framework for Robust Long-Horizon Manipulation
- ProbeAct: Probe-Guided Training-Free Failure Recovery in Vision-Language-Action Models
Related papers
- FMT x: An Efficient and Asymptotically Optimal Extension of the Fast Marching Tree for Dynamic Replanning
- MPCFormer: A physics-informed data-driven approach for explainable socially-aware autonomous driving
- RoboLab: A High-Fidelity Simulation Benchmark for Analysis of Task Generalist Policies
- HRDexDB: A 4D Dexterous Grasping Dataset Across Human and Multiple Robot Embodiments
- APT: Action Expert Pretraining Improves Instruction Generalization of Vision-Language-Action Policies
- Fine-tuning is Not Enough: A Parallel Framework for Collaborative Imitation and Reinforcement Learning in End-to-end Autonomous Driving