VLM-Guided Experience Replay
cs.LG, cs.AI
Submitted: 2026-02-02
Updated: 2026-09-27
Terminology
Sources
- Do As I Can, Not As I Say: Grounding Language in Robotic Affordances
- TorchRL: A data-driven decision-making library for PyTorch
- Uncertainty Prioritized Experience Replay
- PerceptionLM: Open-Access Data and Models for Detailed Visual Understanding
- Investigating Human Priors for Playing Video Games
- FuRL: Visual-Language Models as Fuzzy Rewards for Reinforcement Learning
- Preference VLM: Leveraging VLMs for Scalable Preference-Based Reinforcement Learning
- Foundation Models for Semantic Novelty in Reinforcement Learning
- Soft Actor-Critic Algorithms and Applications
- Topological Experience Replay
- Large Batch Experience Replay
- ROER: Regularized Optimal Experience Replay
- Code as Policies: Language Model Programs for Embodied Control
- Enhancing Rating-Based Reinforcement Learning to Effectively Leverage Feedback from Large Vision-Language Models
- Playing Atari with Deep Reinforcement Learning
- OGBench: Benchmarking Offline Goal-Conditioned RL
- Vision-Language Models are Zero-Shot Reward Models for Reinforcement Learning
- Prioritized Experience Replay
- The Evolving Landscape of LLM- and VLM-Integrated Reinforcement Learning
- VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks