Out-of-Distribution Generalisation with Sequence Models in Offline Multi-Agent Reinforcement Learning
cs.LG, cs.AI
Submitted: 2026-09-03
Updated: 2026-09-03
Project page: https://sites.google.com/view/multi-task-marl
Terminology
Sources
- Multi-Agent Reinforcement Learning with Selective State-Space Models
- Scaling laws for single-agent reinforcement learning
- Offline Decentralized Multi-Agent Reinforcement Learning
- Pre-Training for Robots: Offline RL Enables Learning New Tasks from a Handful of Trials
- Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems
- Offline Multi-Agent Reinforcement Learning via In-Sample Sequential Policy Optimization
- The StarCraft Multi-Agent Challenge
- Retentive Network: A Successor to Transformer for Large Language Models
- Nearly Minimax Optimal Offline Reinforcement Learning with Linear Function Approximation: Single-Agent MDP and Markov Game
- Believe What You See: Implicit Constraint Approach for Offline Multi-Agent Reinforcement Learning
- Offline Learning in Markov Games with General Function Approximation
- Offline-to-Online Multi-Agent Reinforcement Learning with Offline Value Function Memory and Sequential Exploration
- Pessimistic Minimax Value Iteration: Provably Efficient Equilibrium Learning from Offline Datasets
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks