Multi-Agent Coordination via Support-Preserving Distillation
cs.LG, cs.MA, cs.RO
Submitted: 2026-10-07
Updated: 2026-10-08
Project page: https://alex6095.github.io/mosdot/Abstract
Terminology
Sources
- Value-Guidance MeanFlow for Offline Multi-Agent Reinforcement Learning
- From Flow to One Step: Real-Time Multi-Modal Trajectory Policies via Implicit Maximum Likelihood Estimation-based Distribution Distillation
- Generative Modeling via Drifting
- Value-Decomposition Networks For Cooperative Multi-Agent Learning
- The StarCraft Multi-Agent Challenge
- Off-the-Grid MARL: Datasets with Baselines for Offline Multi-Agent Reinforcement Learning
- Advantage-Weighted Regression: Simple and Scalable Off-Policy Reinforcement Learning
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks