A Unified Benchmark for Dynamic Medical Treatment Reinforcement Learning
cs.LG
Submitted: 2026-05-31
Updated: 2026-09-24
License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
Terminology
Sources
- ICU-Sepsis: A Benchmark MDP Built from Real Medical Data
- Evaluating Reinforcement Learning Algorithms in Observational Health Settings
- Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems
- DTR-Bench: An in silico Environment and Benchmark Platform for Reinforcement Learning Based Dynamic Treatment Regime
- Playing Atari with Deep Reinforcement Learning
- Lagrangian Duality in Reinforcement Learning
- Proximal Policy Optimization Algorithms
- Data-Efficient Off-Policy Policy Evaluation for Reinforcement Learning
- Guardian-regularized Safe Offline Reinforcement Learning for Smart Weaning of Mechanical Circulatory Devices
- Empirical Study of Off-Policy Policy Evaluation for Reinforcement Learning
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks