Retimed Bellman Flows: Escaping the Impossible Triangle of Velocity Bootstrapping
cs.LG
Submitted: 2026-09-26
Updated: 2026-09-26
Terminology
Sources
- floq: Training Critics via Flow-Matching for Scaling Compute in Value-Based RL
- Distributed Distributional Deterministic Policy Gradients
- Unleashing Flow Policies with Distributional Critics
- Implicit Quantile Networks for Distributional Reinforcement Learning
- Expressive Value Learning for Scalable Offline Reinforcement Learning
- Temporal Difference Flows
- D4RL: Datasets for Deep Data-Driven Reinforcement Learning
- Offline Reinforcement Learning with Implicit Q-Learning
- Bellman Diffusion: Generative Modeling as Learning a Linear Operator in the Distribution Space
- Flow Matching for Generative Modeling
- Flow Matching Guide and Code
- Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow
- Improving and generalizing flow-based generative models with minibatch optimal transport
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks