Diffusion Reward Models
cs.LG, cs.AI
Submitted: 2026-09-27
Updated: 2026-09-27
Code: https://github.com/thunlp/DRM
Terminology
Sources
- Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback
- Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback
- RM-R1: Reward Modeling as Reasoning
- UltraFeedback: Boosting Language Models with Scaled AI Feedback
- RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment
- Quantile Regression for Distributional Reward Models in RLHF
- Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains
- AIR: A Systematic Analysis of Annotations, Instructions, and Response Pairs in Preference Dataset
- Classifier-Free Diffusion Guidance
- Tulu 3: Pushing Frontiers in Open Language Model Post-Training
- Aligning Crowd Feedback via Distributional Preference Reward Modeling
- Flow Matching for Generative Modeling
- Skywork-Reward: Bag of Tricks for Reward Modeling in LLMs
- Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy
- Uncertainty-aware Reward Model: Teaching Reward Models to Know What is Unknown
- Generative Reward Models
- RewardBench 2: Advancing Reward Model Evaluation
- Proximal Policy Optimization Algorithms
- DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models
- Denoising Diffusion Implicit Models
Related papers
- Polynomial-Augmented Neural Networks (PANNs) with Weak Orthogonality Constraints for Enhanced Function and PDE Approximation
- AIRL-S: Unifying Reinforcement Learning and Search-Based Test-Time Scaling via Adversarial Inverse Reinforcement Learning
- Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation
- Convergence issues in Relational Concept Analysis based on AOC-posets
- Beliefs Beyond Posteriors: Local-Consistency Optimisation for Bayesian Neural Networks
- Understanding Diffusion Models via Ratio-Based Function Approximation with SignReLU Networks