CapField-OPD: Learning Continuous Capability Fields via Joint-Anchored Multi-Teacher On-Policy Distillation for Flow Models
cs.CV
Submitted: 2026-09-28
Updated: 2026-09-29
Code: https://github.com/black-forest-labs/flux
Terminology
Sources
- Training Diffusion Models with Reinforcement Learning
- TwinFlow: Realizing One-step Generation on Large Models with Self-adversarial Flows
- Flow-OPD: On-Policy Distillation for Flow Matching Models
- Any-OPD: Heterogeneous On-Policy Distillation for Flow-Matching Models via Representation-Space Bridging
- Rethinking Classifier-Free Guidance in On-Policy Diffusion Distillation
- TMPO: Trajectory Matching Policy Optimization for Diverse and Efficient Diffusion Alignment
- MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE
- DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models
- DreOPD: Degraded-Reference Extrapolative On-Policy Distillation for Flow-matching Models
- Pave-GRPO: Beyond Instantaneous Guidance through Principled Average Velocity Decomposition
- Flow Matching for Generative Modeling
- Flow-GRPO: Training Flow Matching Models via Online RL
- Improving Video Generation with Human Feedback
- Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow
- Z-Image: An Efficient Image Generation Foundation Model with Single-Stream Diffusion Transformer
- Coefficients-Preserving Sampling for Reinforcement Learning with Flow Matching
- PromptRL: Prompt Matters in RL for Flow-Based Image Generation
- Qwen-Image Technical Report
- Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis
- Advantage Weighted Matching: Aligning RL with Pretraining in Diffusion Models
Related papers
- Loss Knows Best: Detecting Annotation Errors in Videos via Loss Trajectories
- AnchorWeave: World-Consistent Video Generation with Retrieved Local Spatial Memories
- Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift
- MambaX-Net: Dual-Input Mamba-Enhanced Cross-Attention Network for Longitudinal MRI Segmentation
- TeleOCR: Navigating Document Parsing Across Digital and Camera-Captured Documents
- A Survey on Efficient Vision-Language-Action Models