A Continuous-Time Reinforcement Learning Framework for Fine-Tuning Discrete Diffusion Models

arXiv:2607.14522 · cs.LG · Submitted 2026-07-16 · Read on arXiv

cs.LG

Submitted: 2026-07-16

Updated: 2026-09-26

Code: https://github.com/dllm-reasoning/d1

Terminology

Sources

Related papers