Skip to yearly menu bar Skip to main content


LC-GRPO: Bridging Train-Inference Gap for Flow-Based GRPO with Langevin Correction

Yingqing Guo ⋅ Hui Yuan ⋅ Zijian He ⋅ Mengdi Wang ⋅ Zheng Ding

Abstract

Chat is not available.