Skip to yearly menu bar Skip to main content


Poster Thu, Dec 10, 2026 • 2:00 AM – 5:00 AM AEDT Hall C1

$f$-GRPO & Beyond: Divergence-Based Reinforcement Learning Algorithms for General LLM Alignment

Rajdeep Haldar ⋅ Lantao Mei ⋅ Guang Lin ⋅ Yue XING ⋅ Qifan Song

Abstract

Chat is not available.