Skip to yearly menu bar Skip to main content


Poster Tue, Dec 8, 2026 • 5:00 PM – 8:00 PM AEDT Hall 1-4

Reformulate LLM Reinforcement Learning for Stable Training under Black-box Discrepancy

Jiashun Liu ⋅ Runze Liu ⋅ Xu Wan ⋅ Jing Liang ⋅ Hongyao Tang ⋅ Ling Pan

Abstract

Chat is not available.