Skip to yearly menu bar Skip to main content


Poster Thu, Dec 10, 2026 • 10:00 AM – 1:00 PM AEDT Hall 1-4

Reward Budgeting Reduces Premature Convergence in Reinforcement Learning for LLM Reasoning

Mengni Jia ⋅ Mengyu Zhou ⋅ xiaoxi jiang ⋅ Guanjun Jiang

Abstract

Chat is not available.