Skip to yearly menu bar Skip to main content


Poster Thu, Dec 10, 2026 • 5:00 PM – 8:00 PM AEDT Hall 1-4

PRPO: Perception-Reinforced Policy Optimization via Token-Level Dynamic Advantage Reshaping

Qiming Li ⋅ Tianlun Li ⋅ Xiaolong Cheng ⋅ Hangyu Li ⋅ Ruiyan Gong ⋅ Kangning Niu ⋅ kaitao jiang ⋅ Mu Xu

Abstract

Chat is not available.