Skip to yearly menu bar Skip to main content


Poster Wed, Dec 9, 2026 • 10:00 AM – 1:00 PM AEDT Hall 1-4

Composition-RL: Compose Your Verifiable Prompts for Reinforcement Learning of Large Language Models

Xin Xu ⋅ Clive Bai ⋅ Kai Yang ⋅ Tianhao Chen ⋅ Yuchen Cai ⋅ Yangkun Chen ⋅ Weijie Liu ⋅ Hao CHEN ⋅ Yang Wang ⋅ Saiyong Yang ⋅ Can Yang

Abstract

Chat is not available.