Skip to yearly menu bar Skip to main content


Poster Fri, Dec 11, 2026 • 2:00 AM – 5:00 AM AEDT Hall C1

DORA: A Scalable Asynchronous Reinforcement Learning System for Language Model Training

Tianhao Hu ⋅ Xiangcheng Liu ⋅ Yuchun Miao ⋅ Youshao Xiao ⋅ Hong Yu Zang ⋅ Yang Zheng ⋅ huang xuan ⋅ Jinrui Ding ⋅ Yufei Zhang ⋅ Yu Yang ⋅ Yi-Kai Zhang ⋅ Yueqing Sun ⋅ Chengcheng Han ⋅ Xiandi Ma ⋅ Wei Wang ⋅ Qi GU ⋅ Yerui Sun ⋅ Yuchen Xie ⋅ Xunliang Cai

Abstract

Chat is not available.