Skip to yearly menu bar Skip to main content


Poster Wed, Dec 9, 2026 • 10:00 AM – 1:00 PM AEDT Hall 1-4

HiFloat4 Format for End-To-End Reinforcement Learning Post-Training of Large Language Models

Hei Yi Mak ⋅ Shadan Golestan ⋅ Hoang Le ⋅ Mehran Taghian Jazi ⋅ Yunke Peng ⋅ Yaoyuan Wang ⋅ Yao Wang ⋅ JUNSONG WANG ⋅ Tianchi Hu ⋅ Fengchen He ⋅ Guipeng Hu ⋅ Tanzila Rahman ⋅ Anandharaju D Raju

Abstract

Chat is not available.