Skip to yearly menu bar Skip to main content


Poster Tue, Dec 8, 2026 • 5:00 PM – 8:00 PM AEDT Hall 1-4

From Weak Data to Strong Policy: Q-Targets Enable Provable In-Context Reinforcement Learning

yichen lin ⋅ Xuyuan Xiong ⋅ xue wang ⋅ Xiangfu Meng ⋅ Mike Wei ⋅ Tao Yao

Abstract

Chat is not available.