Skip to yearly menu bar Skip to main content


Poster Tue, Dec 8, 2026 • 10:00 AM – 1:00 PM AEDT Hall 1-4

Towards Optimal Pre-training Data Mixtures for Empowering Reinforcement Learning in LLMs

Xue Han ⋅ Qian Hu ⋅ Yitong Wang ⋅ WenChun Gao ⋅ Lianlian Zhang ⋅ Qing Wang ⋅ Lijun Mei ⋅ Zhaoxuefeng ⋅ Junlan Feng

Abstract

Chat is not available.