Skip to yearly menu bar Skip to main content


SynCo: Data Synthesis Co-Training for Self-Evolving LLMs via Multi-Agent Reinforcement Learning

Wei Yang ⋅ Li Li ⋅ Yuehan Qin ⋅ Yawei Wang ⋅ Mingxi Wang ⋅ Shixuan Li ⋅ Tiankai Yang ⋅ Jiate Li ⋅ Jesse Thomason ⋅ Xuezhe Ma ⋅ Yue Zhao

Abstract

Chat is not available.