Skip to yearly menu bar Skip to main content


From $P(y|x)$ to $P(y)$: Investigating Reinforcement Learning in Pre-train Space

Yuqiao Tan ⋅ Minzheng Wang ⋅ Bo Liu ⋅ Zichen Liu ⋅ Shizhu He ⋅ Jun Zhao ⋅ Kang Liu

Abstract

Chat is not available.