Skip to yearly menu bar Skip to main content


Reinforcing Multi-Turn Reasoning in LLM Agents via Turn-Level Reward Design and Credit Assignment

Quan Wei ⋅ Siliang Zeng ⋅ Chenliang Li ⋅ William Brown ⋅ oana frunza ⋅ Wei Deng ⋅ Yuriy Nevmyvaka ⋅ Yang Zhao ⋅ Alfredo Garcia ⋅ Mingyi Hong

Abstract

Chat is not available.