Skip to yearly menu bar Skip to main content


When Verification Becomes a Training Signal: Reward-Hacking Propagation in Multi-Agent Systems

Rishikesh K Muralimohan ⋅ Yash A Patil ⋅ Vatsal Desai ⋅ Cuong H Nguyen ⋅ Diksha Shrivastava

Abstract

Chat is not available.