Search papers, labs, and topics across Lattice.
Bocconi University Bocconi University Bocconi University
1
0
3
Learning $\max$@$k$-optimal policies is statistically harder than traditional reinforcement learning, revealing a critical gap in agent evaluation methods.