Search papers, labs, and topics across Lattice.
1
0
2
Abandoning biased offline critics leads to more efficient online reinforcement learning, achieving superior performance on challenging tasks.