Search papers, labs, and topics across Lattice.
Peking University
2
0
4
Achieving a mean visual order consistency of 0.9872, Robo-Dopamine 2.0 significantly outperforms traditional reward models, demonstrating its superior ability to handle OOD scenarios in robotic manipulation.
Action-conditioned world models may be failing in fundamental ways, with systematic degradation in simulator fidelity revealed by a new diagnostic framework.