Search papers, labs, and topics across Lattice.
2
0
2
16
Reducing denoising iterations by 2.7 times while boosting performance by 3.5% reveals a new frontier in optimizing diffusion policies for continuous control.
Unmasked policy gradient methods can inadvertently suppress valid actions in unvisited states, creating a hidden exploration bottleneck that masking neatly avoids.