Search papers, labs, and topics across Lattice.
2
0
5
0
Agents can now seamlessly transition between seeking and following tasks in dynamic environments, setting a new benchmark for embodied AI performance.
Ditch slow, error-prone autoregressive video captioning: diffusion models can now generate captions in parallel, rivaling autoregressive quality with a significant speed boost.