Search papers, labs, and topics across Lattice.
3
0
3
3
HPSD enables TI2V models to internalize high-quality visual cues, resulting in a remarkable boost in text-to-video performance while simultaneously enhancing image-to-video generation.
Video diffusion models can revolutionize hand motion reconstruction, achieving unprecedented accuracy without relying on traditional detection or optimization techniques.
Text-to-image flow models can achieve superior preference alignment by augmenting the condition space, creating a "dense" reward mapping that better captures inter-sample relationships.