Search papers, labs, and topics across Lattice.
Affiliation:
2
0
3
Cinematic multi-shot video generators are surprisingly poor editors: aesthetic visual quality correlates only weakly with a model's actual ability to follow fundamental cinematic grammar like J-cuts, transition timing, and montage.
Semantic Affine Consistency transforms how visual tokenizers align latent semantics, resulting in a 26% reduction in gFID and setting a new benchmark for diffusion models.