Search papers, labs, and topics across Lattice.
2
0
5
0
DSAQuant reveals that aligning quantization training with the stage-wise nature of video diffusion can drastically enhance visual fidelity in text-to-video generation.
Adversarial attacks on vision-language agents reveal critical vulnerabilities, with multi-view optimization strategies proving significantly more effective than isolated approaches.