Search papers, labs, and topics across Lattice.
2
0
3
0
Masking just 20 Visual Retrieval Heads in VLMs can lead to an 80-point drop in grounding accuracy, revealing their critical role in visual information extraction.
Low early cue precision can enhance conflict behavior in visual classifiers, but shortcut-rich fine-tuning risks erasing this advantage.