Search papers, labs, and topics across Lattice.
1
0
2
Visually grounded linguistic guidance transforms dense video captioning by dynamically adapting to semantic changes, leading to superior event localization.