Search papers, labs, and topics across Lattice.
2
0
4
0
SOCO reveals that vision models excel in semantic structure but falter in transferring correspondences across categories, exposing a significant gap in multimodal understanding.
Semantic correspondence gets a 3D boost: leveraging instance-specific 3D structure recovers from the 2D limitations of foundation models, significantly improving matching accuracy.