Search papers, labs, and topics across Lattice.
Zhejiang University
2
0
3
Tool-augmented models can achieve high accuracy without visual inputs, relying instead on structured text scaffolds to guide reasoning.
Relationship-aware 3D scene understanding can significantly enhance open-vocabulary segmentation, outperforming traditional methods that ignore object relationships.