Search papers, labs, and topics across Lattice.
Xi鈥檃n Jiaotong University
3
0
6
DataClaw_0 can transform chaotic multimodal data into structured, high-quality datasets, enhancing AI's ability to learn from less information.
VLMs often fail at spatial reasoning because they either ignore visual cues or exhibit unstable reasoning, but a novel process-shaping framework can fix this.
RL agents can learn more robust vision-and-language navigation policies by exploring diverse trajectories and comparing their performance, even without expert demonstrations or value networks.