Search papers, labs, and topics across Lattice.
Zhejiang University
2
0
6
TASPO bridges the supervision-credit gap in reinforcement learning, leading to a 10.6% performance boost over traditional methods.
Achieve state-of-the-art fine-grained visual recognition without training by adaptively invoking reasoning in a Large Vision-Language Model only when needed, significantly reducing computational overhead.