Search papers, labs, and topics across Lattice.
4
0
5
Over 15% of benchmark failures for computer-use agents are misclassified, revealing critical flaws in current evaluation methods.
AAPT boosts GUI agent success rates by 58% in decision-critical moments, eliminating delays without sacrificing accuracy.
By decoupling semantic reasoning from spatial grounding, AnchorSeg achieves unprecedented accuracy in reasoning segmentation tasks.
Forget brute-force search: CoT2-Meta shows that strategically controlling reasoning trajectories with metacognition yields significant gains in accuracy and compute efficiency across a wide range of reasoning tasks.