Search papers, labs, and topics across Lattice.
2
0
3
Over 15% of benchmark failures for computer-use agents are misclassified, revealing critical flaws in current evaluation methods.
AAPT boosts GUI agent success rates by 58% in decision-critical moments, eliminating delays without sacrificing accuracy.