Search papers, labs, and topics across Lattice.
2
0
4
3
RPAM reveals a robust connection between upstream evaluations and real-world biases, outperforming traditional downstream metrics in assessing language model associations.
The hardest AI tasks remain largely unsolved, with current models achieving only a 2.6% success rate on economically valuable workflows.