Search papers, labs, and topics across Lattice.
1
0
2
9
Discarding irrelevant reasoning tokens can make language models up to 3x faster at test time without sacrificing performance.