Search papers, labs, and topics across Lattice.
University of California
2
0
3
Looping discrete embeddings with continuous hidden states enables near-perfect accuracy in multi-hop reasoning with fewer training steps than traditional methods.
Transformers can provably internalize chain-of-thought reasoning, matching the sample efficiency of explicit CoT while eliminating its inference overhead.