Search papers, labs, and topics across Lattice.
1
0
2
Extending speculation horizons can backfire, but SparseSpec-L smartly navigates this trade-off to achieve substantial speedups in long-context inference without sacrificing output quality.