Search papers, labs, and topics across Lattice.
Affiliation:
1
0
3
4
Fine-tuning with sparse attention can outperform traditional exact attention models while running efficiently on modest hardware.