Search papers, labs, and topics across Lattice.
Harvard University, Kempner Institute
1
0
2
Amortizing distillation across model size and variant can produce a continuum of optimized LLMs with a single distillation run, revolutionizing model deployment efficiency.