Search papers, labs, and topics across Lattice.
1
0
2
Up to 60% of attention heads can be pruned during domain adaptation without sacrificing performance, revealing a new avenue for efficient model tuning.