Search papers, labs, and topics across Lattice.
The University of Texas at Austin
1
0
3
Caching intermediate features can slash inference latency by up to 35% in diffusion models without sacrificing quality or requiring retraining.