Lattice
Lattice

Search

Search papers, labs, and topics across Lattice.

WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning | Lattice