Search papers, labs, and topics across Lattice.
Huawei Technologies Co., Ltd
2
0
4
MXAttention achieves near-FP16 generation quality in video models while cutting computational costs, revolutionizing efficient attention mechanisms.
StreamKL slashes memory usage from quadratic to constant, enabling efficient long-context attention distillation on a single GPU.