Search papers, labs, and topics across Lattice.
Affiliation:
2
0
4
Achieving up to 64.34脳 speedup in dynamic GPU workloads, DB-SpMSpV redefines the efficiency of Sparse Matrix-Sparse Vector Multiplication.
DiT activations are far more amenable to semi-structured sparsity than weights, unlocking significant inference speedups without sacrificing generation quality.