Search papers, labs, and topics across Lattice.
2
0
4
0
Rollout activation quantization, not training-side errors, is the hidden culprit behind FP4 RL accuracy degradation, and a clever residual correction can bridge the gap to full precision.
MXAttention achieves near-FP16 generation quality in video models while cutting computational costs, revolutionizing efficient attention mechanisms.