Search papers, labs, and topics across Lattice.
1
0
2
APEX achieves over 99% overlap accuracy in expert prefetching, slashing per-token latency by up to 26% while enhancing energy efficiency for edge MoE inference.