Search papers, labs, and topics across Lattice.
2
1
5
2
EcoSpec reveals that optimizing for expert activation costs can lead to faster decoding in large-scale MoE models, achieving significant speedups without sacrificing model performance.
Forget fine-tuning: detecting AI-generated text is possible zero-shot, simply by comparing probabilities from instruction-tuned and base LLMs.