Search papers, labs, and topics across Lattice.
Affiliation:
1
0
2
Achieving 64x faster generative reranking without sacrificing quality, hLLM redefines efficiency in language model output.