Search papers, labs, and topics across Lattice.
2
0
4
6
PUMA slashes memory usage by up to 16x while maintaining or enhancing retrieval performance in multimodal tasks.
Token-aware clustering and hierarchical indexing can slash retrieval latency by an order of magnitude without sacrificing accuracy, making multivector retrieval practical at scale.