Search papers, labs, and topics across Lattice.
3
0
5
0
Achieving up to 2.3x throughput gains, HYDRA reveals that co-designing architecture and runtime policies is essential for optimizing hybrid LLM workloads on chiplet systems.
Achieving up to 1.44X speedup in GPU performance by radically rethinking task scheduling and resource utilization in CUDA pipelines.
LLMs can run up to 35% faster on chiplet architectures thanks to a new lossless exponent compression technique that slashes inter-chiplet communication overhead.