Search papers, labs, and topics across Lattice.
1
0
4
15
Strong performance in static evaluations masks a critical flaw: LLMs struggle to adapt to evolving user intent during multi-turn interactions.