Search papers, labs, and topics across Lattice.
Beijing Academy of Artificial Intelligence
2
0
4
Current LLMs achieve only 50.64% accuracy on a new benchmark for higher-order logical reasoning, revealing a critical gap in their reasoning capabilities.
LLM agents struggle in dynamic environments, but EvoMem boosts their performance by capturing the evolution of memory, leading to better adaptability.