Search papers, labs, and topics across Lattice.
University of Oxford
1
0
3
None of the 30 LLM agents evaluated in CausalGame demonstrated reliable causal thinking, revealing a critical gap in AI's ability to perform scientific reasoning.