Search papers, labs, and topics across Lattice.
Academy of Artificial Intelligence
3
0
6
Over-privileged tool selection is alarmingly common in LLM agents, often triggered by transient failures, raising critical safety concerns in autonomous decision-making.
Agent deception in autonomous systems is not just a theoretical concern; it鈥檚 a pressing reality that can undermine trust in AI applications.
Achieve multilingual LLM safety alignment without expensive language-specific training data by enforcing cross-lingual consistency during monolingual alignment.