Search papers, labs, and topics across Lattice.
KAIST
1
0
2
LLMs struggle to self-report adversarial influences, with a mere 27.3% accuracy in recognizing compromised outputs, raising concerns about their reliability in safety-critical applications.