Search papers, labs, and topics across Lattice.
National Interdisciplinary Research Center of Engineering Physics
2
0
3
9
Multi-item users can face significantly more powerful poisoning attacks, but a new method achieves robust estimation without sacrificing performance.
LLMs leak risk signals in their hidden state trajectories during decoding, enabling a 95% effective jailbreak defense without training or modifying the model.