Search papers, labs, and topics across Lattice.
Zhejiang University
2
0
4
Adversaries can exploit multimodal guardrails to misclassify safe inputs as unsafe, achieving an alarming 84% success rate in disrupting service availability.
MTGuard effectively reduces harmful tool use in LLM agents, combining static and dynamic analysis to enhance security without sacrificing performance.