Search papers, labs, and topics across Lattice.
Beijing University of Posts and Telecommunications
2
0
4
Current multimodal large language models are highly susceptible to situational illusions, revealing critical vulnerabilities in their reasoning and perception capabilities.
MiShield outperforms leading moderation tools by effectively identifying harmful semantics in multi-image content that appear benign in isolation.