Search papers, labs, and topics across Lattice.
2
0
4
HyperSafe slashes harmful response rates in fine-tuned language models to below 1% without sacrificing task performance, revolutionizing safety alignment strategies.
Pre-trained vision encoders are shockingly bad at distinguishing identity when background context is controlled, but a simple contrastive learning scheme can fix it.