Search papers, labs, and topics across Lattice.
University of Oxford
1
0
3
Downstream reinforcement learning easily restores stolen reasoning performance from degraded API outputs, exposing critical vulnerabilities in current frontier model distillation defenses.