Search papers, labs, and topics across Lattice.
Affiliation:
2
0
4
0
Strong benchmark scores can mask critical failures in LLMs' ability to apply individual content moderation criteria effectively.
Fine-tuning small-to-medium LLMs can be dramatically improved with just two online rollouts, reshaping efficiency in model training.