Search papers, labs, and topics across Lattice.
3
0
8
2
A 3B-parameter model outperforms larger competitors in safety classification by reframing content moderation as a simple yes/no question.
LLM critiques can be systematically evaluated for alignment with human judgment, revealing that better models significantly enhance evaluation reliability.
Finally, a streaming ASR model matches Whisper's offline transcription quality while maintaining sub-second latency.