Search papers, labs, and topics across Lattice.
2
0
3
Standard Gaussian teacher assumptions hide severe optimization traps: hidden node alignment alone dictates whether gradient descent fails into boundary versus interior local minima.
Imbalanced pretraining curricula can significantly enhance the precision of fine-tuning by promoting disentangled representations in neural networks.