Search papers, labs, and topics across Lattice.
2
0
2
A single learned policy can safely coordinate multiple drones in dynamic environments, outperforming existing methods in safety and scalability.
Forget hand-engineering initial conditions for robust RL: this method *learns* which conditions are feasible while simultaneously training a safe policy.