Search papers, labs, and topics across Lattice.
1
0
5
Achieving optimal policies in robust MDPs is possible with a polynomial-time algorithm that guarantees satisfaction against adversarial environments.