Search papers, labs, and topics across Lattice.
2
0
4
Worst-case adversarial bandits no longer have to learn from scratch: transferring predictable task-level priors across random action sets achieves provably sublinear transfer regret with intrinsic-dimension $\mathcal{O}(\sqrt{n})$ guarantees.