Logarithmic regret algorithms for online convex optimization
A Steepest-Ascent Method for Solving Optimum Programming Problems
Stochastic Constraint Programming as Reinforcement Learning
Algorithmic Progress in Six Domains
Smooth markets: A basic mechanism for organizing gradient-based learners