Reward Machines: Structuring Reward Function Specifications and Reducing Sample Complexity in RL
- Sheila Mcllraith | University of Toronto
Reinforcement Learning Day 2019:
Reward Machines: Structuring Reward Function Specifications and Reducing Sample Complexity in Reinforcement Learning