RL-Teacher
ProductOpenAIarchived
Open-source implementation for training agents from human preference feedback.
- Aug 3, 2017
- —
- —
- Yes
- —
- 2
Releases
Aug 3, 2017RL-Teacher code releasedSDK release
OpenAI released code for training reinforcement-learning agents from human feedback.
Jun 13, 2017Learning from human preferences research publishedResearch paper
OpenAI and DeepMind researchers showed how agents can learn complex behavior from human preference comparisons.

