Skip to content
FriedParrot's Website
Search
K
Main Navigation
Knowledge Base
Posts
Projects
About Me
Appearance
Menu
Return to top
Outline
Reinforcement Learning
Notes
1. Trust Region Policy Optimization (TRPO)