Skip to content

Latest commit

 

History

14 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 

Repository files navigation

Policy Gradient by Finite-Difference

Compute the policy gradient by old fasion style, finite difference.

Requirements

  • chainer
  • numpy
  • matplotlib

Best parameter

[-0.565921, -0.2087926, -2.46556049, -0.91585176, 0.33338258, 0.41990558, -5.056393, 0.57013692, 1.08717598, -0.2268253, 0.28361697, -0.76006312, -1.92836859, -3.53624301, -2.75193499, 1.73638419]

About

Policy Gradient reinforcement learning with Finite-Difference

Topics

Resources

Stars

1 star

Watchers

1 watching

Forks

Releases

Packages

Contributors

Languages