Skip to content

Instantly share code, notes, and snippets.

@pyliaorachel
Created June 3, 2018 09:02
Show Gist options
  • Select an option

  • Save pyliaorachel/4eb532f32a93695d4fb244998e4be49e to your computer and use it in GitHub Desktop.

Select an option

Save pyliaorachel/4eb532f32a93695d4fb244998e4be49e to your computer and use it in GitHub Desktop.
OpenAI Gym CartPole - Hand-made Policy (learn)
env = gym.make('CartPole-v0')
for i_episode in range(200):
observation = env.reset()
rewards = 0
for t in range(250):
env.render()
action = choose_action(observation)
observation, reward, done, info = env.step(action)
rewards += reward
if done:
print('Episode finished after {} timesteps, total rewards {}'.format(t+1, rewards))
break
env.close()
Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment