Melo, L., & Máximo, M. 2019 out 23. Learning Humanoid Robot Running Skills through Proximal Policy Optimization. Anais do Simpósio Brasileiro de Robótica. [Online] :