Imagen Principal
1

Aprendizaje por Refuerzo Profundo Práctico: Aplica Métodos Modernos de RL, con Redes Q Profundas, Iteración de Valor, Gradientes de Política, TRPO, AlphaGo Zero y Más (Edición en

Imagen ampliada