Implementación de Redes Q Profundas para el Control Autónomo en Flappy Bird
Arquitectura del Sistema y Preprocesamiento
El aprendizaje por refuerzo profundo permite que los agentes artificiales aprendan políticas de control óptimas mediante la interacción directa con el entorno. En este contexto, el juego Flappy Bird representa un problema clásico de control continuo con un espacio de estados visual y recompensas dispe ...
Publicado el 10-3 10:24