Implementación de Redes Q Profundas para el Control Autónomo en Flappy Bird

Arquitectura del Sistema y Preprocesamiento El aprendizaje por refuerzo profundo permite que los agentes artificiales aprendan políticas de control óptimas mediante la interacción directa con el entorno. En este contexto, el juego Flappy Bird representa un problema clásico de control continuo con un espacio de estados visual y recompensas dispe ...

Publicado el 10-3 10:24