Contacta con nosotros

Temario del curso

Introducción al Aprendizaje por Refuerzo

  • Visión general del aprendizaje por refuerzo y sus aplicaciones.
  • Diferencias entre el aprendizaje supervisado, no supervisado y por refuerzo.
  • Conceptos clave: agente, entorno, recompensas y política.

Procesos de Decisión de Markov (MDP)

  • Comprensión de estados, acciones, recompensas y transiciones de estado.
  • Funciones de valor y la Ecuación de Bellman.
  • Programación dinámica para resolver MDPs.

Algoritmos Clave de AR

  • Métodos tabulares: Q-Learning y SARSA.
  • Métodos basados en políticas: algoritmo REINFORCE.
  • Arquitecturas Actor-Crítico y sus aplicaciones.

Aprendizaje Profundo por Refuerzo

  • Introducción a las Redes Cerebro-Q profundas (DQN).
  • Memoria de experiencia y redes objetivo.
  • Gradientes de política y métodos avanzados de AR profundo.

Marcos de Trabajo y Herramientas de AR

  • Introducción a OpenAI Gym y otros entornos de AR.
  • Uso de PyTorch o TensorFlow para el desarrollo de modelos de AR.
  • Entrenamiento, pruebas y evaluación comparativa de agentes de AR.

Desafíos en AR

  • Equilibrio entre exploración y explotación durante el entrenamiento.
  • Manejo de recompensas escasas y problemas de asignación de crédito.
  • Escalabilidad y desafíos computacionales en AR.

Actividades Prácticas

  • Implementación de los algoritmos Q-Learning y SARSA desde cero.
  • Entrenamiento de un agente basado en DQN para jugar un juego simple en OpenAI Gym.
  • Ajuste fino de modelos de AR para mejorar el rendimiento en entornos personalizados.

Resumen y Próximos Pasos

Requerimientos

  • Conocimiento sólido de los principios y algoritmos del aprendizaje automático.
  • Dominio de la programación en Python.
  • Familiaridad con redes neuronales y marcos de trabajo de aprendizaje profundo.

Público Objetivo

  • Ingenieros de aprendizaje automático.
  • Especialistas en IA.
 14 Horas

Número de participantes


Precio por participante

Próximos cursos

Categorías Relacionadas