Contacta con nosotros

Temario del curso

Introducción al Aprendizaje por Refuerzo

  • Visión general del aprendizaje por refuerzo y sus aplicaciones
  • Diferencias entre aprendizaje supervisado, no supervisado y por refuerzo
  • Conceptos clave: agente, entorno, recompensas y política

Procesos de Decisión de Markov (MDP)

  • Comprensión de estados, acciones, recompensas y transiciones de estado
  • Funciones de valor y la Ecuación de Bellman
  • Programación dinámica para resolver MDP

Algoritmos Core del AR

  • Métodos tabulares: Q-Learning y SARSA
  • Métodos basados en políticas: algoritmo REINFORCE
  • Marcos Actor-Crítico y sus aplicaciones

Aprendizaje por Refuerzo Profundo

  • Introducción a las Redes Cerebrales Profundas (DQN)
  • Replay de experiencias y redes objetivo
  • Gradientes de políticas y métodos avanzados de AR profundo

Marcos y Herramientas del AR

  • Introducción a OpenAI Gym y otros entornos de AR
  • Uso de PyTorch o TensorFlow para el desarrollo de modelos de AR
  • Entrenamiento, pruebas y evaluación de agentes de AR

Desafíos en el Aprendizaje por Refuerzo

  • Equilibrar la exploración y la explotación durante el entrenamiento
  • Manejo de recompensas escasas y problemas de asignación de crédito
  • Escalabilidad y desafíos computacionales en el aprendizaje por refuerzo

Actividades Prácticas

  • Implementación de algoritmos Q-Learning y SARSA desde cero
  • Entrenamiento de un agente basado en DQN para jugar un juego simple en OpenAI Gym
  • Ajuste fino de modelos de AR para mejorar el rendimiento en entornos personalizados

Resumen y Próximos Pasos

Requerimientos

  • Sólida comprensión de los principios y algoritmos del aprendizaje automático
  • Dominio de la programación en Python
  • Familiaridad con redes neuronales y marcos de aprendizaje profundo

Público Objetivo

  • Ingenieros de aprendizaje automático
  • Especialistas en inteligencia artificial
 14 Horas

Número de participantes


Precio por participante

Próximos cursos

Categorías Relacionadas