Contacta con nosotros

Temario del curso

Fundamentos de los Sistemas Agénticos en Producción

  • Arquitecturas agénticas: bucles, herramientas, memoria y capas de orquestación
  • Ciclo de vida de los agentes: desarrollo, despliegue y operación continua
  • Desafíos de la gestión de agentes a escala de producción

Modelos de Infraestructura y Despliegue

  • Despliegue de agentes en entornos contenerizados y en la nube
  • Patrones de escalado: horizontal vs. vertical, concurrencia y limitación de velocidad (throttling)
  • Orquestación multi-agente y balanceo de cargas de trabajo

Monitoreo y Observabilidad

  • Métricas clave: latencia, tasa de éxito, uso de memoria y profundidad de llamadas del agente
  • Rastreamiento de la actividad del agente y grafos de llamadas
  • Instrumentación de la observabilidad usando Prometheus, OpenTelemetry y Grafana

Registro de Eventos, Auditoría y Cumplimiento

  • Registro centralizado de eventos y recolección estructurada de sucesos
  • Cumplimiento y auditable en flujos de trabajo agénticos
  • Diseño de registros de auditoría y mecanismos de reproducción para depuración

Ajuste de Rendimiento y Optimización de Recursos

  • Reducción de la sobrecarga de inferencia y optimización de los ciclos de orquestación del agente
  • Caché de modelos e incrustaciones ligeras para una recuperación más rápida
  • Pruebas de carga y escenarios de estrés para pipelines de IA

Control de Costos y Gobernanza

  • Comprensión de los factores que impulsan el costo del agente: llamadas a la API, memoria, procesamiento e integraciones externas
  • Rastreo de costos a nivel de agente y implementación de modelos de recargo (chargeback)
  • Políticas de automatización para prevenir la expansión descontrolada de agentes y el consumo de recursos inactivos

CI/CD y Estrategias de Despliegue para Agentes

  • Integración de pipelines de agentes en sistemas CI/CD
  • Estrategias de prueba, control de versiones y reversión para actualizaciones iterativas de agentes
  • Despliegues progresivos y mecanismos de despliegue seguro

Recuperación ante Fallas e Ingeniería de Confiabilidad

  • Diseño para la tolerancia a fallos y la degradación elegante
  • Patrones de reintento, tiempo de espera y interruptor de circuito (circuit breaker) para la confiabilidad del agente
  • Respuesta a incidentes y marcos post-mortem para operaciones de IA

Proyecto Final

  • Construir e implementar un sistema de IA agéntica con monitoreo completo y seguimiento de costos
  • Simular carga, medir el rendimiento y optimizar el uso de recursos
  • Presentar la arquitectura final y el panel de monitoreo a los compañeros

Resumen y Próximos Pasos

Requerimientos

  • Sólido entendimiento de MLOps y sistemas de aprendizaje automático en producción
  • Experiencia con despliegues contenerizados (Docker/Kubernetes)
  • Familiaridad con herramientas de optimización de costos en la nube y observabilidad

Público Objetivo

  • Ingenieros de MLOps
  • Ingenieros de Confiabilidad del Sitio (SRE)
  • Gerentes de ingeniería que supervisaron infraestructura de IA
 21 Horas

Número de participantes


Precio por participante

Reseñas (3)

Próximos cursos

Categorías Relacionadas