Ponte en Contacto

Temario del curso

Fundamentos de los sistemas agénticos en producción

  • Arquitecturas agénticas: bucles, herramientas, memoria y capas de orquestación
  • Ciclo de vida de los agentes: desarrollo, despliegue y operación continua
  • Desafíos de la gestión de agentes a escala de producción

Infraestructura y modelos de despliegue

  • Despliegue de agentes en entornos contenerizados y en la nube
  • Patrones de escalabilidad: escalado horizontal vs vertical, concurrencia y limitación de tasa (throttling)
  • Orquestación multiagente y equilibramiento de cargas de trabajo

Monitoreo y observabilidad

  • Métricas clave: latencia, tasa de éxito, uso de memoria y profundidad de llamadas del agente
  • Trazado de la actividad de agentes y grafos de llamadas
  • Instrumentación de observabilidad utilizando Prometheus, OpenTelemetry y Grafana

Registros (logging), auditoría y cumplimiento

  • Registro centralizado y recopilación estructurada de eventos
  • Cumplimiento normativo y capacidad de auditoría en flujos de trabajo agénticos
  • Diseño de trazas de auditoría y mecanismos de reproducción (replay) para depuración

Ajuste de rendimiento y optimización de recursos

  • Reducción de la sobrecarga de inferencia y optimización de ciclos de orquestación de agentes
  • Caché de modelos y embeddings ligeros para una recuperación más rápida
  • Pruebas de carga y escenarios de estrés para pipelines de IA

Control de costos y gobernanza

  • Comprensión de los impulsores de costos de los agentes: llamadas a API, memoria, cómputo e integraciones externas
  • Seguimiento de costos a nivel de agente e implementación de modelos de facturación por uso (chargeback)
  • Políticas de automatización para prevenir la proliferación de agentes y el consumo inactivo de recursos

Estrategias de CI/CD e implementación para agentes

  • Integración de pipelines de agentes en sistemas de CI/CD
  • Estrategias de pruebas, versionado y reversión para actualizaciones iterativas de agentes
  • Implementaciones progresivas y mecanismos de despliegue seguro

Recuperación de fallos e ingeniería de confiabilidad

  • Diseño para tolerancia a fallos y degradación gradual
  • Patrones de reintentos (retry), tiempo de espera (timeout) y disyuntor (circuit breaker) para la confiabilidad de los agentes
  • Respuesta a incidentes y marcos de posmortem para operaciones de IA

Proyecto Capstone

  • Construir y desplegar un sistema de IA agéntica con monitoreo completo y seguimiento de costos
  • Simular carga, medir el rendimiento y optimizar el uso de recursos
  • Presentar la arquitectura final y el panel de monitoreo a pares

Resumen y próximos pasos

Requerimientos

  • Sólido conocimiento de MLOps y sistemas de aprendizaje automático de producción
  • Experiencia con despliegues contenerizados (Docker/Kubernetes)
  • Conocimiento de herramientas de optimización de costos en la nube y de observabilidad

Público Objetivo

  • Ingenieros de MLOps
  • Ingenieros de Confiabilidad del Sitio (SRE)
  • Gerentes de ingeniería responsables de infraestructura de IA
 21 Horas

Número de participantes


Precio por participante

Reseñas (3)

Próximos cursos

Categorías Relacionadas