Temario del curso
Fundamentos de las operaciones en la nube en AWS
- Roles y responsabilidades operativas en la nube.
- Estructura de cuentas de AWS, Organizaciones y estrategia multi-cuenta.
- Servicios operativos principales: CloudWatch, CloudTrail y AWS Config.
Infraestructura como Código y aprovisionamiento
- Principios de IaC e infraestructura inmutable.
- Aprovisionamiento con Terraform y AWS CloudFormation.
- Gestión del estado, módulos y promoción de entornos.
CI/CD y estrategias de implementación
- Diseño de canales CI/CD para aplicaciones nativas de la nube.
- Despliegues azul-verde, canario y progresivos (rolling).
- Automatización del rollback, verificaciones de estado y validación de lanzamientos.
Monitoreo, observabilidad y alertas
- Métricas, registros y trazas: enviar, almacenar y analizar.
- Uso de CloudWatch, X-Ray y herramientas de terceros para observabilidad.
- Definición de SLAs/SLOs (Acuerdos y Objetivos de Nivel de Servicio), políticas de alerta y prácticas de guardia (on-call).
Operaciones de seguridad y gestión de identidad
- Mejores prácticas de IAM, privilegio mínimo y acceso multi-cuenta.
- Gestión de secretos, KMS y almacenes de parámetros seguros.
- Seguridad operativa: estrategias de parcheo, análisis de vulnerabilidades y registros de auditoría.
Resiliencia, copias de seguridad y recuperación ante desastres
- Diseño para tolerancia a fallos y alta disponibilidad.
- Estrategias de copia de seguridad, automatización de instantáneas y procedimientos de restauración.
- Planificación de recuperación ante desastres y creación de manuales operativos.
Optimización de costos y gobernanza
- Visibilidad de costos: facturación, etiquetado y estrategias de asignación de costos.
- Ajuste de recursos (rightsizing), instancias reservadas/planes de ahorro y controles presupuestarios.
- Gobernanza: políticas, barreras de seguridad y automatización para el cumplimiento normativo.
Contenedores, serverless y operaciones en tiempo de ejecución
- Consideraciones operativas para ECS, EKS y Lambda.
- Descubrimiento de servicios, escalado automático y límites de recursos.
- Registro, trazabilidad y depuración de cargas de trabajo en contenedores.
Respuesta a incidentes, manuales de procedimiento (playbooks) e ingeniería del caos
- Respuesta a incidentes basada en manuales y prácticas de post-mortem.
- Automatización de la remediación y patrones de autorreparación.
- Introducción a experimentos de caos para validar la resiliencia.
Taller práctico: gestión de una carga de trabajo de ejemplo
- Despliegue de una aplicación de ejemplo utilizando IaC y un canal CI/CD.
- Implementación de monitoreo, alertas y un script de remediación automatizada.
- Simulación de incidentes y práctica de respuesta basada en manuales operativos.
Resumen y próximos pasos
Requerimientos
- Comprensión básica de los conceptos de nube y redes.
- Familiaridad con la línea de comandos y scripting en Linux.
- Experiencia con control de versiones (Git) y conceptos básicos de CI/CD.
Dirigido a
- Ingenieros de operaciones en la nube.
- Ingenieros SRE y de plataforma.
- Ingenieros DevOps y líderes técnicos de equipo.
Reseñas (1)
He descubierto cosas nuevas y interesantes sobre Lambda y Serverless
Oleg Buldumac - PUBLIC COURSE
Curso - AWS Lambda for Developers
Traducción Automática