Temario del curso
Fundamentos de las Operaciones de Cloud en AWS
- Roles y responsabilidades operativas en la nube
- Estructura de cuentas de AWS, organizaciones y estrategia multi-cuenta
- Servicios operativos principales: CloudWatch, CloudTrail, AWS Config
Infraestructura como Código (IaC) y Aprovisionamiento
- Principios de IaC e infraestructura inmutable
- Aprovisionamiento con Terraform y AWS CloudFormation
- Gestión de estado, módulos y promoción de entornos
CI/CD y Estrategias de Despliegue
- Diseño de pipelines CI/CD para aplicaciones nativas de cloud
- Despliegues blue/green, canary y rodantes (rolling)
- Automatización de rollbacks, verificaciones de salud y validación del lanzamiento
Monitoreo, Observabilidad y Alertas
- Métricas, registros y trazas: enviar, almacenar y analizar
- Uso de CloudWatch, X-Ray y herramientas de observabilidad de terceros
- Definición de SLOs/SLIs, políticas de alertas y prácticas de guardia activa (on-call)
Operaciones de Seguridad y Gestión de Identidad
- Mejores prácticas de IAM, principio de menor privilegio y acceso entre cuentas
- Gestión de secretos, KMS y almacenes de parámetros seguros
- Seguridad operacional: estrategias de parcheo, análisis de vulnerabilidades y registros de auditoría
Resiliencia, Copias de Seguridad y Recuperación ante Desastres
- Diseño para tolerancia a fallos y alta disponibilidad
- Estrategias de respaldo, automatización de instantáneas (snapshots) y procedimientos de restauración
- Planificación de recuperación ante desastres y creación de manuales operativos (runbooks)
Optimización de Costos y Gobernanza
- Visibilidad de costos: facturación, etiquetado y estrategias de asignación de costos
- Ajuste de capacidad (rightsizing), instancias reservadas/planes de ahorro y controles presupuestarios
- Gobernanza: políticas, barreras de seguridad (guardrails) y automatización para cumplimiento
Contenedores, Serverless y Operaciones en Tiempo de Ejecución
- Consideraciones operativas para ECS, EKS y Lambda
- Descubrimiento de servicios, escalado automático y límites de recursos
- Registro, trazas y depuración de cargas de trabajo en contenedores
Respuesta a Incidentes, Playbooks e Ingeniería del Caos
- Respuesta a incidentes basada en manuales operativos (runbooks) y prácticas de análisis post-incidente
- Automatización de remediación y patrones de auto-curación
- Introducción a experimentos de caos para validar la resiliencia
Taller Práctico: Operar una Carga de Trabajo de Ejemplo
- Implementar una aplicación de ejemplo utilizando IaC y un pipeline CI/CD
- Implementar monitoreo, alertas y un script de remediación automatizada
- Simular incidentes y practicar la respuesta basada en manuales operativos (runbooks)
Resumen y Próximos Pasos
Requerimientos
- Comprensión básica de conceptos de cloud y networking
- Familiaridad con la línea de comandos y scripting en Linux
- Experiencia con control de versiones (Git) y conceptos básicos de CI/CD
Público Objetivo
- Ingenieros de operaciones cloud
- SREs e ingenieros de plataforma
- Ingenieros DevOps y líderes técnicos de equipo
Reseñas (1)
He descubierto cosas nuevas y interesantes sobre Lambda y Serverless
Oleg Buldumac - PUBLIC COURSE
Curso - AWS Lambda for Developers
Traducción Automática