DevOps, SRE y observabilidad
también la vas a encontrar como Infraestructura · Cloud Native · SRE
Entregar y operar software de forma repetible, observable, segura y consciente de su costo.
0 de 59 temas de la materia0.0%
5 unidades · Operación y especialidades
Unidad 01Junior
10 temas · en camino
1.1Archivos, permisos, procesos y señales en LinuxEn camino
1.2Imágenes, contenedores y registrosEn camino
1.3Construcción de imágenes con DockerfileEn camino
1.4Aplicaciones de varios servicios con Docker ComposeEn camino
1.5Volúmenes y redes de contenedoresEn camino
1.6Integración continua con tests y lintingEn camino
1.7Automatizar tareas con scripts de shellEn camino
1.8Comandos repetibles y documentados en el repositorioEn camino
1.9Acceso remoto, claves SSH y saltos entre hostsEn camino
1.10Servicios, arranque automático y journal del sistemaEn camino
Unidad 02Semi-Senior
13 temas · en camino
2.1Builds multi-stage y caché de capasEn camino
2.2Contenedores mínimos y ejecución sin rootEn camino
2.3Healthchecks y dependencias entre serviciosEn camino
2.4Pods, Deployments, Services e IngressEn camino
2.5ConfigMaps, Secrets y configuración declarativaEn camino
2.6Pipelines de build, test, análisis y despliegueEn camino
2.7Métricas RED: tasa, errores y duraciónEn camino
2.8Seguimiento y agrupación de erroresEn camino
2.9Runners, concurrencia y caché de la integración continuaEn camino
2.10Matrices de build y compatibilidad entre versionesEn camino
2.11Artefactos inmutables, etiquetado y registrosEn camino
2.12Credenciales del pipeline, tokens efímeros y OIDCEn camino
2.13Entornos efímeros por rama y su ciclo de vidaEn camino
Unidad 03Senior
15 temas · en camino
3.1Probes, recursos, autoscaling y cargas con estadoEn camino
3.2Empaquetado y configuración con HelmEn camino
3.3Infraestructura como código, estado y módulosEn camino
3.4Despliegues blue-green y canaryEn camino
3.5Agregación, retención y búsqueda de logsEn camino
3.6Métricas USE: utilización, saturación y erroresEn camino
3.7SLIs, SLOs y error budgetsEn camino
3.8Runbooks y automatización de respuestas operativasEn camino
3.9Gestión y rotación de secretosEn camino
3.10Cuándo Kubernetes agrega más costo que valorEn camino
3.11Control de admisión del clúster con OPA y KyvernoEn camino
3.12Firma, procedencia y cadena de suministro del buildEn camino
3.13Gestión de configuración y servidores reproduciblesEn camino
3.14Service mesh: mTLS, tráfico y su costo operativoEn camino
3.15Probar la restauración, no sólo el backupEn camino
Unidad 04Plataforma y entrega a escala
8 temas · en camino
4.1Tiempo de build, entorno local y fricción diariaEn camino
4.2Ventanas de cambio, congelamientos y despliegues de bajo riesgoEn camino
4.3Planificación de capacidad y crecimiento previsibleEn camino
4.4Game days, simulacros de incidente y fallas inyectadas a propósitoEn camino
4.5Migrar infraestructura con el servicio en líneaEn camino
4.6Estandarizar entre equipos sin convertirse en un cuello de botellaEn camino
4.7Ver el costo de operar cada servicio y quién lo pagaEn camino
4.8Operación sostenible cuando no hay un equipo de plataformaEn camino
Unidad 05Observabilidad en la práctica
13 temas · en camino
5.1Monitoreo, telemetría y observabilidadEn camino
5.2Instrumentación manual y automática con OpenTelemetryEn camino
5.3Propagación de contexto entre procesos y serviciosEn camino
5.4Cardinalidad, etiquetas y costo de las métricasEn camino
5.5Histogramas, percentiles y distribuciones de latenciaEn camino
5.6Trazas, spans y causalidad distribuidaEn camino
5.7Dashboards orientados a preguntas operativasEn camino
5.8Alertar sobre síntomas y evitar fatiga de alertasEn camino
5.9Monitoreo sintético y chequeos externosEn camino
5.10Real User Monitoring y experiencia percibidaEn camino
5.11Profiling continuo y análisis de consumo de recursosEn camino
5.12Correlacionar despliegues, cambios y regresionesEn camino
5.13Dashboards y alertas como códigoEn camino