Módulo 8: Proyecto — Sistema de Alertas Programadas

Test, Deploy y Monitoring Final

Descripción de la cápsula

Cierre del proyecto, cierre de G2. Test exhaustivo del sistema, deployment a producción, y plan de monitoring continuo.


Test exhaustivo

Test Plan

TestEscenarioEsperado
1Ejecución normal sin problemassystem_log limpio, 0 alertas
2Métrica supera warning1 alerta alta, Slack normal
3Métrica supera criticalAlerta crítica, multi-canal, ack tracking
4Ack rápido de críticaSheet update, escalación NO dispara
5Sin ack en 15 minEscalación a manager
6Slack caído (cred inválida)Continue on Fail, fallback a email
7Sheet caídoError Workflow se dispara
8Fuera de horario laboralSkip, system_log registra "fuera de horario"
9Día holidaySkip, system_log registra
10Múltiples alertas simultáneasTodas procesadas, sin race conditions

Ejecutar cada test sistemáticamente

Antes de activar producción, todos los tests deben pasar. Documentar resultados.


Deployment a producción

Checklist pre-prod

  • Tests exhaustivos completados
  • Sheets de input con data real (no mock)
  • Umbrales calibrados con valores reales de tu negocio
  • Credenciales producción configuradas (no test)
  • Slack channels reales (no canal de pruebas)
  • Email recipients verificados
  • Error Workflow asignado a los 3 workflows
  • Heartbeat configurado y corriendo
  • Documentation actualizada

Activar workflows

En orden:

  1. [GUARDIAN-ALERTS] (Error Workflow — primero porque otros lo necesitan)
  2. [ALERTS-ACK] (webhook receiver)
  3. [ALERTS-MAIN] (principal)
  4. [ALERTS-ESCALATE] (escalación)
  5. [ALERTS-HEARTBEAT] (watcher of watchers)

Activar cada uno y verificar primera ejecución antes del siguiente.


Monitoring continuo

Semanal: revisar dashboard

[ALERTS-DASHBOARD] corre diario. Cada semana, revisar:

  • Failure rate: debería ser <5%. Si más, investigar.
  • Duration: debería ser estable (~10-30s). Si crece, hay problema.
  • % runs con alertas: depende del negocio. Si 0% durante mucho tiempo, ¿los umbrales son demasiado altos?
  • % críticas vs altas: si críticas son comunes, los umbrales pueden ser muy bajos.

Mensual: calibrar umbrales

Después de 1 mes de datos:

  • Análisis de qué métricas dispararon alertas
  • ¿Las críticas fueron realmente críticas?
  • ¿Hubo "noise" (falsas alertas)?
  • Ajustar umbrales según learnings.

Trimestral: revisar arquitectura

Cada 3 meses:

  • ¿Métricas relevantes siguen siendo las correctas?
  • ¿Algún workflow needs refactoring por crecimiento?
  • ¿Performance de los workflows aceptable?

Documentación final

Crear documento (Notion, Confluence, Sheet) que documenta:

Para el equipo

  • Qué hace cada workflow
  • Quién es oncall
  • Cómo ack alertas
  • Qué hacer cuando recibes un alert
  • Cómo modificar umbrales

Para el mantenedor (tú u otro dev)

  • Diagrama del sistema
  • Decisiones de diseño
  • Tradeoffs aceptados
  • Plan de evolution

Métricas de éxito

Después de 1 mes en producción:

  • Tasa de detección: % de problemas reales que el sistema detectó
  • Tasa de falsos positivos: alertas que no eran problemas reales
  • Tiempo de respuesta: desde alerta hasta ack
  • Cobertura: % de horas con monitoring activo (vs caído)

Si:

  • Detección > 95%
  • Falsos positivos < 10%
  • Tiempo respuesta < 15 min
  • Cobertura > 99%

Sistema exitoso.


Lo que aprendiste construyendo esto

Cobertura completa de G2:

MóduloAplicado en
M01 TriggersSchedule + Webhook + Manual combinados
M02 BranchingSwitch sobre severidad con sub-workflows
M03 LoopsSplitInBatches sobre métricas
M04 MergeWait con 4 fuentes paralelas
M05 SchedulingCron + business hours + holidays
M06 Error handlingRetry, fallback, Error Workflow, observabilidad
M07 WaitHITL para acknowledgement con escalación

Más importante: sabes integrar todos en un sistema coherente y mantenible.


Resumen final

Sistema de alertas productivo construido. Capaz de monitorear métricas críticas de negocio con resiliencia, escalación humana, y observabilidad completa.

Lo que tienes después de G2

  • G1 + G2 completas (128 cápsulas)
  • Mini-proyectos en cada módulo que aplican los conceptos
  • Proyecto integrador grande (este sistema de alertas)
  • Capacidad de construir workflows productivos serios

Lo que sigue en el path

  • G3: Business Integrations — Google Suite, Slack, Calendly, CRM
  • G4-G6: Documents AI, AI automation basics, AI chatbots
  • G7: AI agents y MCP
  • G8-G9: Recipes y APIs without code
  • G10: Production, maintenance, advanced patterns + capstone

Cada uno construye sobre fundamentos de G1+G2.


¡Felicidades por completar G2! 🎉

Sistema profesional construido. Estás listo para automatizar workflows complejos en cualquier contexto.


Creado: Mayo 11, 2026 Versión: 1.0