Niveles de soporte, SLA y qué pasa cuando el proveedor se cae
El acuerdo de nivel de servicio no es una promesa de que nada falle: es cuánto crédito devuelve el proveedor si falla. Entender eso cambia qué se espera del SLA, qué nivel de soporte se contrata y qué hay que tener preparado para el día de la caída.
Datos de proveedores verificados contra la documentación oficial el 19 de sept de 2026.
Todo servicio gestionado publica su acuerdo de nivel de servicio con una cifra tranquilizadora: 99,9 %, 99,95 %, 99,99 %. Es fácil leer eso como una garantía de funcionamiento.
No lo es. Un SLA es un compromiso comercial con una compensación asociada: si el servicio queda por debajo del objetivo, el proveedor devuelve un porcentaje de lo facturado. Nada más. La caída ocurre igual, el crédito no cubre lo que costó, y hay que pedirlo.
Qué dice y qué no dice un SLA
| Lo que la gente entiende | Lo que dice el documento | |
|---|---|---|
| La cifra | Nunca se va a caer más que eso | Si baja de ahí, hay crédito sobre la factura |
| La compensación | Cubre el daño | Un porcentaje de lo pagado por ese servicio, en crédito |
| Quién lo reclama | Es automático | Hay que pedirlo, con evidencia y dentro de un plazo |
| Qué cubre | Todo el servicio | Métricas específicas, con exclusiones |
| Alcance | La cuenta entera | Suele medirse por región o por recurso |
99.7002 %
2 h 9 min por mes de caída esperada
A esta altura la fórmula deja de describir el sistema real: lo que manda ya no es la probabilidad de cada pieza sino lo que falla junto, como un despliegue o un cambio de configuración.
Y hay un requisito que casi todos los SLA comparten y que conviene leer: la compensación suele exigir haber desplegado con redundancia. Una instancia sola en una zona, en varios servicios, directamente no tiene objetivo de disponibilidad asociado.
Los niveles de soporte
| Nivel | Qué incluye | Tiempo de respuesta | Cuándo se justifica |
|---|---|---|---|
| Básico | Documentación, foros, salud del servicio | Sin compromiso | Pruebas y proyectos personales |
| Desarrollo | Consultas técnicas en horario hábil | Horas | Entornos que no son producción |
| Empresarial estándar | Casos de producción, todos los días | Del orden de una hora para casos críticos | Producción de verdad |
| Empresarial avanzado | Contacto técnico asignado, revisiones, ayuda en eventos | Minutos para casos críticos | Sistemas donde la caída cuesta mucho |
Antes de seguir, predecí
El día que se cae el proveedor
Las caídas grandes tienen un patrón conocido, y saberlo cambia la primera media hora.
Qué hacer, en orden
- Confirmar que es del proveedor, y no propio. El tablero de estado suele tardar en reflejar el incidente; el tablero personalizado de la cuenta —que mira los recursos propios— llega antes.
- Avisar antes de saber: un mensaje temprano diciendo qué se ve y cada cuánto se va a actualizar vale más que la explicación completa una hora tarde.
- Ejecutar lo que esté a mano: degradar funcionalidad, servir contenido en caché, activar el modo de sólo lectura. Casi siempre hay algo mejor que esperar.
- No desplegar cambios grandes en el medio salvo que sean parte del plan: la mitad de los daños colaterales de estos días vienen de arreglos improvisados.
- Anotar la ventana horaria y los recursos afectados, que es lo que después permite reclamar el crédito.
Qué se prepara antes
Cinco cosas que sólo sirven si ya están
- El nivel de soporte adecuado, contratado antes del incidente.
- Un canal de comunicación que no dependa de lo que puede caerse, incluida la página de estado propia, alojada en otro lado.
- Un modo degradado probado: sólo lectura, contenido en caché, funcionalidades secundarias apagadas.
- Las alertas de salud del proveedor integradas al canal del equipo, para no depender de que alguien mire un tablero.
- Saber el número: cuánto cuesta una hora de caída. Es lo que permite decidir en el momento, y lo que justifica cada inversión de esta lista.
Más a fondo · nivel seniorCuando el SLA es hacia adentro
El otro lado de este tema es el compromiso que uno le da a sus propios clientes. Dos reglas de sentido común que se aprenden caro:
Nunca prometer más que la suma de lo que se depende. Si la arquitectura se apoya en tres servicios de 99,9 %, prometer 99,95 % es firmar algo que no se controla. El compromiso externo se calcula desde el SLA compuesto de la arquitectura y con margen, no desde el deseo comercial.
Separar el objetivo interno del compromiso externo. El objetivo interno se fija más alto que el contractual, para que el equipo reaccione antes de incumplir con nadie. Esa diferencia es el margen de maniobra: cuando se empieza a consumir, hay tiempo de actuar; si el único número es el del contrato, la primera señal es un incumplimiento.
Y una consecuencia práctica: conviene que el contrato hable de disponibilidad medida desde el cliente, con ventanas de mantenimiento y exclusiones escritas. Un compromiso sin definición de cómo se mide se discute en cada incidente, que es el peor momento para negociar.
Cierre
Autoevaluación
¿Lo entendiste?
Práctica