Saltar al contenido
TAPCS

La pregunta no es si alguien contesta. Es qué hace esa persona en los primeros diez minutos.

Monitoreo, copias verificadas, parches y guardia real las 24 horas. Con procedimientos escritos por sistema, para que la respuesta no dependa de qué tan despierto esté el ingeniero de turno.

Respuesta en crítico
30 minutos
Cobertura
24 x 7
Penalidad por incumplir
En factura

Qué pasa a las dos de la mañana, paso a paso.

"Soporte 24x7" no significa nada por sí solo. Esto es lo que ocurre de verdad cuando entra una alerta crítica de madrugada, con los tiempos que están firmados en el contrato.

Secuencia de un incidente crítico bajo plan Crecimiento. Los tiempos son los comprometidos en contrato.
MinutoQué ocurreQuién
00:00La base de datos deja de responder. El monitoreo lo detecta en el segundo chequeo fallido.Automático
00:02Se abre el incidente con severidad crítica y se llama por teléfono al ingeniero de turno.Automático
00:06El ingeniero contesta y confirma que lo está atendiendo. El reloj del SLA se detiene aquí.Ingeniero de turno
00:09Abre el procedimiento escrito de ese sistema. No improvisa: sigue la lista que ya existe.Ingeniero de turno
00:14Diagnóstico: el disco de registros se llenó. Causa conocida, procedimiento conocido.Ingeniero de turno
00:21Libera espacio, valida que el servicio responde y confirma que no hubo pérdida de datos.Ingeniero de turno
00:26Servicio restablecido. Se notifica al contacto técnico que usted designó.Ingeniero de turno
00:40Aplica la corrección de fondo: rotación automática de registros y alerta de disco al 75 %.Ingeniero de turno
08:30Resumen escrito en su bandeja antes de que empiece la jornada.TAP CS
+5 díasAnálisis de causa raíz con las acciones para que no se repita.TAP CS

Por qué existe el procedimiento escrito

A las dos de la mañana nadie razona bien. Tener escrito qué revisar y en qué orden, por sistema, es lo que separa una caída de veintiséis minutos de una de cuatro horas.

Por qué se corrige el fondo esa misma noche

Si solo se libera el disco, el incidente vuelve en tres semanas. Un proveedor que cobra por incidente tiene el incentivo contrario. Nosotros cobramos plano, así que nos conviene que no vuelva a pasar.

Por qué el reloj se detiene al contestar

El SLA compromete la primera respuesta, no la solución, porque el tiempo de solución depende de la falla. Prometer un tiempo de resolución fijo para cualquier problema sería una promesa que nadie puede cumplir.

El SLA

Los tiempos que firmamos, y qué pasa si no los cumplimos.

La severidad la define el impacto en su operación y se acuerda por escrito al inicio. No la decidimos nosotros según la carga de trabajo del día.

Escala de severidad y penalidades. El descuento se aplica automáticamente en la factura siguiente, sin que usted tenga que reclamarlo.
SeveridadDefiniciónPrimera respuestaDescuento si se incumple
CríticaLa operación está detenida. No se puede facturar, despachar ni atender.30 minutos10 % de la mensualidad por evento
AltaSistema importante degradado, con forma de seguir trabajando.2 horas5 % de la mensualidad por evento
MediaFalla intermitente o que afecta a un grupo reducido.8 horasSin descuento, entra al informe
ProgramadaCambios y mantenimiento con fecha acordada.Ventana acordadaNo aplica
Pantalla con paneles de monitoreo y métricas en tiempo real.
Los umbrales se calibran hasta que una alerta signifique algo. Una alerta que suena todos los días se termina ignorando.

Qué hacemos todos los meses, se caiga algo o no.

La mayor parte del valor de este servicio está en los meses en que no pasa nada. Eso es precisamente lo que se está pagando.

01
Monitoreo con umbrales ajustados
Disponibilidad, disco, memoria, procesos y certificados. Los umbrales se calibran hasta que una alerta signifique algo, porque la alerta que suena todos los días se ignora.
02
Copias con restauración probada
Cada mes se restaura una copia en un ambiente aislado y se deja constancia. Una copia que nunca se restauró no está verificada, solo está guardada.
03
Parches en ventana acordada
Sistema operativo y componentes críticos, con acta de cambio previa y plan de reversa. Nunca aplicamos un parche sin avisar.
04
Gestión de certificados
Inventario y renovación antes del vencimiento. Un certificado vencido tumba el servicio completo y es de las caídas más evitables que existen.
05
Procedimientos por sistema
Qué revisar y en qué orden cuando cada sistema falla. Se escriben durante la estabilización y se actualizan después de cada incidente.
06
Informe mensual de dos páginas
Qué pasó, qué se previno, qué está en riesgo y qué recomendamos para el trimestre. Dos páginas, no cuarenta, porque las de cuarenta no se leen.
07
Análisis de causa raíz
Para cada incidente mayor, dentro de los 5 días hábiles. Con las acciones concretas para que no se repita y el responsable de cada una.

Nadie puede dar guardia sobre un sistema que no conoce.

Recibir los accesos y empezar a cobrar guardia el mismo día es la forma más rápida de incumplir el primer SLA. Las primeras semanas son de conocer y estabilizar.

  1. Fase 1 / 1 a 2 semanas

    Levantamiento

    Qué hay, qué es crítico para el negocio y qué se ha caído en los últimos seis meses. El historial de caídas es la mejor fuente que existe.

  2. Fase 2 / 2 a 3 semanas

    Estabilización

    Monitoreo real, copias que sí restauran, accesos ordenados y procedimientos escritos para los sistemas críticos.

  3. Fase 3 / 1 semana

    Ensayo de guardia

    Se simulan alertas para verificar que la cadena de llamado funciona de verdad, incluido el escalamiento cuando el primero no contesta.

  4. Fase 4 / Continuo

    Operación con SLA

    Ahí arranca el compromiso con penalidad. Informe mensual y revisión trimestral de lo que sigue en riesgo.

Tres niveles de cobertura.

La diferencia principal entre ellos no es cuánto trabajo hacemos: es a qué hora contestamos y qué tan rápido. La guardia nocturna es lo que más cuesta sostener.

Esencial

Lunes a viernes, 8:00 a 18:00. Respuesta en 4 horas hábiles. Disponibilidad 99,5 %.

desde2M COP /mes2.000.000 pesos colombianos por mes

Crecimiento

24 horas, 7 días. Respuesta en 30 minutos en severidad crítica. Disponibilidad 99,9 %.

desde6M COP /mes6.000.000 pesos colombianos por mes

Crítico

24 horas, 7 días, con ingeniero asignado. Respuesta en 15 minutos en severidad crítica. Disponibilidad 99,95 %.

desde15M COP /mes15.000.000 pesos colombianos por mes

Valores de referencia en pesos colombianos, sin IVA. El precio final depende del alcance, el número de servidores y el nivel de servicio acordado.

La alternativa

Contra tener a alguien de planta haciendo guardia.

Es la comparación honesta, y no siempre ganamos nosotros. Si su operación es simple y ya tiene la persona, el contrato externo puede ser un gasto que no necesita.

Comparación con la alternativa más frecuente. Los valores son de referencia del mercado colombiano.
CriterioPersona de plantaTAP CS
Costo mensual cargado5M a 15M por una persona2M a 15M por un equipo
Cobertura nocturna realRequiere turnos, es decir varias personasIncluida desde el plan Crecimiento
Vacaciones e incapacidadesQuedan sin cubrirCubiertas, hay turnos
Especialidades disponiblesLas que sepa esa personaNube, redes, bases de datos, automatización
Riesgo si renunciaAlto: el conocimiento se va con ellaBajo: queda documentado y en código
Conocimiento del negocioAlto, está adentroMenor, lo aprendemos con el tiempo
Cuándo convieneOperación simple con alguien ya contratadoSistemas críticos o cobertura 24x7

Sobre guardia, penalidades y equipos internos.

¿La guardia es una persona o un buzón?

Es una persona. La alerta entra a un sistema de turnos que llama al ingeniero asignado, y si no contesta en un tiempo definido escala automáticamente al siguiente. Un correo a una lista de distribución a las dos de la mañana no lo lee nadie, y venderlo como guardia sería mentir.

¿Qué pasa si incumplen el SLA?

Se descuenta de la factura del mes según una escala acordada en el contrato. No es una disculpa por correo. Lo decimos porque un compromiso sin consecuencia económica es una intención, y en este mercado casi nadie lo pone por escrito.

¿Reemplazan a nuestro equipo interno?

Casi nunca, y no lo proponemos. Lo habitual es que cubramos la guardia nocturna y de festivos, aportemos especialidades puntuales y descarguemos la operación repetitiva. El equipo interno conoce el negocio, que es lo que nosotros no podemos aprender rápido.

¿Atienden a los usuarios finales?

Nuestro foco es la infraestructura, no la mesa de ayuda de usuario final. Atendemos servidores, redes, bases de datos, nube y los servicios que corren ahí. Si necesita atención de primer nivel para usuarios, se puede incluir, pero se dimensiona y se cotiza aparte porque es otro tipo de operación.

¿Cuánto dura el contrato?

Mínimo tres meses, que es lo que toma estabilizar un entorno heredado y llegar a conocerlo. Después es mensual con 30 días de preaviso. Los contratos de 12 meses tienen descuento. Si decide irse, le entregamos inventario, accesos y documentación sin cobrar por la salida.

Con qué se suele combinar.

Operar revela dónde está el problema real. Si los incidentes se repiten, la respuesta rara vez es más soporte: es automatizar la tarea que falla o corregir el entorno que la provoca.

Ver los siete servicios y la tabla de síntoma a servicio

¿Cuántas veces se les cayó algo en los últimos seis meses?

El historial de caídas es la mejor información para dimensionar esto. Si no lo tiene medido, esa ya es una respuesta útil y es de las primeras cosas que arreglamos.

Respondemos en 1 día hábil.

Un SLA sin consecuencia es una intención.

El nuestro se descuenta de la factura y se aplica solo, sin que usted tenga que reclamarlo. Es la parte del contrato que más nos cuesta y la que más importa cuando algo se cae.

¿Prefiere no llenar un formulario?

Contesta una persona en horario lunes a viernes, 8:00 a 18:00 (cot). Por correo respondemos en 1 día hábil.