Home›Perspectivas›Artículos›Gestión delegada de infraestructura de TI: cómo operar 24/7 sin ingenieros en sitio
Blog · Servicios administrados · Infraestructura
Gestión delegada de infraestructura de TI: cómo operar 24/7 sin ingenieros en sitio
Cientos de máquinas virtuales, más de 300 bases de datos y dos centros de datos, operados de forma 100 % remota. Lo que aprendimos al administrar la infraestructura de una firma de servicios profesionales Big Four en América Latina.
El tamaño del reto
El alcance del servicio da una idea de la complejidad que implica operar una infraestructura corporativa moderna:
- 484 máquinas virtuales VMware , de las cuales 369 están en producción.
- 9 servidores físicos x86 distribuidos entre el sitio principal y el de recuperación ante desastres (DRP).
- 5 sistemas de almacenamiento IBM FlashSystem .
- Más de 300 bases de datos SQL Server y MongoDB administradas.
A eso se suma un entorno multiplataforma —VMware, Windows, Linux, IBM Power e IBM FlashSystem— que exige especialistas distintos para cada capa. Cubrir todo eso con personal propio, en turnos de 24 horas, los 365 días del año, requiere un equipo considerable y difícil de retener.
Qué significa realmente "gestión delegada"
Delegar la infraestructura no es lo mismo que tercerizar el soporte técnico. En un modelo de gestión delegada, el proveedor asume la responsabilidad de la operación diaria: monitorea, detecta, atiende, escala, documenta y reporta. El cliente conserva el control estratégico y la visibilidad, pero deja de cargar con el trabajo operativo.
Para que funcione, el modelo necesita cuatro piezas:
- Un centro de operación permanente que vigile la infraestructura las 24 horas.
- Procesos estandarizados , idealmente basados en marcos reconocidos como ITIL.
- SLA definidos por criticidad , para que cada incidente reciba la atención que su impacto exige.
- Trazabilidad : el cliente debe poder ver qué pasó, cuándo y qué se hizo.
La gestión delegada funciona cuando el cliente sabe exactamente qué está pasando en su infraestructura, sin tener que operarla.
Cómo lo operamos: el modelo detrás del servicio
En este cliente, Redsis presta el servicio a través de su Centro de Atención al Cliente (CAC), que opera bajo las prácticas de ITIL con monitoreo 24/7/365. Los incidentes se clasifican por criticidad y los de nivel 1 tienen un tiempo de respuesta de 15 minutos.
La clasificación por criticidad es una práctica central de ITIL: la prioridad de un incidente se determina combinando su impacto —cuántos usuarios o servicios afecta— con su urgencia —qué tan rápido crece el daño—. Un servidor de pruebas caído no pesa lo mismo que una base de datos de producción inaccesible, y el SLA debe reflejarlo.
Todo el servicio es 100 % remoto, sin ingenieros en sitio. El cliente tiene acceso a un portal de autoservicio y recibe informes mensuales de gestión, lo que le da trazabilidad completa sobre la operación.
Cinco lecciones para delegar la infraestructura sin perder el control
1. Inventariar antes de firmar
Un buen servicio administrado empieza con un inventario preciso: cuántas máquinas virtuales, cuántas en producción, qué servidores, qué almacenamiento, cuántas bases de datos y en qué motores. Sin ese punto de partida, los SLA se negocian a ciegas.
2. Definir la criticidad con el negocio
La matriz de prioridades no la decide TI sola. Hay que acordar con las áreas de negocio qué servicios son críticos y qué impacto tiene cada uno. Ese acuerdo es lo que permite comprometer, por ejemplo, una respuesta de 15 minutos para los incidentes de nivel 1.
3. Tratar la contingencia como parte de la operación
El sitio de recuperación ante desastres no es un seguro que se revisa una vez al año. En este cliente, la cobertura incluye tanto el sitio principal como el DRP, de modo que la continuidad del negocio forma parte del servicio diario y no de un plan guardado en un cajón.
4. Aprovechar las capacidades de la plataforma
El almacenamiento moderno hace parte del trabajo. IBM FlashSystem, por ejemplo, incluye detección de ransomware basada en IA, copias inmutables ( Safeguarded Copy ), replicación de datos y administración centralizada de múltiples sistemas mediante IBM Storage Virtualize. Un operador que conoce a fondo esas capacidades puede usarlas para fortalecer la protección y la continuidad.
5. Medir y mostrar
Un SLA que no se reporta no existe. El portal de autoservicio y los informes mensuales de gestión convierten la operación en algo auditable: el cliente puede verificar el cumplimiento, identificar tendencias y tomar decisiones informadas sobre su infraestructura.
El resultado: infraestructura de misión crítica con menos costo operativo
Hoy la firma cuenta con una operación de infraestructura 24/7/365 bajo ITIL, con SLA por criticidad y respuesta en 15 minutos para incidentes de nivel 1, cobertura de sus sitios principal y DRP y un entorno multiplataforma administrado de punta a punta. Todo sin ingenieros en sitio, con menor costo operativo que un equipo interno dedicado y con trazabilidad total a través del portal de autoservicio y los informes mensuales.
Para Redsis, este servicio demuestra algo importante: un modelo de gestión delegada escalable y replicable para grandes cuentas empresariales, capaz de operar infraestructura de misión crítica con SLA auditables.
¿Por dónde empezar?
Si su equipo de TI dedica la mayor parte de su tiempo a mantener la infraestructura funcionando, si cubrir las noches y los fines de semana es un problema recurrente o si no tiene una visión clara del cumplimiento de sus propios niveles de servicio, vale la pena evaluar un modelo de gestión delegada. En Redsis combinamos más de 25 años de experiencia en infraestructura para la región, alianzas con IBM (Platinum) y Cisco (Premier), y un Centro de Atención al Cliente que opera bajo ITIL las 24 horas.
Lea el caso completo
Conozca cómo Redsis opera la infraestructura de TI de una firma de servicios profesionales Big Four.