El respaldo que se programó y nunca corrió.
Programar el respaldo y verificar que efectivamente corrió son dos cosas distintas. La segunda es la que importa, y es la que casi nadie revisa.
CIJTEC · Servicios y Soluciones Informáticas · Santiago
Somos el área de informática de empresas que no tienen una. Sin mesa de ayuda rotativa ni número de ticket: siempre los mismos dos, que ya saben cómo funciona tu operación y no te van a pedir que expliques todo de nuevo.
Los casos de siempre
Busca tu caso acá abajo. En cada uno está por dónde partimos a buscar. Casi nunca hay una sola causa posible, así que lo que importa es el orden en que se van descartando: ahí está la diferencia entre resolverlo hoy o dar vueltas una semana.
Una persona sentada frente a un cartel rojo, sin poder abrir lo que estaba haciendo.
El mensaje de error casi nunca dice cuál de todas es. Puede ser la licencia asignada a alguien que ya no está, la cuenta con que se inició sesión en ese equipo, un perfil a medio armar después de un cambio de máquina, o la suscripción impaga. Se revisa en el panel de Microsoft 365, de lo más rápido de descartar a lo más lento.
Consultar por estoPor fuera no se nota nada: tus clientes creen que los estás ignorando.
Las más comunes se descartan en orden: el buzón lleno, un registro de DNS mal puesto (SPF, DKIM o DMARC), una regla de bandeja que alguien creó y olvidó, o el dominio en una lista negra por correo saliente. Saltarse el orden es lo que hace perder días.
Consultar por estoTodos los días, a la misma hora, la empresa entera trabaja al doble de lento y se acostumbra.
Que sea siempre a la misma hora ya es la mejor pista: apunta a algo programado o a mucha gente conectada a la vez. De ahí en adelante puede ser el archivo de datos sin espacio para crecer, sesiones que quedaron abiertas, un respaldo o un antivirus corriendo en horario laboral, la red, o consultas sin índice. Se mide antes de comprar nada: nos ha tocado desmentir la compra de un servidor nuevo que no hacía falta.
Consultar por estoLa pregunta no es si el respaldo existe. Es si alguna vez lo probaron restaurando.
Programar el respaldo y verificar que corrió son dos cosas distintas, y la segunda es la que salva. Revisamos que exista, que se pueda restaurar —que es lo que nadie prueba— y cuánto espacio queda antes de que deje de correr solo.
Consultar por estoUna persona parada, cobrando sueldo, mientras el resto trabaja como si nada.
Que el resto sí pueda entrar ya acota bastante. Puede ser una licencia tomada por una sesión que cerró mal, la contraseña vencida o la cuenta bloqueada, permisos que cambiaron sin que nadie avisara, o el perfil de ese equipo. Se revisa de lo más rápido a lo más lento — y si le pasa siempre a la misma persona, el problema es otro.
Consultar por estoEl cliente se entera antes que tú, y a esas alturas ya es un problema de cobranza.
Un documento que no salió no dispara ninguna alarma: se nota cuando reclaman, o cuando contabilidad cuadra el mes y falta. Puede haber quedado en cola, rechazado por el SII, emitido con un dato del receptor mal, o simplemente nunca se generó. Lo primero es ubicar en cuál de esos estados quedó: recién ahí se sabe si el problema es del sistema, del dato o del proceso.
Consultar por estoEl sitio abajo, tres proveedores distintos, y nadie que sepa a cuál llamar.
Dominio, DNS y hosting son tres cosas distintas, se pagan por separado y se caen por motivos distintos. Lo primero es saber cuál de las tres falló — cambiar la equivocada suele dejar el sitio abajo un día más.
Consultar por estoEl que trabaja desde afuera simplemente no puede empezar el día.
Se descarta en orden: la VPN, la sesión del usuario, las licencias CAL del servidor, el firewall y el equipo desde donde se está conectando. Es la falla que más se resuelve reiniciando el servidor a la fuerza, con todos los usuarios adentro y sin avisar.
Consultar por estoEs la única falla que avisa con semanas de anticipación. Y la que más veces llega igual de sorpresa.
Detiene la operación completa, y es de las que más aviso dan con anticipación — si alguien está mirando. Antes de borrar hay que saber qué creció, o en un mes vuelve a pasar: respaldos que no se están rotando, temporales, registros del sistema o la base de datos. Liberamos lo que corresponde y dejamos medido cuánto crece al mes.
Consultar por estoCuéntanoslo igual. Esta lista son los que más se repiten, no todo lo que hacemos — y si resulta que no somos los indicados, te lo decimos de frente.
Contarnos el casoLa línea plana
Mientras se mantenga plana, tu empresa factura, despacha y cierra. Cada vez que se dispara hay un costo concreto: un día de facturación perdido, un cierre que se corre, un cliente esperando su factura.
Casi todo el soporte informático compite por lo rápido que llega después de que la línea se disparó. Nosotros trabajamos en la parte aburrida: que no se dispare. Es menos vistoso y sale bastante más barato.
Cuando nadie está mirando
Programar el respaldo y verificar que efectivamente corrió son dos cosas distintas. La segunda es la que importa, y es la que casi nadie revisa.
La base sigue andando hasta que no queda espacio. Ahí se detiene la operación completa, y suele pasar justo en el peor momento del mes.
No hay alarma. Se nota cuando el cliente reclama la factura, o cuando el área contable cuadra el mes y falta un documento.
Alguien cerró mal y su sesión sigue ocupando la licencia en el servidor. El siguiente no puede entrar, y nadie sabe por qué.
El alcance
No es un menú para elegir. Se mira completo, porque las fallas cruzan de un frente a otro sin avisar: lo que parece un problema del sistema empieza en el disco, y lo que parece de red termina siendo un usuario.
Aplica a cualquier empresa con servidores propios, use el sistema que use. Y si además trabajan en Softland, entramos al sistema por dentro: esa es la especialidad dedicada de uno de los dos.
Integridad de la información
¿Existe de verdad el respaldo de anoche?
Respaldo diario y verificación de que el plan efectivamente corrió. Retención y compresión, espacio en disco, crecimiento de los archivos de datos, integridad y bloqueos.
Disponibilidad de la base de datos
¿Va a aguantar el cierre de mes?
Log de transacciones, espacio del motor, rendimiento, y la mantención periódica que el sistema pide en su manual y que casi nunca se hace. En Softland sabemos exactamente cuál es.
Acceso a la plataforma
¿Pueden entrar todos, mañana a las 8?
Servicios críticos, espacio en disco, licenciamiento CAL de Windows Server, actualizaciones y reinicios programados, terminal server, red y equipamiento de comunicaciones.
Operación funcional y usuarios
¿Salió el documento que tenía que salir?
Giros, notas de venta, guías y facturas, DTE de proveedores, variables de remuneraciones, formatos de documentos, centros de costo, licencias y usuarios. También VPN, escritorio remoto, Office 365, equipos, perfiles, impresoras y credenciales.
La especialidad
Uno de los dos está dedicado a Softland y a la base de datos que hay debajo. Este es un caso real de lo que eso significa cuando el problema no está donde todos creen.
Lo que se creía
El ERP estaba lento y la conclusión dentro de la empresa era que la base de datos ya no daba más. La salida obvia era comprar servidor nuevo.
El motor estaba bien.
Lo que era
El archivo de datos estaba al ras: 18 MB libres, creciendo de a 10 MB. Cada vez que se llenaba, todo esperaba. Y encima estaba la espera de red del terminal server, que mantenía cerca de 240 sesiones de Softland abiertas porque el ERP no cierra sus conexiones.
Se corrigió lo corregible y el resto quedó acotado a su origen real. Sin servidor nuevo.
Quien solo mira el ERP no ve el servidor. Quien solo mira el servidor no sabe que el ERP no cierra sus conexiones. Por eso miramos los dos.
Diagnóstico hecho en vivo y en solo lectura, sin detener la operación ni sacar a nadie del sistema.
Alcance y límites
Esto no le sirve a cualquier empresa, y descubrirlo a mitad de camino sale caro para los dos lados. Así que va sin rodeos.
Te sirve si
No te sirve si
Cómo trabajamos
Eso se sostiene de una sola forma: entender el proceso antes de tocarlo. En sistemas que están en producción, el daño casi nunca lo hace la falla original — lo hace el arreglo apurado.
Quién usa el sistema, para qué, y qué pasa río abajo si algo cambia.
Usuarios conectados, servicios críticos y respaldo confirmado antes de intervenir.
El cambio se prueba con datos reales, y lo aprueba quien usa el sistema todos los días.
Qué se hizo y por qué, para que el próximo que lo mire entienda sin preguntar.
El primer paso
Miramos tus respaldos, el espacio y el estado del ERP, y te decimos qué está en riesgo y en qué orden conviene resolverlo. Se hace en solo lectura: no detenemos nada ni sacamos a nadie del sistema.
Si después de mirarlo resulta que no te hacemos falta, te lo vamos a decir igual.