Una caída de red detiene facturación, piso de producción y cámaras a la vez. Prevenirla no es “comprar el switch más caro”: es energía, diseño, cambios controlados y visibilidad. La mayoría de los incidentes en PyME son predecibles.
El síntoma “no hay internet” esconde causas distintas. Diagnostica si murió el ISP, el firewall, el core o solo el Wi-Fi del segundo piso.
Más allá del hardware, un cambio de cable sin etiquetar un viernes a las 18:00 explica más outages que un rayo.
Energía y el closet de comunicaciones
UPS con autonomía real, no un regulador de escritorio. Conecta firewall, core, APs críticos y, si aplica, NVR. Mide carga: un UPS al 90% no aguanta un corte de 10 minutos.
Temperatura: un closet cerrado con PoE se apaga solo. Deja ventilación y una alerta simple. Tierra física evita reinicios misteriosos.
- UPS en activo crítico
- PDU etiquetado
- Temperatura del rack
- Prueba de corte semestral
Diseño: un solo punto de falla
Un único switch “core” que además alimenta todo el PoE es un SPOF clásico. Separa, aunque sea en dos equipos: core y acceso. Deja uplinks duales cuando el presupuesto lo permita.
STP o equivalentes mal configurados + un cable de usuario a dos switches = storm. Capacita a quien “solo iba a pasar un patch”. El diseño está en red escalable.
WAN, DNS y la nube
Monitorea el ISP y ten un plan B: LTE/5G de contingencia o segundo enlace. Documenta DNSs. Si el ERP es nube, la “red interna perfecta” no salva un solo enlace caído.
Entiende LAN vs WAN vs VPN con esta comparativa para no aplicar el remedio equivocado.
Wi-Fi, DHCP y cambios
Canal, potencia y número de clientes por AP. Un AP doméstico en recepción no es diseño. Reserva DHCP con margen; un alcance /24 lleno “cae” a la hora pico.
Ventanas de cambio: firmware de firewall y switches con rollback. No actualices el core en horario de facturación.
Monitoreo y runbook
Alertas de down, no solo un dashboard que nadie abre. Un runbook de una página: ¿ISP? ¿firewall? ¿core? ¿Wi-Fi? Teléfonos del proveedor y del integrador.
Revisa logs después de cada incidente. Si no hay post-mortem de 15 minutos, el mismo fallo vuelve el mes siguiente.
Cómo implementarlo sin frenar la operación
Empieza por UPS y etiquetado, luego monitoreo básico, luego redundancia de WAN. No rediseñes VLANs el mismo día que cambias de ISP.
Si las caídas ya son recurrentes, un levantamiento con Tecnoha identifica SPOF y un plan por fases. Ver redes empresariales y qué es la infraestructura TI.