Antes de arrancar: una ONU que se desconecta cada 5 minutos exactos suele ser distinta a una que se cae 2 o 3 veces al día. El patrón del corte es la pista más grande. Pero para ordenar el diagnóstico, empecemos por lo que causa más tickets.

1. Corte eléctrico intermitente en casa del cliente (30% de los casos)

La causa #1 no es técnica del ISP: es que en la casa del cliente hay problema eléctrico. Puede ser el tomacorriente flojo, un breaker viejo que trippa, o el simple hecho de que el cliente pone el router junto al microondas y cada vez que calienta comida, la interferencia electromagnética resetea el equipo.

Cómo detectarlo desde la OLT: la ONU envía un evento DyingGasp justo antes de perder alimentación (es el mensaje de despedida que la ONU dispara con su último electrón antes de apagarse). Si en el histórico de alarmas ves varios DyingGasp del mismo cliente, la causa es eléctrica, no óptica.

# Huawei MA5800
display alarm-history frameid 0 slotid 3 alarm-type ont-dying-gasp

# Ver si viene con patrones horarios: mismo horario cada día = probablemente
# electrodoméstico grande (aire acondicionado, refrigeradora arrancando)

Solución: pídele al cliente que enchufe la ONU en un tomacorriente distinto (idealmente uno que no tenga aire acondicionado ni microondas en el mismo circuito). Si el problema persiste, es electricista, no técnico de ISP.

2. Señal óptica al borde del umbral (-27 a -28 dBm) (20% de los casos)

Las ONUs GPON típicas empiezan a fallar cuando la potencia recibida (Rx) baja de -27 dBm. En condiciones ideales debería estar entre -18 y -25 dBm. Si tienes un cliente en -26.5, va a funcionar la mayor parte del tiempo pero cualquier variación mínima (humedad, temperatura, movimiento leve del cable) hace que caiga bajo umbral y se desconecte por unos segundos.

# Huawei — ver potencia actual de una ONU específica
display ont optical-info 0/3/0 12

# Ver historial de la señal (útil para ver si empeoró recientemente)
display ont optical-info-history 0/3/0 12

Umbrales prácticos:

Rx PowerEstadoAcción
-18 a -22 dBmExcelenteNinguna
-22 a -25 dBmBuenoMonitorear
-25 a -27 dBmAl límiteProgramar mantenimiento preventivo
< -27 dBmProblemaEnviar técnico a revisar drop cable, empalmes o splitter

Solución: revisar todo lo que aporta pérdida entre OLT y ONU. Los sospechosos habituales: empalmes sucios, cable drop con curvatura muy cerrada, splitter degradado, o simplemente distancia excesiva. Reemplazar patch cord del cliente cuesta $2 y a veces recupera 3 dBm.

3. Bug de firmware — ONU antigua con OLT moderna (15% de los casos)

Este es un problema clásico de mezcla: una OLT moderna (por ejemplo Huawei MA5800 clase C+/C++) con ONUs viejas de otra marca y firmware desactualizado. El estándar OMCI (Optical Network Termination Management and Control Interface) evolucionó con los años, y las OLTs modernas envían mensajes de gestión que las ONUs viejas no procesan bien. Resultado: la ONU se "duerme" cada 24-72 horas y necesita reinicio manual o queda re-linkeando indefinidamente.

Síntoma típico: desde la OLT ves Ranging failed, LOSi intermitente, o ONU deactivated by OLT en el histórico. El cliente reporta que "por las madrugadas se le va" — coincide con las horas de bajo tráfico donde el watchdog interno de la ONU actúa (menos tráfico = más chance de que se ejecute el bug).

Marcas típicamente afectadas en LATAM:

La regla práctica: el problema aparece cuando la ONU es de marca distinta a la OLT y tiene más de 4-5 años sin update. Una Huawei HG8145X6 nueva en OLT Huawei no tiene este bug. Una Skyworth SKYWB de 2019 en la misma OLT Huawei, sí.

Cómo detectarlo: patrón temporal claro (mismo horario aproximado cada día), un solo cliente, señal óptica normal (-22 dBm), ONU vieja de marca distinta a la OLT.

# Ver eventos de esta ONU en las últimas 24h
display ont register-info 0/3/0 12

# Ver firmware y modelo exacto
display ont version 0/3/0 12

# Ver historial de re-registros (si la ONU se re-registra mucho, hay problema)
display ont register-info history 0/3/0 12

Solución: tres opciones, en orden de esfuerzo:

  1. Upgrade de firmware — si el fabricante liberó una nueva versión (raro en marcas económicas). Muchos ISPs ni siquiera tienen contacto con el fabricante original.
  2. Cambiar el modelo GPON en la OLT — a veces basta con configurar la ONU en la OLT como "generic" o forzar OMCI version legacy. Depende de la OLT.
  3. Reemplazo de ONU — lo que hace la mayoría. Cambiar por una ONU del mismo fabricante de la OLT (Huawei OLT → Huawei ONU), o cualquier ONU moderna certificada (ZTE F670L, Fiberhome AN5506-04-FA nueva).

La conclusión honesta: si tienes inventario viejo de ONUs Skyworth/VSOL/C-Data y compraste una OLT moderna en los últimos 2 años, vas a tener este ticket recurrente hasta que reemplaces las ONUs viejas. El costo de reemplazar 50 ONUs a $25 cada una ($1250) suele ser menor al costo de mantener soportando esos tickets un año.

4. Fibra troncal dañada (afecta múltiples clientes) (10% de los casos)

Si son varios clientes de la misma PON los que se caen al mismo tiempo, no es la ONU. Es la fibra troncal, el splitter o la propia OLT. Diagnóstico rápido: filtra por PON en tu panel y contá cuántas ONUs están offline. Si son más de 5-10 de la misma PON en el mismo minuto, es caída sistémica.

# Huawei — ver estado de todas las ONUs de una PON específica
display ont info 0 3 0 all

# CData
show pon interface 0/1/1 onu status

Solución: mandar técnico a revisar el trayecto físico. Suele ser una fusión mal hecha, un roedor, un empalme que se soltó por lluvia, o (raro pero pasa) el patch cord del splitter que se aflojó.

5. Interferencia WiFi en el router del cliente (10% de los casos)

Ojo con esto: cuando el cliente dice "no tengo internet", muchas veces se refiere a que su celular no ve el WiFi. La ONU/router puede estar funcionando perfectamente, pero el WiFi está saturado o interferido. Este caso da tickets falsos que consumen tiempo del técnico.

Cómo detectarlo desde la OLT: la ONU está online (verde) y con señal óptica normal (-22 dBm). El tráfico de esa IP en tu MikroTik muestra actividad normal cuando el cliente reporta "no tengo internet". Es señal clara de que el problema está en el WiFi interno del cliente.

Solución: recomendarle al cliente cambiar canal WiFi (usar aplicación tipo WiFi Analyzer), acercar el dispositivo al router, o instalar un extensor WiFi si tiene la casa grande. Ver también nuestro post cómo cortar internet a un moroso — el mismo panel de MikroTik te sirve para ver tráfico real en tiempo real.

6. Conector SC/APC sucio o mal insertado (5% de los casos)

Un conector de fibra sucio pierde 2-4 dBm de golpe. Si un cliente antes tenía señal -22 dBm y ahora está en -26, revisa antes que nada el conector. Suele pasar cuando un cliente movió muebles y desenchufó/reenchufó la fibra.

Cómo detectarlo: caída súbita de la señal (no gradual), coincide temporalmente con "moví los muebles" o "vino el electricista". A menudo también se ve en el histórico como un salto claro de -22 a -26 en un momento puntual.

Solución: limpiar el conector SC/APC con un pen cleaner ($8 el pen cleaner, dura para 500+ limpiezas) o kimwipes + alcohol isopropílico 99%. Nunca tocar la punta con los dedos.

7. Sobrecarga en el uplink de la OLT (5% de los casos)

Si tu uplink de la OLT hacia el core está saturado, todas las ONUs sufren timeouts intermitentes. No es que se desconecten, es que sus paquetes no llegan a destino y las aplicaciones cortan las conexiones. Los clientes lo perciben como "internet lento" o "se me cortan las llamadas de WhatsApp".

Cómo detectarlo: gráfico del uplink de la OLT arriba del 85% sostenido por varias horas. Si tienes uplink de 1 Gbps y 300 clientes con planes de 50-100 Mbps, cualquier hora pico te satura.

Solución: hacer un upgrade del uplink (a 10 Gbps si te lo permite el core), o aplicar QoS más estricto para priorizar tráfico crítico. Simón IA en GestionaISP detecta esta situación y te alerta antes de que se convierta en tickets masivos.

8. Roedores o pájaros en la fibra exterior (5% de los casos)

Suena ridículo pero es más común de lo que crees. Ratas comen la cubierta de la fibra por el sabor de los materiales plásticos. Pájaros carpinteros pican los cables aéreos pensando que hay insectos. Un cable con la cubierta comprometida pierde señal y se corta con la humedad de la lluvia.

Cómo detectarlo: pérdida de señal correlacionada con clima (llueve → se cae, sale sol → vuelve). Puede afectar a una casa específica o a toda una NAP si el daño está en el troncal aéreo.

Solución: reemplazar el tramo de fibra y protegerlo con conduit rígido en la zona afectada. En zonas rurales, considerar fibra armada con acero.

Cómo automatizar el diagnóstico

Hacer esto manualmente para cada ticket consume 20-30 minutos por caso. En 500 clientes, con un promedio de 10 tickets al día de "no navego", son 3-5 horas diarias de un técnico. Por eso construimos Simón IA: cuando un cliente reporta problema, Simón consulta la OLT, MikroTik y BD por sí solo y en 20 segundos te dice cuál de estas 8 causas es más probable, con la evidencia técnica.

El objetivo no es reemplazar al técnico. Es que llegue con el diagnóstico ya hecho y no tenga que perder tiempo repitiendo los mismos comandos por cada ticket.

Checklist rápido

Cuando llegue el próximo ticket de "internet intermitente", ejecuta este checklist en orden:

  1. ¿Hay DyingGasp en el histórico? → problema eléctrico del cliente
  2. ¿Rx power < -27 dBm? → problema óptico, mandar técnico
  3. ¿Otros clientes de la misma PON también offline? → problema troncal, revisar splitter/fibra
  4. ¿ONU online con señal buena pero cliente reporta no navega? → probable WiFi interno del cliente
  5. ¿Cambio súbito de señal ayer/hoy? → conector sucio o mal reinsertado
  6. ¿Uplink de OLT saturado? → problema de capacidad, upgrade necesario
  7. ¿Correlacionado con lluvia? → probable daño físico externo (roedores, pájaros)
  8. ¿ONU vieja marca Skyworth/Nokia? → probable bug de firmware, reemplazar
Automatiza los 8 diagnósticos con Simón IA

En vez de correr 5 comandos por cada ticket, Simón los corre todos en paralelo y te da el diagnóstico en segundos. Incluye botones para ejecutar la solución sugerida (limpiar ARP, re-vincular ONU, etc.).

Conocer Simón IA

Posts relacionados