Contingência de Internet Configurada — e a Internet Caiu do Mesmo Jeito
Quando uma empresa com dois links de internet e failover configurado ainda assim fica sem acesso, o primeiro suspeito é o provedor. Na maioria desses casos que investigamos, o culpado é outro: o firewall travou fisicamente e parou de rotear qualquer um dos dois links — o problema nunca foi a internet.
Isto não é sobre configurar failover errado
Contingência de internet bem projetada — dois links de operadoras diferentes, com troca automática configurada no firewall — resolve queda de link. Se o link primário cai, o roteador detecta e passa a rotear pelo secundário em segundos. Isso é failover, e quando ele falha, normalmente é erro de configuração: rota de distância errada, healthcheck mal calibrado, NAT duplicado.
O problema deste artigo é outro, mais raro e mais difícil de diagnosticar remotamente: o próprio hardware do firewall trava — kernel preso, processo de roteamento sem resposta, memória esgotada — e nenhuma lógica de failover roda, porque o equipamento que executaria a troca está inoperante. Os dois links continuam de pé do lado da operadora; o roteador é que parou de processar qualquer pacote.
Como diferenciar queda de link de travamento de hardware
É queda de link
A interface de gerência do firewall (WinBox, WebFig, SSH) continua acessível normalmente. Só a navegação e os serviços que dependem da internet param.
É travamento de hardware
A gerência também não responde. As luzes de link das portas WAN continuam acesas, mas nada passa — o equipamento parou de processar, não só de rotear.
Watchdog de hardware: reinício automático sem depender de alguém no rack
O RouterOS do MikroTik tem um recurso nativo para exatamente esse cenário, em System → Watchdog. Configurado, ele monitora continuamente se o roteador segue respondendo — via ping periódico a um endereço de referência ou verificação interna do próprio sistema. Se o equipamento parar de responder pelo tempo definido, o watchdog força um reinício automático do hardware, restabelecendo o roteamento em minutos em vez de esperar alguém perceber a queda, se deslocar até o rack e desligar da tomada manualmente.
Em ambientes onde o travamento é raro, mas o custo de cada minuto de internet parada é alto — escritórios de contabilidade em época de obrigação fiscal, clínicas com sistema de agendamento online, operações de e-commerce — o watchdog sozinho já reduz drasticamente o tempo de indisponibilidade, de horas (até alguém perceber e agir fisicamente) para minutos (reinício automático).
Watchdog do RouterOS
Detecta o travamento e reinicia o equipamento automaticamente, sem depender de deslocamento até o rack.
Tomada gerenciável
Camada extra para o caso raro em que nem o watchdog interno reage: corte e religa a energia remotamente.
Monitoramento proativo
Alerta a equipe técnica antes do cliente perceber a indisponibilidade, com registro do incidente para relatório.
Onde isso se encaixa na infraestrutura da empresa
Configurar o watchdog é parte da gestão de firewall corporativo, não um ajuste isolado — ele entra junto com a definição das regras de failover, VPN e monitoramento contínuo do equipamento. Para quem está decidindo entre plataformas antes de fechar o projeto, o comparativo entre MikroTik e pfSense detalha em que cenário cada um se sai melhor. E quando o travamento é sintoma de um ambiente maior — rack sem refrigeração adequada, energia instável, cabeamento fora de norma —, o diagnóstico correto é uma auditoria de infraestrutura de rede empresarial.
Sua Internet Já Caiu Assim Mais de Uma Vez?
Diagnosticamos remotamente se o seu firewall está travando e configuramos o watchdog para eliminar o reinício manual — gratuito, sem compromisso.
Perguntas frequentes
Se eu já tenho dois links de internet com failover, por que ainda caio?
Failover troca de link quando o link ativo para de responder — mas ele depende do roteador/firewall estar funcionando para executar a troca. Se o próprio hardware travar (kernel travado, processo preso, memória esgotada), nenhum dos dois links é alcançado, porque quem decidiria a troca está fora do ar. O sintoma parece falha de internet, mas a causa é o equipamento.
Como eu sei se o problema é o link ou o firewall travado?
O teste mais rápido é tentar acessar a interface de gerência do firewall (WinBox, WebFig ou SSH) durante a queda. Se ela também não responde, e as luzes de link das portas WAN continuam acesas, o equipamento está travado — não é o provedor. Se a gerência responde normalmente e só a navegação falha, aí sim o problema está no link.
O que é o watchdog do MikroTik e o que ele resolve?
O RouterOS tem um recurso nativo em System → Watchdog que monitora se o roteador continua respondendo (via ping a um endereço de referência ou verificação interna do sistema). Se o equipamento parar de responder pelo tempo configurado, o watchdog força um reinício automático — sem depender de alguém ir até o rack desligar e ligar da tomada.
Configurar o watchdog é suficiente ou preciso de mais alguma coisa?
O watchdog resolve a maior parte dos travamentos de software. Para o caso raro em que o hardware trava a ponto de nem o watchdog interno reagir, a camada adicional é uma tomada gerenciável (smart PDU) no rack, que permite o reinício remoto por energia mesmo com o equipamento completamente sem resposta — e monitoramento proativo que avisa a equipe antes do cliente perceber a queda.
