Tirado diretamente do Guia de manutenção rápida NetEngine AR da Huawei — o que reunir antes de tocar em um dispositivo configurado por outra pessoa, as quatro verificações que constroem um instantâneo de saúde em minutos, e a linha de base que você deve salvar antes de executar um único comando que mude qualquer coisa.
By Yuwen Zhang (Atlas), founder of AtlasCommTech — 13 years of carrier & enterprise network deployments · Updated July 2026
O conselho do guia para assumir a manutenção de um dispositivo é direto: consiga o mapa e as ferramentas antes de fazer login, não depois que algo quebrar.
O Guia de manutenção rápida NetEngine AR da Huawei abre seu capítulo de manutenção com uma recomendação curta, em duas etapas, para qualquer pessoa prestes a assumir a responsabilidade por um dispositivo: primeiro obter a topologia de rede e o plano de dados, depois preparar as ferramentas necessárias — antes de fazer qualquer outra coisa. É um pequeno passo que mais importa exatamente quando é mais frequentemente ignorado: o primeiro dia com uma rede construída por outra pessoa, onde ninguém no local anotou o que realmente está configurado.
A seguir está a sequência real do primeiro dia segundo esse guia: o mapa e as ferramentas a reunir, as quatro verificações que constroem um instantâneo de saúde em poucos minutos e, separadamente, o que fazer se você nem sequer conseguir fazer login ainda.
Seis etapas, na própria ordem do guia — cada uma pressupõe que você está começando do zero.
Os rótulos do diagrama permanecem em inglês para maior clareza técnica.
O guia se ramifica na etapa 3: se você não conseguir fazer login de jeito nenhum, este fluxo ainda não se aplica — ele te direciona para um procedimento separado para dispositivos aos quais você não consegue acessar.
Duas coisas, segundo o guia, antes de tocar no dispositivo: o mapa e as ferramentas.
| Categoria | Item | Finalidade |
|---|---|---|
| Documentação | Diagrama de topologia de rede + plano de dados | Interfaces, VLANs, endereços IP — impressos e afixados na sala de equipamentos para consulta rápida |
| Cabo | Cabo serial RS232 padrão | Login pela porta de console |
| Cabo | Adaptador serial para USB | Login de console pela porta USB do terminal de manutenção |
| Cabo | Dois cabos Ethernet diretos | Ativar a porta de gerenciamento ou outros serviços |
| Cabo | Cordões de fibra + módulos SFP/eSFP/SFP+ | Conectar-se a dispositivos pares |
| Terminal de manutenção | Notebook com software de comunicação serial | Fazer login no dispositivo |
| Instrumento auxiliar | Medidor de potência óptica | Teste de interface óptica — potência, sensibilidade de recepção |
Se, mesmo com esse kit, você não conseguir de forma alguma uma sessão no dispositivo, o guia te direciona para um procedimento separado para dispositivos aos quais não se consegue fazer login — isso está fora do escopo desta lista de verificação.
Luzes indicadoras, alarmes ativos, um instantâneo do comando de saúde, status das placas — nessa ordem, diz o guia, e cada um indica quando parar e escalar.
| Verificação | Comando / Método | Como é o estado normal |
|---|---|---|
| Luzes indicadoras | Verificação visual em relação à serigrafia | SYS piscando verde lentamente; ACT verde fixo = ativo; PWR/TEMP/FAN/STATUS verde fixo; STAT piscando verde lentamente (fixo em 9ES2/4ES2G-S) |
| Alarmes ativos | display alarm active | Nenhuma entrada Critical ou Major na saída |
| Instantâneo de saúde | display health | Status de temperatura = NORMAL, Estado de energia = Supply, Registro do ventilador = YES, uso de CPU abaixo de 80%, uso de memória abaixo de 60%, uso de armazenamento abaixo de 80% |
| Status das placas | display device | Online = Present, Power = PowerOn, Register = Registered, Alarm = Normal para cada placa instalada |
<Huawei> display alarm active | include Major
1/Independent/2014-10-02 21:38:10/2014-10-02 21:39:00/0xff8c205c/hwCPUUtilizationRising/Major/End/
OID 1.3.6.1.4.1.2011.5.25.219.2.14.1 CPU utilization exceeded the pre-alarm threshold.
<Huawei> display health
Slot Card Sensor No. SensorName Status Upper Lower Temp(C)
11 - 1 SRU-400H TEMP NORMAL 70 0 48
PowerNo Present Mode State Current(A) Voltage(V) Power(W)
9 YES AC Supply N/A 12 350
System CPU Usage Information: SlotID 11 CPU Usage 7% Upper Limit 80%
System Memory Usage Information: SlotID 11 Used 14% Upper Limit 95%
<Huawei> display device
AR6300's Device status:
Slot Sub Type Online Power Register Alarm Primary
14 - SRU-200H Present PowerOn Registered Normal Master
<Huawei> display diagnostic-information dia-info.txt
Info: The diagnostic information was saved to the device successfully.
<Huawei> save logfile
<Huawei> system-view
[Huawei] diagnose
[Huawei-diagnose] save diag-logfile
Qualquer verificação que retorne anormal tem a mesma próxima etapa no guia: se a solução documentada não a resolver, passe a coletar e relatar as informações da falha — não repetir a verificação.
Nenhum desses é um caso extremo exótico — são os mesmos poucos erros contra os quais a própria estrutura do guia de origem alerta.
RISCOCPU abaixo de 80% e memória abaixo de 60% são os limiares de aprovação do guia, não uma garantia — a própria instrução do guia para uma leitura alta é observá-la por cinco a dez minutos antes de decidir que é um problema, não aceitá-la ou descartá-la com base em um único instantâneo.
PRÁTICA MAIS SEGURAFaça o instantâneo de saúde mais de uma vez em sua primeira sessão, com alguns minutos de intervalo, antes de concluir que o dispositivo está bem ou já está com dificuldades.
RISCOO guia diz explicitamente para verificar display cpu-usage e display memory antes de executar display diagnostic-information, e adiar o despejo de diagnóstico se algum já estiver elevado — o próprio comando adiciona carga exatamente quando o dispositivo menos pode arcar com isso.
PRÁTICA MAIS SEGURAVerifique primeiro a CPU e a memória. Se alguma estiver alta, espere ela se estabilizar antes de coletar um instantâneo de diagnóstico completo.
RISCOA mesma serigrafia significa coisas diferentes em módulos diferentes — uma luz ACT fixa significa que a placa de controle principal está ativa, enquanto apagada significa em espera, e OUTPUT verde fixo significa espera fria enquanto verde piscando significa que está realmente fornecendo energia. Reagir a uma luz sem verificar o que ela significa para aquele módulo específico leva a perseguir um problema inexistente.
PRÁTICA MAIS SEGURAMantenha a tabela de estado normal aberta durante sua primeira verificação de luzes indicadoras, e só escale uma luz que não corresponda à sua própria linha.
RISCONenhuma etapa desse fluxo do primeiro dia exige reboot, format ou delete — mas um dispositivo desconhecido com configuração pouco clara é exatamente quando a tentação de “só reiniciar para ver” é mais forte, e exatamente quando é menos seguro fazer isso.
PRÁTICA MAIS SEGURASe uma verificação falhar e a correção não for óbvia, colete primeiro as informações da falha — não recorra a um comando da nossa lista de comandos perigosos para “testar” algo em um dispositivo que você ainda não entende.
RISCOCada verificação neste guia — exceto as luzes indicadoras — pressupõe que você já consegue acessar o dispositivo via Console, Telnet ou STelnet. Se você não conseguir estabelecer uma sessão de jeito nenhum, seguir esse fluxo mesmo assim só desperdiça tempo em etapas que exigem um login que você não tem.
PRÁTICA MAIS SEGURAConfirme que você tem uma sessão funcional antes de iniciar as verificações de instantâneo de saúde; se não tiver, a própria próxima etapa do guia é um procedimento separado para dispositivos aos quais você não consegue fazer login.
O próprio capítulo de relato de falhas do guia também serve como lista de verificação de linha de base do primeiro dia — salve isso agora, antes de fazer uma única alteração, e você o terá depois, quando realmente precisar.
Direto do campo — aquelas que vale a pena ter uma resposta pronta.
Segundo o guia: primeiro obtenha o diagrama de topologia de rede e o plano de dados (interfaces, VLANs, endereços IP), e prepare suas ferramentas e cabos — cabo de console, adaptador, cabos diretos, fibra e SFPs, medidor de potência óptica — para não precisar procurar equipamento no meio da verificação.
Todas as etapas de instantâneo de saúde desta lista pressupõem que o acesso por Console, Telnet ou STelnet já funciona. Se não funcionar, o guia te direciona para um procedimento separado para dispositivos aos quais você não consegue fazer login, em vez de qualquer uma das verificações abordadas aqui.
O guia lista um kit específico: um cabo serial RS232 padrão, um adaptador serial para USB para terminais sem porta serial, dois cabos Ethernet diretos, cordões de fibra com módulos SFP/eSFP/SFP+, e um medidor de potência óptica para teste de interface óptica.
O limiar do guia é CPU abaixo de 80% e memória abaixo de 60%, mas uma leitura acima disso não é um veredito instantâneo — a instrução é observá-la por cinco a dez minutos. Se permanecer alta, é quando se deve passar a coletar informações da falha em vez de continuar observando.
No mínimo: uma configuração salva mais display current-configuration, um despejo completo de display diagnostic-information, e ambos os tipos de log (save logfile e save diag-logfile) transferidos para fora do dispositivo no mesmo dia — veja a lista acima para a sequência completa.
Esta lista de verificação é construída a partir do Guia de manutenção rápida NetEngine AR da Huawei — suas recomendações de “antes de assumir a manutenção” e suas verificações de luzes indicadoras, alarmes, instantâneo de saúde e status das placas. Ela cobre especificamente a sequência do primeiro dia para roteadores da série AR. O que fazer quando você não consegue fazer login de jeito nenhum, os procedimentos de devolução por falha de hardware, e as etapas de transição específicas de switch ou firewall são capítulos diferentes do mesmo guia e não são cobertos aqui.
Envie-nos o modelo do dispositivo, a versão do software e o que você já consegue ver no instantâneo de saúde — ajudaremos você a descobrir o que realmente está rodando antes de mudar qualquer coisa.