Início / Notas técnicas / Assumindo o controle de uma rede desconhecida

Assumindo o controle de uma rede desconhecida: a lista de verificação do primeiro dia

Tirado diretamente do Guia de manutenção rápida NetEngine AR da Huawei — o que reunir antes de tocar em um dispositivo configurado por outra pessoa, as quatro verificações que constroem um instantâneo de saúde em minutos, e a linha de base que você deve salvar antes de executar um único comando que mude qualquer coisa.

By Yuwen Zhang (Atlas), founder of AtlasCommTech — 13 years of carrier & enterprise network deployments · Updated July 2026

A rede que você acabou de herdar não tem nenhuma anotação — crie algumas antes de tocar em qualquer coisa

O conselho do guia para assumir a manutenção de um dispositivo é direto: consiga o mapa e as ferramentas antes de fazer login, não depois que algo quebrar.

O Guia de manutenção rápida NetEngine AR da Huawei abre seu capítulo de manutenção com uma recomendação curta, em duas etapas, para qualquer pessoa prestes a assumir a responsabilidade por um dispositivo: primeiro obter a topologia de rede e o plano de dados, depois preparar as ferramentas necessárias — antes de fazer qualquer outra coisa. É um pequeno passo que mais importa exatamente quando é mais frequentemente ignorado: o primeiro dia com uma rede construída por outra pessoa, onde ninguém no local anotou o que realmente está configurado.

A seguir está a sequência real do primeiro dia segundo esse guia: o mapa e as ferramentas a reunir, as quatro verificações que constroem um instantâneo de saúde em poucos minutos e, separadamente, o que fazer se você nem sequer conseguir fazer login ainda.

De “nenhuma anotação sobre este dispositivo” a uma linha de base de saúde documentada

Seis etapas, na própria ordem do guia — cada uma pressupõe que você está começando do zero.

1 · TOPOLOGY & DATA PLAN Interfaces, VLANs, IPs — printed and posted on-site REF: topology diagram + data plan 2 · STAGE TOOLS & CABLES Console cable, adapter, cables, fiber + SFPs, power meter REF: maintenance tool kit 3 · LOG IN & CHECK LIGHTS Console / Telnet / STelnet — match every light to its table REF: indicator normal-state table 4 · CHECK ACTIVE ALARMS display alarm active — flag Critical or Major entries REF: alarm severity levels 5 · CHECK HEALTH SNAPSHOT display health — temp, power, fan, CPU, memory REF: health thresholds 6 · CAPTURE THE BASELINE Diagnostic info + logs saved off-device, before any change REF: dia-info.txt + logfile

Os rótulos do diagrama permanecem em inglês para maior clareza técnica.

O guia se ramifica na etapa 3: se você não conseguir fazer login de jeito nenhum, este fluxo ainda não se aplica — ele te direciona para um procedimento separado para dispositivos aos quais você não consegue acessar.

O que reunir antes de fazer login

Duas coisas, segundo o guia, antes de tocar no dispositivo: o mapa e as ferramentas.

CategoriaItemFinalidade
DocumentaçãoDiagrama de topologia de rede + plano de dadosInterfaces, VLANs, endereços IP — impressos e afixados na sala de equipamentos para consulta rápida
CaboCabo serial RS232 padrãoLogin pela porta de console
CaboAdaptador serial para USBLogin de console pela porta USB do terminal de manutenção
CaboDois cabos Ethernet diretosAtivar a porta de gerenciamento ou outros serviços
CaboCordões de fibra + módulos SFP/eSFP/SFP+Conectar-se a dispositivos pares
Terminal de manutençãoNotebook com software de comunicação serialFazer login no dispositivo
Instrumento auxiliarMedidor de potência ópticaTeste de interface óptica — potência, sensibilidade de recepção

Se, mesmo com esse kit, você não conseguir de forma alguma uma sessão no dispositivo, o guia te direciona para um procedimento separado para dispositivos aos quais não se consegue fazer login — isso está fora do escopo desta lista de verificação.

As quatro verificações que constroem um instantâneo de saúde

Luzes indicadoras, alarmes ativos, um instantâneo do comando de saúde, status das placas — nessa ordem, diz o guia, e cada um indica quando parar e escalar.

VerificaçãoComando / MétodoComo é o estado normal
Luzes indicadorasVerificação visual em relação à serigrafiaSYS piscando verde lentamente; ACT verde fixo = ativo; PWR/TEMP/FAN/STATUS verde fixo; STAT piscando verde lentamente (fixo em 9ES2/4ES2G-S)
Alarmes ativosdisplay alarm activeNenhuma entrada Critical ou Major na saída
Instantâneo de saúdedisplay healthStatus de temperatura = NORMAL, Estado de energia = Supply, Registro do ventilador = YES, uso de CPU abaixo de 80%, uso de memória abaixo de 60%, uso de armazenamento abaixo de 80%
Status das placasdisplay deviceOnline = Present, Power = PowerOn, Register = Registered, Alarm = Normal para cada placa instalada
<Huawei> display alarm active | include Major
1/Independent/2014-10-02 21:38:10/2014-10-02 21:39:00/0xff8c205c/hwCPUUtilizationRising/Major/End/
OID 1.3.6.1.4.1.2011.5.25.219.2.14.1 CPU utilization exceeded the pre-alarm threshold.

<Huawei> display health
Slot Card Sensor No. SensorName        Status Upper Lower Temp(C)
11   -    1         SRU-400H TEMP      NORMAL 70    0     48
PowerNo Present Mode State   Current(A) Voltage(V) Power(W)
9       YES     AC   Supply  N/A        12         350
System CPU Usage Information:    SlotID 11  CPU Usage 7%   Upper Limit 80%
System Memory Usage Information: SlotID 11  Used 14%       Upper Limit 95%

<Huawei> display device
AR6300's Device status:
Slot Sub Type      Online   Power     Register     Alarm    Primary
14   -   SRU-200H   Present  PowerOn   Registered   Normal   Master

<Huawei> display diagnostic-information dia-info.txt
Info: The diagnostic information was saved to the device successfully.

<Huawei> save logfile
<Huawei> system-view
[Huawei] diagnose
[Huawei-diagnose] save diag-logfile

Qualquer verificação que retorne anormal tem a mesma próxima etapa no guia: se a solução documentada não a resolver, passe a coletar e relatar as informações da falha — não repetir a verificação.

5 armadilhas: o que atrapalha o primeiro dia na rede de outra pessoa

Nenhum desses é um caso extremo exótico — são os mesmos poucos erros contra os quais a própria estrutura do guia de origem alerta.

1. Um número “verde” do display health ainda merece uma segunda olhada

RISCOCPU abaixo de 80% e memória abaixo de 60% são os limiares de aprovação do guia, não uma garantia — a própria instrução do guia para uma leitura alta é observá-la por cinco a dez minutos antes de decidir que é um problema, não aceitá-la ou descartá-la com base em um único instantâneo.

PRÁTICA MAIS SEGURAFaça o instantâneo de saúde mais de uma vez em sua primeira sessão, com alguns minutos de intervalo, antes de concluir que o dispositivo está bem ou já está com dificuldades.

2. Executar display diagnostic-information enquanto CPU ou memória já estão altos piora um momento ruim

RISCOO guia diz explicitamente para verificar display cpu-usage e display memory antes de executar display diagnostic-information, e adiar o despejo de diagnóstico se algum já estiver elevado — o próprio comando adiciona carga exatamente quando o dispositivo menos pode arcar com isso.

PRÁTICA MAIS SEGURAVerifique primeiro a CPU e a memória. Se alguma estiver alta, espere ela se estabilizar antes de coletar um instantâneo de diagnóstico completo.

3. Uma luz piscando não é automaticamente um mau sinal — verifique a tabela de estado normal antes de reagir

RISCOA mesma serigrafia significa coisas diferentes em módulos diferentes — uma luz ACT fixa significa que a placa de controle principal está ativa, enquanto apagada significa em espera, e OUTPUT verde fixo significa espera fria enquanto verde piscando significa que está realmente fornecendo energia. Reagir a uma luz sem verificar o que ela significa para aquele módulo específico leva a perseguir um problema inexistente.

PRÁTICA MAIS SEGURAMantenha a tabela de estado normal aberta durante sua primeira verificação de luzes indicadoras, e só escale uma luz que não corresponda à sua própria linha.

4. Não deixe a curiosidade sobre um dispositivo herdado levar você a um comando da lista perigosa

RISCONenhuma etapa desse fluxo do primeiro dia exige reboot, format ou delete — mas um dispositivo desconhecido com configuração pouco clara é exatamente quando a tentação de “só reiniciar para ver” é mais forte, e exatamente quando é menos seguro fazer isso.

PRÁTICA MAIS SEGURASe uma verificação falhar e a correção não for óbvia, colete primeiro as informações da falha — não recorra a um comando da nossa lista de comandos perigosos para “testar” algo em um dispositivo que você ainda não entende.

5. Se você não conseguir fazer login de jeito nenhum, esta lista de verificação inteira é o documento errado

RISCOCada verificação neste guia — exceto as luzes indicadoras — pressupõe que você já consegue acessar o dispositivo via Console, Telnet ou STelnet. Se você não conseguir estabelecer uma sessão de jeito nenhum, seguir esse fluxo mesmo assim só desperdiça tempo em etapas que exigem um login que você não tem.

PRÁTICA MAIS SEGURAConfirme que você tem uma sessão funcional antes de iniciar as verificações de instantâneo de saúde; se não tiver, a própria próxima etapa do guia é um procedimento separado para dispositivos aos quais você não consegue fazer login.

Antes de mudar qualquer coisa: o que salvar como linha de base do primeiro dia

O próprio capítulo de relato de falhas do guia também serve como lista de verificação de linha de base do primeiro dia — salve isso agora, antes de fazer uma única alteração, e você o terá depois, quando realmente precisar.

  1. Salve a configuração em execução (save) e mantenha uma cópia de display current-configuration — um backup pontual feito antes de você mudar qualquer coisa, não depois.
  2. Gere um instantâneo de diagnóstico completo com display diagnostic-information dia-info.txt — o guia observa que ele reúne configuração de inicialização, configuração em execução, informações de interface, hora e versão do sistema em um único arquivo.
  3. Colete os dois tipos de log descritos pelo guia: save logfile para os logs de operação do usuário, e save diag-logfile mais terminal diag-logging para o log de diagnóstico.
  4. Transfira no mesmo dia o dia-info.txt e o conteúdo de sd1:/logfile/ para fora do dispositivo, via TFTP/FTP/SFTP — uma linha de base que só existe no dispositivo que você acabou de herdar não é uma linha de base.
  5. Arquive o diagrama de topologia e o plano de dados em algum lugar onde o próximo engenheiro realmente vá encontrá-los — não apenas impressos na parede onde você os encontrou.
  6. Mantenha nossa lista de coleta de informações de falha à mão desde o primeiro dia — os mesmos cinco campos (horário da falha, sintoma, impacto, topologia, ações já tomadas) se aplicam quer a falha apareça no dia um ou no dia cem.

Projetos de soluções relacionadas

Cinco perguntas que surgem constantemente

Direto do campo — aquelas que vale a pena ter uma resposta pronta.

Qual é a primeiríssima coisa a fazer antes de tocar em um dispositivo configurado por outra pessoa?

Segundo o guia: primeiro obtenha o diagrama de topologia de rede e o plano de dados (interfaces, VLANs, endereços IP), e prepare suas ferramentas e cabos — cabo de console, adaptador, cabos diretos, fibra e SFPs, medidor de potência óptica — para não precisar procurar equipamento no meio da verificação.

E se eu não conseguir fazer login no dispositivo de jeito nenhum no primeiro dia?

Todas as etapas de instantâneo de saúde desta lista pressupõem que o acesso por Console, Telnet ou STelnet já funciona. Se não funcionar, o guia te direciona para um procedimento separado para dispositivos aos quais você não consegue fazer login, em vez de qualquer uma das verificações abordadas aqui.

Preciso de ferramentas especiais, ou qualquer cabo de console serve?

O guia lista um kit específico: um cabo serial RS232 padrão, um adaptador serial para USB para terminais sem porta serial, dois cabos Ethernet diretos, cordões de fibra com módulos SFP/eSFP/SFP+, e um medidor de potência óptica para teste de interface óptica.

Como sei se um número de CPU ou memória do display health é realmente um problema?

O limiar do guia é CPU abaixo de 80% e memória abaixo de 60%, mas uma leitura acima disso não é um veredito instantâneo — a instrução é observá-la por cinco a dez minutos. Se permanecer alta, é quando se deve passar a coletar informações da falha em vez de continuar observando.

O que devo salvar antes de executar qualquer comando, caso algo dê errado depois?

No mínimo: uma configuração salva mais display current-configuration, um despejo completo de display diagnostic-information, e ambos os tipos de log (save logfile e save diag-logfile) transferidos para fora do dispositivo no mesmo dia — veja a lista acima para a sequência completa.

Limites honestos desta nota

Limites honestos desta nota

Esta lista de verificação é construída a partir do Guia de manutenção rápida NetEngine AR da Huawei — suas recomendações de “antes de assumir a manutenção” e suas verificações de luzes indicadoras, alarmes, instantâneo de saúde e status das placas. Ela cobre especificamente a sequência do primeiro dia para roteadores da série AR. O que fazer quando você não consegue fazer login de jeito nenhum, os procedimentos de devolução por falha de hardware, e as etapas de transição específicas de switch ou firewall são capítulos diferentes do mesmo guia e não são cobertos aqui.

Herdou uma rede sem nenhuma documentação?

Envie-nos o modelo do dispositivo, a versão do software e o que você já consegue ver no instantâneo de saúde — ajudaremos você a descobrir o que realmente está rodando antes de mudar qualquer coisa.

WhatsApp com um engenheiro →

Leituras relacionadas

Usamos cookies apenas para análises anônimas — sem anúncios, sem rastreamento entre sites.Política de privacidade