Início / Notas técnicas / Guia de substituição de um membro do stack

Substituindo um switch membro de stack com falha sem derrubar o stack

Um stack continua encaminhando tráfego quando um membro falha — mas substituir esse membro sem causar uma segunda interrupção exige uma ordem específica: confirmar que modelo, versão e patch coincidem exatamente, cadastrar o novo equipamento como dispositivo não gerenciado, garantir que o equipamento com falha nunca foi o mestre do stack, e só então desligá-lo. Esta é essa sequência completa de substituição, a lista de verificação prévia, e como confirmar que a troca realmente funcionou.

Por Yuwen Zhang (Atlas), fundador da AtlasCommTech — 13 anos de implantações de redes de operadoras e empresariais · Atualizado em julho de 2026

Por que um stack sobrevive à falha de um membro — e por que a substituição ainda exige disciplina

Um sistema em stack é projetado para continuar encaminhando tráfego quando um switch membro falha — essa resiliência é todo o propósito do empilhamento. É a própria substituição o ponto em que um passo apressado pode anulá-la.

Quando um switch membro de um stack apresenta falha, ou envelhece a ponto de afetar o negócio, a solução é simples em princípio: trazer um equipamento de substituição do mesmo modelo, versão e patch, e instalá-lo. O que a documentação de manutenção original trata com cuidado é tudo o que envolve essa troca — o novo equipamento precisa corresponder exatamente ao com falha, sua configuração de stack (número de slot, prioridade, porta de stack) precisa estar alinhada antes de ingressar, e o equipamento com falha não pode ser o mestre do stack no momento de ser desligado. Confirme que a License tem capacidade para mais um dispositivo gerenciado antes de começar, ou o novo equipamento simplesmente não será adicionado.

Se este stack foi montado por outra pessoa, ou você o herdou no meio de uma falha, o modelo, versão, patch, número de slot e prioridade do membro com falha não são coisas para adivinhar de memória. Extraia-os do controlador com a mesma disciplina que usaria em uma rede que está assumindo pela primeira vez, e então faça o substituto corresponder ao que você realmente encontrou no equipamento — não ao que a etiqueta da caixa sugere.

A sequência de substituição segura

Cada etapa abaixo existe para evitar que a identidade do equipamento com falha entre em conflito com a do novo, e para manter intocado o papel de mestre do stack até que a troca esteja realmente concluída.

1. VERIFY Model, version, patch match exactly. Slot ID and priority match the faulty unit. 2. STAGE Add new unit on the controller by ESN, set to join no site. Save config, power off. 3. SWAP Confirm faulty unit is not Master. Power it off, physically swap, reconnect cabling. 4. CONFIRM Auto-join, save stack config. Controller shows new unit online. The controller's replace operation matches the new unit to the faulty one by ESN — it is a separate action from the physical cable swap.

Os rótulos do diagrama são mantidos em inglês para clareza técnica.

A operação de substituição no controlador e a troca física são duas ações diferentes — é a correspondência do ESN que informa ao controlador que o novo equipamento está substituindo o antigo, e não que é uma adição nova ao stack.

Lista de verificação antes da substituição

Cinco verificações, extraídas diretamente do procedimento original — modelo e versão, identidade do stack, papel de mestre e margem de License.

VerificaçãoO que confirmarPor que importa
Modelo / versão / patchdisplay device no novo equipamento mostra o mesmo Type do equipamento com falha; display startup mostra o mesmo software de sistema de inicialização e o mesmo pacote de patch.Um modelo, versão ou patch incompatíveis são exatamente o que a documentação original aponta como motivo para parar e buscar outro equipamento em vez de prosseguir.
ID de stack e prioridadeO número de slot e a prioridade do equipamento com falha, lidos na aba Stack do controlador, devem corresponder ao que você configura no novo equipamento antes que ele ingresse.Um equipamento novo ingressa por padrão no slot 0 com prioridade 100; ingressar com o número de slot errado quebra a correspondência de substituição por ESN no controlador.
Porta de stack (apenas empilhamento por cabo)Se o stack usa cabos comuns em vez de cabos de stack dedicados ou uma placa de stack, a porta de stack é configurada para corresponder às portas de negócio originais do equipamento com falha.Cabos de stack dedicados e placas de stack não precisam de nenhuma configuração desse tipo — configurá-la quando não é necessária, ou omiti-la quando é, ambos quebram o ingresso.
Papel de mestredisplay stack no equipamento com falha mostra seu Role, que não pode ser Master.Desligar o mestre do stack no meio da substituição é um evento diferente, muito mais disruptivo do que substituir um membro em standby — faça a comutação primeiro se o valor for Master.
Capacidade de LicenseA License tem margem para mais um dispositivo gerenciado antes de o novo equipamento ser adicionado.Sem capacidade sobrando, o controlador não consegue colocar o novo equipamento sob gerenciamento de forma alguma, travando a substituição antes mesmo de começar.

Fonte: documentação de manutenção da solução de rede de campus de alta densidade, procedimento de substituição de membro de stack.

Comandos que confirmam cada etapa

Seis comandos, todos executados no próprio equipamento, que confirmam a etapa em que você realmente está antes de passar para a próxima.

EtapaComandoO que confirma
Verificação de modelodisplay deviceMostra o Type (modelo) do equipamento — deve corresponder exatamente ao modelo do equipamento com falha.
Verificação de versão / patchdisplay startupMostra o software de sistema e o pacote de patch configurados e os da próxima inicialização.
Identidadedisplay esnLê o ESN do novo equipamento, necessário para registrá-lo no controlador.
Estado do stackdisplay stackMostra Slot, Priority e Role de cada membro — Role é o campo a verificar antes de desligar qualquer coisa.
Estado da porta de stackdisplay stack port briefMostra o estado físico e de protocolo de cada porta de stack antes de você mexer na configuração de interface.
Persistir a configuraçãosave / save stack configurationGrava a configuração em execução, e separadamente a configuração do stack, para que o ingresso sobreviva a uma reinicialização.
<HUAWEI> display device
S5735-S24T4X's Device status:
Slot Sub  Type                Online    Power      Register     Status   Role
0    -    S5735-S24T4X       Present   PowerOn    Registered   Normal   Master

<HUAWEI> display startup
Startup system software:  flash:/s5735-s-v200r019c10spc500.cc
Startup patch package:    flash:/s5735-s-v200r019sph020.pat

<HUAWEI> display esn
ESN of slot 0: 210235860012xxxxxxxx

<HUAWEI> display stack
Slot    Role        MAC address       Priority   Device type
0    Master      xxxx-xxxx-xxx1    100         S5735-S24T4X
1   Standby     xxxx-xxxx-xxx2    100         S5735-S24T4X

<HUAWEI> system-view
[HUAWEI] stack slot 0 renumber 1
Warning: All the configurations related to the slot ID will be lost after the slot ID is modified.
Do not frequently modify the slot ID because it will make the stack split. Continue? [Y/N]:y

[HUAWEI] stack slot 1 priority 150
Warning: Do not frequently modify the priority because it will make the stack split. Continue? [Y/N]:y

<HUAWEI> system-view
[HUAWEI] slave switchover

<HUAWEI> save
<HUAWEI> save stack configuration

Fonte: documentação de manutenção da solução de rede de campus de alta densidade — os comandos exibidos vêm do procedimento original, com valores e campos MAC/ESN anonimizados.

5 armadilhas: onde essa substituição realmente dá errado

O mesmo procedimento da lista de verificação acima — aqui está o que acontece quando um passo é pulado, e o que verificar em vez disso.

1. Substituir primeiro o switch mestre transforma uma troca planejada em uma divisão de stack não planejada

RISCOO campo Role do display stack não é uma formalidade — se o equipamento com falha for o mestre do stack, desligá-lo antes de comutar os papéis derruba de uma vez todo o plano de controle do stack, não apenas o membro que você queria substituir.

PRÁTICA MAIS SEGURAVerifique o Role antes de mexer na alimentação. Se mostrar Master, execute primeiro o slave switchover e confirme que o papel realmente mudou antes de prosseguir — a mesma disciplina que a lista de comandos perigosos deste site aplica a qualquer comando capaz de derrubar um equipamento inteiro de uma vez.

2. Modelo compatível não é suficiente — versão e patch também precisam coincidir

RISCOdisplay device só confirma o modelo (Type). A documentação original é explícita: a versão e o pacote de patch do novo equipamento, visíveis em display startup, precisam ser idênticos aos do equipamento com falha — um equipamento do mesmo modelo rodando uma versão ou patch diferente ainda pode falhar ao ingressar corretamente.

PRÁTICA MAIS SEGURAVerifique os dois comandos antes de tocar em qualquer cabo — display device para o modelo, display startup para o software de sistema de inicialização e o pacote de patch exatos — e corrija qualquer incompatibilidade no novo equipamento antes que ele chegue perto do stack.

3. Adicionar o novo equipamento a um site quebra a correspondência de substituição por ESN

RISCOO fluxo de substituição do controlador combina o novo equipamento com o com falha por ESN. Adicionar o novo dispositivo a qualquer site durante a etapa inicial de adição o transforma em um dispositivo gerenciado comum em vez de um candidato de substituição em espera, e a operação de substituição não o encontrará.

PRÁTICA MAIS SEGURAAo adicionar o novo equipamento no controlador, sempre defina o Site como “não ingressar em nenhum site”, e também não atribua um site mais tarde no processo — a etapa de substituição depende desse estado não gerenciado.

4. Alterar o ID de slot ou a prioridade sem cuidado arrisca dividir o stack, não apenas renumerá-lo

RISCOO próprio aviso da documentação original sobre stack slot renumber e stack slot priority é inequívoco: mudanças frequentes em qualquer um dos valores podem dividir o stack. Não é um comando de renumeração cosmético.

PRÁTICA MAIS SEGURAAltere o ID de slot e a prioridade apenas uma vez, deliberadamente, para corresponder aos valores conhecidos do equipamento com falha extraídos do controlador — trate ambos os comandos como uma correção única durante esta substituição, não como algo para ajustar repetidamente durante a solução de problemas.

5. Sem capacidade de License sobrando, o novo equipamento nunca é gerenciado

RISCOSe a License não tiver margem para mais um dispositivo gerenciado, o controlador não consegue colocar o novo equipamento sob gerenciamento — a substituição trava na etapa de adição do dispositivo, não na troca física, e é fácil descobrir isso tarde demais se você verificar a capacidade depois de já ter desligado o equipamento com falha.

PRÁTICA MAIS SEGURAConfirme a margem de License antes de desligar qualquer coisa. Se não houver, amplie primeiro a License de gerenciamento de dispositivos — uma verificação de cinco minutos que evita que o equipamento com falha fique desligado sem um substituto pronto para ocupar seu lugar.

A sequência completa de substituição, passo a passo

Faça backup da configuração atual do stack antes de começar — um simples save no stack captura a configuração em execução, e não custa nada ter esse instantâneo à mão caso algum passo abaixo precise ser desfeito antes mesmo de o equipamento com falha ser desligado.

  1. Confirme que o modelo do novo equipamento corresponde ao do com falha — verifique o Type do equipamento com falha na aba Stack do controlador, depois execute display device no novo equipamento e compare o Type campo a campo.
  2. Confirme que a versão e o patch coincidem — execute display startup no novo equipamento e compare o software de sistema de inicialização e o pacote de patch com os do equipamento com falha, mostrados no controlador nas informações de versão e patch do stack; corrija qualquer incompatibilidade antes de continuar.
  3. Leia o ESN do novo equipamento com display esn — o controlador precisa desse valor exato para registrar a substituição.
  4. Configure o número de slot de stack e a prioridade do novo equipamento para corresponder aos do equipamento com falha, usando stack slot slot-id renumber new-slot-id e stack slot slot-id priority priority — altere cada valor apenas uma vez, e espere um aviso de reinicialização após a mudança do ID de slot.
  5. Se o stack usa cabos comuns em vez de cabos de stack dedicados ou uma placa de stack, configure a porta de stack com interface stack-port e port interface ... enable, correspondendo às portas de negócio originais do equipamento com falha.
  6. Salve a configuração no novo equipamento, e então desligue-o.
  7. No controlador, adicione manualmente o novo equipamento — protocolo NETCONF, site definido como não ingressar em nenhum site, modo definido como modelo de dispositivo — e insira seu ESN.
  8. Confirme no stack que o Role do equipamento com falha não é Master; se for, execute primeiro slave switchover.
  9. Desligue o equipamento com falha — o controlador o mostrará como offline.
  10. Na aba Stack do controlador, execute a operação de substituição do grupo de dispositivos, selecionando o novo equipamento como substituto do que está offline.
  11. Instale fisicamente o novo equipamento no lugar do com falha, reconectando o cabeamento de stack e o cabeamento de negócio exatamente como estava. Ligue, confirme que o equipamento ingressa automaticamente no stack, e salve a configuração.
  12. Execute display device no stack para confirmar que cada membro mostra Normal e está registrado, e então execute save stack configuration para persistir a configuração em nível de stack.
  13. No controlador, confirme que o novo equipamento aparece como registrado e online, correspondendo pelo seu ESN.

Projetos de soluções relacionadas

Seis perguntas que surgem constantemente

Tiradas diretamente do campo — as que vale a pena ter uma resposta pronta.

Posso substituir um membro do stack por um modelo de hardware diferente se é o único que tenho à mão?

Não segundo este procedimento — a documentação original exige que o modelo, a versão e o patch do equipamento de substituição correspondam exatamente ao equipamento com falha. Se nenhum dos seus sobressalentes corresponder, o caminho mais seguro é providenciar um equipamento compatível em vez de forçar um incompatível no stack.

O que realmente acontece se o equipamento com falha for o mestre do stack?

Desligá-lo diretamente derrubaria o plano de controle do stack junto com o membro que você queria substituir. Execute primeiro o slave switchover, confirme que o campo Role mudou, e só então continue com a substituição.

Preciso configurar uma porta de stack no novo equipamento?

Somente se o stack usar cabos comuns para empilhar. Cabos de stack dedicados ou uma placa de stack não precisam desse passo de configuração de forma alguma — verifique qual tipo este stack usa antes de supor qualquer coisa.

E se a License não tiver capacidade restante quando eu tentar adicionar o novo equipamento?

O controlador não colocará o novo equipamento sob gerenciamento até que haja margem. Amplie primeiro a License de gerenciamento de dispositivos — vale a pena verificar isso antes de o equipamento com falha ser desligado, não depois.

Como confirmo que a substituição realmente teve sucesso, além do equipamento ligar?

Duas verificações independentes: display device no stack deve mostrar cada membro como Normal e registrado, e o controlador deve mostrar o novo equipamento registrado e online, correspondendo ao ESN que você inseriu ao adicioná-lo.

Existe alguma forma de fazer isso sem desligar o equipamento com falha de jeito nenhum?

Não neste procedimento — o equipamento com falha é desligado antes da troca física. Essa perda breve e planejada de um membro é exatamente o que os demais membros do stack foram projetados para absorver; não é o mesmo que uma interrupção total não planejada do stack.

Limites honestos desta nota

Limites honestos desta nota

Esta nota segue o procedimento de substituição de membro de stack da documentação de manutenção da solução de rede de campus de alta densidade, cobrindo switches gerenciados pelo iMaster NCE-Campus através dos fluxos de adição e substituição do controlador mostrados aqui. Ela assume uma substituição do mesmo fabricante, mesmo modelo, mesma versão — a substituição de stack entre fabricantes diferentes não é coberta, e não é suportada por este fluxo. Também não cobre a substituição de mais de um membro por vez; faça um de cada vez, verificando cada um antes de iniciar o próximo.

Não tem certeza se o seu equipamento de substituição realmente é compatível?

Envie-nos a saída de display device e display startup tanto do equipamento com falha quanto do substituto, além da visão de versão/patch de stack do controlador, e ajudaremos você a confirmar a compatibilidade antes de desligar qualquer coisa.

WhatsApp com um engenheiro →

Leitura relacionada

Usamos cookies apenas para análises anônimas — sem anúncios, sem rastreamento entre sites.Política de privacidade