Inicio / Notas técnicas / Guía de reemplazo de un miembro del stack

Cómo reemplazar un switch miembro de stack averiado sin detener el stack

Un stack sigue reenviando tráfico cuando falla un miembro — pero sustituir ese miembro sin provocar una segunda interrupción exige un orden concreto: confirmar que el modelo, la versión y el parche coinciden exactamente, dar de alta el nuevo equipo como dispositivo no gestionado, asegurarse de que el equipo averiado nunca fue el maestro del stack, y solo entonces apagarlo. Esta es esa secuencia completa de reemplazo, la lista de verificación previa, y cómo comprobar que el cambio realmente funcionó.

Por Yuwen Zhang (Atlas), fundador de AtlasCommTech — 13 años de despliegues de redes de operadores y empresariales · Actualizado en julio de 2026

Por qué un stack sobrevive al fallo de un miembro — y por qué el reemplazo aún exige disciplina

Un sistema en stack está diseñado para seguir reenviando tráfico cuando falla un switch miembro — esa resiliencia es la razón de ser del apilamiento. Es el propio reemplazo donde un paso apresurado puede anularla.

Cuando un switch miembro de un stack presenta una avería, o envejece hasta afectar el negocio, la solución es sencilla en principio: traer un equipo de reemplazo del mismo modelo, versión y parche, e instalarlo. Lo que la documentación de mantenimiento original vigila con cuidado es todo lo que rodea ese cambio — el nuevo equipo debe coincidir exactamente con el averiado, su configuración de stack (número de slot, prioridad, puerto de stack) debe cuadrar antes de que se una, y el equipo averiado no debe ser el maestro del stack en el momento de apagarlo. Confirme que la License tiene capacidad para un dispositivo gestionado más antes de empezar, o el nuevo equipo no se podrá añadir en absoluto.

Si este stack lo construyó otra persona, o lo heredó a mitad de una avería, el modelo, versión, parche, número de slot y prioridad del miembro averiado no son cosas para adivinar de memoria. Extráigalos del controlador con la misma disciplina que emplearía en una red que asume por primera vez, y luego haga coincidir el reemplazo con lo que realmente encontró en el equipo — no con lo que sugiere la etiqueta de la caja.

La secuencia de reemplazo segura

Cada etapa que sigue existe para evitar que la identidad del equipo averiado entre en conflicto con la del nuevo, y para mantener intacto el rol maestro del stack hasta que el cambio esté realmente terminado.

1. VERIFY Model, version, patch match exactly. Slot ID and priority match the faulty unit. 2. STAGE Add new unit on the controller by ESN, set to join no site. Save config, power off. 3. SWAP Confirm faulty unit is not Master. Power it off, physically swap, reconnect cabling. 4. CONFIRM Auto-join, save stack config. Controller shows new unit online. The controller's replace operation matches the new unit to the faulty one by ESN — it is a separate action from the physical cable swap.

Las etiquetas del diagrama se mantienen en inglés para mayor claridad técnica.

La operación de reemplazo en el controlador y el cambio físico son dos acciones distintas — es la coincidencia del ESN lo que le indica al controlador que el nuevo equipo sustituye al antiguo, y no que se trata de una incorporación nueva al stack.

Lista de verificación previa al reemplazo

Cinco verificaciones, extraídas directamente del procedimiento original — modelo y versión, identidad de stack, rol maestro y margen de License.

VerificaciónQué confirmarPor qué importa
Modelo / versión / parchedisplay device en el nuevo equipo muestra el mismo Type que el equipo averiado; display startup muestra el mismo software de sistema de arranque y el mismo paquete de parche.Un modelo, versión o parche que no coincidan es exactamente lo que la documentación original señala como motivo para detenerse y buscar otro equipo en lugar de continuar.
ID de stack y prioridadEl número de slot y la prioridad del equipo averiado, leídos en la pestaña Stack del controlador, deben coincidir con lo que configure en el nuevo equipo antes de que se una.Un equipo nuevo se une por defecto en el slot 0 con prioridad 100; unirse con el número de slot incorrecto rompe la coincidencia de reemplazo por ESN en el controlador.
Puerto de stack (solo apilamiento por cable)Si el stack usa cables ordinarios en lugar de cables de stack dedicados o una tarjeta de stack, el puerto de stack se configura para coincidir con los puertos de negocio originales del equipo averiado.Los cables de stack dedicados y las tarjetas de stack no necesitan ninguna configuración de este tipo — configurarla cuando no hace falta, u omitirla cuando sí hace falta, rompen la unión en ambos casos.
Rol maestrodisplay stack en el equipo averiado muestra su Role, que no debe ser Master.Apagar el maestro del stack a mitad del reemplazo es un evento distinto, mucho más disruptivo que reemplazar un miembro en espera — haga primero la conmutación si el valor es Master.
Capacidad de LicenseLa License tiene margen para un dispositivo gestionado más antes de añadir el nuevo equipo.Sin capacidad de sobra, el controlador no puede poner el nuevo equipo bajo gestión en absoluto, y el reemplazo se detiene antes de empezar.

Fuente: documentación de mantenimiento de la solución de red de campus de alta densidad, procedimiento de reemplazo de miembro de stack.

Comandos que confirman cada etapa

Seis comandos, todos ejecutados en el propio equipo, que confirman la etapa en la que realmente se encuentra antes de pasar a la siguiente.

EtapaComandoQué confirma
Verificación de modelodisplay deviceMuestra el Type (modelo) del equipo — debe coincidir exactamente con el modelo del equipo averiado.
Verificación de versión / parchedisplay startupMuestra el software de sistema y el paquete de parche configurados y los del próximo arranque.
Identidaddisplay esnLee el ESN del nuevo equipo, necesario para registrarlo en el controlador.
Estado del stackdisplay stackMuestra Slot, Priority y Role de cada miembro — Role es el campo que hay que revisar antes de apagar nada.
Estado del puerto de stackdisplay stack port briefMuestra el estado físico y de protocolo de cada puerto de stack antes de tocar la configuración de interfaz.
Persistir la configuraciónsave / save stack configurationGuarda la configuración en ejecución, y por separado la configuración del stack, para que la unión sobreviva a un reinicio.
<HUAWEI> display device
S5735-S24T4X's Device status:
Slot Sub  Type                Online    Power      Register     Status   Role
0    -    S5735-S24T4X       Present   PowerOn    Registered   Normal   Master

<HUAWEI> display startup
Startup system software:  flash:/s5735-s-v200r019c10spc500.cc
Startup patch package:    flash:/s5735-s-v200r019sph020.pat

<HUAWEI> display esn
ESN of slot 0: 210235860012xxxxxxxx

<HUAWEI> display stack
Slot    Role        MAC address       Priority   Device type
0    Master      xxxx-xxxx-xxx1    100         S5735-S24T4X
1   Standby     xxxx-xxxx-xxx2    100         S5735-S24T4X

<HUAWEI> system-view
[HUAWEI] stack slot 0 renumber 1
Warning: All the configurations related to the slot ID will be lost after the slot ID is modified.
Do not frequently modify the slot ID because it will make the stack split. Continue? [Y/N]:y

[HUAWEI] stack slot 1 priority 150
Warning: Do not frequently modify the priority because it will make the stack split. Continue? [Y/N]:y

<HUAWEI> system-view
[HUAWEI] slave switchover

<HUAWEI> save
<HUAWEI> save stack configuration

Fuente: documentación de mantenimiento de la solución de red de campus de alta densidad — los comandos mostrados provienen del procedimiento original, con valores y campos MAC/ESN anonimizados.

5 trampas: dónde este reemplazo realmente sale mal

El mismo procedimiento que la lista de verificación anterior — esto es lo que pasa cuando se salta un paso, y qué comprobar en su lugar.

1. Reemplazar primero el switch maestro convierte un cambio planificado en una división de stack no planificada

RIESGOEl campo Role de display stack no es un trámite — si el equipo averiado es el maestro del stack, apagarlo antes de conmutar los roles derriba de golpe todo el plano de control del stack, no solo el miembro que quería reemplazar.

PRÁCTICA MÁS SEGURARevise Role antes de tocar la alimentación. Si muestra Master, ejecute primero slave switchover y confirme que el rol realmente ha cambiado antes de continuar — la misma disciplina que nuestra lista de comandos peligrosos aplica a cualquier comando capaz de derribar todo un equipo de golpe.

2. Que el modelo coincida no basta — la versión y el parche también deben coincidir

RIESGOdisplay device solo confirma el modelo (Type). La documentación original es explícita: la versión y el paquete de parche del nuevo equipo, visibles en display startup, deben ser idénticos a los del equipo averiado — un equipo del mismo modelo con una versión o parche distinto puede seguir sin unirse limpiamente.

PRÁCTICA MÁS SEGURARevise ambos comandos antes de tocar un cable — display device para el modelo, display startup para el software de sistema de arranque y el paquete de parche exactos — y corrija cualquier discrepancia en el nuevo equipo antes de que se acerque al stack.

3. Añadir el nuevo equipo a un sitio rompe la coincidencia de reemplazo por ESN

RIESGOEl flujo de reemplazo del controlador empareja el nuevo equipo con el averiado por ESN. Añadir el nuevo dispositivo a cualquier sitio durante el paso inicial de alta lo convierte en un dispositivo gestionado ordinario en lugar de un candidato de reemplazo en espera, y la operación de reemplazo no lo encontrará.

PRÁCTICA MÁS SEGURAAl añadir el nuevo equipo en el controlador, configure siempre el Sitio en “no unirse a ningún sitio”, y tampoco le asigne un sitio más adelante en el proceso — el paso de reemplazo depende de ese estado no gestionado.

4. Cambiar el ID de slot o la prioridad a la ligera arriesga dividir el stack, no solo renumerarlo

RIESGOLa propia advertencia de la documentación original sobre stack slot renumber y stack slot priority es inequívoca: cambios frecuentes en cualquiera de los dos valores pueden dividir el stack. No es un comando de renumeración cosmético.

PRÁCTICA MÁS SEGURACambie el ID de slot y la prioridad una sola vez, de forma deliberada, para que coincidan con los valores conocidos del equipo averiado extraídos del controlador — trate ambos comandos como una corrección única durante este reemplazo, no como algo para ajustar repetidamente durante la resolución de problemas.

5. Sin capacidad de License de sobra, el nuevo equipo nunca queda gestionado

RIESGOSi la License no tiene margen para un dispositivo gestionado más, el controlador no puede poner el nuevo equipo bajo gestión — el reemplazo se detiene en el paso de alta del dispositivo, no en el cambio físico, y es fácil descubrirlo demasiado tarde si se revisa la capacidad después de haber apagado ya el equipo averiado.

PRÁCTICA MÁS SEGURAConfirme el margen de License antes de apagar nada. Si no hay ninguno, amplíe primero la License de gestión de dispositivos — una comprobación de cinco minutos que evita que el equipo averiado quede apagado sin un reemplazo listo para ocupar su lugar.

La secuencia completa de reemplazo, paso a paso

Respalde la configuración actual del stack antes de empezar — un simple save en el stack captura la configuración en ejecución, y no cuesta nada tener esa instantánea a mano por si algún paso de abajo necesita deshacerse antes incluso de que el equipo averiado se apague.

  1. Confirme que el modelo del nuevo equipo coincide con el del averiado — revise el Type del equipo averiado en la pestaña Stack del controlador, luego ejecute display device en el nuevo equipo y compare el Type campo por campo.
  2. Confirme que la versión y el parche coinciden — ejecute display startup en el nuevo equipo y compare el software de sistema de arranque y el paquete de parche con los del equipo averiado, mostrados en el controlador en la información de versión y parche del stack; corrija cualquier discrepancia antes de continuar.
  3. Lea el ESN del nuevo equipo con display esn — el controlador necesita ese valor exacto para registrar el reemplazo.
  4. Configure el número de slot de stack y la prioridad del nuevo equipo para que coincidan con los del equipo averiado, usando stack slot slot-id renumber new-slot-id y stack slot slot-id priority priority — cambie cada valor una sola vez, y espere un aviso de reinicio tras el cambio del ID de slot.
  5. Si el stack usa cables ordinarios en lugar de cables de stack dedicados o una tarjeta de stack, configure el puerto de stack con interface stack-port y port interface ... enable, haciéndolo coincidir con los puertos de negocio originales del equipo averiado.
  6. Guarde la configuración en el nuevo equipo, y luego apáguelo.
  7. En el controlador, añada manualmente el nuevo equipo — protocolo NETCONF, sitio configurado como no unirse a ningún sitio, modo configurado como modelo de dispositivo — e introduzca su ESN.
  8. Confirme en el stack que el Role del equipo averiado no es Master; si lo es, ejecute primero slave switchover.
  9. Apague el equipo averiado — el controlador lo mostrará como fuera de línea.
  10. En la pestaña Stack del controlador, ejecute la operación de reemplazo del grupo de dispositivos, seleccionando el nuevo equipo como sustituto del que está fuera de línea.
  11. Instale físicamente el nuevo equipo en el lugar del averiado, reconectando el cableado de stack y el cableado de negocio exactamente como estaba. Enciéndalo, confirme que el equipo se une automáticamente al stack, y guarde la configuración.
  12. Ejecute display device en el stack para confirmar que cada miembro muestra Normal y está registrado, y luego ejecute save stack configuration para persistir la configuración a nivel de stack.
  13. En el controlador, confirme que el nuevo equipo aparece como registrado y en línea, coincidiendo por su ESN.

Diseños de soluciones relacionadas

Seis preguntas que surgen constantemente

Sacadas directamente del terreno — las que vale la pena tener respondidas de antemano.

¿Puedo reemplazar un miembro del stack con un modelo de hardware distinto si es lo único que tengo a mano?

No según este procedimiento — la documentación original exige que el modelo, la versión y el parche del equipo de reemplazo coincidan exactamente con el equipo averiado. Si ninguno de sus repuestos coincide, lo más seguro es conseguir un equipo que coincida en lugar de forzar uno distinto dentro del stack.

¿Qué pasa realmente si el equipo averiado resulta ser el maestro del stack?

Apagarlo directamente derribaría el plano de control del stack junto con el miembro que quería reemplazar. Ejecute primero slave switchover, confirme que el campo Role ha cambiado, y solo entonces continúe con el reemplazo.

¿Necesito configurar un puerto de stack en el nuevo equipo?

Solo si el stack usa cables ordinarios para apilar. Los cables de stack dedicados o una tarjeta de stack no necesitan ese paso de configuración en absoluto — compruebe qué tipo usa este stack antes de suponer nada.

¿Qué pasa si la License no tiene capacidad restante cuando intento añadir el nuevo equipo?

El controlador no pondrá el nuevo equipo bajo gestión hasta que haya margen. Amplíe primero la License de gestión de dispositivos — vale la pena comprobar esto antes de apagar el equipo averiado, no después.

¿Cómo confirmo que el reemplazo realmente tuvo éxito, más allá de que el equipo encienda?

Dos comprobaciones independientes: display device en el stack debe mostrar cada miembro como Normal y registrado, y el controlador debe mostrar el nuevo equipo registrado y en línea, coincidiendo con el ESN que introdujo al añadirlo.

¿Hay alguna manera de hacer esto sin apagar el equipo averiado en absoluto?

No con este procedimiento — el equipo averiado se apaga antes del cambio físico. Esa pérdida breve y planificada de un miembro es exactamente lo que los demás miembros del stack están diseñados para absorber; no es lo mismo que una interrupción total no planificada del stack.

Límites honestos de esta nota

Límites honestos de esta nota

Esta nota sigue el procedimiento de reemplazo de miembro de stack de la documentación de mantenimiento de la solución de red de campus de alta densidad, cubriendo switches gestionados por iMaster NCE-Campus mediante los flujos de alta y reemplazo del controlador mostrados aquí. Asume un reemplazo del mismo fabricante, mismo modelo, misma versión — el reemplazo de stack entre fabricantes distintos no está cubierto, y este flujo no lo admite. Tampoco cubre el reemplazo de más de un miembro a la vez; hágalo uno por uno, verificando cada uno antes de empezar el siguiente.

¿No está seguro de que su equipo de reemplazo realmente coincida?

Envíenos la salida de display device y display startup tanto del equipo averiado como del reemplazo, además de la vista de versión/parche de stack del controlador, y le ayudaremos a confirmar la coincidencia antes de apagar nada.

WhatsApp con un ingeniero →

Lectura relacionada

Solo usamos cookies para analítica anónima — sin publicidad ni rastreo entre sitios.Política de privacidad