Um array totalmente flash promete latência em microssegundos e cumpre — até que uma malha Ethernet comum perca um pacote sob congestionamento Incast e transforme essa promessa em uma travada visível para a aplicação. Projetamos redes de storage a partir dos seus requisitos, com a marca dos equipamentos como escolha aberta na fase de projeto: uma malha RoCEv2 dedicada com PFC e ECN ajustados ao seu tráfego real, acesso NVMe over Fabric (NoF), e storage ativo-ativo entre sites quando os números realmente justificam. Dimensionado honestamente para um único cluster de storage, dois data centers ativo-ativo, ou recuperação de desastres multicêntrica.
Quatro padrões por trás de quase toda chamada de "nosso array flash parece lento" que recebemos:
Um caminho de storage projetado para zero perda de pacotes, não compartilhado com — nem esperando não colidir com — tudo mais na rede:
Diagrama desenhado pela AtlasCommTech seguindo a prática de projeto de data center de nível operadora. Os rótulos permanecem em inglês para clareza técnica.
Por que nós: nosso fundador passou 13 anos dentro do ecossistema de parceiros da Huawei entregando redes de operadoras — onde um pacote perdido era um incidente reportável. Em uma malha de storage tratamos cada quadro perdido da mesma forma, porque é exatamente isso que separa uma rede sem perdas no papel de uma que realmente é.
A solução é dimensionada primeiro pelos seus requisitos e orçamento — a mesma arquitetura pode ser entregue com as linhas de produto de vários fabricantes. Ajudamos você a escolher conforme a disponibilidade de fornecimento no país de destino, o orçamento e os hábitos de operação da sua equipe.
Seis propriedades de uma malha de storage bem ajustada que uma rede de data center genérica e compartilhada nunca terá:
Informe seu número de arrays, número de hosts e requisito de replicação — a faixa define a forma da malha:
| Faixa de porte | Local típico | O que o projeto inclui |
|---|---|---|
| Cluster de storage único | Uma sala · um único cluster totalmente flash servindo um ambiente de computação | Um par de leaf de storage dedicado com RoCEv2, PFC e ECN ajustados ao cluster, acesso NVMe-oF de cada host, gestão fora de banda e telemetria por fila desde o primeiro dia — dimensionado para provar zero perda de pacotes antes de se estender a um segundo site. |
| Dois data centers ativo-ativo | Dois sites dentro da distância de replicação síncrona · negócio sensível a paradas | Uma malha de storage por site, uma interconexão dedicada de baixa latência carregando a replicação síncrona, papéis ativo-ativo validados conforme a tolerância de latência real da sua plataforma de storage, e um teste de failover ensaiado antes de entrar em produção. |
| Recuperação de desastres multicêntrica | Sites além da distância síncrona · negócio regulado ou de nível de arquivamento | Uma malha de storage por site mais um link de replicação assíncrona dimensionado honestamente conforme a distância envolvida, papéis primário-reserva com um manual de comutação escrito e ensaiado, e metas de recuperação acordadas no papel antes de encomendar qualquer hardware. |
A solução é construída com estas categorias de equipamentos — a marca é escolhida com você na fase de projeto. Os modelos exatos dependem do seu número de hosts, número de arrays e distância de replicação — nós os definimos após receber sua lista de requisitos.
| Papel | Função |
|---|---|
| Switch leaf de storage | Conecta hosts NVMe-oF e arrays totalmente flash com RoCEv2 ajustado por porta; dimensionado pelo número de hosts e padrão de leitura/escrita, não por uma contagem de portas genérica. |
| Switch spine de storage | A camada de alta velocidade dedicada onde cada leaf de storage se conecta — mantida não bloqueante para que o congestionamento Incast tenha para onde ir além de um quadro descartado. |
| Roteador de borda / link DCI | Carrega o link de replicação síncrona ou assíncrona para um segundo site — dimensionado conforme a distância real e a tolerância de latência da sua plataforma de storage. |
| Plataforma de ajuste PFC/ECN e telemetria | Onde o controle de congestionamento é configurado e validado por cluster, e onde os contadores de descarte e pausa por fila são observados — isso é tempo de engenharia, não uma caixa de seleção em um assistente. |
| Switch de gestão fora de banda | Um pequeno switch separado cabeado à porta de gestão de cada equipamento — sua porta de entrada quando é a própria malha de storage que precisa ser diagnosticada. |
| Plataforma de gestão | Topologia de toda a malha, histórico de profundidade de fila e backup de configuração — para que uma mudança de ajuste fique documentada, não apenas no conhecimento de uma pessoa. |
Envie sua lista de requisitos — número de hosts, número de arrays, padrão de leitura/escrita, distância de replicação — e a lista de modelos vem em seguida. Essa ordem mantém o projeto honesto.
Um engenheiro responde com um projeto de malha de storage e a lista de categorias de equipamentos. Envie sua lista de requisitos — a lista de modelos vem em seguida.