NVIDIA Mellanox MCX631102AN-ADAT w akcji: RDMA/RoCE Transport niskiego opóźnienia i optymalizacja przepustowości serwera

July 27, 2026

najnowsze wiadomości o firmie NVIDIA Mellanox MCX631102AN-ADAT w akcji: RDMA/RoCE Transport niskiego opóźnienia i optymalizacja przepustowości serwera

NVIDIA Mellanox MCX631102AN-ADAT w akcji: RDMA/RoCE Transport niskiego opóźnienia i optymalizacja przepustowości serwera

Temat i wyzwania: wąski gardło w zakresie opóźnienia i przepustowości w rozproszonym magazynie

Średni dostawca usług chmurowych obsługujący rozproszony klaster pamięci masowej Ceph na 120 serwerach x86 zaczął doświadczać rosnących problemów z wydajnością.polegające na TCP/IP do komunikacji między węzłami, walczyła o dotrzymanie kroku rosnącym basenem pamięci masowej opartym na NVMe.średnie opóźnienia odczytu/zapisu przekraczające 3 milisekundy w godzinach szczytu, a także znaczącą lukę między teoretyczną przepustowością dysku a rzeczywistą wydajnością dostarczaną przez sieć.Zespół inżynierów uznał, że osiągnięcie opóźnienia poniżej milisekundy i całkowite wykorzystanie wydajności NVMe wymagało fundamentalnej zmiany podejścia do sieci, wprowadzenie RDMA przez konwergencyjny Ethernet (RoCE).

Rozwiązanie i wdrożenie: Wprowadzenie rozwiązania karty adaptera Ethernet MCX631102AN-ADAT

Po przeanalizowaniu wielu opcji dostawców zespół wybrałNVIDIA Mellanox MCX631102AN-ADATW związku z powyższym Komisja uznaje, że wprowadzenie nowych technologii w sieci jest kluczowe dla ich rozwoju.MCX631102AN-ADAT ConnectX-6 Lx podwójny port 25GbE SFP28Adapter został wybrany ze względu na native wsparcie RoCEv2, sterowanie zatłoczeniami oparte na sprzęcie i płynną integrację z istniejącą infrastrukturą kabli SFP28.

Strategia wdrożenia została podjęta w trzech etapach:

  • Faza 1 (Pilot):16 węzłów magazynowania zostało wyposażonychKarta adaptera Ethernet MCX631102AN-ADATAdaptory zostały skonfigurowane w trybie dwu-port aktywny-aktywny, z każdym portem podłączonym do pary przełączników NVIDIA Spectrum w celu redundancji.
  • Etap 2 (optymalizacja):RoCEv2 został włączony z priorytetową kontrolą przepływu (PFC) i wyraźnym powiadamianiem o zatłoczeniu (ECN) dostosowanym do zapobiegania upadkom sieci.Zespół wykorzystał silniki obciążenia sprzętowego adaptera do obliczeń NVMe-oF i erasure coding.
  • Etap 3 (pełne wdrożenie):Wszystkie 120 węzłów zostało przeniesionych naNVIDIA Mellanox MCX631102AN-ADAT, z Ceph OSD (Object Storage Daemon) stack sieciowy zrekonfigurowany do wykorzystania transportu RDMA.

Zgodnie zArkusz danych MCX631102AN-ADAT, interfejs PCIe 4.0 x8 adaptera zapewnia wystarczającą szerokość pasma do obsługi łącznej przepustowości 50 Gb/s. Zespół zweryfikował, żeSpecyfikacje MCX631102AN-ADATW tym o opóźnieniu poniżej 0,6 mikrosekundy i sterowaniu ruchem opartym na sprzęcie doskonale spełniają rygorystyczne wymagania dotyczące wydajności.Kompatybilny z MCX631102AN-ADATwraz z istniejącą dystrybucją Linux (RHEL 9.2) i sterownikami Mellanox OFED, znacznie upraszczając proces wdrażania.

Wyniki i korzyści: mierzalne zyski w opóźnieniu i przepustowości

Wpływ migracji był natychmiast widoczny w wskaźnikach produkcji.

Metryczny Wstępna aktualizacja (10GbE TCP/IP) Po modernizacji (MCX631102AN-ADAT z RoCE) Poprawa
Średnia opóźnienie odczytu 20,8 ms 00,4 ms 7x zmniejszenie
Średni opóźnienie pisania 3.2 ms 00,5 ms 6.4x redukcja
Wykorzystanie procesora węzła (stack sieciowy) 42% 11% 31 pp zwolnione
Wynik zbiorczy klastra 18 Gb/s 42 Gb/s 2.3x wzrost

Oprócz liczb zespół zaobserwował znaczące usprawnienia operacyjne.MCX631102AN-ADATumożliwił płynną migrację wirtualnych maszyn wirtualnych z aplikacjami wrażliwymi na opóźnienie, gdyż jitter sieci spadł do nieistotnych poziomów.Oprogramowanie NVMe-oF oparte na sprzęcie obniżyło opóźnienie dostępu do pamięci masowej o dodatkowe 30%, umożliwiając klasterowi obsługę mieszanych obciążeń roboczych odczytu/zapisu z konsekwentnymi czasami odpowiedzi poniżej milisekundy.Cena MCX631102AN-ADATW tym celu, dostawca wykazał, że jego wydajność wynosiła 2,3 razy więcej niż w poprzednich latach, a możliwość odroczenia zakupów dodatkowych serwerów o co najmniej 18 miesięcy była uzasadniona.MCX631102AN-ADAT na sprzedażOpcje za pośrednictwem partnerów kanałowych oferowane elastyczne zniżki objętościowe dla rozszerzonych wdrożeń.

Ponadto wbudowane w adapter możliwości telemetrii i zarządzania poza pasmemArkusz danych MCX631102AN-ADAT zapewnił głęboką widoczność stanu sieci, umożliwiając proaktywne zarządzanie zatłoczeniami i szybszą analizę przyczyny w trakcie rozwiązywania incydentów.

Podsumowanie i perspektywy: Strategiczna podstawa przyszłych obciążeń pracą

Wdrożenie w świecie rzeczywistym pokazuje, żeNVIDIA Mellanox MCX631102AN-ADATJest to znacznie więcej niż zwykła aktualizacja przepustowości.MCX631102AN-ADAT rozwiązanie karty adaptera Ethernetdla środowisk z możliwością RoCE skutecznie eliminuje sieć jako wąski gardło wydajności, uwalniając pełny potencjał nowoczesnych architektur pamięci masowej NVMe i procesora.Połączenie przepustowości 25GbE z dwoma portami, kompleksowe rozładowania RDMA i szeroka kompatybilność z ekosystemem pozycjonują ten adapter jako strategiczną inwestycję dla każdej organizacji planującej skalowanie rurociągów AI / ML, rozproszonych baz danych,lub hiperkonwergencyjnej infrastruktury.

W przyszłości zespół bada rozszerzone przypadki użycia, w tym integrację NVIDIA DOCA dla programowalnych ścieżek danych i zero-touch provisioning.wzmocnienie przepustowości, i odzyskać zasoby CPU,MCX631102AN-ADATwprowadza nowe kryteria odniesienia dla 25GbE adapterów serwerowych w środowiskach przedsiębiorstw i chmury.