
H100/H200 без bottleneck
Кластер на H100/H200 SXM с двумя HCA-портами на узел (rail-optimized) — только NDR обеспечит non-blocking Fat-Tree без bottleneck

Коммутатор InfiniBand 400 Гбит/с — актуальное поколение NDR для флагманских GPU-кластеров на H100/H200. Разбираем модели NVIDIA Quantum-2 (QM9700 и QM9790), считаем число leaf- и spine-коммутаторов под целевую Fat-Tree, подбираем OSFP-кабели по длинам трасс и настраиваем Subnet Manager, показываем, что входит в поставку и в какой срок. Товар не храним — поставка идёт под конкретный проект и его сроки. Работаем под ваше ТЗ

H100/H200 без bottleneck
Кластер на H100/H200 SXM с двумя HCA-портами на узел (rail-optimized) — только NDR обеспечит non-blocking Fat-Tree без bottleneck

Запас под рост кластера
Планируется рост кластера на 3–5 лет — NDR даёт запас пропускной и совместимость вниз с HDR/EDR

Ускорение NCCL-коммуникаций
NCCL-нагрузка составляет 30–50% времени обучения — переход HDR → NDR ускоряет фазу коммуникаций примерно вдвое

Пропускная способность
Крупные LLM 70B+ с высокими объёмами all-reduce трафика — только NDR даёт нужную bisection bandwidth

Оставьте заявку и получите бесплатную консультацию
| Параметр | QM9700 (managed, встроенный Subnet Manager) | QM9790 (unmanaged / externally managed) |
|---|---|---|
| Форм-фактор | 1U rackmount | 1U rackmount |
| Физические порты OSFP | 32 (каждый OSFP = 2 порта NDR) | 32 (каждый OSFP = 2 порта NDR) |
| Эффективная портовая ёмкость (NDR) | 64 порта NDR 400 Гбит/с (split-mode) | 64 порта NDR 400 Гбит/с (split-mode) |
| Совокупная пропускная | 51,2 Тбит/с | 51,2 Тбит/с |
| Латентность port-to-port | ~90–130 нс | ~90–130 нс |
| Subnet Manager | Встроенный (может работать без внешнего SM) | Внешний (OpenSM или NVIDIA UFM) |
| Когда выбирают | Малые/средние фабрики, отказоустойчивость (второй managed как standby SM) | Крупные кластеры с внешним UFM — единая точка управления фабрикой |
| Питание типовое | ~1000–1500 Вт | ~1000–1500 Вт |
| Охлаждение | Воздух front-to-back | Воздух front-to-back |
| Роль | Куда подключён | Соотношение downlink/uplink | Комментарий |
|---|---|---|---|
| Leaf (Top-of-Rack, ToR) | Downlink — к GPU-узлам (HCA ConnectX-7), uplink — к spine | 32 downlink + 32 uplink (non-blocking 1:1) | Rail-optimized: каждый GPU в узле идёт в «свой» leaf для NCCL |
| Spine (Aggregation) | Только к leaf (все порты вверх) | Все 64 порта как uplink | Число spine определяется требованием non-blocking + числом leaf |
| Single-tier (1 коммутатор на кластер) | Только к GPU-узлам напрямую | Все 64 порта как downlink | Работает до ~4 узлов с 8 GPU + 2 HCA-порта (=64 линии) без oversubscription |
| Managed с внешним SM (QM9790 + UFM) | Отдельный сервер под UFM в кластере | — | Единая точка мониторинга и routing |
| Число узлов (8 GPU каждый) | Downlink-портов нужно | Leaf | Spine | Итого QM9700 |
|---|---|---|---|---|
| 4 узла | 4 × 2 = 8 | 1 (single-tier) | 0 | 1 |
| 8 узлов | 8 × 2 = 16 | 1 (single-tier) | 0 | 1 |
| 16 узлов | 16 × 2 = 32 | 1 (single-tier, полный) | 0 | 1 |
| 32 узла | 32 × 2 = 64 | 2 (32 downlink + 32 uplink) | 2 (32 uplink от каждого leaf) | 4 |
| 64 узла | 64 × 2 = 128 | 4 (32 downlink + 32 uplink) | 4 (32 uplink) | 8 |
| 128 узлов | 128 × 2 = 256 | 8 (32 downlink + 32 uplink) | 8 (32 uplink) | 16 |
Заявка и уточнение: 2–4 дня
число узлов, HCA-порты, целевая топология, ЦОД
Расчёт: 5–7 дней
число QM9700/QM9790, роли leaf/spine, длины кабелей OSFP, лицензия UFM
Согласование, договор
по графику клиента
Поставка: 45–75 дней
Поставка коммутаторов и OSFP-кабелей/трансиверов
Монтаж, настройка: 5–10 дней
Монтаж в стойки, кабельные работы, коммутация в топологию
Приёмочные тесты, сдача, гарантия и постпродажное сопровождение
2–3 рабочих дня

Fat-Tree под масштабирование кластера
проектируем топологию Fat-Tree под целевое число узлов и планы роста, не «выдали коммутатор и уходим»

Опыт
опыт с Quantum-2 в кластерах 4–128 узлов, включая rail-optimized routing под NCCL
Выбор коммутатора
даём выбор: QM9790 + внешний UFM для крупных фабрик или QM9700 для стартовых сценариев

Вендоры и поставщики
коммутаторы NDR: NVIDIA (бывшая Mellanox) — Quantum-2 QM9700 и QM9790. Трансиверы и кабели OSFP: NVIDIA, FS.com (эквиваленты), российские интеграторы. Лицензия UFM — NVIDIA. OpenSM — open-source без лицензионных сборов

Постпродажное сопровождение
помогаем администратору фабрики с UFM, обновлениями прошивок Quantum-2 и расширением по мере роста числа GPU-узлов

Пришлите число GPU-узлов, число HCA-портов на узел и планы роста на 3–5 лет — по итогам заявки и расчёта (7–11 рабочих дней) вернёмся с топологией Fat-Tree, числом QM9700/QM9790, длинами OSFP-кабелей, лицензией UFM при необходимости и сроком поставки. План монтажа и приёмочные NCCL-бенчмарки после поставки оборудования, с фиксированным сроком сдачи. Пакет документов под 44-ФЗ при госзаказе
Только в Subnet Manager. QM9700 работает автономно со встроенным SM — удобно для малых и средних фабрик до ~2000 узлов. QM9790 требует внешнего OpenSM или NVIDIA UFM — стандартный выбор для крупных кластеров с единой точкой управления. Физика (порты, латентность 90–130 нс, пропускная 51,2 Тбит/с) идентична.
32 узла × 2 HCA-порта = 64 downlink-порта. Под non-blocking 1:1 нужно 64 uplink к spine. QM9700 несёт 64 порта NDR — итого 2 leaf по 32 downlink + 32 uplink и 2 spine, каждый принимает по 32 uplink от leaf. Всего 4 коммутатора QM9700. Плюс сервер под UFM или дублированный QM9700 в роли Subnet Manager.
Физически на QM9700 32 OSFP-разъёма, но каждый OSFP несёт две линии NDR — итого 64 порта NDR 400G в split-mode. Без него коммутатор давал бы 32 порта 800G, что не совместимо с современными HCA ConnectX-7 (у них порты по 400G). Split-mode — стандартный режим для NDR-развёртываний.
Да, downlink к HDR-узлам работает — Quantum-2 совместимы с HDR 200G и EDR 100G. Но общая пропускная упирается в HDR: сегменты с HDR-узлами не получат преимуществ NDR. Для смешанной фабрики лучше сегментировать: NDR-часть под H100/H200, HDR-часть под A100 и HPC-нагрузки.
Реалистично 45–75 рабочих дней от даты договора. Товар не храним, поставка под конкретный проект. Общий срок сдачи (проект + поставка + монтаж + приёмочные тесты) — 60–95 рабочих дней.

Заполните форму, и мы проведём бесплатный аудит: проверим серверы, сети и системы безопасности, определим риски и предложим план перехода на отечественное оборудование.