Заявка на консультацию
Оставьте ваши данные и наши менеджеры свяжуться с вами в ближайшее время
Рейтинг компании
В реестре проверенных поставщиков
В реестре проверенных поставщиков

Коммутаторы InfiniBand HDR 200 Гбит/с

InfiniBand HDR 200 Гбит/с — зрелое поколение фабрики, оправданное для GPU-кластеров на A100, HPC-задач и стартовых ML-платформ, где NDR избыточен и дороже. Разбираем модели NVIDIA Quantum (QM8700 и QM8790), считаем число leaf- и spine-коммутаторов под целевую Fat-Tree, подбираем QSFP56-кабели по длинам трасс, настраиваем Subnet Manager и объясняем, когда стоит рассматривать шаг к NDR. Товар не храним, поставка идёт под конкретный проект под ваше ТЗ
Главная
/
/
/
InfiniBand 200
Назад
HPC-кластеры
HPC-кластеры на A100 SXM или A100 PCIe — карте A100 хватает пропускной HDR (2 порта HDR на узел = 400 Гбит/с в фабрику), NDR даёт незначительный прирост при большей стоимости
HDR-фабрика
Расширение существующей HDR-фабрики — совместимость с ConnectX-6 HCA, которые уже стоят в узлах
HPC не-LLM задачи
CFD, молекулярная динамика, климатическое моделирование — трафик менее плотный, HDR закрывает
Стартовые ML-платформы
Стартовые ML-платформы 4–8 узлов с фиксированным размером — экономический смысл в HDR за счёт зрелой цены и готовности стека
Оставьте заявку и получите бесплатную консультацию

Когда HDR 200G оправдан, а когда пора смотреть на NDR

{ серверы }

Модели Quantum в линейке HDR

{ отличия }
Параметр QM9700 (managed, встроенный Subnet Manager) QM9790 (unmanaged / externally managed)
Форм-фактор 1U rackmount 1U rackmount
Порты HDR 200G 40 портов QSFP56 40 портов QSFP56
Совокупная пропускная 16 Тбит/с 16 Тбит/с
HDR100 mode 80 портов HDR100 через split (по 2 линии HDR) 80 портов HDR100 через split
Латентность port-to-port ~90–130 нс ~90–130 нс
Subnet Manager Встроенный (может работать без внешнего SM) Внешний (OpenSM или NVIDIA UFM)
Когда выбирают Малые фабрики. Отказоустойчивость (второй managed как standby SM) Средние и крупные HDR-фабрики с единым внешним UFM — единая точка мониторинга
Питание типовое ~700–900 Вт ~700–900 Вт
Охлаждение Воздух front-to-back Воздух front-to-back

HDR 200G vs NDR 400G — как выбирают поколение

{ критерии }
Число узлов Downlink-портов (2 HCA × узлы) Leaf-коммутаторов Spine-коммутаторов Итого QM8700/QM8790
4 узла 8 1 (single-tier) 0 1
8 узлов 16 1 (single-tier) 0 1
16 узлов 32 1 (single-tier, почти полный) 0 1
20 узлов 40 1 (single-tier, полный на 40 портах) 0 1
32 узла 64 4 (по 16 downlink + 16 uplink) 4 (по 16 uplink) 8
64 узла 128 8 (по 16 downlink + 16 uplink) 8 (по 16 uplink) 16
128 узлов 256 16 (по 16 downlink + 16 uplink) 16 (по 16 uplink) 32

Как считаем конфигурацию под целевое число узлов

{ расчёт }
Число узлов (8 GPU каждый) Downlink-портов нужно Leaf Spine Итого QM9700
4 узла 4 × 2 = 8 1 (single-tier) 0 1
8 узлов 8 × 2 = 16 1 (single-tier) 0 1
16 узлов 16 × 2 = 32 1 (single-tier, полный) 0 1
32 узла 32 × 2 = 64 2 (32 downlink + 32 uplink) 2 (32 uplink от каждого leaf) 4
64 узла 64 × 2 = 128 4 (32 downlink + 32 uplink) 4 (32 uplink) 8
128 узлов 128 × 2 = 256 8 (32 downlink + 32 uplink) 8 (32 uplink) 16

Что входит в поставку?

{ комплектация }
Коммутаторы Quantum QM8700 или QM8790
Трансиверы QSFP56 и кабели
Проектирование топологии Fat-Tree
Кабельный журнал и схема rail-optimized routing
Лицензия и настройка Subnet Manager
Монтаж в стойки, коммутация, включение SM, настройка MTU 4KB
Приёмочные тесты на реальном числе узлов
Пакет документов для 44-ФЗ и 223-ФЗ при госзаказе
Заказать консультацию
число узлов, HCA-порты HDR, целевая топология, ЦОД
Заявка и уточнение: 2–4 дня
число QM8700/QM8790, роли leaf/spine, длины QSFP56-кабелей, лицензия UFM
Расчёт: 5–7 дней

Как мы работаем

{ этапы и сроки }
1 этап
по графику клиента
Согласование, договор
Монтаж в стойки, кабельные работы, коммутация в топологию
Монтаж и настройка: 5–10 дней
3 этап
5 этап
2 этап
HDR — зрелое поколение, сроки короче NDR
Поставка коммутаторов и кабелей: 35–60 дней
2–3 рабочих дня
Приёмочные тесты, сдача, гарантия и постпродажное сопровождение
4 этап
6 этап

Почему выбирают нас?

{ под ключ }
проектируем HDR-фабрику под целевое число узлов и планы роста — не «выдали коммутатор и уходим»
HDR-фабрика под рост кластера
Постпродажное сопровождение
помогаем администратору фабрики с UFM, обновлениями прошивок и расширением по мере роста числа узлов. Работаем по 44-ФЗ и 223-ФЗ, готовим пакет документов для закупки
Вендоры и поставщики
коммутаторы HDR: NVIDIA (бывшая Mellanox) — Quantum QM8700 и QM8790. Трансиверы и кабели QSFP56: NVIDIA, FS.com (эквиваленты), российские интеграторы. Лицензия UFM — NVIDIA. Импортозамещение честно: InfiniBand-компоненты Quantum фактически NVIDIA-only
даём выбор между HDR (для A100 и HPC) и NDR (для H100/H200 и pre-training) с расчётом TCO
Выбор коммутатора
Опыт
опыт с Quantum QM8700/QM8790 в кластерах 4–128 узлов, включая гибридные HDR + EDR
Пришлите число GPU-узлов, модель GPU (A100 или H100) и планы роста на 3–5 лет — по итогам расчёта (7–11 рабочих дней) вернёмся с топологией Fat-Tree, числом QM8700/QM8790, длинами QSFP56-кабелей, лицензией UFM при необходимости и сроком поставки. План монтажа и приёмочные NCCL-бенчмарки — после поставки оборудования, с фиксированным сроком сдачи. Пакет документов под 44-ФЗ при госзаказе

Пришлите ТЗ — вернёмся с топологией и числом коммутаторов

{ свяжитесь с нами }

Часто задаваемые вопросы

{ FAQ }
Есть, если целевые GPU — A100 или задача — HPC. Карте A100 хватает пропускной HDR (2 порта × 200 Гбит/с = 400 Гбит/с в фабрику), NDR даёт незначительный прирост при большей стоимости. Для флагманских ML-кластеров на H100/H200 сразу закладываем NDR, там разница по NCCL-скорости на wall-clock времени обучения заметная.