Азияторг
Оборудование и технологии из Китая для промышленности и бизнеса
Каталог
ИТ-инфраструктура
Сетевое и серверное оборудование
Серверное оборудование
Системы хранения данных
Коммутаторы
Маршрутизаторы
Системы конференцсвязи
Оборудование Huawei
Оборудование Hasivo
GPU NVIDIA
GPU MetaX
Промышленная автоматизация
Промышленная автоматика
Крановые портовые решения
Агропром и пищевые линии
Газоочистка и биогаз
Переработка и утилизация отходов
Арамидное полотно
Самоспасатели
Станки и металлообработка
Станки для металлообработки ERHER
Токарные станки с ЧПУ
Фрезерные станки с ЧПУ
Термопластавтоматы
Инструмент
Шпиндели
Подбор станка
Подбор комплектующих
Технологический аудит
Разработка технологии
Ввод в эксплуатацию
Сервисное обслуживание
Обучение персонала
Электроника
Микроэлектроника и компоненты
Микроэлектроника Crystal
Автоматизированные роботы-уборщики
Человекоподобные роботы
Направления
ИТ-инфраструктура
Сетевое и серверное оборудование
Серверное оборудование
Системы хранения данных
Коммутаторы
Маршрутизаторы
Системы конференцсвязи
Оборудование Huawei
Оборудование Hasivo
GPU NVIDIA
GPU MetaX
Промышленная автоматизация
Промышленная автоматика
Крановые портовые решения
Агропром и пищевые линии
Газоочистка и биогаз
Переработка и утилизация отходов
Арамидное полотно
Самоспасатели
Станки и металлообработка
Станки для металлообработки ERHER
Токарные станки с ЧПУ
Фрезерные станки с ЧПУ
Термопластавтоматы
Инструмент
Шпиндели
Подбор станка
Подбор комплектующих
Технологический аудит
Разработка технологии
Ввод в эксплуатацию
Сервисное обслуживание
Обучение персонала
Электроника
Микроэлектроника и компоненты
Микроэлектроника Crystal
Автоматизированные роботы-уборщики
Человекоподобные роботы
Блог
Сетевое и серверное
Промышленная автоматика
Микроэлектроника
Оборудование Huawei
Станки и металлообработка
GPU и AI
Экология
Роботы
Машиностроение
Производство
Материалы и сырьё
Видеоконференцсвязь
Оборудование Hasivo
Покупателям
Условия оплаты
Условия доставки
Гарантия на товар
О компании
О компании
Контакты
Документы
Контакты
8 800 600-81-40
Заказать звонок
Задать вопрос
Войти
  • Корзина0
sale@tkasiatorg.ru
Екатеринбург, ул. Основинская, д. 10, офис 318 (БЦ "Основа")

Москва, Алтуфьевское шоссе, 48к2, офис 314 (БЦ "А-48")

China, Guangzhou, Room 1310, 13th Floor, Minggaocheng Office Building, No. 123 Yingbin Avenue, Huadu District

пн-пт: с 09:00 до 19:00
сб-вс: выходной день

  • О компании
  • Новости
  • Покупателям
  • Производители
  • Офисы
  • Контакты
  • ...
    АзияТорг — торговая компания
    Оборудование и технологии из Китая для промышленности и бизнеса
    8 800 600-81-40
    Заказать звонок
    sale@tkasiatorg.ru
    Почта для заявок
    Направления
    • ИТ-инфраструктура
    • Сетевое и серверное оборудование
    • Серверное оборудование
    • Системы хранения данных
    • Коммутаторы
    • Маршрутизаторы
    • Системы конференцсвязи
    • Оборудование Huawei
    • Оборудование Hasivo
    • GPU NVIDIA
    • GPU MetaX
    • Промышленная автоматизация
    • Промышленная автоматика
    • Крановые портовые решения
    • Агропром и пищевые линии
    • Газоочистка и биогаз
    • Переработка и утилизация отходов
    • Арамидное полотно
    • Самоспасатели
    • Станки и металлообработка
    • Станки для металлообработки ERHER
    • Токарные станки с ЧПУ
    • Фрезерные станки с ЧПУ
    • Термопластавтоматы
    • Инструмент
    • Шпиндели
    • Подбор станка
    • Подбор комплектующих
    • Технологический аудит
    • Разработка технологии
    • Ввод в эксплуатацию
    • Сервисное обслуживание
    • Обучение персонала
    • Электроника
    • Микроэлектроника и компоненты
    • Микроэлектроника Crystal
    • Автоматизированные роботы-уборщики
    • Человекоподобные роботы
    Услуги
    • Подбор и поставка оборудования
    • Подбор и поставка комплектующих
    • Проектирование и внедрение
    • Финансовые программы
    • Сервис и поддержка
    • Логистика и таможенное оформление
    • Лицензии Microsoft
    Блог
    • Сетевое и серверное
    • Промышленная автоматика
    • Микроэлектроника
    • Оборудование Huawei
    • Станки и металлообработка
    • GPU и AI
    • Экология
    • Роботы
    • Машиностроение
    • Производство
    • Материалы и сырьё
    • Видеоконференцсвязь
    • Оборудование Hasivo
    О компании
    • О компании
    • Контакты
    • Документы
    +  ЕЩЕ
      Азияторг
      8 800 600-81-40
      Заказать звонок
      Азияторг
      Корзина 0
      Телефоны
      8 800 600-81-40
      Заказать звонок
      • Каталог
        • Назад
        • Каталог
        • ИТ-инфраструктура
        • Сетевое и серверное оборудование
        • Серверное оборудование
        • Системы хранения данных
        • Коммутаторы
        • Маршрутизаторы
        • Системы конференцсвязи
        • Оборудование Huawei
        • Оборудование Hasivo
        • GPU NVIDIA
        • GPU MetaX
        • Промышленная автоматизация
        • Промышленная автоматика
        • Крановые портовые решения
        • Агропром и пищевые линии
        • Газоочистка и биогаз
        • Переработка и утилизация отходов
        • Арамидное полотно
        • Самоспасатели
        • Станки и металлообработка
        • Станки для металлообработки ERHER
        • Токарные станки с ЧПУ
        • Фрезерные станки с ЧПУ
        • Термопластавтоматы
        • Инструмент
        • Шпиндели
        • Подбор станка
        • Подбор комплектующих
        • Технологический аудит
        • Разработка технологии
        • Ввод в эксплуатацию
        • Сервисное обслуживание
        • Обучение персонала
        • Электроника
        • Микроэлектроника и компоненты
        • Микроэлектроника Crystal
        • Автоматизированные роботы-уборщики
        • Человекоподобные роботы
      • Направления
        • Назад
        • Направления
        • ИТ-инфраструктура
        • Сетевое и серверное оборудование
        • Серверное оборудование
        • Системы хранения данных
        • Коммутаторы
        • Маршрутизаторы
        • Системы конференцсвязи
        • Оборудование Huawei
        • Оборудование Hasivo
        • GPU NVIDIA
        • GPU MetaX
        • Промышленная автоматизация
        • Промышленная автоматика
        • Крановые портовые решения
        • Агропром и пищевые линии
        • Газоочистка и биогаз
        • Переработка и утилизация отходов
        • Арамидное полотно
        • Самоспасатели
        • Станки и металлообработка
        • Станки для металлообработки ERHER
        • Токарные станки с ЧПУ
        • Фрезерные станки с ЧПУ
        • Термопластавтоматы
        • Инструмент
        • Шпиндели
        • Подбор станка
        • Подбор комплектующих
        • Технологический аудит
        • Разработка технологии
        • Ввод в эксплуатацию
        • Сервисное обслуживание
        • Обучение персонала
        • Электроника
        • Микроэлектроника и компоненты
        • Микроэлектроника Crystal
        • Автоматизированные роботы-уборщики
        • Человекоподобные роботы
      • Блог
        • Назад
        • Блог
        • Сетевое и серверное
        • Промышленная автоматика
        • Микроэлектроника
        • Оборудование Huawei
        • Станки и металлообработка
        • GPU и AI
        • Экология
        • Роботы
        • Машиностроение
        • Производство
        • Материалы и сырьё
        • Видеоконференцсвязь
        • Оборудование Hasivo
      • Покупателям
        • Назад
        • Покупателям
        • Условия оплаты
        • Условия доставки
        • Гарантия на товар
      • О компании
        • Назад
        • О компании
        • О компании
        • Контакты
        • Документы
      • Контакты
      • Личный кабинет
      • Корзина0
      • 8 800 600-81-40
      Контактная информация
      Екатеринбург, ул. Основинская, д. 10, офис 318 (БЦ "Основа")

      Москва, Алтуфьевское шоссе, 48к2, офис 314 (БЦ "А-48")

      China, Guangzhou, Room 1310, 13th Floor, Minggaocheng Office Building, No. 123 Yingbin Avenue, Huadu District

      пн-пт: с 09:00 до 19:00
      сб-вс: выходной день

      sale@tkasiatorg.ru

      На что влияет сеть между узлами GPU-кластера при обучении

      Главная
      —
      Блог
      —
      GPU и AI
      —
      Инфраструктура кластера
      —На что влияет сеть между узлами GPU-кластера при обучении
      9 сентября 20266 минут чтения

      Какой трафик возникает при обучении, как считается полоса на ускоритель, чем различаются варианты сетевой части и как проверить эффективность масштабирования.

      В кластере из нескольких серверов с ускорителями обучение модели идёт синхронно: после каждого шага узлы обмениваются градиентами и ждут, пока обмен завершится у всех. Пока идёт обмен, вычислители простаивают. Поэтому сеть между узлами определяет не удобство администрирования, а долю времени, которую ускорители реально считают. При слабой сети кластер из восьми узлов работает как пять, и разница видна сразу на времени обучения.

      Разберём, какой трафик возникает при обучении, как считается требуемая полоса на ускоритель, чем различаются варианты сетевой части и какие данные нужны для расчёта кластера на ускорителях NVIDIA или MetaX.

      Какой трафик возникает при обучении

      • Обмен градиентами. Основной поток. При распределении по данным каждый узел считает свою часть выборки, после чего результаты суммируются по всем ускорителям. Объём обмена зависит от числа параметров модели, а не от размера выборки.
      • Обмен активациями. Возникает, когда модель не вмещается в память одного ускорителя и разделяется между несколькими. Этот обмен чувствителен к задержке сильнее, чем обмен градиентами.
      • Загрузка данных. Чтение обучающей выборки из хранилища. Идёт параллельно вычислениям и мешает основному обмену, если использует ту же сеть.
      • Контрольные точки. Периодическая запись состояния модели. Кратковременно создаёт высокую нагрузку на хранилище и на сеть.
      • Служебный трафик. Управление, мониторинг, журналирование. Объём невелик, но его отделяют от основного обмена, чтобы он не попадал под задержки.
      • Инференс. При эксплуатации обученной модели межузловой обмен обычно много меньше, и требования к сети снижаются — за исключением больших моделей, разделённых между узлами.

      Как считается полоса

      • Внутри узла. Ускорители в одном сервере соединяются высокоскоростной внутренней шиной. Её полоса на порядок выше внешней сети, поэтому обмен внутри узла не является ограничением.
      • Между узлами. Полоса считается на каждый ускоритель, а не на сервер. Ориентир для обучения — от 100 Гбит/с на ускоритель для крупных моделей и от 25–50 Гбит/с для задач меньшего масштаба.
      • Число адаптеров. Из требуемой полосы следует число сетевых адаптеров в узле. Для сервера с восемью ускорителями это несколько адаптеров, а не один.
      • Полоса коммутатора. Проверяется неблокирующая работа: суммарная полоса портов вверх должна соответствовать полосе портов к узлам.
      • Отдельная сеть хранения. Загрузка данных выносится в отдельную сеть или в отдельные адаптеры, чтобы чтение выборки не конкурировало с обменом градиентами.
      • Эффективность масштабирования. Итоговый показатель: доля производительности, сохраняемая при росте числа узлов. Именно она показывает, оправдана ли выбранная сеть.

      Варианты сетевой части

      ПараметрОбычная сеть EthernetEthernet с прямым доступом к памятиВыделенная сеть с низкой задержкой
      Где применяетсяодин-два узла, инференскластеры до нескольких десятков узловкрупные обучающие кластеры
      Задержкавысокаянизкая при правильной настройкенаименьшая
      Загрузка процессоразначительнаямалаямалая
      Требования к настройкеминимальныеуправление перегрузками обязательнонастройка фабрики
      Стоимость на узелнизкаясредняявысокая
      Совместимость с имеющейся сетьюполнаячастичнаяотдельная инфраструктура
      Что ограничиваетзадержка и потеринастройка управления потокомбюджет

      Топология и потери на перегрузках

      • Один коммутатор. Простейший вариант для кластера, целиком укладывающегося в число портов одного устройства. Нет переходов между уровнями и связанных с ними задержек.
      • Двухуровневая схема. При росте числа узлов ставится уровень агрегации. Полоса между уровнями рассчитывается так, чтобы не создавать сужения.
      • Раздельные плоскости. Адаптеры узла подключаются к разным коммутаторам, и обмен между одинаковыми по порядку ускорителями идёт в своей плоскости. Это снижает число конфликтов на портах.
      • Управление перегрузками. На сети Ethernet требуется настройка приоритетов и уведомлений о перегрузке: без неё потери пакетов сводят выигрыш от полосы к нулю.
      • Длины трасс. Внутри стойки применяются кабельные сборки прямого подключения, между стойками — оптика. От длины зависит выбор модулей и итоговая стоимость сетевой части.
      • Проверка на нагрузке. Кластер принимается не по паспортным цифрам, а по измерению коллективных операций обмена и по эффективности масштабирования на реальной задаче.

      Что учитывать помимо сети

      • Хранилище. Скорость чтения выборки должна поддерживать загрузку всех ускорителей; иначе сеть не является узким местом, а простаивают вычислители.
      • Питание и охлаждение стойки. Плотность мощности определяет, сколько узлов встанет в одну стойку и какие длины кабелей потребуются.
      • Программная часть. Библиотеки коллективных операций и их настройка влияют на результат не меньше, чем оборудование.
      • Единообразие узлов. Разные конфигурации в одном кластере приводят к тому, что скорость шага определяется самым медленным узлом.
      • Запас на расширение. Свободные порты и запас по полосе между уровнями закладываются заранее: добавление узлов в работающий кластер не должно требовать перестройки фабрики.
      • Складской запас. Оптические модули и кабельные сборки держатся на объекте, замена модуля — наиболее частая операция обслуживания.

      Что прислать для расчёта

      • Тип задачи: обучение с нуля, дообучение, инференс.
      • Размер модели по числу параметров и планируемый способ распределения по ускорителям.
      • Число узлов и ускорителей в узле, планируемый рост.
      • Объём обучающих данных и требуемую скорость чтения.
      • Наличие действующей сетевой инфраструктуры и её параметры.
      • Доступную мощность на стойку и способ охлаждения.
      • Требования к срокам поставки и порядку ввода в работу.

      Частые вопросы

      Можно ли собрать кластер на обычной сети Ethernet? Для двух-трёх узлов и небольших моделей — да. При большем числе узлов задержка и потери пакетов приводят к тому, что добавление узла почти не сокращает время обучения.

      Сколько полосы нужно на один ускоритель? Для крупных моделей ориентируются на 100 Гбит/с и выше, для задач меньшего масштаба достаточно 25–50 Гбит/с. Точное значение считается по объёму обмена градиентами и по времени шага.

      Обязательно ли выносить хранилище в отдельную сеть? При обучении на больших выборках — да. Чтение данных создаёт длинные потоки, которые задерживают короткие обмены градиентами.

      Что даёт схема с раздельными плоскостями? Снижение числа конфликтов на портах коммутатора и более предсказуемое время обмена. На крупных кластерах это заметно сказывается на эффективности масштабирования.

      Как проверить сеть до закупки всего кластера? Собрать пилот из двух-четырёх узлов и измерить время шага и скорость коллективных операций. Полученная эффективность масштабирования переносится на расчёт полной конфигурации.

      Влияет ли сеть на инференс? Для моделей, помещающихся в память одного узла, — почти нет. Для больших моделей, разделённых между узлами, требования к задержке остаются высокими.

      Что мы делаем

      Считаем требуемую полосу по составу модели и числу ускорителей, подбираем сетевую часть, адаптеры, оптику и кабельные сборки, проверяем совместимость с серверными платформами и планируем топологию с запасом на расширение. Комплектуем кластеры на ускорителях NVIDIA и MetaX целиком — с вычислительными узлами, сетью, хранилищем и инфраструктурой стойки.

      Пришлите тип задачи, размер модели и планируемое число узлов на sale@tkasiatorg.ru — посчитаем полосу на ускоритель, предложим топологию и дадим спецификацию сетевой части со сроками поставки.

      Направление
      GPU-ускорители NVIDIAОткрыть направлениеGPU-ускорители MetaXОткрыть направление
      Читайте также
      • Как выбрать между NVIDIA H200 и H100 для обучения модели
      • Перенос обучения и инференса на MetaX MXMACA — что проверить заранее
      • Что считать при расчёте питания и охлаждения стойки под ускорители
      Назад к списку
      • Сетевое и серверное
      • Промышленная автоматика
      • Микроэлектроника
      • Оборудование Huawei
      • Станки и металлообработка
      • GPU и AI
      • Экология
      • Роботы
      • Машиностроение
      • Производство
      • Материалы и сырьё
      • Видеоконференцсвязь
      • Оборудование Hasivo
      Заказать звонок
      Ваш менеджер
      Комиссаров Глеб
      8 (800) 600-81-40
      Задать вопрос
      Статьи
      14 сентября 2026
      Эхоподавление в переговорной — почему звук важнее камеры
      14 сентября 2026
      Как считается грузооборот при подборе портового крана
      14 сентября 2026
      Где применяется промышленный коммутатор HASIVO на DIN-рейку
      Азияторг
      Оборудование и технологии из Китая для промышленности
      8 800 600-81-40 sale@tkasiatorg.ru
      пн–пт с 09:00 до 19:00, сб–вс — выходной
      Направления
      • ИТ-инфраструктура
      • Промышленная автоматизация
      • Станки и металлообработка
      • Электроника
      • Все направления
      Компания
      • О компании
      • Контакты
      • Реквизиты
      • Новости
      • Блог
      Помощь
      • Условия оплаты
      • Условия доставки
      • Гарантия на товар
      Информация
      • Пользовательское соглашение
      • Политика конфиденциальности
      • Индивидуальные предложения
      Офисы
      Екатеринбург
      ул. Основинская, д. 10, офис 318 (БЦ «Основа»)
      Москва
      Алтуфьевское шоссе, 48к2, офис 314 (БЦ «А-48»)
      Гуанчжоу
      Room 1310, 13th Floor, Minggaocheng Office Building, No. 123 Yingbin Avenue, Huadu District
      © 2019–2026 ООО «ТК „Азияторг“». Поставки оборудования и технологий из Китая.
      ИНН 6686118685 · ОГРН 1196658060972
      Мы используем файлы cookie, чтобы сайт работал корректно и чтобы понимать, какие разделы вам полезны. Продолжая пользоваться сайтом, вы соглашаетесь с этим. Подробнее — в Политике в отношении обработки персональных данных.
      Подробнее