NVIDIA DGX
NVIDIA DGX — готовые системы для обучения и инференса ИИ
NVIDIA DGX объединяет восемь ускорителей NVIDIA, высокоскоростную связь между GPU, серверные процессоры, оперативную память, локальные накопители и программную среду для работы с искусственным интеллектом. Это готовая аппаратно-программная система, в которой компоненты заранее подобраны и протестированы совместно.
Серверы NVIDIA DGX используют для обучения больших языковых моделей, дообучения нейросетей, генеративного ИИ, научных расчётов и высоконагруженного инференса. В отличие от GPU-сервера, собранного из отдельных компонентов, DGX предоставляет стандартизированную конфигурацию с предсказуемой совместимостью оборудования и программного стека.
Чем NVIDIA DGX отличается от обычного GPU-сервера
Система NVIDIA DGX ускоряет совместную работу нескольких GPU с помощью NVLink и NVSwitch. Такое соединение обеспечивает значительно более быстрый обмен данными между ускорителями, чем взаимодействие только через PCIe. Это особенно важно при распределении одной большой модели между несколькими GPU.
Проще говоря, DGX выбирают не только ради восьми мощных видеокарт. Основная ценность платформы — в согласованной работе ускорителей, сети, хранилища и программного обеспечения. Заказчику не приходится самостоятельно проверять совместимость GPU, материнской платы, драйверов, прошивок и библиотек.
При этом суммарная память восьми ускорителей не превращается автоматически в единый общий пул. Чтобы модель использовала ресурсы нескольких GPU, программное обеспечение должно поддерживать тензорный, конвейерный или другой вид параллелизма.
Модели серверов NVIDIA DGX
-
NVIDIA DGX A100 использует восемь ускорителей A100 и предоставляет до 640 ГБ суммарной GPU-памяти. Система остаётся практичным выбором для проектов на архитектуре Ampere, если программный стек уже проверен на A100, а переход на более новое поколение не даёт соразмерного выигрыша.
-
NVIDIA DGX H100 объединяет восемь ускорителей H100 с 640 ГБ суммарной GPU-памяти. Платформа рассчитана на обучение нейросетей, работу с генеративным ИИ и HPC-задачи, в которых важны высокая вычислительная производительность и быстрый обмен между GPU.
-
NVIDIA DGX H200 оснащается восемью ускорителями H200 и предоставляет 1 128 ГБ суммарной GPU-памяти. Увеличенный объём памяти полезен для крупных языковых моделей, длинного контекста и инференса, где производительность ограничивает не только число вычислительных блоков, но и пропускная способность памяти.
-
NVIDIA DGX B200 включает восемь ускорителей поколения Blackwell и 1 440 ГБ суммарной GPU-памяти. Эту систему рассматривают для новых ИИ-кластеров, обучения больших моделей и ресурсоёмкого инференса, когда проекту нужен запас производительности на несколько лет.
-
NVIDIA DGX B300 использует восемь ускорителей Blackwell Ultra и располагает 2,1 ТБ суммарной GPU-памяти. Это решение для наиболее крупных моделей, сложных reasoning-нагрузок и сценариев, в которых размер модели или KV-кэша становится одним из главных ограничений.
Отдельные ускорители и серверы других конфигураций представлены в разделах NVIDIA A100, NVIDIA H100, NVIDIA H200 и серверы с GPU NVIDIA.
Как выбрать NVIDIA DGX под задачу
Выбор NVIDIA DGX начинается не с поколения ускорителей, а с профиля нагрузки. Для обучения нужно оценить размер модели, формат вычислений, объём датасета, предполагаемое число GPU и время, за которое должен завершаться эксперимент. Для инференса важнее размер модели, длина контекста, размер пакета, число одновременных запросов и требуемая задержка ответа.
Если модель помещается в память одной или двух GPU, полноценная DGX-система может оказаться избыточной. В этом случае стоит сравнить её с обычным сервером с GPU. Если задача масштабируется на восемь ускорителей или несколько узлов, преимущества NVSwitch, скоростной сети и стандартизированной платформы становятся заметнее.
При сравнении поколений важно учитывать не только пиковую производительность. Иногда больший объём GPU-памяти сокращает количество серверов, упрощает распределение модели и даёт проекту больше пользы, чем прирост числа операций в секунду.
Что входит в платформу NVIDIA DGX
NVIDIA DGX поставляется как единая серверная платформа с ускорителями, процессорами, оперативной памятью, NVMe-накопителями и сетевыми интерфейсами. Программная часть включает оптимизированную операционную среду, драйверы и компоненты экосистемы NVIDIA для запуска ИИ-нагрузок.
Состав программного обеспечения, срок поддержки и условия использования NVIDIA AI Enterprise могут различаться в зависимости от поколения системы и конкретной поставки. Эти параметры лучше зафиксировать в спецификации до покупки, особенно если сервер будет использоваться в промышленной среде.
Требования к размещению NVIDIA DGX
Система NVIDIA DGX предъявляет повышенные требования к электропитанию, охлаждению и серверной стойке. Например, максимальная потребляемая мощность DGX H100 и H200 превышает 10 кВт, а DGX B200 и B300 требуют около 14 кВт. Перед поставкой необходимо проверить доступную мощность на стойку, схему резервирования питания, тип разъёмов, глубину стойки и способность системы охлаждения отводить выделяемое тепло.
Для многосерверной конфигурации также потребуется высокоскоростная сеть и производительное хранилище. Локальных NVMe-накопителей достаточно для временных данных и кэша, но обучение на больших наборах данных требует отдельного расчёта пропускной способности СХД. Без этого дорогие ускорители могут простаивать в ожидании загрузки данных или сохранения контрольных точек.
NVIDIA DGX или сервер на платформе HGX
NVIDIA DGX является законченной системой NVIDIA, а серверы NVIDIA HGX создаются производителями оборудования на базе вычислительной платформы NVIDIA. DGX удобна, когда заказчику нужна стандартизированная конфигурация с готовым программно-аппаратным стеком. Серверы на базе HGX предоставляют больше свободы в выборе процессоров, оперативной памяти, накопителей, сетевых адаптеров и условий сервисного обслуживания.
Универсально лучшего варианта нет. DGX сокращает количество решений, которые необходимо принимать при проектировании инфраструктуры, а HGX позволяет точнее адаптировать сервер под существующий ЦОД, требования проекта и бюджет. Для менее плотных конфигураций можно рассмотреть и другие серверы NVIDIA.
Цена и покупка NVIDIA DGX
Цена NVIDIA DGX зависит от поколения ускорителей, объёма GPU-памяти, сетевой конфигурации, накопителей, программных лицензий, сервисной поддержки и условий поставки. Поэтому сравнивать системы только по стоимости одного GPU некорректно: в расчёт необходимо включать инфраструктуру ЦОД, сеть, хранилище и дальнейшую эксплуатацию.
Специалисты Сервер Молл помогут подобрать NVIDIA DGX под обучение или инференс, проверить требования к размещению и подготовить спецификацию. Чтобы получить предложение, отправьте описание модели, используемого программного стека, объёма данных и планируемой нагрузки.
Вопросы и ответы
Не нашли нужной информации? Спросите — мы ответим!
Какие условия доставки?
Сроки доставки обычно составляют: 1 рабочий день по Москве и Санкт-Петербургу, по России — 3–5 рабочих дней (в зависимости от региона и перевозчика).
Что входит в гарантию?
Гарантия «Сервер Молл»: 5 лет на серверы и СХД, 1 год на комплектующие, 6 месяцев на Б/У накопители.
8 причин купить NVIDIA DGX в СЕРВЕР МОЛЛ
для людей, а не для галочки: без мелочей вроде платной доставки до транспортной компании
5 лет гарантии
с выездом
Берём все логистические и технические расходы на себя. Быстро реагируем, обрабатываем и закрываем заявки. Собственные сервисные центры, склады и надёжные логистические партнёры — всё, чтобы ваши бизнес-процессы работали 24/365.
СЕРВЕР МОЛЛ — крупнейший поставщик оборудования Dell, HPE и Lenovo в России и СНГ
Мы сэкономим ваше время!
Поможем, расскажем, посоветуем.
