Выберите ваш город

Broadcom выпускает чип Tomahawk Ultra в противовес NVLink и UALink

Опубликовано 17.07.2025
5 мин
315
Broadcom выпускает чип Tomahawk Ultra в противовес NVLink и UALink  Изображение 1

Прежде, чем переходить к деталям о новом чипе Tomahawk Ultra, хотелось бы начать с небольшого предисловия о истоках противостояния технологий Broadcom и NVIDIA (и не только). Итак, хотя производители чипов, например AMD, постепенно сокращают разрыв с NVIDIA по показателям FLOPS GPU или пропускной способности памяти и объему HBM, без высокоскоростной интерконнект-системы и коммутаторов (таких как NVLink и NVSwitch), их способность масштабировать эту производительность ограничена. Наличие этих технологий позволило NVIDIA создавать системы с 72 GPU на стойку, в то время как Intel и AMD все еще ограничены восемью. Чтобы обойти это ограничение, многие представители отрасли поддержали новый протокол Ultra Accelerator Link (UALink) — открытую альтернативу NVLink.

Однако, не все согласны, что новый протокол необходим, и готовы ждать, пока первое оборудование UALink появится на рынке. Несмотря на то, что Broadcom была среди основателей консорциума UALink, теперь в компании считают, что Ethernet способен справиться с данными задачами быстрее.

«Использование одной и той же технологии для всех частей сети дает огромное преимущество», — сказал Пит Дель Веккио (Pete Del Vecchio), менеджер линейки продуктов Tomahawk. «Использование Ethernet дает множество преимуществ с точки зрения инструментов мониторинга, телеметрии и отладки. Вот почему мы думаем, что UALink едва ли сможет куда-то продвинуться».

Вместо этого Broadcom продвигает конкурирующую технологию, которую она называет Scale-Up Ethernet (SUE). Компания утверждает, что эта технология будет поддерживать системы вертикального масштабирования как минимум с 1024 ускорителями, использующие любую платформу Ethernet. Для сравнения, Nvidia заявляет, что ее технология коммутаторов NVLink может поддерживать 576 ускорителей, хотя на сегодняшний день нам неизвестно о каких-либо развертываниях, масштабирующихся за пределы 72 сокетов GPU.

Самые популярные серверы

% выгодное предложение % выгодно
Refurbished В наличии
HPE ProLiant DL360 Gen10 8SFF
Размер:
1U
CPU:
2 x Intel Xeon Scalable 8100-8200 or 3100-3200
RAM:
DDR4 DIMM 12 слотов (1536 GB)
HDD:
до 8 HDD 2.5'' SFF

220 907 ₽

от 80 000

2 780 ₽/мес в лизинг

от 65 574

+ 14 426 НДС

Сконфигурировать
Refurbished В наличии
HPE ProLiant DL380 Gen10 8SFF
Размер:
2U
CPU:
2 x 1st or 2nd Generation Intel Xeon Scalable
RAM:
DDR4 DIMM 12 слотов (1536 GB)
HDD:
до 8 HDD 2.5'' SFF

от 126 000

4 379 ₽/мес в лизинг

от 103 279

+ 22 721 НДС

Сконфигурировать
% выгодное предложение % выгодно
Refurbished В наличии
Dell PowerEdge R640 10SFF
Размер:
1U
CPU:
2 x 2nd Generation Intel Xeon Scalable
RAM:
DDR4 DIMM 12 слотов (3072 GB)
HDD:
до 10 HDD 2.5'' SFF

146 602 ₽

от 77 000

2 676 ₽/мес в лизинг

от 63 115

+ 13 885 НДС

Сконфигурировать
% выгодное предложение % выгодно
Новый В наличии
Lenovo TS ThinkSystem SR650 V3 8SFF
Размер:
2U
CPU:
2 x 4th Generation Intel Xeon Scalable
RAM:
DDR5 DIMM 32 слотов (8192 GB)
HDD:
до 8 HDD 2.5'' SFF

438 045 ₽

от 405 597

14 094 ₽/мес в лизинг

от 332 457

+ 73 140 НДС

Broadcom Tomahawk Ultra

Главным решением Broadcom для SUE станет анонсированный Tomahawk Ultra — чип-коммутатор с пропускной способностью 51,2 Тбит/с, специально оптимизированный для конкуренции с InfiniBand от NVIDIA в традиционных суперкомпьютерах и HPC-кластерах, а также с NVLink в развертываниях на уровне стойки, подобных Nvidia GB200 NVL72 или AMD Helios.

Хотя Tomahawk Ultra использует тот же корпус и совместим по выводам (pin-compatible) с Tomahawk 5 от Broadcom, на самом деле это совершенно другой чип. Наряду с относительно большим radix и 512 SerDes по 100 Гбит/с каждый, чипсет специально оптимизирован для высокопроизводительных сетей и обеспечивает задержку всего в 250 наносекунд при обработке 64-байтовых пакетов со скоростью 77 миллиардов раз в секунду. Это важно, поскольку такие небольшие пакеты распространены в HPC-системах и могут создавать проблемы для сетевого оборудования, не рассчитанного на более высокую частоту сообщений, которая с ними связана.

Источник изображений: Broadcom

Чип также обладает полным набором механизмов контроля перегрузок, включая прямую коррекцию ошибок (forward error correction) и credit-based flow control для снижения потерь пакетов, сохраняя при этом совместимость с существующими сетевыми картами Ethernet (NIC) и процессорами для обработки данных (DPU). Коммутатор также поддерживает внутрисетевые коллективные операции, которые NVIDIA называет SHARP в своих коммутаторах NVLink. Это позволяет передавать операции типа all-reduce на сеть, что повышает эффективность за счет сокращения необходимой для их выполнения пропускной способности.

По сравнению с коммутаторами NVLink пятого поколения от NVIDIA, Tomahawk Ultra предлагает почти вдвое большую пропускную способность: 51,2 Тбит/с против 28,8 Тбит/с. Это означает, что используя такое же количество коммутаторов, как в 72-GPU системах NVL от NVIDIA, Broadcom могла бы поддерживать структуру со 128 ускорителями.

Также утверждается, что в сравнении с UALink, Tomahawk Ultra способен предложить лучшие показатели задержку, хотя объективно оценить это заявление трудно. В частности, недавно Кутис Боуман (Kutis Bowman), председатель консорциума UALink, заявлял, что задержка коммутаторов будет в диапазоне 100-150 нс. Если этого удастся добиться, у протокола UALink появится преимущество.

Ждать информации о том, как новейший чип Broadcom на самом деле проявит себя, придется недолго. Tomahawk Ultra уже поставляются клиентам, и поскольку они совместимы по выводам с TH5, перепрофилирование существующих шасси коммутаторов должно быть относительно простым и быстрым.

А что если объединить технологии?

Конечно, тот факт, что оборудование UALink еще не вышло на рынок, не означает, что протокол недоступен для AMD или Intel. Еще в апреле консорциум UALink опубликовал свою первую спецификацию, а на мероприятии Advancing AI в июне AMD представила свои стойки Helios, которые будут использовать как UALink, так и Ethernet. Всё верно — для своих первых систем AMD будет туннелировать протокол UALink через обычные коммутаторы Ethernet.

Другие транспортные протоколы, такие как UALink или Infinity Fabric, могут передаваться поверх Ethernet. Однако такое туннелирование UALink не назовешь идеальным вариантом. В частности, в таком случае точно не удастся приблизиться к целевой задержке UALink в 100-150 нс. С другой стороны, нельзя поставить то, чего у тебя нет - если бы AMD ждала до 2027 года, чтобы вывести на рынок свою стойку Helios, ей пришлось бы конкурировать с системами Kyber от Nvidia на 144 GPU-сокета.

Источник

Автор

СЕРВЕР МОЛЛ

Поделиться
Комментарии
(0)
Ещё не добавлено ни одного комментария
Написать комментарий
Поля, отмеченные *, обязательны для заполнения
Для AI
Новый
DELL PowerEdge XE9780 16SFF
CPU:
2× Intel Xeon 6 серии (до 86 ядер на процессор)
RAM:
4096GB (DDR5 ECC REG)
GPU:
8 x NVIDIA B300 SXM

от 116 469 008

4 047 298 ₽/мес в лизинг

от 95 466 400

+ 21 002 608 НДС

Для AI
Новый
ASUS ESC8000A-E13 SKU1 6SFF/NVMe
CPU:
2x AMD EPYC 9575F (64c/128t, 3.3GHz-5GHz, 400W)
RAM:
768GB (DDR5 ECC REG)
GPU:
8 x NVIDIA RTX PRO 6000 Blackwell

от 17 333 272

602 331 ₽/мес в лизинг

от 14 207 600

+ 3 125 672 НДС

Для AI
Новый
Supermicro AS-5126GS-TNRT2 2SFF+8NVMe
CPU:
2x AMD EPYC 9554 (64/128, 3.1GHz-3.75GHz, 360W)
RAM:
1536GB (DDR5 ECC REG)
GPU:
8 x NVIDIA RTX PRO 6000 Blackwell

от 21 455 164

745 567 ₽/мес в лизинг

от 17 586 200

+ 3 868 964 НДС

Для AI
Новый
NVIDIA DGX B200
CPU:
2x Intel Xeon Platinum 8570 (56c/112t, 2.1GHz-4GHz, 350W)
RAM:
2000GB (DDR5 ECC REG)
GPU:
8 x NVIDIA B200 SXM

от 86 056 360

2 990 458 ₽/мес в лизинг

от 70 538 000

+ 15 518 360 НДС

client consultations icon-delivery discount icon-facebook franchise icon-google_plus it-solutions icon-jivosite icon-menu icon-up icon-message payment icon-recall shops-local shops-network icon-solutions icon-support tasks icon-twitter Group 8 icon-user icon-viber icon-vk icon-watsup icon-watsup-2
Мы используем файлы 'cookie', чтобы обеспечить максимальное удобство пользователям.