ITequipment.ruсетевое и серверное оборудование · МоскваПерейти в каталог →

AI-фабрика: какое железо нужно для ИИ-кластера

Коротко: Обучение и инференс больших моделей упираются не только в GPU, но и в сеть между ними. Объясняем компоненты AI-фабрики и что учитывать при сборке ИИ-кластера.

GPU-серверы — сердце кластера

NVIDIA H100/H200 и платформы HGX/Supermicro на 4–8 GPU. Плотность, питание и охлаждение — ключевые ограничения. Подборка — GPU NVIDIA и GPU-платформы Supermicro.

Сеть: InfiniBand или Ethernet

Для межузлового обмена нужна сеть с низкой задержкой: InfiniBand (NVIDIA/Mellanox) или Ethernet с RoCE на 200/400G. От неё зависит масштабируемость обучения.

Оптика и кабели 400G

400G-фабрика — это QSFP-DD/OSFP-модули, DAC/AOC и коммутаторы высокой плотности. Совместимость портов критична — подберём комплект.

Питание и охлаждение

GPU-стойка потребляет десятки кВт — нужны мощные PDU, ИБП и часто жидкостное охлаждение. Заложите это в проект серверной заранее.

Смотреть gpu и ai-серверы в наличии →

Вопросы по теме

Можно ли собрать ИИ-кластер на б/у?
Частично: серверы и сеть — да, с проверкой; актуальные GPU обычно новые. Поможем с миксом под бюджет.
InfiniBand обязателен?
Для крупного обучения — желателен; для инференса и небольших задач хватает 100/200/400G Ethernet с RoCE.
Поможете с проектом серверной под GPU?
Да: стойки, питание, охлаждение, сеть — под ключ.