Серверы H100 HGX для крупных моделей
Серверы построены на платформе NVIDIA HGX с восемью ускорителями H100, соединёнными через NVLink и NVSwitch в единый домен на 640 ГБ памяти HBM3. Конфигурация рассчитана на обучение больших языковых моделей и распределённый инференс, где нужна плотная связность между всеми GPU узла.
- Тип: серверные GPU
- Охлаждение: пассивное, под стойку
- Интерфейс: PCIe / SXM
- Под: дата-центр и кластеры
Серверные GPU
Ускорители для дата-центра
Серверные видеокарты с пассивным охлаждением под установку в стойку: A100, H100, L40S, A40 и аналоги. Подбираем модель и количество под нагрузку и форм-фактор сервера.
- Серия: Tesla / A100 / H100
- VRAM: 40-80 ГБ HBM
- Интерфейс: SXM / PCIe, NVLink
- Под: обучение нейросетей
NVIDIA Tesla, A100, H100
Обучение нейросетей
Серверные ускорители NVIDIA A100 и H100 с памятью HBM2e и HBM3 для обучения больших моделей и тяжёлых вычислений. Флагманы для дата-центров и AI-кластеров.
- Серия: Instinct MI
- VRAM: 64-192 ГБ HBM
- Интерфейс: OAM / PCIe
- Под: HPC и AI
AMD Instinct
Вычисления и AI на AMD
Серверные ускорители AMD Instinct MI-серии с памятью HBM под HPC-расчёты и обучение моделей. Высокая плотность вычислений и большой объём видеопамяти для дата-центра.
- Форм-фактор: 2U-4U GPU
- GPU: 2-8 ускорителей
- CPU: 2x Xeon / EPYC
- Под: AI и рендер-фермы
GPU-серверы и платформы
Готовые сборки под GPU
Серверные платформы 2U-4U под 2-8 видеокарт с усиленным питанием и охлаждением. Собираем GPU-серверы под обучение, инференс и рендер-фермы, прошиваем и тестируем.
- Серия: GeForce RTX 30
- VRAM: 8-24 ГБ GDDR6X
- TDP: 170-350 Вт
- Под: игры и монтаж
RTX 30 серии
Доступный рендер и игры
Видеокарты RTX 3060, 3080 и 3090 на архитектуре Ampere. Доступный вариант под игры, монтаж и обучение небольших моделей. Хорошо подходят для апгрейда рабочих станций.
- Серия: GeForce RTX 40
- VRAM: 12-24 ГБ GDDR6X
- TDP: 220-450 Вт
- Под: игры, рендер, графику
RTX 40 серии
Игры, рендер и графика
Игровые и творческие видеокарты RTX 4070, 4080 и флагман RTX 4090 на архитектуре Ada Lovelace. Берут рендер, 3D, видеомонтаж и тяжёлые игры. Лучшее соотношение цены и производительности.
- Серия: RTX A / Quadro
- VRAM: 16-48 ГБ ECC
- TDP: 140-300 Вт
- Под: CAD, CAE, рендер
Профкарты RTX A и Quadro
Профвизуализация и CAD
Профессиональные видеокарты NVIDIA RTX A4000-A6000 и Quadro с ECC-памятью и сертифицированными драйверами. Для CAD, CAE, инженерной графики и студийного рендера.
- Модель: L40S 48GB
- VRAM: 48 ГБ GDDR6 ECC
- TDP: 350 Вт PCIe
- Под: инференс и рендер
NVIDIA L40S
Инференс и рендер в ЦОД
Универсальный ускоритель NVIDIA L40S на 48 ГБ с поддержкой FP8 для инференса нейросетей, рендера и виртуализации графики в дата-центре. Пассивное охлаждение под стойку.
- Серия: Radeon Pro W
- VRAM: 16-48 ГБ GDDR6
- TDP: 190-300 Вт
- Под: графику и монтаж
AMD Radeon Pro
Профграфика и монтаж
Профессиональные видеокарты AMD Radeon Pro W-серии с сертифицированными драйверами под графику, монтаж и проектирование. Альтернатива NVIDIA для рабочих станций.
Доставка по РК
По Алматы привозим видеокарты своим транспортом, в другие города отправляем транспортными компаниями. Оборудование надёжно упаковываем, стоимость и сроки доставки считаем заранее.
Что входит в GPU-сервер 8x H100
Состав поставки под GPU-сервер 8x H100: подбор по VRAM и TDP, прогон под нагрузкой, гарантия и документы. Цена от 120 000 000 ₸/шт.
Договор и безнал
01.Договор и безнал
Работаем с физлицами, компаниями и ИП. Заключаем договор поставки, выдаём накладную и счёт-фактуру, принимаем оплату картой и по безналу с ЭСФ.
- Договор
- ЭСФ и накладная
- Безнал
Гарантия и сроки
02.Гарантия и сроки
Поставляем видеокарты в согласованный срок и даём официальную гарантию производителя. При гарантийном случае оперативно меняем неисправную карту.
- Поставка в срок
- Гарантия вендора
- Сервис и замена
Подбор и тест
03.Подбор и тест
Видеокарту под задачу подбирают инженеры, а серверные ускорители и партии прогоняют под нагрузкой перед отгрузкой, чтобы исключить скрытый брак.
- Подбор под задачу
- Тест под нагрузкой
- Проверка перед отгрузкой
Видеокарты и GPU
Каталог видеокарт и GPU
Перед заказом подберём модель под задачу, согласуем спецификацию и сроки поставки, зафиксируем цену в коммерческом предложении - без скрытых доплат.
Почему покупают GPU-сервер 8x H100 у нас
Прямые каналы поставки чипов NVIDIA и AMD, инженерный подбор и договор с фиксированной ценой на GPU-сервер 8x H100.
Берём проекты любой сложности: от одной видеокарты для рабочей станции до партии серверных ускорителей и GPU-серверов для дата-центра. Подбираем модели NVIDIA и AMD под задачу, проверяем и тестируем перед отгрузкой.
Цену называем заранее и фиксируем в коммерческом предложении. Работаем по безналу с ЭСФ для юрлиц, даём гарантию и полный пакет документов. КП со спецификацией готовим в день обращения.
Получить расчёт
Цену фиксируем в КП до оплаты. Итоговая сумма не меняется при поставке.
Договор и гарантия
Безнал, ЭСФ, закрывающие документы
gpu-сервер 8x h100 hgx
Подробнее о GPU-сервере 8x H100
Что это и что входит
GPU-сервер 8x H100 HGX это готовая вычислительная платформа на восьми ускорителях NVIDIA H100 SXM5 с шиной NVLink и коммутатором NVSwitch внутри одного шасси. 640 ГБ памяти HBM3, до 32 PFLOPS на FP8 в режиме разреженности, агрегатная пропускная NVLink 900 ГБ/с на карту. Это рабочая станция уровня дата-центра под обучение и инференс больших моделей. Поставляем 8x H100, считаем конфигурацию узла под вашу нагрузку и фиксируем цену в КП до отгрузки.
Подробнее
Что такое 8x H100 HGX
HGX H100 это эталонная плата-носитель NVIDIA, на которой восемь ускорителей H100 в форм-факторе SXM5 соединены напрямую через четыре чипа NVSwitch. В отличие от карт PCIe, версия SXM5 имеет TDP до 700 Вт и полную пропускную NVLink 900 ГБ/с в обе стороны, что снимает узкое место PCIe при обмене данными между GPU. Восемь карт видны как единый пул из 640 ГБ HBM3, поэтому модель на десятки миллиардов параметров целиком помещается в памяти узла без разбиения по медленным каналам. Это базовый строительный блок ИИ-кластеров.
Воздух или жидкость
Восемь карт H100 SXM5 дают до 5,6 кВт только на GPU, плюс процессоры, память и сеть - реальное потребление узла доходит до 10,2 кВт. Воздушное охлаждение в корпусе 8U справляется при температуре в зале до 25-27 градусов и хорошем потоке холодного коридора, такой вариант проще монтировать и обслуживать. Прямое жидкостное охлаждение (DLC) на пластинах снимает тепло эффективнее, позволяет уплотнить стойку и снизить PUE дата-центра, но требует контура и распределителя CDU. Под ваш зал и плотность стойки подберём схему и посчитаем нагрузку на питание и климат.
Память HBM3 и пул NVLink
Каждая H100 SXM5 несёт 80 ГБ памяти HBM3 с пропускной около 3,35 ТБ/с - это ключевой параметр для обучения, где упор почти всегда в память, а не в чистые TFLOPS. Через NVLink и NVSwitch восемь карт обмениваются данными со скоростью 900 ГБ/с на карту, поэтому при распараллеливании модели (tensor parallelism) межкарточный обмен не становится тормозом. Для моделей, которые не влезают в 640 ГБ узла, узлы объединяют в кластер через InfiniBand NDR 400G. Считаем, поместится ли ваша модель в один узел или нужен масштаб на несколько серверов.
Процессоры, RAM и хранилище узла
GPU-сервер это не только карты: под восемь H100 ставят два процессора (Intel Xeon Scalable 4-5 поколения или AMD EPYC Genoa) для подготовки данных и загрузки пайплайна. Системная память от 1 до 2 ТБ DDR5 ECC, чтобы держать датасеты и буферы без упора в своп. Локальное хранилище - быстрые NVMe U.2 на 15-30 ТБ под кэш датасета и чекпоинты, плюс подключение к сетевому хранилищу через высокоскоростную сеть. Дисбаланс между мощными GPU и слабым CPU или медленным диском убивает утилизацию карт, поэтому узел балансируем целиком.
H100 против H200 и L40S
H100 это рабочий стандарт для обучения LLM и генеративных моделей. H200 это та же архитектура Hopper, но с 141 ГБ памяти HBM3e и пропускной 4,8 ТБ/с - её берут, когда упор именно в объём и скорость памяти под очень большие модели и длинный контекст. L40S на архитектуре Ada Lovelace дешевле, имеет 48 ГБ GDDR6 и сильна в инференсе, видеогенерации и графике, но проигрывает H100 в обучении и не имеет NVLink-пула. Под обучение с нуля и дообучение крупных моделей берут H100 или H200, под инференс и медиа часто выгоднее парк L40S. Подберём под бюджет и задачу.
Поставка и ввод в эксплуатацию
H100 это дефицитный товар с регулируемым экспортом, поэтому поставку согласуем заранее: проверяем наличие у дистрибьютора, фиксируем конфигурацию узла и срок. Перед отгрузкой проводим burn-in: прогон под нагрузкой, проверку памяти всех восьми карт, тест NVLink и термального режима. По запросу разворачиваем стек - драйверы CUDA, NVIDIA Container Toolkit, фреймворки PyTorch и TensorFlow, оркестрацию через Slurm или Kubernetes. Поставка по Алматы и всему Казахстану, для юрлиц по договору и безналу с ЭСФ. Это продажа оборудования в собственность, а не аренда мощностей.
Цены и характеристики
| Платформа | Цена | Конфигурация | Под что |
|---|---|---|---|
| GPU-сервер 8x H100 HGX (воздух) | от 120 000 000 ₸ | 8x H100 SXM5 80GB, 2x Xeon, 2 ТБ DDR5 | обучение LLM, генеративный ИИ |
| GPU-сервер 8x H100 (жидкость DLC) | от 132 000 000 ₸ | 8x H100 SXM5, DLC, плотная стойка | ЦОД, высокая плотность |
| GPU-сервер 8x H200 HGX | от 150 000 000 ₸ | 8x H200 141GB HBM3e, 2 ТБ RAM | очень большие модели, длинный контекст |
| GPU-сервер 8x L40S (инференс) | от 38 000 000 ₸ | 8x L40S 48GB, 1 ТБ DDR5 | инференс, видеогенерация, рендер |
| Подбор конфигурации узла и КП | 0 ₸ | за 1 рабочий день | бесплатно под задачу |
Какой ускоритель выбрать под задачу
| Ускоритель | Память | Сильная сторона | Где применять |
|---|---|---|---|
| H100 SXM5 | 80 ГБ HBM3 | NVLink-пул, обучение | обучение и дообучение LLM |
| H200 SXM5 | 141 ГБ HBM3e | объём и скорость памяти | огромные модели, длинный контекст |
| L40S | 48 ГБ GDDR6 | цена, инференс, графика | инференс, видео, рендер-фермы |
| RTX 6000 Ada | 48 ГБ GDDR6 | рабочая станция, ECC | локальный R&D, CAD, viz |
Сроки и условия поставки
| Вариант | Наличие | Срок | Гарантия |
|---|---|---|---|
| Со склада в Алматы | при наличии | 3-7 дней | от 1 года, вендор |
| Под заказ у дистрибьютора | поставка | от 3-8 недель | гарантия вендора в РК |
| Сборка узла под ТЗ | под заказ | 2-4 недели с burn-in | на сборку и комплектующие |
Что вы получаете
Поставка и условия
Поставляем GPU-серверы 8x H100 по Алматы и по всему Казахстану: Астана, Шымкент, Караганда, Актобе, Атырау, Усть-Каменогорск и другие города. По Алматы возможна доставка, монтаж в стойку и подключение силами наших инженеров с проверкой питания и охлаждения на месте. В регионы отправляем оборудование транспортными компаниями в заводской упаковке со страхованием груза, монтаж согласуем удалённо или выездом. Конфигурацию узла обсуждаем дистанционно, КП присылаем за 1 рабочий день. Для компаний, ИП, дата-центров и научных институтов работаем по договору поставки и безналу с полным пакетом закрывающих документов и ЭСФ под тендеры и госзакупки.
Коротко
Нужен GPU-сервер 8x H100 под обучение или инференс? Опишите модели, размер датасетов и нагрузку - бесплатно посчитаем конфигурацию узла или кластера, проверим, потянет ли ваш зал по питанию и охлаждению, и пришлём КП за 1 рабочий день. Поставка по Алматы и Казахстану, оригинальные карты, гарантия вендора и договор.
Гарантия и документы
Работаем по договору поставки с полным пакетом закрывающих документов для юрлиц и ИП, отгружаем оригинальные видеокарты с гарантией производителя.
- Счёт и счёт-фактура (ЭСФ)
- Договор поставки
- Спецификация и серийные номера
- Накладная и акт приёма-передачи
- Гарантийный талон производителя
- Документы для постановки на учёт
Оборудование соответствует стандартам и техрегламентам:
- ISO 9001 - Менеджмент качества поставщика
- ISO/IEC 27001 - Информационная безопасность
- ТР ТС 004/2011 - Безопасность низковольтного оборудования
- ТР ТС 020/2011 - Электромагнитная совместимость
- ГОСТ 30804.6.2-2013 - Помехоустойчивость технических средств
Ответы на частые вопросы
GPU-сервер 8x H100 HGX с воздушным охлаждением стоит от 120 000 000 ₸ за узел: восемь карт H100 SXM5 на 80 ГБ, два процессора Xeon или EPYC, 2 ТБ DDR5 ECC и быстрое NVMe-хранилище. Вариант с прямым жидкостным охлаждением дороже примерно на 10-12 миллионов из-за контура и CDU. Итоговая цена зависит от платформы (Supermicro, Dell, GIGABYTE), объёма памяти и дисков, сетевой обвязки InfiniBand и текущего курса и наличия карт у дистрибьютора. H100 это дефицитная позиция, поэтому цену фиксируем в коммерческом предложении на момент брони и держим её до отгрузки.
Версия H100 SXM5 устанавливается в плату HGX и соединяется с другими картами напрямую через NVSwitch на полной скорости NVLink 900 ГБ/с в обе стороны, её TDP до 700 Вт. Версия H100 PCIe ставится в обычный слот, имеет TDP около 350 Вт и связывается с соседними картами только по мосту NVLink на двоих или через шину PCIe, что заметно медленнее при обмене данными. Для обучения больших моделей с распараллеливанием по картам разница принципиальна: SXM5 в составе HGX даёт единый быстрый пул из 640 ГБ, а связка PCIe-карт упирается в межкарточный обмен. Поэтому под серьёзное обучение берут именно SXM5.
Узел 8x H100 даёт 640 ГБ объединённой памяти HBM3, и этого хватает на обучение моделей примерно до 30-70 миллиардов параметров с учётом оптимизатора, градиентов и активаций при разумном размере батча и стандартных техниках вроде ZeRO и mixed precision. Для инференса в эти 640 ГБ помещаются и более крупные модели на сотни миллиардов параметров с квантизацией. Если модель не влезает в один узел, серверы объединяют в кластер через InfiniBand NDR 400G и распределяют по узлам. Назовите архитектуру и размер модели, длину контекста и батч - посчитаем, нужен один узел или несколько, и подберём конфигурацию.
Восемь карт H100 SXM5 дают до 5,6 кВт, а весь узел с процессорами, памятью и сетью потребляет до 10,2 кВт. Под это нужна стойка с подводом питания от 11-13 кВт на узел, два-три блока питания с резервированием и линии на разные фазы. По охлаждению воздушный вариант 8U требует холодного коридора и температуры в зале до 25-27 градусов, жидкостный DLC снимает тепло эффективнее и позволяет уплотнить стойку. Перед поставкой мы считаем тепловую и электрическую нагрузку под ваш конкретный зал или дата-центр и говорим, потянет ли существующая инфраструктура или нужен апгрейд питания и климата.
H100 это текущий рабочий стандарт для обучения LLM и генеративных моделей с 80 ГБ памяти HBM3 на карту. H200 это та же архитектура Hopper, но память увеличена до 141 ГБ HBM3e и пропускная поднята до 4,8 ТБ/с против 3,35 ТБ/с у H100. Брать H200 имеет смысл, когда упор именно в объём и скорость памяти: очень большие модели, длинный контекст, инференс с большим числом одновременных запросов. Если бюджет ограничен, а модели помещаются в память узла H100, переплата за H200 не всегда оправдана. Опишите задачу и размер моделей, и мы честно скажем, где выигрыш H200 окупается, а где хватит H100.
Можно, если ваша задача это инференс, видеогенерация, рендер или графика, а не обучение крупных моделей с нуля. L40S на архитектуре Ada Lovelace несёт 48 ГБ памяти GDDR6, стоит в разы дешевле H100 и отлично работает на инференсе и медийных нагрузках. Но у L40S нет NVLink-пула: карты не объединяются в общую быструю память, поэтому под обучение больших моделей с распараллеливанием по картам она проигрывает H100. На практике многие берут H100 под обучение и отдельный парк L40S под дешёвый инференс готовых моделей. Подберём баланс под ваш сценарий, чтобы не переплачивать за карты там, где задача их не требует.
Да, поставляем только оригинальные ускорители NVIDIA H100 SXM5 и H200 от авторизованных дистрибьюторов, без серого и ремаркированного товара. На каждую платформу даём гарантию вендора, действующую в Казахстане, и по запросу предоставляем серийные номера и документы для постановки оборудования на учёт и прохождения тендерных требований. Перед отгрузкой каждый узел проходит burn-in с проверкой всех восьми карт, тестом памяти HBM3, проверкой NVLink и термального режима, чтобы вы получили заведомо исправную платформу, а не кота в мешке.
Если нужная платформа есть на складе в Алматы, отгружаем за 3-7 рабочих дней с учётом burn-in и подготовки документов. Под заказ у дистрибьютора срок обычно от 3 до 8 недель и зависит от наличия карт H100, которые остаются дефицитной позицией на мировом рынке. Сборка узла под ваше ТЗ на выбранной платформе занимает 2-4 недели вместе с тестовым прогоном. Точный срок называем в коммерческом предложении и фиксируем в договоре вместе с ценой. В регионы Казахстана добавляется время на доставку транспортной компанией, его учитываем заранее и закладываем страхование груза.
Да, GPU-серверы 8x H100 проектируются как строительные блоки кластера: узлы соединяют высокоскоростной сетью InfiniBand NDR 400G через коммутатор, что даёт низкую задержку для обмена градиентами при распределённом обучении. Поверх разворачивается оркестрация: Slurm для классических HPC-нагрузок или Kubernetes с GPU-оператором для контейнеров. Технологии NCCL и SHARP ускоряют коллективные операции между узлами. Поможем спроектировать топологию сети, подобрать коммутаторы и кабели, рассчитать число узлов под нужную скорость обучения и развернуть стек, чтобы кластер работал как единая система, а не набор серверов.
Да, по запросу разворачиваем полный программный стек: драйверы NVIDIA, CUDA нужной версии, cuDNN, NVIDIA Container Toolkit для запуска контейнеров с доступом к GPU, фреймворки PyTorch и TensorFlow, библиотеки NCCL для многокарточного обмена. По оркестрации настраиваем Slurm или Kubernetes с GPU-оператором, мониторинг загрузки карт через DCGM и Prometheus с Grafana. Можем подготовить базовые образы и тестовый пайплайн обучения, чтобы вы убедились в утилизации всех восьми карт. Объём настройки согласуем заранее и включаем в смету, чтобы вы получили готовую к обучению платформу, а не просто железо без софта.
Мощные GPU простаивают, если данные подаются медленно, поэтому хранилище критично. Локально в узел ставим быстрые NVMe U.2 на 15-30 ТБ под кэш активного датасета и чекпоинты, чтобы карты не ждали диск. Для больших датасетов и общего доступа из кластера подключаем сетевое хранилище - параллельную файловую систему или быстрый NAS - через ту же высокоскоростную сеть. Под обучение важна не только ёмкость, но и пропускная и число операций в секунду, чтобы пайплайн загрузки данных успевал за восемью картами. Посчитаем профиль ваших датасетов и подберём связку локального NVMe и сетевого хранилища без узких мест.
Это продажа оборудования в собственность, а не аренда GPU по часам и не облако. Вы получаете физический узел 8x H100 на свою площадку или в свой дата-центр, полный контроль над данными и конфигурацией, без оплаты за время и без зависимости от внешнего провайдера. Это выгодно при постоянной высокой загрузке: при круглосуточном обучении покупка окупается заметно быстрее долгосрочной аренды облака, плюс данные не покидают вашу инфраструктуру, что важно для безопасности и регуляторики. Поможем посчитать совокупную стоимость владения с учётом питания и охлаждения и сравнить с арендой под ваш реальный профиль нагрузки.
Да, с компаниями, ИП, дата-центрами, вузами и научными институтами работаем по договору поставки и безналичному расчёту с выставлением счёта и счёта-фактуры ЭСФ. После отгрузки подписываем накладную и акт приёма-передачи, помогаем с документами для постановки дорогостоящего оборудования на учёт. Реквизиты, проект договора и спецификацию узла присылаем заранее, чтобы снабжение и бухгалтерия успели согласовать закупку. Для тендеров и госзакупок готовим полный комплект документов и характеристики строго под требования заказчика, включая подтверждение оригинальности и гарантии вендора в Казахстане.
Да, на платформу и карты H100 действует гарантия производителя в Казахстане, на сборку узла под ТЗ мы даём собственную гарантию на работу и комплектующие. Дополнительно оформляем сервисное сопровождение: диагностику, замену вышедших из строя компонентов, удалённую поддержку по драйверам, стеку и настройке кластера. Для критичных задач предлагаем расширенную поддержку с приоритетным временем реакции и подменным фондом, чтобы простой узла из-за сбоя был минимальным. Условия гарантии и сервиса прописываем в договоре отдельным разделом, без скрытых оговорок.
Расчёт видеокарт и GPU
Узнайте цену на GPU-сервер 8x H100
Оставьте номер - перезвоним в течение 15 минут, уточним задачу, модель и количество, подберём видеокарту под нагрузку и подготовим коммерческое предложение со спецификацией и ценой.
- Подбор модели под вашу задачу
- Оптовые цены и партии под заказ
- Гарантия, безнал и ЭСФ для юрлиц
- Доставка по всему Казахстану
Звоните или пишите
Заказать GPU-сервер 8x H100
Поставка
Доставляем по Алматы, отправляем партии GPU транспортными компаниями по Казахстану.
г. Алматы и РК