Серверные GPU и ускорители оптом
Ускорители для дата-центров на архитектуре Hopper и Ada Lovelace (H100, A100, L40S) несут пассивное охлаждение, ECC-память HBM3 и поддержку NVLink. Подходят под обучение и инференс нейросетей, виртуализацию vGPU и HPC-кластеры, где нужна масштабируемость по нескольким картам и круглосуточная нагрузка.
- Тип: серверные GPU
- Охлаждение: пассивное, под стойку
- Интерфейс: PCIe / SXM
- Под: дата-центр и кластеры
Серверные GPU
Ускорители для дата-центра
Серверные видеокарты с пассивным охлаждением под установку в стойку: A100, H100, L40S, A40 и аналоги. Подбираем модель и количество под нагрузку и форм-фактор сервера.
- Серия: Tesla / A100 / H100
- VRAM: 40-80 ГБ HBM
- Интерфейс: SXM / PCIe, NVLink
- Под: обучение нейросетей
NVIDIA Tesla, A100, H100
Обучение нейросетей
Серверные ускорители NVIDIA A100 и H100 с памятью HBM2e и HBM3 для обучения больших моделей и тяжёлых вычислений. Флагманы для дата-центров и AI-кластеров.
- Серия: Instinct MI
- VRAM: 64-192 ГБ HBM
- Интерфейс: OAM / PCIe
- Под: HPC и AI
AMD Instinct
Вычисления и AI на AMD
Серверные ускорители AMD Instinct MI-серии с памятью HBM под HPC-расчёты и обучение моделей. Высокая плотность вычислений и большой объём видеопамяти для дата-центра.
- Форм-фактор: 2U-4U GPU
- GPU: 2-8 ускорителей
- CPU: 2x Xeon / EPYC
- Под: AI и рендер-фермы
GPU-серверы и платформы
Готовые сборки под GPU
Серверные платформы 2U-4U под 2-8 видеокарт с усиленным питанием и охлаждением. Собираем GPU-серверы под обучение, инференс и рендер-фермы, прошиваем и тестируем.
- Модель: L40S 48GB
- VRAM: 48 ГБ GDDR6 ECC
- TDP: 350 Вт PCIe
- Под: инференс и рендер
NVIDIA L40S
Инференс и рендер в ЦОД
Универсальный ускоритель NVIDIA L40S на 48 ГБ с поддержкой FP8 для инференса нейросетей, рендера и виртуализации графики в дата-центре. Пассивное охлаждение под стойку.
- Серия: GeForce RTX 40
- VRAM: 12-24 ГБ GDDR6X
- TDP: 220-450 Вт
- Под: игры, рендер, графику
RTX 40 серии
Игры, рендер и графика
Игровые и творческие видеокарты RTX 4070, 4080 и флагман RTX 4090 на архитектуре Ada Lovelace. Берут рендер, 3D, видеомонтаж и тяжёлые игры. Лучшее соотношение цены и производительности.
- Серия: GeForce RTX 30
- VRAM: 8-24 ГБ GDDR6X
- TDP: 170-350 Вт
- Под: игры и монтаж
RTX 30 серии
Доступный рендер и игры
Видеокарты RTX 3060, 3080 и 3090 на архитектуре Ampere. Доступный вариант под игры, монтаж и обучение небольших моделей. Хорошо подходят для апгрейда рабочих станций.
- Серия: RTX A / Quadro
- VRAM: 16-48 ГБ ECC
- TDP: 140-300 Вт
- Под: CAD, CAE, рендер
Профкарты RTX A и Quadro
Профвизуализация и CAD
Профессиональные видеокарты NVIDIA RTX A4000-A6000 и Quadro с ECC-памятью и сертифицированными драйверами. Для CAD, CAE, инженерной графики и студийного рендера.
- Серия: Radeon Pro W
- VRAM: 16-48 ГБ GDDR6
- TDP: 190-300 Вт
- Под: графику и монтаж
AMD Radeon Pro
Профграфика и монтаж
Профессиональные видеокарты AMD Radeon Pro W-серии с сертифицированными драйверами под графику, монтаж и проектирование. Альтернатива NVIDIA для рабочих станций.
Доставка по РК
По Алматы привозим видеокарты своим транспортом, в другие города отправляем транспортными компаниями. Оборудование надёжно упаковываем, стоимость и сроки доставки считаем заранее.
Что входит в серверного GPU
Состав поставки под серверного GPU: подбор по VRAM и TDP, прогон под нагрузкой, гарантия и документы. Цена от 4 800 000 ₸/шт.
Договор и безнал
01.Договор и безнал
Работаем с физлицами, компаниями и ИП. Заключаем договор поставки, выдаём накладную и счёт-фактуру, принимаем оплату картой и по безналу с ЭСФ.
- Договор
- ЭСФ и накладная
- Безнал
Гарантия и сроки
02.Гарантия и сроки
Поставляем видеокарты в согласованный срок и даём официальную гарантию производителя. При гарантийном случае оперативно меняем неисправную карту.
- Поставка в срок
- Гарантия вендора
- Сервис и замена
Подбор и тест
03.Подбор и тест
Видеокарту под задачу подбирают инженеры, а серверные ускорители и партии прогоняют под нагрузкой перед отгрузкой, чтобы исключить скрытый брак.
- Подбор под задачу
- Тест под нагрузкой
- Проверка перед отгрузкой
Видеокарты и GPU
Каталог видеокарт и GPU
Перед заказом подберём модель под задачу, согласуем спецификацию и сроки поставки, зафиксируем цену в коммерческом предложении - без скрытых доплат.
Почему покупают серверного GPU у нас
Прямые каналы поставки чипов NVIDIA и AMD, инженерный подбор и договор с фиксированной ценой на серверного GPU.
Берём проекты любой сложности: от одной видеокарты для рабочей станции до партии серверных ускорителей и GPU-серверов для дата-центра. Подбираем модели NVIDIA и AMD под задачу, проверяем и тестируем перед отгрузкой.
Цену называем заранее и фиксируем в коммерческом предложении. Работаем по безналу с ЭСФ для юрлиц, даём гарантию и полный пакет документов. КП со спецификацией готовим в день обращения.
Получить расчёт
Цену фиксируем в КП до оплаты. Итоговая сумма не меняется при поставке.
Договор и гарантия
Безнал, ЭСФ, закрывающие документы
серверные gpu и ускорители
Подробнее о серверном GPU
Что это и что входит
Серверный GPU это вычислительный ускоритель для дата-центра: пассивное охлаждение под продув стойки, ECC-память HBM или GDDR с коррекцией ошибок и поддержка NVLink для связки нескольких карт в один вычислительный пул. Поставляем ускорители NVIDIA H100, A100, L40S, RTX 6000 Ada и AMD Instinct MI300X оптом и поштучно: AI и ML обучение, инференс, рендер-фермы, виртуализация vGPU. Считаем конфигурацию под нагрузку, фиксируем цену в КП до отгрузки.
Подробнее
Что такое серверный GPU
Серверный GPU отличается от игровой видеокарты охлаждением и памятью. У него пассивный радиатор без своих вентиляторов: воздух гонят корпусные вентиляторы сервера насквозь через стойку, поэтому карта рассчитана на круглосуточную нагрузку. Память идёт с коррекцией ошибок ECC, что критично для долгих вычислений, где одна ошибка бита ломает результат обучения модели. Карты вроде NVIDIA A100 и H100 несут память HBM с пропускной способностью до 3,35 ТБ/с против 1 ТБ/с у топовых GDDR6X. Под одну задачу берут одну карту, под обучение крупных моделей собирают узлы по 4 или 8 GPU.
Какой ускоритель под задачу
Для обучения больших языковых моделей и трансформеров берут H100 SXM или A100 80 ГБ: большой объём HBM и высокая связность NVLink определяют, поместится ли модель в память узла. Под инференс и средние модели выгоднее L40S или RTX 6000 Ada на 48 ГБ GDDR6 ECC: меньше TDP, дешевле, PCIe-форм-фактор ставится в обычный сервер. Под рендер и 3D-вижуал нужны CUDA-ядра и RT-ядра, тут L40S и RTX 6000 Ada сильнее A100. Под виртуализацию рабочих столов с vGPU подходят L40S и L4. Опишите фреймворк и размер модели, подберём карту под VRAM и бюджет.
VRAM, TFLOPS и NVLink
Три цифры решают всё. Объём VRAM задаёт, какая модель влезет: H100 несёт 80 ГБ HBM3, A100 идёт на 40 или 80 ГБ, L40S и RTX 6000 Ada на 48 ГБ GDDR6 ECC. Производительность в FP16 и FP8 на Tensor-ядрах определяет скорость обучения: H100 даёт до 1979 TFLOPS FP16 со sparsity против 312 TFLOPS у A100. NVLink связывает карты напрямую на скорости до 900 ГБ/с в обход PCIe, что обязательно для multi-GPU обучения, иначе шина PCIe 5.0 на 64 ГБ/с станет узким горлом. Считаем эти параметры под вашу нагрузку, а не продаём карту по названию.
SXM против PCIe
Ускорители идут в двух форматах. PCIe-карта (L40S, RTX 6000 Ada, A100 PCIe, H100 PCIe) ставится в стандартный слот PCIe 5.0 x16 обычного сервера, NVLink-мост связывает максимум две карты. SXM-модуль (A100 SXM4, H100 SXM5) монтируется на материнскую плату через разъём SXM и работает только в специализированных платформах HGX на 4 или 8 GPU с полносвязной топологией NVSwitch и более высоким TDP до 700 Вт. SXM быстрее и плотнее, но требует именно HGX-узла. PCIe гибче и дешевле, ставится в любой совместимый сервер. Подскажем, что выгоднее под вашу архитектуру и стойку.
GPU-сервер целиком
Часто заказчику нужна не голая карта, а готовая GPU-платформа. Собираем серверы под ускорители: 2U под 2-4 PCIe GPU, 4U под 8 PCIe GPU, платформы HGX под 8 SXM-модулей с NVSwitch. Считаем питание: восемь H100 SXM это около 5,6 кВт только на GPU, плюс процессоры и обвязка, поэтому закладываем резервные блоки питания на 3+ кВт и проверяем, держит ли стойка такую плотность. Охлаждение проверяем под полной нагрузкой на стенде. По запросу ставим драйверы CUDA, контейнерную среду и прогоняем тест обучения перед отгрузкой, чтобы вы получили рабочий узел, а не коробку с железом.
Поставка и опт
Работаем поштучно и оптом: для интеграторов, рендер-студий, AI-стартапов, майнинг-площадок и дата-центров действуют объёмные цены от партии. После согласования спецификации проверяем карты на стенде, прогоняем под нагрузкой, снимаем серийные номера. Поставка по Алматы со склада и по всему Казахстану под заказ. Для юрлиц и ИП работаем по договору поставки и безналу с ЭСФ, готовим комплект документов под тендеры и постановку на учёт. Гарантию вендора и сервисное сопровождение оформляем сразу. КП с фиксированной ценой присылаем за 1 рабочий день.
Цены и характеристики
| Ускоритель | Цена | Память и шина | Под что |
|---|---|---|---|
| NVIDIA L4 | от 1 350 000 ₸ | 24 ГБ GDDR6 ECC, PCIe | инференс, vGPU, видеотранскод |
| NVIDIA L40S | от 4 800 000 ₸ | 48 ГБ GDDR6 ECC, PCIe 4.0 | инференс, рендер, vGPU |
| NVIDIA RTX 6000 Ada | от 5 200 000 ₸ | 48 ГБ GDDR6 ECC, PCIe 4.0 | рендер, CAD, обучение средних моделей |
| NVIDIA A100 80 ГБ | от 9 800 000 ₸ | 80 ГБ HBM2e, PCIe / SXM4 | обучение, HPC, крупные модели |
| NVIDIA H100 80 ГБ | от 19 500 000 ₸ | 80 ГБ HBM3, PCIe / SXM5 | LLM-обучение, тяжёлый AI |
Какой ускоритель под нагрузку
| Карта | VRAM | Профиль | Где применять |
|---|---|---|---|
| NVIDIA L4 | 24 ГБ | низкий TDP 72 Вт | инференс, видео, vGPU |
| NVIDIA L40S | 48 ГБ | универсал 350 Вт | инференс, рендер, vGPU |
| NVIDIA A100 | 40-80 ГБ | HBM, NVLink | обучение, HPC |
| NVIDIA H100 | 80 ГБ | флагман, NVSwitch | LLM, тяжёлое обучение |
Сроки поставки
| Вариант | Наличие | Срок | Гарантия |
|---|---|---|---|
| Со склада в Алматы | в наличии | 1-3 дня | от 1 года |
| GPU-сервер на заказ | под заказ | 5-10 дней | на сборку и комплектующие |
| H100, A100, HGX под заказ | поставка | от 2-5 недель | гарантия вендора в РК |
Что вы получаете
Поставка и условия
Поставляем серверные GPU и ускорители по Алматы со склада и по всему Казахстану под заказ: Астана, Шымкент, Караганда, Актобе, Атырау, Усть-Каменогорск и другие города. По Алматы возможна доставка и установка карт в сервер силами наших инженеров с проверкой охлаждения под нагрузкой, в регионы отправляем транспортными компаниями с антистатической упаковкой и страховкой груза. Конфигурацию GPU-узла согласуем удалённо, КП с фиксированной ценой присылаем за 1 рабочий день. Для компаний и ИП работаем по договору поставки и безналу с закрывающими документами и ЭСФ, под опт даём объёмные цены от партии.
Коротко
Нужен серверный GPU или готовый GPU-сервер? Опишите задачу, фреймворк и размер модели, бесплатно подберём ускоритель под VRAM и бюджет, рассчитаем питание узла и пришлём КП за 1 рабочий день. Поставка по Алматы и Казахстану, опт для интеграторов, оригинальные карты, гарантия и договор.
Гарантия и документы
Работаем по договору поставки с полным пакетом закрывающих документов для юрлиц и ИП, отгружаем оригинальные видеокарты с гарантией производителя.
- Счёт и счёт-фактура (ЭСФ)
- Договор поставки
- Спецификация и серийные номера
- Накладная и акт приёма-передачи
- Гарантийный талон производителя
- Документы для постановки на учёт
Оборудование соответствует стандартам и техрегламентам:
- ISO 9001 - Менеджмент качества поставщика
- ISO/IEC 27001 - Информационная безопасность
- ТР ТС 004/2011 - Безопасность низковольтного оборудования
- ТР ТС 020/2011 - Электромагнитная совместимость
- ГОСТ 30804.6.2-2013 - Помехоустойчивость технических средств
Ответы на частые вопросы
Цена зависит от класса ускорителя. NVIDIA L4 на 24 ГБ под инференс начинается от 1 350 000 ₸, универсальный L40S на 48 ГБ от 4 800 000 ₸, RTX 6000 Ada от 5 200 000 ₸. Карты под обучение дороже: A100 80 ГБ от 9 800 000 ₸, флагман H100 80 ГБ от 19 500 000 ₸. Итоговая стоимость зависит от формата (PCIe или SXM), объёма памяти и партии: при оптовом заказе цена за карту ниже. Точную стоимость фиксируем в коммерческом предложении после уточнения задачи, и цена в КП не меняется при отгрузке.
Тремя вещами. Охлаждение: у серверной карты пассивный радиатор без вентиляторов, воздух гонит сам сервер насквозь через стойку, поэтому карта держит круглосуточную нагрузку без перегрева. Память: серверный GPU несёт ECC с коррекцией ошибок, что обязательно для долгих вычислений, где сбой одного бита ломает результат обучения. Связность: серверные карты поддерживают NVLink и NVSwitch для объединения нескольких GPU в один пул, у игровых этого нет. Игровая карта не рассчитана на 24/7 в дата-центре и формально лишена поддержки для виртуализации vGPU.
Зависит от размера модели и фреймворка. Под крупные языковые модели и трансформеры берут H100 или A100 80 ГБ: решает объём HBM и связность NVLink, потому что модель должна поместиться в память узла. Под средние модели и дообучение хватает RTX 6000 Ada или L40S на 48 ГБ GDDR6 ECC, это заметно дешевле. Под обучение совсем больших моделей собирают узлы по 4 или 8 GPU с NVSwitch, чтобы карты делили память и данные на скорости 900 ГБ/с. Опишите архитектуру, число параметров и батч, мы подберём карту и число GPU под вашу нагрузку и бюджет.
Это два форм-фактора одной карты. PCIe-версия (L40S, RTX 6000 Ada, A100 PCIe, H100 PCIe) ставится в обычный слот PCIe 5.0 x16 стандартного сервера, NVLink-мостом связываются максимум две карты, питание до 350-400 Вт. SXM-модуль (A100 SXM4, H100 SXM5) крепится прямо на материнскую плату специальной платформы HGX на 4 или 8 GPU с полносвязной топологией NVSwitch и TDP до 700 Вт. SXM быстрее, плотнее и лучше масштабируется на многокарточных задачах, но работает только в HGX-узле. PCIe гибче, дешевле и ставится в любой совместимый сервер. Подскажем формат под вашу платформу.
Да, работаем поштучно и оптом. Для системных интеграторов, рендер-студий, AI-стартапов, майнинг-площадок и дата-центров действуют объёмные цены: чем крупнее партия, тем ниже цена за карту. Под крупные проекты подбираем единую спецификацию, резервируем наличие и согласуем график поставок партиями под ваш бюджет и сроки развёртывания. Для постоянных партнёров держим карты под заказ и предупреждаем о доступности дефицитных позиций вроде H100 заранее. Оптовое КП с ценой за единицу и за партию готовим за 1 рабочий день, для юрлиц работаем по договору и безналу с ЭСФ.
Да, собираем GPU-серверы целиком, а не только продаём карты. Под 2-4 PCIe-ускорителя берём корпус 2U, под 8 PCIe GPU формат 4U, под SXM-модули платформу HGX на 8 GPU с NVSwitch. Считаем питание под полную нагрузку: восемь H100 это около 5,6 кВт только на картах, поэтому закладываем резервные блоки на 3+ кВт и проверяем, держит ли стойка такую плотность по питанию и теплу. Прогоняем узел на стенде под нагрузкой, по запросу ставим драйверы CUDA и контейнерную среду. Опишите задачу, соберём готовый к обучению узел под ключ.
Складываем TDP всех карт и добавляем процессоры, память и обвязку. Карта L40S это 350 Вт, A100 SXM до 400-500 Вт, H100 SXM до 700 Вт. Восемь H100 дают около 5,6 кВт только на GPU, плюс два процессора и периферия выводят узел за 7 кВт, поэтому нужны резервные блоки питания и стойка, рассчитанная на такую нагрузку. Охлаждение проверяем под полной загрузкой: серверные карты пассивные и требуют достаточного продува, иначе срабатывает троттлинг. Мы рассчитаем питание, подберём блоки с запасом и проверим тепловой режим на стенде до отгрузки.
Да, под рендер и 3D-визуализацию лучше всего идут L40S и RTX 6000 Ada: у них много CUDA-ядер, RT-ядра для трассировки лучей и 48 ГБ памяти под тяжёлые сцены и текстуры высокого разрешения. Они сильнее A100 в задачах рендера, потому что A100 заточен под вычисления и лишён RT-ядер. Для рендер-ферм собираем узлы по несколько PCIe-карт в 4U-корпусе и считаем производительность под ваш движок: Redshift, Octane, V-Ray, Arnold, Blender Cycles. Поддержку выбранного движка и драйверов проверим заранее, чтобы карты дали максимум в вашем пайплайне.
vGPU это разделение одной серверной карты на несколько виртуальных GPU для виртуальных рабочих столов и приложений. Так одна L40S или L4 раздаёт ускорение десяткам пользователей VDI: CAD, дизайн, видеомонтаж в облаке. Для vGPU нужна не только карта с поддержкой виртуализации, но и подписочная лицензия NVIDIA vGPU, которая считается по числу одновременных пользователей. Мы подберём карту под нужное число рабочих мест и поможем оформить лицензию vGPU под вашу платформу виртуализации (VMware, Citrix, Proxmox). Рассчитаем, сколько пользователей потянет узел, чтобы вы не переплатили за лишние карты.
Да, поставляем только оригинальные ускорители от производителя без серого и ремаркированного товара. Серверные GPU идут строго с ECC-памятью, потому что для долгих вычислений коррекция ошибок обязательна. На каждую карту даём гарантию: на оборудование действует гарантия вендора в Казахстане, на сборку GPU-сервера наша гарантия на работу и комплектующие. По запросу предоставляем серийные номера и документы для постановки на учёт и тендерных требований. Карты проверяем на стенде под нагрузкой перед отгрузкой, чтобы исключить брак и троттлинг, а вы получили заведомо рабочее железо.
Если позиция есть на складе в Алматы, отгружаем за 1-3 рабочих дня. Дефицитные флагманы вроде H100 и платформы HGX обычно идут под заказ от двух до пяти недель в зависимости от наличия у дистрибьютора и объёма партии. Готовый GPU-сервер на заказ с тестом и прогоном собираем за 5-10 дней. Точный срок называем сразу в КП и фиксируем в договоре, по дефицитным картам предупреждаем о реальной доступности честно, без обещаний на словах. В регионы Казахстана добавляется время на доставку транспортной компанией, его учитываем заранее в графике.
Да, с компаниями и ИП работаем по договору поставки и безналичному расчёту с выставлением счёта и счёта-фактуры (ЭСФ). После отгрузки подписываем накладную и акт приёма-передачи. Реквизиты, проект договора и спецификацию по картам и GPU-серверу присылаем заранее, чтобы бухгалтерия и отдел снабжения успели всё провести. Поможем с документами для постановки оборудования на учёт и амортизации. Для тендеров и госзакупок готовим полный комплект документов и технические характеристики ускорителей под требования заказчика, включая подтверждение оригинальности и гарантийных обязательств в Казахстане.
Да, при подборе мы оставляем запас под рост. В PCIe-сервере можно дозаполнить свободные слоты дополнительными картами, если хватает питания и продува, поэтому изначально закладываем блок питания и корпус с запасом. В HGX-платформе число SXM-модулей фиксировано шасси (обычно 4 или 8), поэтому под рост берут узел сразу на 8 GPU и заполняют постепенно. Для масштабирования за пределы одного узла собираем кластер из нескольких GPU-серверов со связью по InfiniBand или 100/200 GbE. Поможем спланировать апгрейд так, чтобы добавлять карты партиями без замены платформы и простоя.
NVIDIA доминирует в AI за счёт экосистемы CUDA: большинство фреймворков (PyTorch, TensorFlow, JAX) и готовых моделей оптимизированы именно под CUDA и Tensor-ядра, поэтому H100, A100, L40S это стандарт де-факто для обучения и инференса. AMD Instinct MI300X несёт рекордные 192 ГБ HBM3 и сильна в задачах, где решает объём памяти, а софт собран под ROCm. На практике выбор почти всегда диктует ваш стек: если код и модели заточены под CUDA, берут NVIDIA, если есть поддержка ROCm и нужен максимум VRAM на карту, AMD выходит выгоднее. Подскажем под ваш фреймворк, что встанет без переписывания кода.
Расчёт видеокарт и GPU
Узнайте цену на серверного GPU
Оставьте номер - перезвоним в течение 15 минут, уточним задачу, модель и количество, подберём видеокарту под нагрузку и подготовим коммерческое предложение со спецификацией и ценой.
- Подбор модели под вашу задачу
- Оптовые цены и партии под заказ
- Гарантия, безнал и ЭСФ для юрлиц
- Доставка по всему Казахстану
Звоните или пишите
Заказать серверного GPU
Поставка
Доставляем по Алматы, отправляем партии GPU транспортными компаниями по Казахстану.
г. Алматы и РК