NVIDIA H100 80GB оптом
Ускоритель на архитектуре Hopper с 80 ГБ памяти HBM3 и пропускной способностью свыше 3 ТБ/с создан для обучения больших языковых моделей и тяжёлого инференса. Тензорные ядра четвёртого поколения с поддержкой FP8 и интерфейс NVLink дают линейное масштабирование в серверных сборках на 4 и 8 GPU.
- Серия: Tesla / A100 / H100
- VRAM: 40-80 ГБ HBM
- Интерфейс: SXM / PCIe, NVLink
- Под: обучение нейросетей
NVIDIA Tesla, A100, H100
Обучение нейросетей
Серверные ускорители NVIDIA A100 и H100 с памятью HBM2e и HBM3 для обучения больших моделей и тяжёлых вычислений. Флагманы для дата-центров и AI-кластеров.
- Серия: RTX A / Quadro
- VRAM: 16-48 ГБ ECC
- TDP: 140-300 Вт
- Под: CAD, CAE, рендер
Профкарты RTX A и Quadro
Профвизуализация и CAD
Профессиональные видеокарты NVIDIA RTX A4000-A6000 и Quadro с ECC-памятью и сертифицированными драйверами. Для CAD, CAE, инженерной графики и студийного рендера.
- Модель: L40S 48GB
- VRAM: 48 ГБ GDDR6 ECC
- TDP: 350 Вт PCIe
- Под: инференс и рендер
NVIDIA L40S
Инференс и рендер в ЦОД
Универсальный ускоритель NVIDIA L40S на 48 ГБ с поддержкой FP8 для инференса нейросетей, рендера и виртуализации графики в дата-центре. Пассивное охлаждение под стойку.
- Серия: Radeon Pro W
- VRAM: 16-48 ГБ GDDR6
- TDP: 190-300 Вт
- Под: графику и монтаж
AMD Radeon Pro
Профграфика и монтаж
Профессиональные видеокарты AMD Radeon Pro W-серии с сертифицированными драйверами под графику, монтаж и проектирование. Альтернатива NVIDIA для рабочих станций.
- Тип: серверные GPU
- Охлаждение: пассивное, под стойку
- Интерфейс: PCIe / SXM
- Под: дата-центр и кластеры
Серверные GPU
Ускорители для дата-центра
Серверные видеокарты с пассивным охлаждением под установку в стойку: A100, H100, L40S, A40 и аналоги. Подбираем модель и количество под нагрузку и форм-фактор сервера.
- Серия: GeForce RTX 40
- VRAM: 12-24 ГБ GDDR6X
- TDP: 220-450 Вт
- Под: игры, рендер, графику
RTX 40 серии
Игры, рендер и графика
Игровые и творческие видеокарты RTX 4070, 4080 и флагман RTX 4090 на архитектуре Ada Lovelace. Берут рендер, 3D, видеомонтаж и тяжёлые игры. Лучшее соотношение цены и производительности.
- Серия: GeForce RTX 30
- VRAM: 8-24 ГБ GDDR6X
- TDP: 170-350 Вт
- Под: игры и монтаж
RTX 30 серии
Доступный рендер и игры
Видеокарты RTX 3060, 3080 и 3090 на архитектуре Ampere. Доступный вариант под игры, монтаж и обучение небольших моделей. Хорошо подходят для апгрейда рабочих станций.
- Серия: Instinct MI
- VRAM: 64-192 ГБ HBM
- Интерфейс: OAM / PCIe
- Под: HPC и AI
AMD Instinct
Вычисления и AI на AMD
Серверные ускорители AMD Instinct MI-серии с памятью HBM под HPC-расчёты и обучение моделей. Высокая плотность вычислений и большой объём видеопамяти для дата-центра.
- Форм-фактор: 2U-4U GPU
- GPU: 2-8 ускорителей
- CPU: 2x Xeon / EPYC
- Под: AI и рендер-фермы
GPU-серверы и платформы
Готовые сборки под GPU
Серверные платформы 2U-4U под 2-8 видеокарт с усиленным питанием и охлаждением. Собираем GPU-серверы под обучение, инференс и рендер-фермы, прошиваем и тестируем.
Доставка по РК
По Алматы привозим видеокарты своим транспортом, в другие города отправляем транспортными компаниями. Оборудование надёжно упаковываем, стоимость и сроки доставки считаем заранее.
Что входит в видеокарту NVIDIA H100
Состав поставки под видеокарту NVIDIA H100: подбор по VRAM и TDP, прогон под нагрузкой, гарантия и документы. Цена от 14 000 000 ₸/шт.
Договор и безнал
01.Договор и безнал
Работаем с физлицами, компаниями и ИП. Заключаем договор поставки, выдаём накладную и счёт-фактуру, принимаем оплату картой и по безналу с ЭСФ.
- Договор
- ЭСФ и накладная
- Безнал
Гарантия и сроки
02.Гарантия и сроки
Поставляем видеокарты в согласованный срок и даём официальную гарантию производителя. При гарантийном случае оперативно меняем неисправную карту.
- Поставка в срок
- Гарантия вендора
- Сервис и замена
Подбор и тест
03.Подбор и тест
Видеокарту под задачу подбирают инженеры, а серверные ускорители и партии прогоняют под нагрузкой перед отгрузкой, чтобы исключить скрытый брак.
- Подбор под задачу
- Тест под нагрузкой
- Проверка перед отгрузкой
Видеокарты и GPU
Каталог видеокарт и GPU
Перед заказом подберём модель под задачу, согласуем спецификацию и сроки поставки, зафиксируем цену в коммерческом предложении - без скрытых доплат.
Почему покупают видеокарту NVIDIA H100 у нас
Прямые каналы поставки чипов NVIDIA и AMD, инженерный подбор и договор с фиксированной ценой на видеокарту NVIDIA H100.
Берём проекты любой сложности: от одной видеокарты для рабочей станции до партии серверных ускорителей и GPU-серверов для дата-центра. Подбираем модели NVIDIA и AMD под задачу, проверяем и тестируем перед отгрузкой.
Цену называем заранее и фиксируем в коммерческом предложении. Работаем по безналу с ЭСФ для юрлиц, даём гарантию и полный пакет документов. КП со спецификацией готовим в день обращения.
Получить расчёт
Цену фиксируем в КП до оплаты. Итоговая сумма не меняется при поставке.
Договор и гарантия
Безнал, ЭСФ, закрывающие документы
nvidia h100 80gb
Подробнее о видеокарте NVIDIA H100
Что это и что входит
NVIDIA H100 80GB это флагманский ускоритель на архитектуре Hopper для обучения и инференса больших моделей. 80 ГБ HBM3 с пропускной способностью до 3.35 ТБ/с, движок Transformer Engine с FP8, до 1979 TFLOPS на FP16 и NVLink на 900 ГБ/с между картами. Поставляем H100 в форматах SXM5 и PCIe Gen5, отдельными картами и в составе GPU-серверов на 4 и 8 ускорителей, фиксируем конфигурацию и цену в КП до отгрузки.
Подробнее
Что такое NVIDIA H100
H100 это ускоритель вычислений на архитектуре NVIDIA Hopper, преемник A100. В основе чип GH100 на техпроцессе TSMC 4N с 80 миллиардами транзисторов, 16896 ядер CUDA в версии SXM5 и 528 тензорных ядер четвёртого поколения. Главное отличие от прошлого поколения это Transformer Engine с поддержкой формата FP8, который ускоряет обучение трансформеров в разы при сохранении точности. Карта рассчитана не на графику, а на матричные вычисления: обучение LLM, инференс, HPC, научные расчёты.
SXM5 или PCIe
H100 выпускается в двух исполнениях. SXM5 это модуль, который ставится в плату-носитель HGX, имеет TDP до 700 Вт, полный NVLink на 900 ГБ/с и максимум производительности, его берут под плотные сборки 8x GPU в дата-центрах. PCIe-версия это обычная карта в слот Gen5 x16 с TDP 350 Вт и NVLink-мостом на 600 ГБ/с между парами карт, она удобна для установки в стандартные серверы и сборки на 4 GPU. SXM5 быстрее и плотнее, PCIe гибче и проще в интеграции. Подберём исполнение под вашу платформу и бюджет.
Память HBM3 и полоса
У H100 80 ГБ памяти HBM3 с пропускной способностью до 3.35 ТБ/с в версии SXM5, это в полтора раза больше, чем у A100 80GB. Для обучения и инференса больших моделей объём и скорость памяти часто важнее пиковых TFLOPS: если модель не помещается в память одной карты, её приходится резать между GPU, а это потери на коммуникацию. 80 ГБ позволяют держать в одной карте крупные модели и большие батчи. Под совсем тяжёлые задачи существует H100 NVL с 94 ГБ, её тоже поставляем под заказ.
Transformer Engine и FP8
Ключевая фишка Hopper это Transformer Engine, который автоматически переключает вычисления между FP8 и FP16 по слоям сети. FP8 даёт до 3958 TFLOPS на тензорных ядрах и до 9x ускорения обучения трансформеров против A100, при этом точность модели сохраняется за счёт умного масштабирования. Для инференса LLM это означает кратно больше токенов в секунду на ту же карту. Если ваша нагрузка это обучение или прод-инференс GPT-подобных моделей, H100 окупается именно за счёт FP8, а не сырых флопсов.
NVLink и многокарточные сборки
Одна H100 редко решает задачу обучения целиком, нужен пул карт. NVLink 4.0 связывает GPU напрямую на 900 ГБ/с в SXM5-сборках, минуя узкий PCIe, через NVSwitch все 8 карт в платформе HGX H100 видят друг друга на полной скорости. Это критично для распределённого обучения: данные между картами летают без бутылочного горла. Для PCIe-версий есть NVLink-мост на пары карт. Собираем GPU-серверы на 4x H100 PCIe и платформы на 8x H100 SXM5 с нужной сетью InfiniBand или Ethernet 400G под кластер.
Поставка и ввод в работу
После согласования спецификации поставляем карты или собранную GPU-платформу, проверяем каждый ускоритель на стенде под нагрузкой, прогоняем тесты памяти и температур. По запросу ставим драйверы CUDA, NCCL, контейнерную среду и проверяем масштабирование на нескольких картах. Поставка по Алматы и всему Казахстану, для юрлиц и ИП работаем по договору и безналу с ЭСФ. H100 это дефицитный товар с длинным сроком, наличие и срок подтверждаем до оплаты, гарантию оформляем сразу.
Цены и характеристики
| Позиция | Цена | Конфигурация | Под что |
|---|---|---|---|
| H100 80GB PCIe Gen5 | от 14 000 000 ₸/шт | 80 ГБ HBM3, 350 Вт, x16 | инференс, обучение в обычном сервере |
| H100 80GB SXM5 | от 16 500 000 ₸/шт | 80 ГБ HBM3, до 700 Вт, NVLink | плотные сборки HGX, кластер |
| H100 NVL 94GB | от 19 000 000 ₸/шт | 94 ГБ, пара по NVLink | крупные LLM, максимум памяти |
| Сервер 4x H100 PCIe | от 68 000 000 ₸ | 4 GPU, 2x EPYC, NVLink-мосты | рабочая станция обучения |
| Платформа 8x H100 SXM5 | по запросу | HGX, NVSwitch, InfiniBand | узел AI-кластера |
H100 против других ускорителей
| Модель | Память | FP16 TFLOPS | Под что |
|---|---|---|---|
| H100 80GB | 80 ГБ HBM3 | до 1979 | обучение и инференс LLM |
| A100 80GB | 80 ГБ HBM2e | до 624 | обучение, бюджет ниже |
| L40S | 48 ГБ GDDR6 | до 733 | инференс, рендер, графика |
| RTX 6000 Ada | 48 ГБ GDDR6 | до 91 | рабочая станция, CAD, инференс |
Сроки и наличие
| Вариант | Наличие | Срок | Гарантия |
|---|---|---|---|
| Со склада в Алматы | ограниченно | 1-5 дней | от 1 года |
| Поставка под заказ | под заказ | 2-6 недель | гарантия производителя |
| Сборка GPU-сервера | под ТЗ | 2-4 недели | на платформу и карты |
Что вы получаете
Поставка и условия
Поставляем NVIDIA H100 по Алматы со склада и по всему Казахстану под заказ: Астана, Шымкент, Караганда, Актобе, Атырау и другие города. По Алматы возможна доставка и установка карт или GPU-сервера силами наших инженеров, в регионы отправляем транспортными компаниями в защитной упаковке со страховкой груза, ускорители это дорогой и хрупкий товар. Спецификацию и наличие согласуем удалённо, КП на H100 присылаем за 1 рабочий день. Для компаний и ИП работаем по договору поставки и безналу с закрывающими документами и ЭСФ, готовим комплект под тендеры и госзакупки.
Коротко
Нужны NVIDIA H100 под обучение или инференс? Опишите задачу, размер модели и нужное число карт, бесплатно подберём конфигурацию, подтвердим наличие и пришлём КП за 1 рабочий день. Поставка по Алматы и Казахстану, оригинал NVIDIA, гарантия и договор для юрлиц.
Гарантия и документы
Работаем по договору поставки с полным пакетом закрывающих документов для юрлиц и ИП, отгружаем оригинальные видеокарты с гарантией производителя.
- Счёт и счёт-фактура (ЭСФ)
- Договор поставки
- Спецификация и серийные номера
- Накладная и акт приёма-передачи
- Гарантийный талон производителя
- Документы для постановки на учёт
Оборудование соответствует стандартам и техрегламентам:
- ISO 9001 - Менеджмент качества поставщика
- ISO/IEC 27001 - Информационная безопасность
- ТР ТС 004/2011 - Безопасность низковольтного оборудования
- ТР ТС 020/2011 - Электромагнитная совместимость
- ГОСТ 30804.6.2-2013 - Помехоустойчивость технических средств
Ответы на частые вопросы
Цена H100 80GB PCIe начинается от 14 000 000 ₸ за карту, версия SXM5 для плотных сборок стоит от 16 500 000 ₸, а H100 NVL на 94 ГБ от 19 000 000 ₸. Стоимость плавает в зависимости от исполнения, объёма партии и текущего наличия на рынке, H100 это дефицитный товар. Собранный GPU-сервер на 4x H100 PCIe выходит от 68 000 000 ₸ с процессорами, памятью и NVLink-мостами. Точную цену фиксируем в коммерческом предложении после уточнения задачи и формата, и эта цена не меняется при отгрузке.
H100 это следующее поколение после A100 на новой архитектуре Hopper. Главное отличие это Transformer Engine с поддержкой FP8, который даёт до 9 раз быстрее обучение трансформеров и кратно больше токенов в секунду на инференсе. Память тоже быстрее: 80 ГБ HBM3 с полосой до 3.35 ТБ/с против HBM2e и 2 ТБ/с у A100. По сырому FP16 H100 выдаёт до 1979 TFLOPS против 624 у A100. Если задача это обучение и прод-инференс больших языковых моделей, H100 окупается скоростью. A100 берут, когда бюджет важнее и нужна память подешевле.
SXM5 это модуль для платы-носителя HGX с TDP до 700 Вт, полным NVLink на 900 ГБ/с и максимумом производительности, его ставят в плотные сборки на 8 карт в дата-центрах. PCIe-версия это обычная карта в слот Gen5 x16 с TDP 350 Вт и NVLink-мостом на пары карт, она проще в интеграции в стандартные серверы и сборки на 4 GPU. SXM5 быстрее и плотнее, но требует специальной платформы. PCIe гибче и дешевле в интеграции. Если у вас обычный сервер или нужно до 4 карт, берите PCIe, если строите узел кластера на 8 GPU, берите SXM5. Подберём под вашу платформу.
Зависит от размера модели и сроков. Для дообучения и LoRA небольших моделей хватает 1-2 карт по 80 ГБ. Для обучения моделей на десятки миллиардов параметров с нуля считают узлами по 8x H100 SXM5 и собирают кластер из нескольких узлов через InfiniBand. Ключевой ограничитель это память: если модель и батч не влезают в 80 ГБ, нужно больше карт и распределённое обучение. Опишите размер модели, датасет и желаемое время обучения, и мы посчитаем нужное число карт и предложим конфигурацию узла с запасом.
Да, и это одно из главных применений. Благодаря FP8 и Transformer Engine H100 выдаёт кратно больше токенов в секунду на инференсе LLM, чем A100 или потребительские карты. 80 ГБ памяти позволяют держать крупные модели целиком на одной карте без разбиения, а для совсем больших моделей берут пару карт по NVLink или версию NVL на 94 ГБ. Под высоконагруженный прод-инференс собираем серверы на 4 и 8 H100 с балансировкой нагрузки. Если задача это API-сервис на собственной модели, H100 даёт лучшую плотность запросов на карту.
Да, продаём как отдельные карты, так и собранные GPU-серверы. Одну H100 PCIe можно поставить в подходящий сервер с слотом Gen5 x16, достаточным питанием и охлаждением, мы проверим совместимость с вашей платформой по питанию, длине слота и BIOS. Под рабочую станцию для обучения чаще берут сразу 2-4 карты, чтобы был запас памяти и масштабирование по NVLink. SXM5-версию отдельной картой ставить некуда, она требует платы HGX, поэтому её поставляем в составе платформы. Подскажем, что выгоднее под вашу задачу.
H100 PCIe требует сервер с слотами PCIe Gen5 x16, мощным блоком питания (одна карта 350 Вт, плюс процессоры и обвязка) и серьёзным охлаждением, потому что карта пассивная и рассчитана на проток воздуха в стойке. Под 4 карты берут двухпроцессорную платформу на EPYC или Xeon с достаточным числом линий PCIe и резервом питания. SXM5-версия ставится только в готовую платформу HGX H100 на 4 или 8 модулей с NVSwitch. Мы либо подберём и соберём GPU-сервер целиком, либо проверим, подойдёт ли ваш существующий сервер под установку карт.
Поставляем только оригинальные ускорители NVIDIA, без серого, ремаркированного или восстановленного товара. H100 это дата-центровый продукт, реплик у него быть не может, но на рынке встречаются карты сомнительного происхождения и без гарантии, мы с такими не работаем. На каждую карту даём гарантию и по запросу предоставляем серийные номера для проверки и постановки на учёт. Каждый GPU перед отгрузкой проходит тест на стенде: проверяем память, температуры и производительность под нагрузкой, чтобы вы получили рабочую карту, а не кота в мешке.
H100 это дефицитный товар с ограниченным наличием, поэтому сроки зависят от формата и партии. Если нужная версия есть на складе в Алматы, отгружаем за 1-5 рабочих дней. Поставка под заказ обычно занимает от 2 до 6 недель в зависимости от исполнения и объёма. Сборка GPU-сервера на 4 или 8 карт под ваше ТЗ это 2-4 недели с тестом и прогоном. Точный срок и подтверждённое наличие называем до оплаты и фиксируем в договоре, чтобы не было сюрпризов. В регионы добавляется время на доставку, его тоже закладываем заранее.
H100 NVL это специальная версия с увеличенной памятью 94 ГБ HBM3 на карту, которая поставляется парой, соединённой мостом NVLink, что даёт суммарно 188 ГБ на связку. Её создали под инференс и обучение очень крупных языковых моделей, которым не хватает 80 ГБ. По вычислительной части она близка к SXM5, но в формате PCIe-карт с высоким TDP. Если ваша модель упирается именно в объём памяти и не помещается в 80 ГБ без жёсткого разбиения, NVL это правильный выбор. Под обычные задачи переплачивать за лишнюю память смысла нет, хватит стандартной H100 80GB.
Да, с компаниями и ИП работаем по договору поставки и безналичному расчёту с выставлением счёта и счёта-фактуры (ЭСФ). После отгрузки подписываем накладную и акт приёма-передачи. Реквизиты, проект договора и спецификацию по картам или GPU-серверу присылаем заранее, чтобы бухгалтерия и отдел снабжения успели всё провести и согласовать бюджет, а суммы на H100 серьёзные. Поможем с документами для постановки оборудования на учёт. Для тендеров и госзакупок подготовим полный комплект документов и технические характеристики под требования закупки.
Да, по запросу устанавливаем и настраиваем софт: драйверы NVIDIA, CUDA Toolkit, cuDNN, NCCL для многокарточной связи, контейнерную среду с NVIDIA Container Toolkit под Docker. Проверяем масштабирование на нескольких картах, корректную работу NVLink и температурный режим под нагрузкой. По желанию разворачиваем готовую среду для обучения или инференса: PyTorch, vLLM, TensorRT-LLM или ваш стек. Если строим узел кластера, настраиваем сеть InfiniBand и проверяем пропускную способность между узлами. Объём настройки согласуем заранее и включаем в смету, чтобы вы получили готовую к работе систему.
Да, на оригинальные карты NVIDIA действует гарантия производителя, на собранные GPU-серверы мы даём собственную гарантию на платформу и сборку. Дополнительно оформляем сервисное обслуживание: диагностика, замена вышедших из строя компонентов, удалённая поддержка по настройке и драйверам. Для производственных AI-систем предлагаем расширенную поддержку с приоритетным временем реакции, потому что простой кластера стоит дорого. Серийные номера и условия гарантии прописываем в договоре без скрытых оговорок. При сбое поможем оперативно диагностировать проблему и решить вопрос замены или ремонта по гарантии.
Да, если бюджет под H100 не вытягивается, есть варианты под конкретную задачу. Под обучение с меньшими сроками берут A100 80GB, она дешевле и тоже даёт 80 ГБ памяти. Под инференс LLM и генеративную графику отлично подходит L40S с 48 ГБ за заметно меньшие деньги. Под рабочую станцию инженера или дизайнера с задачами AI и рендера берут RTX 6000 Ada на 48 ГБ. Мы не навязываем самую дорогую карту: опишите реальную нагрузку и бюджет, и подберём ускоритель с оптимальным соотношением цены и производительности именно под вашу задачу.
Расчёт видеокарт и GPU
Узнайте цену на видеокарту NVIDIA H100
Оставьте номер - перезвоним в течение 15 минут, уточним задачу, модель и количество, подберём видеокарту под нагрузку и подготовим коммерческое предложение со спецификацией и ценой.
- Подбор модели под вашу задачу
- Оптовые цены и партии под заказ
- Гарантия, безнал и ЭСФ для юрлиц
- Доставка по всему Казахстану
Звоните или пишите
Заказать видеокарту NVIDIA H100
Поставка
Доставляем по Алматы, отправляем партии GPU транспортными компаниями по Казахстану.
г. Алматы и РК