GPU и AI

Аренда NVIDIA H100 в России: цена, доступность и трезвая альтернатива

H100 — самая мощная и самая дефицитная карта для ИИ на российском рынке. Её ищут, потому что она на слуху, но в половине случаев задача закрывается A100 или парой RTX 4090 за втрое меньшие деньги. Разбираем, сколько стоит H100 в аренду, что с доступностью и как понять, нужна ли она вам.

Подберём карту под задачуСкажите, какую модель и в каком режиме запускаете — честно скажем, нужна ли вам H100 или хватит A100. Закупаем под договор от 12 месяцев. Серверы с H100 →

NVIDIA H100 — это флагман архитектуры Hopper: 80 ГБ памяти HBM3, тензорные ядра четвёртого поколения и поддержка FP8. Карта проектировалась под обучение и высокоскоростной инференс крупнейших языковых моделей. В России её можно арендовать, но рынок узкий, а цена такова, что решение стоит принимать с калькулятором.

Сколько стоит H100 в аренду

По публичным прайсам российских GPU-провайдеров на август 2026 года почасовая аренда H100 стоит порядка 350 ₽ в час и выше. Переведём в месяц по формуле «ставка × 730 часов»:

  • 350 ₽/час при круглосуточной работе — около 255 000 ₽ в месяц;
  • для сравнения, выделенный сервер с RTX 4090 у нас стоит 44 900 ₽/мес, то есть примерно в пять-шесть раз дешевле.

У нас H100 идёт по схеме закупки под проект: карта приобретается под договор от 12 месяцев и ставится в наш дата-центр. Точную цену называем после того, как поймём конфигурацию — это честнее, чем публиковать цифру, которая устареет к следующей поставке. Подробности — на странице аренды сервера с H100.

Что с доступностью

H100 не лежит на складе в свободном доступе. Практические следствия для заказчика:

  • срок поставки измеряется неделями, а не часами — «взять на попробовать» не получится;
  • почти все предложения — под долгий контракт, потому что провайдер закупает карту под вас;
  • в почасовых облаках H100 часто разобрана, и свободный слот приходится ждать.

Именно поэтому мы не обещаем мгновенный запуск: при договоре от 12 месяцев закупаем нужную карту и через оговорённый срок отдаём готовый сервер.

Когда H100 действительно нужна

Есть сценарии, где заменить её нечем:

  • Обучение и полноценный fine-tuning больших моделей. Здесь важны и объём памяти, и скорость межкарточного обмена — на этом H100 отрывается сильнее всего.
  • Высоконагруженный инференс моделей 70B и выше, когда нужен низкий отклик при большом числе параллельных запросов.
  • Работа в FP8. Поддержка этого формата — архитектурное преимущество Hopper, которого нет у предыдущих поколений.
  • Плотность на стойку. Когда критично уместить максимум вычислений в ограниченный объём и энергобюджет.

Когда хватит карты попроще

Аренда GPU-сервера — Пришлите название модели — проверим, на каком GPU запустится и сколько стоит.
Проверить GPU →

А вот типичные задачи, где H100 — переплата:

  • Инференс моделей до 32B. Одна RTX 4090 с 24 ГБ держит 7–14B в fp16 и до 32B в четырёхбитной квантизации.
  • Модели 70B без экстремальных требований к отклику. Смотрите в сторону A100 на 80 ГБ или сборки 2×RTX 4090.
  • Stable Diffusion, генерация изображений, рендеринг. Эти задачи упираются в память и пропускную способность, а не в тензорные ядра Hopper.
  • LoRA и лёгкое дообучение. Отлично живёт на 4090.

Подробное сравнение по памяти, скорости и цене — в статье A100 vs H100 vs RTX 4090.

Как решить за пять минут

Три вопроса, которые снимают большую часть сомнений:

  1. Вы обучаете модель или запускаете готовую? Если только инференс — H100 почти наверняка избыточна.
  2. Сколько параметров у модели и в какой точности вы её держите? Посчитайте требуемуюVRAM: примерно 2 ГБ на миллиард параметров в fp16 и около 0,6 ГБ в 4-битной квантизации, плюс запас на контекст.
  3. Сколько запросов в секунду нужно держать? Единицы — хватит 4090. Десятки при большом контексте — разговор про A100 и H100.

Что дальше

Если после этих вопросов H100 всё ещё выглядит нужной — напишите нам, посчитаем конфигурацию и сроки. Если сомневаетесь — начните с сервера с RTX 4090: его можно взять сразу, а карту помощнее добавить, когда упрётесь в потолок. Про размещение собственной карты в стойке — GPU в колокейшн.

Частые вопросы

Сколько стоит аренда H100 в России?

По публичным прайсам российских провайдеров на август 2026 года — примерно от 350 ₽ в час, что при круглосуточной работе даёт около 255 000 ₽ в месяц. У нас H100 закупается под проект по договору от 12 месяцев, цена считается под конфигурацию.

Чем H100 лучше A100?

Архитектура Hopper даёт более быстрые тензорные ядра, поддержку формата FP8 и более высокую пропускную способность памяти. Это заметно при обучении и высоконагруженном инференсе, но для многих задач разница не окупает разницу в цене.

Можно ли заменить H100 на RTX 4090?

Для инференса моделей до 32B — да, и это будет в разы дешевле. Для обучения крупных моделей и работы с 70B+ при высокой нагрузке замена неполноценная: не хватит памяти и скорости обмена между картами.

Как быстро можно получить сервер с H100?

Карта закупается под проект, поэтому срок измеряется неделями, а не часами. Точные сроки называем при расчёте — они зависят от поставки.

Сколько видеопамяти нужно под мою модель?

Ориентир: около 2 ГБ на миллиард параметров в fp16 и примерно 0,6 ГБ в 4-битной квантизации, плюс запас на контекст и служебные данные. Модель на 70B в 4-битном виде требует порядка 45–50 ГБ.

Данные остаются в России?

Да. Сервер стоит в собственном дата-центре в Москве, данные не покидают РФ.

Читайте также

Проверить GPU →
Позвонить Оставить заявку