Аренда NVIDIA H100 в России: цена, доступность и трезвая альтернатива
H100 — самая мощная и самая дефицитная карта для ИИ на российском рынке. Её ищут, потому что она на слуху, но в половине случаев задача закрывается A100 или парой RTX 4090 за втрое меньшие деньги. Разбираем, сколько стоит H100 в аренду, что с доступностью и как понять, нужна ли она вам.
⚡ Подберём карту под задачуСкажите, какую модель и в каком режиме запускаете — честно скажем, нужна ли вам H100 или хватит A100. Закупаем под договор от 12 месяцев. Серверы с H100 →NVIDIA H100 — это флагман архитектуры Hopper: 80 ГБ памяти HBM3, тензорные ядра четвёртого поколения и поддержка FP8. Карта проектировалась под обучение и высокоскоростной инференс крупнейших языковых моделей. В России её можно арендовать, но рынок узкий, а цена такова, что решение стоит принимать с калькулятором.
Сколько стоит H100 в аренду
По публичным прайсам российских GPU-провайдеров на август 2026 года почасовая аренда H100 стоит порядка 350 ₽ в час и выше. Переведём в месяц по формуле «ставка × 730 часов»:
- 350 ₽/час при круглосуточной работе — около 255 000 ₽ в месяц;
- для сравнения, выделенный сервер с RTX 4090 у нас стоит 44 900 ₽/мес, то есть примерно в пять-шесть раз дешевле.
У нас H100 идёт по схеме закупки под проект: карта приобретается под договор от 12 месяцев и ставится в наш дата-центр. Точную цену называем после того, как поймём конфигурацию — это честнее, чем публиковать цифру, которая устареет к следующей поставке. Подробности — на странице аренды сервера с H100.
Что с доступностью
H100 не лежит на складе в свободном доступе. Практические следствия для заказчика:
- срок поставки измеряется неделями, а не часами — «взять на попробовать» не получится;
- почти все предложения — под долгий контракт, потому что провайдер закупает карту под вас;
- в почасовых облаках H100 часто разобрана, и свободный слот приходится ждать.
Именно поэтому мы не обещаем мгновенный запуск: при договоре от 12 месяцев закупаем нужную карту и через оговорённый срок отдаём готовый сервер.
Когда H100 действительно нужна
Есть сценарии, где заменить её нечем:
- Обучение и полноценный fine-tuning больших моделей. Здесь важны и объём памяти, и скорость межкарточного обмена — на этом H100 отрывается сильнее всего.
- Высоконагруженный инференс моделей 70B и выше, когда нужен низкий отклик при большом числе параллельных запросов.
- Работа в FP8. Поддержка этого формата — архитектурное преимущество Hopper, которого нет у предыдущих поколений.
- Плотность на стойку. Когда критично уместить максимум вычислений в ограниченный объём и энергобюджет.
Когда хватит карты попроще
А вот типичные задачи, где H100 — переплата:
- Инференс моделей до 32B. Одна RTX 4090 с 24 ГБ держит 7–14B в fp16 и до 32B в четырёхбитной квантизации.
- Модели 70B без экстремальных требований к отклику. Смотрите в сторону A100 на 80 ГБ или сборки 2×RTX 4090.
- Stable Diffusion, генерация изображений, рендеринг. Эти задачи упираются в память и пропускную способность, а не в тензорные ядра Hopper.
- LoRA и лёгкое дообучение. Отлично живёт на 4090.
Подробное сравнение по памяти, скорости и цене — в статье A100 vs H100 vs RTX 4090.
Как решить за пять минут
Три вопроса, которые снимают большую часть сомнений:
- Вы обучаете модель или запускаете готовую? Если только инференс — H100 почти наверняка избыточна.
- Сколько параметров у модели и в какой точности вы её держите? Посчитайте требуемуюVRAM: примерно 2 ГБ на миллиард параметров в fp16 и около 0,6 ГБ в 4-битной квантизации, плюс запас на контекст.
- Сколько запросов в секунду нужно держать? Единицы — хватит 4090. Десятки при большом контексте — разговор про A100 и H100.
Что дальше
Если после этих вопросов H100 всё ещё выглядит нужной — напишите нам, посчитаем конфигурацию и сроки. Если сомневаетесь — начните с сервера с RTX 4090: его можно взять сразу, а карту помощнее добавить, когда упрётесь в потолок. Про размещение собственной карты в стойке — GPU в колокейшн.
Частые вопросы
Сколько стоит аренда H100 в России?
По публичным прайсам российских провайдеров на август 2026 года — примерно от 350 ₽ в час, что при круглосуточной работе даёт около 255 000 ₽ в месяц. У нас H100 закупается под проект по договору от 12 месяцев, цена считается под конфигурацию.
Чем H100 лучше A100?
Архитектура Hopper даёт более быстрые тензорные ядра, поддержку формата FP8 и более высокую пропускную способность памяти. Это заметно при обучении и высоконагруженном инференсе, но для многих задач разница не окупает разницу в цене.
Можно ли заменить H100 на RTX 4090?
Для инференса моделей до 32B — да, и это будет в разы дешевле. Для обучения крупных моделей и работы с 70B+ при высокой нагрузке замена неполноценная: не хватит памяти и скорости обмена между картами.
Как быстро можно получить сервер с H100?
Карта закупается под проект, поэтому срок измеряется неделями, а не часами. Точные сроки называем при расчёте — они зависят от поставки.
Сколько видеопамяти нужно под мою модель?
Ориентир: около 2 ГБ на миллиард параметров в fp16 и примерно 0,6 ГБ в 4-битной квантизации, плюс запас на контекст и служебные данные. Модель на 70B в 4-битном виде требует порядка 45–50 ГБ.
Данные остаются в России?
Да. Сервер стоит в собственном дата-центре в Москве, данные не покидают РФ.