3 октября 2026 г. · Редакция Тераферма
Облачные GPU в России в 2026: как выбрать сервис и на что смотреть
Облачные GPU в России в 2026 году можно арендовать у трёх типов сервисов: крупных облачных провайдеров, специализированных GPU-хостингов и маркетплейсов видеокарт. Главные критерии выбора — нужная карта с достаточной видеопамятью, поминутная тарификация, оплата российской картой и прозрачная цена в рублях. В Тераферме, например, RTX 4090 стоит 44 ₽/час, A100 — 102 ₽/час, H100 — 255 ₽/час.
Разберём, как устроен рынок облачных видеокарт в России, чем отличаются типы сервисов и по каким критериям выбирать, чтобы не переплатить.
Что изменилось на рынке к 2026 году
Спрос на видеокарты для нейросетей за последние годы вырос в разы. Открытые модели вроде Llama, Qwen, DeepSeek, Flux стали достаточно хорошими, чтобы компании и частные разработчики запускали их у себя, а не только через платные API. Для этого нужны GPU.
Для российских пользователей рынок сложился по-своему:
- зарубежные GPU-облака и маркетплейсы (Vast.ai, RunPod и другие) продолжают работать, но не принимают российские карты, а оплата через посредников и криптовалюту добавляет комиссии и риски;
- российские облачные провайдеры предлагают GPU-серверы, но чаще с упором на корпоративных клиентов, серверные карты и почасовую или помесячную оплату;
- специализированные российские сервисы и маркетплейсы (например, immers.cloud, Qudata, Тераферма) закрывают запрос на гибкую аренду с оплатой в рублях;
- потребительские карты RTX 3090, 4090 и 5090 стали полноценным инструментом для ИИ: для генерации изображений и инференса моделей до 30B они часто выгоднее серверных.
Ещё одна заметная перемена — сами пользователи. Если несколько лет назад облачные GPU арендовали в основном исследователи и крупные компании, то сейчас среди клиентов много дизайнеров, авторов контента, студентов и небольших команд разработчиков. Им нужна карта на несколько часов, понятная цена в рублях и запуск без договоров и согласований.
В итоге у пользователя из России есть выбор, но сервисы сильно различаются по ценам, набору карт и удобству. Поэтому важно понимать, на что смотреть.
Три типа сервисов облачных GPU
| Тип | Как устроен | Плюсы | Минусы |
|---|---|---|---|
| Крупное облако | GPU как часть большой облачной платформы | экосистема сервисов, корпоративные договоры | высокая цена часа, мало потребительских карт, сложный вход |
| GPU-хостинг | провайдер ставит собственные серверы с картами | стабильные конфигурации, выделенные серверы | ограниченный выбор карт, часто помесячная оплата |
| Маркетплейс GPU | карты разных владельцев на одной площадке | широкий выбор, низкие цены, быстрый старт | нужно смотреть на характеристики конкретного сервера |
Крупные облака хороши, когда GPU — лишь часть большой инфраструктуры: базы данных, Kubernetes, хранилища, корпоративная безопасность. Для частного разработчика или небольшой команды, которой нужна видеокарта на несколько часов, это обычно дорого и избыточно.
GPU-хостинги подходят для постоянной нагрузки: сервер работает 24/7, конфигурация не меняется месяцами.
Маркетплейсы — самый гибкий вариант. Владельцы видеокарт подключают их к площадке, а площадка берёт на себя подключение, оплату и контроль. Благодаря этому на маркетплейсе можно найти и RTX 3060 за 10 ₽/час, и H100, и B200. Тераферма работает именно по этой модели: подробнее — на странице облачного GPU.
Восемь критериев выбора облачной GPU
1. Нужная карта и объём видеопамяти
Начинайте с задачи, а не с сервиса. Сколько видеопамяти нужно модели? Для SDXL — 12–16 ГБ, для Llama 8B — 24 ГБ, для 70B в 4 битах — 48–80 ГБ. Если в сервисе нет подходящей карты по разумной цене, остальное неважно. Сравнение популярных карт — в статье H100 vs A100 vs RTX 4090.
2. Модель тарификации
Поминутная оплата выгоднее почасовой, особенно для коротких задач. При почасовом округлении 10 минут теста стоят как час. Помесячная оплата оправдана только при загрузке 24/7.
3. Способ оплаты
Для российских пользователей это часто решающий критерий. Оплата картой РФ в рублях убирает валютные комиссии, посредников и риски блокировки. Подробнее — в статье аренда GPU с оплатой картой РФ.
4. Итоговая цена в рублях
Сравнивайте не цену часа в долларах, а итоговую стоимость в рублях со всеми комиссиями. Карта за 0,4 $ в час на зарубежном сервисе после конвертации и наценки посредника может выйти дороже, чем за 44 ₽ в российском.
5. Конфигурация сервера
ОЗУ, процессор, диск и скорость сети. Видеокарта на 24 ГБ с 16 ГБ оперативной памяти и медленным диском будет работать хуже, чем должна. Подробно о выборе конфигурации — в статье аренда сервера с видеокартой для ИИ.
6. Хранение данных
Сохраняется ли диск при остановке сервера? Сколько стоит хранение? Модели и датасеты весят десятки гигабайт, и скачивать их заново при каждом запуске — потеря времени и денег.
7. Скорость старта
Сколько времени проходит от решения арендовать до работающего сервера: минуты или дни? Нужно ли подписывать договор, ждать одобрения заявки, оплачивать минимальный период?
8. Доступ и удобство
SSH для скриптов, Jupyter для экспериментов, возможность ставить свои пакеты и Docker-контейнеры. Поддержка на русском языке, которая отвечает, когда что-то пошло не так.
Сколько стоят облачные GPU в России
Цены у разных сервисов различаются заметно, поэтому приведём тарифы Тераферма как ориентир. Актуальные цены — на странице цен.
| Видеокарта | Память | Цена, ₽/час | Для каких задач |
|---|---|---|---|
| RTX 3060 | 12 ГБ | 10 | обучение, тесты, SD 1.5 |
| RTX 4060 Ti | 16 ГБ | 15 | SDXL, небольшие LLM |
| RTX 3090 | 24 ГБ | 22 | LLM до 8B, LoRA, SDXL |
| RTX 4090 | 24 ГБ | 44 | ComfyUI, Flux, быстрый инференс |
| RTX 5090 | 32 ГБ | 70 | Flux FP16, LLM до 30B |
| RTX A6000 | 48 ГБ | 60 | 70B в 4 битах, видео |
| L40S | 48 ГБ | 102 | инференс, генерация |
| A100 80GB | 80 ГБ | 102 | обучение, крупные модели |
| H100 | 80 ГБ | 255 | обучение LLM, высоконагруженный API |
| H200 | 141 ГБ | 534 | модели 70B+ без нарезки |
| B200 | 192 ГБ | 884 | обучение и инференс самых больших моделей |
Для ориентира: рыночная цена RTX 4090 на зарубежных маркетплейсах в октябре 2026 — около 0,3–0,5 $ в час, A100 80GB — около 0,4–0,8 $, H100 — около 1,6–2,7 $. При пересчёте в рубли с учётом комиссий за оплату из России тарифы российских сервисов с оплатой картой РФ обычно оказываются сопоставимыми или ниже.
Данные и безопасность в облачной GPU
Вопрос «а что будет с моими данными» в облаке задают чаще всего, и правильно делают. Несколько практических правил, которые работают в любом сервисе.
Видеокарта должна быть выделенной. Пока ваш сервер запущен, карта не должна делиться с другими пользователями. В Тераферме это так: вся видеопамять и все ядра работают только на вашу задачу.
Не открывайте сервисы в интернет без защиты. Jupyter, ComfyUI, API модели — у многих из них нет встроенной авторизации. Пробрасывайте порты через SSH-туннель или ставьте перед сервисом прокси с паролем и HTTPS.
Ключи вместо паролей. Подключайтесь по SSH-ключу, а токены Hugging Face и других сервисов храните в переменных окружения, а не в коде, который может попасть в публичный репозиторий.
Удаляйте лишнее после работы. Если данные чувствительные, удаляйте их с сервера после завершения задачи и не оставляйте копии на постоянном диске дольше, чем нужно.
Открытые модели вместо внешних API. Один из главных плюсов собственной модели на арендованной GPU — данные не уходят в сторонний сервис. Документы, переписка и код обрабатываются на сервере, который вы контролируете, и удаляются вместе с ним.
Для компаний с повышенными требованиями к хранению данных стоит заранее уточнить у сервиса, где физически находятся серверы и какие документы он может предоставить.
Типичные ошибки при выборе
Выбирать по бренду, а не по задаче. Крупное облако с известным именем не всегда лучший выбор для генерации картинок на RTX 4090 по вечерам.
Сравнивать цену часа без учёта комиссий. Доллары, конвертация, посредники — итоговая сумма может отличаться от указанной на 10–30%.
Брать помесячный тариф «на всякий случай». При загрузке ниже 60–80% почасовая аренда почти всегда дешевле. Расчёт — в статье почасовая аренда или выделенный сервер.
Не тестировать перед долгой задачей. Пробный запуск на 15 минут обходится в десятки рублей и показывает реальную скорость.
Гнаться за самой новой картой. B200 и H200 нужны для моделей на сотни миллиардов параметров. Для дообучения 8B или генерации в Flux они не дадут выигрыша, сопоставимого с ценой, а RTX 4090 или A100 решат задачу в разы дешевле.
Забывать про стоимость простоя. Сервер, который остался включённым на ночь, стоит денег, даже если ничего не делает. Поминутная оплата спасает только тогда, когда сервер вовремя останавливают.
Итог: как выбрать облачную GPU в 2026
Рынок облачных GPU в России в 2026 году даёт выбор, но сервисы сильно различаются. Чтобы не переплатить:
- определите, сколько видеопамяти нужно вашей задаче;
- выбирайте сервис с поминутной тарификацией;
- платите в рублях картой РФ, без посредников;
- сравнивайте итоговую цену задачи, а не цену часа;
- проверяйте конфигурацию сервера и условия хранения данных.
Тераферма закрывает все эти пункты: российский маркетплейс видеокарт от RTX 3060 за 10 ₽/час до B200 за 884 ₽/час, поминутная оплата картой российского банка, запуск за несколько минут и доступ по SSH или Jupyter. Выберите карту под свою задачу и проверьте её в работе уже сегодня.