3 октября 2026 г. · Редакция Тераферма
RTX 5090 для ИИ: стоит ли арендовать и в каких задачах она выгоднее 4090
RTX 5090 — самая мощная потребительская видеокарта NVIDIA: 32 ГБ памяти GDDR7 с пропускной способностью около 1,8 ТБ/с. На Тераферме она стоит 70 ₽ в час. Арендовать её имеет смысл, когда задача не помещается в 24 ГБ RTX 4090 или когда важна скорость генерации токенов, а платить за A100 не хочется.
Разберём, где RTX 5090 действительно выигрывает, а где переплата не оправдана.
Что изменилось по сравнению с RTX 4090
С точки зрения ИИ у RTX 5090 три важных отличия от предшественницы.
Больше памяти: 32 ГБ вместо 24 ГБ. Плюс 8 ГБ — это граница, которая решает, влезет ли модель 32B с нормальным контекстом, получится ли обучить LoRA для Flux без ухищрений и сколько изображений поместится в батч.
Намного быстрее память. Шина 512 бит и GDDR7 дают около 1,8 ТБ/с против примерно 1 ТБ/с у RTX 4090. Для инференса языковых моделей это ключевой параметр: генерация каждого токена упирается в то, как быстро карта читает веса из памяти.
Новые тензорные ядра с поддержкой FP4. Архитектура Blackwell умеет считать в 4-битных форматах аппаратно. Поддержка в фреймворках ещё развивается, но там, где она есть, инференс квантованных моделей ускоряется заметно.
Обратная сторона — энергопотребление до 575 Вт. Дома это требует мощного блока питания и хорошего охлаждения. В аренде эта проблема ложится на владельца машины, а не на вас.
Сравнение с другими картами в аренде
| Видеокарта | VRAM | Пропускная способность памяти | Цена, ₽/час | ₽ за 1 ГБ VRAM в час |
|---|---|---|---|---|
| RTX 3090 | 24 ГБ | ~0,94 ТБ/с | 22 | 0,92 |
| RTX 4090 | 24 ГБ | ~1,0 ТБ/с | 44 | 1,83 |
| RTX 5090 | 32 ГБ | ~1,8 ТБ/с | 70 | 2,19 |
| RTX A6000 | 48 ГБ | ~0,77 ТБ/с | 60 | 1,25 |
| A100 80 ГБ | 80 ГБ | ~1,9–2,0 ТБ/с | 102 | 1,28 |
Из таблицы видно, что RTX 5090 — не самый дешёвый способ получить память. Если нужен просто объём, RTX A6000 и A100 выгоднее в пересчёте на гигабайт. Сильная сторона 5090 — сочетание скорости памяти и вычислительной мощности в одной карте по цене ниже A100.
Цены на все конфигурации собраны на странице цен.
Где RTX 5090 выгоднее всего
Инференс LLM до 32B
Модели класса 30–32B в 4-битном квантовании занимают около 18–20 ГБ. В RTX 4090 они помещаются, но на длинный контекст остаётся мало места. В RTX 5090 остаётся около 12 ГБ под KV-кэш, этого хватает на десятки тысяч токенов контекста.
Плюс скорость. Генерация токенов в однопользовательском режиме почти линейно зависит от пропускной способности памяти. Поэтому прирост к RTX 4090 здесь больше, чем в обучении: по открытым тестам он часто превышает 50%.
Внутренний ассистент для небольшой команды
Частый сценарий: компания хочет свой чат-ассистент на открытой модели, чтобы документы не уходили во внешние сервисы. Модель 14B в 8 битах или 32B в 4 битах на RTX 5090, запущенная через сервер инференса вроде vLLM, обслуживает несколько одновременных запросов. Для команды из 5–15 человек, которые пользуются ассистентом в рабочее время, этого обычно хватает.
Арифметика такая: 10 рабочих часов в день по 70 ₽ — около 700 ₽ в день, или примерно 15 400 ₽ за 22 рабочих дня. Это дешевле, чем покупать собственный сервер, и при этом не нужно держать машину включённой ночью и в выходные.
Генерация изображений и видео
Flux в полной точности, видеомодели, апскейл в высоком разрешении. Здесь 32 ГБ снимают постоянную борьбу с нехваткой памяти, а вычислительная мощность сокращает время на кадр. Если вы генерируете серию роликов или сотни изображений для проекта, 5090 экономит часы.
Дообучение моделей 7–14B
LoRA и QLoRA для моделей 7–14B на RTX 5090 идут с запасом, можно увеличить батч и длину последовательности. Для полной донастройки 7B памяти уже не хватит: тут нужны A100 или H100.
Рендеринг
В Blender Cycles и других GPU-рендерах RTX 5090 быстрее 4090, а 32 ГБ позволяют держать в памяти тяжёлые сцены с большими текстурами. Подробности — в статье про аренду GPU для рендеринга в Blender.
Цена за результат на типовых задачах
Сравнивать карты по цене часа неправильно: важно, сколько стоит готовый результат. Ниже ориентировочный расчёт для трёх задач. Время указано условно, исходя из типичного соотношения скоростей, на ваших данных оно может отличаться.
| Задача | RTX 4090: время и цена | RTX 5090: время и цена | Что выгоднее |
|---|---|---|---|
| 1 000 картинок SDXL | ~2 ч, ~88 ₽ | ~1,5 ч, ~105 ₽ | 4090 дешевле, 5090 быстрее |
| LoRA для Flux | ~3 ч, ~132 ₽ (с ухищрениями по памяти) | ~2 ч, ~140 ₽ | Почти вровень, на 5090 проще |
| Генерация 1 млн токенов моделью 32B | ~6 ч, ~264 ₽ | ~4 ч, ~280 ₽ | Вровень, на 5090 длиннее контекст |
Картина типичная. По деньгам RTX 5090 обычно выходит близко к RTX 4090, иногда чуть дороже. Платите вы за время и за отсутствие компромиссов по памяти. Если задача горит или вы сидите и ждёте результат, 5090 оправдана. Если запускаете на ночь, разница в рублях может оказаться в пользу 4090 или даже 3090.
Когда RTX 5090 брать не стоит
Модель 70B. Даже в 4 битах ей нужно 40–45 ГБ. В одну RTX 5090 она не влезет. Берите RTX A6000 за 60 ₽ в час (дешевле 5090) или A100.
Задачи до 16 ГБ. Stable Diffusion 1.5, небольшие LLM, распознавание речи. Здесь RTX 3090 за 22 ₽ или RTX 4060 Ti за 15 ₽ сделают то же самое втрое дешевле, а разница во времени не окупит переплату.
Долгое обучение больших моделей. Если обучение идёт сутками и нужна связка из нескольких карт с быстрой межкарточной связью, лучше сразу брать A100 или H100. Потребительские карты не поддерживают NVLink, и масштабирование на несколько штук у них хуже.
Мультикарточные конфигурации. Если одной карты мало, две RTX 5090 дадут 64 ГБ, но модель придётся делить между картами по шине PCIe. Для инференса это рабочий вариант, для обучения больших моделей связка из двух A100 обычно эффективнее.
Отладка. Пока код падает на первой эпохе, нет смысла платить 70 ₽ в час. Отладьте на дешёвой карте, потом переходите на 5090.
Как выбрать карту под объём модели, подробно разобрано в статье сколько видеопамяти нужно для LLM.
Аренда или покупка: считаем
По рыночным ценам на октябрь 2026 года RTX 5090 в российской рознице стоит порядка 300 тысяч рублей и выше в зависимости от исполнения. К этому добавьте блок питания на 1 000–1 200 Вт, корпус с хорошим охлаждением и электричество.
Сколько часов аренды можно купить на эти деньги:
| Сценарий использования | Часов в месяц | Расход на аренду в месяц | Срок, за который аренда «съест» 300 тыс. ₽ |
|---|---|---|---|
| 2 часа в день | ~60 | ~4 200 ₽ | ~6 лет |
| 4 часа в день | ~120 | ~8 400 ₽ | ~3 года |
| 8 часов в день | ~240 | ~16 800 ₽ | ~1,5 года |
| Круглосуточно | 720 | ~50 400 ₽ | ~6 месяцев |
Вывод простой. Если карта нужна несколько часов в день или эпизодически, аренда выгоднее. Если она должна работать почти круглосуточно больше года, покупка начинает окупаться.
Есть и промежуточный вариант. Если вы всё-таки купили RTX 5090, её можно сдавать в аренду на Тераферме в те часы, когда она вам не нужна. Владелец получает 43,1 ₽ за каждый час аренды, это заметно сокращает срок окупаемости. Подробнее — на странице сдать RTX 5090.
Как запустить RTX 5090 на Тераферме
- Зарегистрируйтесь и пополните баланс картой российского банка.
- Откройте страницу аренды RTX 5090 и выберите свободную машину.
- Выберите шаблон: PyTorch с актуальной CUDA, Jupyter или окружение для генерации изображений.
- Подключитесь по SSH или через браузер.
- После работы выгрузите результаты и остановите машину: списание поминутное и прекращается сразу.
Перед долгим запуском сделайте короткий замер. Запустите задачу на 5–10 минут, посмотрите в nvidia-smi загрузку GPU и использование памяти, засеките скорость: картинок в минуту, токенов в секунду или шагов обучения. Если загрузка карты ниже 70–80%, узкое место где-то ещё, например в подготовке данных на процессоре, и мощная видеокарта будет простаивать за ваши деньги. Такой замер на RTX 5090 стоит меньше 12 ₽ и сразу показывает, нужна ли вам именно эта карта.
Учтите технический нюанс. Архитектура Blackwell требует свежих версий драйвера, CUDA и PyTorch. Старые контейнеры, собранные под RTX 30-й и 40-й серии, могут не запуститься или работать без ускорения. Готовые шаблоны Тераферма уже собраны под новые карты, поэтому начинать лучше с них.
Итог
RTX 5090 стоит брать в аренду, когда 24 ГБ уже тесно, а 80 ГБ ещё не нужны. Её сильные стороны — инференс моделей до 32B с длинным контекстом, тяжёлая генерация изображений и видео, быстрый рендер. Для маленьких задач она избыточна, для 70B и масштабного обучения — недостаточна.
Час работы стоит 70 ₽, оплата поминутная, картой РФ. Попробуйте на своей задаче и сравните с RTX 4090: на реальных данных разница видна за первые полчаса.