Аренда L40S — от 102 ₽/час
Аренда NVIDIA L40S на Тераферме стоит от 102 ₽ в час. Это серверная карта на архитектуре Ada Lovelace (2023) с 48 ГБ памяти GDDR6: серверная Ada для инференса и генерации изображений с 48 ГБ памяти. Оплата поминутная, картой российского банка, без абонентской платы.
Для каких задач подходит L40S
Инференс LLM
В 48 ГБ помещается модель примерно до 20 млрд параметров в FP16 и до 68 млрд в 4-битной квантизации — например, Llama 3.3 70B и Qwen 2.5 72B. Пропускная способность памяти 864 ГБ/с определяет скорость генерации токенов.
Генерация изображений
Подходит для Flux.1 [dev] в полной точности, SDXL с ControlNet и обучение LoRA без компромиссов.
Обучение и дообучение
Полноценное обучение и полное дообучение моделей; FP16/BF16 Tensor ≈ 362 TFLOPS.
Стоимость аренды L40S
| Период | Стоимость |
|---|---|
| 1 час | 102 ₽ |
| Сутки (24 часа) | 2 448 ₽ |
| Неделя | 17 136 ₽ |
| Месяц (720 часов) | 73 440 ₽ |
Цены обновлены 03.10.2026. Цена на 20% ниже, чем у крупнейшего российского агрегатора GPU.
L40S и похожие видеокарты
Как арендовать L40S
- Зарегистрируйтесь и пополните баланс картой РФ — от 300 ₽.
- Выберите L40S в каталоге и шаблон: PyTorch, ComfyUI, vLLM или свой Docker-образ.
- Через 1–2 минуты получите SSH и Jupyter. Остановите машину, когда закончите, — списание прекратится.
Вопросы об аренде L40S
Сколько стоит аренда L40S?
От 102 ₽ в час. Списание поминутное: 15 минут работы стоят четверть часа. Цены обновлены 03.10.2026.
Какую нейросеть можно запустить на L40S?
В 48 ГБ помещается LLM примерно до 20 млрд параметров в FP16 или до 68 млрд в 4 битах — например, Llama 3.3 70B и Qwen 2.5 72B.
Как получить доступ к арендованной L40S?
После запуска вы получаете SSH-доступ и Jupyter. Можно выбрать готовый шаблон с PyTorch, ComfyUI или vLLM либо свой Docker-образ.
Можно ли оплатить картой российского банка?
Да. Пополнение баланса картой РФ, списания поминутно. Для юрлиц — оплата по счёту.
Чем L40S лучше соседних моделей?
A100 стоит столько же, памяти на 32 ГБ больше, FP16 ≈ 312 TFLOPS против 362. RTX 5090 дешевле на 31%, памяти на 16 ГБ меньше, FP16 ≈ 210 TFLOPS против 362. L40 дешевле на 32%, памяти столько же, FP16 ≈ 181 TFLOPS против 362.
Что будет с данными после окончания аренды?
Контейнер и диск удаляются после завершения аренды. Важные результаты сохраняйте в своё хранилище до остановки.