Стартовые цены: все тарифы на 30% дешевле самого дешёвого конкурента. Сравнение ценКаждый тариф на 30% дешевле самого дешёвого офшорного хостера

RTX A4000 · 4090 · 5090 · 6000 Ada

Серверы с RTX 4090 и 5090.
Лучшая цена за токен

Карты RTX дают максимум скорости инференса на каждый доллар: 24 ГБ у 4090, 32 ГБ GDDR7 у 5090 и 48 ГБ у RTX 6000 Ada. Выделенные карты, предустановленные драйвер и CUDA, оплата криптовалютой. От $61.99/мес.

  • От 16 до 64 ГБ видеопамяти
  • До 1.8 ТБ/с на карту
  • Приватный инференс
  • Готов через 1–24 часа

Настройте свой сервер с RTXГотов через 1–24 ч

ЮрисдикцияМолдова · Кишинёв

ТарифСравнить тарифы

Период оплаты

$84.99/мес.

Помесячно · отмена в любой момент

Самый дешёвый конкурент $121.50−30%

Без документовBTC, XMR, USDT +2Без платы за установку

01Тарифы и цены

Пять серверов с RTX, от 16 до 64 ГБ видеопамяти

Каждая карта выделена только вам. У каждого сервера — NVMe-хранилище и порт 1 Гбит/с с безлимитным трафиком.

GPU-серверы: 5 тарифов, цены в USD за месяц
GPU VRAM Процессор ОЗУ (RAM) Диск Локации Цена Заказ
RTX A4000 Инференс начального уровня, модели 7-13B 16 ГБ VRAM8 vCPU64 ГБ ОЗУ1 ТБ NVMeМолдоваНидерландыРумыния 16 ГБ 8 vCPU 64 ГБ 1 ТБ NVMe МолдоваНидерландыРумыния $61.99/мес. Самый дешёвый конкурент $89.00 Развернуть RTX A4000
RTX 5090 Быстрый инференс, изображения и видео 32 ГБ VRAM12 vCPU96 ГБ ОЗУ2 ТБ NVMeМолдоваНидерландыИсландия 32 ГБ 12 vCPU 96 ГБ 2 ТБ NVMe МолдоваНидерландыИсландия $134.99/мес. Самый дешёвый конкурент $193.00 Развернуть RTX 5090
RTX 6000 Ada 48 ГБ, 32B с 8-битной точностью 48 ГБ VRAMEPYC 7302P 16c128 ГБ ОЗУ2 × 1.92 ТБ NVMeМолдоваНидерланды 48 ГБ EPYC 7302P · 16c 128 ГБ 2 × 1.92 ТБ NVMe МолдоваНидерланды $306.99/мес. Самый дешёвый конкурент $439.00 Развернуть RTX 6000 Ada
2 × RTX 5090 64 ГБ VRAM в одном сервере 64 ГБ VRAMEPYC 9354 32c256 ГБ ОЗУ2 × 1.92 ТБ NVMeМолдоваНидерланды 64 ГБ EPYC 9354 · 32c 256 ГБ 2 × 1.92 ТБ NVMe МолдоваНидерланды $558.99/мес. Самый дешёвый конкурент $799.00 Развернуть 2 × RTX 5090
  • RTX 4090, 5090, L40S, A100, H100
  • Драйверы CUDA предустановлены
  • Узлы с одним и несколькими GPU
  • Без KYC · BTC, ETH, XMR, USDT, SOL

Нужны память HBM или NVLink? Смотрите A100, L40S и H100.

02Выбор

RTX 4090 или RTX 5090?

4090 — выгодный выбор. У 5090 на 8 ГБ больше памяти и примерно на 78% выше пропускная способность памяти, что заметно по числу токенов в секунду.

RTX 4090 Выгодный

24 ГБ GDDR6X

Пропускная способность памяти
1 008 ГБ/с
Помещается при 16-битной точности
Примерно до 8B
Помещается при 8-битной точности
Примерно до 14B
Модели генерации изображений
SDXL и Flux
Подходит для
Чат-ассистенты, генерация изображений

RTX 5090

32 ГБ GDDR7

Пропускная способность памяти
1 792 ГБ/с
Помещается при 4-битной точности
Примерно до 32B
Помещается при 8-битной точности
14B с длинным контекстом
Модели генерации изображений
Flux, видеомодели
Подходит для
Быстрее генерация, длиннее контекст

03Подбор

Что помещается на каждой карте

Объём памяти, который нужен плотной модели с контекстом 8K токенов и запасом 10%. Для более длинного контекста памяти нужно больше.

Что помещается на каждой карте
Размер модели4 бит8 бит16 бит
7–8B~7 ГБ
RTX A4000
~11 ГБ
RTX A4000
~19 ГБ
RTX 4090
13–14B~11 ГБ
RTX A4000
~18 ГБ
RTX 4090
~32 ГБ
RTX 6000 Ada, L40S
32B~24 ГБ
RTX 5090
~40 ГБ
RTX 6000 Ada, L40S
~73 ГБ
A100 или H100
70B~50 ГБ
A100, H100 или 2 × RTX 5090
~85 ГБ
2 × H100
~157 ГБ
4 × H100

Модели 70B в 4-битной точности нужно около 50 ГБ: 2 × RTX 5090 (64 ГБ) или A100 либо H100 на 80 ГБ. Полное руководство: сколько видеопамяти нужно LLM?

04Сценарии использования

Для чего лучше всего подходят серверы с RTX

Потребительские карты и карты для рабочих станций лучше всего проявляют себя, когда модель помещается в 24–64 ГБ видеопамяти.

  • Приватные чат-ассистенты

    Модели от 8B до 32B с интерфейсом Open WebUI — для вас или вашей команды.

    Руководство по Ollama
  • Генерация изображений

    Рабочие процессы Stable Diffusion и Flux в ComfyUI.

    RTX 5090
  • Видео и 3D

    Видеомодели и рендеринг в Blender Cycles на карте, которую вы ни с кем не делите.

    2 × RTX 5090
  • Ассистенты для программирования

    Модели для кода на собственном сервере, которые отвечают с опорой на ваши репозитории.

    Руководство по vLLM

06Офшор — чёрным по белому

Правила — ещё до оплаты

Всё, что мы обещаем, закреплено в наших политиках, а не только в рекламе.

  • Американские уведомления DMCAНе исполняются

    Мы отвечаем на них со ссылкой на нашу политику, но никогда их не исполняем. Потребовать действий может только решение местного суда или, в локациях в ЕС, действительное уведомление по праву ЕС.

    Политика по DMCA
  • Личные данныеТолько email

    Ни имени, ни адреса, ни телефона, ни документов — никогда. Подойдёт приватный или одноразовый email.

    Политика конфиденциальности
  • Оплата5 криптовалют

    Bitcoin, Ethereum, Monero, USDT и Solana: оплата в блокчейне с любого кошелька на ваш баланс. Без карточного эквайринга и без чарджбэков.

    Оплата криптовалютой
  • ПрозрачностьПодписанная «канарейка»

    Ежеквартальная «канарейка» (warrant canary) с PGP-подписью и публичный подсчёт всех полученных запросов.

    «Канарейка» (warrant canary)

07Вопросы и ответы

Серверы с RTX: ответы на вопросы

Остались вопросы? В полном разделе вопросов и ответов — всё, о чём спрашивают перед заказом: оплата, конфиденциальность, жалобы и поддержка.

Все вопросы и ответы
Почему RTX, а не A100 или H100?

Для инференса моделей, которые помещаются в 24–48 ГБ, карты RTX дают больше токенов на доллар. GPU для дата-центров оправданы, когда нужны 80 ГБ на одной карте, пропускная способность HBM для обучения или NVLink между GPU.

Могут ли две RTX 5090 работать с одной моделью?

Да. vLLM и llama.cpp распределяют модель между обеими картами (тензорный параллелизм или параллелизм по слоям), и вы получаете 64 ГБ для модели 70B в 4-битной точности. Карты обмениваются данными через PCIe, а не через NVLink, поэтому для инференса масштабирование хорошее, а для обучения — более ограниченное.

Стоит ли брать RTX 6000 Ada?

Да, если вам нужны 48 ГБ памяти с ECC на одной карте: на ней работают модели 32B в 8-битной точности и модели 14B в полной точности без разделения между GPU. Модели 70B в 4-битной точности нужно около 50 ГБ, так что рассчитывайте на две карты или 80 ГБ. Для моделей поменьше RTX 5090 быстрее и дешевле.

Драйвер и CUDA установлены?

Да, в образе Ubuntu 24.04. Для RTX 5090 нужна сборка PyTorch под свежую версию CUDA; точные команды — в руководстве по образам для GPU.

Можно ли вернуть средства?

После выдачи возврат средств за GPU-серверы невозможен, поскольку оборудование резервируется специально для вас. Перед заказом ознакомьтесь с характеристиками и руководством по образам для GPU.

Максимум скорости на каждый доллар — в офшорных юрисдикциях

  1. 1Выберите карту и юрисдикцию
  2. 2Оплата криптовалютой, без документов
  3. 3Вход по SSH через 1–24 часа
Настроить сервер с RTX Все GPU-серверы

От $61.99/мес. · выделенные карты · CUDA предустановлена

С возвращением

Войдите, чтобы управлять серверами и балансом.

Без KYCПроверка на человека с помощью Cloudflare TurnstileБез отслеживания