Стартовые цены: все тарифы на 30% дешевле самого дешёвого конкурента. Сравнение ценКаждый тариф на 30% дешевле самого дешёвого офшорного хостера

NVIDIA · CUDA предустановлена · без KYC

Офшорные GPU-серверы.
Приватный ИИ без KYC

Выделенные GPU NVIDIA — от RTX A4000 до 4 × H100 — для инференса LLM, дообучения, генерации изображений и рендеринга. Драйвер и CUDA предустановлены, а ваши промпты никогда не покидают сервер. От $61.99/мес. — на 30% ниже, чем у самого дешёвого офшорного конкурента.

  • Готов через 1–24 часа
  • Выделенные GPU без соседей
  • Промпты остаются на вашем сервере
  • Без KYC, только email

Настройте свой GPU-серверГотов через 1–24 ч

ЮрисдикцияМолдова · Кишинёв

ТарифСравнить тарифы

Период оплаты

$84.99/мес.

Помесячно · отмена в любой момент

Самый дешёвый конкурент $121.50−30%

Без документовBTC, XMR, USDT +2Без платы за установку

01Тарифы и цены

10 GPU-серверов: от RTX A4000 до 4 × H100

Каждый GPU выделен только вам: никакого разделения по времени и никаких спотовых мощностей, которые пропадают посреди задачи.

GPU-серверы: 10 тарифов, цены в USD за месяц
GPU VRAM Процессор ОЗУ (RAM) Диск Локации Цена Заказ
RTX A4000 Инференс начального уровня, модели 7-13B 16 ГБ VRAM8 vCPU64 ГБ ОЗУ1 ТБ NVMeМолдоваНидерландыРумыния 16 ГБ 8 vCPU 64 ГБ 1 ТБ NVMe МолдоваНидерландыРумыния $61.99/мес. Самый дешёвый конкурент $89.00 Развернуть RTX A4000
RTX 5090 Быстрый инференс, изображения и видео 32 ГБ VRAM12 vCPU96 ГБ ОЗУ2 ТБ NVMeМолдоваНидерландыИсландия 32 ГБ 12 vCPU 96 ГБ 2 ТБ NVMe МолдоваНидерландыИсландия $134.99/мес. Самый дешёвый конкурент $193.00 Развернуть RTX 5090
RTX 6000 Ada 48 ГБ, 32B с 8-битной точностью 48 ГБ VRAMEPYC 7302P 16c128 ГБ ОЗУ2 × 1.92 ТБ NVMeМолдоваНидерланды 48 ГБ EPYC 7302P · 16c 128 ГБ 2 × 1.92 ТБ NVMe МолдоваНидерланды $306.99/мес. Самый дешёвый конкурент $439.00 Развернуть RTX 6000 Ada
A100 80 GB Обучение и дообучение 80 ГБ VRAM16 vCPU128 ГБ ОЗУ3.84 ТБ NVMeМолдоваНидерландыИсландия 80 ГБ 16 vCPU 128 ГБ 3.84 ТБ NVMe МолдоваНидерландыИсландия $355.99/мес. Самый дешёвый конкурент $509.00 Развернуть A100 80 GB
L40S Инференс в больших масштабах 48 ГБ VRAMEPYC 7443P 24c256 ГБ ОЗУ2 × 1.92 ТБ NVMeМолдоваНидерланды 48 ГБ EPYC 7443P · 24c 256 ГБ 2 × 1.92 ТБ NVMe МолдоваНидерланды $418.99/мес. Самый дешёвый конкурент $599.00 Развернуть L40S
2 × RTX 5090 64 ГБ VRAM в одном сервере 64 ГБ VRAMEPYC 9354 32c256 ГБ ОЗУ2 × 1.92 ТБ NVMeМолдоваНидерланды 64 ГБ EPYC 9354 · 32c 256 ГБ 2 × 1.92 ТБ NVMe МолдоваНидерланды $558.99/мес. Самый дешёвый конкурент $799.00 Развернуть 2 × RTX 5090
H100 80 GB Обучение передовых моделей, SXM5 80 ГБ VRAM24 vCPU192 ГБ ОЗУ2 ТБ NVMeМолдоваНидерландыИсландия 80 ГБ 24 vCPU 192 ГБ 2 ТБ NVMe МолдоваНидерландыИсландия $581.99/мес. Самый дешёвый конкурент $832.50 Развернуть H100 80 GB
2 × H100 160 ГБ HBM3, NVLink 160 ГБ VRAM48 vCPU384 ГБ ОЗУ4 ТБ NVMeМолдоваНидерланды 160 ГБ 48 vCPU 384 ГБ 4 ТБ NVMe МолдоваНидерланды $1,096.99/мес. Самый дешёвый конкурент $1,567.50 Развернуть 2 × H100
  • RTX 4090, 5090, L40S, A100, H100
  • Драйверы CUDA предустановлены
  • Узлы с одним и несколькими GPU
  • Без KYC · BTC, ETH, XMR, USDT, SOL

Планируете кластер или модель, которой нужно больше 320 ГБ видеопамяти? Клиенты с GPU- и выделенными серверами могут запросить индивидуальную конфигурацию через тикет в личном кабинете.

02Линейки

Три типа GPU-серверов

Потребительские карты RTX выигрывают ценой за токен, GPU для дата-центров — памятью и пропускной способностью, а узлы с несколькими GPU подходят для самых больших моделей.

04Приватный хостинг LLM

Ваши модели, ваши промпты, ваш сервер

Запускайте модели с открытыми весами на оборудовании, к которому больше никто не прикасается. Ни один API-провайдер не видит ваших промптов, а мы не ведём логов вашего трафика и не анализируем его.

Llama, Qwen, Mistral, DeepSeek, Gemma и другие модели с открытыми весами после квантования работают на одном GPU, а самые крупные помещаются на наших узлах с несколькими GPU. Запускайте их через Ollama для быстрого старта, через vLLM — для OpenAI-совместимого эндпоинта под нагрузкой или через llama.cpp — для самых компактных конфигураций.

В таблице указан объём памяти, который нужен модели при каждом уровне точности, с контекстом 8K токенов для одного пользователя и запасом 10%. Для более длинного контекста и большего числа пользователей памяти нужно больше.

  • Общайтесь с приватным ассистентом из браузера через SSH-туннель.
  • Открывайте доступ к API своим приложениям, но никогда — стороннему провайдеру.
  • Дообучайте модели с LoRA на своих данных, которые никогда не покидают сервер.

Настройка Ollama, vLLM или ComfyUI · Сколько видеопамяти нужно LLM?

Примерный объём видеопамяти, который нужен языковой модели с контекстом 8K токенов, и наименьший GPU, на котором она помещается
Размер модели4 бит8 бит16 бит
7–8B~7 ГБ
RTX A4000
~11 ГБ
RTX A4000
~19 ГБ
RTX 4090
13–14B~11 ГБ
RTX A4000
~18 ГБ
RTX 4090
~32 ГБ
RTX 6000 Ada, L40S
32B~24 ГБ
RTX 5090
~40 ГБ
RTX 6000 Ada, L40S
~73 ГБ
A100 или H100
70B~50 ГБ
A100, H100 или 2 × RTX 5090
~85 ГБ
2 × H100
~157 ГБ
4 × H100
123B~86 ГБ
2 × H100
~147 ГБ
2 × H100
~274 ГБ
4 × H100

05Включено

Всё готово для CUDA с первого входа

Проверьте карту, скачайте модель и запускайте инференс.

  • Выделенные GPU

    Каждая карта только ваша: без разделения по времени и без общей памяти.

  • Драйвер и CUDA готовы

    Ubuntu 24.04 с установленными драйвером NVIDIA и CUDA Toolkit.

  • Руководство для любого стека

    Пошаговые инструкции для PyTorch, vLLM, Ollama, ComfyUI и Docker.

  • Диски NVMe

    От 1 до 30 ТБ NVMe для наборов данных, контрольных точек и весов.

  • 1 Гбит/с, безлимитный трафик

    Скачивайте модели и наборы данных, не считая трафик.

  • Никаких логов

    Мы никогда не видим ваши промпты, ответы моделей и обучающие данные и не записываем их в логи.

  • Защита от DDoS

    Публичные эндпоинты остаются доступными во время атак.

  • Полный root-доступ

    Ваши драйверы, ваши модули ядра, ваш стек.

06Сравнение

Все GPU в сравнении

При инференсе пропускная способность памяти определяет число токенов в секунду, а объём видеопамяти — то, какие модели поместятся.

Сравнение офшорных GPU-серверов
ХарактеристикаRTX A4000RTX 4090ПопулярныйRTX 5090RTX 6000 AdaA100 80 GBL40S2 × RTX 5090H100 80 GB2 × H1004 × H100Кластер
GPU1 × RTX A40001 × RTX 50901 × RTX 6000 Ada1 × A1001 × L40S2 × RTX 50901 × H1002 × H100
VRAM16 ГБ32 ГБ48 ГБ80 ГБ48 ГБ64 ГБ80 ГБ160 ГБ
Тип памятиGDDR6 ECCGDDR7GDDR6 ECCHBM2eGDDR6 ECCGDDR7HBM3HBM3
Пропускная способность на GPU448 ГБ/с1 792 ГБ/с960 ГБ/с~2.0 ТБ/с864 ГБ/с1 792 ГБ/с3.35 ТБ/с3.35 ТБ/с
Процессор8 vCPU12 vCPUEPYC 7302P · 16c16 vCPUEPYC 7443P · 24cEPYC 9354 · 32c24 vCPU48 vCPU
Оперативная память64 ГБ96 ГБ128 ГБ128 ГБ256 ГБ256 ГБ192 ГБ384 ГБ
Диск1 ТБ NVMe2 ТБ NVMe2 × 1.92 ТБ NVMe3.84 ТБ NVMe2 × 1.92 ТБ NVMe2 × 1.92 ТБ NVMe2 ТБ NVMe4 ТБ NVMe
ЮрисдикцииМолдова Нидерланды РумынияМолдова Нидерланды ИсландияМолдова НидерландыМолдова Нидерланды ИсландияМолдова НидерландыМолдова НидерландыМолдова Нидерланды ИсландияМолдова Нидерланды
Месяц$61.99$134.99$306.99$355.99$418.99$558.99$581.99$1,096.99
Квартал, цена за месяц$58.89$128.24$291.64$338.19$398.04$531.04$552.89$1,042.14
Год, цена за месяц$54.55$118.79$270.15$313.27$368.71$491.91$512.15$965.35
Самый дешёвый конкурент$89.00$193.00$439.00$509.00$599.00$799.00$832.50$1,567.50
ЗаказРазвернуть RTX A4000Развернуть RTX 5090Развернуть RTX 6000 AdaРазвернуть A100 80 GBРазвернуть L40SРазвернуть 2 × RTX 5090Развернуть H100 80 GBРазвернуть 2 × H100

07Сценарии использования

Что запускают на офшорных GPU

От приватного чат-ассистента до дообучения на собственных данных — на картах, которыми больше никто не пользуется.

  • Инференс LLM

    Приватные чаты и API на моделях с открытыми весами — от 8B до 405B.

    Руководство по видеопамяти
  • Дообучение

    LoRA и QLoRA на ваших данных, которые не покидают сервер.

    A100 и H100
  • Генерация изображений и видео

    Stable Diffusion, Flux и видеомодели в ComfyUI.

    RTX 5090
  • 3D-рендеринг

    Blender Cycles и другие GPU-рендереры — без нагрузки на вашу рабочую станцию.

    Серверы с RTX
  • Синтез речи и транскрибация

    Whisper и модели синтеза речи для аудио, которое должно оставаться конфиденциальным.

    Образы для GPU
  • Исследования и анализ данных

    Эксперименты в Jupyter, PyTorch и CUDA на выделенном оборудовании.

    Сравнить GPU

09Офшор — чёрным по белому

Правила — ещё до оплаты

Всё, что мы обещаем, закреплено в наших политиках, а не только в рекламе.

  • Американские уведомления DMCAНе исполняются

    Мы отвечаем на них со ссылкой на нашу политику, но никогда их не исполняем. Потребовать действий может только решение местного суда или, в локациях в ЕС, действительное уведомление по праву ЕС.

    Политика по DMCA
  • Личные данныеТолько email

    Ни имени, ни адреса, ни телефона, ни документов — никогда. Подойдёт приватный или одноразовый email.

    Политика конфиденциальности
  • Оплата5 криптовалют

    Bitcoin, Ethereum, Monero, USDT и Solana: оплата в блокчейне с любого кошелька на ваш баланс. Без карточного эквайринга и без чарджбэков.

    Оплата криптовалютой
  • ПрозрачностьПодписанная «канарейка»

    Ежеквартальная «канарейка» (warrant canary) с PGP-подписью и публичный подсчёт всех полученных запросов.

    «Канарейка» (warrant canary)

10Вопросы и ответы

GPU-серверы: ответы на вопросы

Остались вопросы? В полном разделе вопросов и ответов — всё, о чём спрашивают перед заказом: оплата, конфиденциальность, жалобы и поддержка.

Все вопросы и ответы
GPU используются совместно или делятся по времени?

Нет. Каждый GPU в вашем тарифе выделен вашему серверу на весь срок аренды. Никто другой не запускает на нём задачи, а его память никогда не используется совместно.

Какой GPU нужен для моей модели?

Отталкивайтесь от объёма памяти, который нужен весам: см. таблицу выше или наше руководство по видеопамяти для LLM. Как правило, модели 70B в 4-битной точности с контекстом 8K нужно около 50 ГБ, то есть A100 или H100 на 80 ГБ либо две RTX 5090.

Драйвер NVIDIA и CUDA установлены?

Да. Образы Ubuntu поставляются с драйвером NVIDIA и CUDA Toolkit. PyTorch, vLLM, Ollama и ComfyUI устанавливаются несколькими командами, как показано в руководстве по образам для GPU.

Можно ли запустить публичный ИИ-сервис?

Да, если он законен в юрисдикции вашего сервера и соответствует нашим правилам допустимого использования. Вы несёте ответственность за всё, что ваш сервис генерирует и выдаёт.

Как быстро выдаётся сервер?

От 1 до 24 часов после заказа, в зависимости от карты. Если GPU временно нет в наличии в выбранной вами юрисдикции, мы сообщим вам об этом и либо придержим заказ, либо вернём оплату на ваш баланс.

Можно ли заниматься майнингом криптовалюты на GPU-сервере?

Да. Майнинг разрешён на GPU- и выделенных серверах, которые предоставляются только вам.

Можно ли вернуть средства?

После выдачи возврат средств за GPU-серверы невозможен, поскольку оборудование резервируется специально для вас. Перед заказом ознакомьтесь с характеристиками и руководством по образам для GPU; средствами на балансе всегда можно оплатить другие услуги.

Ведёте ли вы логи промптов, ответов моделей или наборов данных?

Нет. Мы не ведём логов трафика вашего сервера, не анализируем его и никогда не смотрим, что на сервере запущено.

Собственный GPU вдали от больших облаков

  1. 1Выберите GPU и юрисдикцию
  2. 2Оплата криптовалютой, без документов
  3. 3Вход по SSH через 1–24 часа
Настроить GPU-сервер Какой GPU выбрать для моей модели?

От $61.99/мес. · выделенные карты · CUDA предустановлена

С возвращением

Войдите, чтобы управлять серверами и балансом.

Без KYCПроверка на человека с помощью Cloudflare TurnstileБез отслеживания