
NVIDIA
Офшорные GPU-серверы.
Приватный ИИ без KYC
Выделенные GPU NVIDIA — от
- Готов через 1–24 часа
- Выделенные GPU без соседей
- Промпты остаются на вашем сервере
- Без KYC, только email
01Тарифы и цены
10 GPU-серверов: от RTX A4000 до 4 × H100
Каждый GPU выделен только вам: никакого разделения по времени и никаких спотовых мощностей, которые пропадают посреди задачи.
| GPU | VRAM | Процессор | ОЗУ (RAM) | Диск | Локации | Цена | Заказ |
|---|---|---|---|---|---|---|---|
|
|
16 ГБ | 64 ГБ | 1 ТБ NVMe |
$61.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
24 ГБ | 64 ГБ | 1 ТБ NVMe |
$84.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
32 ГБ | 96 ГБ | 2 ТБ NVMe |
$134.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
48 ГБ | 128 ГБ |
$306.99/мес.
Самый дешёвый конкурент |
Развернуть |
|||
|
|
80 ГБ | 128 ГБ | 3.84 ТБ NVMe |
$355.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
L40S
Инференс в больших масштабах
48 ГБ VRAM |
48 ГБ | 256 ГБ |
$418.99/мес.
Самый дешёвый конкурент |
Развернуть L40S | |||
|
|
64 ГБ | 256 ГБ |
$558.99/мес.
Самый дешёвый конкурент |
Развернуть |
|||
|
|
80 ГБ | 192 ГБ | 2 ТБ NVMe |
$581.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
160 ГБ | 384 ГБ | 4 ТБ NVMe |
$1,096.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
320 ГБ | 768 ГБ | 30 ТБ NVMe |
$2,348.99/мес.
Самый дешёвый конкурент |
Развернуть |
В этой юрисдикции пока нет GPU-серверов: или сравнить их.
RTX 4090 , 5090, L40S, A100, H100- Драйверы CUDA предустановлены
- Узлы с одним и несколькими GPU
- Без KYC
· BTC, ETH, XMR, USDT, SOL
Планируете кластер или модель, которой нужно больше 320 ГБ видеопамяти? Клиенты с GPU- и выделенными серверами могут запросить индивидуальную конфигурацию через тикет в личном кабинете.
02Линейки
Три типа GPU-серверов
Потребительские карты RTX выигрывают ценой за токен, GPU для дата-центров — памятью и пропускной способностью, а узлы с несколькими GPU подходят для самых больших моделей.
- От
RTX A4000 до 6000 AdaОт 16 до 64 ГБ видеопамяти. Максимум инференса на каждый доллар — для моделей от 7B до 70B и генерации изображений.От $61.99/мес.Смотреть серверы - A100, L40S и H100Память HBM или ECC и пропускная способность до 3.35 ТБ/с — для обучения и инференса в больших масштабах.От $355.99/мес.Смотреть серверы
- Узлы с несколькими GPUДва или четыре GPU в одном сервере, до 320 ГБ видеопамяти, на H100 — с NVLink.От $558.99/мес.Смотреть серверы
- Индивидуальная конфигурацияУже арендуете у нас GPU- или выделенный сервер? Запросите через тикет другой GPU, больше памяти или дискового пространства либо конкретную юрисдикцию — мы ответим и назовём цену.Как работает поддержка
03По моделям
Арендуйте конкретный GPU
Четыре самые востребованные карты: для каждой — характеристики, что помещается в её память и цена за час использования.
RTX 4090 , 24 ГБВыгодная карта для приватных чат-ассистентов и генерации изображений.$84.99/мес.Серверы сRTX 4090 RTX 5090 , 32 ГБBlackwell и GDDR7: более быстрая генерация токенов, более длинный контекст или две карты для 70B.$134.99/мес.Серверы сRTX 5090 - A100, 80 ГБ80 ГБ HBM2e на одной карте — для дообучения и больших моделей.$355.99/мес.Серверы с A100
- H100, 80 ГБHBM3 с пропускной способностью 3.35 ТБ/с и FP8 — одна карта или до четырёх с NVLink.$581.99/мес.Серверы с H100
04Приватный хостинг LLM
Ваши модели, ваши промпты, ваш сервер
Запускайте модели с открытыми весами на оборудовании, к которому больше никто не прикасается. Ни один API-провайдер не видит ваших промптов, а мы не ведём логов вашего трафика и не анализируем его.
Llama, Qwen, Mistral, DeepSeek, Gemma и другие модели с открытыми весами после квантования работают на одном GPU, а самые крупные помещаются на наших узлах с несколькими GPU. Запускайте их через Ollama для быстрого старта, через vLLM — для OpenAI-совместимого эндпоинта под нагрузкой или через llama.cpp — для самых компактных конфигураций.
В таблице указан объём памяти, который нужен модели при каждом уровне точности, с контекстом 8K токенов для одного пользователя и запасом 10%. Для более длинного контекста и большего числа пользователей памяти нужно больше.
- Общайтесь с приватным ассистентом из браузера через SSH-туннель.
- Открывайте доступ к API своим приложениям, но никогда — стороннему провайдеру.
- Дообучайте модели с LoRA на своих данных, которые никогда не покидают сервер.
Настройка Ollama, vLLM или ComfyUI · Сколько видеопамяти нужно LLM?
| Размер модели | 4 бит | 8 бит | 16 бит |
|---|---|---|---|
| 7–8B | ~7 ГБ | ~11 ГБ | ~19 ГБ |
| 13–14B | ~11 ГБ | ~18 ГБ | ~32 ГБ |
| 32B | ~24 ГБ | ~40 ГБ | ~73 ГБ A100 или H100 |
| 70B | ~50 ГБ A100, H100 или | ~85 ГБ | ~157 ГБ |
| 123B | ~86 ГБ | ~147 ГБ | ~274 ГБ |
05Включено
Всё готово для CUDA с первого входа
Проверьте карту, скачайте модель и запускайте инференс.
Выделенные GPU
Каждая карта только ваша: без разделения по времени и без общей памяти.
Драйвер и CUDA готовы
Ubuntu 24.04 с установленными драйвером NVIDIA и CUDA Toolkit.Руководство для любого стека
Пошаговые инструкции для PyTorch, vLLM, Ollama, ComfyUI и Docker.
Диски NVMe
От 1 до 30 ТБ NVMe для наборов данных, контрольных точек и весов.
1 Гбит/с, безлимитный трафик
Скачивайте модели и наборы данных, не считая трафик.
Никаких логов
Мы никогда не видим ваши промпты, ответы моделей и обучающие данные и не записываем их в логи.
Защита от DDoS
Публичные эндпоинты остаются доступными во время атак.
Полный root-доступ
Ваши драйверы, ваши модули ядра, ваш стек.
06Сравнение
Все GPU в сравнении
При инференсе пропускная способность памяти определяет число токенов в секунду, а объём видеопамяти — то, какие модели поместятся.
| Характеристика | L40S | |||||||||
|---|---|---|---|---|---|---|---|---|---|---|
| GPU | ||||||||||
| VRAM | 16 ГБ | 24 ГБ | 32 ГБ | 48 ГБ | 80 ГБ | 48 ГБ | 64 ГБ | 80 ГБ | 160 ГБ | 320 ГБ |
| Тип памяти | GDDR6 ECC | GDDR6X | GDDR7 | GDDR6 ECC | HBM2e | GDDR6 ECC | GDDR7 | HBM3 | HBM3 | HBM3 |
| Пропускная способность на GPU | 448 ГБ/с | 1 008 ГБ/с | 1 792 ГБ/с | 960 ГБ/с | ~2.0 ТБ/с | 864 ГБ/с | 1 792 ГБ/с | 3.35 ТБ/с | 3.35 ТБ/с | 3.35 ТБ/с |
| Процессор | ||||||||||
| Оперативная память | 64 ГБ | 64 ГБ | 96 ГБ | 128 ГБ | 128 ГБ | 256 ГБ | 256 ГБ | 192 ГБ | 384 ГБ | 768 ГБ |
| Диск | 1 ТБ NVMe | 1 ТБ NVMe | 2 ТБ NVMe | 3.84 ТБ NVMe | 2 ТБ NVMe | 4 ТБ NVMe | 30 ТБ NVMe | |||
| Юрисдикции | ||||||||||
| Месяц | $61.99 | $84.99 | $134.99 | $306.99 | $355.99 | $418.99 | $558.99 | $581.99 | $1,096.99 | $2,348.99 |
| Квартал, цена за месяц | $58.89 | $80.74 | $128.24 | $291.64 | $338.19 | $398.04 | $531.04 | $552.89 | $1,042.14 | $2,231.54 |
| Год, цена за месяц | $54.55 | $74.79 | $118.79 | $270.15 | $313.27 | $368.71 | $491.91 | $512.15 | $965.35 | $2,067.11 |
| Самый дешёвый конкурент | ||||||||||
| Заказ | Развернуть | Развернуть | Развернуть | Развернуть | Развернуть | Развернуть L40S | Развернуть | Развернуть | Развернуть | Развернуть |
07Сценарии использования
Что запускают на офшорных GPU
От приватного чат-ассистента до дообучения на собственных данных — на картах, которыми больше никто не пользуется.
Инференс LLM
Приватные чаты и API на моделях с открытыми весами — от 8B до 405B.
Дообучение
LoRA и QLoRA на ваших данных, которые не покидают сервер.
Генерация изображений и видео
Stable Diffusion, Flux и видеомодели в ComfyUI.
3D-рендеринг
Blender Cycles и другие GPU-рендереры — без нагрузки на вашу рабочую станцию.
Синтез речи и транскрибация
Whisper и модели синтеза речи для аудио, которое должно оставаться конфиденциальным.
Исследования и анализ данных
Эксперименты в Jupyter, PyTorch и CUDA на выделенном оборудовании.
08Юрисдикции
Четыре юрисдикции для GPU
Наличие зависит от карты: в таблице тарифов показано, где есть каждая из них.
-
МолдоваКишинёвОптимальный выбор Вне ЕС
· без DSA Лондон~33 мсНью-Йорк~113 мсСингапур~129 мс -
НидерландыАмстердамСетевой хаб Член ЕС
· действует DSA Лондон~7 мсНью-Йорк~87 мсСингапур~154 мс -
ИсландияРейкьявикОплот свободы слова ЕЭЗ
· вне ЕС· без DSA Лондон~29 мсНью-Йорк~63 мсСингапур~169 мс -
РумынияБухарестБюджетный вариант в ЕС Член ЕС
· действует DSA Лондон~32 мсНью-Йорк~113 мсСингапур~131 мс
Значения задержки — оценка по расстоянию, а не результаты измерений. Цены во всех юрисдикциях одинаковы. Как мы оцениваем задержку
09Офшор — чёрным по белому
Правила — ещё до оплаты
Всё, что мы обещаем, закреплено в наших политиках, а не только в рекламе.
Американские уведомления DMCAНе исполняются
Мы отвечаем на них со ссылкой на нашу политику, но никогда их не исполняем. Потребовать действий может только решение местного суда или, в локациях в ЕС, действительное уведомление по праву ЕС.
Политика по DMCAЛичные данныеТолько email
Ни имени, ни адреса, ни телефона, ни документов — никогда. Подойдёт приватный или одноразовый email.
Политика конфиденциальностиОплата5 криптовалют
Bitcoin, Ethereum, Monero, USDT и Solana: оплата в блокчейне с любого кошелька на ваш баланс. Без карточного эквайринга и без чарджбэков.
Оплата криптовалютойПрозрачностьПодписанная «канарейка»
Ежеквартальная «канарейка» (warrant canary) с PGP-подписью и публичный подсчёт всех полученных запросов.
«Канарейка» (warrant canary)
10Вопросы и ответы
GPU-серверы: ответы на вопросы
Остались вопросы? В полном разделе вопросов и ответов — всё, о чём спрашивают перед заказом: оплата, конфиденциальность, жалобы и поддержка.
Все вопросы и ответыGPU используются совместно или делятся по времени?
Нет. Каждый GPU в вашем тарифе выделен вашему серверу на весь срок аренды. Никто другой не запускает на нём задачи, а его память никогда не используется совместно.
Какой GPU нужен для моей модели?
Отталкивайтесь от объёма памяти, который нужен весам: см. таблицу выше или наше руководство по видеопамяти для LLM. Как правило, модели 70B в 4-битной точности с контекстом 8K нужно около 50 ГБ, то есть A100 или H100 на 80 ГБ либо две
Драйвер NVIDIA и CUDA установлены?
Да. Образы Ubuntu поставляются с драйвером NVIDIA и CUDA Toolkit. PyTorch, vLLM, Ollama и ComfyUI устанавливаются несколькими командами, как показано в руководстве по образам для GPU.
Можно ли запустить публичный ИИ-сервис?
Да, если он законен в юрисдикции вашего сервера и соответствует нашим правилам допустимого использования. Вы несёте ответственность за всё, что ваш сервис генерирует и выдаёт.
Как быстро выдаётся сервер?
От 1 до 24 часов после заказа, в зависимости от карты. Если GPU временно нет в наличии в выбранной вами юрисдикции, мы сообщим вам об этом и либо придержим заказ, либо вернём оплату на ваш баланс.
Можно ли заниматься майнингом криптовалюты на GPU-сервере?
Да. Майнинг разрешён на GPU- и выделенных серверах, которые предоставляются только вам.
Можно ли вернуть средства?
После выдачи возврат средств за GPU-серверы невозможен, поскольку оборудование резервируется специально для вас. Перед заказом ознакомьтесь с характеристиками и руководством по образам для GPU; средствами на балансе всегда можно оплатить другие услуги.
Ведёте ли вы логи промптов, ответов моделей или наборов данных?
Нет. Мы не ведём логов трафика вашего сервера, не анализируем его и никогда не смотрим, что на сервере запущено.
Собственный GPU вдали от больших облаков
- 1Выберите GPU и юрисдикцию
- 2Оплата криптовалютой, без документов
- 3Вход по SSH через 1–24 часа
От $61.99/мес.