Стартовые цены: все тарифы на 30% дешевле самого дешёвого конкурента. Сравнение ценКаждый тариф на 30% дешевле самого дешёвого офшорного хостера

2 × RTX 5090 · 2 × H100 · 4 × H100

Серверы с несколькими GPU.
До 320 ГБ видеопамяти

Два или четыре GPU в одном сервере — для моделей, которые не помещаются на одну карту: 2 × RTX 5090 с 64 ГБ или 2 × и 4 × H100 с NVLink и до 320 ГБ HBM3. От $558.99/мес., без KYC.

  • От 64 до 320 ГБ видеопамяти
  • NVLink на узлах с H100
  • До 30 ТБ NVMe
  • Готов через 1–24 часа

Настройте свой сервер с несколькими GPUГотов через 1–24 ч

ЮрисдикцияМолдова · Кишинёв

ТарифСравнить тарифы

Период оплаты

$1,096.99/мес.

Помесячно · отмена в любой момент

Самый дешёвый конкурент $1 567,50−30%

Без документовBTC, XMR, USDT +2Без платы за установку

01Тарифы и цены

Три сервера с несколькими GPU

Все GPU в сервере выделены только вам, плюс большие NVMe-массивы для весов и наборов данных.

GPU-серверы: 3 тарифа, цены в USD за месяц
GPU VRAM Процессор ОЗУ (RAM) Диск Локации Цена Заказ
2 × RTX 5090 64 ГБ VRAM в одном сервере 64 ГБ VRAMEPYC 9354 32c256 ГБ ОЗУ2 × 1.92 ТБ NVMeМолдоваНидерланды 64 ГБ EPYC 9354 · 32c 256 ГБ 2 × 1.92 ТБ NVMe МолдоваНидерланды $558.99/мес. Самый дешёвый конкурент $799.00 Развернуть 2 × RTX 5090
2 × H100 160 ГБ HBM3, NVLink 160 ГБ VRAM48 vCPU384 ГБ ОЗУ4 ТБ NVMeМолдоваНидерланды 160 ГБ 48 vCPU 384 ГБ 4 ТБ NVMe МолдоваНидерланды $1,096.99/мес. Самый дешёвый конкурент $1,567.50 Развернуть 2 × H100
  • RTX 4090, 5090, L40S, A100, H100
  • Драйверы CUDA предустановлены
  • Узлы с одним и несколькими GPU
  • Без KYC · BTC, ETH, XMR, USDT, SOL

02Подбор

Что помещается в одном узле

Плотные модели с контекстом 8K токенов и запасом 10%, распределённые между GPU с помощью vLLM или llama.cpp. Для более длинного контекста памяти нужно больше.

Что помещается в одном узле
СерверВсего видеопамятиКрупнейшая модель при 4-битной точностиПри 16-битной точностиСвязь между GPU
2 × RTX 509064 ГБ70B14BPCIe
2 × H100160 ГБ123B32B (70B в 8-битной точности)NVLink
4 × H100320 ГБ405B123BNVLink

Моделям со смесью экспертов (MoE), например gpt-oss-120b, нужно меньше вычислений на токен, но все их веса всё равно должны находиться в памяти.

03Как это работает

Одна модель, несколько GPU

Почему связь между GPU важна не меньше, чем сами GPU.

Фреймворки для инференса распределяют модель между GPU двумя способами. Тензорный параллелизм делит каждый слой между картами и требует быстрой связи между ними; конвейерный параллелизм, или параллелизм по слоям, отдаёт каждой карте блок слоёв и допускает более медленную связь.

Поэтому связь и важна. В наших серверах с H100 карты обмениваются данными через NVLink, так что тензорный параллелизм хорошо масштабируется и для инференса, и для обучения. Две карты RTX 5090 связаны через PCIe: это отличный вариант для инференса модели, разделённой надвое, но для обучения возможности более ограничены.

После выдачи сервера выполните nvidia-smi topo -m, чтобы увидеть топологию, а затем задайте в vLLM параметр --tensor-parallel-size равным числу GPU. Полные команды — в руководстве по образам для GPU.

Серверы с несколькими GPU: память и пропускная способность
СерверОЗУ (RAM)Пропускная способность на GPU
2 × RTX 50902 × 32 ГБ GDDR71 792 ГБ/с
2 × H1002 × 80 ГБ HBM33.35 ТБ/с
4 × H1004 × 80 ГБ HBM33.35 ТБ/с

04Сценарии использования

Когда одного GPU мало

Модели и задачи, которым нужна память или производительность нескольких GPU в одном сервере.

  • Модели от 70B до 405B

    Запускайте крупнейшие модели с открытыми весами приватно, распределяя их между несколькими GPU.

    4 × H100
  • Распределённое обучение

    Обучение с параллелизмом по данным и тензорным параллелизмом через NVLink.

    2 × H100
  • Параллельные задачи

    По одной модели на GPU: несколько экспериментов или пользователей одновременно.

    2 × RTX 5090
  • Высоконагруженный инференс

    Множество одновременных пользователей на одном эндпоинте благодаря пакетной обработке запросов.

    Руководство по vLLM

06Офшор — чёрным по белому

Правила — ещё до оплаты

Всё, что мы обещаем, закреплено в наших политиках, а не только в рекламе.

  • Американские уведомления DMCAНе исполняются

    Мы отвечаем на них со ссылкой на нашу политику, но никогда их не исполняем. Потребовать действий может только решение местного суда или, в локациях в ЕС, действительное уведомление по праву ЕС.

    Политика по DMCA
  • Личные данныеТолько email

    Ни имени, ни адреса, ни телефона, ни документов — никогда. Подойдёт приватный или одноразовый email.

    Политика конфиденциальности
  • Оплата5 криптовалют

    Bitcoin, Ethereum, Monero, USDT и Solana: оплата в блокчейне с любого кошелька на ваш баланс. Без карточного эквайринга и без чарджбэков.

    Оплата криптовалютой
  • ПрозрачностьПодписанная «канарейка»

    Ежеквартальная «канарейка» (warrant canary) с PGP-подписью и публичный подсчёт всех полученных запросов.

    «Канарейка» (warrant canary)

07Вопросы и ответы

Серверы с несколькими GPU: ответы на вопросы

Остались вопросы? В полном разделе вопросов и ответов — всё, о чём спрашивают перед заказом: оплата, конфиденциальность, жалобы и поддержка.

Все вопросы и ответы
Можно ли использовать GPU по отдельности?

Да. Система видит каждый GPU отдельно: запускайте по одной модели на карту с помощью CUDA_VISIBLE_DEVICES или распределите одну модель по всем картам.

Есть ли NVLink в каждом сервере с несколькими GPU?

В серверах 2 × и 4 × H100 — да. RTX 5090 не поддерживает NVLink, поэтому в сервере 2 × RTX 5090 карты соединены через PCIe.

Можно ли получить восемь GPU или несколько узлов?

Да, в виде индивидуальной конфигурации. После выдачи вашего первого сервера опишите нужный кластер в тикете из личного кабинета, и мы назовём цену.

Как быстро выдаётся сервер?

От 1 до 24 часов после заказа. Узлы с несколькими GPU зависят от наличия: если в выбранной вами юрисдикции такого узла нет, мы сообщим вам об этом и либо придержим заказ, либо вернём оплату на ваш баланс.

Можно ли вернуть средства?

После выдачи возврат средств за GPU-серверы невозможен, поскольку оборудование резервируется специально для вас.

Крупнейшие открытые модели на вашем собственном узле

  1. 1Выберите 2 или 4 GPU
  2. 2Оплата криптовалютой, без документов
  3. 3Вход по SSH через 1–24 часа
Настроить сервер Все GPU-серверы

От $558.99/мес. · выделенные GPU · NVLink на H100

С возвращением

Войдите, чтобы управлять серверами и балансом.

Без KYCПроверка на человека с помощью Cloudflare TurnstileБез отслеживания