
Серверы с несколькими GPU.
До 320 ГБ видеопамяти
Два или четыре GPU в одном сервере — для моделей, которые не помещаются на одну карту:
- От 64 до 320 ГБ видеопамяти
- NVLink на узлах с H100
- До 30 ТБ NVMe
- Готов через 1–24 часа
01Тарифы и цены
Три сервера с несколькими GPU
Все GPU в сервере выделены только вам, плюс большие NVMe-массивы для весов и наборов данных.
| GPU | VRAM | Процессор | ОЗУ (RAM) | Диск | Локации | Цена | Заказ |
|---|---|---|---|---|---|---|---|
|
|
64 ГБ | 256 ГБ |
$558.99/мес.
Самый дешёвый конкурент |
Развернуть |
|||
|
|
160 ГБ | 384 ГБ | 4 ТБ NVMe |
$1,096.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
320 ГБ | 768 ГБ | 30 ТБ NVMe |
$2,348.99/мес.
Самый дешёвый конкурент |
Развернуть |
В этой юрисдикции пока нет GPU-серверов: или сравнить их.
RTX 4090 , 5090, L40S, A100, H100- Драйверы CUDA предустановлены
- Узлы с одним и несколькими GPU
- Без KYC
· BTC, ETH, XMR, USDT, SOL
02Подбор
Что помещается в одном узле
Плотные модели с контекстом 8K токенов и запасом 10%, распределённые между GPU с помощью vLLM или llama.cpp. Для более длинного контекста памяти нужно больше.
| Сервер | Всего видеопамяти | Крупнейшая модель при 4-битной точности | При 16-битной точности | Связь между GPU |
|---|---|---|---|---|
| 64 ГБ | 70B | 14B | PCIe | |
| 160 ГБ | 123B | 32B (70B в 8-битной точности) | NVLink | |
| 320 ГБ | 405B | 123B | NVLink |
Моделям со смесью экспертов (MoE), например
03Как это работает
Одна модель, несколько GPU
Почему связь между GPU важна не меньше, чем сами GPU.
Фреймворки для инференса распределяют модель между GPU двумя способами. Тензорный параллелизм делит каждый слой между картами и требует быстрой связи между ними; конвейерный параллелизм, или параллелизм по слоям, отдаёт каждой карте блок слоёв и допускает более медленную связь.
Поэтому связь и важна. В наших серверах с H100 карты обмениваются данными через NVLink, так что тензорный параллелизм хорошо масштабируется и для инференса, и для обучения. Две карты
После выдачи сервера выполните nvidia-smi topo -m--tensor-parallel-size
| Сервер | ОЗУ (RAM) | Пропускная способность на GPU |
|---|---|---|
| 1 792 ГБ/с | ||
| 3.35 ТБ/с | ||
| 3.35 ТБ/с |
04Сценарии использования
Когда одного GPU мало
Модели и задачи, которым нужна память или производительность нескольких GPU в одном сервере.
Модели от 70B до 405B
Запускайте крупнейшие модели с открытыми весами приватно, распределяя их между несколькими GPU.
Распределённое обучение
Обучение с параллелизмом по данным и тензорным параллелизмом через NVLink.
Параллельные задачи
По одной модели на GPU: несколько экспериментов или пользователей одновременно.
Высоконагруженный инференс
Множество одновременных пользователей на одном эндпоинте благодаря пакетной обработке запросов.
05Юрисдикции
Где доступны серверы с несколькими GPU
Наши узлы с несколькими GPU размещены в Молдове и Нидерландах.
-
МолдоваКишинёвОптимальный выбор Вне ЕС
· без DSA Лондон~33 мсНью-Йорк~113 мсСингапур~129 мс -
НидерландыАмстердамСетевой хаб Член ЕС
· действует DSA Лондон~7 мсНью-Йорк~87 мсСингапур~154 мс - Сравнить все семь Статус в ЕС, основания для удаления контента и задержка — в одной таблице. Открыть сравнение
Значения задержки — оценка по расстоянию, а не результаты измерений. Цены во всех юрисдикциях одинаковы. Как мы оцениваем задержку
06Офшор — чёрным по белому
Правила — ещё до оплаты
Всё, что мы обещаем, закреплено в наших политиках, а не только в рекламе.
Американские уведомления DMCAНе исполняются
Мы отвечаем на них со ссылкой на нашу политику, но никогда их не исполняем. Потребовать действий может только решение местного суда или, в локациях в ЕС, действительное уведомление по праву ЕС.
Политика по DMCAЛичные данныеТолько email
Ни имени, ни адреса, ни телефона, ни документов — никогда. Подойдёт приватный или одноразовый email.
Политика конфиденциальностиОплата5 криптовалют
Bitcoin, Ethereum, Monero, USDT и Solana: оплата в блокчейне с любого кошелька на ваш баланс. Без карточного эквайринга и без чарджбэков.
Оплата криптовалютойПрозрачностьПодписанная «канарейка»
Ежеквартальная «канарейка» (warrant canary) с PGP-подписью и публичный подсчёт всех полученных запросов.
«Канарейка» (warrant canary)
07Вопросы и ответы
Серверы с несколькими GPU: ответы на вопросы
Остались вопросы? В полном разделе вопросов и ответов — всё, о чём спрашивают перед заказом: оплата, конфиденциальность, жалобы и поддержка.
Все вопросы и ответыМожно ли использовать GPU по отдельности?
Да. Система видит каждый GPU отдельно: запускайте по одной модели на карту с помощью CUDA_VISIBLE_DEVICES
Есть ли NVLink в каждом сервере с несколькими GPU?
В серверах
Можно ли получить восемь GPU или несколько узлов?
Да, в виде индивидуальной конфигурации. После выдачи вашего первого сервера опишите нужный кластер в тикете из личного кабинета, и мы назовём цену.
Как быстро выдаётся сервер?
От 1 до 24 часов после заказа. Узлы с несколькими GPU зависят от наличия: если в выбранной вами юрисдикции такого узла нет, мы сообщим вам об этом и либо придержим заказ, либо вернём оплату на ваш баланс.
Можно ли вернуть средства?
После выдачи возврат средств за GPU-серверы невозможен, поскольку оборудование резервируется специально для вас.
Крупнейшие открытые модели на вашем собственном узле
- 1Выберите 2 или
4 GPU - 2Оплата криптовалютой, без документов
- 3Вход по SSH через 1–24 часа