---
title: "Серверы с несколькими GPU: 2× RTX 5090, 2× и 4× H100"
description: "Две или четыре выделенные видеокарты в одном офшорном сервере: 2 × RTX 5090 или 2 × и 4 × H100 с NVLink и до 320 ГБ видеопамяти. Без KYC."
url: https://offshoreserv.com/ru/offshore-gpu-servers/multi-gpu
lang: ru
updated: 2026-09-27
source: HTML page at the url above (canonical); this is its Markdown version
---

2 × RTX 5090 · 2 × H100 · 4 × H100

# Серверы с несколькими GPU. До 320 ГБ видеопамяти

Два или четыре GPU в одном сервере — для моделей, которые не помещаются на одну карту: 2 × RTX 5090 с 64 ГБ или 2 × и 4 × H100 с NVLink и до 320 ГБ HBM3. **От $558.99/мес., без KYC.**

- От 64 до 320 ГБ видеопамяти
- NVLink на узлах с H100
- До 30 ТБ NVMe
- Готов через 1–24 часа

## Три сервера с несколькими GPU

Все GPU в сервере выделены только вам, плюс большие NVMe-массивы для весов и наборов данных.

| GPU | VRAM | Процессор | ОЗУ (RAM) | Диск | Цена |
| --- | --- | --- | --- | --- | --- |
| **2 × RTX 5090** (64 ГБ VRAM в одном сервере) | 64 ГБ | EPYC 9354 · 32c | 256 ГБ | 2 × 1.92 ТБ NVMe | **$558.99**/мес. |
| **2 × H100** (160 ГБ HBM3, NVLink) | 160 ГБ | 48 vCPU | 384 ГБ | 4 ТБ NVMe | **$1,096.99**/мес. |
| **4 × H100** (320 ГБ HBM3, NVLink), Кластер | 320 ГБ | 96 vCPU | 768 ГБ | 30 ТБ NVMe | **$2,348.99**/мес. |

## Что помещается в одном узле

Плотные модели с контекстом 8K токенов и запасом 10%, распределённые между GPU с помощью vLLM или llama.cpp. Для более длинного контекста памяти нужно больше.

| Сервер | Всего видеопамяти | Крупнейшая модель при 4-битной точности | При 16-битной точности | Связь между GPU |
| --- | --- | --- | --- | --- |
| 2 × RTX 5090 | 64 ГБ | 70B | 14B | PCIe |
| 2 × H100 | 160 ГБ | 123B | 32B (70B в 8-битной точности) | NVLink |
| 4 × H100 | 320 ГБ | 405B | 123B | NVLink |

Моделям со смесью экспертов (MoE), например gpt-oss-120b, нужно меньше вычислений на токен, но все их веса всё равно должны находиться в памяти.

## Одна модель, несколько GPU

Почему связь между GPU важна не меньше, чем сами GPU.

Фреймворки для инференса распределяют модель между GPU двумя способами. **Тензорный параллелизм** делит каждый слой между картами и требует быстрой связи между ними; **конвейерный параллелизм, или параллелизм по слоям**, отдаёт каждой карте блок слоёв и допускает более медленную связь.

Поэтому связь и важна. В наших серверах с H100 карты обмениваются данными через **NVLink**, так что тензорный параллелизм хорошо масштабируется и для инференса, и для обучения. Две карты RTX 5090 связаны через PCIe: это отличный вариант для инференса модели, разделённой надвое, но для обучения возможности более ограничены.

После выдачи сервера выполните `nvidia-smi topo -m`, чтобы увидеть топологию, а затем задайте в vLLM параметр `--tensor-parallel-size` равным числу GPU. Полные команды — в [руководстве по образам для GPU](https://offshoreserv.com/ru/docs/gpu/images).

| Сервер | ОЗУ (RAM) | Пропускная способность на GPU |
| --- | --- | --- |
| 2 × RTX 5090 | 2 × 32 ГБ GDDR7 | 1 792 ГБ/с |
| 2 × H100 | 2 × 80 ГБ HBM3 | 3.35 ТБ/с |
| 4 × H100 | 4 × 80 ГБ HBM3 | 3.35 ТБ/с |

## Когда одного GPU мало

Модели и задачи, которым нужна память или производительность нескольких GPU в одном сервере.

- **Модели от 70B до 405B** — Запускайте крупнейшие модели с открытыми весами приватно, распределяя их между несколькими GPU. — 4 × H100
- **Распределённое обучение** — Обучение с параллелизмом по данным и тензорным параллелизмом через NVLink. — 2 × H100
- **Параллельные задачи** — По одной модели на GPU: несколько экспериментов или пользователей одновременно. — 2 × RTX 5090
- **Высоконагруженный инференс** — Множество одновременных пользователей на одном эндпоинте благодаря пакетной обработке запросов. — [Руководство по vLLM](https://offshoreserv.com/ru/docs/gpu/images)

## Где доступны серверы с несколькими GPU

Наши узлы с несколькими GPU размещены в Молдове и Нидерландах.

- [Молдова Кишинёв Оптимальный выбор — Вне ЕС · без DSA — Лондон **~33 мс** Нью-Йорк **~113 мс** Сингапур **~129 мс**](https://offshoreserv.com/ru/locations/moldova)
- [Нидерланды Амстердам Сетевой хаб — Член ЕС · действует DSA — Лондон **~7 мс** Нью-Йорк **~87 мс** Сингапур **~154 мс**](https://offshoreserv.com/ru/locations/netherlands)
- [Сравнить все семь — Статус в ЕС, основания для удаления контента и задержка — в одной таблице.](https://offshoreserv.com/ru/locations#compare)

Значения задержки — оценка по расстоянию, а не результаты измерений. Цены во всех юрисдикциях одинаковы. [Как мы оцениваем задержку](https://offshoreserv.com/ru/network)

## Правила — ещё до оплаты

Всё, что мы обещаем, закреплено в наших политиках, а не только в рекламе.

- Американские уведомления DMCA **Не исполняются** — Мы отвечаем на них со ссылкой на нашу политику, но никогда их не исполняем. Потребовать действий может только решение местного суда или, в локациях в ЕС, действительное уведомление по праву ЕС.
- Личные данные **Только email** — Ни имени, ни адреса, ни телефона, ни документов — никогда. Подойдёт приватный или одноразовый email.
- Оплата **5 криптовалют** — Bitcoin, Ethereum, Monero, USDT и Solana: оплата в блокчейне с любого кошелька на ваш баланс. Без карточного эквайринга и без чарджбэков.
- Прозрачность **Подписанная «канарейка»** — Ежеквартальная «канарейка» (warrant canary) с PGP-подписью и публичный подсчёт всех полученных запросов.

## Серверы с несколькими GPU: ответы на вопросы

**Остались вопросы?** В полном разделе вопросов и ответов — всё, о чём спрашивают перед заказом: оплата, конфиденциальность, жалобы и поддержка.

### Можно ли использовать GPU по отдельности?

Да. Система видит каждый GPU отдельно: запускайте по одной модели на карту с помощью `CUDA_VISIBLE_DEVICES` или распределите одну модель по всем картам.

### Есть ли NVLink в каждом сервере с несколькими GPU?

В серверах 2 × и 4 × H100 — да. RTX 5090 не поддерживает NVLink, поэтому в сервере 2 × RTX 5090 карты соединены через PCIe.

### Можно ли получить восемь GPU или несколько узлов?

Да, в виде индивидуальной конфигурации. После выдачи вашего первого сервера опишите нужный кластер в тикете из [личного кабинета](https://offshoreserv.com/ru/account/support), и мы назовём цену.

### Как быстро выдаётся сервер?

От 1 до 24 часов после заказа. Узлы с несколькими GPU зависят от наличия: если в выбранной вами юрисдикции такого узла нет, мы сообщим вам об этом и либо придержим заказ, либо вернём оплату на ваш баланс.

### Можно ли вернуть средства?

После выдачи возврат средств за GPU-серверы невозможен, поскольку оборудование резервируется специально для вас.

## Читайте также

Руководства, политики и статьи, подобранные для этой страницы и написанные нашей командой.

- [Серверы с H100 80 ГБ HBM3, до 4 × H100.](https://offshoreserv.com/ru/offshore-gpu-servers/h100)
- [Серверы с RTX 5090 32 ГБ GDDR7 за $134.99/мес.](https://offshoreserv.com/ru/offshore-gpu-servers/rtx-5090)
- [Сколько видеопамяти нужно LLM?Размеры моделей, квантование и выбор подходящего GPU.](https://offshoreserv.com/ru/blog/how-much-vram-for-llms)
- [Образы для GPU, готовые к работе с ИИ Драйверы, CUDA и инструменты, предустановленные на GPU-серверах.](https://offshoreserv.com/ru/docs/gpu/images)
- [A100, L40S и H100 HBM, ECC и NVLink для обучения.](https://offshoreserv.com/ru/offshore-gpu-servers/datacenter)
- [GPU-серверы с RTX Лучшая цена за токен для инференса.](https://offshoreserv.com/ru/offshore-gpu-servers/rtx)

## Крупнейшие открытые модели на вашем собственном узле

1. Выберите 2 или 4 GPU
2. Оплата криптовалютой, без документов
3. Вход по SSH через 1–24 часа

От $558.99/мес. · выделенные GPU · NVLink на H100

---

OffshoreServ — офшорный хостинг-провайдер: VPS, выделенные серверы, Windows RDP и GPU-серверы в семи юрисдикциях (Исландия, Швейцария, Молдова, Румыния, Нидерланды, Болгария и Малайзия), оплата только криптовалютой (Bitcoin, Ethereum, Monero, Tether (USDT) и Solana), без проверки личности (без KYC).

Prices and plans: https://offshoreserv.com/ru/pricing · Answers: https://offshoreserv.com/ru/faq · Every page: https://offshoreserv.com/llms.txt
