A100 80 ГБ Выгодный
Ampere, HBM2e
- Пропускная способность памяти
- ~2.0 ТБ/с
- Точность вычислений
- FP16, BF16, TF32 и INT8
- Помещается при 4-битной точности
- Примерно до 70B
- Подходит для
- Дообучение, постоянный инференс

A100
Память HBM или ECC и NVLink для обучения, дообучения и инференса больших моделей: A100 80 ГБ, L40S 48 ГБ и H100 80 ГБ, до четырёх H100 в одном сервере. От $355.99/мес., без KYC.
01Тарифы и цены
Каждый GPU выделен только вам, плюс быстрый NVMe для наборов данных и контрольных точек.
| GPU | VRAM | Процессор | ОЗУ (RAM) | Диск | Локации | Цена | Заказ |
|---|---|---|---|---|---|---|---|
|
|
80 ГБ | 128 ГБ | 3.84 ТБ NVMe |
$355.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
L40S
Инференс в больших масштабах
48 ГБ VRAM |
48 ГБ | 256 ГБ |
$418.99/мес.
Самый дешёвый конкурент |
Развернуть L40S | |||
|
|
80 ГБ | 192 ГБ | 2 ТБ NVMe |
$581.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
160 ГБ | 384 ГБ | 4 ТБ NVMe |
$1,096.99/мес.
Самый дешёвый конкурент |
Развернуть |
||
|
|
320 ГБ | 768 ГБ | 30 ТБ NVMe |
$2,348.99/мес.
Самый дешёвый конкурент |
Развернуть |
В этой юрисдикции пока нет GPU-серверов: или сравнить их.
Нужны восемь GPU или InfiniBand между серверами? Клиенты с GPU- и выделенными серверами могут запросить индивидуальную конфигурацию через тикет в личном кабинете.
02Выбор
У обеих по 80 ГБ. У H100 гораздо выше пропускная способность и есть поддержка FP8; A100 дешевле в месяц.
Ampere, HBM2e
Hopper SXM5, HBM3
L40S (48 ГБ, FP8) — промежуточный вариант: карта для инференса моделей 32B в 8-битной точности и для генерации изображений и видео.
03Подбор
Наши отправные точки для самых распространённых задач обучения и инференса.
| Задача | Наш выбор | Почему |
|---|---|---|
| Дообучение с LoRA для моделей до 14B | L40S или A100 | В 48–80 ГБ помещаются модель, адаптеры и состояние оптимизатора. |
| Полное дообучение модели 7–8B | Обучению со смешанной точностью нужно примерно 16 байт на параметр: от 112 до 128 ГБ — больше, чем вмещает одна карта на 80 ГБ. | |
| Инференс 70B в 4-битной точности | A100 или H100 | Около 50 ГБ с контекстом 8K — на одной карте на 80 ГБ остаётся запас для пакетной обработки запросов. |
| Инференс 70B в 8-битной точности | Около 85 ГБ с контекстом 8K; модель разделяется между GPU через NVLink. | |
| 405B в 4-битной точности или масштабное обучение | 320 ГБ HBM3 в одном узле. |
Требования к памяти для весов приведены в нашей таблице видеопамяти; контекстное окно и размер батча увеличивают эти цифры.
04Сценарии использования
Задачи, в которых пропускная способность HBM, память ECC и NVLink оправдывают более высокую ежемесячную цену.
LoRA, QLoRA и полное дообучение на конфиденциальных данных, которые не покидают сервер.
Эндпоинты vLLM для моделей класса 70B с множеством одновременных пользователей.
Исследовательские запуски на конфигурациях до четырёх H100, соединённых через NVLink.
Крупные задачи генерации изображений, видео или эмбеддингов, растянутые на несколько дней.
05Юрисдикции
У каждого сервера свой список юрисдикций; где именно — показано в тарифах выше.
Значения задержки — оценка по расстоянию, а не результаты измерений. Цены во всех юрисдикциях одинаковы. Как мы оцениваем задержку
06Офшор — чёрным по белому
Всё, что мы обещаем, закреплено в наших политиках, а не только в рекламе.
Американские уведомления DMCAНе исполняются
Мы отвечаем на них со ссылкой на нашу политику, но никогда их не исполняем. Потребовать действий может только решение местного суда или, в локациях в ЕС, действительное уведомление по праву ЕС.
Политика по DMCAЛичные данныеТолько email
Ни имени, ни адреса, ни телефона, ни документов — никогда. Подойдёт приватный или одноразовый email.
Политика конфиденциальностиОплата5 криптовалют
Bitcoin, Ethereum, Monero, USDT и Solana: оплата в блокчейне с любого кошелька на ваш баланс. Без карточного эквайринга и без чарджбэков.
Оплата криптовалютойПрозрачностьПодписанная «канарейка»
Ежеквартальная «канарейка» (warrant canary) с PGP-подписью и публичный подсчёт всех полученных запросов.
«Канарейка» (warrant canary)07Вопросы и ответы
Остались вопросы? В полном разделе вопросов и ответов — всё, о чём спрашивают перед заказом: оплата, конфиденциальность, жалобы и поддержка.
Все вопросы и ответыВ наших серверах с H100 используется форм-фактор SXM5 с памятью HBM3 и пропускной способностью 3.35 ТБ/с на GPU. Серверы
Да. Каждый GPU выделен вашему серверу. Никакого разделения по времени и никаких MIG-разделов, общих с другими клиентами.
Образ nvidia-smi
От 1 до 24 часов после заказа. Если сервера временно нет в наличии в выбранной вами юрисдикции, мы сообщим вам об этом и либо придержим заказ, либо вернём оплату на ваш баланс.
После выдачи возврат средств за GPU-серверы невозможен, поскольку оборудование резервируется специально для вас. Перед заказом ознакомьтесь с характеристиками и руководством по образам для GPU.