上线优惠价:每个套餐的价格都比我们追踪的最便宜的离岸竞争对手低 30%。 查看价格对比所有套餐价格均比最便宜的离岸主机服务商低 30%

NVIDIA · 预装 CUDA · 无需 KYC

离岸 GPU 服务器
私有 AI,无需 KYC

独享 NVIDIA GPU,从 RTX A4000 到 4 × H100,适用于大语言模型推理、微调、图像生成和渲染。预装驱动与 CUDA,您的提示词绝不会离开这台服务器。月付 $61.99 起,比最便宜的离岸竞争对手低 30%。

  • 1 至 24 小时内交付
  • 独享 GPU,绝不共享
  • 提示词只留在您的服务器上
  • 无需 KYC,仅需邮箱

配置您的 GPU 服务器1–24 小时就绪

司法管辖区摩尔多瓦 · 基希讷乌

套餐比较套餐

付费周期

$84.99/月

月付 · 随时取消

竞品最低价 $121.50−30%

无需证件BTC、XMR、USDT +2免开通费

01 套餐与价格

10 款 GPU 服务器,从 RTX A4000 到 4 × H100

每块 GPU 都由您独享:没有分时复用,也没有会在任务中途被收回的竞价实例。

GPU 服务器:10 个套餐,月付价格(美元)
GPU VRAM CPU 内存 存储 地区 价格 订购
RTX A4000 入门级推理,7-13B 模型 16 GB VRAM8 vCPU64 GB 内存1 TB NVMe摩尔多瓦荷兰罗马尼亚 16 GB 8 vCPU 64 GB 1 TB NVMe 摩尔多瓦荷兰罗马尼亚 $61.99/月 竞品最低价 $89.00 部署 RTX A4000
RTX 5090 快速推理、图像与视频 32 GB VRAM12 vCPU96 GB 内存2 TB NVMe摩尔多瓦荷兰冰岛 32 GB 12 vCPU 96 GB 2 TB NVMe 摩尔多瓦荷兰冰岛 $134.99/月 竞品最低价 $193.00 部署 RTX 5090
RTX 6000 Ada 48 GB,可运行 8 位精度的 32B 模型 48 GB VRAMEPYC 7302P 16c128 GB 内存2 × 1.92 TB NVMe摩尔多瓦荷兰 48 GB EPYC 7302P · 16c 128 GB 2 × 1.92 TB NVMe 摩尔多瓦荷兰 $306.99/月 竞品最低价 $439.00 部署 RTX 6000 Ada
A100 80 GB 训练与微调 80 GB VRAM16 vCPU128 GB 内存3.84 TB NVMe摩尔多瓦荷兰冰岛 80 GB 16 vCPU 128 GB 3.84 TB NVMe 摩尔多瓦荷兰冰岛 $355.99/月 竞品最低价 $509.00 部署 A100 80 GB
L40S 大规模推理 48 GB VRAMEPYC 7443P 24c256 GB 内存2 × 1.92 TB NVMe摩尔多瓦荷兰 48 GB EPYC 7443P · 24c 256 GB 2 × 1.92 TB NVMe 摩尔多瓦荷兰 $418.99/月 竞品最低价 $599.00 部署 L40S
2 × RTX 5090 单机 64 GB VRAM 64 GB VRAMEPYC 9354 32c256 GB 内存2 × 1.92 TB NVMe摩尔多瓦荷兰 64 GB EPYC 9354 · 32c 256 GB 2 × 1.92 TB NVMe 摩尔多瓦荷兰 $558.99/月 竞品最低价 $799.00 部署 2 × RTX 5090
H100 80 GB 前沿模型训练,SXM5 80 GB VRAM24 vCPU192 GB 内存2 TB NVMe摩尔多瓦荷兰冰岛 80 GB 24 vCPU 192 GB 2 TB NVMe 摩尔多瓦荷兰冰岛 $581.99/月 竞品最低价 $832.50 部署 H100 80 GB
2 × H100 160 GB HBM3, NVLink 160 GB VRAM48 vCPU384 GB 内存4 TB NVMe摩尔多瓦荷兰 160 GB 48 vCPU 384 GB 4 TB NVMe 摩尔多瓦荷兰 $1,096.99/月 竞品最低价 $1,567.50 部署 2 × H100
  • RTX 4090、5090、L40S、A100、H100
  • 预装 CUDA 驱动
  • 单 GPU 与多 GPU 节点
  • 无需 KYC · BTC、ETH、XMR、USDT、SOL

计划搭建集群,或运行需要超过 320 GB 显存的模型?GPU 服务器和独立服务器客户可在客户中心提交工单,申请定制配置。

04 私有大语言模型托管

您的模型、您的提示词、您的服务器

在无人共用的硬件上运行开放权重模型。没有任何 API 服务商能看到您的提示词,我们也不会记录或检查您的流量。

Llama、Qwen、Mistral、DeepSeek、Gemma 等开放权重模型经过量化后即可在单块 GPU 上运行,最大的模型也能装进我们的多 GPU 节点。部署推理服务时,可用 Ollama 快速上手,用 vLLM 在高负载下提供兼容 OpenAI 的端点,或用 llama.cpp 实现最精简的配置。

下表列出了模型在各精度下所需的显存,按单用户、8K token 上下文并预留 10% 余量计算。上下文更长或用户更多时,所需显存也更多。

  • 通过 SSH 隧道,在浏览器中与私有助手对话。
  • 为您自己的应用提供 API,绝不经由第三方服务商。
  • 用 LoRA 基于您自己的数据进行微调,数据始终不离开服务器。

搭建 Ollama、vLLM 或 ComfyUI · 大语言模型需要多少显存?

语言模型在 8K token 上下文下大致所需的显存,以及能容纳该模型的最小 GPU
模型规模4 位精度8 位精度16 位精度
7–8B~7 GB
RTX A4000
~11 GB
RTX A4000
~19 GB
RTX 4090
13–14B~11 GB
RTX A4000
~18 GB
RTX 4090
~32 GB
RTX 6000 Ada, L40S
32B~24 GB
RTX 5090
~40 GB
RTX 6000 Ada, L40S
~73 GB
A100 或 H100
70B~50 GB
A100、H100 或 2 × RTX 5090
~85 GB
2 × H100
~157 GB
4 × H100
123B~86 GB
2 × H100
~147 GB
2 × H100
~274 GB
4 × H100

05 标配

首次登录即可使用 CUDA

检查显卡,拉取模型,开始提供服务。

  • 独享 GPU

    每块显卡都由您独享:没有分时复用,也没有共享显存。

  • 驱动与 CUDA 就绪

    Ubuntu 24.04,已安装 NVIDIA 驱动和 CUDA 工具包。

  • 每种技术栈都有指南

    PyTorch、vLLM、Ollama、ComfyUI 和 Docker 的分步教程。

  • NVMe 存储

    1 至 30 TB NVMe 存储,用于存放数据集、检查点和模型权重。

  • 1 Gbps 不限流量

    拉取模型和数据集不计流量。

  • 不留日志

    我们从不查看或记录您的提示词、输出内容或训练数据。

  • DDoS 防护

    公开端点在遭受攻击时仍保持在线。

  • 完整 root 权限

    驱动、内核模块和技术栈,全由您自己决定。

06 对比

所有 GPU 并排对比

就推理而言,显存带宽决定每秒生成的 token 数,显存容量决定能装下哪些模型。

离岸 GPU 服务器对比
规格RTX A4000RTX 4090热门RTX 5090RTX 6000 AdaA100 80 GBL40S2 × RTX 5090H100 80 GB2 × H1004 × H100集群
GPU1 × RTX A40001 × RTX 50901 × RTX 6000 Ada1 × A1001 × L40S2 × RTX 50901 × H1002 × H100
VRAM16 GB32 GB48 GB80 GB48 GB64 GB80 GB160 GB
显存类型GDDR6 ECCGDDR7GDDR6 ECCHBM2eGDDR6 ECCGDDR7HBM3HBM3
单 GPU 显存带宽448 GB/s1,792 GB/s960 GB/s~2.0 TB/s864 GB/s1,792 GB/s3.35 TB/s3.35 TB/s
CPU8 vCPU12 vCPUEPYC 7302P · 16c16 vCPUEPYC 7443P · 24cEPYC 9354 · 32c24 vCPU48 vCPU
系统内存64 GB96 GB128 GB128 GB256 GB256 GB192 GB384 GB
存储1 TB NVMe2 TB NVMe2 × 1.92 TB NVMe3.84 TB NVMe2 × 1.92 TB NVMe2 × 1.92 TB NVMe2 TB NVMe4 TB NVMe
司法管辖区摩尔多瓦 荷兰 罗马尼亚摩尔多瓦 荷兰 冰岛摩尔多瓦 荷兰摩尔多瓦 荷兰 冰岛摩尔多瓦 荷兰摩尔多瓦 荷兰摩尔多瓦 荷兰 冰岛摩尔多瓦 荷兰
月付$61.99$134.99$306.99$355.99$418.99$558.99$581.99$1,096.99
季付(折合每月)$58.89$128.24$291.64$338.19$398.04$531.04$552.89$1,042.14
年付(折合每月)$54.55$118.79$270.15$313.27$368.71$491.91$512.15$965.35
竞品最低价$89.00$193.00$439.00$509.00$599.00$799.00$832.50$1,567.50
订购部署 RTX A4000部署 RTX 5090部署 RTX 6000 Ada部署 A100 80 GB部署 L40S部署 2 × RTX 5090部署 H100 80 GB部署 2 × H100

07 应用场景

离岸 GPU 的常见用途

从私有聊天助手到基于自有数据的微调,全部运行在无人共用的显卡上。

  • 大语言模型推理

    基于 8B 至 405B 开放权重模型的私有聊天与 API。

    显存指南
  • 微调

    基于您自己的数据进行 LoRA 和 QLoRA 微调,数据始终不离开服务器。

    A100 与 H100
  • 图像与视频生成

    通过 ComfyUI 运行 Stable Diffusion、Flux 和视频模型。

    RTX 5090
  • 3D 渲染

    Blender Cycles 等 GPU 渲染器,无需占用您的工作站。

    RTX 服务器
  • 语音与转写

    用 Whisper 和文本转语音模型处理必须保密的音频。

    GPU 镜像
  • 科研与数据科学

    在独享硬件上进行 Jupyter、PyTorch 和 CUDA 实验。

    对比 GPU

09 离岸承诺,白纸黑字

付款之前,先看规则

我们的承诺写进了政策条款,而不只是营销文案。

  • 美国 DMCA 通知不予执行

    我们依据政策予以答复,但从不执行。只有当地法院命令,或在欧盟地区收到的有效欧盟通知,才能要求我们采取行动。

    DMCA 政策
  • 身份仅需邮箱

    我们从不索取姓名、地址、电话或身份证件。私密邮箱或一次性邮箱均可。

    隐私政策
  • 支付5 种加密货币

    比特币、以太坊、门罗币、USDT 和 Solana,可从任意钱包链上支付至您的余额。不经过银行卡收单机构,不存在拒付。

    加密货币支付
  • 透明度签名金丝雀声明

    每季度发布一份经 PGP 签名的令状金丝雀(warrant canary),并公开统计我们收到的每一项请求。

    令状金丝雀

10 常见问题

GPU 服务器常见问题

还有其他问题?完整的常见问题页面解答了大家下单前常问的问题:付款、隐私、投诉与支持。

阅读完整常见问题
GPU 会被共享或分时复用吗?

不会。在租用期内,您套餐中的每块 GPU 都专属于您的服务器。其他人不会在上面运行任务,其显存也绝不共享。

我的模型需要哪款 GPU?

先看权重需要多少显存:参见上方表格或我们的大语言模型显存指南。一般来说,4 位精度的 70B 模型在 8K 上下文下约需 50 GB,因此需要一块 80 GB 的 A100 或 H100,或两块 RTX 5090。

是否已安装 NVIDIA 驱动和 CUDA?

是的。Ubuntu 镜像已自带 NVIDIA 驱动和 CUDA 工具包。PyTorch、vLLM、Ollama 和 ComfyUI 只需几条命令即可安装,详见 GPU 镜像指南。

我可以运营面向公众的 AI 服务吗?

可以,只要该服务在您服务器所在的司法管辖区合法,并遵守我们的可接受使用政策。您需对您的服务所生成和提供的内容负责。

多久可以交付?

订购后 1 至 24 小时内交付,具体取决于显卡型号。如果某款 GPU 在您所选的司法管辖区暂时缺货,我们会通知您,并为您保留订单或将款项退回您的余额。

可以在 GPU 服务器上挖加密货币吗?

可以。GPU 服务器和独立服务器允许挖矿,这些服务器专为您一人开通。

可以退款吗?

GPU 服务器一经交付即不可退款,因为硬件是专门为您预留的。订购前请查看规格参数和 GPU 镜像指南;账户余额随时可用于支付其他服务。

你们会记录提示词、输出内容或数据集吗?

不会。我们不会记录或检查您服务器的流量,也从不查看服务器内运行的内容。

专属 GPU,远离大型云平台

  1. 1 选择 GPU 和司法管辖区
  2. 2 加密货币付款,无需证件
  3. 31 至 24 小时内即可 SSH 登录
配置您的 GPU 服务器 我的模型该选哪款 GPU?

月付 $61.99 起 · 独享显卡 · 预装 CUDA

欢迎回来

登录以管理您的服务器和余额。

无需 KYC由 Cloudflare Turnstile 提供人机验证无跟踪