我们的 GPU 托管套餐
固定价格套餐,按 GPU 服务器的功耗配置。一键申请报价,我们会在 24 个工作小时内回复。
GPU Starter
1 至 2 块 GPU 的机器,适用于推理、微调或图像生成。
- 预留功率800 W
- 机柜空间2U
- 保证带宽100 Mbps
- IPv4 地址2
- 10 Gbps 上行端口免费
GPU Pro
4U 多 GPU 服务器,生产环境 AI 最常见的规格。
- 预留功率1.5 kVA
- 机柜空间4U
- 保证带宽250 Mbps
- IPv4 地址4
- 10 Gbps 上行端口免费
GPU Cluster
多台 GPU 服务器并排部署,在同一机柜空间内互联。
- 预留功率3 kVA
- 机柜空间8U
- 保证带宽500 Mbps
- IPv4 地址8
- 10 Gbps 上行端口免费
定制
8 GPU 服务器、超过 3 kVA 或半个机柜:自由组合您的托管空间。
- 机柜空间1 至 24U
- 功率0.5 至 6 kVA
- 保证带宽50 至 1,000 Mbps
- 10 Gbps 上行端口免费
组合您的定制托管空间
含 10 Gbps 上行端口、IPv6 /64 和 A/B 冗余供电。我们会在 24 个工作小时内发送正式报价。
- Tier III+ 基础设施(N+1 冗余)
- 可按需提供 IPMI / KVM 监控
- 多运营商传输
- 所有套餐均含 IPv6 /64
- 安装费:49.99 €(签约 12 个月免收)
为什么要把 GPU 服务器放进数据中心
多显卡机器发热大、噪音大,耗电量和取暖器相当。它应该放在机柜里,而不是办公桌下。
预留电力
每个套餐都在 A/B 冗余供电上预留 800 W 至 3 kVA 的功率:一路电源故障时,另一路无缝接管,正在进行的训练不会中断。
为模型服务的网络
免费 10 Gbps 上行端口,多运营商传输,按套餐提供 100 至 500 Mbps 保证带宽,独立 IPv4 和 IPv6 /64。足以对外提供推理 API 或传输您的数据集。
数据始终归您所有
服务器归您所有,放置在 Aubervilliers 的 Equinix PA6 数据中心。训练数据、模型权重、提示词:都不会经过任何第三方云平台。
远程掌控您的机器
可按需开通 IPMI/KVM 访问,无需到场即可重启、重装 NVIDIA 驱动或更换内核。我们的团队负责接收、上架并连接您的硬件。
您的 GPU 服务器需要多少功率?
在 GPU 托管中,决定套餐的是电力,远比机柜空间重要。估算需预留的功率:把每块 GPU 和处理器(CPU)的最大功耗相加,再加上约 150 W 用于主板、内存、NVMe SSD 和风扇。然后再留出 20% 余量以应对负载峰值。
| 显卡 | 显存 | 最大功耗 | 典型用途 |
|---|---|---|---|
| GeForce RTX 4090 | 24 GB GDDR6X | 450 W | LLM 推理(最高约 300 亿量化参数)、Stable Diffusion、LoRA 微调 |
| GeForce RTX 5090 | 32 GB GDDR7 | 575 W | 用途与 4090 相同,显存更大 |
| RTX 6000 Ada | 48 GB GDDR6 | 300 W | AI 与 3D 渲染,涡轮散热双槽显卡,适合机架机箱 |
| L40S | 48 GB GDDR6 | 350 W | 生产环境推理与图像生成,多 GPU 服务器 |
| A100 PCIe | 80 GB HBM2e | 300 W | 中等规模模型的训练与微调 |
| H100 PCIe | 80 GB HBM2e | 350 W | 大语言模型的训练与推理 |
示例:一台配有 2 块 RTX 4090(2 × 450 W)和 170 W 处理器的服务器,最大功耗为 900 + 170 + 150 = 1,220 W。加上 20% 余量,约为 1.45 kVA:选择 GPU Pro 套餐即可。单块此类显卡可放入 GPU Starter。以上为 NVIDIA 官方数值,请以您具体型号的规格表为准:部分非公版显卡功耗更高。
GPU 托管、云、独立服务器还是办公室?
运行 AI 模型的四种方式,在成本、控制程度和灵活性上差异很大。
| GPU 托管 | 云端 GPU 租用 | 租用独立服务器或 VPS | 办公室服务器 | |
|---|---|---|---|---|
| 硬件 | 自有,长期摊销 | 租用,从不拥有 | 向服务商租用,很少配备 GPU | 自有 |
| 虚拟化 | 无:物理机,GPU 直通 | 通常是虚拟机 | VPS:共享虚拟服务器;独立服务器:无 | 无 |
| 成本 | 固定月租 | 按小时计费,持续使用成本攀升 | 服务器月租 | 电费和空调费 |
| 管理 | 完整 root 权限,由您管理系统、防火墙和备份 | 通过服务商控制台 | root 权限,托管服务视套餐而定 | 一切由您现场负责 |
| 供电 | 数据中心 A/B 冗余 | 由服务商负责 | 由主机商负责 | 一个插座,无备用 |
| 网络 | 10 Gbps 上行,固定 IP 地址 | 视套餐而定 | 带宽视套餐而定 | 企业宽带 |
| 数据 | 在您的机器上,位于法国 | 在服务商处 | 在主机商处 | 在您的场所 |
| 最适合 | 7×24 使用:推理、API、长时间训练 | 几小时的临时需求 | 无 GPU 负载,或不想购买硬件 | 原型开发,单块显卡 |
还没有硬件?租用独立服务器也是一种选择:独立服务器免去购买成本。对于不带 GPU 的普通服务器,我们的托管套餐从 1U、100 W 起。仍在犹豫?我们的指南托管还是托管型独立服务器比较了两种方式,而数据中心托管如何运作讲解了 U、机柜和接入。
管理托管中的 GPU 服务器
ElypseCloud 是您的物理托管商,而不是代运维服务商:机器完全由您掌控。
系统与驱动
您拥有完整的 root 权限。安装您选择的发行版,例如 Ubuntu Server 或 Debian,然后安装 NVIDIA 驱动、CUDA,若使用容器,再安装 Docker 和 NVIDIA Container Toolkit。
SSH 访问与防火墙
使用密钥登录 SSH,禁用密码,并配置防火墙(UFW 或 nftables),只开放 SSH 和推理 API 端口。我们的首批安全设置可直接照做。
存储与备份
模型权重和数据集更适合放在 NVMe SSD 上。托管模式下备份由您负责:对于无法重新下载的内容,请在机器之外保留一份备份。
数据中心提供什么
高可用基础设施(A/B 供电、N+1 冗余)、保证带宽、固定 IP 地址,以及可按需开通的 IPMI/KVM 访问,便于远程接管。
GPU 托管可以运行什么
LLM 推理
使用 vLLM、Ollama 或 llama.cpp,在您自己的 API 后面部署开源模型(Llama、Mistral、Qwen…),无需按 token 付费。
训练与微调
使用 PyTorch 和 CUDA 连续数天让模型适配您的数据(LoRA、QLoRA),无需盯着计时收费。
图像与视频生成
为应用或创意工作室在生产环境中运行 Stable Diffusion、Flux 或 ComfyUI。
3D 渲染与计算
Blender 或 Unreal 渲染农场、仿真、科学计算:一切受益于数千个 CUDA 核心的任务。
常见问题 - GPU 托管
关于在 Equinix PA6 数据中心托管 GPU 与 AI 服务器的一切。