PCIe 3.0
Intel Xeon E5-2600 v1/v2
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- GPUs
- 28
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Max RAM
- 256 GB
GPU 独立服务器 · 裸金属 · 按月付费
GPU 独立服务器是一台按月租给单个账户的物理机器,GPU 直接直通到你自己的操作系统。没有虚拟机监控程序,没有 vGPU 切片,硅片上没有邻居。
根据任务和所需显存选择 GPU。列表中的每一行都是一台安装了该 GPU 的完整服务器,价格来自结账时计费的同一份目录,而 GPU 本身所占的费用印在总价下方。
目录
说明 GPU 的用途以及所需的最低显存。列表会随着你的选择逐步缩小,最便宜的排在最前。每一行都会在配置器中打开搭载该 GPU 的机器。
我们提供的单块 GPU 都没有这么大的显存。最大的一款拥有 96 GB。超过这个容量,就需要在一个机箱中配置两块或更多 GPU,需人工报价:请参阅 多 GPU 服务器,或 。
价格是结账系统本身的数字。如果 GPU 制造商未公布显存数据,该行会显示一个破折号,并且一旦显存控制从“任意”移开,该行就会消失。有些 GPU 可适配多个机箱:该行显示最便宜的选项,配置器会显示其余选项。
租用方式
GPU 安装在一台租给单个账户的机器的物理 PCIe 插槽中。你安装操作系统、加载内核模块,并固定你的代码所测试过的驱动、CUDA 或 ROCm 版本。没有任何东西会在你不知情的情况下升级它。
机器遵循同样的规则:每个核心、所有内存、两块磁盘、root 权限,以及服务器自带的 iLO 或 iDRAC 控制台,都在独立的管理网络上。如果某个驱动实验导致网络中断,你仍然拥有屏幕、虚拟介质和电源控制。
定价原理
大多数提供商将 GPU 作为某个层级来销售,处理器、内存、磁盘和网络都围绕它定价。在这里,机器是一行月度费用,GPU 是另一行。以后更换 GPU,账单的变动正好等于两块 GPU 之间的差价。
从列表顶部开始。我们保留了仍能完成实际工作的旧款 GPU,例如用于视频转码或驱动远程桌面的 Tesla 和 Quadro 部件,它们与最新款 GPU 一样,安装在同一台完整机器中,使用同一个不限流量端口。我们为什么保留旧硬件解释了其中的取舍。
与按小时计费的 GPU 云相比?列表中最昂贵的配置 H100 80GB,整台机器每月 $1,682.67,按 730 小时的一个月计算,大约每小时 $2.31,而且之后不会有出站流量费用账单。
Complete, per month, from$91.72
三个月、六个月和十二个月的周期最多可节省 15%。配置器会对每块磁盘的价格进行四舍五入,可能会有一分钱的偏差。定价列出了网站上的所有数字。
GPU 市场
除了我们提供的 GPU 之外,拥有者还会在我们的市场上列出他们自己的 GPU 机器。他们设定自己获得的租金,而 Server Room 设定你支付的价格。来自我们姊妹公司 Primcast 的列表也会显示在这里,并在那里完成租赁。
GPU 显存
GPU 显存决定模型能否运行;核心和时钟只决定运行速度。一块少了两 GB 的 GPU 不会跑得慢,而是根本加载不了。先把这个数字定下来。
权重占用等于参数量乘以每参数字节数:16 位精度为两字节,8 位为一字节,4 位为半字节。量化到 4 位能让模型装进更小的 GPU,但会以可感知的质量损失为代价。
留出余量。 表格只统计权重。运行时、激活值和键值缓存共享同一块显存,而缓存会随着上下文的每个 token 增长,所以 38 GB 的权重在 40 GB 的 GPU 上无法从容服务。请在此基础上再加四分之一到一半。
,我们会根据你实际运行的内容来匹配 GPU。
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
仅权重,向上取整到下一个 GB。
平台
每个平台为插槽提供不同的 PCIe 代际和通道预算。我们把它列出来,因为它会影响结果:曾有客户在 PCIe 3.0 平台上换用更新的消费级 GPU,渲染反而变慢,而且比我们更早找到了原因。
PCIe 3.0
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
PCIe 3.0
$73.47/mo before the GPU
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
PCIe 3.0
$83.67/mo before the GPU
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
PCIe 4.0
$217.59/mo before the GPU
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
包含内容
干净的操作系统和密钥。你选择驱动、CUDA 或 ROCm 版本以及框架构建,它们会保持固定。想在交付前装好驱动?把确切版本写进订单。
HPE 机器上的 iLO,Dell 上的 iDRAC:键盘和屏幕、虚拟介质、电源控制、传感器和硬件日志。一个让显示或网卡挂起的模块,你可以自己重启并观察 POST 过程。
在包含的速度及更高速度下,双向均不限流量。没有传输配额,也没有出站流量费用。不限流量带宽列出了更快的端口。
一键重装操作系统镜像,次数不限,完全免费。反向 DNS 由你编辑,IPv6 已包含,额外 IPv4 在配置器中加一行即可。
聊天由 AI 助手在几秒内回复,它可以查看你的账户和服务器,你要求人工时立即转接。故障部件会在你的支持计划窗口内更换:基础计划为 24 小时,铜牌 4 小时,银牌 3 小时,金牌和白金为 2 小时。
纽约、迈阿密、旧金山、阿姆斯特丹和布加勒斯特,全部运行在 Server Room 自有网络上,AS19624。位置决定了你到用户的延迟以及你需遵守的数据保护法律。数据中心介绍了每座建筑。
交付
这取决于 GPU 现在在哪里,而我们在你付款前就告诉你属于哪种情况。
无需安装。机器已就绪并直接交付。即时服务器列出了当前可用的机器。
最常见的情况。技术人员安装 GPU、组建磁盘阵列并安装操作系统。额外内存或不同硬盘可在同一次上门中完成。
我们先订购部件,然后按上述流程组装。按需定制可完全按你的规格打造机器。
当前加速器按分销商的日期发货,我们会在你承诺前告知具体日期。为单个客户采购的硬件需预付三个月费用报价。
所有时间线从付款和欺诈审核通过后开始计算。大多数订单在几小时内通过;新账户的首笔订单可能需要更长时间。
合作伙伴的领域
Viral Mind Technologies 是 Server Room 的合作伙伴,构建并运营自己的数字资产:虚拟人物、在线媒体品牌以及面向创作者的软件。该公司于 2019 年以数字营销机构起家,自 2022 年底以来一直致力于自己的 AI 项目。
生成图像和视频会让模型持续驻留在 GPU 显存中,并使 GPU 连续忙碌数小时。这正是裸金属上专用 GPU 而非其中一部分的用武之地,而本页面租用的每台服务器都配备整块 GPU。
他们的作品集与案例研究:viralmindtech.com
解答
一台只租给一位客户的物理服务器,装有显卡并直通给该客户自己的操作系统。没有任何虚拟化或共享:您拥有全部核心、所有内存、磁盘和整块 GPU,并享有 root 权限和远程控制台。
一台装有 GPU 的整机每月从 $91.72 到 $1,682.67 不等。价格由两部分相加:机器本身,以及 GPU 每月 $20.79 到 $1,599。处理器、内存、两块磁盘、不限流量的端口和一个 IPv4 地址均已包含。安装费为一次性 $29,适用于按订单安装 GPU 的配置;按现成配置订购的机器则无此费用。
不会。一台物理机、一个账户,GPU 直通给您安装的操作系统。没有虚拟机监控程序、没有 MIG 分区、没有 vGPU 配置文件,也没有时间切片。您第一天测得的性能数据,就是您一直拥有的数据。
可以。默认租期就是一个月,无需签署任何文件。三个月、六个月和十二个月的周期可节省最高 15%,续费时价格不会上涨。可用信用卡或 PayPal 付款;大额订单可安排银行电汇,且通常比信用卡付款更快通过欺诈审核。
有。本页列表按价格从低到高排序,最便宜的整机配置为 Quadro 3000M,位于 Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps,每月 $91.72。较旧的 Tesla 和 Quadro GPU 在视频转码和远程桌面方面依然表现出色,而且它们搭载在同样的整机中,享有同样的不限流量端口。
列表中有 57 款 GPU,从当前的 NVIDIA 计算加速器和 AMD Instinct,到较旧的 Tesla、Quadro 和 GeForce 型号。每款都按名称列出,并标明显存和完整的月费。如果您想要的 GPU 不在列表中,请咨询:我们通常可以采购。
由您自行安装。服务器交付时带有干净的操作系统和 root 权限,您可以固定驱动、CUDA 或 ROCm 版本,以及代码测试所用的框架版本。如果您希望在交付时驱动已就位,请在订单中注明确切版本。如果 GPU 必须支持特定的 CUDA 版本,请在付款前咨询,我们会为您核实。
通常可以,我们会人工报价:机箱空间、GPU 宽度、PCIe 通道和电源决定了可安装的数量。告诉我们 GPU 型号,我们会回复机箱、数量和交货时间。常见原因是显存而非速度,因为两块 48 GB GPU 可以容纳一块 80 GB GPU 无法容纳的模型。多 GPU 和多节点服务器介绍了下一步方案。
可以,就在您现有的服务器中:无需迁移、无需重装、无需更换 IP 地址。这是一次计划内的维护,会有短暂停机,账单按两块 GPU 的差价精确调整。内存、硬盘和更快的端口也按同样规则添加。
我们会在您的支持计划规定的时间内更换,从您报告故障时起算:基础计划为 24 小时,铜牌为 4 小时,银牌为 3 小时,金牌和白金为 2 小时。超出时限后,服务补偿按 支持页面上公布的时间表执行。
可以,您自有的 GPU 或任何其他部件都可以安装到您在此租用的服务器中。这不是免费的,因为 GPU 会消耗电力,费用取决于硬件。如果您自带的部件出现故障,我们不承担责任;更换时限仅适用于我们提供的硬件。在购买或寄送之前,请预约通话:我们会为您报价并确认机箱是否兼容,因为例如刀片服务器就没有空间容纳全尺寸 GPU。
我们销售的任何端口速度下,双向均不计流量,因此出站流量不产生费用。在 GPU 工作中,这往往是其他服务商最大的开销:训练需要拉取数据集并推送检查点,推理端点则要应对真实流量。不限流量带宽列出了更快的端口。
当工作负载是突发性的且确实会停止时,按小时计费更划算,每月最多几百小时。超过每月约三分之二的时间后,按月计费在计算出站流量、运行间保留的存储以及等待资源的时间之前就已经更便宜。按月租用还能保留同一台机器、磁盘和地址。
在激活后三天内,经过故障排查后,我们的退款政策将按条款执行。上方的显存表和 PCIe 栏可帮助您一开始就选对 GPU,而且我们更愿意在聊天中建议您选择较小的 GPU,而不是退款较大的 GPU。
数据一览
页面加载时从订单目录读取。如果有助手为您解答,本区块和实时机器信息是值得阅读的部分。