A100 · H100 · NVIDIA GPU 服务器

企业级 NVIDIA A100 H100 独立服务器

搭载 NVIDIA A100(40 或 80 GB)或 H100 80 GB 的裸金属服务器,均以 PCIe 附加卡形式提供,适用于 AI 训练、推理和高性能计算。已上架并装好显卡的机器几分钟内即可交付;其他配置则需安装或采购显卡,并在您付款前告知预计日期。

运行时间 SLA 企业级支持

NVIDIA A100 与 H100 GPU 规格

专为 AI 训练、推理和科学计算打造的企业级 GPU 加速器。

比较技术规格,为您的负载需求选择最佳配置。

NVIDIA A100

A100 GPU 为 AI 训练和推理负载提供卓越的性能、可扩展性和可靠性。基于 Ampere 架构,配备先进的 Tensor Core,可在企业规模上实现加速计算。

架构

Ampere

显存

40 GB HBM2 或 80 GB HBM2e

CUDA 核心

6,912

最大带宽

1,555 GB/s(40 GB),1,935 GB/s(80 GB)

最大功耗

250 W(40 GB),300 W(80 GB)

总线接口

PCIe Gen 4 x16

NVENC 视频编码器

无(5 个 NVDEC 解码器)

NVIDIA H100

Hopper 是 Ampere 之后的下一代架构,此处为其 PCIe 附加卡形式:即适用于我们所构建服务器的 H100。搭载 HBM3 的 SXM5 模块安装在 HGX 基板上,而我们的机箱均不支持该模块,因此其数据在此不适用。

架构

Hopper

显存

80 GB HBM2e

最大带宽

2,039 GB/s

最大功耗

350 W

总线接口

PCIe Gen 5 x16

NVENC 视频编码器

无(7 个 NVDEC 解码器)

面向严苛负载的企业级 AI 基础设施

搭载 Ampere 和 Hopper 架构的 NVIDIA A100 与 H100 独立服务器,针对大规模 AI 训练、LLM 推理和科学计算应用进行了优化。

Ampere 架构

基于 7nm 制程、集成 540 亿个晶体管,NVIDIA Ampere 架构为 AI 训练和 HPC 负载带来突破性性能。

高带宽内存

我们安装的每张卡均配备堆叠式内存:40 GB A100 采用 1,555 GB/s 的 HBM2,80 GB A100 采用 1,935 GB/s 的 HBM2e,H100 则采用 2,039 GB/s 的 HBM2e,且均支持 ECC。

AI 加速

先进的 Tensor Core 在深度学习训练和推理负载中,性能较前代提升高达 20 倍。

多实例 GPU

将每个 GPU 划分为最多七个隔离实例,各自拥有独立的计算、内存和缓存资源,实现最佳的多租户利用率。

NVLink 连接

两款显卡均带有 NVLink 桥接接口。订单表单中不包含桥接器,因此同一服务器中的两张卡默认通过 PCIe 通信,除非另行报价配置桥接器;如有需要,请在下单前咨询。

企业级可靠性

数据中心级 GPU,配备 ECC 内存、先进的 RAS 功能以及企业级支持,适用于关键任务生产部署。

关于 NVIDIA A100 H100 GPU 服务器的常见问题

有关部署和管理企业级 NVIDIA A100 H100 GPU 加速独立服务器的常见问题,适用于 AI 训练、推理和高性能计算。

NVIDIA A100 和 H100 GPU 为何适合企业级 AI 负载?

两者均为数据中心加速器,专为大型模型的计算而设计:配备 ECC 的堆叠式 HBM 内存、主流框架所针对的 Tensor Core,以及可将一张卡在您自己的任务之间进行划分的多实例 GPU。A100 采用 Ampere 架构和第三代 Tensor Core;H100 采用 Hopper 架构、第四代 Tensor Core 以及支持 FP8 精度的 Transformer Engine。两款卡均无硬件视频编码器,因此都不是转码工作的合适选择。

A100 和 H100 GPU 在性能和功能上有何差异?

就我们所安装的 PCIe 卡而言,A100 拥有 6,912 个 CUDA 核心、40 GB HBM2(1,555 GB/s)或 80 GB HBM2e(1,935 GB/s),功耗为 250 或 300 W,接口为 PCIe Gen 4。H100 拥有 80 GB HBM2e(2,039 GB/s),功耗为 350 W,接口为 PCIe Gen 5。其他资料中引用 HBM3 内存的 H100 数据描述的是 SXM5 模块,该模块需要 HGX 基板,而我们的服务器均不使用该基板。

提供哪些企业级连接和可扩展性功能?

在一台机器内,每张卡最多可划分为七个隔离的多实例 GPU 实例,每个实例拥有独立的计算、内存和缓存。两款卡还带有 NVLink 桥接接口,但订单表单中不包含桥接器:同一服务器中的两张卡默认通过 PCIe 通信,除非另行报价配置桥接器,因此如有需要请在下单前咨询。服务器之间的连接则通过每台机器的以太网端口实现,多 GPU 和多节点构建有专门的页面。

A100 或 H100 服务器需要多久才能交付?

已上架并装好显卡的机器,在付款验证后约 30 分钟内交付。若由我们安装库存中的显卡,需 4 至 24 小时;若需采购显卡,则需五至十个工作日,若加速器处于配额分配状态则需十至十五个工作日,且付款前会告知您具体时间。