AMD Instinct GPU 服务器

在裸金属基础设施上部署 AMD Instinct MI210

搭载 AMD Instinct MI210 加速器的 HPE 企业级裸金属服务器——64 GB HBM2e,适用于机器学习与高性能计算。为语言模型选配硬件是另一个问题:请从 LLM 托管 开始。

64 GB HBM2e,内存带宽 1,638 GB/s。 PCIe 4.0 卡上的第二代 CDNA™ 架构。 HPE ProLiant 企业级基础设施。

AMD Instinct MI210 裸金属服务器

专为机器学习与高性能计算而设计。MI210 将第二代 CDNA™ 计算架构与 64 GB HBM2e 内存相结合,适用于高强度训练、推理和 HPC 应用。

极致计算吞吐量

第二代 CDNA™ 架构为深度学习训练和科学计算工作负载带来突破性的计算性能,满足对最大吞吐量的需求。

标准 PCIe 外形规格

MI210 将 MI200 系列芯片带入标准 PCIe 4.0 卡,因此可部署在企业级 HPE ProLiant 服务器中,而非专用加速器平台。

超大内存容量

64 GB 带 ECC 的 HBM2e 支持大规模模型的训练与推理以及内存密集型 HPC 工作负载,1,638 GB/s 的带宽让计算单元始终有充足的数据供给。

MI200 系列中的 PCIe 成员

MI250 和 MI250X 是用于专用百亿亿次平台的 OAM 模块。MI210 将相同的第二代 CDNA™ 架构带入标准 PCIe 4.0 卡——这正是它成为我们货架上的 Instinct 加速器的原因。

第二代 CDNA™ 架构

专为计算打造的芯片,在大规模并行处理工作负载中提供卓越的密度和能效。

AI 加速

优化的矩阵运算和混合精度计算,加速深度学习训练、模型微调和推理部署。

内存一致性架构

第三代 AMD Infinity 架构在 GPU 计算单元与系统内存之间实现高带宽、低延迟通信,最大化数据吞吐量。

GPU 互连

AMD Infinity Fabric™ 链路支持 MI210 卡之间的高速点对点通信,适用于多 GPU 训练和分布式计算工作负载。

面向 AMD Instinct™ 工作负载的 HPE 企业级基础设施

HPE ProLiant 平台

部署在 HPE ProLiant 企业服务器上的 AMD Instinct 加速器,为生产级 AI 和 HPC 工作负载提供运营商级可靠性和稳定性能。

灵活扩展

通过快速的硬件供应按需扩展 GPU 基础设施。标准升级和额外容量通常在 24 小时内完成部署。

专家支持

GPU 基础设施专家全天候通过在线聊天和电子邮件提供协助,涵盖部署、优化和故障排除。

MI210 L40S A100 H100
GPU 架构 CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
GPU 内存 64GB HBM2e 48GB GDDR6 80GB HBM2e 80GB HBM3
GPU 内存带宽 1638 GB/s 864 GB/s 1935 GB/s 3352 GB/s
FP32 22.63 TFLOPS 91.6 TFLOPS 19.5 TFLOPS 51 TFLOPS
TF32 Tensor Core 312 TFLOPS 366 TFLOPS 312 TFLOPS 756 TFLOPS
FP16/BF16 Tensor Core 181 TFLOPS 733 TFLOPS 624 TFLOPS 1513 TFLOPS
功耗 最高 300W 最高 350W 最高 400W 最高 350W
加载中... 加载中... 加载中... 加载中...

关于 AMD Instinct MI210 服务器的常见问题

获取有关部署和运行 MI210 GPU 加速裸金属服务器的常见问题解答,涵盖训练、推理和高性能计算应用。

什么是 AMD Instinct MI210?哪些工作负载受益最大?

AMD Instinct MI210 是一款基于第二代 CDNA™ 架构的企业级计算 GPU,专为计算而非图形优化。它在深度学习训练与推理、科学模拟、计算流体动力学、分子建模以及需要大规模并行处理能力的数据分析方面表现出色。如果您正在为语言模型选择硬件,该问题有专门的页面——请参阅 LLM 托管

MI210 与 MI250 和 MI250X 有何不同?

MI250 和 MI250X 是专为百亿亿次平台打造的 OAM 模块,不在我们的产品目录中。MI210 将相同的第二代 CDNA™ 架构带入标准 PCIe 4.0 卡,配备 64 GB HBM2e,因此可部署在企业级 HPE ProLiant 服务器中,与我们的其他 GPU 选项并列。

AMD Instinct 服务器的典型部署时间是多久?

即时交付服务器通常在付款验证后约 30 分钟内完成配置。定制配置根据组件可用性进行部署。所有 AMD Instinct 服务器均支持即时重装操作系统,无需提交支持工单,从而实现快速迭代。网络基础设施针对持续高吞吐量工作负载和低延迟连接进行了优化。

哪些软件框架和工具支持 AMD Instinct GPU?

AMD Instinct 加速器运行在 ROCm(Radeon Open Compute)上,这是一个开源 GPU 计算平台,支持 PyTorch、TensorFlow、JAX、ONNX Runtime 等主流 ML 框架。ROCm 包含 HIP(异构计算可移植性接口),可轻松移植 CUDA 代码,并提供针对线性代数、FFT、随机数生成和深度神经网络的优化库。通过 Docker 和 Kubernetes 提供完整的容器支持,实现生产级 AI/ML 部署。

MI210 提供怎样的内存?

MI210 搭载 64 GB 带 ECC 的 HBM2e(高带宽内存),提供 1,638 GB/s 的内存带宽。这一容量支持大型数据集和内存密集型 HPC 工作负载,无需频繁在主机与加速器之间搬运内存。系统 RAM 和 NVMe 存储在订单表单中单独配置,因此可独立于加速器进行扩展。