Servidores GPU AMD Instinct

Implemente a AMD Instinct MI210 em infraestrutura bare metal

O acelerador AMD Instinct MI210, com 64 GB de HBM2e para aprendizado de máquina e computação de alto desempenho, em um servidor bare metal sobre plataforma Intel Xeon Scalable ou AMD EPYC. Dimensionar hardware para um modelo de linguagem é uma questão diferente: comece pela página de hospedagem de LLM.

64 GB HBM2e com 1.638 GB/s de largura de banda de memória. Arquitetura CDNA™ de 2ª geração em placa PCIe 4.0. Três linhas de servidores: duas em Intel Xeon Scalable, uma em AMD EPYC.

Servidores bare metal AMD Instinct MI210

Projetados para aprendizado de máquina e computação de alto desempenho. O MI210 combina a arquitetura de computação CDNA™ de 2ª geração com 64 GB de memória HBM2e para treinamento intensivo, inferência e aplicações HPC.

Máximo rendimento computacional

A arquitetura CDNA™ de 2ª geração oferece desempenho computacional revolucionário para treinamento de aprendizado profundo e cargas de trabalho de computação científica que exigem rendimento máximo.

Formato PCIe padrão

O MI210 traz o silício da série MI200 para uma placa PCIe 4.0 padrão, encaixando-se em um servidor Xeon Scalable ou EPYC comum, em vez de uma plataforma aceleradora especializada.

Capacidade de memória massiva

64 GB de HBM2e com ECC permitem treinar e inferir modelos de grande escala e cargas HPC limitadas por memória, com 1.638 GB/s de largura de banda mantendo as unidades de computação alimentadas.

O membro PCIe da série MI200

Os MI250 e MI250X são módulos OAM para plataformas exascale especializadas. O MI210 traz a mesma arquitetura CDNA™ de 2ª geração para uma placa PCIe 4.0 padrão — e é por isso que ele é o acelerador Instinct em nosso catálogo.

Arquitetura CDNA™ de 2ª geração

Silício de computação construído sob medida, com densidade e eficiência energética excepcionais para cargas de processamento paralelo em escala.

Aceleração de IA

Operações matriciais otimizadas e computação de precisão mista para treinamento acelerado de aprendizado profundo, ajuste fino de modelos e implantação de inferência.

Arquitetura de coerência de memória

A arquitetura AMD Infinity de 3ª geração permite comunicação de alta largura de banda e baixa latência entre as unidades de computação da GPU e a memória do sistema, maximizando o fluxo de dados.

Interconexão de GPU

Os links AMD Infinity Fabric™ permitem comunicação peer-to-peer de alta velocidade entre placas MI210 para treinamento multi-GPU e cargas de computação distribuída.

Servidores Intel Xeon Scalable e AMD EPYC para cargas de trabalho AMD Instinct™

Três plataformas de host

O MI210 é oferecido na linha Intel Xeon Scalable Silver e Gold, nas duas linhas empresariais montadas sob encomenda (Xeon Gold 6330 a 6354 em DDR4, Gold 6438Y em DDR5) e na linha AMD EPYC, até o EPYC 7763 de 64 núcleos. O EPYC dá à placa um slot PCIe 4.0, sua própria geração; Silver e Gold dão PCIe 3.0, metade do link do host, o que reduz a velocidade de um loop de treinamento que transmite lotes pelo barramento e não muda nada para um servidor de inferência cujos pesos já estão na HBM.

Expansão flexível

Escale sua infraestrutura de GPU sob demanda com provisionamento rápido de hardware. Upgrades padrão e capacidade adicional normalmente implantados em até 24 horas.

Suporte especializado

Especialistas em infraestrutura de GPU disponíveis 24 horas por dia, via chat ao vivo e e-mail, para auxiliar na implantação, otimização e solução de problemas.

MI210 L40S A100 H100
Arquitetura da GPU CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
Memória da GPU 64GB HBM2e 48GB GDDR6 80GB HBM2e 80GB HBM2e
Largura de banda da memória da GPU 1638 GB/s 864 GB/s 1935 GB/s 2039 GB/s
FP32 22,63 TFLOPS 91,6 TFLOPS 19,5 TFLOPS 51 TFLOPS
Núcleo Tensor TF32 — 366 TFLOPS 312 TFLOPS 756 TFLOPS
Núcleo Tensor FP16/BF16 181 TFLOPS 733 TFLOPS 624 TFLOPS 1513 TFLOPS
Consumo Até 300W Até 350W Até 300W Até 350W
Apenas a placa, por mês Carregando... Carregando... Carregando... Carregando...

A NVIDIA publica os números de núcleo tensor da L40S, A100 e H100 com esparsidade estruturada, então divida essas células pela metade para trabalho com matrizes densas. A AMD cita os 181 TFLOPS do MI210 sem fator de esparsidade, o que torna a linha FP16/BF16 um número denso ao lado de três esparsos. O MI210 não tem modo TF32, daí o travessão nessa linha.

Perguntas frequentes sobre servidores AMD Instinct MI210

Obtenha respostas para perguntas comuns sobre a implantação e operação de servidores bare metal acelerados por GPU MI210 para treinamento, inferência e aplicações de computação de alto desempenho.

O que é a AMD Instinct MI210 e quais cargas de trabalho mais se beneficiam?

A AMD Instinct MI210 é uma GPU de computação de nível empresarial construída sobre a arquitetura CDNA™ de 2ª geração, otimizada para computação em vez de gráficos. Ela se destaca em treinamento e inferência de aprendizado profundo, simulações científicas, dinâmica de fluidos computacional, modelagem molecular e análise de dados que exigem capacidades massivas de processamento paralelo. Se você está escolhendo hardware para um modelo de linguagem, essa questão tem página própria — veja hospedagem de LLM.

Como o MI210 difere do MI250 e do MI250X?

Os MI250 e MI250X são módulos OAM construídos para plataformas exascale especializadas e não fazem parte do nosso catálogo. O MI210 traz a mesma arquitetura CDNA™ de 2ª geração para uma placa PCIe 4.0 padrão com 64 GB de HBM2e, e é por isso que ele entra nos mesmos servidores Xeon Scalable e EPYC que nossas outras opções de GPU.

Qual é o tempo típico de implantação para servidores AMD Instinct?

Uma máquina já montada em rack com um MI210 é entregue em cerca de 30 minutos após a verificação do pagamento. Quando instalamos uma placa que temos em estoque, leva de 4 a 24 horas; uma placa que precisamos comprar leva de cinco a dez dias úteis, e você é informado de qual caso se trata antes de pagar. Todos os servidores AMD Instinct suportam recarga instantânea do sistema operacional sem necessidade de tickets de suporte, permitindo iteração rápida. A infraestrutura de rede é otimizada para cargas de trabalho sustentadas de alto rendimento e conectividade de baixa latência.

Quais frameworks de software e ferramentas suportam GPUs AMD Instinct?

Os aceleradores AMD Instinct rodam em ROCm (Radeon Open Compute), uma plataforma de computação GPU de código aberto com suporte a PyTorch, TensorFlow, JAX, ONNX Runtime e outros frameworks líderes de ML. O ROCm inclui HIP (Heterogeneous-Compute Interface for Portability), permitindo portabilidade direta de código CUDA, além de bibliotecas otimizadas para álgebra linear, FFT, geração de números aleatórios e redes neurais profundas. O suporte completo a contêineres via Docker e Kubernetes permite implantação de IA/ML em escala de produção.

Que memória o MI210 oferece?

O MI210 carrega 64 GB de HBM2e (High Bandwidth Memory) com ECC, entregando 1.638 GB/s de largura de banda de memória. Essa capacidade suporta grandes conjuntos de dados e cargas HPC limitadas por memória sem constante troca de memória entre host e acelerador. RAM do sistema e armazenamento NVMe são configurados separadamente no formulário de pedido, escalando de forma independente do acelerador.