Servidores GPU AMD Instinct

Implemente la AMD Instinct MI210 en infraestructura de bare metal

El acelerador AMD Instinct MI210, con 64 GB de HBM2e para aprendizaje automático y computación de alto rendimiento, en un servidor bare metal sobre plataforma Intel Xeon Scalable o AMD EPYC. Dimensionar hardware para un modelo de lenguaje es una cuestión distinta: empiece por alojamiento de LLM.

64 GB HBM2e con 1.638 GB/s de ancho de banda de memoria. Arquitectura CDNA™ de 2.ª generación en una tarjeta PCIe 4.0. Tres líneas de servidores: dos sobre Intel Xeon Scalable, una sobre AMD EPYC.

Servidores bare metal AMD Instinct MI210

Diseñados para aprendizaje automático y computación de alto rendimiento. El MI210 combina la arquitectura de cómputo CDNA™ de 2.ª generación con 64 GB de memoria HBM2e para entrenamiento intensivo, inferencia y aplicaciones HPC.

Máximo rendimiento de cómputo

La arquitectura CDNA™ de 2.ª generación ofrece un rendimiento de cómputo revolucionario para entrenamiento de aprendizaje profundo y cargas de trabajo de computación científica que requieren el máximo rendimiento.

Factor de forma PCIe estándar

El MI210 incorpora el silicio de la serie MI200 a una tarjeta PCIe 4.0 estándar, de modo que se instala en un servidor Xeon Scalable o EPYC común en lugar de una plataforma aceleradora especializada.

Capacidad de memoria masiva

64 GB de HBM2e con ECC permiten entrenar e inferir modelos a gran escala y cargas de trabajo HPC limitadas por memoria, con 1.638 GB/s de ancho de banda que mantienen alimentadas las unidades de cómputo.

El miembro PCIe de la serie MI200

Los MI250 y MI250X son módulos OAM para plataformas exaescala especializadas. El MI210 lleva la misma arquitectura CDNA™ de 2.ª generación a una tarjeta PCIe 4.0 estándar, y por eso es el acelerador Instinct que tenemos en nuestro catálogo.

Arquitectura CDNA™ de 2.ª generación

Silicio de cómputo diseñado específicamente que ofrece una densidad y eficiencia energética excepcionales para cargas de trabajo de procesamiento paralelo a escala.

Aceleración de IA

Operaciones matriciales optimizadas y cómputo de precisión mixta para entrenamiento acelerado de aprendizaje profundo, ajuste fino de modelos e implementación de inferencia.

Arquitectura de coherencia de memoria

La arquitectura AMD Infinity de 3.ª generación permite una comunicación de alto ancho de banda y baja latencia entre las unidades de cómputo de la GPU y la memoria del sistema para maximizar el rendimiento de datos.

Interconexión de GPU

Los enlaces AMD Infinity Fabric™ permiten una comunicación de alta velocidad entre pares de tarjetas MI210 para entrenamiento multi-GPU y cargas de trabajo de computación distribuida.

Servidores Intel Xeon Scalable y AMD EPYC para cargas de trabajo AMD Instinct™

Tres plataformas host

El MI210 se monta en la línea Intel Xeon Scalable Silver y Gold, en las dos líneas empresariales bajo pedido (Xeon Gold 6330 a 6354 con DDR4, Gold 6438Y con DDR5) y en la línea AMD EPYC, hasta el EPYC 7763 de 64 núcleos. EPYC le da a la tarjeta una ranura PCIe 4.0, su propia generación; Silver y Gold le dan PCIe 3.0, la mitad del enlace con el host, lo que ralentiza un bucle de entrenamiento que transmite lotes por el bus y no cambia nada para un servidor de inferencia cuyos pesos ya residen en HBM.

Expansión flexible

Escale su infraestructura de GPU bajo demanda con aprovisionamiento rápido de hardware. Las actualizaciones estándar y la capacidad adicional suelen desplegarse en un plazo de 24 horas.

Soporte experto

Especialistas en infraestructura de GPU disponibles las 24 horas mediante chat en vivo y correo electrónico para asistir en la implementación, optimización y resolución de problemas.

MI210 L40S A100 H100
Arquitectura de GPU CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
Memoria de GPU 64 GB HBM2e 48 GB GDDR6 80 GB HBM2e 80 GB HBM2e
Ancho de banda de memoria de GPU 1638 GB/s 864 GB/s 1935 GB/s 2039 GB/s
FP32 22,63 TFLOPS 91,6 TFLOPS 19,5 TFLOPS 51 TFLOPS
Núcleo tensorial TF32 — 366 TFLOPS 312 TFLOPS 756 TFLOPS
Núcleo tensorial FP16/BF16 181 TFLOPS 733 TFLOPS 624 TFLOPS 1513 TFLOPS
Potencia Hasta 300 W Hasta 350 W Hasta 300 W Hasta 350 W
Solo la tarjeta, al mes Cargando... Cargando... Cargando... Cargando...

NVIDIA publica las cifras de núcleos tensoriales de la L40S, A100 y H100 con dispersión estructurada, así que divida esas celdas a la mitad para trabajo con matrices densas. AMD cita los 181 TFLOPS del MI210 sin factor de dispersión, lo que convierte la fila FP16/BF16 en una cifra densa junto a tres dispersas. El MI210 no tiene modo TF32, de ahí el guion en esa fila.

Preguntas frecuentes sobre los servidores AMD Instinct MI210

Obtenga respuestas a preguntas habituales sobre la implementación y operación de servidores bare metal acelerados por GPU MI210 para entrenamiento, inferencia y aplicaciones de computación de alto rendimiento.

¿Qué es la AMD Instinct MI210 y qué cargas de trabajo se benefician más?

La AMD Instinct MI210 es una GPU de cómputo de nivel empresarial construida sobre la arquitectura CDNA™ de 2.ª generación, optimizada para cómputo en lugar de gráficos. Destaca en entrenamiento e inferencia de aprendizaje profundo, simulaciones científicas, dinámica de fluidos computacional, modelado molecular y análisis de datos que requieren capacidades masivas de procesamiento paralelo. Si está eligiendo hardware para un modelo de lenguaje, esa cuestión tiene su propia página; consulte alojamiento de LLM.

¿En qué se diferencia la MI210 de las MI250 y MI250X?

Las MI250 y MI250X son módulos OAM construidos para plataformas exaescala especializadas y no forman parte de nuestro catálogo. La MI210 lleva la misma arquitectura CDNA™ de 2.ª generación a una tarjeta PCIe 4.0 estándar con 64 GB de HBM2e, por lo que se instala en los mismos servidores Xeon Scalable y EPYC que nuestras otras opciones de GPU.

¿Cuál es el tiempo de implementación típico de los servidores AMD Instinct?

Una máquina ya montada en bastidor con una MI210 se entrega en unos 30 minutos tras la verificación del pago. Cuando instalamos una tarjeta que tenemos en stock, tarda de 4 a 24 horas; una tarjeta que debemos comprar tarda de cinco a diez días laborables, y se le informa de cuál es el caso antes de pagar. Todos los servidores AMD Instinct admiten la recarga instantánea del sistema operativo sin necesidad de tickets de soporte, lo que permite una iteración rápida. La infraestructura de red está optimizada para cargas de trabajo sostenidas de alto rendimiento y conectividad de baja latencia.

¿Qué frameworks y herramientas de software admiten las GPU AMD Instinct?

Los aceleradores AMD Instinct se ejecutan sobre ROCm (Radeon Open Compute), una plataforma de cómputo GPU de código abierto compatible con PyTorch, TensorFlow, JAX, ONNX Runtime y otros frameworks de ML líderes. ROCm incluye HIP (Heterogeneous-Compute Interface for Portability), que permite portar código CUDA de forma sencilla, además de bibliotecas optimizadas para álgebra lineal, FFT, generación de números aleatorios y redes neuronales profundas. El soporte completo de contenedores mediante Docker y Kubernetes permite implementaciones de IA/ML a escala de producción.

¿Qué memoria ofrece la MI210?

La MI210 incorpora 64 GB de HBM2e (memoria de alto ancho de banda) con ECC, que ofrecen 1.638 GB/s de ancho de banda de memoria. Esa capacidad admite grandes conjuntos de datos y cargas de trabajo HPC limitadas por memoria sin un trasiego constante entre la memoria del host y la del acelerador. La RAM del sistema y el almacenamiento NVMe se configuran por separado en el formulario de pedido, de modo que escalan independientemente del acelerador.