Serveurs GPU AMD Instinct

Déployez l'AMD Instinct MI210 sur une infrastructure bare metal

L'accélérateur AMD Instinct MI210, avec 64 Go de HBM2e pour le machine learning et le calcul haute performance, dans un serveur bare metal sur plateforme Intel Xeon Scalable ou AMD EPYC. Dimensionner le matériel pour un modèle de langage est une autre question : commencez plutôt par l'hébergement LLM.

64 Go de HBM2e avec une bande passante mémoire de 1 638 Go/s. Architecture CDNA™ de 2e génération sur une carte PCIe 4.0. Trois gammes de serveurs : deux sur Intel Xeon Scalable, une sur AMD EPYC.

Serveurs bare metal AMD Instinct MI210

Conçus pour le machine learning et le calcul haute performance. Le MI210 associe l'architecture de calcul CDNA™ de 2e génération à 64 Go de mémoire HBM2e pour l'entraînement intensif, l'inférence et les applications HPC.

Débit de calcul maximal

L'architecture CDNA™ de 2e génération offre des performances de calcul révolutionnaires pour l'entraînement en deep learning et les charges de calcul scientifique exigeant un débit maximal.

Format PCIe standard

Le MI210 intègre le silicium de la série MI200 dans une carte PCIe 4.0 standard, ce qui lui permet de s'insérer dans un serveur Xeon Scalable ou EPYC ordinaire plutôt que dans une plateforme d'accélération spécialisée.

Capacité mémoire massive

64 Go de HBM2e avec ECC permettent l'entraînement et l'inférence de modèles à grande échelle ainsi que les charges HPC limitées par la mémoire, avec une bande passante de 1 638 Go/s qui alimente en continu les unités de calcul.

Le membre PCIe de la série MI200

Les MI250 et MI250X sont des modules OAM destinés aux plateformes exascale spécialisées. Le MI210 apporte la même architecture CDNA™ de 2e génération sur une carte PCIe 4.0 standard — c'est pourquoi c'est l'accélérateur Instinct que nous proposons.

Architecture CDNA™ de 2e génération

Silicium de calcul spécialement conçu offrant une densité et une efficacité énergétique exceptionnelles pour les charges de traitement parallèle à grande échelle.

Accélération de l'IA

Opérations matricielles optimisées et calcul en précision mixte pour l'entraînement accéléré en deep learning, le fine-tuning de modèles et le déploiement d'inférence.

Architecture de cohérence mémoire

L'architecture AMD Infinity de 3e génération permet une communication à haute bande passante et faible latence entre les unités de calcul GPU et la mémoire système pour un débit de données maximisé.

Interconnexion GPU

Les liaisons AMD Infinity Fabric™ permettent une communication peer-to-peer à haute vitesse entre les cartes MI210 pour l'entraînement multi-GPU et les charges de calcul distribué.

Serveurs Intel Xeon Scalable et AMD EPYC pour les charges AMD Instinct™

Trois plateformes hôtes

Le MI210 s'installe sur les gammes Intel Xeon Scalable Silver et Gold, sur les deux gammes entreprise montées à la demande (Xeon Gold 6330 à 6354 sur DDR4, Gold 6438Y sur DDR5), et sur la gamme AMD EPYC, jusqu'à l'EPYC 7763 à 64 cœurs. L'EPYC offre à la carte un slot PCIe 4.0, sa propre génération ; Silver et Gold lui offrent du PCIe 3.0, soit la moitié du lien hôte, ce qui ralentit une boucle d'entraînement qui transfère les lots sur le bus et ne change rien pour un serveur d'inférence dont les poids résident déjà en HBM.

Extension flexible

Faites évoluer votre infrastructure GPU à la demande grâce à un provisionnement matériel rapide. Les mises à niveau standard et la capacité supplémentaire sont généralement déployées sous 24 heures.

Support expert

Des spécialistes de l'infrastructure GPU disponibles 24h/24 et 7j/7 par chat en direct et par e-mail pour vous aider au déploiement, à l'optimisation et au dépannage.

MI210 L40S A100 H100
Architecture GPU CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
Mémoire GPU 64 Go HBM2e 48 Go GDDR6 80 Go HBM2e 80 Go HBM2e
Bande passante mémoire GPU 1 638 Go/s 864 Go/s 1 935 Go/s 2 039 Go/s
FP32 22,63 TFLOPS 91,6 TFLOPS 19,5 TFLOPS 51 TFLOPS
TF32 Tensor Core — 366 TFLOPS 312 TFLOPS 756 TFLOPS
FP16/BF16 Tensor Core 181 TFLOPS 733 TFLOPS 624 TFLOPS 1 513 TFLOPS
Consommation Jusqu'à 300 W Jusqu'à 350 W Jusqu'à 300 W Jusqu'à 350 W
La carte seule, par mois Chargement... Chargement... Chargement... Chargement...

NVIDIA publie les chiffres des tensor cores des L40S, A100 et H100 avec sparsité structurée : divisez donc ces cellules par deux pour le calcul matriciel dense. AMD annonce les 181 TFLOPS du MI210 sans facteur de sparsité, ce qui fait de la ligne FP16/BF16 un chiffre dense à côté de trois chiffres creux. Le MI210 n'a pas de mode TF32, d'où le tiret dans cette ligne.

Questions fréquentes sur les serveurs AMD Instinct MI210

Obtenez des réponses aux questions courantes sur le déploiement et l'exploitation de serveurs bare metal accélérés par GPU MI210 pour l'entraînement, l'inférence et les applications de calcul haute performance.

Qu'est-ce que l'AMD Instinct MI210 et quelles charges en bénéficient le plus ?

L'AMD Instinct MI210 est un GPU de calcul de qualité entreprise construit sur l'architecture CDNA™ de 2e génération, optimisé pour le calcul plutôt que pour le graphisme. Il excelle dans l'entraînement et l'inférence en deep learning, les simulations scientifiques, la mécanique des fluides numérique, la modélisation moléculaire et l'analyse de données exigeant des capacités massives de traitement parallèle. Si vous choisissez du matériel pour un modèle de langage, cette question a sa propre page — voir l'hébergement LLM.

En quoi le MI210 diffère-t-il des MI250 et MI250X ?

Les MI250 et MI250X sont des modules OAM conçus pour des plateformes exascale spécialisées et ne font pas partie de notre catalogue. Le MI210 apporte la même architecture CDNA™ de 2e génération sur une carte PCIe 4.0 standard avec 64 Go de HBM2e, ce qui lui permet de s'intégrer aux mêmes serveurs Xeon Scalable et EPYC que nos autres options GPU.

Quel est le délai de déploiement typique des serveurs AMD Instinct ?

Une machine déjà en baie avec un MI210 est livrée environ 30 minutes après la vérification du paiement. Lorsque nous installons une carte que nous avons en stock, cela prend de 4 à 24 heures ; une carte que nous devons acheter prend de cinq à dix jours ouvrés, et vous êtes informé avant de payer. Tous les serveurs AMD Instinct prennent en charge la réinstallation instantanée du système d'exploitation sans ticket de support, permettant une itération rapide. L'infrastructure réseau est optimisée pour les charges soutenues à haut débit et la connectivité à faible latence.

Quels frameworks logiciels et outils prennent en charge les GPU AMD Instinct ?

Les accélérateurs AMD Instinct fonctionnent sur ROCm (Radeon Open Compute), une plateforme de calcul GPU open source prenant en charge PyTorch, TensorFlow, JAX, ONNX Runtime et d'autres frameworks ML de premier plan. ROCm inclut HIP (Heterogeneous-Compute Interface for Portability) permettant un portage simple du code CUDA, ainsi que des bibliothèques optimisées pour l'algèbre linéaire, la FFT, la génération de nombres aléatoires et les réseaux de neurones profonds. La prise en charge complète des conteneurs via Docker et Kubernetes permet un déploiement AI/ML à l'échelle de la production.

Quelle mémoire le MI210 fournit-il ?

Le MI210 embarque 64 Go de HBM2e (High Bandwidth Memory) avec ECC, offrant une bande passante mémoire de 1 638 Go/s. Cette capacité prend en charge de grands ensembles de données et des charges HPC limitées par la mémoire sans brassage constant entre la mémoire hôte et l'accélérateur. La RAM système et le stockage NVMe sont configurés séparément sur le formulaire de commande, ils évoluent donc indépendamment de l'accélérateur.