Servere GPU AMD Instinct

Implementează AMD Instinct MI210 pe infrastructură bare metal

Acceleratorul AMD Instinct MI210, cu 64 GB de HBM2e pentru învățare automată și calcul de înaltă performanță, într-un server bare metal pe o platformă Intel Xeon Scalable sau AMD EPYC. Dimensionarea hardware pentru un model de limbaj este o întrebare diferită: pornește de la găzduire LLM.

64 GB HBM2e cu lățime de bandă de memorie de 1.638 GB/s. Arhitectură CDNA™ de a 2-a generație pe o placă PCIe 4.0. Trei linii de servere: două pe Intel Xeon Scalable, una pe AMD EPYC.

Servere bare metal AMD Instinct MI210

Proiectate pentru învățare automată și calcul de înaltă performanță. MI210 îmbină arhitectura de calcul CDNA™ de a 2-a generație cu 64 GB de memorie HBM2e pentru antrenare intensivă, inferență și aplicații HPC.

Debit de calcul maxim

Arhitectura CDNA™ de a 2-a generație oferă performanțe de calcul revoluționare pentru antrenarea deep learning și sarcinile de calcul științific care necesită debit maxim.

Factor de formă PCIe standard

MI210 aduce siliciul din seria MI200 pe o placă PCIe 4.0 standard, astfel încât se montează într-un server obișnuit Xeon Scalable sau EPYC, nu pe o platformă de accelerare specializată.

Capacitate de memorie masivă

64 GB de HBM2e cu ECC permit antrenarea și inferența modelelor la scară largă și a sarcinilor HPC limitate de memorie, cu o lățime de bandă de 1.638 GB/s care menține unitățile de calcul alimentate.

Membrul PCIe al seriei MI200

MI250 și MI250X sunt module OAM pentru platforme exascale specializate. MI210 aduce aceeași arhitectură CDNA™ de a 2-a generație pe o placă PCIe 4.0 standard — motiv pentru care este acceleratorul Instinct de pe raftul nostru.

Arhitectură CDNA™ de a 2-a generație

Siliciu de calcul dedicat, care oferă densitate și eficiență energetică excepționale pentru sarcini de procesare paralelă la scară.

Accelerare AI

Operații matriceale optimizate și calcul cu precizie mixtă pentru antrenare deep learning accelerată, reglare fină a modelelor și implementare de inferență.

Arhitectură de coerență a memoriei

Arhitectura AMD Infinity de a 3-a generație permite comunicare cu lățime de bandă mare și latență redusă între unitățile de calcul GPU și memoria de sistem, pentru un debit maxim al datelor.

Interconectare GPU

Legăturile AMD Infinity Fabric™ permit comunicare peer-to-peer de mare viteză între plăcile MI210 pentru antrenare multi-GPU și sarcini de calcul distribuit.

Servere Intel Xeon Scalable și AMD EPYC pentru sarcini AMD Instinct™

Trei platforme gazdă

MI210 se montează pe liniile Intel Xeon Scalable Silver și Gold, pe cele două linii enterprise construite la comandă (Xeon Gold 6330 până la 6354 pe DDR4, Gold 6438Y pe DDR5) și pe linia AMD EPYC, până la EPYC 7763 cu 64 de nuclee. EPYC îi oferă plăcii un slot PCIe 4.0, generația sa proprie; Silver și Gold îi oferă PCIe 3.0, jumătate din legătura gazdă, ceea ce încetinește o buclă de antrenare care transmite loturi prin magistrală și nu schimbă nimic pentru un server de inferență ale cărui ponderi se află deja în HBM.

Extindere flexibilă

Scalează-ți infrastructura GPU la cerere, cu furnizare rapidă de hardware. Upgrade-urile standard și capacitatea suplimentară sunt de obicei implementate în 24 de ore.

Suport de specialitate

Specialiști în infrastructură GPU disponibili non-stop prin chat live și e-mail pentru a te ajuta cu implementarea, optimizarea și depanarea.

MI210 L40S A100 H100
Arhitectură GPU CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
Memorie GPU 64GB HBM2e 48GB GDDR6 80GB HBM2e 80GB HBM2e
Lățime de bandă memorie GPU 1638 GB/s 864 GB/s 1935 GB/s 2039 GB/s
FP32 22.63 TFLOPS 91.6 TFLOPS 19.5 TFLOPS 51 TFLOPS
TF32 Tensor Core — 366 TFLOPS 312 TFLOPS 756 TFLOPS
FP16/BF16 Tensor Core 181 TFLOPS 733 TFLOPS 624 TFLOPS 1513 TFLOPS
Putere Până la 300W Până la 350W Până la 300W Până la 350W
Doar placa, pe lună Se încarcă... Se încarcă... Se încarcă... Se încarcă...

NVIDIA publică cifrele tensor-core pentru L40S, A100 și H100 cu raritate structurată, așa că înjumătățește acele celule pentru lucrul cu matrice dense. AMD citează cei 181 TFLOPS ai MI210 fără factor de raritate, ceea ce face ca rândul FP16/BF16 să fie o cifră densă lângă trei cifre rare. MI210 nu are mod TF32, de unde liniuța din acel rând.

Întrebări frecvente despre serverele AMD Instinct MI210

Obține răspunsuri la întrebările frecvente despre implementarea și operarea serverelor bare metal accelerate GPU MI210 pentru antrenare, inferență și aplicații de calcul de înaltă performanță.

Ce este AMD Instinct MI210 și ce sarcini beneficiază cel mai mult?

AMD Instinct MI210 este un GPU de calcul de nivel enterprise, construit pe arhitectura CDNA™ de a 2-a generație, optimizat pentru calcul, nu pentru grafică. Excelează la antrenarea și inferența deep learning, simulări științifice, dinamica computațională a fluidelor, modelare moleculară și analiza datelor care necesită capacități masive de procesare paralelă. Dacă alegi hardware pentru un model de limbaj, acea întrebare are propria pagină — vezi găzduire LLM.

Cum diferă MI210 de MI250 și MI250X?

MI250 și MI250X sunt module OAM construite pentru platforme exascale specializate și nu fac parte din catalogul nostru. MI210 aduce aceeași arhitectură CDNA™ de a 2-a generație pe o placă PCIe 4.0 standard cu 64 GB de HBM2e, motiv pentru care intră în aceleași servere Xeon Scalable și EPYC ca și celelalte opțiuni GPU ale noastre.

Care este timpul tipic de implementare pentru serverele AMD Instinct?

O mașină deja montată în rack cu un MI210 este livrată în aproximativ 30 de minute de la verificarea plății. Când montăm o placă pe care o avem în stoc, durează între 4 și 24 de ore; o placă pe care trebuie să o cumpărăm durează cinci până la zece zile lucrătoare, iar tu ești anunțat care variantă se aplică înainte de a plăti. Toate serverele AMD Instinct acceptă reinstalarea instantanee a sistemului de operare fără a necesita tichete de suport, permițând iterații rapide. Infrastructura de rețea este optimizată pentru sarcini susținute cu debit mare și conectivitate cu latență redusă.

Ce framework-uri și instrumente software acceptă GPU-urile AMD Instinct?

Acceleratoarele AMD Instinct rulează pe ROCm (Radeon Open Compute), o platformă de calcul GPU open-source care acceptă PyTorch, TensorFlow, JAX, ONNX Runtime și alte framework-uri ML de top. ROCm include HIP (Heterogeneous-Compute Interface for Portability), care permite portarea simplă a codului CUDA, plus biblioteci optimizate pentru algebră liniară, FFT, generare de numere aleatorii și rețele neuronale profunde. Suportul complet pentru containere prin Docker și Kubernetes permite implementarea AI/ML la scară de producție.

Ce memorie oferă MI210?

MI210 dispune de 64 GB de HBM2e (High Bandwidth Memory) cu ECC, oferind o lățime de bandă de memorie de 1.638 GB/s. Această capacitate susține seturi mari de date și sarcini HPC limitate de memorie, fără transferuri constante de memorie între gazdă și accelerator. RAM-ul de sistem și stocarea NVMe sunt configurate separat în formularul de comandă, astfel încât se scalează independent de accelerator.