Servere GPU AMD Instinct

Implementați AMD Instinct MI210 pe infrastructură bare metal

Un server bare metal de nivel enterprise HPE cu acceleratorul AMD Instinct MI210 — 64 GB de HBM2e pentru învățare automată și calcul de înaltă performanță. Dimensionarea hardware pentru un model de limbaj este o întrebare diferită: începeți în schimb de la găzduire LLM.

64 GB HBM2e cu lățime de bandă de memorie de 1.638 GB/s. Arhitectură CDNA™ de a 2-a generație pe o placă PCIe 4.0. Infrastructură enterprise HPE ProLiant.

Servere bare metal AMD Instinct MI210

Proiectate pentru învățare automată și calcul de înaltă performanță. MI210 îmbină arhitectura de calcul CDNA™ de a 2-a generație cu 64 GB de memorie HBM2e pentru antrenare intensivă, inferență și aplicații HPC.

Debit de calcul maxim

Arhitectura CDNA™ de a 2-a generație oferă performanțe de calcul revoluționare pentru antrenarea învățării profunde și sarcinile de calcul științific care necesită debit maxim.

Factor de formă PCIe standard

MI210 aduce siliciul din seria MI200 pe o placă PCIe 4.0 standard, astfel încât se implementează în servere enterprise HPE ProLiant, nu în platforme de accelerare specializate.

Capacitate masivă de memorie

64 GB de HBM2e cu ECC permit antrenarea și inferența modelelor la scară largă și a sarcinilor HPC limitate de memorie, cu o lățime de bandă de 1.638 GB/s care menține unitățile de calcul alimentate.

Membrul PCIe al seriei MI200

MI250 și MI250X sunt module OAM pentru platforme exascale specializate. MI210 aduce aceeași arhitectură CDNA™ de a 2-a generație pe o placă PCIe 4.0 standard — motiv pentru care este acceleratorul Instinct de pe raftul nostru.

Arhitectură CDNA™ de a 2-a generație

Siliciu de calcul dedicat, care oferă densitate și eficiență energetică excepționale pentru sarcini de procesare paralelă la scară.

Accelerare AI

Operații matriceale optimizate și calcul cu precizie mixtă pentru antrenarea accelerată a învățării profunde, reglarea fină a modelelor și implementarea inferenței.

Arhitectură de coerență a memoriei

Arhitectura AMD Infinity de a 3-a generație permite comunicare cu lățime de bandă mare și latență redusă între unitățile de calcul GPU și memoria de sistem pentru un debit maxim de date.

Interconectare GPU

Legăturile AMD Infinity Fabric™ permit comunicare peer-to-peer de mare viteză între plăcile MI210 pentru antrenare multi-GPU și sarcini de calcul distribuit.

Infrastructură enterprise HPE pentru sarcini AMD Instinct™

Platformă HPE ProLiant

Acceleratoarele AMD Instinct implementate pe servere enterprise HPE ProLiant oferă fiabilitate de nivel operator și performanțe constante pentru sarcinile de producție AI și HPC.

Extindere flexibilă

Scalați infrastructura GPU la cerere cu furnizare rapidă de hardware. Upgrade-urile standard și capacitatea suplimentară sunt de obicei implementate în 24 de ore.

Suport de specialitate

Specialiști în infrastructura GPU disponibili non-stop prin chat live și e-mail pentru a vă asista cu implementarea, optimizarea și depanarea.

MI210 L40S A100 H100
Arhitectură GPU CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
Memorie GPU 64GB HBM2e 48GB GDDR6 80GB HBM2e 80GB HBM3
Lățime de bandă memorie GPU 1638 GB/s 864 GB/s 1935 GB/s 3352 GB/s
FP32 22.63 TFLOPS 91.6 TFLOPS 19.5 TFLOPS 51 TFLOPS
TF32 Tensor Core 312 TFLOPS 366 TFLOPS 312 TFLOPS 756 TFLOPS
FP16/BF16 Tensor Core 181 TFLOPS 733 TFLOPS 624 TFLOPS 1513 TFLOPS
Putere Până la 300W Până la 350W Până la 400W Până la 350W
Se încarcă... Se încarcă... Se încarcă... Se încarcă...

Întrebări frecvente despre serverele AMD Instinct MI210

Obțineți răspunsuri la întrebările frecvente despre implementarea și operarea serverelor bare metal accelerate cu GPU MI210 pentru antrenare, inferență și aplicații de calcul de înaltă performanță.

Ce este AMD Instinct MI210 și ce sarcini beneficiază cel mai mult?

AMD Instinct MI210 este un GPU de calcul de nivel enterprise construit pe arhitectura CDNA™ de a 2-a generație, optimizat pentru calcul, nu pentru grafică. Excelează la antrenarea și inferența învățării profunde, simulări științifice, dinamica computațională a fluidelor, modelare moleculară și analiza datelor care necesită capacități masive de procesare paralelă. Dacă alegeți hardware pentru un model de limbaj, această întrebare are propria pagină — vedeți găzduire LLM.

Cum diferă MI210 de MI250 și MI250X?

MI250 și MI250X sunt module OAM construite pentru platforme exascale specializate și nu fac parte din catalogul nostru. MI210 aduce aceeași arhitectură CDNA™ de a 2-a generație pe o placă PCIe 4.0 standard cu 64 GB de HBM2e, motiv pentru care se implementează în servere enterprise HPE ProLiant alături de celelalte opțiuni GPU ale noastre.

Care este timpul tipic de implementare pentru serverele AMD Instinct?

Serverele cu livrare instantanee sunt de obicei furnizate în ~30 minute după verificarea plății. Configurațiile personalizate se implementează în funcție de disponibilitatea componentelor. Toate serverele AMD Instinct acceptă reîncărcarea instantanee a sistemului de operare fără a necesita tichete de suport, permițând iterații rapide. Infrastructura de rețea este optimizată pentru sarcini susținute cu debit mare și conectivitate cu latență redusă.

Ce framework-uri și instrumente software acceptă GPU-urile AMD Instinct?

Acceleratoarele AMD Instinct rulează pe ROCm (Radeon Open Compute), o platformă de calcul GPU open-source care acceptă PyTorch, TensorFlow, JAX, ONNX Runtime și alte framework-uri ML de top. ROCm include HIP (Heterogeneous-Compute Interface for Portability) care permite portarea simplă a codului CUDA, plus biblioteci optimizate pentru algebră liniară, FFT, generarea numerelor aleatorii și rețele neuronale profunde. Suportul complet pentru containere prin Docker și Kubernetes permite implementarea AI/ML la scară de producție.

Ce memorie oferă MI210?

MI210 dispune de 64 GB de HBM2e (High Bandwidth Memory) cu ECC, oferind o lățime de bandă de memorie de 1.638 GB/s. Această capacitate acceptă seturi mari de date și sarcini HPC limitate de memorie fără transferuri constante de memorie între gazdă și accelerator. RAM-ul de sistem și stocarea NVMe sunt configurate separat în formularul de comandă, astfel încât se scalează independent de accelerator.