AMD Instinct GPU-Server

Setzen Sie die AMD Instinct MI210 auf Bare-Metal-Infrastruktur ein

Der AMD Instinct MI210-Beschleuniger mit 64 GB HBM2e für maschinelles Lernen und High-Performance-Computing in einem Bare-Metal-Server auf einer Intel Xeon Scalable- oder AMD EPYC-Plattform. Die Hardware für ein Sprachmodell zu dimensionieren ist eine andere Frage: Beginnen Sie stattdessen mit LLM-Hosting.

64 GB HBM2e mit 1.638 GB/s Speicherbandbreite. CDNA™-Architektur der 2. Generation auf einer PCIe-4.0-Karte. Drei Serverlinien: zwei auf Intel Xeon Scalable, eine auf AMD EPYC.

AMD Instinct MI210 Bare-Metal-Server

Entwickelt für maschinelles Lernen und High-Performance-Computing. Die MI210 kombiniert die CDNA™-Rechenarchitektur der 2. Generation mit 64 GB HBM2e-Speicher für intensives Training, Inferenz und HPC-Anwendungen.

Maximaler Rechendurchsatz

Die CDNA™-Architektur der 2. Generation liefert bahnbrechende Rechenleistung für Deep-Learning-Training und wissenschaftliche Rechenworkloads, die maximalen Durchsatz erfordern.

Standard-PCIe-Formfaktor

Die MI210 bringt die Siliziumtechnologie der MI200-Serie auf eine Standard-PCIe-4.0-Karte und passt damit in einen gewöhnlichen Xeon Scalable- oder EPYC-Server statt in eine spezialisierte Beschleunigerplattform.

Massive Speicherkapazität

64 GB HBM2e mit ECC ermöglichen Training und Inferenz großer Modelle und speichergebundener HPC-Workloads, wobei 1.638 GB/s Bandbreite die Recheneinheiten kontinuierlich versorgen.

Das PCIe-Mitglied der MI200-Serie

Die MI250 und MI250X sind OAM-Module für spezialisierte Exascale-Plattformen. Die MI210 bringt dieselbe CDNA™-Architektur der 2. Generation auf eine Standard-PCIe-4.0-Karte – deshalb ist sie der Instinct-Beschleuniger in unserem Sortiment.

CDNA™-Architektur der 2. Generation

Speziell entwickelte Rechen-Siliziumtechnologie mit außergewöhnlicher Dichte und Energieeffizienz für parallele Verarbeitungs-Workloads in großem Maßstab.

KI-Beschleunigung

Optimierte Matrixoperationen und Mixed-Precision-Computing für beschleunigtes Deep-Learning-Training, Modell-Feintuning und Inferenz-Bereitstellung.

Speicherkohärenz-Architektur

Die AMD Infinity-Architektur der 3. Generation ermöglicht Kommunikation mit hoher Bandbreite und niedriger Latenz zwischen GPU-Recheneinheiten und Systemspeicher für maximalen Datendurchsatz.

GPU-Interconnect

AMD Infinity Fabric™-Verbindungen ermöglichen schnelle Peer-to-Peer-Kommunikation zwischen MI210-Karten für Multi-GPU-Training und verteilte Rechenworkloads.

Intel Xeon Scalable- und AMD EPYC-Server für AMD Instinct™-Workloads

Drei Host-Plattformen

Die MI210 passt in die Intel Xeon Scalable Silver- und Gold-Linie, in die beiden nach Auftrag gefertigten Enterprise-Linien (Xeon Gold 6330 bis 6354 auf DDR4, Gold 6438Y auf DDR5) und in die AMD EPYC-Linie bis zum 64-Kern-EPYC 7763. EPYC bietet der Karte einen PCIe-4.0-Steckplatz, ihre eigene Generation; Silver und Gold bieten PCIe 3.0, die halbe Host-Verbindung, was eine Trainingsschleife verlangsamt, die Batches über den Bus streamt, und für einen Inferenzserver, dessen Gewichte bereits im HBM liegen, keinen Unterschied macht.

Flexible Erweiterung

Skalieren Sie Ihre GPU-Infrastruktur bei Bedarf mit schneller Hardware-Bereitstellung. Standard-Upgrades und zusätzliche Kapazität werden in der Regel innerhalb von 24 Stunden bereitgestellt.

Experten-Support

GPU-Infrastrukturspezialisten sind rund um die Uhr per Live-Chat und E-Mail erreichbar, um bei Bereitstellung, Optimierung und Fehlerbehebung zu helfen.

MI210 L40S A100 H100
GPU-Architektur CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
GPU-Speicher 64 GB HBM2e 48 GB GDDR6 80 GB HBM2e 80 GB HBM2e
GPU-Speicherbandbreite 1638 GB/s 864 GB/s 1935 GB/s 2039 GB/s
FP32 22,63 TFLOPS 91,6 TFLOPS 19,5 TFLOPS 51 TFLOPS
TF32 Tensor Core — 366 TFLOPS 312 TFLOPS 756 TFLOPS
FP16/BF16 Tensor Core 181 TFLOPS 733 TFLOPS 624 TFLOPS 1513 TFLOPS
Leistung Bis zu 300 W Bis zu 350 W Bis zu 300 W Bis zu 350 W
Nur die Karte, pro Monat Wird geladen... Wird geladen... Wird geladen... Wird geladen...

NVIDIA veröffentlicht die Tensor-Core-Werte für L40S, A100 und H100 mit strukturierter Sparsity; halbieren Sie diese Zellen daher für dichte Matrixarbeit. AMD gibt die 181 TFLOPS der MI210 ohne Sparsity-Faktor an, wodurch die FP16/BF16-Zeile einen dichten Wert neben drei spärlichen zeigt. Die MI210 hat keinen TF32-Modus, daher der Gedankenstrich in dieser Zeile.

Häufig gestellte Fragen zu AMD Instinct MI210-Servern

Erhalten Sie Antworten auf häufige Fragen zur Bereitstellung und zum Betrieb von MI210 GPU-beschleunigten Bare-Metal-Servern für Training, Inferenz und High-Performance-Computing-Anwendungen.

Was ist die AMD Instinct MI210 und welche Workloads profitieren am meisten?

Die AMD Instinct MI210 ist eine Compute-GPU der Enterprise-Klasse auf Basis der CDNA™-Architektur der 2. Generation, optimiert für Rechenleistung statt Grafik. Sie eignet sich hervorragend für Deep-Learning-Training und -Inferenz, wissenschaftliche Simulationen, numerische Strömungsmechanik, Molekülmodellierung und Datenanalysen, die massive parallele Verarbeitungsfähigkeiten erfordern. Wenn Sie Hardware für ein Sprachmodell auswählen, hat diese Frage eine eigene Seite – siehe LLM-Hosting.

Wie unterscheidet sich die MI210 von der MI250 und MI250X?

Die MI250 und MI250X sind OAM-Module für spezialisierte Exascale-Plattformen und nicht Teil unseres Katalogs. Die MI210 bringt dieselbe CDNA™-Architektur der 2. Generation auf eine Standard-PCIe-4.0-Karte mit 64 GB HBM2e und passt daher in dieselben Xeon Scalable- und EPYC-Server wie unsere anderen GPU-Optionen.

Was ist die typische Bereitstellungszeit für AMD Instinct-Server?

Eine bereits mit einer MI210 bestückte Maschine wird innerhalb von etwa 30 Minuten nach Zahlungsbestätigung geliefert. Wenn wir eine Karte einbauen, die wir auf Lager haben, dauert es 4 bis 24 Stunden; eine Karte, die wir erst beschaffen müssen, dauert fünf bis zehn Werktage, und Sie erfahren vor der Zahlung, welcher Fall zutrifft. Alle AMD Instinct-Server unterstützen sofortiges OS-Neuinstallieren ohne Support-Tickets und ermöglichen so schnelle Iteration. Die Netzwerkinfrastruktur ist für anhaltend hohe Durchsatz-Workloads und Verbindungen mit niedriger Latenz optimiert.

Welche Software-Frameworks und Tools unterstützen AMD Instinct-GPUs?

AMD Instinct-Beschleuniger laufen auf ROCm (Radeon Open Compute), einer Open-Source-GPU-Computing-Plattform, die PyTorch, TensorFlow, JAX, ONNX Runtime und andere führende ML-Frameworks unterstützt. ROCm umfasst HIP (Heterogeneous-Compute Interface for Portability) für unkompliziertes Portieren von CUDA-Code sowie optimierte Bibliotheken für lineare Algebra, FFT, Zufallszahlengenerierung und tiefe neuronale Netze. Volle Container-Unterstützung über Docker und Kubernetes ermöglicht KI/ML-Bereitstellung im Produktionsmaßstab.

Welchen Speicher bietet die MI210?

Die MI210 verfügt über 64 GB HBM2e (High Bandwidth Memory) mit ECC und liefert 1.638 GB/s Speicherbandbreite. Diese Kapazität unterstützt große Datensätze und speichergebundene HPC-Workloads ohne ständiges Verschieben von Daten zwischen Host und Beschleuniger. System-RAM und NVMe-Speicher werden separat im Bestellformular konfiguriert und skalieren unabhängig vom Beschleuniger.