AMD Instinct GPU-Server

Setzen Sie den AMD Instinct MI210 auf Bare-Metal-Infrastruktur ein

Ein Bare-Metal-Server in Enterprise-Qualität von HPE mit dem AMD Instinct MI210-Beschleuniger – 64 GB HBM2e für maschinelles Lernen und High-Performance-Computing. Die richtige Hardware für ein Sprachmodell zu dimensionieren, ist eine andere Frage: Beginnen Sie stattdessen mit LLM-Hosting.

64 GB HBM2e mit 1.638 GB/s Speicherbandbreite. CDNA™-Architektur der 2. Generation auf einer PCIe-4.0-Karte. HPE ProLiant Enterprise-Infrastruktur.

AMD Instinct MI210 Bare-Metal-Server

Entwickelt für maschinelles Lernen und High-Performance-Computing. Der MI210 kombiniert die CDNA™-Rechenarchitektur der 2. Generation mit 64 GB HBM2e-Speicher für intensives Training, Inferenz und HPC-Anwendungen.

Maximaler Rechendurchsatz

Die CDNA™-Architektur der 2. Generation liefert bahnbrechende Rechenleistung für Deep-Learning-Training und wissenschaftliche Rechenworkloads, die maximalen Durchsatz erfordern.

Standard-PCIe-Formfaktor

Der MI210 bringt die Siliziumtechnologie der MI200-Serie auf eine Standard-PCIe-4.0-Karte und lässt sich so in HPE ProLiant Enterprise-Servern einsetzen statt in spezialisierten Beschleunigerplattformen.

Massive Speicherkapazität

64 GB HBM2e mit ECC ermöglichen Training und Inferenz großer Modelle und speichergebundener HPC-Workloads – mit 1.638 GB/s Bandbreite, die die Recheneinheiten kontinuierlich versorgt.

Das PCIe-Mitglied der MI200-Serie

Der MI250 und der MI250X sind OAM-Module für spezialisierte Exascale-Plattformen. Der MI210 bringt dieselbe CDNA™-Architektur der 2. Generation auf eine Standard-PCIe-4.0-Karte – deshalb ist er der Instinct-Beschleuniger in unserem Sortiment.

CDNA™-Architektur der 2. Generation

Zweckgebautes Compute-Silizium mit außergewöhnlicher Dichte und Energieeffizienz für parallele Verarbeitungs-Workloads in großem Maßstab.

KI-Beschleunigung

Optimierte Matrixoperationen und Mixed-Precision-Computing für beschleunigtes Deep-Learning-Training, Modell-Feintuning und Inferenz-Bereitstellung.

Speicherkohärenz-Architektur

Die AMD Infinity-Architektur der 3. Generation ermöglicht Kommunikation mit hoher Bandbreite und niedriger Latenz zwischen GPU-Recheneinheiten und Systemspeicher für maximalen Datendurchsatz.

GPU-Interconnect

AMD Infinity Fabric™-Links ermöglichen schnelle Peer-to-Peer-Kommunikation zwischen MI210-Karten für Multi-GPU-Training und verteilte Rechenworkloads.

HPE Enterprise-Infrastruktur für AMD Instinct™-Workloads

HPE ProLiant-Plattform

AMD Instinct-Beschleuniger auf HPE ProLiant Enterprise-Servern bieten Carrier-Grade-Zuverlässigkeit und konstante Leistung für produktive KI- und HPC-Workloads.

Flexible Erweiterung

Skalieren Sie Ihre GPU-Infrastruktur bei Bedarf mit schneller Hardware-Bereitstellung. Standard-Upgrades und zusätzliche Kapazität werden in der Regel innerhalb von 24 Stunden bereitgestellt.

Experten-Support

GPU-Infrastruktur-Spezialisten sind rund um die Uhr per Live-Chat und E-Mail erreichbar, um bei Bereitstellung, Optimierung und Fehlerbehebung zu unterstützen.

MI210 L40S A100 H100
GPU-Architektur CDNA 2.0 Ada Lovelace NVIDIA Ampere Hopper
GPU-Speicher 64 GB HBM2e 48 GB GDDR6 80 GB HBM2e 80 GB HBM3
GPU-Speicherbandbreite 1638 GB/s 864 GB/s 1935 GB/s 3352 GB/s
FP32 22,63 TFLOPS 91,6 TFLOPS 19,5 TFLOPS 51 TFLOPS
TF32 Tensor Core 312 TFLOPS 366 TFLOPS 312 TFLOPS 756 TFLOPS
FP16/BF16 Tensor Core 181 TFLOPS 733 TFLOPS 624 TFLOPS 1513 TFLOPS
Leistung Bis zu 300 W Bis zu 350 W Bis zu 400 W Bis zu 350 W
Wird geladen... Wird geladen... Wird geladen... Wird geladen...

Häufig gestellte Fragen zu AMD Instinct MI210-Servern

Erhalten Sie Antworten auf häufige Fragen zur Bereitstellung und zum Betrieb von MI210-GPU-beschleunigten Bare-Metal-Servern für Training, Inferenz und High-Performance-Computing-Anwendungen.

Was ist der AMD Instinct MI210 und welche Workloads profitieren am meisten?

Der AMD Instinct MI210 ist eine Compute-GPU in Enterprise-Qualität auf Basis der CDNA™-Architektur der 2. Generation, optimiert für Rechenleistung statt Grafik. Er glänzt bei Deep-Learning-Training und -Inferenz, wissenschaftlichen Simulationen, numerischer Strömungsmechanik, Molekülmodellierung und Datenanalysen, die massive parallele Verarbeitungsfähigkeiten erfordern. Wenn Sie Hardware für ein Sprachmodell auswählen, gibt es dafür eine eigene Seite – siehe LLM-Hosting.

Wie unterscheidet sich der MI210 vom MI250 und MI250X?

Der MI250 und der MI250X sind OAM-Module für spezialisierte Exascale-Plattformen und nicht Teil unseres Katalogs. Der MI210 bringt dieselbe CDNA™-Architektur der 2. Generation auf eine Standard-PCIe-4.0-Karte mit 64 GB HBM2e und lässt sich daher in HPE ProLiant Enterprise-Servern neben unseren anderen GPU-Optionen einsetzen.

Was ist die typische Bereitstellungszeit für AMD Instinct-Server?

Instant-Delivery-Server werden in der Regel innerhalb von ~30 Minuten nach Zahlungsbestätigung bereitgestellt. Individuelle Konfigurationen werden je nach Komponentenverfügbarkeit bereitgestellt. Alle AMD Instinct-Server unterstützen sofortiges OS-Neuladen ohne Support-Tickets und ermöglichen so schnelle Iteration. Die Netzwerkinfrastruktur ist für anhaltende Workloads mit hohem Durchsatz und Konnektivität mit niedriger Latenz optimiert.

Welche Software-Frameworks und Tools unterstützen AMD Instinct-GPUs?

AMD Instinct-Beschleuniger laufen auf ROCm (Radeon Open Compute), einer Open-Source-GPU-Computing-Plattform, die PyTorch, TensorFlow, JAX, ONNX Runtime und andere führende ML-Frameworks unterstützt. ROCm umfasst HIP (Heterogeneous-Compute Interface for Portability) für unkompliziertes Portieren von CUDA-Code sowie optimierte Bibliotheken für lineare Algebra, FFT, Zufallszahlengenerierung und tiefe neuronale Netze. Volle Container-Unterstützung über Docker und Kubernetes ermöglicht produktionsreife KI/ML-Bereitstellung.

Welchen Speicher bietet der MI210?

Der MI210 verfügt über 64 GB HBM2e (High Bandwidth Memory) mit ECC und liefert 1.638 GB/s Speicherbandbreite. Diese Kapazität unterstützt große Datensätze und speichergebundene HPC-Workloads ohne ständiges Verschieben von Daten zwischen Host und Beschleuniger. System-RAM und NVMe-Speicher werden im Bestellformular separat konfiguriert und skalieren daher unabhängig vom Beschleuniger.