A100 · H100 · Διακομιστές NVIDIA GPU

Εταιρικοί NVIDIA A100 H100 αποκλειστικοί διακομιστές

Bare metal διακομιστές με NVIDIA A100 (40 ή 80 GB) ή H100 80 GB, και οι δύο ως κάρτες επέκτασης PCIe, για εκπαίδευση AI, συμπερασματολογία και υπολογιστική υψηλών επιδόσεων. Ένα μηχάνημα ήδη τοποθετημένο σε rack με την κάρτα του παραδίδεται μέσα σε λίγα λεπτά· οποιαδήποτε άλλη σύνθεση τοποθετείται ή αγοράζεται και χρονολογείται πριν πληρώσετε.

SLA χρόνου λειτουργίας Εταιρική υποστήριξη

Προδιαγραφές GPU NVIDIA A100 & H100

Επιταχυντές GPU εταιρικής κλάσης σχεδιασμένοι για εκπαίδευση AI, συμπερασματολογία και επιστημονικούς υπολογισμούς.

Συγκρίνετε τις τεχνικές προδιαγραφές για να επιλέξετε τη βέλτιστη διαμόρφωση για τις απαιτήσεις του φόρτου εργασίας σας.

NVIDIA A100

Η GPU A100 προσφέρει εξαιρετικές επιδόσεις, επεκτασιμότητα και αξιοπιστία για φόρτους εργασίας εκπαίδευσης και συμπερασματολογίας AI. Βασισμένη στην αρχιτεκτονική Ampere με προηγμένους Tensor Cores για επιταχυνόμενους υπολογισμούς σε εταιρική κλίμακα.

Αρχιτεκτονική

Ampere

Μνήμη βίντεο

40 GB HBM2 ή 80 GB HBM2e

Πυρήνες CUDA

6.912

Μέγιστο εύρος ζώνης

1.555 GB/s (40 GB), 1.935 GB/s (80 GB)

Μέγιστη ισχύς

250 W (40 GB), 300 W (80 GB)

Διασύνδεση διαύλου

PCIe Gen 4 x16

Κωδικοποιητές βίντεο NVENC

Κανένας (5 αποκωδικοποιητές NVDEC)

NVIDIA H100

Hopper, η γενιά μετά την Ampere, στη μορφή κάρτας επέκτασης PCIe: η H100 που ταιριάζει στους διακομιστές που κατασκευάζουμε. Η μονάδα SXM5 με HBM3 τοποθετείται σε βασική πλακέτα HGX και κανένα από τα πλαίσιά μας δεν τη δέχεται, επομένως τα στοιχεία της δεν ισχύουν εδώ.

Αρχιτεκτονική

Hopper

Μνήμη βίντεο

80 GB HBM2e

Μέγιστο εύρος ζώνης

2.039 GB/s

Μέγιστη ισχύς

350 W

Διασύνδεση διαύλου

PCIe Gen 5 x16

Κωδικοποιητές βίντεο NVENC

Κανένας (7 αποκωδικοποιητές NVDEC)

Εταιρική υποδομή AI για απαιτητικούς φόρτους εργασίας

Αποκλειστικοί διακομιστές NVIDIA A100 και H100 με αρχιτεκτονικές Ampere και Hopper, βελτιστοποιημένοι για εκπαίδευση AI μεγάλης κλίμακας, συμπερασματολογία LLM και επιστημονικές υπολογιστικές εφαρμογές.

Αρχιτεκτονική Ampere

Κατασκευασμένη σε διαδικασία 7nm με 54 δισεκατομμύρια τρανζίστορ, η αρχιτεκτονική NVIDIA Ampere προσφέρει πρωτοποριακές επιδόσεις για εκπαίδευση AI και φόρτους εργασίας HPC.

Μνήμη υψηλού εύρους ζώνης

Στοιβαγμένη μνήμη σε κάθε κάρτα που τοποθετούμε: HBM2 στα 1.555 GB/s στην A100 40 GB, HBM2e στα 1.935 GB/s στην A100 80 GB και στα 2.039 GB/s στην H100, όλες με ECC.

Επιτάχυνση AI

Οι προηγμένοι Tensor Cores προσφέρουν έως και 20x βελτίωση επιδόσεων σε σχέση με προηγούμενες γενιές για φόρτους εργασίας εκπαίδευσης και συμπερασματολογίας βαθιάς μάθησης.

Multi-Instance GPU

Χωρίστε κάθε GPU σε έως και επτά απομονωμένα στιγμιότυπα με αποκλειστικούς πόρους υπολογισμού, μνήμης και κρυφής μνήμης για βέλτιστη αξιοποίηση πολλαπλών ενοικιαστών.

Συνδεσιμότητα NVLink

Και οι δύο κάρτες διαθέτουν υποδοχή γέφυρας NVLink. Δεν υπάρχει γέφυρα στη φόρμα παραγγελίας, επομένως δύο κάρτες σε έναν διακομιστή επικοινωνούν μέσω PCIe εκτός εάν ζητηθεί προσφορά για γέφυρα· ρωτήστε πριν την παραγγελία αν η εργασία τη χρειάζεται.

Εταιρική αξιοπιστία

GPU κλάσης κέντρων δεδομένων με μνήμη ECC, προηγμένα χαρακτηριστικά RAS και εταιρική υποστήριξη για κρίσιμες παραγωγικές αναπτύξεις.

Συχνές ερωτήσεις για διακομιστές GPU NVIDIA A100 H100

Συνήθεις ερωτήσεις σχετικά με την ανάπτυξη και διαχείριση εταιρικών αποκλειστικών διακομιστών με επιτάχυνση GPU NVIDIA A100 H100 για εκπαίδευση AI, συμπερασματολογία και υπολογιστική υψηλών επιδόσεων.

Τι κάνει τις GPU NVIDIA A100 και H100 κατάλληλες για εταιρικούς φόρτους εργασίας AI;

Και οι δύο είναι επιταχυντές κέντρων δεδομένων κατασκευασμένοι για αριθμητική σε μεγάλα μοντέλα: στοιβαγμένη μνήμη HBM με ECC, Tensor Cores που στοχεύουν τα κύρια πλαίσια και Multi-Instance GPU για διαχωρισμό μιας κάρτας μεταξύ των δικών σας εργασιών. Η A100 είναι Ampere με Tensor Cores τρίτης γενιάς· η H100 είναι Hopper με Tensor Cores τέταρτης γενιάς και τον Transformer Engine για ακρίβεια FP8. Καμία κάρτα δεν διαθέτει κωδικοποιητή βίντεο υλικού, επομένως καμία δεν είναι η σωστή επιλογή για διακωδικοποίηση.

Πώς συγκρίνονται οι GPU A100 και H100 σε επιδόσεις και δυνατότητες;

Ως κάρτες PCIe που τοποθετούμε, η A100 έχει 6.912 πυρήνες CUDA, 40 GB HBM2 στα 1.555 GB/s ή 80 GB HBM2e στα 1.935 GB/s, καταναλώνει 250 ή 300 W και συνδέεται με PCIe Gen 4. Η H100 έχει 80 GB HBM2e στα 2.039 GB/s, καταναλώνει 350 W και συνδέεται με PCIe Gen 5. Τα στοιχεία της H100 που αναφέρονται αλλού με μνήμη HBM3 περιγράφουν τη μονάδα SXM5, η οποία απαιτεί βασική πλακέτα HGX που κανένας από τους διακομιστές μας δεν χρησιμοποιεί.

Ποιες εταιρικές δυνατότητες συνδεσιμότητας και επεκτασιμότητας είναι διαθέσιμες;

Μέσα σε ένα μηχάνημα, κάθε κάρτα μπορεί να χωριστεί σε έως και επτά απομονωμένα στιγμιότυπα Multi-Instance GPU, το καθένα με δικό του υπολογισμό, μνήμη και κρυφή μνήμη. Και οι δύο κάρτες διαθέτουν επίσης υποδοχή γέφυρας NVLink, αλλά δεν υπάρχει γέφυρα στη φόρμα παραγγελίας: δύο κάρτες σε έναν διακομιστή επικοινωνούν μέσω PCIe εκτός εάν ζητηθεί προσφορά για γέφυρα, οπότε ρωτήστε πριν την παραγγελία αν η εργασία τη χρειάζεται. Μεταξύ διακομιστών η σύνδεση είναι η θύρα Ethernet κάθε μηχανήματος και οι κατασκευές πολλαπλών GPU και πολλαπλών κόμβων έχουν τη δική τους σελίδα.

Πόσο χρόνο χρειάζεται η παράδοση ενός διακομιστή A100 ή H100;

Ένα μηχάνημα ήδη τοποθετημένο σε rack με την κάρτα παραδίδεται εντός περίπου 30 λεπτών από την επαλήθευση πληρωμής. Όταν τοποθετούμε μια κάρτα που έχουμε σε απόθεμα, χρειάζεται 4 έως 24 ώρες· μια κάρτα που πρέπει να αγοράσουμε χρειάζεται πέντε έως δέκα εργάσιμες ημέρες ή δέκα έως δεκαπέντε όταν ο επιταχυντής είναι σε κατανομή, και ενημερώνεστε ποιο ισχύει πριν πληρώσετε.