Server GPU NVIDIA A100 · H100

Server dedicati NVIDIA A100 H100 enterprise

Server bare metal con NVIDIA A100 (40 o 80 GB) o H100 80 GB, entrambe come schede aggiuntive PCIe, per addestramento AI, inferenza e calcolo ad alte prestazioni. Una macchina già installata a rack con la sua scheda viene consegnata in pochi minuti; qualsiasi altra configurazione viene montata o acquistata e datata prima del pagamento.

SLA di uptime Supporto enterprise

Specifiche delle GPU NVIDIA A100 e H100

Acceleratori GPU di livello enterprise progettati per addestramento AI, inferenza e calcolo scientifico.

Confronta le specifiche tecniche per scegliere la configurazione ottimale per i requisiti del tuo carico di lavoro.

NVIDIA A100

La GPU A100 offre prestazioni, scalabilità e affidabilità eccezionali per carichi di lavoro di addestramento e inferenza AI. Basata su architettura Ampere con Tensor Core avanzati per il calcolo accelerato su scala enterprise.

Architettura

Ampere

Memoria video

40 GB HBM2 o 80 GB HBM2e

Core CUDA

6.912

Larghezza di banda massima

1.555 GB/s (40 GB), 1.935 GB/s (80 GB)

Potenza massima

250 W (40 GB), 300 W (80 GB)

Interfaccia bus

PCIe Gen 4 x16

Encoder video NVENC

Nessuno (5 decoder NVDEC)

NVIDIA H100

Hopper, la generazione successiva ad Ampere, nella sua forma di scheda aggiuntiva PCIe: l'H100 che si adatta ai server che costruiamo. Il modulo SXM5 con HBM3 si monta su una scheda base HGX e nessuno dei nostri chassis ne accetta uno, quindi i suoi valori non si applicano qui.

Architettura

Hopper

Memoria video

80 GB HBM2e

Larghezza di banda massima

2.039 GB/s

Potenza massima

350 W

Interfaccia bus

PCIe Gen 5 x16

Encoder video NVENC

Nessuno (7 decoder NVDEC)

Infrastruttura AI enterprise per carichi di lavoro impegnativi

Server dedicati NVIDIA A100 e H100 basati su architetture Ampere e Hopper, ottimizzati per addestramento AI su larga scala, inferenza LLM e applicazioni di calcolo scientifico.

Architettura Ampere

Realizzata con processo a 7 nm e 54 miliardi di transistor, l'architettura NVIDIA Ampere offre prestazioni rivoluzionarie per carichi di lavoro di addestramento AI e HPC.

Memoria ad alta larghezza di banda

Memoria impilata su ogni scheda che montiamo: HBM2 a 1.555 GB/s sull'A100 da 40 GB, HBM2e a 1.935 GB/s sull'A100 da 80 GB e a 2.039 GB/s sull'H100, tutte con ECC.

Accelerazione AI

I Tensor Core avanzati offrono un miglioramento delle prestazioni fino a 20 volte rispetto alle generazioni precedenti per carichi di lavoro di addestramento e inferenza di deep learning.

GPU Multi-Instance

Partiziona ogni GPU in un massimo di sette istanze isolate con risorse dedicate di calcolo, memoria e cache per un utilizzo multi-tenant ottimale.

Connettività NVLink

Entrambe le schede dispongono di un connettore bridge NVLink. Nessun bridge è presente nel modulo d'ordine, quindi due schede in un server comunicano tramite PCIe a meno che non venga quotato un bridge; chiedi prima di ordinare se il lavoro ne richiede uno.

Affidabilità enterprise

GPU di livello data center con memoria ECC, funzionalità RAS avanzate e supporto enterprise per implementazioni di produzione mission-critical.

FAQ sui server GPU NVIDIA A100 H100

Domande comuni sull'implementazione e la gestione di server dedicati enterprise con accelerazione GPU NVIDIA A100 H100 per addestramento AI, inferenza e calcolo ad alte prestazioni.

Cosa rende le GPU NVIDIA A100 e H100 adatte ai carichi di lavoro AI enterprise?

Entrambe sono acceleratori per data center progettati per l'aritmetica su modelli di grandi dimensioni: memoria HBM impilata con ECC, Tensor Core supportati dai principali framework e GPU Multi-Instance per suddividere una scheda tra i propri job. L'A100 è Ampere con Tensor Core di terza generazione; l'H100 è Hopper con Tensor Core di quarta generazione e il Transformer Engine per la precisione FP8. Nessuna delle due schede dispone di un encoder video hardware, quindi nessuna delle due è la scelta giusta per la transcodifica.

Come si confrontano le GPU A100 e H100 in termini di prestazioni e capacità?

Come schede PCIe che montiamo, l'A100 ha 6.912 core CUDA, 40 GB di HBM2 a 1.555 GB/s o 80 GB di HBM2e a 1.935 GB/s, assorbe 250 o 300 W e si collega tramite PCIe Gen 4. L'H100 ha 80 GB di HBM2e a 2.039 GB/s, assorbe 350 W e si collega tramite PCIe Gen 5. I valori dell'H100 citati altrove con memoria HBM3 descrivono il modulo SXM5, che richiede una scheda base HGX che nessuno dei nostri server utilizza.

Quali funzionalità di connettività e scalabilità enterprise sono disponibili?

All'interno di una macchina, ogni scheda può essere partizionata in un massimo di sette istanze GPU Multi-Instance isolate, ciascuna con il proprio calcolo, memoria e cache. Entrambe le schede dispongono inoltre di un connettore bridge NVLink, ma nessun bridge è presente nel modulo d'ordine: due schede in un server comunicano tramite PCIe a meno che non venga quotato un bridge, quindi chiedi prima di ordinare se il lavoro ne richiede uno. Tra i server il collegamento è la porta Ethernet di ciascuna macchina e le configurazioni multi-GPU e multi-nodo hanno una propria pagina.

Quanto tempo richiede la consegna di un server A100 o H100?

Una macchina già installata a rack con la scheda viene consegnata entro circa 30 minuti dalla verifica del pagamento. Quando montiamo una scheda che teniamo in stock, occorrono da 4 a 24 ore; una scheda che dobbiamo acquistare richiede da cinque a dieci giorni lavorativi, o da dieci a quindici quando l'acceleratore è in allocazione, e ti viene comunicato quale prima del pagamento.