A100 · H100 · Servere GPU NVIDIA

Servere dedicate NVIDIA A100 H100 pentru întreprinderi

Servere bare metal cu un NVIDIA A100 (40 sau 80 GB) sau un H100 80 GB, ambele ca plăci adiționale PCIe, pentru antrenare AI, inferență și calcul de înaltă performanță. O mașină deja montată în rack cu placa sa este predată în câteva minute; orice altă configurație este montată sau achiziționată și datată înainte să plătiți.

SLA de disponibilitate Suport pentru întreprinderi

Specificații GPU NVIDIA A100 și H100

Acceleratoare GPU de nivel enterprise, concepute pentru antrenare AI, inferență și calcul științific.

Comparați specificațiile tehnice pentru a selecta configurația optimă pentru cerințele sarcinilor dumneavoastră.

NVIDIA A100

GPU-ul A100 oferă performanță, scalabilitate și fiabilitate excepționale pentru sarcinile de antrenare și inferență AI. Construit pe arhitectura Ampere cu nuclee Tensor avansate pentru calcul accelerat la scară de întreprindere.

Arhitectură

Ampere

Memorie video

40 GB HBM2 sau 80 GB HBM2e

Nuclee CUDA

6.912

Lățime de bandă maximă

1.555 GB/s (40 GB), 1.935 GB/s (80 GB)

Putere maximă

250 W (40 GB), 300 W (80 GB)

Interfață magistrală

PCIe Gen 4 x16

Codificatoare video NVENC

Niciunul (5 decodificatoare NVDEC)

NVIDIA H100

Hopper, generația de după Ampere, în forma sa de placă adițională PCIe: H100-ul care se potrivește serverelor pe care le construim. Modulul SXM5 cu HBM3 se montează pe o placă de bază HGX, iar niciunul dintre șasiurile noastre nu acceptă unul, deci cifrele sale nu se aplică aici.

Arhitectură

Hopper

Memorie video

80 GB HBM2e

Lățime de bandă maximă

2.039 GB/s

Putere maximă

350 W

Interfață magistrală

PCIe Gen 5 x16

Codificatoare video NVENC

Niciunul (7 decodificatoare NVDEC)

Infrastructură AI enterprise pentru sarcini solicitante

Servere dedicate NVIDIA A100 și H100 bazate pe arhitecturile Ampere și Hopper, optimizate pentru antrenare AI la scară largă, inferență LLM și aplicații de calcul științific.

Arhitectura Ampere

Construită pe procesul de 7 nm cu 54 de miliarde de tranzistori, arhitectura NVIDIA Ampere oferă performanțe revoluționare pentru sarcinile de antrenare AI și HPC.

Memorie cu lățime de bandă mare

Memorie stivuită pe fiecare placă pe care o montăm: HBM2 la 1.555 GB/s pe A100 de 40 GB, HBM2e la 1.935 GB/s pe A100 de 80 GB și la 2.039 GB/s pe H100, toate cu ECC.

Accelerare AI

Nucleele Tensor avansate oferă o îmbunătățire a performanței de până la 20 de ori față de generațiile anterioare pentru sarcinile de antrenare și inferență în învățarea profundă.

GPU cu instanțe multiple

Partiționați fiecare GPU în până la șapte instanțe izolate cu resurse dedicate de calcul, memorie și cache pentru o utilizare multi-tenant optimă.

Conectivitate NVLink

Ambele plăci au un conector de punte NVLink. Nicio punte nu este pe formularul de comandă, deci două plăci într-un server comunică prin PCIe, cu excepția cazului în care se ofertează o punte; întrebați înainte de a comanda dacă sarcina are nevoie de una.

Fiabilitate enterprise

GPU-uri de nivel centru de date cu memorie ECC, funcții RAS avansate și suport enterprise pentru implementări de producție critice.

Întrebări frecvente despre serverele GPU NVIDIA A100 H100

Întrebări frecvente despre implementarea și gestionarea serverelor dedicate enterprise accelerate cu GPU NVIDIA A100 H100 pentru antrenare AI, inferență și calcul de înaltă performanță.

Ce face GPU-urile NVIDIA A100 și H100 potrivite pentru sarcinile AI enterprise?

Ambele sunt acceleratoare de centru de date construite pentru aritmetică pe modele mari: memorie HBM stivuită cu ECC, nuclee Tensor vizate de cadrele majore și GPU cu instanțe multiple pentru împărțirea unei plăci între propriile sarcini. A100 este Ampere cu nuclee Tensor de a treia generație; H100 este Hopper cu nuclee Tensor de a patra generație și motorul Transformer pentru precizie FP8. Nicio placă nu are codificator video hardware, deci niciuna nu este alegerea potrivită pentru transcodare.

Cum se compară GPU-urile A100 și H100 în performanță și capabilități?

Ca plăci PCIe pe care le montăm, A100 are 6.912 nuclee CUDA, 40 GB de HBM2 la 1.555 GB/s sau 80 GB de HBM2e la 1.935 GB/s, consumă 250 sau 300 W și se conectează la PCIe Gen 4. H100 are 80 GB de HBM2e la 2.039 GB/s, consumă 350 W și se conectează la PCIe Gen 5. Cifrele H100 citate în altă parte cu memorie HBM3 descriu modulul SXM5, care necesită o placă de bază HGX pe care niciunul dintre serverele noastre nu o folosește.

Ce funcții de conectivitate și scalabilitate enterprise sunt disponibile?

În interiorul unei mașini, fiecare placă poate fi partiționată în până la șapte instanțe GPU cu instanțe multiple izolate, fiecare cu propriul calcul, memorie și cache. Ambele plăci au și un conector de punte NVLink, dar nicio punte nu este pe formularul de comandă: două plăci într-un server comunică prin PCIe, cu excepția cazului în care se ofertează o punte, deci întrebați înainte de a comanda dacă sarcina are nevoie de una. Între servere, legătura este portul Ethernet al fiecărei mașini, iar configurațiile multi-GPU și multi-nod au propria pagină.

Cât durează livrarea unui server A100 sau H100?

O mașină deja montată în rack cu placa este livrată în aproximativ 30 minute de la verificarea plății. Când montăm o placă pe care o avem în stoc, durează 4 până la 24 de ore; o placă pe care trebuie să o achiziționăm durează cinci până la zece zile lucrătoare, sau zece până la cincisprezece când acceleratorul este pe alocare, și vi se spune care înainte să plătiți.