A100 · H100 · NVIDIA GPU sunucuları

Kurumsal NVIDIA A100 H100 dedicated sunucular

AI eğitimi, çıkarım ve yüksek performanslı hesaplama için PCIe eklenti kartı olarak NVIDIA A100 (40 veya 80 GB) ya da H100 80 GB içeren bare metal sunucular. Kartıyla birlikte rafa yerleştirilmiş bir makine dakikalar içinde teslim edilir; diğer tüm yapılandırmalarda kart takılır ya da satın alınır ve ödeme yapmadan önce tarih belirtilir.

Çalışma Süresi SLA Kurumsal destek

NVIDIA A100 ve H100 GPU teknik özellikleri

AI eğitimi, çıkarım ve bilimsel hesaplama için tasarlanmış kurumsal düzey GPU hızlandırıcılar.

İş yükü gereksinimlerinize en uygun yapılandırmayı seçmek için teknik özellikleri karşılaştırın.

NVIDIA A100

A100 GPU, AI eğitimi ve çıkarım iş yükleri için olağanüstü performans, ölçeklenebilirlik ve güvenilirlik sunar. Kurumsal ölçekte hızlandırılmış hesaplama için gelişmiş Tensor Çekirdekleriyle Ampere mimarisi üzerine inşa edilmiştir.

Mimari

Ampere

Video belleği

40 GB HBM2 veya 80 GB HBM2e

CUDA çekirdekleri

6.912

Maksimum Bant Genişliği

1.555 GB/sn (40 GB), 1.935 GB/sn (80 GB)

Maksimum güç

250 W (40 GB), 300 W (80 GB)

Veri yolu arayüzü

PCIe Gen 4 x16

NVENC video kodlayıcılar

Yok (5 NVDEC kod çözücü)

NVIDIA H100

Ampere'den sonraki nesil Hopper, PCIe eklenti kartı biçiminde: kurduğumuz sunuculara uyan H100. HBM3'lü SXM5 modülü bir HGX taban plakasına monte edilir ve kasalarımızın hiçbiri bunu kabul etmez; bu nedenle buradaki rakamlar geçerli değildir.

Mimari

Hopper

Video belleği

80 GB HBM2e

Maksimum Bant Genişliği

2.039 GB/sn

Maksimum güç

350 W

Veri yolu arayüzü

PCIe Gen 5 x16

NVENC video kodlayıcılar

Yok (7 NVDEC kod çözücü)

Zorlu iş yükleri için kurumsal AI altyapısı

Ampere ve Hopper mimarileriyle güçlendirilmiş, büyük ölçekli AI eğitimi, LLM çıkarımı ve bilimsel hesaplama uygulamaları için optimize edilmiş NVIDIA A100 ve H100 dedicated sunucular.

Ampere mimarisi

7nm süreciyle 54 milyar transistör üzerine inşa edilen NVIDIA Ampere mimarisi, AI eğitimi ve HPC iş yükleri için çığır açan performans sunar.

Yüksek bant genişlikli bellek

Taktığımız her kartta yığılmış bellek: 40 GB A100'de 1.555 GB/sn hızında HBM2, 80 GB A100'de 1.935 GB/sn ve H100'de 2.039 GB/sn hızında HBM2e; hepsi ECC'li.

AI hızlandırma

Gelişmiş Tensor Çekirdekleri, derin öğrenme eğitimi ve çıkarım iş yüklerinde önceki nesillere göre 20 kata kadar performans artışı sağlar.

Çok Örnekli GPU

Her GPU'yu, optimum çok kiracılı kullanım için ayrılmış hesaplama, bellek ve önbellek kaynaklarına sahip yedi adede kadar yalıtılmış örneğe bölün.

NVLink bağlantısı

Her iki kart da NVLink köprü konektörü taşır. Sipariş formunda köprü bulunmaz; bu nedenle bir sunucudaki iki kart, köprü için fiyat teklifi alınmadığı sürece PCIe üzerinden iletişim kurar. İş bunu gerektiriyorsa sipariş vermeden önce sorun.

Kurumsal güvenilirlik

ECC bellekli, gelişmiş RAS özellikli ve görev açısından kritik üretim dağıtımları için kurumsal destekli veri merkezi sınıfı GPU'lar.

NVIDIA A100 H100 GPU sunucuları hakkında SSS

AI eğitimi, çıkarım ve yüksek performanslı hesaplama için kurumsal NVIDIA A100 H100 GPU hızlandırmalı dedicated sunucuların dağıtımı ve yönetimi hakkında sık sorulan sorular.

NVIDIA A100 ve H100 GPU'ları kurumsal AI iş yükleri için uygun kılan nedir?

Her ikisi de büyük modeller üzerinde aritmetik için üretilmiş veri merkezi hızlandırıcılarıdır: ECC'li yığılmış HBM bellek, büyük çerçevelerin hedeflediği Tensor Çekirdekleri ve bir kartı kendi işleriniz arasında bölmek için Çok Örnekli GPU. A100, üçüncü nesil Tensor Çekirdekli Ampere'dir; H100 ise dördüncü nesil Tensor Çekirdekli ve FP8 hassasiyeti için Transformer Engine'li Hopper'dır. Her iki kartta da donanım video kodlayıcı bulunmadığından, ikisi de kod dönüştürme için doğru seçim değildir.

A100 ve H100 GPU'lar performans ve yetenekler açısından nasıl karşılaştırılır?

Taktığımız PCIe kartları olarak A100'de 6.912 CUDA çekirdeği, 1.555 GB/sn hızında 40 GB HBM2 veya 1.935 GB/sn hızında 80 GB HBM2e bulunur, 250 veya 300 W güç çeker ve PCIe Gen 4 ile bağlanır. H100'de 2.039 GB/sn hızında 80 GB HBM2e bulunur, 350 W güç çeker ve PCIe Gen 5 ile bağlanır. Başka yerlerde HBM3 bellekle belirtilen H100 rakamları, sunucularımızın hiçbirinin kullanmadığı bir HGX taban plakası gerektiren SXM5 modülünü tanımlar.

Hangi kurumsal bağlantı ve ölçeklenebilirlik özellikleri mevcuttur?

Tek bir makinede her kart, her biri kendi hesaplama, bellek ve önbelleğine sahip yedi adede kadar yalıtılmış Çok Örnekli GPU örneğine bölünebilir. Her iki kart da NVLink köprü konektörü taşır, ancak sipariş formunda köprü bulunmaz: bir sunucudaki iki kart, köprü için fiyat teklifi alınmadığı sürece PCIe üzerinden iletişim kurar; bu nedenle iş bunu gerektiriyorsa sipariş vermeden önce sorun. Sunucular arasında bağlantı her makinenin Ethernet bağlantı noktasıdır ve çok GPU'lu ve çok düğümlü yapılandırmaların kendi sayfası vardır.

A100 veya H100 sunucusunun teslimi ne kadar sürer?

Kartla birlikte rafa yerleştirilmiş bir makine, ödeme onayından yaklaşık 30 dakika sonra teslim edilir. Stokta tuttuğumuz bir kartı taktığımızda 4 ila 24 saat sürer; satın almamız gereken bir kart beş ila on iş günü, hızlandırıcı tahsisli olduğunda on ila on beş iş günü sürer ve ödeme yapmadan önce hangisi olduğu size bildirilir.