A100 · H100 · Servidores GPU NVIDIA

Servidores dedicados NVIDIA A100 H100 empresariais

Servidores bare metal com uma NVIDIA A100 (40 ou 80 GB) ou uma H100 80 GB, ambas como placas PCIe add-in, para treino de IA, inferência e computação de alto desempenho. Uma máquina já montada em rack com a placa é entregue em minutos; qualquer outra configuração é instalada ou adquirida, e datada antes de você pagar.

SLA de uptime Suporte empresarial

Especificações das GPUs NVIDIA A100 e H100

Aceleradores GPU de nível empresarial projetados para treino de IA, inferência e computação científica.

Compare as especificações técnicas para selecionar a configuração ideal para os requisitos da sua carga de trabalho.

NVIDIA A100

A GPU A100 oferece desempenho, escalabilidade e confiabilidade excepcionais para cargas de trabalho de treino e inferência de IA. Construída na arquitetura Ampere com Tensor Cores avançados para computação acelerada em escala empresarial.

Arquitetura

Ampere

Memória de vídeo

40 GB HBM2 ou 80 GB HBM2e

Núcleos CUDA

6.912

Largura de banda máxima

1.555 GB/s (40 GB), 1.935 GB/s (80 GB)

Potência máxima

250 W (40 GB), 300 W (80 GB)

Interface de barramento

PCIe Gen 4 x16

Codificadores de vídeo NVENC

Nenhum (5 decodificadores NVDEC)

NVIDIA H100

Hopper, a geração posterior à Ampere, em sua forma de placa PCIe add-in: a H100 que cabe nos servidores que montamos. O módulo SXM5 com HBM3 é montado em uma placa-base HGX, e nenhum dos nossos chassis aceita um, portanto seus números não se aplicam aqui.

Arquitetura

Hopper

Memória de vídeo

80 GB HBM2e

Largura de banda máxima

2.039 GB/s

Potência máxima

350 W

Interface de barramento

PCIe Gen 5 x16

Codificadores de vídeo NVENC

Nenhum (7 decodificadores NVDEC)

Infraestrutura de IA empresarial para cargas de trabalho exigentes

Servidores dedicados NVIDIA A100 e H100 com arquiteturas Ampere e Hopper, otimizados para treino de IA em larga escala, inferência de LLMs e aplicações de computação científica.

Arquitetura Ampere

Construída em processo de 7 nm com 54 bilhões de transistores, a arquitetura NVIDIA Ampere oferece desempenho revolucionário para cargas de trabalho de treino de IA e HPC.

Memória de alta largura de banda

Memória empilhada em cada placa que instalamos: HBM2 a 1.555 GB/s na A100 de 40 GB, HBM2e a 1.935 GB/s na A100 de 80 GB e a 2.039 GB/s na H100, todas com ECC.

Aceleração de IA

Tensor Cores avançados oferecem até 20x de melhoria de desempenho em relação às gerações anteriores para cargas de trabalho de treino e inferência de aprendizado profundo.

GPU Multi-Instância

Particione cada GPU em até sete instâncias isoladas com recursos dedicados de computação, memória e cache para utilização multi-inquilino ideal.

Conectividade NVLink

Ambas as placas possuem um conector de ponte NVLink. Nenhuma ponte está no formulário de pedido, então duas placas em um servidor se comunicam via PCIe, a menos que uma ponte seja cotada; pergunte antes de fazer o pedido se o trabalho precisar de uma.

Confiabilidade empresarial

GPUs de nível data center com memória ECC, recursos avançados de RAS e suporte empresarial para implantações de produção de missão crítica.

Perguntas frequentes sobre servidores GPU NVIDIA A100 H100

Perguntas comuns sobre a implantação e o gerenciamento de servidores dedicados empresariais com aceleração por GPU NVIDIA A100 H100 para treino de IA, inferência e computação de alto desempenho.

O que torna as GPUs NVIDIA A100 e H100 adequadas para cargas de trabalho empresariais de IA?

Ambas são aceleradores de data center construídos para aritmética em modelos grandes: memória HBM empilhada com ECC, Tensor Cores visados pelos principais frameworks e GPU Multi-Instância para dividir uma placa entre seus próprios trabalhos. A A100 é Ampere com Tensor Cores de terceira geração; a H100 é Hopper com Tensor Cores de quarta geração e o Transformer Engine para precisão FP8. Nenhuma das placas possui codificador de vídeo por hardware, portanto nenhuma é a escolha certa para transcodificação.

Como as GPUs A100 e H100 se comparam em desempenho e capacidades?

Como as placas PCIe que instalamos, a A100 tem 6.912 núcleos CUDA, 40 GB de HBM2 a 1.555 GB/s ou 80 GB de HBM2e a 1.935 GB/s, consome 250 ou 300 W e se conecta em PCIe Gen 4. A H100 tem 80 GB de HBM2e a 2.039 GB/s, consome 350 W e se conecta em PCIe Gen 5. Os números da H100 citados em outros lugares com memória HBM3 descrevem o módulo SXM5, que precisa de uma placa-base HGX que nenhum dos nossos servidores usa.

Quais recursos de conectividade e escalabilidade empresarial estão disponíveis?

Dentro de uma máquina, cada placa pode ser particionada em até sete instâncias isoladas de GPU Multi-Instância, cada uma com sua própria computação, memória e cache. Ambas as placas também possuem um conector de ponte NVLink, mas nenhuma ponte está no formulário de pedido: duas placas em um servidor se comunicam via PCIe, a menos que uma ponte seja cotada, então pergunte antes de fazer o pedido se o trabalho precisar de uma. Entre servidores, o link é a porta Ethernet de cada máquina, e as configurações multi-GPU e multi-nó têm sua própria página.

Quanto tempo leva para entregar um servidor A100 ou H100?

Uma máquina já montada em rack com a placa é entregue em cerca de 30 minutos após a verificação do pagamento. Quando instalamos uma placa que temos em estoque, leva de 4 a 24 horas; uma placa que precisamos comprar leva de cinco a dez dias úteis, ou de dez a quinze quando o acelerador está sob alocação, e você é informado antes de pagar.