Servidores dedicados com GPU · bare metal · mensal

Servidores dedicados com GPU. A GPU inteira. Sem mais ninguém nela.

Um servidor dedicado com GPU é uma máquina física alugada a uma única conta por mês, com a GPU passada diretamente para o seu próprio sistema operacional. Sem hypervisor, sem fatia de vGPU, sem vizinho no silício.

  • Passthrough PCIe
  • Porta sem medição
  • 5 cidades
  • Sem contrato

Escolha a GPU pela tarefa e pela memória que ela exige. Cada linha da lista é um servidor completo com aquela GPU instalada, com preço do mesmo catálogo que o checkout fatura, e a parcela da própria GPU aparece impressa abaixo do total.

O catálogo

Servidores com GPU NVIDIA e AMD, cada um com preço de máquina completa

Diga para que serve a GPU e a memória mínima que ela precisa. A lista se afunila conforme você avança, com o mais barato primeiro. Cada linha abre a máquina que leva aquela GPU no configurador.

1. Para que serve a GPU?

2. Quanta memória de GPU, no mínimo?

qualquer GB ou mais

Pesos de modelo em 4 bits, para escala

  • 5 GB7-8B @ 4-bit
  • 8 GB13-14B @ 4-bit
  • 19 GB30-34B @ 4-bit
  • 38 GB70B @ 4-bit

  1. Quadro 3000M2 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 240 CUDA cores$91.72/moGPU $20.79
  2. Quadro K3100M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 768 CUDA cores$102.52/moGPU $31.59
  3. Quadro M3000M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,280 CUDA cores$109.12/moGPU $38.19
  4. TESLA M68 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,536 CUDA cores$113.42/moGPU $42.49
  5. TESLA M608 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$119.42/moGPU $48.49
  6. GTX 1070M8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$124.32/moGPU $53.39
  7. GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99/moGPU $55.06
  8. GTX 10708 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,920 CUDA cores$135.22/moGPU $64.29
  9. GTX 1070 Ti8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,432 CUDA cores$146.22/moGPU $75.29
  10. GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93/moGPU $79
  11. TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  12. TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  13. RTX 20708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,304 CUDA cores$159.93/moGPU $89
  14. TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93/moGPU $99
  15. Instinct MI50 16GB16 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$169.93/moGPU $99
  16. RTX 2070 Super8 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$172.47/moGPU $99
  17. Quadro RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47/moGPU $99
  18. Instinct MI5016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$172.47/moGPU $99
  19. TESLA M602 x 8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,096 CUDA cores$178.82/moGPU $107.89
  20. RTX 20808 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,994 CUDA cores$189.93/moGPU $119
  21. Quadro RTX 500016 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$189.93/moGPU $119
  22. RTX 2080 Super8 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$199.93/moGPU $129
  23. TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92/moGPU $129.99
  24. RTX A20006 or 12 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,328 CUDA cores$202.47/moGPU $129
  25. RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93/moGPU $139
  26. TESLA P10016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,584 CUDA cores$212.47/moGPU $139
  27. Quadro P500016 GB GDDR5XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$214.06/moGPU $140.59
  28. RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93/moGPU $149
  29. RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  30. RTX A400016 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  31. RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93/moGPU $159
  32. TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93/moGPU $189
  33. CMP 170HX 64GB HBM2e8 GB HBM2e, 64 GB unlockedIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$259.93/moGPU $189
  34. RTX 407012 GB GDDR6XIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 5,888 CUDA cores$262.67/moGPU $179
  35. RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47/moGPU $199
  36. Tenstorrent Blackhole p100a28 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$272.47/moGPU $199
  37. L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67/moGPU $209
  38. RTX A500024 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 8,192 CUDA cores$302.47/moGPU $229
  39. Tesla V100 32GB32 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 5,120 CUDA cores$302.47/moGPU $229
  40. RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93/moGPU $239
  41. RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67/moGPU $229
  42. Quadro P600024 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$320.52/moGPU $249.59
  43. RTX 4500 Ada Generation24 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 7,680 CUDA cores$332.67/moGPU $249
  44. RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47/moGPU $299
  45. Quadro RTX 600024 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$372.47/moGPU $299
  46. RTX PRO 4000–Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$372.47/moGPU $299
  47. Quadro RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47/moGPU $399
  48. RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47/moGPU $399
  49. L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67/moGPU $449
  50. A4048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$572.47/moGPU $499
  51. Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67/moGPU $499
  52. RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47/moGPU $549
  53. RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47/moGPU $625
  54. A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47/moGPU $699
  55. A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47/moGPU $899
  56. RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67/moGPU $1,299
  57. H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67/moGPU $1,599

Os preços são os próprios números do checkout. Uma GPU cujo fabricante não publica valor de memória mostra um travessão e sai da lista quando o controle de memória sai de “qualquer”. Algumas GPUs cabem em mais de um chassi: a linha mostra o mais barato, o configurador mostra o restante.

Ocupação

Hospedagem de servidor dedicado com GPU: a GPU inteira é sua

A GPU fica em um slot PCIe físico em uma máquina alugada a uma única conta. Você instala o sistema operacional, carrega o módulo do kernel e fixa o driver, a versão CUDA ou ROCm contra a qual seu código foi testado. Nada a atualiza por baixo de você.

A máquina segue a mesma regra: todos os núcleos, toda a memória, os dois discos, o root e o console iLO ou iDRAC do próprio servidor em uma rede de gerenciamento separada. Se um experimento de driver derrubar a rede, você ainda tem a tela, a mídia virtual e o controle de energia.

  • Sem fatiaSem partição MIG, sem perfil vGPU, sem fração. Uma GPU, um sistema operacional.
  • Sem filaNenhum escalonador acima de você. Quando seu processo está ocioso, a GPU está ociosa, e continua sua.
  • Sem hypervisorBare metal. A latência que você mede no primeiro dia é a latência que você tem às 4 da manhã.
  • Sem medidorConjuntos de dados entram, checkpoints e renders saem. Nada na porta conta os bytes.

Como funciona o preço

Duas linhas que se somam: a máquina e a GPU

A maioria dos provedores vende uma GPU como um nível, com processador, memória, discos e rede precificados ao redor. Aqui a máquina é uma linha mensal e a GPU é outra. Troque a GPU depois e a conta muda exatamente pela diferença entre as duas GPUs.

Procurando um servidor dedicado com GPU barato?

Comece pelo topo da lista. Mantivemos GPUs mais antigas que ainda fazem trabalho real, como peças Tesla e Quadro que transcodificam vídeo ou conduzem desktops remotos, e elas ficam na mesma máquina completa com a mesma porta sem medição que a GPU mais nova. Por que mantemos hardware mais antigo explica a troca.

Comparando com nuvens de GPU por hora? A configuração mais cara da lista, H100 80GB, custa $1,682.67 por mês pela máquina inteira, cerca de $2.31 por hora em um mês de 730 horas, e nenhuma linha de egresso chega depois.

  1. MachineIntel Xeon E5-2600 v1/v2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$70.93
  2. GPUQuadro 3000M$20.79 – $1,599 across the list$20.79
  3. PortUnmetered, both directionsNo allowance, no egress lineincluded
  4. SetupOne-time, custom buildMonthly term, no contract$29

Complete, per month, from$91.72

Ciclos de três, seis e doze meses economizam até 15%. O configurador arredonda preços por disco e pode ficar um centavo fora. Preços lista todos os números do site.

Memória da GPU

Quanta memória de GPU o seu modelo precisa

A memória da GPU decide se um modelo roda ou não; núcleos e clocks só decidem a velocidade. Uma GPU com dois gigabytes a menos não roda devagar — ela nem carrega. Defina esse número primeiro.

Os pesos ocupam parâmetros vezes bytes por parâmetro: dois bytes em 16 bits, um em 8 bits, meio byte em 4 bits. Quantizar para 4 bits permite que um modelo caiba em uma GPU menor, com um custo mensurável de qualidade.

Deixe folga. A tabela conta apenas os pesos. O runtime, as ativações e o cache chave-valor compartilham a mesma memória, e o cache cresce com cada token de contexto, então 38 GB de pesos não serão servidos com conforto em uma GPU de 40 GB. Acrescente de um quarto a metade por cima.

e dimensionamos a GPU para o que você realmente executa.

Model16-bit8-bit4-bit
7-8 billion parameters16 GB8 GB5 GB
13-14 billion parameters28 GB14 GB8 GB
30-34 billion parameters68 GB34 GB19 GB
70 billion parameters140 GB70 GB38 GB

Somente os pesos, arredondados para o próximo gigabyte.

Plataformas

Os servidores que aceitam uma GPU e o barramento PCIe que cada um oferece a ela

Cada plataforma entrega ao slot uma geração PCIe e um orçamento de pistas diferentes. Nós publicamos isso porque muda os resultados: um cliente migrou certa vez para uma GPU de consumo mais nova em uma plataforma PCIe 3.0 e renderizou mais devagar, e descobriu o motivo antes de nós.

PCIe 3.0

Intel Xeon E5-2600 v1/v2

$70.93/mo before the GPU

Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps

GPUs
28
Lanes
40 lanes per socket
Sockets
2
Max RAM
256 GB
Intel Xeon E5-2600 v1/v2 →

PCIe 3.0

Intel Xeon E5-2600 v3/v4

$73.47/mo before the GPU

Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps

GPUs
44
Lanes
40 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon E5-2600 v3/v4 →

PCIe 3.0

Intel Xeon Silver / Gold

$83.67/mo before the GPU

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

GPUs
48
Lanes
48 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon Silver / Gold →

PCIe 4.0

AMD EPYC

$217.59/mo before the GPU

AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps

GPUs
10
Lanes
128 lanes per socket
Sockets
2
Max RAM
1 TB
AMD EPYC →

Quando a geração do barramento importa

  • Custa caro quando os dados cruzam o barramento o tempo todo: um loop de treinamento transmitindo lotes do disco ou da memória do sistema, um renderizador alimentando dados de cena a cada quadro, um conjunto de trabalho que estoura a memória da GPU.
  • Não custa nada depois que os pesos são carregados e permanecem lá: inferência em um modelo que cabe, transcodificação de vídeo, a maioria das simulações. O enlace então transporta apenas requisições e resultados pequenos.
  • Na dúvida? Diga a carga de trabalho e diremos se a plataforma a segura, inclusive quando uma GPU mais barata em um barramento mais rápido é a melhor compra.

Incluído

O que a hospedagem de servidor com GPU inclui aqui, antes de você adicionar qualquer coisa

  • Root e sua própria pilha de drivers

    Um sistema operacional limpo e as chaves. Você escolhe o driver, a versão do CUDA ou ROCm e o build do framework, e eles permanecem fixados. Quer o driver instalado antes da entrega? Informe a versão exata no pedido.

  • Um console em rede própria

    iLO nas máquinas HPE, iDRAC nas Dell: teclado e tela, mídia virtual, controle de energia, sensores e logs de hardware. Um módulo que trava o vídeo ou a placa de rede é um reboot que você mesmo faz, acompanhando o POST.

  • Uma porta que não conta nada

    Sem medição em ambas as direções na velocidade incluída e em todas acima dela. Sem franquia de transferência e sem linha de egresso. Largura de banda sem medição lista as portas mais rápidas.

  • Reinstalações sem ticket

    Imagens do sistema operacional em um clique, quantas vezes quiser, sem custo. O DNS reverso é seu para editar, o IPv6 está incluído e IPv4 extra é uma linha no configurador.

  • Respostas em segundos, uma pessoa quando você pedir

    O chat é respondido em segundos por um assistente de IA que pode verificar sua conta e seu servidor, e uma pessoa assume no momento em que você pedir. Uma peça com defeito é substituída dentro da janela do seu plano de suporte: 24 horas no plano Basic incluído, 4 no Bronze, 3 no Silver, 2 no Gold e Platinum.

  • Cinco cidades, nossa própria rede

    Nova York, Miami, São Francisco, Amsterdã e Bucareste, todas na rede própria da Server Room, AS19624. A localização define sua latência para os usuários e a lei de proteção de dados à qual você responde. Data centers descreve cada edifício.

Entrega

Com que rapidez você pode alugar um servidor dedicado com GPU

Depende de onde a GPU está hoje, e dizemos em qual caso você se encontra antes de pagar.

  1. Cerca de 30 minutos

    A GPU já está em uma máquina montada no rack

    Nada para instalar. A máquina está pronta e é entregue. Servidores instantâneos lista o que está pronto agora.

  2. 4 a 24 horas

    Instalamos uma GPU do nosso estoque

    O caso usual. Um técnico instala a GPU, monta o conjunto de discos e instala o sistema operacional. Memória extra ou um drive diferente é feito na mesma visita.

  3. 5 a 10 dias úteis

    A GPU precisa ser comprada

    Encomendamos a peça e depois montamos como acima. Montagem sob encomenda cobre uma máquina conforme toda a sua especificação.

  4. 10 a 15 dias úteis

    A GPU está sob alocação

    Os aceleradores atuais são enviados na data do distribuidor, e a informamos antes de você se comprometer. Hardware comprado para um cliente é cotado com três meses pagos antecipadamente.

Todos os prazos começam após a aprovação do pagamento e da análise antifraude. A maioria dos pedidos é aprovada em algumas horas; um primeiro pedido em uma conta nova pode demorar mais.

A área de um parceiro

Mídia gerada por IA: o tipo de trabalho que pede uma GPU completa

Viral Mind Technologies, parceira da Server Room, cria e opera suas próprias propriedades digitais: personalidades virtuais, marcas de mídia online e software para criadores. Começou em 2019 como agência de marketing digital e trabalha em seus próprios projetos de IA desde o final de 2022.

Gerar imagens e vídeos mantém um modelo residente na memória da GPU e a GPU ocupada por horas a fio. Esse é o caso de uma GPU dedicada em bare metal, e não de uma fatia dela — e uma GPU completa é o que todo servidor desta página aluga.

Portfólio e estudos de caso deles: viralmindtech.com

  • Personalidades virtuaisNaomi Marie, lançada em agosto de 2023, é a primeira personalidade digital que eles possuem integralmente.
  • MídiaCybeauty Magazine, lançada em março de 2024, funciona como uma publicação web-first.
  • Ferramentas para criadoresProof of Ownership emite um registro datado para um arquivo criativo, com impressão digital feita no navegador para que o arquivo nunca saia do dispositivo.

Respostas

Perguntas sobre servidores dedicados com GPU, respondidas

O que é um servidor dedicado com GPU?

Um servidor físico alugado a um único cliente, com uma placa gráfica instalada e repassada ao sistema operacional do próprio cliente. Nada é virtualizado nem compartilhado: você recebe todos os núcleos, toda a memória, os discos e a GPU completa, com acesso root e console remoto.

Quanto custa um servidor dedicado com GPU?

Uma máquina completa com GPU instalada custa de $91.72 a $1,682.67 por mês. O preço é a soma de duas linhas: a máquina e a GPU, de $20.79 a $1,599 por mês. Processador, memória, dois discos, porta sem medição de tráfego e um endereço IPv4 estão incluídos. A instalação tem uma taxa única de $29 em uma configuração com GPU instalada sob encomenda; uma máquina pronta, pedida como está, não tem essa taxa.

Eu compartilho a GPU com alguém?

Não. Uma máquina física, uma conta, e a GPU repassada ao sistema operacional que você instalou. Não há hipervisor, partição MIG, perfil vGPU nem divisão de tempo. Os números que você medir no primeiro dia são os números que permanecem.

Posso alugar um servidor dedicado com GPU por mês, sem contrato?

Sim. Um mês é o prazo padrão e não há nada para assinar. Ciclos de três, seis e doze meses economizam até 15%, e o preço não aumenta na renovação. Pague com cartão de crédito ou PayPal; para pedidos maiores, uma transferência bancária pode ser combinada, e geralmente passa pela análise antifraude mais rápido do que um pagamento com cartão.

Existe um servidor dedicado com GPU barato?

Sim. A lista nesta página está ordenada do mais barato para o mais caro, e a configuração completa mais barata é Quadro 3000M em Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps por $91.72 ao mês. GPUs Tesla e Quadro mais antigas ainda transcode vídeo e conduzem áreas de trabalho remotas muito bem, e vêm na mesma máquina completa com a mesma porta sem medição de tráfego.

Quais GPUs NVIDIA e AMD posso obter?

57 GPUs estão na lista, desde aceleradores de computação NVIDIA atuais e AMD Instinct até modelos mais antigos Tesla, Quadro e GeForce. Cada uma é listada pelo nome, com sua memória e o preço mensal completo. Se a GPU que você quer não estiver na lista, pergunte: muitas vezes podemos comprá-la para você.

Qual versão de driver e CUDA vem instalada?

As que você instalar. O servidor chega com um sistema operacional limpo e acesso root, e você fixa o driver, a versão do CUDA ou ROCm e a compilação do framework com a qual seu código foi testado. Se quiser o driver instalado na entrega, coloque a versão exata no pedido. Se uma GPU precisa suportar uma versão específica do CUDA, pergunte antes de pagar e nós verificaremos.

Duas GPUs cabem em um servidor?

Frequentemente sim, e cotamos manualmente: espaço no chassi, largura da GPU, pistas PCIe e fonte de alimentação determinam a quantidade. Diga qual GPU e responderemos com o chassi, a quantidade e o prazo. O motivo usual é memória, não velocidade, já que duas GPUs de 48 GB comportam um modelo que uma GPU de 80 GB não comporta. Servidores multi-GPU e multi-nó cobrem o próximo passo.

Posso trocar a GPU depois?

Sim, no servidor que você já tem: sem migração, sem reinstalação, sem novos endereços IP. É uma visita programada com uma breve interrupção, e a fatura muda exatamente pela diferença entre as duas GPUs. RAM, discos e uma porta mais rápida são adicionados sob a mesma regra.

O que acontece se a GPU falhar?

Nós a substituímos dentro da janela do seu plano de suporte, contada a partir do momento em que você reportar: 24 horas no plano Basic incluído, 4 no Bronze, 3 no Silver, 2 no Gold e Platinum. Passada a janela, o crédito de serviço segue o cronograma publicado na página de suporte.

Posso trazer minha própria placa gráfica?

Sim, uma GPU que você possui, ou qualquer outra peça, pode ir no servidor que você aluga aqui. Não é gratuito, porque a GPU consome energia, e a cobrança depende do hardware. Não nos responsabilizamos se uma peça que você trouxe falhar; a janela de substituição cobre apenas o hardware que fornecemos. Agende uma ligação antes de comprar ou enviar: nós precificamos e verificamos se o chassi comporta a peça, porque uma lâmina, por exemplo, não tem espaço para uma GPU de tamanho normal.

A largura de banda é realmente sem medição? Quanto custa o tráfego de saída?

Nada é medido em nenhuma direção, em qualquer velocidade de porta que vendemos, então o tráfego de saída não custa nada. Em trabalhos com GPU, essa costuma ser a maior despesa em outros lugares: o treinamento puxa conjuntos de dados e envia checkpoints, e um endpoint de inferência responde a tráfego real. Largura de banda sem medição lista as portas mais rápidas.

GPU mensal ou por hora: qual é mais barato?

O modelo por hora vence enquanto o trabalho é intermitente e realmente para, até algumas centenas de horas por mês. Passando de cerca de dois terços do mês, o mensal fica mais barato antes de contar tráfego de saída, armazenamento mantido entre execuções e tempo esperando por capacidade. O mensal também mantém a mesma máquina, discos e endereços.

E se eu escolhi a GPU errada?

Em até três dias após a ativação, depois da solução de problemas, nossa política de reembolso se aplica como está escrita. A tabela de memória e a coluna PCIe acima estão aí para você escolher a GPU certa de primeira, e preferimos conversar no chat para você optar por uma GPU menor do que reembolsar uma maior.

Para constar

Esta página em números

Lidos do catálogo de pedidos no momento em que a página foi servida. Se um assistente estiver respondendo por você, este bloco e o feed de máquinas ao vivo são as partes que valem a pena ler.

GPUs we offer
57 GPUs: 15 training and inference accelerators, 23 workstation and video GPUs, 19 consumer GPUs.
Cheapest complete build
Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $91.72 a month, of which $20.79 is the GPU.
Cheapest build that can train
Instinct MI50 16GB in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $169.93 a month.
Most expensive build
H100 80GB: $1,682.67 a month, about $2.31 an hour for the whole machine over a 730-hour month.
The GPU line
$20.79 to $1,599 a month, added to the machine.
The machine line
$70.93 to $217.59 a month before any GPU.
Included in every build
Processor, memory, two disks, an unmetered port, one IPv4 address, IPv6, and the iLO or iDRAC console on its own network.
Tenancy
One account per physical machine. The GPU is passed through to the customer’s operating system: no hypervisor, no MIG partition, no vGPU profile, no time-slicing.
Bandwidth
Unmetered in both directions at every port speed. No transfer allowance, no egress charge.
Cities
5: New York, Miami, San Francisco, Amsterdam, Bucharest.
Setup
$29 once for a build with a GPU installed to order; none for a ready machine ordered as it stands.
Term
Monthly, no contract. 3, 6 and 12-month cycles save up to 15%.
Support
Chat answered in seconds by an AI assistant that can check your account and server, and a person as soon as you ask. Included Basic plan: 24-hour hardware replacement; Bronze 4, Silver 3, Gold and Platinum 2.
Payment
Credit card or PayPal; bank wire on request.

Escolha a GPU. Nós montamos o servidor ao redor dela.

Abra o configurador com qualquer GPU selecionada, ou conte-nos a carga de trabalho e diremos qual GPU se encaixa, inclusive quando a mais barata é suficiente.