Placas gráficas dedicadas em bare metal · Server Room · desde 2004

A placa é uma linha na fatura. A máquina é a outra.

Todos os catálogos deste setor precificam a placa e o servidor como um valor único que outra pessoa compôs. Este aqui os mantém separados: a máquina tem seu próprio valor mensal, a placa tem o seu, e o total é a soma dos dois. Ajuste os dois controles abaixo — o que roda nela e quanta memória de placa o trabalho exige — e tudo o que continuar de pé é um servidor completo, precificado pelo mesmo catálogo que o checkout fatura.

Filtrar as prateleiras De quem é a placa?

Uma conta por máquina física. A placa é entregue ao seu sistema operacional via passthrough PCIe — seu módulo de kernel, sua versão de driver, sem hypervisor no caminho.

A bancada

Dois controles. O resto é aritmética.

Nada aqui reserva estoque ou abre uma conta. O valor em cada linha é o servidor completo com aquela placa instalada — processador, memória, discos espelhados, porta sem medição, um IPv4 — e a parte da própria placa está impressa abaixo, para que as duas metades do dinheiro permaneçam visíveis.

What runs on it?

How much card memory?

anygigabytes or more

  • 5 GB7-8 billion parameters, 4-bit
  • 8 GB13-14 billion parameters, 4-bit
  • 19 GB30-34 billion parameters, 4-bit
  • 38 GB70 billion parameters, 4-bit

  1. 3000M2 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 240 CUDA cores$91.72a month, complete$20.79 of that is the card
  2. K3100M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 768 CUDA cores$102.52a month, complete$31.59 of that is the card
  3. M3000M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,280 CUDA cores$109.12a month, complete$38.19 of that is the card
  4. TESLA M68 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,536 CUDA cores$113.42a month, complete$42.49 of that is the card
  5. TESLA M608 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$119.42a month, complete$48.49 of that is the card
  6. GTX 1070M8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$124.32a month, complete$53.39 of that is the card
  7. GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99a month, complete$55.06 of that is the card
  8. GTX 10708 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,920 CUDA cores$135.22a month, complete$64.29 of that is the card
  9. GTX 1070 Ti8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,432 CUDA cores$146.22a month, complete$75.29 of that is the card
  10. GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93a month, complete$79 of that is the card
  11. TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
  12. TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
  13. RTX 20708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,304 CUDA cores$159.93a month, complete$89 of that is the card
  14. TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93a month, complete$99 of that is the card
  15. Instinct MI50 16GB16 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$169.93a month, complete$99 of that is the card
  16. RTX 2070 Super8 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$172.47a month, complete$99 of that is the card
  17. RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47a month, complete$99 of that is the card
  18. Instinct MI5016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$172.47a month, complete$99 of that is the card
  19. TESLA M602 x 8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,096 CUDA cores$178.82a month, complete$107.89 of that is the card
  20. RTX 20808 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,994 CUDA cores$189.93a month, complete$119 of that is the card
  21. RTX 500016 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$189.93a month, complete$119 of that is the card
  22. RTX 2080 Super8 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$199.93a month, complete$129 of that is the card
  23. TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92a month, complete$129.99 of that is the card
  24. RTX A2000 40 Mh/s6 or 12 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 40 MH/s$202.47a month, complete$129 of that is the card
  25. RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93a month, complete$139 of that is the card
  26. TESLA P10016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,584 CUDA cores$212.47a month, complete$139 of that is the card
  27. P500016 GB GDDR5XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$214.06a month, complete$140.59 of that is the card
  28. RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93a month, complete$149 of that is the card
  29. RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
  30. RTX A400016 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
  31. RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93a month, complete$159 of that is the card
  32. TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93a month, complete$189 of that is the card
  33. CMP-170HX Mining GPU 164MH/s8 GB HBM2eIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 164 MH/s$259.93a month, complete$189 of that is the card
  34. RTX 407012 GB GDDR6XIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 5,888 CUDA cores$262.67a month, complete$179 of that is the card
  35. RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47a month, complete$199 of that is the card
  36. Tenstorrent Blackhole p100a28 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$272.47a month, complete$199 of that is the card
  37. L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67a month, complete$209 of that is the card
  38. RTX A500024 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 8,192 CUDA cores$302.47a month, complete$229 of that is the card
  39. Tesla V100 32GB32 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 5,120 CUDA cores$302.47a month, complete$229 of that is the card
  40. RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93a month, complete$239 of that is the card
  41. RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67a month, complete$229 of that is the card
  42. P600024 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$320.52a month, complete$249.59 of that is the card
  43. RTX 4500 Ada Generation24 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 7,680 CUDA cores$332.67a month, complete$249 of that is the card
  44. RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47a month, complete$299 of that is the card
  45. RTX 600024 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$372.47a month, complete$299 of that is the card
  46. RTX PRO 4000memory not publishedIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$372.47a month, complete$299 of that is the card
  47. RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47a month, complete$399 of that is the card
  48. RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47a month, complete$399 of that is the card
  49. L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67a month, complete$449 of that is the card
  50. A4048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$572.47a month, complete$499 of that is the card
  51. Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67a month, complete$499 of that is the card
  52. RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47a month, complete$549 of that is the card
  53. RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47a month, complete$625 of that is the card
  54. A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47a month, complete$699 of that is the card
  55. A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47a month, complete$899 of that is the card
  56. RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67a month, complete$1,299 of that is the card
  57. H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67a month, complete$1,599 of that is the card

Estimativas do catálogo de pedidos, não uma tabela de tarifas, e são os próprios valores do checkout. Uma placa cujo fabricante não publica valor de memória não imprime nenhum aqui — e desaparece assim que o controle de memória sai de “qualquer”, porque não mostraremos uma peça passando por uma barra que não podemos verificar; pergunte e lemos o valor diretamente da placa. Várias peças se encaixam em mais de um chassis por mais de um preço: a linha mostra o encaixe mais barato, o configurador lista os demais.

Contado no momento em que a página foi servida

  • 57Cards on the shelves
  • $20.79Cheapest card line, per month
  • $91.72Cheapest complete build with a card
  • 5Cities
  • 0Bytes metered

Lido do catálogo de pedidos no momento da renderização, nunca digitado. Retire uma placa da loja amanhã e esta faixa será menor amanhã. O que está em rack e ligado esta manhã é uma questão separada, com sua própria página: servidores instantâneos.

Locação, antes de qualquer coisa

Um locatário. A placa inteira. Nada agendado acima de você.

Repassada, não fatiada.

A placa fica em um slot PCIe físico em uma máquina alugada para uma única conta, e o sistema operacional que a possui é aquele que você instalou. Você carrega o módulo do kernel, fixa o driver, e o CUDA ou ROCm permanece na versão contra a qual seu código foi testado. Não há camada de hypervisor, nem partição MIG, nem perfil vGPU, nem agendador de fatias de tempo — a latência que você mede na primeira tarde é a latência que você mantém, às quatro da tarde e às quatro da manhã.

O chassis segue a mesma regra: cada núcleo, cada DIMM, ambos os discos, o root e o iLO ou iDRAC da própria máquina em uma rede de gerenciamento separada para console, mídia virtual e energia. Um experimento de driver que derrube a rede ainda deixa a tela para você.

  • Sem fatiaSem partição MIG, sem perfil vGPU, sem alocação fracionária. Uma placa, um sistema operacional.
  • Sem filaNenhum agendador compartilha o silício. Quando seu processo está ocioso, a placa está ociosa — e continua sendo sua.
  • Sem camadaBare metal. Seu kernel, seus módulos, sua versão de driver, fixados até você movê-los.
  • Sem medidorDatasets entram, checkpoints e renders saem. Nada na porta conta os bytes.

O modelo de precificação

Duas linhas que se somam. Não um tier.

Uma “instância” de GPU é a decisão de outra pessoa sobre o que um comprador de placa deveria pagar pelo processador, memória, discos e rede ao redor da placa. Aqui esses itens são uma linha, a placa é outra, e elas se somam — e é por isso que qualquer extremidade da prateleira acima se encaixa no mesmo chassis, e por que trocar a placa altera a fatura exatamente pela diferença entre as duas placas.

  1. The machineIntel Xeon E5-2600 v1/v2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$70.93
  2. The cardAny part on the shelves above$20.79 to $1,599, cheapest shelf to dearest$20.79
  3. The portUnmetered, both directionsNo allowance, no egress line, at any speedincluded
  4. SetupNothingNo contract; the default term is one month

Complete machine, card fitted, per month, from$91.72

The same arithmetic at the other end of the list: H100 80GB in a complete machine is $1,682.67 a month — $2.31 an hour if the comparison is against hourly billing, and the traffic adds nothing.

O configurador arredonda o preço por disco e pode ficar um ou dois centavos fora desses valores. Ciclos de cobrança mais longos têm desconto adicional — preços reúne todos os valores em um só lugar, e hardware mais antigo, preço mais baixo é o argumento permanente para a existência da base da prateleira.

Memória da placa

O encaixe é binário. Todo o resto é apenas velocidade.

Núcleos e clocks definem a rapidez com que um modelo roda. A memória da placa define se ele roda: os pesos ou estão residentes ou não estão, e uma placa com dois gigabytes a menos não roda devagar — ela sai. Resolva esse número antes de qualquer outro, porque é a única especificação que quase ninguém imprime ao lado de um preço.

A aritmética é parâmetros vezes bytes por parâmetro: dois bytes cada em 16 bits, um em 8 bits, meio byte em 4 bits. Quantizar para 4 bits é a alavanca que assenta um modelo numa prateleira menor, e ela troca uma quantidade mensurável de qualidade pelo assento.

Reserve folga. A tabela são os pesos e nada mais. O runtime, as ativações e o cache chave-valor vivem todos na mesma memória, e o cache cresce com cada token de contexto — 38 GB de pesos não são servidos com conforto a partir de uma placa de 40 GB. Deixe um quarto a metade a mais, ou diga-nos o modelo e o comprimento de contexto que você realmente roda e nós dimensionaremos contra isso.

Weights alone. Leave head-room for the runtime and the context window before settling on a card.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB8 GB5 GB
13-14 billion parameters28 GB14 GB8 GB
30-34 billion parameters68 GB34 GB19 GB
70 billion parameters140 GB70 GB38 GB

O chassi por baixo

Quatro plataformas aceitam uma placa, e o barramento é o que as separa.

Cada uma entrega ao slot uma geração de link e um orçamento de pistas diferentes, e a coluna é impressa porque muda os resultados e ninguém mais a publica: um cliente trocou uma geração de consumo pela seguinte numa plataforma Gen 3 e ficou mais lento, e descobriu o porquê antes de nós. O número pertence à página.

Intel Xeon E5-2600 v1/v2

$70.93per month, before the card

Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps

Cards accepted
28
Bus to the card
PCIe 3.0
Lanes
40 lanes per socket
Sockets
2
Memory ceiling
256 GB

Open it in the configurator →

Intel Xeon E5-2600 v3/v4

$73.47per month, before the card

Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps

Cards accepted
44
Bus to the card
PCIe 3.0
Lanes
40 lanes per socket
Sockets
2
Memory ceiling
1 TB

Open it in the configurator →

Intel Xeon Silver / Gold

$83.67per month, before the card

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

Cards accepted
48
Bus to the card
PCIe 3.0
Lanes
48 lanes per socket
Sockets
2
Memory ceiling
1 TB

Open it in the configurator →

AMD EPYC

$217.59per month, before the card

AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps

Cards accepted
10
Bus to the card
PCIe 4.0
Lanes
128 lanes per socket
Sockets
2
Memory ceiling
1 TB

Open it in the configurator →

Quando a geração do link importa, medido por carga de trabalho

Uma placa construída para um barramento mais novo roda corretamente num mais antigo; ela simplesmente não consegue mover dados pelo link na taxa de projeto. Se isso lhe custa algo depende inteiramente de onde os dados estão.

  • Custa-lhe quando o tráfego cruza o barramento continuamente — um loop de treinamento transmitindo lotes do disco ou da memória do sistema, um renderizador alimentando dados de cena a cada quadro, qualquer conjunto de trabalho que transborde da memória da placa.
  • Não lhe custa nada uma vez que os pesos estão residentes e permanecem residentes — inferência num modelo que cabe, transcodificação de vídeo, a maioria das simulações. O link então carrega pedidos e resultados, e esses são pequenos.
  • Nomeie a carga de trabalho se não tiver certeza. Diremos claramente se a plataforma a estrangula — inclusive quando a especificação honesta é uma placa mais barata num link mais rápido, em vez de uma placa mais cara num mais lento.

Já no valor

O que cada máquina traz antes de você adicionar qualquer coisa.

  • Root, e uma pilha de drivers que é sua

    Um sistema operacional limpo e as chaves. Você escolhe a versão do driver, a versão do CUDA ou ROCm e o build do framework, e os fixa — nada é atualizado sob um prazo. Quer o driver no lugar antes da entrega? Informe a versão no pedido e ele estará.

  • Console fora de banda em rede própria

    iLO no chassi HPE, iDRAC no Dell: console de teclado e tela, mídia virtual, controle de energia, sensores e registros de hardware. Um módulo que trava o display ou a NIC é uma reinicialização que você mesmo executa, assistindo ao POST — não um chamado.

  • Uma porta que nada conta

    Sem medição em ambas as direções na velocidade incluída e em toda velocidade acima dela. Sem franquia de transferência, sem linha de egresso em fatura alguma — datasets entrando, checkpoints saindo, um modelo servido a tráfego real, tudo pelo preço da porta. Banda sem medição é a escada para cima, e é a maior linha que esta página apaga de uma fatura de hyperscaler.

  • Reinstalações sem chamado

    Imagens do sistema operacional em um clique, quantas vezes quiser, sem custo — um experimento de driver que dá errado custa vinte minutos. O DNS reverso é seu para editar, IPv6 está incluído, e IPv4 adicional é uma linha de catálogo, não uma negociação.

  • Engenheiros de plantão, o tempo todo

    Telefone, chat ao vivo e chamados em cada máquina, e um componente com falha é substituído em até quatro horas após o relato por telefone ou chat. Suporte publica os tempos de resposta e o cronograma de créditos por escrito.

  • Cinco salas em dois continentes

    Nova York, Miami, São Francisco, Amsterdã e Bucareste. Onde a máquina está define sua latência para o que a chama e o regime de proteção de dados ao qual ela responde; data centers descreve cada edifício.

Prazo de entrega

De meia hora a três semanas, definido por onde a placa está hoje.

Um único número seria mentira em uma direção ou outra, porque nunca foi um número só: uma placa já assentada numa máquina em rack é uma entrega; uma placa que precisa ser comprada é uma ordem de compra. O que nos comprometemos é dizer em qual degrau você está antes de pagar.

  1. ~30 minutos

    A placa já está assentada numa máquina em rack

    Nada é instalado e nada se move. A máquina é imageada e entregue. Servidores instantâneos lista o que está lá agora.

  2. 4–24 horas

    Uma placa do nosso próprio estoque é instalada

    O caso comum desta página. A peça está no depósito; um técnico a assenta, monta o array e instala o sistema operacional. Uma máquina em rack que está próxima mas não exata — memória adicionada, um drive trocado, o array reconstruído no seu layout — é a mesma visita, feita no lugar.

  3. 5–10 dias úteis

    A placa é comprada

    Uma peça que não mantemos é encomendada, e então a montagem prossegue como acima. Montagem sob encomenda é a página quando toda a especificação é sua.

  4. 10–15 dias úteis

    A placa está em alocação

    Aceleradores da geração atual são enviados na data do distribuidor, não na nossa, e nomeamos esse poste longo antes de você se comprometer, não depois. Hardware comprado para um cliente é cotado com três meses adiantados, porque é uma máquina que não podemos realugar se a conta fechar na segunda semana.

Cada degrau começa quando o pagamento e a revisão antifraude são liberados — o único passo para o qual não faremos promessa: a maioria dos pedidos é liberada em algumas horas; um primeiro pedido de uma conta nova pode demorar mais. Cartão, PayPal, ACH e transferência são aceitos, e num primeiro pedido maior uma transferência geralmente libera a revisão mais rápido que um cartão.

Perguntas já feitas, respondidas aqui

As onze perguntas que esta página existe para resolver.

Reunidas do chat e dos tickets, aproximadamente na ordem em que os compradores as fazem. A primeira já custou pedidos reais, e é por isso que abre a lista.

Eu compartilho a GPU com alguém?
Não. Uma máquina física, uma conta, e a placa repassada ao sistema operacional que você instalou — sem hipervisor, sem partição MIG, sem perfil vGPU, sem escalonador de fatias de tempo, sem job em lote do vizinho no seu silício. Os números que você mede no primeiro dia são os números que você mantém.
Duas placas cabem em uma máquina?
Frequentemente, e isso é cotado em vez de marcado: folga no chassi, largura física da placa, orçamento de pistas e a fonte definem a contagem, então uma resposta honesta exige a peça específica. Diga a placa, e a resposta volta com o chassi, a contagem e o prazo. O motivo usual é memória em vez de velocidade — duas placas de 48 GB seguram um modelo que uma de 80 GB não segura — e multi-GPU e multi-nó é a página vizinha quando a segunda placa começa a parecer uma segunda máquina.
Qual driver e versão de CUDA vêm instalados?
Os que você instalar. A máquina chega com um sistema operacional limpo e root; você fixa o driver, a versão de CUDA ou ROCm e a build do framework naquilo contra o que seu código foi validado, e nada os move depois. Se quiser o driver no lugar antes da entrega, coloque a versão exata no pedido. Se uma placa específica precisa suportar uma versão específica de CUDA, pergunte antes de pagar e nós verificamos em vez de adivinhar.
A placa que eu quero não está em estoque hoje — e então?
Então ela é instalada do estoque ou comprada, e você fica sabendo qual antes de pagar: peças em estoque são instaladas em quatro a vinte e quatro horas, peças compradas levam de cinco a dez dias úteis, e aceleradores sujeitos a alocação, de dez a quinze. Esta página deliberadamente não imprime contagens de estoque — uma placa é uma peça que instalamos, não um produto que vai e vem — mas quando a exigência é uma máquina hoje, servidores instantâneos lista o que está no rack e ligado agora.
A placa pode mudar depois da implantação?
Sim, na máquina que você já tem: sem migração, sem reinstalação, sem endereços novos. É uma visita programada ao rack com uma breve indisponibilidade, e a fatura muda exatamente pela diferença entre as duas placas. Memória, discos e velocidade de porta sobem sob a mesma regra.
O que acontece quando uma placa morre?
Ela é trocada, num relógio que o contrato põe por escrito: quatro horas a partir do momento em que é reportada por telefone ou chat ao vivo. Perdeu a janela e o crédito de serviço segue uma tabela publicada em vez de um pedido de boa vontade. Suporte traz a tabela e o número de telefone.
A largura de banda é mesmo sem medição? Quanto custa o egresso?
De verdade: nada é medido em nenhuma direção, em qualquer velocidade de porta que vendemos, e o egresso custa zero porque não existe medidor para cobrá-lo. Em trabalho de GPU essa costuma ser a maior linha em outros lugares — um treino puxa conjuntos de dados para dentro e empurra checkpoints para fora, um endpoint de inferência atende tráfego real, e o egresso por gigabyte cobra cada um desses bytes. Largura de banda sem medição é o degrau acima da velocidade incluída.
Mensal aqui versus uma GPU por hora — onde fica o ponto de virada?
A aritmética resolve. Por hora vence enquanto o trabalho é intermitente e realmente para — até algumas centenas de horas por mês. Passando de cerca de dois terços do mês deixa de ser parelho, antes de contar egresso, armazenamento persistente entre execuções e tempo de fila esperando capacidade. Mensal também significa a mesma máquina, discos e endereços no mês seguinte, com o que cargas de produção se importam mais do que benchmarks.
Como se paga, e como é o contrato?
Cartão, PayPal, ACH ou transferência bancária — e não há contrato para assinar: um mês é o prazo padrão, ciclos de três, seis e doze meses levam desconto, e a renovação não aumenta o preço. Num primeiro pedido maior, uma transferência costuma liberar a revisão de fraude mais rápido que um cartão, o que vale saber antes de uma build ficar esperando por isso.
E se a placa se revelar a errada?
Em até três dias corridos da primeira ativação, depois de esgotada a solução de problemas, a política de reembolso se aplica como escrita. A tabela de dimensionamento e a coluna de geração de barramento acima existem exatamente para tornar essa cláusula desnecessária — preferimos convencê-lo a descer para uma placa menor do que processar a devolução de uma maior.
Vocês têm a placa mais nova?
Às vezes — e geralmente é a especificação errada. A peça mais nova é escassa, sujeita a alocação, precificada como se cada transistor fosse necessário, e assentada em plataformas que não conseguem alimentá-la com a geração de barramento para a qual foi projetada. A maior parte do trabalho de GPU aqui não é treino de fronteira: é servir um modelo que já cabe, codificar vídeo, renderizar quadros, tocar desktops — trabalhos em que a placa certa tem duas gerações de idade por um quarto do dinheiro. Diga o trabalho; se a resposta genuinamente for a peça mais nova, nós dizemos, com o custo e a data em que ela pode existir.

Páginas vizinhas

Tudo a um passo desta página.

Esta página trata de uma pergunta — quais placas instalamos e quanto cada uma custa. As perguntas de cada lado dela têm sua própria página, e este é o conjunto completo.

Ainda pesando duas prateleiras? — quem responder já dimensionou uma destas antes, e dirá quando a placa mais barata é a especificação certa.

For the record

The whole page, reduced to figures.

Read from the order catalog at the moment this page was served. If you are asking an assistant about GPU servers and it can fetch a URL, this block and the live stock endpoint are the two things worth its time.

Cards we fit
57 add-in cards on 3 shelves: 15 training and inference accelerators, 23 workstation and video parts, 19 consumer parts.
The card, as a line
$20.79 to $1,599 a month, added to the machine it seats in. The machine’s own figure never moves with the card.
A complete machine with a card in it
$91.72 to $1,682.67 a month — processor, memory, mirrored disks, unmetered port, one IPv4 and the out-of-band console all in the figure. Nothing left to add.
The machine alone
$70.93 to $217.59 a month before any card is fitted.
Cheapest build that can train
Instinct MI50 16GB, $169.93 a month complete.
Dearest
H100 80GB, $1,682.67 a month complete — $2.31 an hour for the whole machine if you are comparing against hourly billing, with no egress charge arriving later.
Tenancy
One account per physical machine, and the card is passed through to that account’s own operating system. No hypervisor in the path, no MIG partition, no vGPU profile, no time-slicing.
Bandwidth
Unmetered in both directions at every port speed we sell. No transfer allowance and no egress line on any invoice — datasets, checkpoints and rendered output move for the price of the port.
Where
5 cities: New York, Miami, San Francisco, Amsterdam, Bucharest.
Term
Monthly, no contract. Three, six and twelve-month cycles discount up to 15%.
Multiple cards
Possible, quoted rather than ticked: chassis width, lane budget and power decide the count, so the answer names the specific card. Ask and the reply names the chassis and the lead time.
Payment
Card, PayPal, ACH and wire.