Tarjetas gráficas adicionales en bare metal · Server Room · desde 2004

La tarjeta es una línea en la factura. La máquina es la otra.

Todos los catálogos de este sector fijan el precio de la tarjeta y del servidor como una sola cifra compuesta por otra persona. Este los mantiene separados: la máquina tiene su propia cifra mensual, la tarjeta tiene la suya, y el total es su suma. Ajuste los dos controles de abajo — qué se ejecuta en ella y cuánta memoria de tarjeta necesita el trabajo — y todo lo que siga en pie es un servidor completo, con el precio del mismo catálogo que factura el pago.

Acote las opciones ¿De quién es la tarjeta?

Una cuenta por máquina física. La tarjeta se entrega a su sistema operativo mediante passthrough PCIe — su módulo de kernel, su versión de controlador, sin hipervisor en el camino.

El banco de pruebas

Dos controles. El resto es aritmética.

Nada aquí reserva existencias ni abre una cuenta. La cifra de cada fila es el servidor completo con esa tarjeta instalada — procesador, memoria, discos en espejo, puerto sin medición, una IPv4 — y la parte correspondiente a la tarjeta se imprime debajo, para que ambas mitades del dinero sigan visibles.

What runs on it?

How much card memory?

anygigabytes or more

  • 5 GB7-8 billion parameters, 4-bit
  • 8 GB13-14 billion parameters, 4-bit
  • 19 GB30-34 billion parameters, 4-bit
  • 38 GB70 billion parameters, 4-bit

  1. 3000M2 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 240 CUDA cores$91.72a month, complete$20.79 of that is the card
  2. K3100M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 768 CUDA cores$102.52a month, complete$31.59 of that is the card
  3. M3000M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,280 CUDA cores$109.12a month, complete$38.19 of that is the card
  4. TESLA M68 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,536 CUDA cores$113.42a month, complete$42.49 of that is the card
  5. TESLA M608 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$119.42a month, complete$48.49 of that is the card
  6. GTX 1070M8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$124.32a month, complete$53.39 of that is the card
  7. GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99a month, complete$55.06 of that is the card
  8. GTX 10708 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,920 CUDA cores$135.22a month, complete$64.29 of that is the card
  9. GTX 1070 Ti8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,432 CUDA cores$146.22a month, complete$75.29 of that is the card
  10. GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93a month, complete$79 of that is the card
  11. TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
  12. TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
  13. RTX 20708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,304 CUDA cores$159.93a month, complete$89 of that is the card
  14. TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93a month, complete$99 of that is the card
  15. Instinct MI50 16GB16 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$169.93a month, complete$99 of that is the card
  16. RTX 2070 Super8 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$172.47a month, complete$99 of that is the card
  17. RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47a month, complete$99 of that is the card
  18. Instinct MI5016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$172.47a month, complete$99 of that is the card
  19. TESLA M602 x 8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,096 CUDA cores$178.82a month, complete$107.89 of that is the card
  20. RTX 20808 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,994 CUDA cores$189.93a month, complete$119 of that is the card
  21. RTX 500016 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$189.93a month, complete$119 of that is the card
  22. RTX 2080 Super8 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$199.93a month, complete$129 of that is the card
  23. TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92a month, complete$129.99 of that is the card
  24. RTX A2000 40 Mh/s6 or 12 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 40 MH/s$202.47a month, complete$129 of that is the card
  25. RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93a month, complete$139 of that is the card
  26. TESLA P10016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,584 CUDA cores$212.47a month, complete$139 of that is the card
  27. P500016 GB GDDR5XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$214.06a month, complete$140.59 of that is the card
  28. RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93a month, complete$149 of that is the card
  29. RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
  30. RTX A400016 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
  31. RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93a month, complete$159 of that is the card
  32. TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93a month, complete$189 of that is the card
  33. CMP-170HX Mining GPU 164MH/s8 GB HBM2eIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 164 MH/s$259.93a month, complete$189 of that is the card
  34. RTX 407012 GB GDDR6XIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 5,888 CUDA cores$262.67a month, complete$179 of that is the card
  35. RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47a month, complete$199 of that is the card
  36. Tenstorrent Blackhole p100a28 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$272.47a month, complete$199 of that is the card
  37. L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67a month, complete$209 of that is the card
  38. RTX A500024 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 8,192 CUDA cores$302.47a month, complete$229 of that is the card
  39. Tesla V100 32GB32 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 5,120 CUDA cores$302.47a month, complete$229 of that is the card
  40. RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93a month, complete$239 of that is the card
  41. RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67a month, complete$229 of that is the card
  42. P600024 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$320.52a month, complete$249.59 of that is the card
  43. RTX 4500 Ada Generation24 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 7,680 CUDA cores$332.67a month, complete$249 of that is the card
  44. RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47a month, complete$299 of that is the card
  45. RTX 600024 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$372.47a month, complete$299 of that is the card
  46. RTX PRO 4000memory not publishedIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$372.47a month, complete$299 of that is the card
  47. RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47a month, complete$399 of that is the card
  48. RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47a month, complete$399 of that is the card
  49. L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67a month, complete$449 of that is the card
  50. A4048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$572.47a month, complete$499 of that is the card
  51. Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67a month, complete$499 of that is the card
  52. RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47a month, complete$549 of that is the card
  53. RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47a month, complete$625 of that is the card
  54. A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47a month, complete$699 of that is the card
  55. A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47a month, complete$899 of that is the card
  56. RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67a month, complete$1,299 of that is the card
  57. H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67a month, complete$1,599 of that is the card

Estimaciones del catálogo de pedidos, no de una tarifa, y son las cifras propias del pago. Una tarjeta cuyo fabricante no publica cifra de memoria no imprime ninguna aquí — y desaparece en cuanto el control de memoria deja de estar en “cualquiera”, porque no mostraremos un componente que supere un listón que no podemos verificar; pregunte y leemos la cifra directamente de la tarjeta. Varios componentes se instalan en más de un chasis a más de un precio: la fila muestra el asiento más barato, el configurador enumera el resto.

Contado en el momento de servir la página

  • 57Cards on the shelves
  • $20.79Cheapest card line, per month
  • $91.72Cheapest complete build with a card
  • 5Cities
  • 0Bytes metered

Leído del catálogo de pedidos en el momento del renderizado, nunca escrito a mano. Retire una tarjeta de la tienda mañana y esta franja será más pequeña mañana. Lo que está en bastidor y encendido esta mañana es una cuestión aparte con su propia página: servidores instantáneos.

La tenencia, antes que nada

Un solo inquilino. Toda la tarjeta. Nada programado por encima de usted.

Pasada directamente, no troceada.

La tarjeta está en una ranura PCIe física de una máquina alquilada a una sola cuenta, y el sistema operativo que la posee es el que usted instaló. Usted carga el módulo del kernel, fija el controlador, y CUDA o ROCm se mantiene en la versión contra la que se probó su código. No hay capa de hipervisor, ni partición MIG, ni perfil vGPU, ni planificador de tiempo compartido — la latencia que mida la primera tarde es la latencia que conserva, a las cuatro de la tarde y a las cuatro de la madrugada.

El chasis sigue la misma regla: cada núcleo, cada DIMM, ambos discos, el root y el iLO o iDRAC propio de la máquina en una red de gestión separada para consola, medios virtuales y alimentación. Un experimento de controladores que tire la red le deja aún la pantalla.

  • Sin particionesSin partición MIG, sin perfil vGPU, sin asignación fraccionada. Una tarjeta, un sistema operativo.
  • Sin colaNingún planificador comparte el silicio. Cuando su proceso está inactivo, la tarjeta está inactiva — y sigue siendo suya.
  • Sin capasBare metal. Su kernel, sus módulos, su versión de controlador, fijados hasta que usted los mueva.
  • Sin medidorConjuntos de datos entran, checkpoints y renders salen. Nada en el puerto cuenta los bytes.

El modelo de precios

Dos líneas que suman. No es un nivel.

Una “instancia” de GPU es la decisión de otra persona sobre lo que un comprador de tarjetas debería pagar por el procesador, la memoria, los discos y la red que rodean a la tarjeta. Aquí esos son una línea, la tarjeta es otra, y suman — por eso cualquiera de los extremos del estante de arriba se instala en el mismo chasis, y por eso cambiar la tarjeta modifica la factura exactamente en la diferencia entre las dos tarjetas.

  1. The machineIntel Xeon E5-2600 v1/v2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$70.93
  2. The cardAny part on the shelves above$20.79 to $1,599, cheapest shelf to dearest$20.79
  3. The portUnmetered, both directionsNo allowance, no egress line, at any speedincluded
  4. SetupNothingNo contract; the default term is one month

Complete machine, card fitted, per month, from$91.72

The same arithmetic at the other end of the list: H100 80GB in a complete machine is $1,682.67 a month — $2.31 an hour if the comparison is against hourly billing, and the traffic adds nothing.

El configurador redondea el precio por disco y puede quedar uno o dos céntimos por debajo de estas cifras. Los ciclos de facturación más largos descuentan más — precios tiene todas las cifras en un solo lugar, y hardware más antiguo, precio más bajo es el argumento permanente de por qué existe la parte baja del estante.

Memoria de la tarjeta

El ajuste es binario. Todo lo demás es solo velocidad.

Los núcleos y las frecuencias determinan lo rápido que corre un modelo. La memoria de la tarjeta determina si corre: los pesos están residentes o no lo están, y una tarjeta que se queda dos gigabytes corta no corre despacio — se cae. Resuelve esta cifra antes que cualquier otra, porque es la única especificación que casi nadie imprime junto a un precio.

La aritmética es parámetros por bytes por parámetro: dos bytes cada uno a 16 bits, uno a 8 bits, medio byte a 4 bits. Cuantizar a 4 bits es la palanca que sienta un modelo en una balda más pequeña, y cambia una cantidad medible de calidad por el asiento.

Deja margen. La tabla son los pesos y nada más. El tiempo de ejecución, las activaciones y la caché clave-valor viven en la misma memoria, y la caché crece con cada token de contexto — 38 GB de pesos no se sirven con holgura desde una tarjeta de 40 GB. Deja entre un cuarto y la mitad más, o dinos el modelo y la longitud de contexto que realmente ejecutas y lo dimensionaremos contra eso.

Weights alone. Leave head-room for the runtime and the context window before settling on a card.
Model16-bit8-bit4-bit
7-8 billion parameters16 GB8 GB5 GB
13-14 billion parameters28 GB14 GB8 GB
30-34 billion parameters68 GB34 GB19 GB
70 billion parameters140 GB70 GB38 GB

El chasis debajo

Cuatro plataformas aceptan una tarjeta, y el bus es lo que las separa.

Cada una entrega a la ranura una generación de enlace y un presupuesto de carriles distintos, y la columna se imprime porque cambia los resultados y nadie más la publica: un cliente cambió una vez una generación de consumo por la siguiente en una plataforma Gen 3 y quedó más lento, y había averiguado el porqué antes que nosotros. La cifra pertenece a la página.

Intel Xeon E5-2600 v1/v2

$70.93per month, before the card

Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps

Cards accepted
28
Bus to the card
PCIe 3.0
Lanes
40 lanes per socket
Sockets
2
Memory ceiling
256 GB

Open it in the configurator →

Intel Xeon E5-2600 v3/v4

$73.47per month, before the card

Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps

Cards accepted
44
Bus to the card
PCIe 3.0
Lanes
40 lanes per socket
Sockets
2
Memory ceiling
1 TB

Open it in the configurator →

Intel Xeon Silver / Gold

$83.67per month, before the card

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

Cards accepted
48
Bus to the card
PCIe 3.0
Lanes
48 lanes per socket
Sockets
2
Memory ceiling
1 TB

Open it in the configurator →

AMD EPYC

$217.59per month, before the card

AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps

Cards accepted
10
Bus to the card
PCIe 4.0
Lanes
128 lanes per socket
Sockets
2
Memory ceiling
1 TB

Open it in the configurator →

Cuándo importa la generación del enlace, medido por carga de trabajo

Una tarjeta construida para un bus más nuevo funciona correctamente en uno más antiguo; simplemente no puede mover datos por el enlace a su velocidad de diseño. Que eso te cueste algo depende por completo de dónde residen los datos.

  • Te cuesta cuando el tráfico cruza el bus de forma continua — un bucle de entrenamiento que transmite lotes desde disco o memoria del sistema, un renderizador que alimenta datos de escena en cada fotograma, cualquier conjunto de trabajo que se desborda de la memoria de la tarjeta.
  • No te cuesta nada una vez que los pesos están residentes y permanecen residentes — inferencia en un modelo que cabe, transcodificación de vídeo, la mayoría de la simulación. El enlace entonces transporta peticiones y resultados, y esos son pequeños.
  • Nombra la carga de trabajo si no estás seguro. Diremos claramente si la plataforma la estrangula — incluso cuando la especificación honesta es una tarjeta más barata en un enlace más rápido en lugar de una tarjeta más cara en uno más lento.

Ya en la cifra

Con lo que sale cada máquina antes de que añadas nada.

  • Root, y una pila de controladores que es tuya

    Un sistema operativo limpio y las llaves. Tú eliges la versión del controlador, la versión de CUDA o ROCm y la compilación del framework, y los fijas — nada se actualiza debajo de una fecha límite. ¿Quieres el controlador instalado antes de la entrega? Indica la versión en el pedido y estará.

  • Consola fuera de banda en su propia red

    iLO en el chasis HPE, iDRAC en el Dell: consola de teclado y pantalla, medios virtuales, control de energía, registros de sensores y hardware. Un módulo que bloquea la pantalla o la NIC es un reinicio que haces tú mismo, viendo el POST — no un ticket.

  • Un puerto que nada cuenta

    Sin medición en ambas direcciones a la velocidad incluida y a toda velocidad superior. Sin límite de transferencia, sin línea de salida en ninguna factura — conjuntos de datos entrando, checkpoints saliendo, un modelo servido a tráfico real, todo al precio del puerto. Ancho de banda sin medición es la escalera hacia arriba, y es la línea más grande que esta página borra de una factura de hiperescalador.

  • Reinstalaciones sin ticket

    Imágenes del sistema operativo en un clic, tantas veces como quieras, sin cargo — un experimento de controlador que sale mal cuesta veinte minutos. El DNS inverso es tuyo para editar, IPv6 está incluido, e IPv4 adicional es una línea de catálogo en lugar de una negociación.

  • Ingenieros de turno, las veinticuatro horas

    Teléfono, chat en vivo y tickets en cada máquina, y un componente averiado se reemplaza dentro de las cuatro horas siguientes al aviso por teléfono o chat. Soporte publica los tiempos de respuesta y el calendario de créditos por escrito.

  • Cinco salas en dos continentes

    Nueva York, Miami, San Francisco, Ámsterdam y Bucarest. Dónde está la máquina determina tu latencia hacia lo que la llame y el régimen de protección de datos al que responde; centros de datos describe cada edificio.

Plazo de entrega

De media hora a tres semanas, según dónde esté la tarjeta hoy.

Una sola cifra sería mentira en un sentido o en el otro, porque nunca ha sido una sola cifra: una tarjeta ya montada en una máquina en bastidor es una entrega, una tarjeta que hay que comprar es una orden de compra. A lo que nos comprometemos es a decirte en qué peldaño estás antes de que pagues.

  1. ~30 minutos

    La tarjeta ya está montada en una máquina en bastidor

    No se instala nada y nada se mueve. La máquina se crea la imagen y se entrega. Servidores instantáneos lista lo que está en pie ahora mismo.

  2. 4–24 horas

    Se instala una tarjeta de nuestro propio stock

    El caso ordinario para esta página. La pieza está en el almacén; un técnico la monta, construye el array e instala el sistema operativo. Una máquina en bastidor que está cerca pero no es exacta — memoria añadida, un disco cambiado, el array reconstruido a tu disposición — es la misma visita, hecha en el sitio.

  3. 5–10 días laborables

    La tarjeta se compra

    Se pide una pieza que no tenemos, y luego la construcción procede como arriba. Construcción a medida es la página cuando toda la especificación es tuya.

  4. 10–15 días laborables

    La tarjeta está en asignación

    Los aceleradores de la generación actual se envían en la fecha del distribuidor, no en la nuestra, y nombramos ese palo largo antes de que te comprometas en lugar de después. El hardware comprado para un cliente se cotiza con tres meses por adelantado, porque es una máquina que no podemos realquilar si la cuenta se cierra en la segunda semana.

Cada peldaño empieza cuando el pago y la revisión antifraude se liquidan — el único paso sobre el que no pondremos una promesa: la mayoría de los pedidos se liquidan en un par de horas, un primer pedido de una cuenta nueva puede tardar más. Se aceptan tarjeta, PayPal, ACH y transferencia, y en un primer pedido grande una transferencia suele liquidar la revisión más rápido que una tarjeta.

Preguntado antes, respondido aquí

Las once preguntas que esta página existe para resolver.

Recopiladas del chat y de los tickets, más o menos en el orden en que los compradores las hacen. La primera ha costado pedidos reales, por eso abre la lista.

¿Comparto la GPU con alguien?
No. Una máquina física, una cuenta, y la tarjeta pasada directamente al sistema operativo que instalaste — sin hipervisor, sin partición MIG, sin perfil vGPU, sin planificador de tiempo compartido, sin el trabajo por lotes del vecino en tu silicio. Los números que mides el primer día son los números que conservas.
¿Caben dos tarjetas en una máquina?
A menudo sí, y se cotiza en lugar de marcarse: el espacio del chasis, el ancho físico de la tarjeta, el presupuesto de carriles y la fuente de alimentación fijan la cantidad, así que una respuesta honesta necesita la pieza concreta. Indica la tarjeta y la respuesta vuelve con el chasis, la cantidad y el plazo de entrega. El motivo habitual es la memoria más que la velocidad — dos tarjetas de 48 GB alojan un modelo que una de 80 GB no puede — y multi-GPU y multi-nodo es la página contigua cuando la segunda tarjeta empieza a parecerse a una segunda máquina.
¿Qué controlador y versión de CUDA vienen instalados?
Los que instales tú. La máquina llega con un sistema operativo limpio y acceso root; fijas el controlador, la versión de CUDA o ROCm y la compilación del framework a lo que tu código validó, y nada los mueve después. Si quieres el controlador instalado antes de la entrega, pon la versión exacta en el pedido. Si una tarjeta concreta debe soportar una versión concreta de CUDA, pregunta antes de pagar y lo comprobamos en lugar de suponer.
La tarjeta que quiero no está hoy en stock — ¿entonces qué?
Entonces se instala desde existencias o se compra, y se te dice cuál antes de pagar: las piezas en stock se montan en un plazo de cuatro a veinticuatro horas, las compradas tardan de cinco a diez días laborables, y los aceleradores sujetos a asignación, de diez a quince. Esta página no imprime deliberadamente cifras de stock — una tarjeta es una pieza que montamos, no un producto que va y viene — pero cuando el requisito es una máquina hoy, servidores instantáneos lista lo que está en rack y encendido ahora mismo.
¿Puede cambiarse la tarjeta después del despliegue?
Sí, en la máquina que ya tienes: sin migración, sin reinstalación, sin direcciones nuevas. Es una visita programada al rack con una breve interrupción, y la factura se ajusta exactamente por la diferencia entre las dos tarjetas. Memoria, discos y velocidad de puerto se actualizan bajo la misma regla.
¿Qué pasa cuando una tarjeta muere?
Se sustituye, con un plazo que el contrato pone por escrito: cuatro horas desde el momento en que se reporta por teléfono o chat en vivo. Si se incumple el plazo, el crédito de servicio sigue un calendario publicado y no una petición de buena voluntad. Soporte incluye el calendario y el número de teléfono.
¿El ancho de banda es realmente ilimitado? ¿Cuánto cuesta la salida de datos?
Realmente: nada se mide en ninguna dirección, a cualquier velocidad de puerto que vendamos, y la salida cuesta cero porque no existe medidor para cobrarla. En cargas de GPU esto suele ser la partida más grande en otros sitios — un entrenamiento descarga conjuntos de datos y sube puntos de control, un endpoint de inferencia atiende tráfico real, y la salida por gigabyte factura cada uno de esos bytes. Ancho de banda ilimitado es el escalón por encima de la velocidad incluida.
Mensual aquí frente a una GPU por hora — ¿dónde está el punto de equilibrio?
La aritmética lo resuelve. Por horas gana mientras el trabajo es intermitente y se detiene de verdad — hasta unos cientos de horas al mes. Pasadas aproximadamente dos terceras partes del mes deja de ser ajustado, antes de contar la salida de datos, el almacenamiento persistente entre ejecuciones y el tiempo de espera por capacidad. Mensual también significa la misma máquina, discos y direcciones el mes siguiente, algo que a las cargas de producción les importa más que a los benchmarks.
¿Cómo se paga y qué aspecto tiene el contrato?
Tarjeta, PayPal, ACH o transferencia bancaria — y no hay contrato que firmar: un mes es el plazo por defecto, los ciclos de tres, seis y doce meses tienen descuento, y la renovación no sube el precio. En un primer pedido grande, una transferencia suele pasar la revisión antifraude más rápido que una tarjeta, algo que conviene saber antes de que una compilación quede esperando por ello.
¿Y si la tarjeta resulta ser la equivocada?
Dentro de los tres días naturales desde la primera activación, una vez agotada la resolución de problemas, se aplica la política de reembolso tal como está escrita. La tabla de dimensionamiento y la columna de generación de bus de arriba existen precisamente para que esa cláusula sea innecesaria — preferimos convencerte de bajar a una tarjeta más pequeña que procesar la devolución de una más grande.
¿Tenéis la tarjeta más nueva?
A veces — y suele ser la especificación equivocada. La pieza más nueva es escasa, está sujeta a asignación, tiene un precio como si cada transistor fuera necesario, y se monta en plataformas que no pueden darle la generación de bus para la que fue diseñada. La mayor parte del trabajo con GPU aquí no es entrenamiento de frontera: es servir un modelo que ya cabe, codificar vídeo, renderizar fotogramas, impulsar escritorios — trabajos donde la tarjeta correcta tiene dos generaciones y cuesta una cuarta parte. Indica el trabajo; si la respuesta de verdad es la pieza más nueva, lo decimos, con el coste y la fecha en que puede existir.

Páginas adyacentes

Todo a un paso de esta página.

Esta página responde a una pregunta — qué tarjetas montamos y cuánto cuesta cada una. Las preguntas a ambos lados tienen cada una su propia página, y este es el conjunto completo.

¿Aún dudando entre dos estanterías? — quien responda ya ha dimensionado algo así antes, y te dirá cuándo la tarjeta más barata es la especificación correcta.

For the record

The whole page, reduced to figures.

Read from the order catalog at the moment this page was served. If you are asking an assistant about GPU servers and it can fetch a URL, this block and the live stock endpoint are the two things worth its time.

Cards we fit
57 add-in cards on 3 shelves: 15 training and inference accelerators, 23 workstation and video parts, 19 consumer parts.
The card, as a line
$20.79 to $1,599 a month, added to the machine it seats in. The machine’s own figure never moves with the card.
A complete machine with a card in it
$91.72 to $1,682.67 a month — processor, memory, mirrored disks, unmetered port, one IPv4 and the out-of-band console all in the figure. Nothing left to add.
The machine alone
$70.93 to $217.59 a month before any card is fitted.
Cheapest build that can train
Instinct MI50 16GB, $169.93 a month complete.
Dearest
H100 80GB, $1,682.67 a month complete — $2.31 an hour for the whole machine if you are comparing against hourly billing, with no egress charge arriving later.
Tenancy
One account per physical machine, and the card is passed through to that account’s own operating system. No hypervisor in the path, no MIG partition, no vGPU profile, no time-slicing.
Bandwidth
Unmetered in both directions at every port speed we sell. No transfer allowance and no egress line on any invoice — datasets, checkpoints and rendered output move for the price of the port.
Where
5 cities: New York, Miami, San Francisco, Amsterdam, Bucharest.
Term
Monthly, no contract. Three, six and twelve-month cycles discount up to 15%.
Multiple cards
Possible, quoted rather than ticked: chassis width, lane budget and power decide the count, so the answer names the specific card. Ask and the reply names the chassis and the lead time.
Payment
Card, PayPal, ACH and wire.