PCIe 3.0
Intel Xeon E5-2600 v1/v2
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- GPUs
- 28
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Max RAM
- 256 GB
Servidores dedicados con GPU · bare metal · mensual
Un servidor dedicado con GPU es una máquina física alquilada a una sola cuenta por mes, con la GPU pasada directamente a tu propio sistema operativo. Sin hipervisor, sin porción de vGPU, sin vecino en el silicio.
Elige la GPU según la tarea y la memoria que necesita. Cada fila de la lista es un servidor completo con esa GPU instalada, con precio del mismo catálogo que factura el checkout, y la parte correspondiente a la GPU aparece impresa bajo el total.
El catálogo
Indica para qué es la GPU y la memoria mínima que necesita. La lista se reduce a medida que avanzas, primero lo más barato. Cada fila abre la máquina que lleva esa GPU en el configurador.
Ninguna GPU individual que ofrecemos tiene tanta memoria. La más grande tiene 96 GB. A partir de ahí la configuración son dos o más GPUs en un mismo chasis, cotizadas a mano: consulta servidores multi-GPU, o .
Los precios son las cifras del propio checkout. Una GPU cuyo fabricante no publica cifra de memoria muestra una raya y desaparece cuando el control de memoria deja de estar en “cualquiera”. Algunas GPUs caben en más de un chasis: la fila muestra el más barato, el configurador muestra el resto.
Tenencia
La GPU va en una ranura PCIe física de una máquina alquilada a una sola cuenta. Tú instalas el sistema operativo, cargas el módulo del kernel y fijas la versión del controlador, CUDA o ROCm contra la que se probó tu código. Nada se actualiza debajo de ti.
La máquina sigue la misma regla: cada núcleo, toda la memoria, ambos discos, root y la consola iLO o iDRAC del propio servidor en una red de gestión separada. Si un experimento con el controlador tumba la red, sigues teniendo la pantalla, los medios virtuales y el control de energía.
Cómo funciona el precio
La mayoría de los proveedores venden una GPU como un nivel, con el procesador, la memoria, los discos y la red con precio alrededor. Aquí la máquina es una línea mensual y la GPU es otra. Si cambias la GPU más adelante, la factura se mueve exactamente por la diferencia entre las dos GPUs.
Empieza por el principio de la lista. Mantuvimos GPUs antiguas que aún hacen trabajo real, como piezas Tesla y Quadro que transcodifican vídeo o mueven escritorios remotos, y van en la misma máquina completa con el mismo puerto sin medición que la GPU más nueva. Por qué conservamos hardware antiguo explica el intercambio.
¿Comparando con nubes de GPU por hora? La configuración más cara de la lista, H100 80GB, cuesta $1,682.67 al mes por la máquina completa, unos $2.31 por hora en un mes de 730 horas, y no llega ninguna línea de salida después.
Complete, per month, from$91.72
Los ciclos de tres, seis y doce meses ahorran hasta un 15%. El configurador redondea los precios por disco y puede quedar a un céntimo. Precios enumera cada cifra del sitio.
Marketplace de GPUs
Junto a las GPUs que ofrecemos, los propietarios publican sus propias máquinas con GPU en nuestro marketplace. Ellos fijan la renta que reciben, y Server Room fija el precio que pagas tú. Los anuncios de nuestra empresa hermana, Primcast, también aparecen aquí y se alquilan allí.
Memoria de GPU
La memoria de la GPU decide si un modelo puede ejecutarse; los núcleos y las frecuencias solo deciden a qué velocidad. Una GPU a la que le faltan dos gigabytes no funciona más lento: directamente no carga. Define primero esta cifra.
Los pesos ocupan parámetros por bytes por parámetro: dos bytes en 16 bits, uno en 8 bits, medio byte en 4 bits. Cuantizar a 4 bits permite que un modelo quepa en una GPU más pequeña, con un coste medible en calidad.
Deja margen. La tabla cuenta solo los pesos. El runtime, las activaciones y la caché clave-valor comparten la misma memoria, y la caché crece con cada token de contexto, así que 38 GB de pesos no se servirán con holgura desde una GPU de 40 GB. Añade entre un cuarto y la mitad por encima.
y dimensionamos la GPU según lo que realmente ejecutas.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
Solo los pesos, redondeados al siguiente gigabyte.
Plataformas
Cada plataforma asigna a la ranura una generación PCIe y un presupuesto de líneas distintos. Lo publicamos porque cambia los resultados: un cliente pasó una vez a una GPU de consumo más nueva en una plataforma PCIe 3.0 y renderizó más lento, y averiguó el motivo antes que nosotros.
PCIe 3.0
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
PCIe 3.0
$73.47/mo before the GPU
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
PCIe 3.0
$83.67/mo before the GPU
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
PCIe 4.0
$217.59/mo before the GPU
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Incluido
Un sistema operativo limpio y las llaves. Tú eliges el controlador, la versión de CUDA o ROCm y la compilación del framework, y quedan fijados. ¿Quieres el controlador instalado antes de la entrega? Indica la versión exacta en el pedido.
iLO en máquinas HPE, iDRAC en Dell: teclado y pantalla, medios virtuales, control de energía, sensores y registros de hardware. Un módulo que cuelga la pantalla o la tarjeta de red es un reinicio que haces tú mismo, viendo el POST.
Sin medición en ambas direcciones a la velocidad incluida y a todas las superiores. Sin límite de transferencia y sin línea de salida. Ancho de banda sin medición enumera los puertos más rápidos.
Imágenes del sistema operativo en un clic, tantas veces como quieras, sin coste. El DNS inverso lo editas tú, IPv6 está incluido y IPv4 adicional es una línea en el configurador.
El chat lo responde en segundos un asistente de IA que puede revisar tu cuenta y tu servidor, y una persona toma el relevo en cuanto lo pides. Una pieza averiada se sustituye dentro de la ventana de tu plan de soporte: 24 horas en el plan Basic incluido, 4 en Bronze, 3 en Silver, 2 en Gold y Platinum.
Nueva York, Miami, San Francisco, Ámsterdam y Bucarest, todas en la red propia de Server Room, AS19624. La ubicación determina tu latencia hacia los usuarios y la ley de protección de datos a la que respondes. Centros de datos describe cada edificio.
Entrega
Depende de dónde esté hoy la GPU, y te decimos en qué caso te encuentras antes de que pagues.
Nada que instalar. La máquina está montada y se entrega. Servidores instantáneos enumera lo que está listo ahora mismo.
El caso habitual. Un técnico instala la GPU, monta la matriz de discos e instala el sistema operativo. Memoria adicional o un disco distinto se hace en la misma visita.
Pedimos la pieza y luego montamos como se indica arriba. Montaje a medida cubre una máquina según tu especificación completa.
Los aceleradores actuales se envían en la fecha del distribuidor, y la indicamos antes de que te comprometas. El hardware comprado para un cliente se presupuesta con tres meses pagados por adelantado.
Todos los plazos empiezan una vez que el pago y la revisión antifraude se aprueban. La mayoría de los pedidos se aprueban en un par de horas; un primer pedido en una cuenta nueva puede tardar más.
El campo de un socio
Viral Mind Technologies, socio de Server Room, crea y gestiona sus propias propiedades digitales: personalidades virtuales, marcas de medios en línea y software para creadores. Empezó en 2019 como agencia de marketing digital y trabaja en sus propios proyectos de IA desde finales de 2022.
Generar imágenes y vídeo mantiene un modelo residente en la memoria de la GPU y la GPU ocupada durante horas. Ese es el caso de una GPU dedicada en bare metal y no de una fracción de una, y una GPU completa es lo que alquila cada servidor de esta página.
Su portafolio y casos de estudio: viralmindtech.com
Respuestas
Un servidor físico alquilado a un solo cliente, con una tarjeta gráfica instalada y pasada directamente al sistema operativo propio de ese cliente. Nada está virtualizado ni compartido: obtienes todos los núcleos, toda la memoria, los discos y la GPU completa, con acceso root y consola remota.
Una máquina completa con GPU instalada cuesta desde $91.72 hasta $1,682.67 al mes. El precio es la suma de dos líneas: la máquina y la GPU, de $20.79 a $1,599 al mes. Procesador, memoria, dos discos, un puerto sin medición y una dirección IPv4 están incluidos. La instalación tiene un coste único de $29 en un equipo con GPU instalada bajo pedido; una máquina lista pedida tal cual no lo tiene.
No. Una máquina física, una cuenta y la GPU pasada directamente al sistema operativo que instalaste. No hay hipervisor, ni partición MIG, ni perfil vGPU, ni reparto de tiempo. Las cifras que obtengas en el primer benchmark son las que mantendrás.
Sí. Un mes es el plazo por defecto y no hay nada que firmar. Los ciclos de tres, seis y doce meses ahorran hasta un 15%, y el precio no sube al renovar. Paga con tarjeta de crédito o PayPal; para pedidos mayores se puede gestionar una transferencia bancaria, que suele pasar la revisión antifraude más rápido que un pago con tarjeta.
Sí. La lista de esta página está ordenada de más barato a más caro, y la configuración completa más económica es Quadro 3000M en Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps por $91.72 al mes. Las GPU Tesla y Quadro más antiguas siguen transcodificando vídeo y moviendo escritorios remotos perfectamente, y vienen en la misma máquina completa con el mismo puerto sin medición.
57 GPU están en la lista, desde aceleradores de cómputo NVIDIA actuales y AMD Instinct hasta modelos Tesla, Quadro y GeForce más antiguos. Cada una aparece por nombre con su memoria y el precio mensual completo. Si falta la GPU que quieres, pregunta: a menudo podemos conseguirla.
Las que instales tú. El servidor llega con un sistema operativo limpio y acceso root, y tú fijas el driver, la versión de CUDA o ROCm y la compilación del framework con la que se probó tu código. Si quieres el driver ya instalado en la entrega, indica la versión exacta en el pedido. Si una GPU debe soportar una versión concreta de CUDA, pregunta antes de pagar y lo comprobaremos.
A menudo sí, y lo cotizamos a mano: el espacio del chasis, el ancho de la GPU, las líneas PCIe y la fuente de alimentación determinan la cantidad. Indica la GPU y te responderemos con el chasis, la cantidad y el plazo de entrega. El motivo habitual es la memoria más que la velocidad, ya que dos GPU de 48 GB alojan un modelo que una GPU de 80 GB no puede. Servidores multi-GPU y multi-nodo cubre el siguiente paso.
Sí, en el servidor que ya tienes: sin migración, sin reinstalación, sin nuevas direcciones IP. Es una visita programada con una breve interrupción, y la factura cambia exactamente por la diferencia entre las dos GPU. La RAM, los discos y un puerto más rápido se añaden con la misma regla.
La reemplazamos dentro de la ventana de tu plan de soporte, contada desde que lo comunicas: 24 horas en el plan Basic incluido, 4 en Bronze, 3 en Silver, 2 en Gold y Platinum. Pasada la ventana, se aplica el crédito de servicio según el calendario publicado en la página de soporte.
Sí, una GPU de tu propiedad, o cualquier otra pieza, puede instalarse en el servidor que alquilas aquí. No es gratis, porque la GPU consume energía, y el cargo depende del hardware. No nos hacemos responsables si falla una pieza que trajiste; la ventana de reemplazo cubre solo el hardware que suministramos nosotros. Reserva una llamada antes de comprarla o enviarla: la cotizamos y comprobamos que el chasis la admite, porque un blade, por ejemplo, no tiene espacio para una GPU de tamaño completo.
Nada se mide en ninguna dirección a ninguna velocidad de puerto que vendamos, así que la salida de datos no cuesta nada. En trabajos con GPU suele ser la partida más grande en otros sitios: el entrenamiento descarga conjuntos de datos y sube checkpoints, y un endpoint de inferencia responde tráfico real. Ancho de banda sin medición lista los puertos más rápidos.
El pago por horas gana mientras el trabajo sea intermitente y se detenga de verdad, hasta unos cientos de horas al mes. Pasadas unas dos terceras partes del mes, el pago mensual es más barato antes de contar la salida de datos, el almacenamiento mantenido entre ejecuciones y el tiempo de espera por capacidad. El pago mensual también conserva la misma máquina, discos y direcciones.
Dentro de los tres días posteriores a la activación, tras la resolución de problemas, se aplica nuestra política de reembolso tal como está escrita. La tabla de memoria y la columna PCIe de arriba están para que elijas bien la GPU a la primera, y preferimos recomendarte una GPU más pequeña por chat antes que reembolsarte una más grande.
Para que conste
Leído del catálogo de pedidos en el momento de servir la página. Si un asistente responde por ti, este bloque y el feed de máquinas en vivo son las partes que vale la pena leer.
Relacionado
Abre el configurador con cualquier GPU seleccionada, o cuéntanos la carga de trabajo y te diremos qué GPU encaja, incluso cuándo la más barata es suficiente.