Serveurs dédiés GPU · bare metal · au mois

Serveurs dédiés GPU. Le GPU complet. Personne d'autre dessus.

Un serveur dédié GPU est une machine physique louée à un seul compte au mois, avec le GPU transmis directement à votre propre système d'exploitation. Pas d'hyperviseur, pas de tranche vGPU, pas de voisin sur le silicium.

  • Passthrough PCIe
  • Port non mesuré
  • 5 villes
  • Sans engagement

Choisissez le GPU selon la tâche et la mémoire qu'elle exige. Chaque ligne de la liste est un serveur complet avec ce GPU installé, au prix du même catalogue que celui facturé au moment du paiement, et la part propre du GPU est indiquée sous le total.

Le catalogue

Serveurs GPU NVIDIA et AMD, chacun au prix d'une machine complète

Dites à quoi sert le GPU et la mémoire minimale qu'il lui faut. La liste se réduit au fur et à mesure, du moins cher au plus cher. Chaque ligne ouvre la machine qui accueille ce GPU dans le configurateur.

1. À quoi sert le GPU ?

2. Combien de mémoire GPU, au minimum ?

quelconque Go ou plus

Poids des modèles en 4 bits, pour l'échelle

  • 5 GB7-8B @ 4-bit
  • 8 GB13-14B @ 4-bit
  • 19 GB30-34B @ 4-bit
  • 38 GB70B @ 4-bit

  1. Quadro 3000M2 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 240 CUDA cores$91.72/moGPU $20.79
  2. Quadro K3100M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 768 CUDA cores$102.52/moGPU $31.59
  3. Quadro M3000M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,280 CUDA cores$109.12/moGPU $38.19
  4. TESLA M68 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,536 CUDA cores$113.42/moGPU $42.49
  5. TESLA M608 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$119.42/moGPU $48.49
  6. GTX 1070M8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$124.32/moGPU $53.39
  7. GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99/moGPU $55.06
  8. GTX 10708 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,920 CUDA cores$135.22/moGPU $64.29
  9. GTX 1070 Ti8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,432 CUDA cores$146.22/moGPU $75.29
  10. GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93/moGPU $79
  11. TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  12. TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  13. RTX 20708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,304 CUDA cores$159.93/moGPU $89
  14. TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93/moGPU $99
  15. Instinct MI50 16GB16 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$169.93/moGPU $99
  16. RTX 2070 Super8 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$172.47/moGPU $99
  17. Quadro RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47/moGPU $99
  18. Instinct MI5016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$172.47/moGPU $99
  19. TESLA M602 x 8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,096 CUDA cores$178.82/moGPU $107.89
  20. RTX 20808 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,994 CUDA cores$189.93/moGPU $119
  21. Quadro RTX 500016 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$189.93/moGPU $119
  22. RTX 2080 Super8 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$199.93/moGPU $129
  23. TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92/moGPU $129.99
  24. RTX A20006 or 12 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,328 CUDA cores$202.47/moGPU $129
  25. RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93/moGPU $139
  26. TESLA P10016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,584 CUDA cores$212.47/moGPU $139
  27. Quadro P500016 GB GDDR5XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$214.06/moGPU $140.59
  28. RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93/moGPU $149
  29. RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  30. RTX A400016 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  31. RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93/moGPU $159
  32. TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93/moGPU $189
  33. CMP 170HX 64GB HBM2e8 GB HBM2e, 64 GB unlockedIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$259.93/moGPU $189
  34. RTX 407012 GB GDDR6XIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 5,888 CUDA cores$262.67/moGPU $179
  35. RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47/moGPU $199
  36. Tenstorrent Blackhole p100a28 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$272.47/moGPU $199
  37. L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67/moGPU $209
  38. RTX A500024 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 8,192 CUDA cores$302.47/moGPU $229
  39. Tesla V100 32GB32 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 5,120 CUDA cores$302.47/moGPU $229
  40. RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93/moGPU $239
  41. RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67/moGPU $229
  42. Quadro P600024 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$320.52/moGPU $249.59
  43. RTX 4500 Ada Generation24 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 7,680 CUDA cores$332.67/moGPU $249
  44. RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47/moGPU $299
  45. Quadro RTX 600024 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$372.47/moGPU $299
  46. RTX PRO 4000–Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$372.47/moGPU $299
  47. Quadro RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47/moGPU $399
  48. RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47/moGPU $399
  49. L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67/moGPU $449
  50. A4048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$572.47/moGPU $499
  51. Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67/moGPU $499
  52. RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47/moGPU $549
  53. RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47/moGPU $625
  54. A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47/moGPU $699
  55. A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47/moGPU $899
  56. RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67/moGPU $1,299
  57. H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67/moGPU $1,599

Les prix sont ceux du paiement. Un GPU dont le fabricant ne publie aucune valeur de mémoire affiche un tiret et disparaît dès que le contrôle de mémoire quitte « quelconque ». Certains GPU s'adaptent à plusieurs châssis : la ligne montre le moins cher, le configurateur montre les autres.

Occupation

Hébergement de serveur GPU dédié : le GPU complet est à vous

Le GPU est installé dans un emplacement PCIe physique d'une machine louée à un seul compte. Vous installez le système d'exploitation, chargez le module noyau et figez le pilote, la version CUDA ou ROCm sur laquelle votre code a été testé. Rien ne le met à niveau à votre insu.

La machine suit la même règle : chaque cœur, toute la mémoire, les deux disques, la racine et la console iLO ou iDRAC propre au serveur sur un réseau de gestion séparé. Si un essai de pilote coupe le réseau, vous gardez l'écran, les médias virtuels et le contrôle de l'alimentation.

  • Pas de tranchePas de partition MIG, pas de profil vGPU, pas de part fractionnaire. Un GPU, un système d'exploitation.
  • Pas de file d'attenteAucun ordonnanceur au-dessus de vous. Quand votre processus est inactif, le GPU est inactif, et toujours à vous.
  • Pas d'hyperviseurBare metal. La latence mesurée le premier jour est celle que vous obtenez à 4 h du matin.
  • Pas de compteurLes jeux de données entrent, les points de contrôle et les rendus sortent. Rien sur le port ne compte les octets.

Fonctionnement des prix

Deux lignes qui s'additionnent : la machine et le GPU

La plupart des fournisseurs vendent un GPU comme un palier, avec le processeur, la mémoire, les disques et le réseau tarifés autour. Ici, la machine est une ligne mensuelle et le GPU une autre. Changez le GPU plus tard et la facture évolue exactement de la différence entre les deux GPU.

Vous cherchez un serveur dédié GPU pas cher ?

Commencez en haut de la liste. Nous avons conservé des GPU plus anciens qui font encore un vrai travail, comme les pièces Tesla et Quadro qui transcodent la vidéo ou pilotent des bureaux à distance, et ils sont dans la même machine complète avec le même port non mesuré que le GPU le plus récent. Pourquoi nous gardons du matériel plus ancien explique le compromis.

Vous comparez avec les clouds GPU à l'heure ? La configuration la plus chère de la liste, H100 80GB, est à $1,682.67 par mois pour toute la machine, soit environ $2.31 de l'heure sur un mois de 730 heures, et aucune ligne de sortie n'arrive plus tard.

  1. MachineIntel Xeon E5-2600 v1/v2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$70.93
  2. GPUQuadro 3000M$20.79 – $1,599 across the list$20.79
  3. PortUnmetered, both directionsNo allowance, no egress lineincluded
  4. SetupOne-time, custom buildMonthly term, no contract$29

Complete, per month, from$91.72

Les cycles de trois, six et douze mois économisent jusqu'à 15%. Le configurateur arrondit les prix par disque et peut tomber à un centime près. Tarification liste chaque chiffre du site.

Mémoire GPU

De combien de mémoire GPU votre modèle a-t-il besoin

La mémoire GPU détermine si un modèle peut s’exécuter ou non ; les cœurs et les fréquences ne déterminent que sa vitesse. Un GPU à qui il manque deux gigaoctets ne tourne pas lentement, il ne se charge pas. Réglez d’abord cette question.

Les poids occupent le nombre de paramètres multiplié par les octets par paramètre : deux octets en 16 bits, un en 8 bits, un demi-octet en 4 bits. La quantification en 4 bits permet à un modèle de tenir sur un GPU plus petit, au prix d’une perte mesurable de qualité.

Gardez de la marge. Le tableau ne compte que les poids. Le moteur d’exécution, les activations et le cache clé-valeur partagent la même mémoire, et le cache grossit avec chaque jeton de contexte ; ainsi, 38 Go de poids ne tiendront pas confortablement sur un GPU de 40 Go. Ajoutez un quart à la moitié en plus.

et nous dimensionnons le GPU en fonction de ce que vous exécutez réellement.

Model16-bit8-bit4-bit
7-8 billion parameters16 GB8 GB5 GB
13-14 billion parameters28 GB14 GB8 GB
30-34 billion parameters68 GB34 GB19 GB
70 billion parameters140 GB70 GB38 GB

Poids seuls, arrondis au gigaoctet supérieur.

Plateformes

Les serveurs qui acceptent un GPU, et le bus PCIe que chacun lui offre

Chaque plateforme attribue au slot une génération PCIe et un budget de lignes différents. Nous l’affichons parce que cela change les résultats : un client est passé un jour à un GPU grand public plus récent sur une plateforme PCIe 3.0 et a constaté un rendu plus lent, et il en a compris la raison avant nous.

PCIe 3.0

Intel Xeon E5-2600 v1/v2

$70.93/mo before the GPU

Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps

GPUs
28
Lanes
40 lanes per socket
Sockets
2
Max RAM
256 GB
Intel Xeon E5-2600 v1/v2 →

PCIe 3.0

Intel Xeon E5-2600 v3/v4

$73.47/mo before the GPU

Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps

GPUs
44
Lanes
40 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon E5-2600 v3/v4 →

PCIe 3.0

Intel Xeon Silver / Gold

$83.67/mo before the GPU

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

GPUs
48
Lanes
48 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon Silver / Gold →

PCIe 4.0

AMD EPYC

$217.59/mo before the GPU

AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps

GPUs
10
Lanes
128 lanes per socket
Sockets
2
Max RAM
1 TB
AMD EPYC →

Quand la génération du bus compte

  • Elle vous coûte lorsque les données traversent le bus en permanence : une boucle d’entraînement qui lit des lots depuis le disque ou la mémoire système, un moteur de rendu qui envoie les données de scène à chaque image, un ensemble de travail qui déborde de la mémoire GPU.
  • Elle ne vous coûte rien une fois les poids chargés et stables : inférence sur un modèle qui tient, transcodage vidéo, la plupart des simulations. Le lien ne transporte alors que de petites requêtes et des résultats.
  • Pas sûr ? Décrivez la charge de travail et nous vous dirons si la plateforme la freine, y compris lorsqu’un GPU moins cher sur un bus plus rapide est le meilleur achat.

Inclus

Ce que l’hébergement de serveurs GPU inclut ici, avant tout ajout

  • Accès root et votre propre pile de pilotes

    Un système d’exploitation propre et les clés. Vous choisissez le pilote, la version CUDA ou ROCm et la compilation du framework, et ils restent figés. Vous voulez le pilote installé avant la livraison ? Indiquez la version exacte sur la commande.

  • Une console sur son propre réseau

    iLO sur les machines HPE, iDRAC sur Dell : clavier et écran, médias virtuels, contrôle de l’alimentation, capteurs et journaux matériels. Un module qui bloque l’affichage ou la carte réseau est un redémarrage que vous faites vous-même, en regardant le POST.

  • Un port que rien ne compte

    Sans mesure dans les deux sens à la vitesse incluse et à toutes les vitesses supérieures. Pas de quota de transfert ni de ligne de sortie. Bande passante non mesurée répertorie les ports plus rapides.

  • Réinstallations sans ticket

    Images du système d’exploitation en un clic, aussi souvent que vous le souhaitez, sans frais. Le DNS inverse est modifiable par vos soins, l’IPv6 est incluse, et l’IPv4 supplémentaire est une ligne dans le configurateur.

  • Réponses en quelques secondes, un humain quand vous le demandez

    Le chat est répondu en quelques secondes par un assistant IA qui peut vérifier votre compte et votre serveur, et un humain prend le relais dès que vous le demandez. Une pièce défaillante est remplacée dans le délai de votre plan de support : 24 heures avec le plan Basic inclus, 4 avec Bronze, 3 avec Silver, 2 avec Gold et Platinum.

  • Cinq villes, notre propre réseau

    New York, Miami, San Francisco, Amsterdam et Bucarest, toutes sur le réseau propre de Server Room, AS19624. L’emplacement détermine votre latence vers les utilisateurs et la loi de protection des données à laquelle vous êtes soumis. Centres de données décrit chaque bâtiment.

Livraison

À quelle vitesse vous pouvez louer un serveur dédié avec GPU

Cela dépend de l’endroit où se trouve le GPU aujourd’hui, et nous vous indiquons votre cas avant que vous ne payiez.

  1. Environ 30 minutes

    Le GPU est déjà dans une machine en rack

    Rien à installer. La machine est montée et livrée. Serveurs instantanés répertorie ce qui est prêt immédiatement.

  2. 4 à 24 heures

    Nous installons un GPU de notre stock

    Le cas habituel. Un technicien installe le GPU, construit la matrice de disques et installe le système d’exploitation. De la mémoire supplémentaire ou un disque différent est fait lors de la même intervention.

  3. 5 à 10 jours ouvrés

    Le GPU doit être acheté

    Nous commandons la pièce, puis nous assemblons comme ci-dessus. Configuration à la demande couvre une machine selon vos spécifications complètes.

  4. 10 à 15 jours ouvrés

    Le GPU est en allocation

    Les accélérateurs actuels sont expédiés à la date du distributeur, et nous la précisons avant que vous ne vous engagiez. Le matériel acheté pour un client est facturé avec trois mois payés d’avance.

Chaque délai commence une fois le paiement et l’examen anti-fraude validés. La plupart des commandes sont validées en quelques heures ; une première commande sur un nouveau compte peut prendre plus de temps.

Le domaine d’un partenaire

Médias générés par IA : le type de travail qui justifie un GPU complet

Viral Mind Technologies, partenaire de Server Room, conçoit et exploite ses propres propriétés numériques : personnalités virtuelles, marques de médias en ligne et logiciels pour créateurs. L’entreprise a démarré en 2019 comme agence de marketing digital et travaille sur ses propres projets d’IA depuis fin 2022.

La génération d’images et de vidéos maintient un modèle en mémoire GPU et occupe le GPU pendant des heures d’affilée. C’est le cas pour un GPU dédié sur serveur bare metal plutôt que pour une fraction de GPU, et un GPU complet est précisément ce que loue chaque serveur de cette page.

Leur portfolio et leurs études de cas : viralmindtech.com

  • Personnalités virtuellesNaomi Marie, lancée en août 2023, est la première personnalité numérique qu’ils possèdent en propre.
  • MédiasCybeauty Magazine, lancé en mars 2024, fonctionne comme une publication web-first.
  • Outils pour créateursProof of Ownership émet un enregistrement daté pour un fichier créatif, empreinté dans le navigateur afin que le fichier ne quitte jamais l’appareil.

Réponses

Questions sur les serveurs dédiés GPU, avec réponses

Qu’est-ce qu’un serveur GPU dédié ?

Un serveur physique loué à un seul client, avec une carte graphique installée et transmise au système d’exploitation propre de ce client. Rien n’est virtualisé ni partagé : vous disposez de tous les cœurs, de toute la mémoire, des disques et du GPU complet, avec un accès root et une console distante.

Combien coûte un serveur dédié GPU ?

Une machine complète avec GPU installé coûte de $91.72 à $1,682.67 par mois. Le prix est la somme de deux lignes : la machine, et le GPU à $20.79 à $1,599 par mois. Le processeur, la mémoire, deux disques, un port non mesuré et une adresse IPv4 sont inclus. L’installation est facturée une seule fois $29 pour une configuration avec GPU installé sur commande ; une machine prête commandée telle quelle n’en a pas.

Est-ce que je partage le GPU avec quelqu’un ?

Non. Une machine physique, un compte, et le GPU transmis au système d’exploitation que vous avez installé. Il n’y a ni hyperviseur, ni partition MIG, ni profil vGPU, ni partage de temps. Les chiffres que vous mesurez le premier jour sont les chiffres que vous conservez.

Puis-je louer un serveur dédié avec GPU au mois, sans contrat ?

Oui. Un mois est la durée par défaut et il n’y a rien à signer. Les cycles de trois, six et douze mois permettent d’économiser jusqu’à 15%, et le prix n’augmente pas au renouvellement. Payez par carte bancaire ou PayPal ; pour une commande plus importante, un virement bancaire peut être organisé, et il passe généralement la vérification anti-fraude plus rapidement qu’un paiement par carte.

Existe-t-il un serveur dédié GPU bon marché ?

Oui. La liste sur cette page est triée du moins cher au plus cher, et la configuration complète la moins chère est Quadro 3000M dans Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps à $91.72 par mois. Les anciens GPU Tesla et Quadro transcrivent encore bien la vidéo et pilotent bien les bureaux distants, et ils sont fournis dans la même machine complète avec le même port non mesuré.

Quels GPU NVIDIA et AMD puis-je obtenir ?

57 GPU figurent sur la liste, des accélérateurs de calcul NVIDIA actuels et AMD Instinct jusqu’aux anciens modèles Tesla, Quadro et GeForce. Chacun est répertorié par nom avec sa mémoire et le prix mensuel complet. Si le GPU que vous voulez manque, demandez : nous pouvons souvent l’acheter.

Quelle version de pilote et de CUDA est installée ?

Celles que vous installez. Le serveur arrive avec un système d’exploitation propre et un accès root, et vous fixez le pilote, la version CUDA ou ROCm et la version du framework avec laquelle votre code a été testé. Si vous voulez que le pilote soit en place à la livraison, indiquez la version exacte sur la commande. Si un GPU doit prendre en charge une version CUDA particulière, demandez avant de payer et nous vérifierons.

Est-ce que deux GPU tiennent dans un seul serveur ?

Souvent, et nous le chiffrons manuellement : le dégagement du châssis, la largeur du GPU, les lignes PCIe et l’alimentation déterminent le nombre. Indiquez le GPU et nous répondrons avec le châssis, le nombre et le délai. La raison habituelle est la mémoire plutôt que la vitesse, car deux GPU de 48 Go contiennent un modèle qu’un GPU de 80 Go ne peut pas contenir. Serveurs multi-GPU et multi-nœuds couvre l’étape suivante.

Puis-je changer de GPU plus tard ?

Oui, dans le serveur que vous avez déjà : pas de migration, pas de réinstallation, pas de nouvelles adresses IP. Il s’agit d’une intervention planifiée avec une courte interruption, et la facture évolue exactement de la différence entre les deux GPU. La RAM, les disques et un port plus rapide sont ajoutés selon la même règle.

Que se passe-t-il si le GPU tombe en panne ?

Nous le remplaçons dans le délai de votre plan de support, compté à partir du moment où vous le signalez : 24 heures avec le plan Basic inclus, 4 avec Bronze, 3 avec Silver, 2 avec Gold et Platinum. Au-delà du délai, l’avoir de service suit le calendrier publié sur la page de support.

Puis-je apporter ma propre carte graphique ?

Oui, un GPU que vous possédez, ou toute autre pièce, peut être installé dans le serveur que vous louez ici. Ce n’est pas gratuit, car le GPU consomme de l’énergie, et le coût dépend du matériel. Nous ne sommes pas responsables si une pièce que vous avez apportée tombe en panne ; la fenêtre de remplacement ne couvre que le matériel que nous fournissons. Réservez un appel avant de l’acheter ou de l’expédier : nous le chiffrons et vérifions que le châssis l’accepte, car une lame, par exemple, n’a pas de place pour un GPU pleine taille.

La bande passante est-elle vraiment non mesurée ? Combien coûte le trafic sortant ?

Rien n’est mesuré dans les deux sens à aucune vitesse de port que nous vendons, donc le trafic sortant ne coûte rien. Sur les travaux GPU, c’est souvent la ligne la plus importante ailleurs : l’entraînement tire des jeux de données et pousse des points de contrôle, et un point de terminaison d’inférence répond au trafic réel. Bande passante non mesurée répertorie les ports plus rapides.

GPU mensuel ou horaire : lequel est le moins cher ?

L’horaire gagne tant que le travail est sporadique et s’arrête vraiment, jusqu’à quelques centaines d’heures par mois. Au-delà d’environ deux tiers du mois, le mensuel est moins cher avant même de compter le trafic sortant, le stockage conservé entre les exécutions et le temps passé à attendre de la capacité. Le mensuel conserve aussi la même machine, les mêmes disques et les mêmes adresses.

Et si j’ai choisi le mauvais GPU ?

Dans les trois jours suivant l’activation, après dépannage, notre politique de remboursement s’applique telle qu’écrite. Le tableau de mémoire et la colonne PCIe ci-dessus sont là pour que vous puissiez choisir le bon GPU du premier coup, et nous préférons vous orienter vers un GPU plus petit dans le chat plutôt que de rembourser un plus grand.

Pour mémoire

Cette page en chiffres

Lus dans le catalogue de commandes au moment où la page a été servie. Si un assistant répond à votre place, ce bloc et le flux de machines en direct sont les parties qui valent la peine d’être lues.

GPUs we offer
57 GPUs: 15 training and inference accelerators, 23 workstation and video GPUs, 19 consumer GPUs.
Cheapest complete build
Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $91.72 a month, of which $20.79 is the GPU.
Cheapest build that can train
Instinct MI50 16GB in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $169.93 a month.
Most expensive build
H100 80GB: $1,682.67 a month, about $2.31 an hour for the whole machine over a 730-hour month.
The GPU line
$20.79 to $1,599 a month, added to the machine.
The machine line
$70.93 to $217.59 a month before any GPU.
Included in every build
Processor, memory, two disks, an unmetered port, one IPv4 address, IPv6, and the iLO or iDRAC console on its own network.
Tenancy
One account per physical machine. The GPU is passed through to the customer’s operating system: no hypervisor, no MIG partition, no vGPU profile, no time-slicing.
Bandwidth
Unmetered in both directions at every port speed. No transfer allowance, no egress charge.
Cities
5: New York, Miami, San Francisco, Amsterdam, Bucharest.
Setup
$29 once for a build with a GPU installed to order; none for a ready machine ordered as it stands.
Term
Monthly, no contract. 3, 6 and 12-month cycles save up to 15%.
Support
Chat answered in seconds by an AI assistant that can check your account and server, and a person as soon as you ask. Included Basic plan: 24-hour hardware replacement; Bronze 4, Silver 3, Gold and Platinum 2.
Payment
Credit card or PayPal; bank wire on request.

Choisissez le GPU. Nous construisons le serveur autour.

Ouvrez le configurateur avec n’importe quel GPU sélectionné, ou indiquez-nous la charge de travail et nous vous dirons quel GPU convient, y compris quand le moins cher suffit.

Configurer un serveur GPU