PCIe 3.0
Intel Xeon E5-2600 v1/v2
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- GPUs
- 28
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Max RAM
- 256 GB
Serveurs dédiés GPU · bare metal · au mois
Un serveur dédié GPU est une machine physique louée à un seul compte au mois, avec le GPU transmis directement à votre propre système d'exploitation. Pas d'hyperviseur, pas de tranche vGPU, pas de voisin sur le silicium.
Choisissez le GPU selon la tâche et la mémoire qu'elle exige. Chaque ligne de la liste est un serveur complet avec ce GPU installé, au prix du même catalogue que celui facturé au moment du paiement, et la part propre du GPU est indiquée sous le total.
Le catalogue
Dites à quoi sert le GPU et la mémoire minimale qu'il lui faut. La liste se réduit au fur et à mesure, du moins cher au plus cher. Chaque ligne ouvre la machine qui accueille ce GPU dans le configurateur.
Aucun GPU que nous proposons n'a autant de mémoire. Le plus grand en possède 96 Go. Au-delà, la configuration comprend deux GPU ou plus dans un même châssis, avec devis manuel : voir serveurs multi-GPU, ou .
Les prix sont ceux du paiement. Un GPU dont le fabricant ne publie aucune valeur de mémoire affiche un tiret et disparaît dès que le contrôle de mémoire quitte « quelconque ». Certains GPU s'adaptent à plusieurs châssis : la ligne montre le moins cher, le configurateur montre les autres.
Occupation
Le GPU est installé dans un emplacement PCIe physique d'une machine louée à un seul compte. Vous installez le système d'exploitation, chargez le module noyau et figez le pilote, la version CUDA ou ROCm sur laquelle votre code a été testé. Rien ne le met à niveau à votre insu.
La machine suit la même règle : chaque cœur, toute la mémoire, les deux disques, la racine et la console iLO ou iDRAC propre au serveur sur un réseau de gestion séparé. Si un essai de pilote coupe le réseau, vous gardez l'écran, les médias virtuels et le contrôle de l'alimentation.
Fonctionnement des prix
La plupart des fournisseurs vendent un GPU comme un palier, avec le processeur, la mémoire, les disques et le réseau tarifés autour. Ici, la machine est une ligne mensuelle et le GPU une autre. Changez le GPU plus tard et la facture évolue exactement de la différence entre les deux GPU.
Commencez en haut de la liste. Nous avons conservé des GPU plus anciens qui font encore un vrai travail, comme les pièces Tesla et Quadro qui transcodent la vidéo ou pilotent des bureaux à distance, et ils sont dans la même machine complète avec le même port non mesuré que le GPU le plus récent. Pourquoi nous gardons du matériel plus ancien explique le compromis.
Vous comparez avec les clouds GPU à l'heure ? La configuration la plus chère de la liste, H100 80GB, est à $1,682.67 par mois pour toute la machine, soit environ $2.31 de l'heure sur un mois de 730 heures, et aucune ligne de sortie n'arrive plus tard.
Complete, per month, from$91.72
Les cycles de trois, six et douze mois économisent jusqu'à 15%. Le configurateur arrondit les prix par disque et peut tomber à un centime près. Tarification liste chaque chiffre du site.
Marketplace GPU
À côté des GPU que nous proposons, les propriétaires listent leurs propres machines GPU sur notre marketplace. Ils fixent le loyer qu'ils reçoivent, et Server Room fixe le prix que vous payez. Les annonces de notre société sœur, Primcast, apparaissent aussi ici et sont louées là-bas.
Mémoire GPU
La mémoire GPU détermine si un modèle peut s’exécuter ou non ; les cœurs et les fréquences ne déterminent que sa vitesse. Un GPU à qui il manque deux gigaoctets ne tourne pas lentement, il ne se charge pas. Réglez d’abord cette question.
Les poids occupent le nombre de paramètres multiplié par les octets par paramètre : deux octets en 16 bits, un en 8 bits, un demi-octet en 4 bits. La quantification en 4 bits permet à un modèle de tenir sur un GPU plus petit, au prix d’une perte mesurable de qualité.
Gardez de la marge. Le tableau ne compte que les poids. Le moteur d’exécution, les activations et le cache clé-valeur partagent la même mémoire, et le cache grossit avec chaque jeton de contexte ; ainsi, 38 Go de poids ne tiendront pas confortablement sur un GPU de 40 Go. Ajoutez un quart à la moitié en plus.
et nous dimensionnons le GPU en fonction de ce que vous exécutez réellement.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
Poids seuls, arrondis au gigaoctet supérieur.
Plateformes
Chaque plateforme attribue au slot une génération PCIe et un budget de lignes différents. Nous l’affichons parce que cela change les résultats : un client est passé un jour à un GPU grand public plus récent sur une plateforme PCIe 3.0 et a constaté un rendu plus lent, et il en a compris la raison avant nous.
PCIe 3.0
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
PCIe 3.0
$73.47/mo before the GPU
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
PCIe 3.0
$83.67/mo before the GPU
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
PCIe 4.0
$217.59/mo before the GPU
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Inclus
Un système d’exploitation propre et les clés. Vous choisissez le pilote, la version CUDA ou ROCm et la compilation du framework, et ils restent figés. Vous voulez le pilote installé avant la livraison ? Indiquez la version exacte sur la commande.
iLO sur les machines HPE, iDRAC sur Dell : clavier et écran, médias virtuels, contrôle de l’alimentation, capteurs et journaux matériels. Un module qui bloque l’affichage ou la carte réseau est un redémarrage que vous faites vous-même, en regardant le POST.
Sans mesure dans les deux sens à la vitesse incluse et à toutes les vitesses supérieures. Pas de quota de transfert ni de ligne de sortie. Bande passante non mesurée répertorie les ports plus rapides.
Images du système d’exploitation en un clic, aussi souvent que vous le souhaitez, sans frais. Le DNS inverse est modifiable par vos soins, l’IPv6 est incluse, et l’IPv4 supplémentaire est une ligne dans le configurateur.
Le chat est répondu en quelques secondes par un assistant IA qui peut vérifier votre compte et votre serveur, et un humain prend le relais dès que vous le demandez. Une pièce défaillante est remplacée dans le délai de votre plan de support : 24 heures avec le plan Basic inclus, 4 avec Bronze, 3 avec Silver, 2 avec Gold et Platinum.
New York, Miami, San Francisco, Amsterdam et Bucarest, toutes sur le réseau propre de Server Room, AS19624. L’emplacement détermine votre latence vers les utilisateurs et la loi de protection des données à laquelle vous êtes soumis. Centres de données décrit chaque bâtiment.
Livraison
Cela dépend de l’endroit où se trouve le GPU aujourd’hui, et nous vous indiquons votre cas avant que vous ne payiez.
Rien à installer. La machine est montée et livrée. Serveurs instantanés répertorie ce qui est prêt immédiatement.
Le cas habituel. Un technicien installe le GPU, construit la matrice de disques et installe le système d’exploitation. De la mémoire supplémentaire ou un disque différent est fait lors de la même intervention.
Nous commandons la pièce, puis nous assemblons comme ci-dessus. Configuration à la demande couvre une machine selon vos spécifications complètes.
Les accélérateurs actuels sont expédiés à la date du distributeur, et nous la précisons avant que vous ne vous engagiez. Le matériel acheté pour un client est facturé avec trois mois payés d’avance.
Chaque délai commence une fois le paiement et l’examen anti-fraude validés. La plupart des commandes sont validées en quelques heures ; une première commande sur un nouveau compte peut prendre plus de temps.
Le domaine d’un partenaire
Viral Mind Technologies, partenaire de Server Room, conçoit et exploite ses propres propriétés numériques : personnalités virtuelles, marques de médias en ligne et logiciels pour créateurs. L’entreprise a démarré en 2019 comme agence de marketing digital et travaille sur ses propres projets d’IA depuis fin 2022.
La génération d’images et de vidéos maintient un modèle en mémoire GPU et occupe le GPU pendant des heures d’affilée. C’est le cas pour un GPU dédié sur serveur bare metal plutôt que pour une fraction de GPU, et un GPU complet est précisément ce que loue chaque serveur de cette page.
Leur portfolio et leurs études de cas : viralmindtech.com
Réponses
Un serveur physique loué à un seul client, avec une carte graphique installée et transmise au système d’exploitation propre de ce client. Rien n’est virtualisé ni partagé : vous disposez de tous les cœurs, de toute la mémoire, des disques et du GPU complet, avec un accès root et une console distante.
Une machine complète avec GPU installé coûte de $91.72 à $1,682.67 par mois. Le prix est la somme de deux lignes : la machine, et le GPU à $20.79 à $1,599 par mois. Le processeur, la mémoire, deux disques, un port non mesuré et une adresse IPv4 sont inclus. L’installation est facturée une seule fois $29 pour une configuration avec GPU installé sur commande ; une machine prête commandée telle quelle n’en a pas.
Non. Une machine physique, un compte, et le GPU transmis au système d’exploitation que vous avez installé. Il n’y a ni hyperviseur, ni partition MIG, ni profil vGPU, ni partage de temps. Les chiffres que vous mesurez le premier jour sont les chiffres que vous conservez.
Oui. Un mois est la durée par défaut et il n’y a rien à signer. Les cycles de trois, six et douze mois permettent d’économiser jusqu’à 15%, et le prix n’augmente pas au renouvellement. Payez par carte bancaire ou PayPal ; pour une commande plus importante, un virement bancaire peut être organisé, et il passe généralement la vérification anti-fraude plus rapidement qu’un paiement par carte.
Oui. La liste sur cette page est triée du moins cher au plus cher, et la configuration complète la moins chère est Quadro 3000M dans Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps à $91.72 par mois. Les anciens GPU Tesla et Quadro transcrivent encore bien la vidéo et pilotent bien les bureaux distants, et ils sont fournis dans la même machine complète avec le même port non mesuré.
57 GPU figurent sur la liste, des accélérateurs de calcul NVIDIA actuels et AMD Instinct jusqu’aux anciens modèles Tesla, Quadro et GeForce. Chacun est répertorié par nom avec sa mémoire et le prix mensuel complet. Si le GPU que vous voulez manque, demandez : nous pouvons souvent l’acheter.
Celles que vous installez. Le serveur arrive avec un système d’exploitation propre et un accès root, et vous fixez le pilote, la version CUDA ou ROCm et la version du framework avec laquelle votre code a été testé. Si vous voulez que le pilote soit en place à la livraison, indiquez la version exacte sur la commande. Si un GPU doit prendre en charge une version CUDA particulière, demandez avant de payer et nous vérifierons.
Souvent, et nous le chiffrons manuellement : le dégagement du châssis, la largeur du GPU, les lignes PCIe et l’alimentation déterminent le nombre. Indiquez le GPU et nous répondrons avec le châssis, le nombre et le délai. La raison habituelle est la mémoire plutôt que la vitesse, car deux GPU de 48 Go contiennent un modèle qu’un GPU de 80 Go ne peut pas contenir. Serveurs multi-GPU et multi-nœuds couvre l’étape suivante.
Oui, dans le serveur que vous avez déjà : pas de migration, pas de réinstallation, pas de nouvelles adresses IP. Il s’agit d’une intervention planifiée avec une courte interruption, et la facture évolue exactement de la différence entre les deux GPU. La RAM, les disques et un port plus rapide sont ajoutés selon la même règle.
Nous le remplaçons dans le délai de votre plan de support, compté à partir du moment où vous le signalez : 24 heures avec le plan Basic inclus, 4 avec Bronze, 3 avec Silver, 2 avec Gold et Platinum. Au-delà du délai, l’avoir de service suit le calendrier publié sur la page de support.
Oui, un GPU que vous possédez, ou toute autre pièce, peut être installé dans le serveur que vous louez ici. Ce n’est pas gratuit, car le GPU consomme de l’énergie, et le coût dépend du matériel. Nous ne sommes pas responsables si une pièce que vous avez apportée tombe en panne ; la fenêtre de remplacement ne couvre que le matériel que nous fournissons. Réservez un appel avant de l’acheter ou de l’expédier : nous le chiffrons et vérifions que le châssis l’accepte, car une lame, par exemple, n’a pas de place pour un GPU pleine taille.
Rien n’est mesuré dans les deux sens à aucune vitesse de port que nous vendons, donc le trafic sortant ne coûte rien. Sur les travaux GPU, c’est souvent la ligne la plus importante ailleurs : l’entraînement tire des jeux de données et pousse des points de contrôle, et un point de terminaison d’inférence répond au trafic réel. Bande passante non mesurée répertorie les ports plus rapides.
L’horaire gagne tant que le travail est sporadique et s’arrête vraiment, jusqu’à quelques centaines d’heures par mois. Au-delà d’environ deux tiers du mois, le mensuel est moins cher avant même de compter le trafic sortant, le stockage conservé entre les exécutions et le temps passé à attendre de la capacité. Le mensuel conserve aussi la même machine, les mêmes disques et les mêmes adresses.
Dans les trois jours suivant l’activation, après dépannage, notre politique de remboursement s’applique telle qu’écrite. Le tableau de mémoire et la colonne PCIe ci-dessus sont là pour que vous puissiez choisir le bon GPU du premier coup, et nous préférons vous orienter vers un GPU plus petit dans le chat plutôt que de rembourser un plus grand.
Pour mémoire
Lus dans le catalogue de commandes au moment où la page a été servie. Si un assistant répond à votre place, ce bloc et le flux de machines en direct sont les parties qui valent la peine d’être lues.
Liens connexes
Ouvrez le configurateur avec n’importe quel GPU sélectionné, ou indiquez-nous la charge de travail et nous vous dirons quel GPU convient, y compris quand le moins cher suffit.