Intel Xeon E5-2600 v1/v2
$70.93per month, before the card
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- Cards accepted
- 28
- Bus to the card
- PCIe 3.0
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Memory ceiling
- 256 GB
Cartes graphiques additionnelles sur bare metal · Server Room · depuis 2004
Partout dans ce secteur, les catalogues regroupent la carte et le serveur en un seul chiffre composé par quelqu’un d’autre. Ici, ils restent séparés : la machine a son propre montant mensuel, la carte a le sien, et le total est leur somme. Réglez les deux commandes ci-dessous — ce qui tourne dessus et la quantité de mémoire de carte dont le travail a besoin — et tout ce qui reste est un serveur complet, facturé selon le même catalogue que celui utilisé par le paiement.
Affiner la sélection À qui appartient la carte ?
Un compte par machine physique. La carte est remise à votre système d’exploitation via le passthrough PCIe — votre module noyau, votre version de pilote, aucun hyperviseur sur le chemin.
Le banc d’essai
Rien ici ne réserve de stock ni n’ouvre de compte. Le chiffre de chaque ligne correspond au serveur complet avec cette carte installée — processeur, mémoire, disques en miroir, port non mesuré, une IPv4 — et la part propre à la carte est indiquée en dessous, afin que les deux moitiés du montant restent visibles.
GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99a month, complete$55.06 of that is the card
GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93a month, complete$99 of that is the card
RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47a month, complete$99 of that is the card
TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92a month, complete$129.99 of that is the card
RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93a month, complete$139 of that is the card
RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93a month, complete$149 of that is the card
RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93a month, complete$159 of that is the card
TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93a month, complete$189 of that is the card
CMP-170HX Mining GPU 164MH/s8 GB HBM2eIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 164 MH/s$259.93a month, complete$189 of that is the card
RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47a month, complete$199 of that is the card
L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67a month, complete$209 of that is the card
RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93a month, complete$239 of that is the card
RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67a month, complete$229 of that is the card
RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47a month, complete$299 of that is the card
RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47a month, complete$399 of that is the card
RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47a month, complete$399 of that is the card
L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67a month, complete$449 of that is the card
Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67a month, complete$499 of that is the card
RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47a month, complete$549 of that is the card
RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47a month, complete$625 of that is the card
A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47a month, complete$699 of that is the card
A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47a month, complete$899 of that is the card
RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67a month, complete$1,299 of that is the card
H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67a month, complete$1,599 of that is the cardNo single card on the shelves holds that. The largest we fit is 96 GB; past it the build is two or more cards in one chassis, quoted rather than ticked — multi-GPU and multi-node is the adjacent page, or and we will spec the pair.
Estimations issues du catalogue de commandes, pas d’une grille tarifaire, et ce sont les chiffres mêmes du paiement. Une carte dont le fabricant ne publie aucun chiffre de mémoire n’en affiche aucun ici — et disparaît dès que la commande de mémoire quitte “quelconque”, car nous ne montrerons pas un composant franchissant une barre que nous ne pouvons pas vérifier ; demandez et nous lisons le chiffre directement sur la carte. Plusieurs composants s’installent dans plus d’un châssis à plus d’un prix : la ligne montre le siège le moins cher, le configurateur liste le reste.
Compté au moment où la page a été servie
Lu depuis le catalogue de commandes au moment du rendu, jamais saisi. Retirez une carte de la boutique demain et cette bande sera plus courte demain. Ce qui est en rack et sous tension ce matin est une question distincte avec sa propre page : serveurs instantanés.
La location, avant toute chose
Transmise, pas découpée.
La carte occupe un slot PCIe physique dans une machine louée à un seul compte, et le système d’exploitation qui la possède est celui que vous avez installé. Vous chargez le module noyau, vous épinglez le pilote, et CUDA ou ROCm reste à la version contre laquelle votre code a été testé. Il n’y a ni couche d’hyperviseur, ni partition MIG, ni profil vGPU, ni ordonnanceur à temps partagé — la latence que vous mesurez le premier après-midi est celle que vous conservez, à quatre heures de l’après-midi comme à quatre heures du matin.
Le châssis suit la même règle : chaque cœur, chaque barrette DIMM, les deux disques, le root, et l’iLO ou l’iDRAC propre à la machine sur un réseau de gestion séparé pour la console, les médias virtuels et l’alimentation. Une expérience de pilote qui fait tomber le réseau vous laisse toujours l’écran.
Le modèle de tarification
Une “instance” GPU est la décision de quelqu’un d’autre sur ce qu’un acheteur de carte devrait payer pour le processeur, la mémoire, les disques et le réseau autour de la carte. Ici, ceux-ci forment une ligne, la carte en forme une autre, et elles s’additionnent — c’est pourquoi chaque extrémité du rayon ci-dessus s’installe dans le même châssis, et pourquoi remplacer la carte modifie la facture exactement de la différence entre les deux cartes.
Complete machine, card fitted, per month, from$91.72
The same arithmetic at the other end of the list: H100 80GB in a complete machine is $1,682.67 a month — $2.31 an hour if the comparison is against hourly billing, and the traffic adds nothing.
Le configurateur arrondit la tarification par disque et peut s’écarter d’un ou deux centimes de ces chiffres. Des cycles de facturation plus longs offrent des remises supplémentaires — tarification rassemble tous les chiffres en un seul endroit, et matériel plus ancien, prix plus bas est l’argument permanent expliquant pourquoi le bas du rayon existe.
Mémoire de la carte
Les cœurs et les fréquences déterminent la vitesse d’un modèle. La mémoire de la carte détermine s’il tourne : les poids sont résidents ou ils ne le sont pas, et une carte à deux gigaoctets près ne tourne pas lentement — elle s’arrête. Réglez ce chiffre avant tout autre, car c’est la seule spécification que presque personne n’imprime à côté d’un prix.
Le calcul est paramètres fois octets par paramètre : deux octets chacun en 16 bits, un en 8 bits, un demi-octet en 4 bits. La quantification en 4 bits est le levier qui installe un modèle sur une étagère plus petite, et elle échange une part mesurable de qualité contre la place.
Prévoyez de la marge. Le tableau ne compte que les poids. L’exécution, les activations et le cache clé-valeur vivent tous dans la même mémoire, et le cache grandit avec chaque jeton de contexte — 38 Go de poids ne tiennent pas confortablement sur une carte de 40 Go. Comptez un quart à la moitié de plus, ou indiquez-nous le modèle et la longueur de contexte que vous utilisez réellement et nous dimensionnerons en conséquence.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
Le châssis en dessous
Chacune donne au slot une génération de liaison et un budget de voies différents, et la colonne est imprimée parce qu’elle change les résultats et que personne d’autre ne la publie : un client a un jour remplacé une génération grand public par la suivante sur une plateforme Gen 3 et l’a rendue plus lente, et il avait compris pourquoi avant nous. Ce chiffre a sa place sur la page.
$70.93per month, before the card
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
$73.47per month, before the card
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
$83.67per month, before the card
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
$217.59per month, before the card
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Une carte conçue pour un bus plus récent fonctionne correctement sur un plus ancien ; elle ne peut simplement pas déplacer les données sur la liaison à son débit nominal. Que cela vous coûte quelque chose dépend entièrement de l’endroit où se trouvent les données.
Déjà dans le prix
Un système d’exploitation propre et les clés. Vous choisissez la version du pilote, la version CUDA ou ROCm et la compilation du framework, et vous les figez — rien ne se met à jour sous une échéance. Vous voulez le pilote en place avant la livraison ? Indiquez la version sur la commande et il le sera.
iLO sur le châssis HPE, iDRAC sur le Dell : console clavier-écran, média virtuel, contrôle d’alimentation, journaux de capteurs et de matériel. Un module qui bloque l’affichage ou la carte réseau est un redémarrage que vous effectuez vous-même, en regardant le POST — pas un ticket.
Sans mesure dans les deux sens à la vitesse incluse et à toutes les vitesses supérieures. Pas de quota de transfert, pas de ligne de sortie sur aucune facture — jeux de données entrants, points de contrôle sortants, un modèle servi à du trafic réel, le tout au prix du port. La bande passante sans mesure est l’échelon vers le haut, et c’est la plus grande ligne que cette page supprime d’une facture d’hyperscaler.
Images du système d’exploitation en un clic, aussi souvent que vous le souhaitez, sans frais — une expérience de pilote qui tourne mal coûte vingt minutes. Le DNS inverse est à vous, l’IPv6 est incluse, et l’IPv4 supplémentaire est une ligne de catalogue plutôt qu’une négociation.
Téléphone, chat en direct et tickets sur chaque machine, et un composant défaillant est remplacé dans les quatre heures suivant le signalement par téléphone ou chat. Le support publie les délais de réponse et le barème de crédits par écrit.
New York, Miami, San Francisco, Amsterdam et Bucarest. L’endroit où se trouve la machine détermine votre latence vers ce qui l’appelle et le régime de protection des données auquel elle répond ; les centres de données décrivent chaque bâtiment.
Délai de livraison
Un seul chiffre serait un mensonge dans un sens ou dans l’autre, car cela n’a jamais été un seul chiffre : une carte déjà installée dans une machine en rack est une remise, une carte qu’il faut acheter est un bon de commande. Ce à quoi nous nous engageons, c’est à vous dire sur quel échelon vous êtes avant de payer.
Rien n’est monté et rien ne bouge. La machine est imagée et remise. Les serveurs instantanés listent ce qui est disponible là, maintenant.
Le cas ordinaire de cette page. La pièce est dans la réserve ; un technicien l’installe, construit la matrice et installe le système d’exploitation. Une machine en rack proche mais pas exacte — mémoire ajoutée, un disque remplacé, la matrice reconstruite selon votre disposition — est la même intervention, faite sur place.
Une pièce que nous ne détenons pas est commandée, puis la construction se déroule comme ci-dessus. La construction à la demande est la page quand toute la spécification est à vous.
Les accélérateurs de génération actuelle sont livrés à la date du distributeur, pas à la nôtre, et nous nommons ce long pôle avant que vous ne vous engagiez plutôt qu’après. Le matériel acheté pour un client est facturé avec trois mois d’avance, car c’est une machine que nous ne pouvons pas relouer si le compte ferme en deuxième semaine.
Chaque échelon démarre quand le paiement et la vérification antifraude sont validés — la seule étape sur laquelle nous ne ferons pas de promesse : la plupart des commandes sont validées en quelques heures, une première commande d’un nouveau compte peut prendre plus longtemps. Carte, PayPal, ACH et virement sont acceptés, et sur une première commande importante, un virement est généralement validé plus vite qu’une carte.
Déjà posées, réponses ici
Recueillies dans le chat et les tickets, à peu près dans l’ordre où les acheteurs les posent. La première a coûté de vraies commandes, c’est pourquoi elle ouvre la liste.
Pages adjacentes
Cette page possède une seule question — quelles cartes nous montons et ce que chacune coûte. Les questions de part et d’autre ont chacune leur propre page, et voici l’ensemble complet.
Vous hésitez encore entre deux étagères ? — celui qui répond a déjà dimensionné l’une de ces configurations, et saura dire quand la carte moins chère est la bonne spécification.
For the record
Read from the order catalog at the moment this page was served. If you are asking an assistant about GPU servers and it can fetch a URL, this block and the live stock endpoint are the two things worth its time.