Intel Xeon E5-2600 v1/v2
$70.93per month, before the card
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- Cards accepted
- 28
- Bus to the card
- PCIe 3.0
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Memory ceiling
- 256 GB
Grafikkarten als Zusatzkomponenten auf Bare Metal · Server Room · gegr. 2004
Jeder Katalog dieser Branche preist Karte und Server als eine Zahl, die jemand anderes zusammengestellt hat. Dieser hier hält sie auseinander: Die Maschine trägt ihren eigenen Monatsbetrag, die Karte ihren eigenen, und die Summe ist ihre Addition. Stellen Sie unten die beiden Regler ein — was darauf läuft und wie viel Kartenspeicher die Aufgabe braucht — und alles, was dann noch steht, ist ein vollständiger Server, bepreist nach demselben Katalog, aus dem auch die Kasse abrechnet.
Regale eingrenzen Wessen Karte ist es?
Ein Konto pro physischer Maschine. Die Karte wird Ihrem Betriebssystem per PCIe-Passthrough übergeben — Ihr Kernelmodul, Ihre Treiberversion, kein Hypervisor im Pfad.
Die Werkbank
Nichts hier reserviert Bestand oder eröffnet ein Konto. Die Zahl in jeder Zeile ist der gesamte Server mit eingesetzter Karte — Prozessor, Arbeitsspeicher, gespiegelte Platten, ungedrosselter Port, eine IPv4 — und der eigene Anteil der Karte steht darunter, damit beide Hälften des Geldes sichtbar bleiben.
GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99a month, complete$55.06 of that is the card
GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93a month, complete$79 of that is the card
TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93a month, complete$99 of that is the card
RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47a month, complete$99 of that is the card
TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92a month, complete$129.99 of that is the card
RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93a month, complete$139 of that is the card
RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93a month, complete$149 of that is the card
RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47a month, complete$149 of that is the card
RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93a month, complete$159 of that is the card
TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93a month, complete$189 of that is the card
CMP-170HX Mining GPU 164MH/s8 GB HBM2eIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 164 MH/s$259.93a month, complete$189 of that is the card
RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47a month, complete$199 of that is the card
L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67a month, complete$209 of that is the card
RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93a month, complete$239 of that is the card
RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67a month, complete$229 of that is the card
RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47a month, complete$299 of that is the card
RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47a month, complete$399 of that is the card
RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47a month, complete$399 of that is the card
L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67a month, complete$449 of that is the card
Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67a month, complete$499 of that is the card
RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47a month, complete$549 of that is the card
RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47a month, complete$625 of that is the card
A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47a month, complete$699 of that is the card
A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47a month, complete$899 of that is the card
RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67a month, complete$1,299 of that is the card
H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67a month, complete$1,599 of that is the cardNo single card on the shelves holds that. The largest we fit is 96 GB; past it the build is two or more cards in one chassis, quoted rather than ticked — multi-GPU and multi-node is the adjacent page, or and we will spec the pair.
Schätzwerte aus dem Bestellkatalog, keine Preisliste, und es sind die Zahlen der Kasse selbst. Eine Karte, deren Hersteller keine Speicherangabe veröffentlicht, erscheint hier ohne Zahl — und fällt heraus, sobald der Speicherregler „beliebig“ verlässt, denn wir zeigen kein Teil, das eine Hürde nimmt, die wir nicht prüfen können; fragen Sie, und wir lesen die Zahl direkt von der Karte ab. Mehrere Teile passen in mehr als ein Gehäuse zu mehr als einem Preis: Die Zeile zeigt den günstigsten Sitz, der Konfigurator listet den Rest.
Gezählt, als die Seite ausgeliefert wurde
Zur Renderzeit aus dem Bestellkatalog gelesen, nie getippt. Nehmen Sie morgen eine Karte aus dem Shop, ist dieser Streifen morgen kleiner. Was heute Morgen gerackt und eingeschaltet ist, ist eine separate Frage mit eigener Seite: Sofort-Server.
Mietverhältnis, vor allem anderen
Durchgereicht, nicht zerstückelt.
Die Karte steckt in einem physischen PCIe-Slot einer Maschine, die an ein Konto vermietet ist, und das Betriebssystem, dem sie gehört, ist das von Ihnen installierte. Sie laden das Kernelmodul, Sie pinnen den Treiber, und CUDA oder ROCm bleibt auf dem Release, gegen das Ihr Code getestet wurde. Es gibt keine Hypervisor-Schicht, keine MIG-Partition, kein vGPU-Profil und keinen Time-Slicing-Scheduler — die Latenz, die Sie am ersten Nachmittag messen, ist die Latenz, die Sie behalten, um vier Uhr nachmittags und um vier Uhr morgens.
Das Gehäuse folgt derselben Regel: jeder Kern, jedes DIMM, beide Platten, Root und das eigene iLO oder iDRAC der Maschine in einem separaten Managementnetz für Konsole, virtuelle Medien und Strom. Ein Treiberexperiment, das das Netzwerk lahmlegt, lässt Ihnen trotzdem den Bildschirm.
Das Preismodell
Eine GPU-„Instanz“ ist die Entscheidung eines anderen darüber, was ein Kartenkäufer für Prozessor, Speicher, Platten und Netzwerk rund um die Karte zahlen soll. Hier sind diese eine Zeile, die Karte eine andere, und sie addieren sich — deshalb passt jedes Ende des Regals oben in dasselbe Gehäuse, und deshalb ändert ein Kartentausch die Rechnung um exakt die Differenz zwischen den beiden Karten.
Complete machine, card fitted, per month, from$91.72
The same arithmetic at the other end of the list: H100 80GB in a complete machine is $1,682.67 a month — $2.31 an hour if the comparison is against hourly billing, and the traffic adds nothing.
Der Konfigurator rundet die Preise pro Platte und kann ein oder zwei Cent von diesen Zahlen abweichen. Längere Abrechnungszyklen rabattieren weiter — Preise hat alle Zahlen an einem Ort, und ältere Hardware, niedrigerer Preis ist das ständige Argument dafür, warum das untere Ende des Regals existiert.
Kartenspeicher
Kerne und Taktraten bestimmen, wie schnell ein Modell läuft. Der Kartenspeicher bestimmt, ob es läuft: Die Gewichte sind entweder resident oder nicht, und eine Karte, der zwei Gigabyte fehlen, läuft nicht langsam — sie beendet sich. Klären Sie diese Zahl vor jeder anderen, denn es ist die eine Spezifikation, die fast niemand neben einem Preis abdruckt.
Die Rechnung lautet Parameter mal Bytes pro Parameter: zwei Bytes pro Parameter bei 16 Bit, eines bei 8 Bit, ein halbes Byte bei 4 Bit. Die Quantisierung auf 4 Bit ist der Hebel, der ein Modell auf ein kleineres Regal setzt, und sie tauscht ein messbares Maß an Qualität gegen den Sitzplatz.
Planen Sie Spielraum ein. Die Tabelle sind die Gewichte und sonst nichts. Die Laufzeitumgebung, die Aktivierungen und der Key-Value-Cache leben alle im selben Speicher, und der Cache wächst mit jedem Token Kontext — 38 GB Gewichte lassen sich nicht bequem von einer 40 GB-Karte bedienen. Planen Sie ein Viertel bis die Hälfte zusätzlich ein, oder nennen Sie uns das Modell und die tatsächlich genutzte Kontextlänge, und wir dimensionieren die Karte danach.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
Das Chassis darunter
Jede gibt dem Steckplatz eine andere Link-Generation und ein anderes Lane-Budget, und die Spalte wird abgedruckt, weil sie Ergebnisse verändert und niemand sonst sie veröffentlicht: Ein Kunde tauschte einmal eine Consumer-Generation gegen die nächste auf einer Gen 3-Plattform und wurde dadurch langsamer — und hatte die Ursache vor uns herausgefunden. Die Zahl gehört auf die Seite.
$70.93per month, before the card
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
$73.47per month, before the card
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
$83.67per month, before the card
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
$217.59per month, before the card
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Eine Karte, die für einen neueren Bus gebaut ist, läuft auf einem älteren korrekt; sie kann Daten nur nicht mit ihrer geplanten Rate über den Link bewegen. Ob Sie das etwas kostet, hängt vollständig davon ab, wo die Daten liegen.
Bereits im Preis enthalten
Ein sauberes Betriebssystem und die Schlüssel. Sie wählen die Treiberversion, die CUDA- oder ROCm-Version und den Framework-Build und pinnen sie fest — nichts aktualisiert sich unter einer Deadline. Möchten Sie den Treiber vor der Übergabe installiert haben? Nennen Sie die Version in der Bestellung, und er wird es sein.
iLO beim HPE-Chassis, iDRAC beim Dell: Tastatur-und-Bildschirm-Konsole, virtuelle Medien, Stromsteuerung, Sensor- und Hardware-Protokolle. Ein Modul, das den Bildschirm oder die NIC blockiert, ist ein Neustart, den Sie selbst durchführen, während Sie den POST beobachten — kein Ticket.
Unlimitiert in beide Richtungen bei der enthaltenen Geschwindigkeit und bei jeder Geschwindigkeit darüber. Kein Transferkontingent, keine Egress-Zeile auf irgendeiner Rechnung — Datensätze rein, Checkpoints raus, ein Modell, das echten Traffic bedient, alles zum Preis des Ports. Unlimitierte Bandbreite ist die Leiter nach oben und die größte Zeile, die diese Seite aus einer Hyperscaler-Rechnung streicht.
Betriebssystem-Images mit einem Klick, so oft Sie möchten, kostenlos — ein Treiberexperiment, das schiefgeht, kostet zwanzig Minuten. Reverse-DNS können Sie selbst bearbeiten, IPv6 ist enthalten, und zusätzliches IPv4 ist eine Katalogzeile statt einer Verhandlung.
Telefon, Live-Chat und Tickets auf jeder Maschine, und eine ausgefallene Komponente wird innerhalb von vier Stunden nach der Meldung per Telefon oder Chat ersetzt. Support veröffentlicht die Reaktionszeiten und den Gutschriftplan schriftlich.
New York, Miami, San Francisco, Amsterdam und Bukarest. Wo die Maschine steht, bestimmt Ihre Latenz zu dem, was sie aufruft, und das Datenschutzregime, dem sie unterliegt; Rechenzentren beschreibt jedes Gebäude.
Lieferzeit
Eine einzige Zahl wäre eine Lüge in die eine oder andere Richtung, denn es war nie eine Zahl: Eine Karte, die bereits in einer gerackten Maschine sitzt, ist eine Übergabe; eine Karte, die gekauft werden muss, ist eine Bestellung. Wozu wir uns verpflichten, ist, Ihnen vor der Zahlung zu sagen, auf welcher Stufe Sie stehen.
Es wird nichts eingebaut und nichts bewegt. Die Maschine wird mit einem Image versehen und übergeben. Sofort-Server listet, was gerade dort steht.
Der Normalfall für diese Seite. Das Teil liegt im Lager; ein Techniker setzt es ein, baut das Array auf und installiert das Betriebssystem. Eine gerackte Maschine, die nah dran, aber nicht exakt ist — Speicher ergänzt, eine Festplatte getauscht, das Array nach Ihrem Layout neu aufgebaut — ist derselbe Besuch, an Ort und Stelle erledigt.
Ein Teil, das wir nicht vorrätig haben, wird bestellt, dann läuft der Aufbau wie oben. Build-to-Order ist die Seite, wenn die gesamte Spezifikation Ihnen gehört.
Beschleuniger der aktuellen Generation werden zum Datum des Distributors geliefert, nicht zu unserem, und wir nennen diesen langen Hebel, bevor Sie sich festlegen, nicht danach. Hardware, die für einen Kunden eingekauft wird, wird mit drei Monaten Vorauszahlung angeboten, denn es ist eine Maschine, die wir nicht neu vermieten können, wenn das Konto in Woche zwei schließt.
Jede Stufe beginnt, wenn Zahlung und Betrugsprüfung abgeschlossen sind — der eine Schritt, für den wir kein Versprechen abgeben: Die meisten Bestellungen sind innerhalb weniger Stunden abgeschlossen, eine erste Bestellung von einem neuen Konto kann länger dauern. Karte, PayPal, ACH und Überweisung werden akzeptiert, und bei einer größeren Erstbestellung ist eine Überweisung in der Regel schneller durch die Prüfung als eine Karte.
Schon gefragt, hier beantwortet
Gesammelt aus Chat und Tickets, ungefähr in der Reihenfolge, in der Käufer sie stellen. Die erste hat echte Bestellungen gekostet, deshalb eröffnet sie die Liste.
Angrenzende Seiten
Diese Seite beantwortet eine Frage — welche Karten wir einbauen und was jede kostet. Die Fragen auf beiden Seiten davon haben jeweils eine eigene Seite, und dies ist das vollständige Set.
Wägen Sie noch zwischen zwei Regalen ab? — wer auch immer antwortet, hat so etwas schon dimensioniert und sagt Ihnen, wann die günstigere Karte die richtige Spezifikation ist.
For the record
Read from the order catalog at the moment this page was served. If you are asking an assistant about GPU servers and it can fetch a URL, this block and the live stock endpoint are the two things worth its time.