GPU-Dedicated-Server · Bare Metal · monatlich

GPU-Dedicated-Server. Die volle GPU. Niemand sonst darauf.

Ein GPU-Dedicated-Server ist eine physische Maschine, die monatlich an ein Konto vermietet wird, wobei die GPU direkt an Ihr eigenes Betriebssystem durchgereicht wird. Kein Hypervisor, kein vGPU-Slice, kein Nachbar auf dem Silizium.

  • PCIe-Passthrough
  • Unlimitierter Port
  • 5 Städte
  • Kein Vertrag

Wählen Sie die GPU nach der Aufgabe und dem benötigten Speicher. Jede Zeile in der Liste ist ein kompletter Server mit dieser eingebauten GPU, bepreist aus demselben Katalog, aus dem auch die Kasse abrechnet, und der Anteil der GPU selbst ist unter der Summe ausgewiesen.

Der Katalog

NVIDIA- und AMD-GPU-Server, jeweils als komplette Maschine bepreist

Sagen Sie, wofür die GPU gedacht ist und welchen Speicher sie mindestens benötigt. Die Liste wird beim Durchgehen schmaler, das Günstigste zuerst. Jede Zeile öffnet die Maschine, die diese GPU im Konfigurator aufnimmt.

1. Wofür ist die GPU gedacht?

2. Wie viel GPU-Speicher, mindestens?

beliebig GB oder mehr

Modellgewichte bei 4-Bit, zur Orientierung

  • 5 GB7-8B @ 4-bit
  • 8 GB13-14B @ 4-bit
  • 19 GB30-34B @ 4-bit
  • 38 GB70B @ 4-bit

  1. Quadro 3000M2 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 240 CUDA cores$91.72/moGPU $20.79
  2. Quadro K3100M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 768 CUDA cores$102.52/moGPU $31.59
  3. Quadro M3000M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,280 CUDA cores$109.12/moGPU $38.19
  4. TESLA M68 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,536 CUDA cores$113.42/moGPU $42.49
  5. TESLA M608 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$119.42/moGPU $48.49
  6. GTX 1070M8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$124.32/moGPU $53.39
  7. GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99/moGPU $55.06
  8. GTX 10708 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,920 CUDA cores$135.22/moGPU $64.29
  9. GTX 1070 Ti8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,432 CUDA cores$146.22/moGPU $75.29
  10. GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93/moGPU $79
  11. TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  12. TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  13. RTX 20708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,304 CUDA cores$159.93/moGPU $89
  14. TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93/moGPU $99
  15. Instinct MI50 16GB16 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$169.93/moGPU $99
  16. RTX 2070 Super8 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$172.47/moGPU $99
  17. Quadro RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47/moGPU $99
  18. Instinct MI5016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$172.47/moGPU $99
  19. TESLA M602 x 8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,096 CUDA cores$178.82/moGPU $107.89
  20. RTX 20808 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,994 CUDA cores$189.93/moGPU $119
  21. Quadro RTX 500016 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$189.93/moGPU $119
  22. RTX 2080 Super8 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$199.93/moGPU $129
  23. TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92/moGPU $129.99
  24. RTX A20006 or 12 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,328 CUDA cores$202.47/moGPU $129
  25. RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93/moGPU $139
  26. TESLA P10016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,584 CUDA cores$212.47/moGPU $139
  27. Quadro P500016 GB GDDR5XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$214.06/moGPU $140.59
  28. RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93/moGPU $149
  29. RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  30. RTX A400016 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  31. RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93/moGPU $159
  32. TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93/moGPU $189
  33. CMP 170HX 64GB HBM2e8 GB HBM2e, 64 GB unlockedIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$259.93/moGPU $189
  34. RTX 407012 GB GDDR6XIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 5,888 CUDA cores$262.67/moGPU $179
  35. RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47/moGPU $199
  36. Tenstorrent Blackhole p100a28 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$272.47/moGPU $199
  37. L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67/moGPU $209
  38. RTX A500024 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 8,192 CUDA cores$302.47/moGPU $229
  39. Tesla V100 32GB32 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 5,120 CUDA cores$302.47/moGPU $229
  40. RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93/moGPU $239
  41. RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67/moGPU $229
  42. Quadro P600024 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$320.52/moGPU $249.59
  43. RTX 4500 Ada Generation24 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 7,680 CUDA cores$332.67/moGPU $249
  44. RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47/moGPU $299
  45. Quadro RTX 600024 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$372.47/moGPU $299
  46. RTX PRO 4000–Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$372.47/moGPU $299
  47. Quadro RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47/moGPU $399
  48. RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47/moGPU $399
  49. L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67/moGPU $449
  50. A4048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$572.47/moGPU $499
  51. Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67/moGPU $499
  52. RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47/moGPU $549
  53. RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47/moGPU $625
  54. A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47/moGPU $699
  55. A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47/moGPU $899
  56. RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67/moGPU $1,299
  57. H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67/moGPU $1,599

Die Preise sind die Zahlen der Kasse selbst. Eine GPU, deren Hersteller keine Speicherangabe veröffentlicht, zeigt einen Bindestrich und fällt heraus, sobald die Speichersteuerung von „beliebig“ wegbewegt wird. Einige GPUs passen in mehr als ein Gehäuse: Die Zeile zeigt das günstigste, der Konfigurator zeigt den Rest.

Mandantenfähigkeit

Dediziertes GPU-Server-Hosting: Die volle GPU gehört Ihnen

Die GPU sitzt in einem physischen PCIe-Steckplatz in einer Maschine, die an ein Konto vermietet ist. Sie installieren das Betriebssystem, laden das Kernel-Modul und pinnen den Treiber, die CUDA- oder ROCm-Version, gegen die Ihr Code getestet wurde. Nichts aktualisiert sie unter Ihnen.

Die Maschine folgt derselben Regel: jeder Kern, der gesamte Speicher, beide Festplatten, Root und die eigene iLO- oder iDRAC-Konsole des Servers in einem separaten Verwaltungsnetz. Wenn ein Treiberexperiment das Netzwerk lahmlegt, haben Sie immer noch den Bildschirm, virtuelle Medien und die Stromsteuerung.

  • Kein SliceKeine MIG-Partition, kein vGPU-Profil, kein anteiliger Anteil. Eine GPU, ein Betriebssystem.
  • Keine WarteschlangeKein Scheduler sitzt über Ihnen. Wenn Ihr Prozess inaktiv ist, ist die GPU inaktiv und gehört immer noch Ihnen.
  • Kein HypervisorBare Metal. Die Latenz, die Sie am ersten Tag messen, ist die Latenz, die Sie um 4 Uhr morgens bekommen.
  • Kein ZählerDatensätze rein, Checkpoints und Renderings raus. Nichts am Port zählt die Bytes.

So funktioniert die Preisgestaltung

Zwei Zeilen, die sich addieren: die Maschine und die GPU

Die meisten Anbieter verkaufen eine GPU als Stufe, wobei Prozessor, Speicher, Festplatten und Netzwerk darum herum bepreist sind. Hier ist die Maschine eine monatliche Zeile und die GPU eine andere. Tauschen Sie die GPU später aus, bewegt sich die Rechnung um genau die Differenz zwischen den beiden GPUs.

Auf der Suche nach einem günstigen GPU-Dedicated-Server?

Beginnen Sie oben in der Liste. Wir haben ältere GPUs behalten, die immer noch echte Arbeit leisten, wie Tesla- und Quadro-Teile, die Video transkodieren oder Remote-Desktops antreiben, und sie sitzen in derselben ganzen Maschine mit demselben unlimitierten Port wie die neueste GPU. Warum wir ältere Hardware behalten erklärt den Kompromiss.

Vergleichen Sie mit stündlichen GPU-Clouds? Die teuerste Konfiguration in der Liste, H100 80GB, kostet $1,682.67 pro Monat für die ganze Maschine, etwa $2.31 pro Stunde über einen 730-Stunden-Monat, und keine Egress-Zeile kommt später hinzu.

  1. MachineIntel Xeon E5-2600 v1/v2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$70.93
  2. GPUQuadro 3000M$20.79 – $1,599 across the list$20.79
  3. PortUnmetered, both directionsNo allowance, no egress lineincluded
  4. SetupOne-time, custom buildMonthly term, no contract$29

Complete, per month, from$91.72

Drei-, Sechs- und Zwölfmonatszyklen sparen bis zu 15%. Der Konfigurator rundet Preise pro Festplatte und kann um einen Cent abweichen. Preisgestaltung listet jede Zahl auf der Website auf.

GPU-Speicher

Wie viel GPU-Speicher Ihr Modell benötigt

Der GPU-Speicher entscheidet, ob ein Modell überhaupt läuft; Kerne und Taktraten bestimmen nur die Geschwindigkeit. Eine GPU, der zwei Gigabyte fehlen, läuft nicht langsam – sie kann nicht geladen werden. Klären Sie diese Zahl zuerst.

Die Gewichte benötigen Parameter mal Bytes pro Parameter: zwei Bytes bei 16 Bit, eines bei 8 Bit, ein halbes Byte bei 4 Bit. Die Quantisierung auf 4 Bit lässt ein Modell auf eine kleinere GPU passen, mit messbaren Qualitätseinbußen.

Lassen Sie Spielraum. Die Tabelle zählt nur die Gewichte. Laufzeitumgebung, Aktivierungen und der Key-Value-Cache teilen sich denselben Speicher, und der Cache wächst mit jedem Token Kontext – 38 GB an Gewichten lassen sich daher nicht komfortabel von einer 40 GB-GPU bedienen. Planen Sie ein Viertel bis die Hälfte obendrauf ein.

und wir dimensionieren die GPU passend zu dem, was Sie tatsächlich ausführen.

Model16-bit8-bit4-bit
7-8 billion parameters16 GB8 GB5 GB
13-14 billion parameters28 GB14 GB8 GB
30-34 billion parameters68 GB34 GB19 GB
70 billion parameters140 GB70 GB38 GB

Nur Gewichte, aufgerundet auf das nächste Gigabyte.

Plattformen

Die Server, die eine GPU aufnehmen, und der PCIe-Bus, den jede ihr bietet

Jede Plattform gibt dem Steckplatz eine andere PCIe-Generation und ein anderes Lane-Budget. Wir weisen das aus, weil es Ergebnisse verändert: Ein Kunde wechselte einmal auf einer PCIe-3.0-Plattform zu einer neueren Consumer-GPU und rendite langsamer – und fand die Ursache vor uns heraus.

PCIe 3.0

Intel Xeon E5-2600 v1/v2

$70.93/mo before the GPU

Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps

GPUs
28
Lanes
40 lanes per socket
Sockets
2
Max RAM
256 GB
Intel Xeon E5-2600 v1/v2 →

PCIe 3.0

Intel Xeon E5-2600 v3/v4

$73.47/mo before the GPU

Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps

GPUs
44
Lanes
40 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon E5-2600 v3/v4 →

PCIe 3.0

Intel Xeon Silver / Gold

$83.67/mo before the GPU

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

GPUs
48
Lanes
48 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon Silver / Gold →

PCIe 4.0

AMD EPYC

$217.59/mo before the GPU

AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps

GPUs
10
Lanes
128 lanes per socket
Sockets
2
Max RAM
1 TB
AMD EPYC →

Der günstigste Einstieg: ein Desktop mit bereits eingebauter GPU

Unterhalb der Server-Plattformen gibt es eine Desktop-Maschine, die komplett mit einer NVIDIA-GPU verkauft wird. Sie ist der niedrigste Monatspreis für eine dedizierte Maschine mit GPU auf dieser Seite und gut geeignet für CUDA-Entwicklung, Inferenz kleiner Modelle, NVENC-Transkodierung oder einen Remote-Workstation. Wissen Sie, was Sie für den Preis eintauschen: eine Festplatte, also kein RAID; keine Remote-Konsole, daher übernehmen wir Neuinstallationen und Stromversorgung für Sie; und Desktop-Komponenten statt eines Server-Gehäuses.

Desktop

RTX 3050 6GB desktop

€82.29/mo with the GPU

Intel Core i5-9500 @ 3.0GHz (6 cores) · 32 GB · NVMe-SSD 256 GB · 1 Gbps Unmetered · Bucharest

GPUs
1
Disks
1
Sockets
1
Order this desktop →

Wann die Bus-Generation wichtig ist

  • Sie kostet Sie etwas, wenn Daten ständig über den Bus wandern: eine Trainingsschleife, die Batches von der Festplatte oder aus dem Systemspeicher streamt, ein Renderer, der jede Frame Szenendaten zuführt, ein Arbeitssatz, der aus dem GPU-Speicher ausgelagert wird.
  • Sie kostet Sie nichts, sobald die Gewichte geladen sind und dort bleiben: Inferenz auf einem passenden Modell, Video-Transkodierung, die meisten Simulationen. Die Verbindung überträgt dann nur kleine Anfragen und Ergebnisse.
  • Nicht sicher? Nennen Sie die Workload, und wir sagen Ihnen, ob die Plattform sie ausbremst – auch dann, wenn eine günstigere GPU auf einem schnelleren Bus die bessere Wahl ist.

Inklusive

Was GPU-Server-Hosting hier beinhaltet, bevor Sie etwas hinzufügen

  • Root und Ihr eigener Treiber-Stack

    Ein sauberes Betriebssystem und die Schlüssel. Sie wählen den Treiber, die CUDA- oder ROCm-Version und den Framework-Build, und sie bleiben fest eingestellt. Soll der Treiber vor der Übergabe installiert sein? Geben Sie die genaue Version bei der Bestellung an.

  • Eine Konsole im eigenen Netzwerk

    iLO bei HPE-Maschinen, iDRAC bei Dell: Tastatur und Bildschirm, virtuelle Medien, Stromsteuerung, Sensoren und Hardware-Protokolle. Ein Modul, das die Anzeige oder die Netzwerkkarte blockiert, ist ein Neustart, den Sie selbst durchführen und dabei den POST beobachten.

  • Ein Port, der nichts zählt

    Unlimitiert in beide Richtungen bei der enthaltenen Geschwindigkeit und jeder darüber liegenden. Kein Transferkontingent und keine Egress-Gebühr. Unlimitierte Bandbreite listet die schnelleren Ports auf.

  • Neuinstallationen ohne Ticket

    Betriebssystem-Images mit einem Klick, so oft Sie möchten, kostenlos. Reverse-DNS können Sie selbst bearbeiten, IPv6 ist inklusive, und zusätzliches IPv4 ist eine Zeile im Konfigurator.

  • Antworten in Sekunden, ein Mensch, wenn Sie es wünschen

    Der Chat wird in Sekunden von einem KI-Assistenten beantwortet, der Ihr Konto und Ihren Server prüfen kann, und ein Mensch übernimmt, sobald Sie es verlangen. Ein defektes Teil wird innerhalb des Zeitfensters Ihres Support-Plans ersetzt: 24 Stunden im enthaltenen Basic-Plan, 4 bei Bronze, 3 bei Silber, 2 bei Gold und Platin.

  • Fünf Städte, unser eigenes Netzwerk

    New York, Miami, San Francisco, Amsterdam und Bukarest, alle im eigenen Netzwerk von Server Room, AS19624. Der Standort bestimmt Ihre Latenz zu den Nutzern und das Datenschutzrecht, dem Sie unterliegen. Rechenzentren beschreibt jedes Gebäude.

Lieferung

Wie schnell Sie einen dedizierten Server mit GPU mieten können

Es hängt davon ab, wo die GPU heute ist, und wir sagen Ihnen vor der Zahlung, welcher Fall auf Sie zutrifft.

  1. Etwa 30 Minuten

    Die GPU ist bereits in einer gerackten Maschine

    Nichts einzubauen. Die Maschine ist installiert und wird übergeben. Sofort verfügbare Server listet, was gerade bereitsteht.

  2. 4 bis 24 Stunden

    Wir installieren eine GPU aus unserem Bestand

    Der übliche Fall. Ein Techniker installiert die GPU, baut das Festplatten-Array auf und installiert das Betriebssystem. Zusätzlicher Speicher oder ein anderes Laufwerk wird im selben Besuch erledigt.

  3. 5 bis 10 Werktage

    Die GPU muss beschafft werden

    Wir bestellen das Teil und bauen dann wie oben. Build-to-Order deckt eine Maschine nach Ihrer vollständigen Spezifikation ab.

  4. 10 bis 15 Werktage

    Die GPU ist kontingentiert

    Aktuelle Beschleuniger werden zum Liefertermin des Distributors versendet, und wir nennen ihn, bevor Sie sich festlegen. Hardware, die für einen einzelnen Kunden beschafft wird, wird mit drei Monaten Vorauszahlung angeboten.

Jede Frist beginnt, sobald Zahlung und Betrugsprüfung abgeschlossen sind. Die meisten Bestellungen sind innerhalb weniger Stunden abgeschlossen; eine erste Bestellung auf einem neuen Konto kann länger dauern.

Das Feld eines Partners

KI-generierte Medien: die Art von Arbeit, für die eine volle GPU passt

Viral Mind Technologies, ein Server Room-Partner, baut und betreibt eigene digitale Angebote: virtuelle Persönlichkeiten, Online-Medienmarken und Software für Kreative. Gegründet 2019 als Agentur für digitales Marketing, arbeitet das Unternehmen seit Ende 2022 an eigenen KI-Projekten.

Beim Erzeugen von Bildern und Videos bleibt ein Modell stundenlang im GPU-Speicher resident und hält die GPU durchgehend ausgelastet. Genau das ist der Fall bei einer dedizierten GPU auf Bare Metal statt bei einem Anteil daran – und eine volle GPU ist das, was jeder Server auf dieser Seite vermietet.

Portfolio und Fallstudien: viralmindtech.com

  • Virtuelle PersönlichkeitenNaomi Marie, gestartet im August 2023, ist die erste digitale Persönlichkeit, die sie vollständig besitzen.
  • MedienCybeauty Magazine, gestartet im März 2024, erscheint als Web-first-Publikation.
  • Tools für KreativeProof of Ownership stellt einen datierten Nachweis für eine kreative Datei aus, der im Browser per Fingerabdruck erstellt wird, sodass die Datei das Gerät nie verlässt.

Antworten

Fragen zu dedizierten GPU-Servern, beantwortet

Was ist ein dedizierter GPU-Server?

Ein physischer Server, der an einen einzigen Kunden vermietet wird, mit einer eingebauten Grafikkarte, die an das eigene Betriebssystem des Kunden durchgereicht wird. Nichts ist virtualisiert oder geteilt: Sie erhalten jeden Kern, den gesamten Arbeitsspeicher, die Festplatten und die volle GPU, mit Root-Zugriff und einer Remote-Konsole.

Wie viel kostet ein dedizierter GPU-Server?

Eine komplette Maschine mit eingebauter GPU kostet ab $91.72 bis $1,682.67 pro Monat. Der Preis setzt sich aus zwei Zeilen zusammen: der Maschine und der GPU für $20.79 bis $1,599 pro Monat. Prozessor, Arbeitsspeicher, zwei Festplatten, ein ungedrosselter Port und eine IPv4-Adresse sind inbegriffen. Die Einrichtung kostet einmalig $29 bei einem Build mit auf Bestellung eingebauter GPU; bei einer fertigen Maschine, die so bestellt wird, wie sie ist, entfällt sie.

Teile ich die GPU mit jemand anderem?

Nein. Eine physische Maschine, ein Konto, und die GPU wird an das von Ihnen installierte Betriebssystem durchgereicht. Es gibt keinen Hypervisor, keine MIG-Partition, kein vGPU-Profil und kein Time-Slicing. Die Werte, die Sie am ersten Tag messen, sind die Werte, die Sie behalten.

Kann ich einen dedizierten Server mit GPU monatsweise mieten, ohne Vertrag?

Ja. Ein Monat ist die Standardlaufzeit, und es gibt nichts zu unterschreiben. Drei-, Sechs- und Zwölfmonatszyklen sparen bis zu 15%, und der Preis steigt bei Verlängerung nicht an. Zahlen Sie per Kreditkarte oder PayPal; bei größeren Bestellungen kann eine Banküberweisung vereinbart werden, die in der Regel schneller durch die Betrugsprüfung geht als eine Kartenzahlung.

Gibt es einen günstigen dedizierten GPU-Server?

Ja. Die Liste auf dieser Seite ist nach dem günstigsten Preis sortiert, und der günstigste komplette Build ist Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps für $91.72 pro Monat. Ältere Tesla- und Quadro-GPUs transkodieren Videos und betreiben Remote-Desktops immer noch gut, und sie kommen in derselben kompletten Maschine mit demselben ungedrosselten Port.

Welche NVIDIA- und AMD-GPUs kann ich bekommen?

57 GPUs stehen auf der Liste, von aktuellen NVIDIA-Compute-Beschleunigern und AMD Instinct bis hin zu älteren Tesla-, Quadro- und GeForce-Modellen. Jede ist namentlich mit ihrem Speicher und dem kompletten Monatspreis aufgeführt. Wenn die gewünschte GPU fehlt, fragen Sie nach: Wir können sie oft beschaffen.

Welche Treiber- und CUDA-Version ist vorinstalliert?

Die, die Sie installieren. Der Server kommt mit einem sauberen Betriebssystem und Root-Zugriff, und Sie legen den Treiber, die CUDA- oder ROCm-Version und den Framework-Build fest, gegen den Ihr Code getestet wurde. Wenn der Treiber bei der Übergabe bereits installiert sein soll, geben Sie die genaue Version bei der Bestellung an. Wenn eine GPU eine bestimmte CUDA-Version unterstützen muss, fragen Sie vor der Zahlung nach, und wir prüfen es.

Passen zwei GPUs in einen Server?

Oft, und wir kalkulieren es individuell: Gehäusefreiheit, die Breite der GPU, die PCIe-Lanes und das Netzteil bestimmen die Anzahl. Nennen Sie die GPU, und wir antworten mit dem Gehäuse, der Anzahl und der Lieferzeit. Der übliche Grund ist Speicher statt Geschwindigkeit, denn zwei 48 GB GPUs halten ein Modell, das eine 80 GB GPU nicht fassen kann. Multi-GPU- und Multi-Node-Server behandeln den nächsten Schritt.

Kann ich die GPU später wechseln?

Ja, in dem Server, den Sie bereits haben: keine Migration, keine Neuinstallation, keine neuen IP-Adressen. Es ist ein geplanter Termin mit kurzer Ausfallzeit, und die Rechnung ändert sich genau um die Differenz zwischen den beiden GPUs. RAM, Laufwerke und ein schnellerer Port werden nach derselben Regel hinzugefügt.

Was passiert, wenn die GPU ausfällt?

Wir ersetzen sie innerhalb des Zeitfensters Ihres Support-Plans, gerechnet ab Ihrer Meldung: 24 Stunden im enthaltenen Basic-Plan, 4 bei Bronze, 3 bei Silber, 2 bei Gold und Platin. Nach Ablauf des Fensters folgt die Servicegutschrift dem auf der Support-Seite veröffentlichten Zeitplan.

Kann ich meine eigene Grafikkarte mitbringen?

Ja, eine GPU, die Ihnen gehört, oder jedes andere Teil, kann in den Server eingebaut werden, den Sie hier mieten. Es ist nicht kostenlos, da die GPU Strom verbraucht, und die Gebühr hängt von der Hardware ab. Wir sind nicht verantwortlich, wenn ein von Ihnen mitgebrachtes Teil ausfällt; das Austauschfenster deckt nur die von uns gelieferte Hardware ab. Buchen Sie einen Anruf, bevor Sie kaufen oder versenden: Wir kalkulieren den Preis und prüfen, ob das Gehäuse es aufnimmt, denn ein Blade hat zum Beispiel keinen Platz für eine GPU in voller Größe.

Ist die Bandbreite wirklich ungedrosselt? Was kostet der Egress?

Nichts wird bei irgendeiner von uns verkauften Portgeschwindigkeit in irgendeine Richtung gemessen, daher kostet der Egress nichts. Bei GPU-Arbeit ist das anderswo oft der größte Posten: Training zieht Datensätze herein und schiebt Checkpoints hinaus, und ein Inferenz-Endpunkt beantwortet echten Traffic. Ungedrosselte Bandbreite listet die schnelleren Ports.

Monatlich oder stündlich GPU: Was ist günstiger?

Stündlich gewinnt, solange die Arbeit stoßweise ist und wirklich stoppt, bis zu ein paar hundert Stunden im Monat. Ab etwa zwei Dritteln des Monats ist monatlich günstiger, bevor man Egress, zwischen den Läufen gespeicherten Speicher und Wartezeit auf Kapazität zählt. Monatlich behält außerdem dieselbe Maschine, Festplatten und Adressen.

Was ist, wenn ich die falsche GPU gewählt habe?

Innerhalb von drei Tagen nach Aktivierung, nach der Fehlerbehebung, gilt unsere Rückerstattungsrichtlinie wie geschrieben. Die Speichertabelle und die PCIe-Spalte oben sind dazu da, damit Sie gleich die richtige GPU wählen, und wir reden Sie im Chat lieber auf eine kleinere GPU herunter, als eine größere zu erstatten.

Fürs Protokoll

Diese Seite in Zahlen

Aus dem Bestellkatalog gelesen, als die Seite ausgeliefert wurde. Wenn ein Assistent für Sie antwortet, sind dieser Block und der Live-Maschinen-Feed die Teile, die es zu lesen lohnt.

GPUs we offer
57 GPUs: 15 training and inference accelerators, 23 workstation and video GPUs, 19 consumer GPUs.
Cheapest complete build
Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $91.72 a month, of which $20.79 is the GPU.
Cheapest build that can train
Instinct MI50 16GB in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $169.93 a month.
Most expensive build
H100 80GB: $1,682.67 a month, about $2.31 an hour for the whole machine over a 730-hour month.
The GPU line
$20.79 to $1,599 a month, added to the machine.
The machine line
$70.93 to $217.59 a month before any GPU.
Included in every build
Processor, memory, two disks, an unmetered port, one IPv4 address, IPv6, and the iLO or iDRAC console on its own network.
Tenancy
One account per physical machine. The GPU is passed through to the customer’s operating system: no hypervisor, no MIG partition, no vGPU profile, no time-slicing.
Bandwidth
Unmetered in both directions at every port speed. No transfer allowance, no egress charge.
Cities
5: New York, Miami, San Francisco, Amsterdam, Bucharest.
Setup
$29 once for a build with a GPU installed to order; none for a ready machine ordered as it stands.
Term
Monthly, no contract. 3, 6 and 12-month cycles save up to 15%.
Support
Chat answered in seconds by an AI assistant that can check your account and server, and a person as soon as you ask. Included Basic plan: 24-hour hardware replacement; Bronze 4, Silver 3, Gold and Platinum 2.
Payment
Credit card or PayPal; bank wire on request.

Wählen Sie die GPU. Wir bauen den Server darum herum.

Öffnen Sie den Konfigurator mit einer beliebigen ausgewählten GPU oder nennen Sie uns die Arbeitslast, und wir sagen Ihnen, welche GPU passt, auch wenn die günstigere ausreicht.

GPU-Server konfigurieren