Servere dedicate GPU · bare metal · lunar

Servere dedicate GPU. GPU-ul întreg. Fără nimeni altcineva pe el.

Un server dedicat GPU este o mașină fizică închiriată unui singur cont pe lună, cu GPU-ul trecut direct către propriul tău sistem de operare. Fără hypervisor, fără felie de vGPU, fără vecin pe siliciu.

  • Passthrough PCIe
  • Port nemăsurat
  • 5 orașe
  • Fără contract

Alege GPU-ul după sarcină și memoria de care are nevoie. Fiecare rând din listă este un server complet cu acel GPU instalat, prețuit din același catalog din care facturează checkout-ul, iar partea GPU-ului propriu-zis este tipărită sub total.

Catalogul

Servere GPU NVIDIA și AMD, fiecare prețuit ca mașină completă

Spune pentru ce este GPU-ul și memoria minimă de care are nevoie. Lista se restrânge pe măsură ce avansezi, cele mai ieftine întâi. Fiecare rând deschide mașina care acceptă acel GPU în configurator.

1. Pentru ce este GPU-ul?

2. Câtă memorie GPU, cel puțin?

oricare GB sau mai mult

Greutăți de model la 4 biți, pentru scară

  • 5 GB7-8B @ 4-bit
  • 8 GB13-14B @ 4-bit
  • 19 GB30-34B @ 4-bit
  • 38 GB70B @ 4-bit

  1. Quadro 3000M2 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 240 CUDA cores$91.72/moGPU $20.79
  2. Quadro K3100M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 768 CUDA cores$102.52/moGPU $31.59
  3. Quadro M3000M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,280 CUDA cores$109.12/moGPU $38.19
  4. TESLA M68 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,536 CUDA cores$113.42/moGPU $42.49
  5. TESLA M608 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$119.42/moGPU $48.49
  6. GTX 1070M8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$124.32/moGPU $53.39
  7. GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99/moGPU $55.06
  8. GTX 10708 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,920 CUDA cores$135.22/moGPU $64.29
  9. GTX 1070 Ti8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,432 CUDA cores$146.22/moGPU $75.29
  10. GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93/moGPU $79
  11. TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  12. TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  13. RTX 20708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,304 CUDA cores$159.93/moGPU $89
  14. TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93/moGPU $99
  15. Instinct MI50 16GB16 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$169.93/moGPU $99
  16. RTX 2070 Super8 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$172.47/moGPU $99
  17. Quadro RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47/moGPU $99
  18. Instinct MI5016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$172.47/moGPU $99
  19. TESLA M602 x 8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,096 CUDA cores$178.82/moGPU $107.89
  20. RTX 20808 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,994 CUDA cores$189.93/moGPU $119
  21. Quadro RTX 500016 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$189.93/moGPU $119
  22. RTX 2080 Super8 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$199.93/moGPU $129
  23. TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92/moGPU $129.99
  24. RTX A20006 or 12 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,328 CUDA cores$202.47/moGPU $129
  25. RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93/moGPU $139
  26. TESLA P10016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,584 CUDA cores$212.47/moGPU $139
  27. Quadro P500016 GB GDDR5XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$214.06/moGPU $140.59
  28. RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93/moGPU $149
  29. RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  30. RTX A400016 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  31. RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93/moGPU $159
  32. TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93/moGPU $189
  33. CMP 170HX 64GB HBM2e8 GB HBM2e, 64 GB unlockedIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$259.93/moGPU $189
  34. RTX 407012 GB GDDR6XIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 5,888 CUDA cores$262.67/moGPU $179
  35. RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47/moGPU $199
  36. Tenstorrent Blackhole p100a28 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$272.47/moGPU $199
  37. L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67/moGPU $209
  38. RTX A500024 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 8,192 CUDA cores$302.47/moGPU $229
  39. Tesla V100 32GB32 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 5,120 CUDA cores$302.47/moGPU $229
  40. RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93/moGPU $239
  41. RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67/moGPU $229
  42. Quadro P600024 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$320.52/moGPU $249.59
  43. RTX 4500 Ada Generation24 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 7,680 CUDA cores$332.67/moGPU $249
  44. RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47/moGPU $299
  45. Quadro RTX 600024 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$372.47/moGPU $299
  46. RTX PRO 4000–Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$372.47/moGPU $299
  47. Quadro RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47/moGPU $399
  48. RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47/moGPU $399
  49. L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67/moGPU $449
  50. A4048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$572.47/moGPU $499
  51. Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67/moGPU $499
  52. RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47/moGPU $549
  53. RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47/moGPU $625
  54. A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47/moGPU $699
  55. A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47/moGPU $899
  56. RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67/moGPU $1,299
  57. H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67/moGPU $1,599

Prețurile sunt cifrele proprii ale checkout-ului. Un GPU al cărui producător nu publică nicio cifră de memorie arată o liniuță și dispare din listă odată ce controlul de memorie se mută de la „oricare”. Unele GPU-uri se potrivesc în mai mult de un șasiu: rândul arată cel mai ieftin, configuratorul arată restul.

Ocupare

Găzduire server dedicat GPU: GPU-ul întreg este al tău

GPU-ul stă într-un slot PCIe fizic dintr-o mașină închiriată unui singur cont. Instalezi sistemul de operare, încarci modulul de kernel și fixezi driverul, versiunea CUDA sau ROCm pe care a fost testat codul tău. Nimic nu îl actualizează pe sub tine.

Mașina urmează aceeași regulă: fiecare nucleu, toată memoria, ambele discuri, root-ul și consola iLO sau iDRAC proprie a serverului pe o rețea de management separată. Dacă un experiment de driver dă jos rețeaua, tot ai ecranul, media virtuală și controlul de alimentare.

  • Fără felieFără partiție MIG, fără profil vGPU, fără cotă fracționară. Un GPU, un sistem de operare.
  • Fără coadăNiciun planificator nu stă deasupra ta. Când procesul tău este inactiv, GPU-ul este inactiv și tot al tău.
  • Fără hypervisorBare metal. Latența pe care o măsori în prima zi este latența pe care o ai la 4 dimineața.
  • Fără contorSeturi de date înăuntru, checkpoint-uri și randări afară. Nimic de pe port nu numără octeții.

Cum funcționează prețul

Două linii care se adună: mașina și GPU-ul

Majoritatea furnizorilor vând un GPU ca pe un nivel, cu procesorul, memoria, discurile și rețeaua prețuite în jurul lui. Aici mașina este o linie lunară, iar GPU-ul este alta. Schimbă GPU-ul mai târziu și factura se mișcă exact cu diferența dintre cele două GPU-uri.

Cauți un server dedicat GPU ieftin?

Începe din vârful listei. Am păstrat GPU-uri mai vechi care încă fac treabă reală, cum ar fi piesele Tesla și Quadro care transcodifică video sau conduc desktop-uri la distanță, și stau în aceeași mașină întreagă cu același port nemăsurat ca cel mai nou GPU. De ce păstrăm hardware mai vechi explică compromisul.

Compari cu nori GPU pe oră? Cea mai scumpă configurație de pe listă, H100 80GB, este $1,682.67 pe lună pentru întreaga mașină, aproximativ $2.31 pe oră într-o lună de 730 de ore, și nicio linie de egress nu sosește mai târziu.

  1. MachineIntel Xeon E5-2600 v1/v2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$70.93
  2. GPUQuadro 3000M$20.79 – $1,599 across the list$20.79
  3. PortUnmetered, both directionsNo allowance, no egress lineincluded
  4. SetupOne-time, custom buildMonthly term, no contract$29

Complete, per month, from$91.72

Ciclurile de trei, șase și douăsprezece luni economisesc până la 15%. Configuratorul rotunjește prețurile pe disc și poate să iasă cu un cent diferit. Prețuri listează fiecare cifră de pe site.

Memorie GPU

Câtă memorie GPU are nevoie modelul tău

Memoria GPU decide dacă un model rulează deloc; nucleele și frecvențele decid doar cât de repede. Un GPU cu doi gigaocteți mai puțin nu rulează lent, ci nu se încarcă deloc. Stabilește mai întâi acest număr.

Ponderile ocupă parametri înmulțiți cu octeți per parametru: doi octeți la 16 biți, unul la 8 biți, jumătate de octet la 4 biți. Cuantizarea la 4 biți permite unui model să încapă pe un GPU mai mic, cu un cost măsurabil în calitate.

Lasă spațiu de rezervă. Tabelul ia în calcul doar ponderile. Runtime-ul, activările și cache-ul cheie-valoare împart aceeași memorie, iar cache-ul crește cu fiecare token de context, așa că 38 GB de ponderi nu vor fi serviți confortabil de pe un GPU de 40 GB. Adaugă un sfert până la jumătate peste.

și dimensionăm GPU-ul în funcție de ce rulezi efectiv.

Model16-bit8-bit4-bit
7-8 billion parameters16 GB8 GB5 GB
13-14 billion parameters28 GB14 GB8 GB
30-34 billion parameters68 GB34 GB19 GB
70 billion parameters140 GB70 GB38 GB

Doar ponderile, rotunjite în sus la următorul gigaoctet.

Platforme

Servere care acceptă un GPU și magistrala PCIe pe care fiecare i-o oferă

Fiecare platformă oferă slotului o generație PCIe și un buget de linii diferit. Le publicăm pentru că schimbă rezultatele: un client a trecut odată la un GPU de consum mai nou pe o platformă PCIe 3.0 și a randat mai lent, și și-a dat seama de ce înaintea noastră.

PCIe 3.0

Intel Xeon E5-2600 v1/v2

$70.93/mo before the GPU

Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps

GPUs
28
Lanes
40 lanes per socket
Sockets
2
Max RAM
256 GB
Intel Xeon E5-2600 v1/v2 →

PCIe 3.0

Intel Xeon E5-2600 v3/v4

$73.47/mo before the GPU

Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps

GPUs
44
Lanes
40 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon E5-2600 v3/v4 →

PCIe 3.0

Intel Xeon Silver / Gold

$83.67/mo before the GPU

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

GPUs
48
Lanes
48 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon Silver / Gold →

PCIe 4.0

AMD EPYC

$217.59/mo before the GPU

AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps

GPUs
10
Lanes
128 lanes per socket
Sockets
2
Max RAM
1 TB
AMD EPYC →

Când contează generația magistralei

  • Te costă când datele traversează magistrala tot timpul: o buclă de antrenare care aduce loturi de pe disc sau din memoria de sistem, un renderer care alimentează datele scenei la fiecare cadru, un set de lucru care depășește memoria GPU.
  • Nu te costă nimic odată ce ponderile sunt încărcate și rămân acolo: inferență pe un model care încape, transcodare video, majoritatea simulărilor. Legătura transportă atunci doar cereri mici și rezultate.
  • Nu ești sigur? Numește sarcina de lucru și îți vom spune dacă platforma o limitează, inclusiv când un GPU mai ieftin pe o magistrală mai rapidă este alegerea mai bună.

Incluse

Ce include găzduirea de servere GPU aici, înainte să adaugi ceva

  • Root și propriul tău set de drivere

    Un sistem de operare curat și cheile. Tu alegi driverul, versiunea CUDA sau ROCm și build-ul framework-ului, iar ele rămân fixate. Vrei driverul instalat înainte de predare? Pune versiunea exactă în comandă.

  • O consolă pe propria rețea

    iLO pe mașinile HPE, iDRAC pe Dell: tastatură și ecran, medii virtuale, control al alimentării, senzori și jurnale hardware. Un modul care blochează afișajul sau placa de rețea este o repornire pe care o faci singur, urmărind POST-ul.

  • Un port pe care nimic nu se contorizează

    Nemăsurat în ambele direcții la viteza inclusă și la orice viteză peste ea. Fără limită de transfer și fără linie de egress. Lățime de bandă nemăsurată listează porturile mai rapide.

  • Reinstalări fără tichet

    Imagini de sistem de operare într-un singur clic, oricât de des dorești, fără costuri. DNS-ul invers este al tău de editat, IPv6 este inclus, iar IPv4 suplimentar este o linie în configurator.

  • Răspunsuri în secunde, o persoană când ceri

    Chat-ul primește răspuns în secunde de la un asistent AI care îți poate verifica contul și serverul, iar o persoană preia imediat ce ceri. O piesă defectă este înlocuită în fereastra planului tău de suport: 24 de ore pe planul Basic inclus, 4 pe Bronze, 3 pe Silver, 2 pe Gold și Platinum.

  • Cinci orașe, propria noastră rețea

    New York, Miami, San Francisco, Amsterdam și București, toate pe rețeaua proprie a Server Room, AS19624. Locația stabilește latența ta față de utilizatori și legea privind protecția datelor căreia i te supui. Centrele de date descrie fiecare clădire.

Livrare

Cât de repede poți închiria un server dedicat cu GPU

Depinde de unde se află GPU-ul astăzi, iar noi îți spunem în ce caz te afli înainte să plătești.

  1. Aproximativ 30 de minute

    GPU-ul este deja într-o mașină montată în rack

    Nimic de montat. Mașina este instalată și predată. Servere instant listează ce este disponibil chiar acum.

  2. 4 până la 24 de ore

    Instalăm un GPU din stocul nostru

    Cazul obișnuit. Un tehnician instalează GPU-ul, construiește matricea de discuri și instalează sistemul de operare. Memorie suplimentară sau un alt disc se face în aceeași vizită.

  3. 5 până la 10 zile lucrătoare

    GPU-ul trebuie achiziționat

    Comandăm piesa, apoi construim ca mai sus. Construire la comandă acoperă o mașină conform întregii tale specificații.

  4. 10 până la 15 zile lucrătoare

    GPU-ul este pe alocare

    Acceleratoarele actuale se livrează la data distribuitorului, iar noi o numim înainte să te angajezi. Hardware-ul achiziționat pentru un singur client este cotat cu trei luni plătite în avans.

Fiecare termen începe după ce plata și verificarea antifraudă sunt finalizate. Majoritatea comenzilor se finalizează în câteva ore; o primă comandă pe un cont nou poate dura mai mult.

Domeniul unui partener

Media generate de AI: genul de lucru pentru care se potrivește un GPU complet

Viral Mind Technologies, partener Server Room, își construiește și își administrează propriile proprietăți digitale: personalități virtuale, branduri media online și software pentru creatori. A pornit în 2019 ca agenție de marketing digital și lucrează la propriile proiecte AI de la sfârșitul lui 2022.

Generarea de imagini și clipuri video menține un model rezident în memoria GPU și ține GPU-ul ocupat ore întregi. Acesta este cazul pentru un GPU dedicat pe bare metal, nu pentru o felie dintr-unul, iar un GPU complet este ceea ce închiriază fiecare server de pe această pagină.

Portofoliul și studiile lor de caz: viralmindtech.com

  • Personalități virtualeNaomi Marie, lansată în august 2023, este prima personalitate digitală pe care o dețin integral.
  • MediaCybeauty Magazine, lansată în martie 2024, funcționează ca publicație web-first.
  • Unelte pentru creatoriProof of Ownership emite o înregistrare datată pentru un fișier creativ, amprentat în browser astfel încât fișierul nu părăsește niciodată dispozitivul.

Răspunsuri

Întrebări despre serverele dedicate GPU, cu răspunsuri

Ce este un server GPU dedicat?

Un server fizic închiriat unui singur client, cu o placă grafică instalată și pasată către sistemul de operare propriu al clientului. Nimic nu este virtualizat sau partajat: primești fiecare nucleu, toată memoria, discurile și GPU-ul complet, cu acces root și o consolă la distanță.

Cât costă un server dedicat GPU?

O mașină completă cu GPU instalat pornește de la $91.72 până la $1,682.67 pe lună. Prețul este suma a două linii: mașina și GPU-ul la $20.79 până la $1,599 pe lună. Procesorul, memoria, două discuri, un port nemăsurat și o adresă IPv4 sunt incluse. Configurarea este o taxă unică de $29 pentru o configurație cu GPU instalat la comandă; o mașină gata, comandată așa cum este, nu are nicio taxă.

Partajez GPU-ul cu altcineva?

Nu. O singură mașină fizică, un singur cont, iar GPU-ul este pasat către sistemul de operare pe care l-ai instalat. Nu există hypervisor, partiție MIG, profil vGPU sau partajare în timp. Cifrele pe care le testezi în prima zi sunt cifrele pe care le păstrezi.

Pot închiria un server dedicat cu GPU lunar, fără contract?

Da. O lună este termenul implicit și nu ai nimic de semnat. Ciclurile de trei, șase și douăsprezece luni economisesc până la 15%, iar prețul nu crește la reînnoire. Plătești cu card de credit sau PayPal; pentru o comandă mai mare se poate aranja un transfer bancar, care de obicei trece mai repede de verificarea antifraudă decât o plată cu cardul.

Există un server dedicat GPU ieftin?

Da. Lista de pe această pagină este sortată cu cel mai ieftin primul, iar cea mai ieftină configurație completă este Quadro 3000M în Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps la $91.72 pe lună. GPU-urile Tesla și Quadro mai vechi încă transcodifică video și rulează bine desktopuri la distanță, și vin în aceeași mașină completă cu același port nemăsurat.

Ce GPU-uri NVIDIA și AMD pot obține?

57 GPU-uri sunt pe listă, de la acceleratoare de calcul NVIDIA actuale și AMD Instinct până la modele mai vechi Tesla, Quadro și GeForce. Fiecare este listat pe nume cu memoria sa și prețul lunar complet. Dacă GPU-ul dorit lipsește, întreabă: îl putem adesea achiziționa.

Ce versiune de driver și CUDA vine instalată?

Cele pe care le instalezi tu. Serverul ajunge cu un sistem de operare curat și acces root, iar tu fixezi driverul, versiunea CUDA sau ROCm și build-ul framework-ului pe care a fost testat codul tău. Dacă vrei driverul instalat la predare, pune versiunea exactă în comandă. Dacă un GPU trebuie să suporte o anumită versiune CUDA, întreabă înainte de plată și vom verifica.

Încap două GPU-uri într-un singur server?

Adesea da, și oferim un preț manual: spațiul din carcasă, lățimea GPU-ului, liniile PCIe și sursa de alimentare decid numărul. Spune-ne GPU-ul și răspundem cu carcasa, numărul și timpul de livrare. Motivul obișnuit este memoria mai degrabă decât viteza, deoarece două GPU-uri de 48 GB pot ține un model pe care un GPU de 80 GB nu îl poate. Servere multi-GPU și multi-nod acoperă pasul următor.

Pot schimba GPU-ul mai târziu?

Da, în serverul pe care îl ai deja: fără migrare, fără reinstalare, fără adrese IP noi. Este o vizită programată cu o scurtă întrerupere, iar factura se modifică exact cu diferența dintre cele două GPU-uri. RAM, discurile și un port mai rapid se adaugă după aceeași regulă.

Ce se întâmplă dacă GPU-ul se defectează?

Îl înlocuim în fereastra planului tău de suport, socotită din momentul raportării: 24 de ore la planul Basic inclus, 4 la Bronze, 3 la Silver, 2 la Gold și Platinum. După fereastră, creditul de serviciu urmează programul publicat pe pagina de suport.

Pot aduce propria placă grafică?

Da, un GPU pe care îl deții, sau orice altă componentă, poate intra în serverul pe care îl închiriezi aici. Nu este gratuit, deoarece GPU-ul consumă energie, iar taxa depinde de hardware. Nu suntem responsabili dacă o componentă adusă de tine se defectează; fereastra de înlocuire acoperă doar hardware-ul furnizat de noi. Programează o discuție înainte să cumperi sau să o expediezi: îți spunem prețul și verificăm dacă încape în carcasă, pentru că un blade, de exemplu, nu are loc pentru un GPU de dimensiune completă.

Lățimea de bandă este într-adevăr nemăsurată? Cât costă traficul de ieșire?

Nimic nu este măsurat în nicio direcție la nicio viteză de port pe care o vindem, deci traficul de ieșire nu costă nimic. La lucrul cu GPU, aceasta este adesea cea mai mare linie în altă parte: antrenarea trage seturi de date înăuntru și împinge puncte de control afară, iar un endpoint de inferență răspunde la trafic real. Lățime de bandă nemăsurată listează porturile mai rapide.

GPU lunar sau orar: care este mai ieftin?

Orar câștigă cât timp lucrul este intermitent și chiar se oprește, până la câteva sute de ore pe lună. După aproximativ două treimi din lună, lunar este mai ieftin înainte să socotești traficul de ieșire, stocarea păstrată între rulări și timpul petrecut așteptând capacitate. Lunar păstrează, de asemenea, aceeași mașină, discuri și adrese.

Ce se întâmplă dacă am ales GPU-ul greșit?

În termen de trei zile de la activare, după depanare, se aplică politica noastră de rambursare așa cum este scrisă. Tabelul de memorie și coloana PCIe de mai sus există ca să poți alege corect GPU-ul din prima, și preferăm să te sfătuim în chat către un GPU mai mic decât să rambursăm unul mai mare.

Pentru evidență

Această pagină în cifre

Citite din catalogul de comenzi când a fost servită pagina. Dacă un asistent răspunde pentru tine, acest bloc și fluxul live al mașinilor sunt părțile care merită citite.

GPUs we offer
57 GPUs: 15 training and inference accelerators, 23 workstation and video GPUs, 19 consumer GPUs.
Cheapest complete build
Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $91.72 a month, of which $20.79 is the GPU.
Cheapest build that can train
Instinct MI50 16GB in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $169.93 a month.
Most expensive build
H100 80GB: $1,682.67 a month, about $2.31 an hour for the whole machine over a 730-hour month.
The GPU line
$20.79 to $1,599 a month, added to the machine.
The machine line
$70.93 to $217.59 a month before any GPU.
Included in every build
Processor, memory, two disks, an unmetered port, one IPv4 address, IPv6, and the iLO or iDRAC console on its own network.
Tenancy
One account per physical machine. The GPU is passed through to the customer’s operating system: no hypervisor, no MIG partition, no vGPU profile, no time-slicing.
Bandwidth
Unmetered in both directions at every port speed. No transfer allowance, no egress charge.
Cities
5: New York, Miami, San Francisco, Amsterdam, Bucharest.
Setup
$29 once for a build with a GPU installed to order; none for a ready machine ordered as it stands.
Term
Monthly, no contract. 3, 6 and 12-month cycles save up to 15%.
Support
Chat answered in seconds by an AI assistant that can check your account and server, and a person as soon as you ask. Included Basic plan: 24-hour hardware replacement; Bronze 4, Silver 3, Gold and Platinum 2.
Payment
Credit card or PayPal; bank wire on request.

Alege GPU-ul. Noi construim serverul în jurul lui.

Deschide configuratorul cu orice GPU selectat, sau spune-ne sarcina de lucru și îți vom spune ce GPU se potrivește, inclusiv când cel mai ieftin este suficient.

Configurează un server GPU