Server dedicati con GPU · bare metal · mensili

Server dedicati con GPU. La GPU completa. Nessun altro sopra.

Un server dedicato con GPU è una macchina fisica affittata a un singolo account con canone mensile, con la GPU passata direttamente al tuo sistema operativo. Nessun hypervisor, nessuna porzione di vGPU, nessun vicino sul silicio.

  • Passthrough PCIe
  • Porta senza limiti
  • 5 città
  • Nessun contratto

Scegli la GPU in base al lavoro e alla memoria che richiede. Ogni riga dell'elenco è un server completo con quella GPU installata, prezzato dallo stesso catalogo usato dal checkout per la fatturazione, e la quota della GPU è indicata sotto il totale.

Il catalogo

Server GPU NVIDIA e AMD, ciascuno prezzato come macchina completa

Indica a cosa serve la GPU e la memoria minima richiesta. L'elenco si restringe man mano, dal più economico. Ogni riga apre la macchina che ospita quella GPU nel configuratore.

1. A cosa serve la GPU?

2. Quanta memoria GPU, come minimo?

qualsiasi GB o più

Pesi del modello a 4 bit, per riferimento

  • 5 GB7-8B @ 4-bit
  • 8 GB13-14B @ 4-bit
  • 19 GB30-34B @ 4-bit
  • 38 GB70B @ 4-bit

  1. Quadro 3000M2 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 240 CUDA cores$91.72/moGPU $20.79
  2. Quadro K3100M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 768 CUDA cores$102.52/moGPU $31.59
  3. Quadro M3000M4 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,280 CUDA cores$109.12/moGPU $38.19
  4. TESLA M68 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,536 CUDA cores$113.42/moGPU $42.49
  5. TESLA M608 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$119.42/moGPU $48.49
  6. GTX 1070M8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,048 CUDA cores$124.32/moGPU $53.39
  7. GTX 10808 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$125.99/moGPU $55.06
  8. GTX 10708 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 1,920 CUDA cores$135.22/moGPU $64.29
  9. GTX 1070 Ti8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,432 CUDA cores$146.22/moGPU $75.29
  10. GTX 1080 Ti11 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,584 CUDA cores$149.93/moGPU $79
  11. TESLA P4 / QUADRO P50008 or 16 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  12. TESLA P48 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$149.93/moGPU $79
  13. RTX 20708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,304 CUDA cores$159.93/moGPU $89
  14. TESLA P40 / QUADRO P600024 GBIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$169.93/moGPU $99
  15. Instinct MI50 16GB16 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$169.93/moGPU $99
  16. RTX 2070 Super8 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$172.47/moGPU $99
  17. Quadro RTX 40008 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,304 CUDA cores$172.47/moGPU $99
  18. Instinct MI5016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$172.47/moGPU $99
  19. TESLA M602 x 8 GB GDDR5Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,096 CUDA cores$178.82/moGPU $107.89
  20. RTX 20808 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,994 CUDA cores$189.93/moGPU $119
  21. Quadro RTX 500016 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$189.93/moGPU $119
  22. RTX 2080 Super8 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,072 CUDA cores$199.93/moGPU $129
  23. TITAN V12 GB HBM2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,120 CUDA cores$200.92/moGPU $129.99
  24. RTX A20006 or 12 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,328 CUDA cores$202.47/moGPU $129
  25. RTX 30708 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 5,888 CUDA cores$209.93/moGPU $139
  26. TESLA P10016 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 3,584 CUDA cores$212.47/moGPU $139
  27. Quadro P500016 GB GDDR5XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 2,560 CUDA cores$214.06/moGPU $140.59
  28. RTX 2080 Ti11 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 4,352 CUDA cores$219.93/moGPU $149
  29. RTX 3070 Ti8 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  30. RTX A400016 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,144 CUDA cores$222.47/moGPU $149
  31. RTX 308010 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 8,704 CUDA cores$229.93/moGPU $159
  32. TESLA T416 GB GDDR6Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 2,560 CUDA cores$259.93/moGPU $189
  33. CMP 170HX 64GB HBM2e8 GB HBM2e, 64 GB unlockedIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$259.93/moGPU $189
  34. RTX 407012 GB GDDR6XIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 5,888 CUDA cores$262.67/moGPU $179
  35. RTX 3080 Ti12 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,240 CUDA cores$272.47/moGPU $199
  36. Tenstorrent Blackhole p100a28 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$272.47/moGPU $199
  37. L4 ADA 24GB GDDR624 GB GDDR6Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$292.67/moGPU $209
  38. RTX A500024 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 8,192 CUDA cores$302.47/moGPU $229
  39. Tesla V100 32GB32 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 5,120 CUDA cores$302.47/moGPU $229
  40. RTX 309024 GB GDDR6XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 10,496 CUDA cores$309.93/moGPU $239
  41. RTX 508016 GB GDDR7Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$312.67/moGPU $229
  42. Quadro P600024 GB GDDR5XIntel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps · 3,840 CUDA cores$320.52/moGPU $249.59
  43. RTX 4500 Ada Generation24 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 7,680 CUDA cores$332.67/moGPU $249
  44. RTX 4090D24 GB GDDR6XIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 14,592 CUDA cores$372.47/moGPU $299
  45. Quadro RTX 600024 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$372.47/moGPU $299
  46. RTX PRO 4000–Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps$372.47/moGPU $299
  47. Quadro RTX 800048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 4,608 CUDA cores$472.47/moGPU $399
  48. RTX 509032 GB GDDR7Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 21,760 CUDA cores$472.47/moGPU $399
  49. L40S48 GB GDDR6 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$532.67/moGPU $449
  50. A4048 GB GDDR6Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$572.47/moGPU $499
  51. Instinct MI21064 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$582.67/moGPU $499
  52. RTX A600048 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 10,752 CUDA cores$622.47/moGPU $549
  53. RTX 6000 ADA48 GB GDDR6 ECCIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 18,176 CUDA cores$698.47/moGPU $625
  54. A100 40GB40 GB HBM2Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$772.47/moGPU $699
  55. A100 80GB80 GB HBM2eIntel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps · 6,912 CUDA cores$972.47/moGPU $899
  56. RTX PRO 6000 Blackwell 96GB96 GB GDDR7 ECCIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps$1,382.67/moGPU $1,299
  57. H100 80GB80 GB HBM2eIntel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps · 16,896 CUDA cores$1,682.67/moGPU $1,599

I prezzi sono quelli del checkout. Una GPU il cui produttore non pubblica il dato sulla memoria mostra un trattino e scompare quando il controllo della memoria si sposta da “qualsiasi”. Alcune GPU sono compatibili con più chassis: la riga mostra il più economico, il configuratore mostra gli altri.

Esclusività

Hosting server dedicato con GPU: la GPU completa è tua

La GPU è inserita in uno slot PCIe fisico di una macchina affittata a un singolo account. Installi il sistema operativo, carichi il modulo del kernel e fissi la versione del driver, CUDA o ROCm con cui è stato testato il tuo codice. Nulla si aggiorna a tua insaputa.

La macchina segue la stessa regola: ogni core, tutta la memoria, entrambi i dischi, root e la console iLO o iDRAC del server su una rete di gestione separata. Se un esperimento sui driver manda giù la rete, hai comunque schermo, supporti virtuali e controllo dell'alimentazione.

  • Nessuna porzioneNessuna partizione MIG, nessun profilo vGPU, nessuna quota frazionaria. Una GPU, un sistema operativo.
  • Nessuna codaNessuno scheduler sopra di te. Quando il tuo processo è inattivo la GPU è inattiva, e resta tua.
  • Nessun hypervisorBare metal. La latenza misurata il primo giorno è la latenza che ottieni alle 4 del mattino.
  • Nessun contatoreDataset in ingresso, checkpoint e render in uscita. Nulla sulla porta conta i byte.

Come funziona il prezzo

Due righe che si sommano: la macchina e la GPU

La maggior parte dei provider vende una GPU come livello, con processore, memoria, dischi e rete prezzati intorno. Qui la macchina è una riga mensile e la GPU un'altra. Se in seguito cambi GPU, la fattura varia esattamente della differenza tra le due GPU.

Cerchi un server dedicato con GPU economico?

Parti dall'inizio dell'elenco. Abbiamo mantenuto GPU meno recenti che svolgono ancora un lavoro reale, come i modelli Tesla e Quadro che transcodificano video o gestiscono desktop remoti, e sono ospitate nella stessa macchina completa con la stessa porta senza limiti della GPU più recente. Perché teniamo hardware meno recente spiega il compromesso.

Confronti con i cloud GPU orari? La configurazione più costosa dell'elenco, H100 80GB, costa $1,682.67 al mese per l'intera macchina, circa $2.31 all'ora su un mese di 730 ore, e nessuna riga di traffico in uscita arriva in seguito.

  1. MachineIntel Xeon E5-2600 v1/v2Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps$70.93
  2. GPUQuadro 3000M$20.79 – $1,599 across the list$20.79
  3. PortUnmetered, both directionsNo allowance, no egress lineincluded
  4. SetupOne-time, custom buildMonthly term, no contract$29

Complete, per month, from$91.72

I cicli da tre, sei e dodici mesi consentono di risparmiare fino al 15%. Il configuratore arrotonda i prezzi per disco e può discostarsi di un centesimo. Prezzi elenca ogni cifra del sito.

Memoria GPU

Quanta memoria GPU serve al tuo modello

La memoria GPU decide se un modello può essere eseguito; core e clock decidono solo la velocità. Una GPU con due gigabyte in meno non gira lentamente: non si carica proprio. Definisci prima questo numero.

I pesi occupano parametri per byte per parametro: due byte a 16 bit, uno a 8 bit, mezzo byte a 4 bit. La quantizzazione a 4 bit permette a un modello di entrare in una GPU più piccola, con un costo misurabile in termini di qualità.

Lascia margine. La tabella considera solo i pesi. Runtime, attivazioni e cache chiave-valore condividono la stessa memoria, e la cache cresce con ogni token di contesto, quindi 38 GB di pesi non saranno serviti comodamente da una GPU da 40 GB. Aggiungi da un quarto alla metà in più.

e dimensioniamo la GPU in base a ciò che esegui realmente.

Model16-bit8-bit4-bit
7-8 billion parameters16 GB8 GB5 GB
13-14 billion parameters28 GB14 GB8 GB
30-34 billion parameters68 GB34 GB19 GB
70 billion parameters140 GB70 GB38 GB

Solo pesi, arrotondati per eccesso al gigabyte successivo.

Piattaforme

I server che accettano una GPU e il bus PCIe che ciascuno le offre

Ogni piattaforma assegna allo slot una generazione PCIe e un budget di linee differenti. Lo indichiamo perché cambia i risultati: un cliente è passato una volta a una GPU consumer più recente su una piattaforma PCIe 3.0 e il rendering è diventato più lento, e ha capito il perché prima di noi.

PCIe 3.0

Intel Xeon E5-2600 v1/v2

$70.93/mo before the GPU

Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps

GPUs
28
Lanes
40 lanes per socket
Sockets
2
Max RAM
256 GB
Intel Xeon E5-2600 v1/v2 →

PCIe 3.0

Intel Xeon E5-2600 v3/v4

$73.47/mo before the GPU

Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps

GPUs
44
Lanes
40 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon E5-2600 v3/v4 →

PCIe 3.0

Intel Xeon Silver / Gold

$83.67/mo before the GPU

Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps

GPUs
48
Lanes
48 lanes per socket
Sockets
2
Max RAM
1 TB
Intel Xeon Silver / Gold →

PCIe 4.0

AMD EPYC

$217.59/mo before the GPU

AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps

GPUs
10
Lanes
128 lanes per socket
Sockets
2
Max RAM
1 TB
AMD EPYC →

Quando conta la generazione del bus

  • Ti costa quando i dati attraversano continuamente il bus: un ciclo di addestramento che trasferisce batch dal disco o dalla memoria di sistema, un renderer che invia i dati della scena a ogni frame, un working set che eccede la memoria della GPU.
  • Non ti costa nulla una volta che i pesi sono caricati e restano lì: inferenza su un modello che entra nella memoria, transcodifica video, gran parte delle simulazioni. Il collegamento trasporta allora richieste e risultati di piccole dimensioni.
  • Non sei sicuro? Indica il carico di lavoro e ti diremo se la piattaforma lo frena, incluso quando una GPU più economica su un bus più veloce è l'acquisto migliore.

Incluso

Cosa include qui l'hosting di server GPU, prima di aggiungere qualsiasi cosa

  • Root e il tuo stack di driver

    Un sistema operativo pulito e le chiavi. Scegli tu il driver, la release CUDA o ROCm e la build del framework, e restano fissi. Vuoi il driver installato prima della consegna? Indica la versione esatta nell'ordine.

  • Una console su una rete dedicata

    iLO sulle macchine HPE, iDRAC su Dell: tastiera e schermo, supporti virtuali, controllo dell'alimentazione, sensori e log hardware. Un modulo che blocca il display o la scheda di rete è un riavvio che fai da solo, guardando il POST.

  • Una porta che non conta nulla

    Senza limiti in entrambe le direzioni alla velocità inclusa e a ogni velocità superiore. Nessun limite di trasferimento e nessuna tariffa di uscita. Larghezza di banda senza limiti elenca le porte più veloci.

  • Reinstallazioni senza ticket

    Immagini del sistema operativo con un clic, tutte le volte che vuoi, senza costi. Il DNS inverso è modificabile da te, IPv6 è incluso e IPv4 aggiuntivi sono una voce nel configuratore.

  • Risposte in pochi secondi, una persona quando la chiedi

    La chat riceve risposta in pochi secondi da un assistente AI che può controllare il tuo account e il tuo server, e una persona subentra nel momento in cui lo chiedi. Un componente guasto viene sostituito entro la finestra del tuo piano di supporto: 24 ore con il piano Basic incluso, 4 con Bronze, 3 con Silver, 2 con Gold e Platinum.

  • Cinque città, la nostra rete

    New York, Miami, San Francisco, Amsterdam e Bucarest, tutte sulla rete di Server Room, AS19624. La posizione determina la latenza verso i tuoi utenti e la normativa sulla protezione dei dati a cui rispondi. Data center descrive ogni struttura.

Consegna

Quanto velocemente puoi noleggiare un server dedicato con GPU

Dipende da dove si trova oggi la GPU, e ti diciamo in quale caso ti trovi prima che tu paghi.

  1. Circa 30 minuti

    La GPU è già in una macchina montata in rack

    Niente da installare. La macchina è pronta e viene consegnata. Server istantanei elenca ciò che è disponibile subito.

  2. Da 4 a 24 ore

    Installiamo una GPU dal nostro magazzino

    Il caso più comune. Un tecnico installa la GPU, configura l'array di dischi e installa il sistema operativo. Memoria aggiuntiva o un disco diverso vengono gestiti nella stessa visita.

  3. Da 5 a 10 giorni lavorativi

    La GPU deve essere acquistata

    Ordiniamo il componente, poi assembliamo come sopra. Configurazione su ordinazione copre una macchina secondo le tue specifiche complete.

  4. Da 10 a 15 giorni lavorativi

    La GPU è in allocazione

    Gli acceleratori attuali vengono spediti alla data del distributore, e la indichiamo prima che tu ti impegni. L'hardware acquistato per un singolo cliente viene quotato con tre mesi pagati in anticipo.

Ogni tempistica parte dopo l'approvazione del pagamento e della verifica antifrode. La maggior parte degli ordini viene approvata entro un paio d'ore; un primo ordine su un nuovo account può richiedere più tempo.

Il campo di un partner

Media generati dall’IA: il tipo di lavoro adatto a una GPU completa

Viral Mind Technologies, partner di Server Room, costruisce e gestisce le proprie proprietà digitali: personalità virtuali, marchi mediatici online e software per creatori. Ha iniziato nel 2019 come agenzia di marketing digitale e dal fine 2022 lavora ai propri progetti di IA.

Generare immagini e video mantiene un modello residente nella memoria della GPU e tiene la GPU occupata per ore alla volta. È il caso di una GPU dedicata su bare metal piuttosto che di una porzione di essa, e una GPU completa è ciò che ogni server in questa pagina noleggia.

Il loro portfolio e i casi di studio: viralmindtech.com

  • Personalità virtualiNaomi Marie, lanciata ad agosto 2023, è la prima personalità digitale di loro piena proprietà.
  • MediaCybeauty Magazine, lanciato a marzo 2024, opera come pubblicazione web-first.
  • Strumenti per creatoriProof of Ownership rilascia una registrazione datata per un file creativo, con impronta digitale nel browser così che il file non lasci mai il dispositivo.

Risposte

Domande sui server dedicati con GPU, con risposta

Che cos'è un server dedicato con GPU?

Un server fisico affittato a un solo cliente, con una scheda grafica installata e passata direttamente al sistema operativo del cliente stesso. Nulla è virtualizzato o condiviso: hai a disposizione tutti i core, tutta la memoria, i dischi e la GPU completa, con accesso root e console remota.

Quanto costa un server dedicato con GPU?

Una macchina completa con GPU installata parte da $91.72 a $1,682.67 al mese. Il prezzo è la somma di due voci: la macchina e la GPU, da $20.79 a $1,599 al mese. Processore, memoria, due dischi, una porta senza limiti di traffico e un indirizzo IPv4 sono inclusi. L'attivazione è un costo una tantum di $29 per una configurazione con GPU installata su ordinazione; una macchina pronta ordinata così com'è non prevede alcun costo di attivazione.

La GPU è condivisa con qualcuno?

No. Una macchina fisica, un account e la GPU passata direttamente al sistema operativo che hai installato. Nessun hypervisor, nessuna partizione MIG, nessun profilo vGPU e nessuna suddivisione del tempo di calcolo. I valori che misuri il primo giorno sono quelli che mantieni.

Posso noleggiare un server dedicato con GPU mese per mese, senza contratto?

Sì. Un mese è la durata predefinita e non c'è nulla da firmare. I cicli di tre, sei e dodici mesi consentono di risparmiare fino al 15% e il prezzo non aumenta al rinnovo. Paga con carta di credito o PayPal; per ordini più consistenti si può concordare un bonifico bancario, che di solito supera i controlli antifrode più rapidamente di un pagamento con carta.

Esiste un server dedicato con GPU economico?

Sì. L'elenco in questa pagina è ordinato dal più economico e la configurazione completa più conveniente è Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps a $91.72 al mese. Le GPU Tesla e Quadro di generazioni precedenti gestiscono ancora bene la transcodifica video e i desktop remoti, e sono montate nella stessa macchina completa con la stessa porta senza limiti di traffico.

Quali GPU NVIDIA e AMD posso ottenere?

Sono disponibili 57 GPU, dagli attuali acceleratori di calcolo NVIDIA e AMD Instinct fino ai modelli precedenti Tesla, Quadro e GeForce. Ognuna è elencata per nome con la relativa memoria e il prezzo mensile completo. Se la GPU che cerchi non è presente, chiedi: spesso possiamo procurarcela.

Quale versione di driver e CUDA viene installata?

Quelle che installi tu. Il server arriva con un sistema operativo pulito e accesso root, e sei tu a fissare il driver, la versione di CUDA o ROCm e la build del framework su cui è stato testato il tuo codice. Se desideri che il driver sia già installato alla consegna, indica la versione esatta nell'ordine. Se una GPU deve supportare una specifica release di CUDA, chiedi prima di pagare e verificheremo.

Due GPU possono essere installate in un solo server?

Spesso sì, e lo valutiamo caso per caso: lo spazio nello chassis, la larghezza della GPU, le linee PCIe e l'alimentatore determinano il numero possibile. Indica la GPU e ti risponderemo con lo chassis, il numero di GPU e i tempi di consegna. Di solito il motivo è la memoria piuttosto che la velocità, dato che due GPU da 48 GB possono contenere un modello che una GPU da 80 GB non riesce a gestire. Server multi-GPU e multi-nodo illustra il passo successivo.

Posso cambiare la GPU in un secondo momento?

Sì, nello stesso server che hai già: nessuna migrazione, nessuna reinstallazione, nessun nuovo indirizzo IP. Si tratta di un intervento programmato con una breve interruzione, e la fattura varia esattamente della differenza tra le due GPU. RAM, dischi e una porta più veloce vengono aggiunti con la stessa regola.

Cosa succede se la GPU si guasta?

La sostituiamo entro i tempi previsti dal tuo piano di supporto, a partire dalla segnalazione: 24 ore con il piano Basic incluso, 4 con Bronze, 3 con Silver, 2 con Gold e Platinum. Oltre tale termine, si applica un credito di servizio secondo quanto pubblicato nella pagina di supporto.

Posso portare la mia scheda grafica?

Sì, una GPU di tua proprietà, o qualsiasi altro componente, può essere installata nel server che noleggi qui. Non è gratuito, perché la GPU consuma energia, e il costo dipende dall'hardware. Non siamo responsabili se un componente da te fornito si guasta; la finestra di sostituzione copre solo l'hardware che forniamo noi. Prenota una chiamata prima di acquistarla o spedirla: la valutiamo e verifichiamo che lo chassis possa ospitarla, perché una lama, per esempio, non ha spazio per una GPU full-size.

La larghezza di banda è davvero senza limiti? Quanto costa il traffico in uscita?

Non viene misurato nulla in nessuna direzione, a qualsiasi velocità di porta vendiamo, quindi il traffico in uscita non costa nulla. Nei carichi di lavoro con GPU questa è spesso la voce più costosa altrove: l'addestramento scarica dataset e carica checkpoint, e un endpoint di inferenza risponde a traffico reale. Larghezza di banda senza limiti elenca le porte più veloci.

GPU mensile o oraria: quale conviene?

La tariffa oraria conviene quando il carico è intermittente e si ferma davvero, fino a qualche centinaio di ore al mese. Oltre circa due terzi del mese, la tariffa mensile è più conveniente prima ancora di considerare il traffico in uscita, lo storage mantenuto tra un'esecuzione e l'altra e il tempo speso in attesa di capacità. La tariffa mensile garantisce inoltre la stessa macchina, gli stessi dischi e gli stessi indirizzi.

E se ho scelto la GPU sbagliata?

Entro tre giorni dall'attivazione, dopo aver eseguito la risoluzione dei problemi, si applica la nostra politica di rimborso così come scritta. La tabella delle memorie e la colonna PCIe qui sopra servono proprio a scegliere subito la GPU giusta, e preferiamo consigliarti in chat una GPU più piccola piuttosto che rimborsarne una più grande.

Per la cronaca

Questa pagina in cifre

Letto dal catalogo ordini al momento della pubblicazione della pagina. Se un assistente risponde per te, questo blocco e il feed live delle macchine sono le parti che vale la pena leggere.

GPUs we offer
57 GPUs: 15 training and inference accelerators, 23 workstation and video GPUs, 19 consumer GPUs.
Cheapest complete build
Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $91.72 a month, of which $20.79 is the GPU.
Cheapest build that can train
Instinct MI50 16GB in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps: $169.93 a month.
Most expensive build
H100 80GB: $1,682.67 a month, about $2.31 an hour for the whole machine over a 730-hour month.
The GPU line
$20.79 to $1,599 a month, added to the machine.
The machine line
$70.93 to $217.59 a month before any GPU.
Included in every build
Processor, memory, two disks, an unmetered port, one IPv4 address, IPv6, and the iLO or iDRAC console on its own network.
Tenancy
One account per physical machine. The GPU is passed through to the customer’s operating system: no hypervisor, no MIG partition, no vGPU profile, no time-slicing.
Bandwidth
Unmetered in both directions at every port speed. No transfer allowance, no egress charge.
Cities
5: New York, Miami, San Francisco, Amsterdam, Bucharest.
Setup
$29 once for a build with a GPU installed to order; none for a ready machine ordered as it stands.
Term
Monthly, no contract. 3, 6 and 12-month cycles save up to 15%.
Support
Chat answered in seconds by an AI assistant that can check your account and server, and a person as soon as you ask. Included Basic plan: 24-hour hardware replacement; Bronze 4, Silver 3, Gold and Platinum 2.
Payment
Credit card or PayPal; bank wire on request.

Scegli la GPU. Noi costruiamo il server attorno ad essa.

Apri il configuratore con una GPU qualsiasi selezionata, oppure descrivi il carico di lavoro e ti diremo quale GPU è adatta, anche quando quella più economica è sufficiente.

Configura un server GPU