PCIe 3.0
Intel Xeon E5-2600 v1/v2
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- GPUs
- 28
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Max RAM
- 256 GB
Server dedicati con GPU · bare metal · mensili
Un server dedicato con GPU è una macchina fisica affittata a un singolo account con canone mensile, con la GPU passata direttamente al tuo sistema operativo. Nessun hypervisor, nessuna porzione di vGPU, nessun vicino sul silicio.
Scegli la GPU in base al lavoro e alla memoria che richiede. Ogni riga dell'elenco è un server completo con quella GPU installata, prezzato dallo stesso catalogo usato dal checkout per la fatturazione, e la quota della GPU è indicata sotto il totale.
Il catalogo
Indica a cosa serve la GPU e la memoria minima richiesta. L'elenco si restringe man mano, dal più economico. Ogni riga apre la macchina che ospita quella GPU nel configuratore.
Nessuna GPU singola che offriamo dispone di così tanta memoria. La più capiente ha 96 GB. Oltre quella soglia la configurazione prevede due o più GPU in un unico chassis, quotata manualmente: vedi server multi-GPU, oppure .
I prezzi sono quelli del checkout. Una GPU il cui produttore non pubblica il dato sulla memoria mostra un trattino e scompare quando il controllo della memoria si sposta da “qualsiasi”. Alcune GPU sono compatibili con più chassis: la riga mostra il più economico, il configuratore mostra gli altri.
Esclusività
La GPU è inserita in uno slot PCIe fisico di una macchina affittata a un singolo account. Installi il sistema operativo, carichi il modulo del kernel e fissi la versione del driver, CUDA o ROCm con cui è stato testato il tuo codice. Nulla si aggiorna a tua insaputa.
La macchina segue la stessa regola: ogni core, tutta la memoria, entrambi i dischi, root e la console iLO o iDRAC del server su una rete di gestione separata. Se un esperimento sui driver manda giù la rete, hai comunque schermo, supporti virtuali e controllo dell'alimentazione.
Come funziona il prezzo
La maggior parte dei provider vende una GPU come livello, con processore, memoria, dischi e rete prezzati intorno. Qui la macchina è una riga mensile e la GPU un'altra. Se in seguito cambi GPU, la fattura varia esattamente della differenza tra le due GPU.
Parti dall'inizio dell'elenco. Abbiamo mantenuto GPU meno recenti che svolgono ancora un lavoro reale, come i modelli Tesla e Quadro che transcodificano video o gestiscono desktop remoti, e sono ospitate nella stessa macchina completa con la stessa porta senza limiti della GPU più recente. Perché teniamo hardware meno recente spiega il compromesso.
Confronti con i cloud GPU orari? La configurazione più costosa dell'elenco, H100 80GB, costa $1,682.67 al mese per l'intera macchina, circa $2.31 all'ora su un mese di 730 ore, e nessuna riga di traffico in uscita arriva in seguito.
Complete, per month, from$91.72
I cicli da tre, sei e dodici mesi consentono di risparmiare fino al 15%. Il configuratore arrotonda i prezzi per disco e può discostarsi di un centesimo. Prezzi elenca ogni cifra del sito.
Marketplace GPU
Accanto alle GPU che offriamo, i proprietari pubblicano le proprie macchine GPU sul nostro marketplace. Stabiliscono il canone che ricevono e Server Room fissa il prezzo che paghi. Le inserzioni della nostra società consociata, Primcast, compaiono qui e vengono affittate lì.
Memoria GPU
La memoria GPU decide se un modello può essere eseguito; core e clock decidono solo la velocità. Una GPU con due gigabyte in meno non gira lentamente: non si carica proprio. Definisci prima questo numero.
I pesi occupano parametri per byte per parametro: due byte a 16 bit, uno a 8 bit, mezzo byte a 4 bit. La quantizzazione a 4 bit permette a un modello di entrare in una GPU più piccola, con un costo misurabile in termini di qualità.
Lascia margine. La tabella considera solo i pesi. Runtime, attivazioni e cache chiave-valore condividono la stessa memoria, e la cache cresce con ogni token di contesto, quindi 38 GB di pesi non saranno serviti comodamente da una GPU da 40 GB. Aggiungi da un quarto alla metà in più.
e dimensioniamo la GPU in base a ciò che esegui realmente.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
Solo pesi, arrotondati per eccesso al gigabyte successivo.
Piattaforme
Ogni piattaforma assegna allo slot una generazione PCIe e un budget di linee differenti. Lo indichiamo perché cambia i risultati: un cliente è passato una volta a una GPU consumer più recente su una piattaforma PCIe 3.0 e il rendering è diventato più lento, e ha capito il perché prima di noi.
PCIe 3.0
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
PCIe 3.0
$73.47/mo before the GPU
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
PCIe 3.0
$83.67/mo before the GPU
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
PCIe 4.0
$217.59/mo before the GPU
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Incluso
Un sistema operativo pulito e le chiavi. Scegli tu il driver, la release CUDA o ROCm e la build del framework, e restano fissi. Vuoi il driver installato prima della consegna? Indica la versione esatta nell'ordine.
iLO sulle macchine HPE, iDRAC su Dell: tastiera e schermo, supporti virtuali, controllo dell'alimentazione, sensori e log hardware. Un modulo che blocca il display o la scheda di rete è un riavvio che fai da solo, guardando il POST.
Senza limiti in entrambe le direzioni alla velocità inclusa e a ogni velocità superiore. Nessun limite di trasferimento e nessuna tariffa di uscita. Larghezza di banda senza limiti elenca le porte più veloci.
Immagini del sistema operativo con un clic, tutte le volte che vuoi, senza costi. Il DNS inverso è modificabile da te, IPv6 è incluso e IPv4 aggiuntivi sono una voce nel configuratore.
La chat riceve risposta in pochi secondi da un assistente AI che può controllare il tuo account e il tuo server, e una persona subentra nel momento in cui lo chiedi. Un componente guasto viene sostituito entro la finestra del tuo piano di supporto: 24 ore con il piano Basic incluso, 4 con Bronze, 3 con Silver, 2 con Gold e Platinum.
New York, Miami, San Francisco, Amsterdam e Bucarest, tutte sulla rete di Server Room, AS19624. La posizione determina la latenza verso i tuoi utenti e la normativa sulla protezione dei dati a cui rispondi. Data center descrive ogni struttura.
Consegna
Dipende da dove si trova oggi la GPU, e ti diciamo in quale caso ti trovi prima che tu paghi.
Niente da installare. La macchina è pronta e viene consegnata. Server istantanei elenca ciò che è disponibile subito.
Il caso più comune. Un tecnico installa la GPU, configura l'array di dischi e installa il sistema operativo. Memoria aggiuntiva o un disco diverso vengono gestiti nella stessa visita.
Ordiniamo il componente, poi assembliamo come sopra. Configurazione su ordinazione copre una macchina secondo le tue specifiche complete.
Gli acceleratori attuali vengono spediti alla data del distributore, e la indichiamo prima che tu ti impegni. L'hardware acquistato per un singolo cliente viene quotato con tre mesi pagati in anticipo.
Ogni tempistica parte dopo l'approvazione del pagamento e della verifica antifrode. La maggior parte degli ordini viene approvata entro un paio d'ore; un primo ordine su un nuovo account può richiedere più tempo.
Il campo di un partner
Viral Mind Technologies, partner di Server Room, costruisce e gestisce le proprie proprietà digitali: personalità virtuali, marchi mediatici online e software per creatori. Ha iniziato nel 2019 come agenzia di marketing digitale e dal fine 2022 lavora ai propri progetti di IA.
Generare immagini e video mantiene un modello residente nella memoria della GPU e tiene la GPU occupata per ore alla volta. È il caso di una GPU dedicata su bare metal piuttosto che di una porzione di essa, e una GPU completa è ciò che ogni server in questa pagina noleggia.
Il loro portfolio e i casi di studio: viralmindtech.com
Risposte
Un server fisico affittato a un solo cliente, con una scheda grafica installata e passata direttamente al sistema operativo del cliente stesso. Nulla è virtualizzato o condiviso: hai a disposizione tutti i core, tutta la memoria, i dischi e la GPU completa, con accesso root e console remota.
Una macchina completa con GPU installata parte da $91.72 a $1,682.67 al mese. Il prezzo è la somma di due voci: la macchina e la GPU, da $20.79 a $1,599 al mese. Processore, memoria, due dischi, una porta senza limiti di traffico e un indirizzo IPv4 sono inclusi. L'attivazione è un costo una tantum di $29 per una configurazione con GPU installata su ordinazione; una macchina pronta ordinata così com'è non prevede alcun costo di attivazione.
No. Una macchina fisica, un account e la GPU passata direttamente al sistema operativo che hai installato. Nessun hypervisor, nessuna partizione MIG, nessun profilo vGPU e nessuna suddivisione del tempo di calcolo. I valori che misuri il primo giorno sono quelli che mantieni.
Sì. Un mese è la durata predefinita e non c'è nulla da firmare. I cicli di tre, sei e dodici mesi consentono di risparmiare fino al 15% e il prezzo non aumenta al rinnovo. Paga con carta di credito o PayPal; per ordini più consistenti si può concordare un bonifico bancario, che di solito supera i controlli antifrode più rapidamente di un pagamento con carta.
Sì. L'elenco in questa pagina è ordinato dal più economico e la configurazione completa più conveniente è Quadro 3000M in Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps a $91.72 al mese. Le GPU Tesla e Quadro di generazioni precedenti gestiscono ancora bene la transcodifica video e i desktop remoti, e sono montate nella stessa macchina completa con la stessa porta senza limiti di traffico.
Sono disponibili 57 GPU, dagli attuali acceleratori di calcolo NVIDIA e AMD Instinct fino ai modelli precedenti Tesla, Quadro e GeForce. Ognuna è elencata per nome con la relativa memoria e il prezzo mensile completo. Se la GPU che cerchi non è presente, chiedi: spesso possiamo procurarcela.
Quelle che installi tu. Il server arriva con un sistema operativo pulito e accesso root, e sei tu a fissare il driver, la versione di CUDA o ROCm e la build del framework su cui è stato testato il tuo codice. Se desideri che il driver sia già installato alla consegna, indica la versione esatta nell'ordine. Se una GPU deve supportare una specifica release di CUDA, chiedi prima di pagare e verificheremo.
Spesso sì, e lo valutiamo caso per caso: lo spazio nello chassis, la larghezza della GPU, le linee PCIe e l'alimentatore determinano il numero possibile. Indica la GPU e ti risponderemo con lo chassis, il numero di GPU e i tempi di consegna. Di solito il motivo è la memoria piuttosto che la velocità, dato che due GPU da 48 GB possono contenere un modello che una GPU da 80 GB non riesce a gestire. Server multi-GPU e multi-nodo illustra il passo successivo.
Sì, nello stesso server che hai già: nessuna migrazione, nessuna reinstallazione, nessun nuovo indirizzo IP. Si tratta di un intervento programmato con una breve interruzione, e la fattura varia esattamente della differenza tra le due GPU. RAM, dischi e una porta più veloce vengono aggiunti con la stessa regola.
La sostituiamo entro i tempi previsti dal tuo piano di supporto, a partire dalla segnalazione: 24 ore con il piano Basic incluso, 4 con Bronze, 3 con Silver, 2 con Gold e Platinum. Oltre tale termine, si applica un credito di servizio secondo quanto pubblicato nella pagina di supporto.
Sì, una GPU di tua proprietà, o qualsiasi altro componente, può essere installata nel server che noleggi qui. Non è gratuito, perché la GPU consuma energia, e il costo dipende dall'hardware. Non siamo responsabili se un componente da te fornito si guasta; la finestra di sostituzione copre solo l'hardware che forniamo noi. Prenota una chiamata prima di acquistarla o spedirla: la valutiamo e verifichiamo che lo chassis possa ospitarla, perché una lama, per esempio, non ha spazio per una GPU full-size.
Non viene misurato nulla in nessuna direzione, a qualsiasi velocità di porta vendiamo, quindi il traffico in uscita non costa nulla. Nei carichi di lavoro con GPU questa è spesso la voce più costosa altrove: l'addestramento scarica dataset e carica checkpoint, e un endpoint di inferenza risponde a traffico reale. Larghezza di banda senza limiti elenca le porte più veloci.
La tariffa oraria conviene quando il carico è intermittente e si ferma davvero, fino a qualche centinaio di ore al mese. Oltre circa due terzi del mese, la tariffa mensile è più conveniente prima ancora di considerare il traffico in uscita, lo storage mantenuto tra un'esecuzione e l'altra e il tempo speso in attesa di capacità. La tariffa mensile garantisce inoltre la stessa macchina, gli stessi dischi e gli stessi indirizzi.
Entro tre giorni dall'attivazione, dopo aver eseguito la risoluzione dei problemi, si applica la nostra politica di rimborso così come scritta. La tabella delle memorie e la colonna PCIe qui sopra servono proprio a scegliere subito la GPU giusta, e preferiamo consigliarti in chat una GPU più piccola piuttosto che rimborsarne una più grande.
Per la cronaca
Letto dal catalogo ordini al momento della pubblicazione della pagina. Se un assistente risponde per te, questo blocco e il feed live delle macchine sono le parti che vale la pena leggere.
Correlati
Apri il configuratore con una GPU qualsiasi selezionata, oppure descrivi il carico di lavoro e ti diremo quale GPU è adatta, anche quando quella più economica è sufficiente.