PCIe 3.0
Intel Xeon E5-2600 v1/v2
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
- GPUs
- 28
- Lanes
- 40 lanes per socket
- Sockets
- 2
- Max RAM
- 256 GB
Servidores dedicados com GPU · bare metal · mensal
Um servidor dedicado com GPU é uma máquina física alugada a uma única conta por mês, com a GPU passada diretamente para o seu próprio sistema operacional. Sem hypervisor, sem fatia de vGPU, sem vizinho no silício.
Escolha a GPU pela tarefa e pela memória que ela exige. Cada linha da lista é um servidor completo com aquela GPU instalada, com preço do mesmo catálogo que o checkout fatura, e a parcela da própria GPU aparece impressa abaixo do total.
O catálogo
Diga para que serve a GPU e a memória mínima que ela precisa. A lista se afunila conforme você avança, com o mais barato primeiro. Cada linha abre a máquina que leva aquela GPU no configurador.
Nenhuma GPU individual que oferecemos tem tanta memória. A maior tem 96 GB. Acima disso, a configuração é de duas ou mais GPUs em um único chassi, cotada manualmente: veja servidores multi-GPU, ou .
Os preços são os próprios números do checkout. Uma GPU cujo fabricante não publica valor de memória mostra um travessão e sai da lista quando o controle de memória sai de “qualquer”. Algumas GPUs cabem em mais de um chassi: a linha mostra o mais barato, o configurador mostra o restante.
Ocupação
A GPU fica em um slot PCIe físico em uma máquina alugada a uma única conta. Você instala o sistema operacional, carrega o módulo do kernel e fixa o driver, a versão CUDA ou ROCm contra a qual seu código foi testado. Nada a atualiza por baixo de você.
A máquina segue a mesma regra: todos os núcleos, toda a memória, os dois discos, o root e o console iLO ou iDRAC do próprio servidor em uma rede de gerenciamento separada. Se um experimento de driver derrubar a rede, você ainda tem a tela, a mídia virtual e o controle de energia.
Como funciona o preço
A maioria dos provedores vende uma GPU como um nível, com processador, memória, discos e rede precificados ao redor. Aqui a máquina é uma linha mensal e a GPU é outra. Troque a GPU depois e a conta muda exatamente pela diferença entre as duas GPUs.
Comece pelo topo da lista. Mantivemos GPUs mais antigas que ainda fazem trabalho real, como peças Tesla e Quadro que transcodificam vídeo ou conduzem desktops remotos, e elas ficam na mesma máquina completa com a mesma porta sem medição que a GPU mais nova. Por que mantemos hardware mais antigo explica a troca.
Comparando com nuvens de GPU por hora? A configuração mais cara da lista, H100 80GB, custa $1,682.67 por mês pela máquina inteira, cerca de $2.31 por hora em um mês de 730 horas, e nenhuma linha de egresso chega depois.
Complete, per month, from$91.72
Ciclos de três, seis e doze meses economizam até 15%. O configurador arredonda preços por disco e pode ficar um centavo fora. Preços lista todos os números do site.
Marketplace de GPUs
Ao lado das GPUs que oferecemos, donos anunciam suas próprias máquinas com GPU em nosso marketplace. Eles definem o aluguel que recebem, e a Server Room define o preço que você paga. Anúncios da nossa empresa irmã, Primcast, aparecem aqui também e são alugados lá.
Memória da GPU
A memória da GPU decide se um modelo roda ou não; núcleos e clocks só decidem a velocidade. Uma GPU com dois gigabytes a menos não roda devagar — ela nem carrega. Defina esse número primeiro.
Os pesos ocupam parâmetros vezes bytes por parâmetro: dois bytes em 16 bits, um em 8 bits, meio byte em 4 bits. Quantizar para 4 bits permite que um modelo caiba em uma GPU menor, com um custo mensurável de qualidade.
Deixe folga. A tabela conta apenas os pesos. O runtime, as ativações e o cache chave-valor compartilham a mesma memória, e o cache cresce com cada token de contexto, então 38 GB de pesos não serão servidos com conforto em uma GPU de 40 GB. Acrescente de um quarto a metade por cima.
e dimensionamos a GPU para o que você realmente executa.
| Model | 16-bit | 8-bit | 4-bit |
|---|---|---|---|
| 7-8 billion parameters | 16 GB | 8 GB | 5 GB |
| 13-14 billion parameters | 28 GB | 14 GB | 8 GB |
| 30-34 billion parameters | 68 GB | 34 GB | 19 GB |
| 70 billion parameters | 140 GB | 70 GB | 38 GB |
Somente os pesos, arredondados para o próximo gigabyte.
Plataformas
Cada plataforma entrega ao slot uma geração PCIe e um orçamento de pistas diferentes. Nós publicamos isso porque muda os resultados: um cliente migrou certa vez para uma GPU de consumo mais nova em uma plataforma PCIe 3.0 e renderizou mais devagar, e descobriu o motivo antes de nós.
PCIe 3.0
$70.93/mo before the GPU
Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps
PCIe 3.0
$73.47/mo before the GPU
Intel Xeon E5-2620 v4 Octo Core 2.10 GHz · 32 GB DDR4 · 2 × SATA 500 GB (RAID 1) · 1 Gbps
PCIe 3.0
$83.67/mo before the GPU
Intel Xeon Silver 4110 8 Core 2.10 GHz · 16 GB DDR4 · 2 × SATA-SSD 240 GB (RAID 1) · 1 Gbps
PCIe 4.0
$217.59/mo before the GPU
AMD EPYC 7413 24 CORE 2.65 GHz 128MB L3 CACHE · 32 GB DDR4 · 1 × SATA-SSD 240 GB · 1 Gbps
Incluído
Um sistema operacional limpo e as chaves. Você escolhe o driver, a versão do CUDA ou ROCm e o build do framework, e eles permanecem fixados. Quer o driver instalado antes da entrega? Informe a versão exata no pedido.
iLO nas máquinas HPE, iDRAC nas Dell: teclado e tela, mídia virtual, controle de energia, sensores e logs de hardware. Um módulo que trava o vídeo ou a placa de rede é um reboot que você mesmo faz, acompanhando o POST.
Sem medição em ambas as direções na velocidade incluída e em todas acima dela. Sem franquia de transferência e sem linha de egresso. Largura de banda sem medição lista as portas mais rápidas.
Imagens do sistema operacional em um clique, quantas vezes quiser, sem custo. O DNS reverso é seu para editar, o IPv6 está incluído e IPv4 extra é uma linha no configurador.
O chat é respondido em segundos por um assistente de IA que pode verificar sua conta e seu servidor, e uma pessoa assume no momento em que você pedir. Uma peça com defeito é substituída dentro da janela do seu plano de suporte: 24 horas no plano Basic incluído, 4 no Bronze, 3 no Silver, 2 no Gold e Platinum.
Nova York, Miami, São Francisco, Amsterdã e Bucareste, todas na rede própria da Server Room, AS19624. A localização define sua latência para os usuários e a lei de proteção de dados à qual você responde. Data centers descreve cada edifício.
Entrega
Depende de onde a GPU está hoje, e dizemos em qual caso você se encontra antes de pagar.
Nada para instalar. A máquina está pronta e é entregue. Servidores instantâneos lista o que está pronto agora.
O caso usual. Um técnico instala a GPU, monta o conjunto de discos e instala o sistema operacional. Memória extra ou um drive diferente é feito na mesma visita.
Encomendamos a peça e depois montamos como acima. Montagem sob encomenda cobre uma máquina conforme toda a sua especificação.
Os aceleradores atuais são enviados na data do distribuidor, e a informamos antes de você se comprometer. Hardware comprado para um cliente é cotado com três meses pagos antecipadamente.
Todos os prazos começam após a aprovação do pagamento e da análise antifraude. A maioria dos pedidos é aprovada em algumas horas; um primeiro pedido em uma conta nova pode demorar mais.
A área de um parceiro
Viral Mind Technologies, parceira da Server Room, cria e opera suas próprias propriedades digitais: personalidades virtuais, marcas de mídia online e software para criadores. Começou em 2019 como agência de marketing digital e trabalha em seus próprios projetos de IA desde o final de 2022.
Gerar imagens e vídeos mantém um modelo residente na memória da GPU e a GPU ocupada por horas a fio. Esse é o caso de uma GPU dedicada em bare metal, e não de uma fatia dela — e uma GPU completa é o que todo servidor desta página aluga.
Portfólio e estudos de caso deles: viralmindtech.com
Respostas
Um servidor físico alugado a um único cliente, com uma placa gráfica instalada e repassada ao sistema operacional do próprio cliente. Nada é virtualizado nem compartilhado: você recebe todos os núcleos, toda a memória, os discos e a GPU completa, com acesso root e console remoto.
Uma máquina completa com GPU instalada custa de $91.72 a $1,682.67 por mês. O preço é a soma de duas linhas: a máquina e a GPU, de $20.79 a $1,599 por mês. Processador, memória, dois discos, porta sem medição de tráfego e um endereço IPv4 estão incluídos. A instalação tem uma taxa única de $29 em uma configuração com GPU instalada sob encomenda; uma máquina pronta, pedida como está, não tem essa taxa.
Não. Uma máquina física, uma conta, e a GPU repassada ao sistema operacional que você instalou. Não há hipervisor, partição MIG, perfil vGPU nem divisão de tempo. Os números que você medir no primeiro dia são os números que permanecem.
Sim. Um mês é o prazo padrão e não há nada para assinar. Ciclos de três, seis e doze meses economizam até 15%, e o preço não aumenta na renovação. Pague com cartão de crédito ou PayPal; para pedidos maiores, uma transferência bancária pode ser combinada, e geralmente passa pela análise antifraude mais rápido do que um pagamento com cartão.
Sim. A lista nesta página está ordenada do mais barato para o mais caro, e a configuração completa mais barata é Quadro 3000M em Intel Xeon E5-2630L Hex Core 2.00 GHz · 32 GB DDR3 · 2 × SATA 500 GB (RAID 1) · 500 Mbps por $91.72 ao mês. GPUs Tesla e Quadro mais antigas ainda transcode vídeo e conduzem áreas de trabalho remotas muito bem, e vêm na mesma máquina completa com a mesma porta sem medição de tráfego.
57 GPUs estão na lista, desde aceleradores de computação NVIDIA atuais e AMD Instinct até modelos mais antigos Tesla, Quadro e GeForce. Cada uma é listada pelo nome, com sua memória e o preço mensal completo. Se a GPU que você quer não estiver na lista, pergunte: muitas vezes podemos comprá-la para você.
As que você instalar. O servidor chega com um sistema operacional limpo e acesso root, e você fixa o driver, a versão do CUDA ou ROCm e a compilação do framework com a qual seu código foi testado. Se quiser o driver instalado na entrega, coloque a versão exata no pedido. Se uma GPU precisa suportar uma versão específica do CUDA, pergunte antes de pagar e nós verificaremos.
Frequentemente sim, e cotamos manualmente: espaço no chassi, largura da GPU, pistas PCIe e fonte de alimentação determinam a quantidade. Diga qual GPU e responderemos com o chassi, a quantidade e o prazo. O motivo usual é memória, não velocidade, já que duas GPUs de 48 GB comportam um modelo que uma GPU de 80 GB não comporta. Servidores multi-GPU e multi-nó cobrem o próximo passo.
Sim, no servidor que você já tem: sem migração, sem reinstalação, sem novos endereços IP. É uma visita programada com uma breve interrupção, e a fatura muda exatamente pela diferença entre as duas GPUs. RAM, discos e uma porta mais rápida são adicionados sob a mesma regra.
Nós a substituímos dentro da janela do seu plano de suporte, contada a partir do momento em que você reportar: 24 horas no plano Basic incluído, 4 no Bronze, 3 no Silver, 2 no Gold e Platinum. Passada a janela, o crédito de serviço segue o cronograma publicado na página de suporte.
Sim, uma GPU que você possui, ou qualquer outra peça, pode ir no servidor que você aluga aqui. Não é gratuito, porque a GPU consome energia, e a cobrança depende do hardware. Não nos responsabilizamos se uma peça que você trouxe falhar; a janela de substituição cobre apenas o hardware que fornecemos. Agende uma ligação antes de comprar ou enviar: nós precificamos e verificamos se o chassi comporta a peça, porque uma lâmina, por exemplo, não tem espaço para uma GPU de tamanho normal.
Nada é medido em nenhuma direção, em qualquer velocidade de porta que vendemos, então o tráfego de saída não custa nada. Em trabalhos com GPU, essa costuma ser a maior despesa em outros lugares: o treinamento puxa conjuntos de dados e envia checkpoints, e um endpoint de inferência responde a tráfego real. Largura de banda sem medição lista as portas mais rápidas.
O modelo por hora vence enquanto o trabalho é intermitente e realmente para, até algumas centenas de horas por mês. Passando de cerca de dois terços do mês, o mensal fica mais barato antes de contar tráfego de saída, armazenamento mantido entre execuções e tempo esperando por capacidade. O mensal também mantém a mesma máquina, discos e endereços.
Em até três dias após a ativação, depois da solução de problemas, nossa política de reembolso se aplica como está escrita. A tabela de memória e a coluna PCIe acima estão aí para você escolher a GPU certa de primeira, e preferimos conversar no chat para você optar por uma GPU menor do que reembolsar uma maior.
Para constar
Lidos do catálogo de pedidos no momento em que a página foi servida. Se um assistente estiver respondendo por você, este bloco e o feed de máquinas ao vivo são as partes que valem a pena ler.
Relacionado
Abra o configurador com qualquer GPU selecionada, ou conte-nos a carga de trabalho e diremos qual GPU se encaixa, inclusive quando a mais barata é suficiente.