Servidores dedicados AMD Ryzen AI • Montados sob encomenda em cinco locais

Duas máquinas de IA com Ryzen , e nada mais em nenhuma delas.

O Ryzen AI Max+ 395 com 126 TOPS em 16 núcleos, ou o Ryzen AI 9 HX 370 com 128 GB de DDR5. Ambos com acesso dedicado, acesso root via hardware e uma porta Gigabit dedicada. A partir de US$ 249 por mês, e esse valor não sofrerá alterações.

Configure a partir de US$ 249/mês
Raiz no metal Porta gigabit ilimitada Fabricado sob encomenda em 4 a 24 horas. Sem taxa de instalação

Como a máquina chega até você

Não guardamos estes produtos em prateleiras, e preferimos dizer isso a fingir o contrário.

Fabricado sob encomenda

Cada unidade é construída sob encomenda, no pavilhão escolhido em uma de nossas cinco unidades. O configurador indica um prazo de 4 a 24 horas, e esse é o prazo que utilizamos.

Fedora 43 e root, nada mais.

Ele chega executando um Fedora 43 limpo com acesso root completo e sem nenhum serviço de inferência em execução. O que você executar nele — vLLM, Ollama, llama.cpp, PyTorch fixado na versão com a qual seu código foi testado — é de sua responsabilidade para instalar e versionar.

Seu tráfego não é medido.

Uma porta gigabit, sem limite de dados. Sem franquia grande, sem crédito para picos de uso, sem limite de uso que se transforma em fatura. Um endereço IPv4 incluso e IPv6 disponível mediante solicitação.

O que os alimenta?

Uma NPU e uma Radeon integrada compartilhando um mesmo pool de memória são muito mais adequadas para algumas tarefas do que uma parte alugada de um servidor maior.

Extração e análise de dados
Extração que não pode sair do prédio

Resumir contratos, extrair entidades de logs, classificar uma fila de suporte. O trabalho é pouco glamoroso e o motivo pelo qual acaba em um servidor dedicado é quase sempre a restrição de acesso a um endpoint compartilhado.

IA Conversacional
Implementar um modelo de IA em seu próprio hardware

Assistentes, redução do número de chamadas para o suporte técnico, interfaces de voz. Uma única máquina que ninguém mais utiliza, portanto, a latência medida na terça-feira será a mesma na sexta-feira.

Ferramentas de desenvolvedor
Conclusão de código, mantida internamente

Modelos de autocompletar e revisar código para uma equipe, com o repositório hospedado em hardware alugado. Várias versões do modelo podem estar no disco simultaneamente, e você escolhe qual delas ficará ativa.

Pesquisa e prototipagem
Descobrindo as surpresas logo no início

É importante montar e executar um conjunto de componentes em uma NPU e ROCm antes de investir em racks de hardware. Descobrir aqui o que não é compatível com outras plataformas é mais barato.

Especificação de referência

As configurações que o configurador abre. Tudo aqui está incluído no valor mensal.

Ryzen AI Max+ 395

Processador

AMD Ryzen AI Max+ 395, 16 núcleos

capacidade de processamento de IA

126 TOPS

Gráficos

AMD Radeon 8060S

Memória

64 GB DDR5

Armazenar

SSD NVMe de 1 TB, um slot

Preço

US$ 399 por mês, sem taxa de instalação.

Ryzen AI 9 HX 370

Processador

AMD Ryzen AI 9 HX 370, 12 núcleos

capacidade de processamento de IA

80 TOPs, 50 deles na NPU

Gráficos

AMD Radeon 890M

Memória

128 GB DDR5

Armazenar

SSD NVMe de 1 TB, um slot

Preço

US$ 249 por mês, sem taxa de instalação.

Ambas as máquinas

Rede

1 Gbps ilimitado, não compartilhado

Endereços

1x IPv4 incluído, IPv6 disponível

Sistema operacional

Fedora 43, pré-instalado, com privilégios de root completos.

Opções de armazenamento

NVMe de 1 TB, 2 TB ou 3,84 TB

Gerenciamento

O pacote básico inclui: resposta em 12 horas e substituição de hardware em 4 horas.

Locais

Nova Iorque, Miami, São Francisco, Bucareste, Amsterdã

Disponibilidade

Fabricado sob encomenda, de 4 a 24 horas.

Os preços são mensais e não incluem impostos, quando aplicáveis. Precisa de mais núcleos, mais memória ou uma placa de vídeo dedicada? Monte um computador de acordo com as suas especificações .

O que está incluído no aluguel?

As partes do serviço que estão incluídas em vez de serem vendidas separadamente para você.

Gestão básica sem custos adicionais.

Resposta em até doze horas e substituição de hardware com defeito em até quatro horas, em todas as máquinas, sem custo adicional. Os planos Bronze, Prata, Ouro e Platina reduzem o tempo de resposta para quatro horas, duas, uma e trinta minutos, respectivamente, se necessário.

NVMe, não um disco rígido.

O armazenamento de 1 TB incluído é NVMe, portanto, carregar um ponto de verificação ou transmitir um conjunto de treinamento não será um problema. Estão disponíveis versões de 2 TB e 3,84 TB no mesmo slot.

Engenheiros no mesmo salão

Engenheiros disponíveis no chat ao vivo 24 horas por dia, trabalhando nos corredores onde essas máquinas estão localizadas. Pergunte antes de fazer o pedido se quiser saber o status atual da fila de produção.

Servidores Ryzen AI: perguntas e respostas.

As perguntas que os engenheiros realmente nos enviam antes de fazer um pedido.

Qual dos dois devo escolher?

A memória é mais determinante do que a taxa de transferência. A HX 370, por US$ 249, oferece 128 GB, o dobro da Max+ 395, mais rápida, sendo assim, ela suporta programas que a versão de 64 GB não consegue executar. Opte pela Max+ 395, por US$ 399, se os programas que você precisa executar couberem em 64 GB e você quiser os 126 TOPS e a placa de vídeo Radeon mais potente.

Trata-se de uma máquina inteira ou apenas de uma parte dela?

Uma máquina inteira. Um único usuário, acesso root completo, nada virtualizado entre você e o hardware. A NPU, a Radeon integrada e a memória são suas durante o mês e não são compartilhadas com mais ninguém.

Quanto espaço de armazenamento posso ter?

Estas placas possuem um único slot NVMe, e 1 TB está incluído no preço. Você pode optar por 2 TB ou 3,84 TB no configurador. Não há um segundo slot, portanto, se você precisar de mais discos rígidos ou de RAID, esta não é a linha de produtos adequada e teremos prazer em montar a placa ideal para você.

Vem com alguma pilha de inferência instalada?

Não, e isso é proposital. Ele vem como um Fedora 43 limpo e lhe dá acesso root completo ao hardware. Instale o vLLM, Ollama, llama.cpp, PyTorch ou qualquer outro pacote que você tenha padronizado, fixando as versões com as quais seu código foi testado, em vez das versões que incluímos por acaso.

Quanto tempo demora para receber um?

Fabricamos cada produto sob encomenda, sem manter estoque, e o configurador indica um prazo de 4 a 24 horas. Se o seu prazo for curto, entre em contato conosco pelo chat antes de fazer o pedido e informaremos a sua situação na fila de espera.

Onde posso instalá-lo?

Nova Iorque, Miami ou São Francisco nos EUA, Bucareste ou Amsterdã na UE. O preço é o mesmo em todas as cinco salas, e você escolhe a sala no configurador, em vez de ser encaminhado para aquela que tiver espaço disponível.