Início/Servidores dedicados

Bare metal e servidores GPU dedicados

Servidores GPU de inquilino único, preços publicados, sem custo de hipervisor

Alugue a máquina inteira — cada GPU, cada núcleo, cada faixa NVMe, com acesso root e BMC incluídos. Mensal, anual ou por hora, em 25 mercados, com hardware da Dell, Supermicro, HPE, Lenovo, GIGABYTE e QCT.

Prefere ser dono do hardware? Compre de qualquer OEM e deixe que operemos — veja Traga sua própria GPU. Alugar e possuir usam as mesmas salas, o mesmo fabric e os mesmos engenheiros.

Inquilino
100% inquilino único
Acesso
Root + BMC IPMI/Redfish
Prazos
Por hora · 1 a 36 meses
Provisionamento
2 horas a 10 dias
Banda
Opções de 10 a 100G sem medição
Nós de IA principais

Servidores dedicados NVIDIA HGX e NVL72

Nós SXM de oito GPUs com NVLink e NVSwitch, CPUs de duplo soquete, NICs de fabric de 400G/800G e NVMe local. Vendidos como nós completos e como pods multinó com InfiniBand entre eles.

ConfiguraçãoCPU / RAMNVMe localNIC de fabricMensalAnual (por mês)Por hora
GB300 NVL72 — 72 GPU36× Grace · 40 TB4× 7.68 TB18× XDR 800GSob consultaSob consulta
8× B300 SXM 288GB2× Xeon 6 / EPYC 9005 · 3 TB8× 7.68 TB Gen58× XDR 800G$44,800$39,900$66.72
8× B200 SXM 180GB2× Xeon 6 / EPYC 9005 · 3 TB8× 7.68 TB Gen58× NDR/XDR$38,000$33,800$52.88
8× H200 SXM 141GB2× Xeon 8568Y+ / EPYC 9554 · 2 TB8× 3.84 TB Gen4/58× NDR 400G$23,900$21,300$30.32
8× H100 SXM 80GB2× Xeon 8468 / EPYC 9474F · 2 TB8× 3.84 TB Gen48× NDR 400G$18,400$16,400$24.80
8× A100 SXM 80GB2× EPYC 7763 / Xeon 8358 · 1 TB4× 3.84 TB Gen48× HDR 200G$10,400$9,300$15.20
8× A100 SXM 40GB2× EPYC 7742 · 1 TB4× 1.92 TB Gen48× HDR 200G$8,000$7,100$11.76

Preços de tabela indicativos em USD por nó, sem impostos, armazenamento paralelo e trânsito inter-regional. Pods multinó incluem leaf/spine InfiniBand, cabeamento e validação.

Servidores PCIe e de inferência

As configurações que o mercado realmente aluga

Frotas de inferência, fine-tuning, renderização e CI raramente precisam de um NVL72. Estas são as configurações de trabalho, com a mesma garantia de inquilino único.

ConfiguraçãoMemória GPUPlataformaCarga típicaMensalPor hora
8× H100 NVL 94GB752 GB2× EPYC 9454 · 1.5 TB · PCIe Gen5Inferência LLM de alta densidade$14,700$21.60
4× H100 PCIe 80GB320 GB2× Xeon 8462Y+ · 768 GBFine-tuning, serving de porte médio$7,300$10.80
8× RTX PRO 6000 Blackwell 96GB768 GB2× EPYC 9455 · 1.5 TB · Gen5Inferência, Omniverse, simulação$9,500$17.44
8× L40S 48GB384 GB2× Xeon 8462Y+ · 1 TBInferência, vídeo, VDI, renderização$6,000$10.80
4× L40S 48GB192 GB2× EPYC 9354 · 512 GBServing de modelos pequenos, lote$3,300$5.40
8× RTX 5090 32GB256 GB2× EPYC 9354 · 768 GBPesquisa, difusão, clusters de desenvolvimento$3,800$6.00
8× RTX 4090 24GB192 GB2× EPYC 7543 · 512 GBDifusão, CI, inferência sensível a custo$2,700$5.04
4× RTX A6000 48GB192 GB2× Xeon 6338 · 512 GBClasse workstation, CAD, CUDA legado$1,900$5.40
8× L4 24GB192 GB2× EPYC 9124 · 384 GBInferência de baixo consumo, transcodificação$2,200$3.12
2× L40S 48GB96 GB1× EPYC 9254 · 256 GBNó de inferência de entrada$1,640$2.70
Bare metal de CPU e armazenamento

O resto do parque

Pipelines de dados, tokenização, nós de acesso, bancos vetoriais e armazenamento de checkpoints — tudo na mesma rede, na mesma sala que suas GPUs.

ConfiguraçãoNúcleos / threadsMemóriaArmazenamentoRedeMensal
Computação — EPYC 9654 duplo192C / 384T768 GB DDR52× 3.84 TB NVMe2× 25G$1,490
Computação — Xeon 6740E duplo192C / 192T512 GB DDR52× 1.92 TB NVMe2× 25G$1,210
Geral — EPYC 9354 simples32C / 64T256 GB DDR52× 1.92 TB NVMe2× 10G$680
Nó de login16C / 32T128 GB2× 960 GB NVMe2× 10G$370
Armazenamento — NVMe denso64C / 128T512 GB24× 7.68 TB NVMe (184 TB)2× 100G$3,800
Armazenamento — capacidade HDD32C / 64T256 GB60× 22 TB SAS (1.3 PB raw)2× 25G$4,500
Otimizado para memória96C / 192T3 TB DDR54× 3.84 TB NVMe2× 100G$2,800
Contexto de mercado

Acima da mediana, de propósito

O preço de tabela da Velyrix fica 15% acima da mediana do mercado — de propósito, e publicamos a conta. Não queremos ser a GPU-hora mais barata da internet, porque a GPU-hora mais barata costuma estar supervendida, com fabric bloqueante, sem suporte, ou as três coisas. O adicional paga engenharia: fabric sem bloqueio, relatório de aceitação assinado, substituição de hardware em quatro horas e engenheiros que atendem às 3 da manhã.

Unidade de locaçãoFaixa de mercadoMediana de mercadoTabela Velyrixvs medianaO que o prêmio entrega
H100 SXM — por GPU-hora$1.90 – $3.50$2.70$3.10+15%Fabric NDR 1:1 sem bloqueio, tenancy única
H200 SXM — por GPU-hora$2.40 – $4.20$3.30$3.79+15%Capacidade garantida, sem overbooking
B200 — por GPU-hora$4.00 – $7.50$5.75$6.61+15%Salas com refrigeração líquida, clocks sustentados
B300 / GB300 — por GPU-hora$5.50 – $9.00$7.25$8.34+15%Comissionamento em escala rack e CDU redundante
A100 80GB — por GPU-hora$1.10 – $2.20$1.65$1.90+15%Frota mantida, burn-in antes de cada entrega
L40S — por GPU-hora$0.75 – $1.60$1.18$1.35+15%SLA corporativo em vez de best effort
RTX 4090 — por GPU-hora$0.30 – $0.80$0.55$0.63+15%Instalação classe Tier III, não uma prateleira
8× H100 SXM 80GB nó — por mês$10,000 – $22,000$16,000$18,400+15%NOC 24×7, troca em 4 horas, relatório de aceitação
8× H200 SXM 141GB nó — por mês$13,500 – $28,000$20,750$23,900+15%Arquiteto dedicado, relatório SLA mensal
8× B200 SXM 180GB nó — por mês$21,000 – $45,000$33,000$38,000+15%Refrigeração direta ao chip, fabric validado

As faixas e medianas de mercado são observações da própria Velyrix sobre preços de tabela publicados por provedores de nuvem GPU e bare metal, oferecidas apenas como orientação; não constituem afirmação sobre os preços atuais de terceiros, e nenhuma comparação é endossada por outro provedor. As tarifas da Velyrix são preços de tabela indicativos confirmados em orçamento escrito. Compromissos plurianuais e grandes volumes recebem orçamento individual.

Incluído e opcional

O que acompanha cada servidor dedicado

  • Acesso root e BMC: IPMI/Redfish, mídia virtual, serial sobre LAN e reinicialização remota
  • O sistema operacional de sua escolha: Ubuntu, Rocky, RHEL, Debian, Windows Server ou uma imagem própria via iPXE
  • Pilha de drivers pré-validada: driver NVIDIA, CUDA, Fabric Manager, DCGM, NVIDIA Container Toolkit
  • Burn-in antes da entrega: relatório de estresse de GPU de 24 a 72 horas e validação de ECC e térmica
  • Banda: 10G sem medição ou 25/100G medidos, com dupla conexão e mitigação de DDoS
  • Suporte local: engenheiros da instalação 24×7 e meta de substituição de hardware em quatro horas
AdicionalUnidadePreço
Sistema de arquivos paralelo (WEKA/VAST)por TB / mês$42
Armazenamento em bloco NVMepor TB / mês$100
Armazenamento de objetos (API S3)por TB / mês$20
Backup e snapshotspor TB / mês$14
Uplink 100G sem mediçãopor porta / mês$1,600
IPv4 /29 adicionalpor mês$46
Interconexão privada de nuvempor 10G / mês$545
Rede InfiniBand do podpor nó / mês$805
SO gerenciado e patchespor servidor / mês$230
Slurm / Kubernetes gerenciadospor cluster / mês$2,400
Fale com um arquiteto de infraestrutura de IA

As GPUs são suas. Nós operamos.

Compre seus servidores NVIDIA do OEM ou distribuidor que preferir, envie-os para um data center da Velyrix e cuidamos do resto: implantação, rede, refrigeração, monitoramento e suporte. Ou alugue os nossos. De qualquer forma, você recebe um plano em um dia útil.

Perguntas frequentes

Qual a diferença entre um servidor GPU dedicado e uma instância de nuvem GPU?

Um servidor dedicado é uma máquina física inteira alugada a um único cliente: todas as GPUs, todos os núcleos de CPU, todos os NVMe e o BMC pertencem a você durante o prazo, sem sobrecarga de hipervisor nem tenancy compartilhada. Uma instância de nuvem é provisionada por segundo e pode ser virtualizada. Servidores dedicados costumam sair de 25 a 45 por cento mais baratos por GPU-hora em prazos de três meses ou mais.

Quanto custa alugar um servidor 8x H100 por mês?

A Velyrix lista um nó 8x NVIDIA H100 SXM a partir de US$ 18.400 por mês, caindo para US$ 16.400 em prazo de doze meses e US$ 15.600 em trinta e seis meses. O preço de tabela fica intencionalmente 15 por cento acima da mediana de mercado de cerca de US$ 16.000: reflete fabric sem bloqueio, relatório de aceitação assinado, cobertura de NOC 24x7 e meta de substituição de hardware em quatro horas, e não hospedagem de melhor esforço.

Posso alugar uma única GPU em vez de um nó inteiro?

Sim, pela nuvem GPU da Velyrix, que oferece instâncias de 1, 2, 4 e 8 GPUs cobradas por segundo. Servidores dedicados são vendidos como nós completos porque a topologia NVLink e NVSwitch dentro de uma placa HGX não pode ser dividida de forma razoável entre inquilinos.

Em quanto tempo um servidor dedicado é entregue?

Configurações em estoque numa região ativa costumam ficar prontas em duas a vinte e quatro horas. Configurações sob medida, pods grandes e nós classe Blackwell dependem dos prazos do OEM e são normalmente entregues em cinco a vinte dias úteis.

Vocês cobram por banda ou tráfego de saída?

Não. Os planos padrão incluem um uplink de 10G sem medição e sem cobrança de saída. Portas de trânsito dedicadas de maior capacidade de 25G e 100G e interconexões privadas de nuvem são cobradas como adicionais.

Posso atualizar ou trocar o hardware no meio do prazo?

Sim. Dentro de um prazo, você pode migrar para um nível superior pagando a diferença de tarifa, mantendo seus dados no mesmo armazenamento. Reduções de nível valem a partir da renovação seguinte.