Traga suas próprias GPUs. Construímos a fábrica de IA em volta delas.
Compre seus servidores NVIDIA GPU de qualquer OEM ou distribuidor autorizado, envie-os diretamente para uma instalação da Velyrix e nossa equipe de engenharia cuida da implantação, rede, refrigeração, configuração do cluster, monitoramento e suporte contínuo. Prefere não ser dono do hardware? Alugue a mesma classe de cluster da nossa frota. De qualquer forma, um único parceiro da doca de carga ao modelo em produção.
Traga sua própria GPU: você compra o hardware, nós operamos enquanto ele for seu
Compre seus servidores NVIDIA GPU de qualquer OEM ou distribuidor autorizado — Dell, Supermicro, GIGABYTE, HPE, Lenovo ou outro. Envie-os diretamente para nossa instalação e nossa equipe de engenharia cuidará da implantação, rede, refrigeração, configuração do cluster, monitoramento e suporte contínuo. Não ganhamos dinheiro com seus servidores. Ganhamos dinheiro mantendo-os funcionando.
A assistência de compra está disponível — revisão de configuração, comparação neutra de plataformas e informações reais de prazo — mas você nunca precisa comprar hardware pela Velyrix, e seu preço é idêntico nos dois casos.
Nove formas de trabalhar com a Velyrix
Traga seu próprio hardware para nossas salas, alugue por hora, reserve um cluster privado, deixe que construímos e comissionamos toda a fábrica de IA — ou revenda tudo isso sob sua própria marca.
Traga sua própria GPU
Você compra os servidores NVIDIA de qualquer OEM e mantém o ativo. Nós implantamos, refrigeramos, conectamos, monitoramos e damos suporte — sem margem sobre o hardware e sem amarras.
- Qualquer OEM ou distribuidor autorizado
- Instalação que preserva a garantia
- Assistência de compra opcional
Nuvem GPU
Instâncias NVIDIA GPU sob demanda e reservadas, com treinamento multinó conectado por InfiniBand, Slurm ou Kubernetes, e cobrança por segundo.
- H100, H200, B200, B300 e GB300
- Clusters de 8 a 4.096 GPUs
- Ativação em menos de 90 segundos
Servidores GPU dedicados
Bare metal de inquilino único por mês ou ano. Acesso root, sem custo de hipervisor, sem vizinhos barulhentos, preços publicados com transparência.
- Nós 8×H100 / H200 / B200
- A100, L40S, RTX PRO 6000
- Contratos de 1 a 36 meses
Colocation de IA
Traga seus sistemas HGX, DGX, MGX ou GPU de OEM para salas refrigeradas a líquido projetadas para racks de 40 a 160 kW.
- Ar, RDHx e líquido direto ao chip
- Jaula, sala privativa ou atacado
- Suporte local 24×7
Implantação e comissionamento de infraestrutura de IA
Construção chave na mão: vistoria de site, montagem em rack, cabeamento de fabric, firmware, burn-in, validação NCCL e testes de aceitação documentados.
- Entrega de fábricas de IA novas
- Construção de fabric InfiniBand e Spectrum-X
- Relatórios de aceitação assinados
Implantação e otimização de LLM privados
Seu próprio endpoint DeepSeek, Qwen, Llama, GPT-OSS, Mistral, GLM, Kimi, MiniMax, Gemma ou Nemotron — ajustado, quantizado e pronto para ambientes isolados.
- Serviço com vLLM, SGLang e TensorRT-LLM
- Quantização FP8 / FP4 / AWQ
- Fine-tuning LoRA e RAG
Armazenamento, rede e operação gerenciada
Sistemas de arquivos paralelos, armazenamento de objetos, trânsito de 400G, interconexão privada e um NOC 24×7 que opera o cluster por você.
- Camadas WEKA / VAST / Ceph
- Slurm e Kubernetes gerenciados
- Observabilidade e relatórios de SLA
Migração, auditoria e ciclo de vida
Mova uma frota GPU em produção entre salas ou provedores, ou peça a uma equipe de engenharia independente que explique por que seu cluster atual rende abaixo do esperado.
- Migração em fases com mínima interrupção
- Auditoria de fabric, firmware e MFU
- Renovação e descomissionamento certificado
Parceiros OEM e de canal
Somos a equipe de implantação e suporte por trás do hardware que você vende — sob sua marca, com registro de oportunidade e uma política escrita de neutralidade de canal.
- Implantação white-label e ATP
- Suporte L1–L3, RMA e peças
- Nunca revendemos servidores por conta própria
Todas as gerações de aceleradores NVIDIA, em um só operador
Da Ampere para inferência otimizada em custo aos racks Blackwell Ultra para treinamento de trilhões de parâmetros, a Velyrix aplica um único modelo operacional a toda a frota — o mesmo projeto de fabric, o mesmo monitoramento, o mesmo SLA.
- Blackwell Ultra: NVIDIA GB300 NVL72 e HGX B300 em salas refrigeradas a líquido direto ao chip
- Blackwell: Nós HGX B200 de 8 GPUs com 1,4 TB de HBM3e por nó
- Hopper: HGX H200 e H100 SXM em escala, disponíveis hoje em todas as regiões
- Ampere e Ada: A100 80GB, L40S e RTX PRO 6000 Blackwell para inferência e visualização
Envelopes de potência indicativos por rack e por nó usados para planejamento de capacidade. O consumo real depende do chassi do OEM, do método de refrigeração e do perfil da carga.
Preços de GPU transparentes, publicados de antemão
Tarifas iniciais para capacidade de inquilino único. Clusters reservados multinó e contratos de 12 a 36 meses recebem orçamento individual — compromissos maiores ficam bem abaixo destes números.
| Acelerador | Memória | Sob demanda | Reserva 6 meses | Nó de 8 GPU / mês | Status |
|---|---|---|---|---|---|
| GB300 NVL72 | 288 GB HBM3e | a partir de $8.91 | $8.20 | Escala rack — sob consulta | T4 2026 |
| B300 SXM | 288 GB HBM3e | a partir de $8.34 | $7.67 | a partir de $44,800 | Limitado |
| B200 SXM | 180 GB HBM3e | a partir de $6.61 | $6.08 | a partir de $38,000 | Disponível |
| H200 SXM | 141 GB HBM3e | a partir de $3.79 | $3.49 | a partir de $23,900 | Disponível |
| H100 SXM | 80 GB HBM3 | a partir de $3.10 | $2.85 | a partir de $18,400 | Disponível |
| A100 SXM 80GB | 80 GB HBM2e | a partir de $1.90 | $1.75 | a partir de $10,400 | Disponível |
Preços de tabela indicativos em USD, sem impostos, vigentes em setembro de 2026. Os preços variam conforme região, prazo, armazenamento e perfil de tráfego, e são confirmados em orçamento escrito. Veja a tabela de preços completa.
Execute modelos de pesos abertos de fronteira dentro do seu próprio perímetro
A Velyrix implanta, quantiza e otimiza as principais famílias de modelos de pesos abertos em hardware dedicado da Velyrix, no seu próprio espaço de colocation ou totalmente isolado on-premise — com uma API compatível com OpenAI e critérios de aceitação medidos em tokens por segundo.
# Your private endpoint — no data leaves your VPC curl https://llm.internal.acme.com/v1/chat/completions \ -H "Authorization: Bearer $VELYRIX_KEY" \ -d '{ "model": "deepseek-v3-fp8", "messages": [{"role":"user","content":"Summarise Q3 risk report"}], "max_tokens": 1024 }' # Served by vLLM on 8x NVIDIA H200 — measured at handover throughput : 14,850 tok/s aggregate ttft_p95 : 218 ms availability: 99.9% monthly SLA
25 mercados em 18 países — todos livres de risco de exportação
A Velyrix só instala capacidade em jurisdições onde aceleradores NVIDIA avançados podem ser implantados legalmente e sem risco de licenciamento, dentro de data centers parceiros neutros e auditados de forma independente. Dois mercados estão ativos com capacidade reservada hoje; os demais são entregues sob demanda conforme sua necessidade específica. Dizemos qual é qual antes de qualquer compromisso — veja a tabela de status completa.
"Ativo" significa que a Velyrix tem espaço e energia contratados hoje. "Sob demanda" significa que contratamos espaço conforme sua necessidade específica, somando cerca de duas a seis semanas. "Previsto" significa que ainda está em negociação e não aceitaremos pedidos com base nisso. Todos os mercados desta lista são destinos permitidos para os aceleradores que implantamos, e cada pedido passa por verificação antes do envio; veja conformidade comercial e como escolhemos os países.
Seja o que você comprar, sabemos implantar
A Velyrix mantém manuais de implantação validados — elevação de rack, plano de energia, método de refrigeração, plano de cabeamento e perfil de aceitação — para as plataformas que o mercado realmente entrega.
Também projetos NVIDIA DGX, ASUS, QCT, Wiwynn e Foxconn ORv3. Os nomes de plataforma são marcas de seus respectivos proprietários, citados para descrever nossa capacidade de implantação. Você é OEM, distribuidor ou revendedor? Veja nosso programa de parceiros.
Engenharia de hyperscaler, agilidade de especialista
Semanas, não trimestres
Clusters reservados entregues em 4 a 8 semanas; capacidade sob demanda ativa em minutos. Fábricas de IA novas comissionadas em 12 a 20 semanas.
Throughput útil, não apenas FLOPS
Contratamos com base no throughput útil medido do cluster. Cada entrega inclui números de aceitação de banda NCCL e MFU sustentada — e se não atingirmos o valor acordado, corrigimos por nossa conta.
Inquilino único por padrão
Hosts dedicados, partições de fabric dedicadas, chaves de criptografia sob guarda do cliente e enclaves isolados opcionais.
Eficiente por projeto
PUE de projeto de 1,15 a 1,25 com refrigeração líquida direta ao chip, reaproveitamento de calor quando possível e contratação de energia renovável.
Preferimos preencher este espaço com compromissos em vez de logotipos. Então eis o que entra no seu contrato: critérios de aceitação medidos e testados antes do pagamento, créditos de serviço aplicados automaticamente sem processo de reclamação, prazos mensais disponíveis na hospedagem BYOG e o telefone direto do engenheiro que construiu seu cluster.
Perguntas frequentes
Posso levar servidores GPU que eu mesmo comprei?
Sim — esse é nosso modelo principal, Traga sua própria GPU. Compre servidores NVIDIA GPU de qualquer OEM ou distribuidor autorizado, envie-os diretamente para uma instalação da Velyrix e nossa equipe de engenharia cuida da implantação, rede, refrigeração, configuração do cluster, monitoramento e suporte contínuo. Você mantém a propriedade, a garantia e o relacionamento com o OEM; a assistência de compra é opcional e nunca obrigatória.
O que é uma neocloud e em que a Velyrix difere de um hyperscaler?
Uma neocloud é um provedor de nuvem criado especificamente para computação acelerada, em vez de TI de propósito geral. A Velyrix opera apenas infraestrutura de IA: salas de alta densidade refrigeradas a líquido, frotas de GPUs NVIDIA, fabrics InfiniBand e Spectrum-X sem perdas e armazenamento paralelo. Esse foco significa maior densidade de GPU por rack, fabrics sem bloqueio como padrão, preços publicados e acesso direto aos engenheiros que construíram seu cluster.
Quais GPUs NVIDIA posso alugar ou hospedar na Velyrix?
A Velyrix suporta sistemas NVIDIA GB300 NVL72, HGX B300, HGX B200, HGX H200, HGX H100, HGX A100, L40S e RTX PRO 6000 Blackwell dos principais OEMs, disponíveis como instâncias de nuvem GPU, servidores dedicados bare metal ou hardware do cliente hospedado em colocation da Velyrix.
Posso levar meus próprios servidores GPU em vez de alugar?
Sim. A colocation da Velyrix é projetada para racks de 40 a 160 kW com ar, trocador de porta traseira e refrigeração líquida direta ao chip, e aceita sistemas HGX, DGX, MGX e OCP ORv3 da Dell, Supermicro, HPE, Lenovo, Gigabyte, QCT e outros. Também podemos implantar e comissionar o hardware por você.
Em quanto tempo um cluster pode ser entregue?
Instâncias de nuvem GPU sob demanda iniciam em menos de 90 segundos. Clusters reservados multinó em uma sala existente costumam estar ativos em 4 a 8 semanas. A construção de uma fábrica de IA nova, incluindo fabric, refrigeração e comissionamento, leva normalmente de 12 a 20 semanas conforme os prazos do hardware.
Vocês ajudam a implantar nosso próprio LLM em vez de usar uma API pública?
Sim. Nosso serviço de Implantação e Otimização de LLM Privados instala, quantiza, mede e opera modelos de pesos abertos como DeepSeek, Qwen, Llama, OpenAI gpt-oss, Mistral, GLM, Kimi, MiniMax, Gemma e NVIDIA Nemotron em infraestrutura que você controla, expostos por uma API compatível com OpenAI e com metas contratadas de throughput e latência.