BYOG 自带 GPU  任意 OEM 采购 · 直发我们机房 · 我们负责运营

GPU 你来买,AI 工厂我们替你建

从任何一家授权 OEM 或代理商采购你的 NVIDIA GPU 服务器,直接发货到 Velyrix 机房,我们的工程团队 负责部署、组网、散热、集群配置、监控与长期支持。不想持有硬件?也可以直接租用我们机队里同级别的集群。 无论哪种方式,从卸货平台到模型跑起来,只对接一个合作方。

0%对你自购硬件不赚任何差价
72 小时交付前烤机并签署验收报告
15 分钟写入合同的 P1 响应,7×24
3.2 Tb/s单节点无阻塞 InfiniBand XDR
NVIDIA HGX B300GB300 NVL72HGX B200HGX H200HGX H100 Quantum-X800 InfiniBandSpectrum-X 以太网BlueField-3 DPU 芯片级液冷 DLCSlurm 与 KubernetesvLLM / SGLang / TensorRT-LLM WEKA 与 VAST 并行存储OCP ORv3
我们最大的优势 — BYOG

BYOG 自带 GPU:硬件你买,只要你还在用,运营就由我们负责

从任何一家授权 OEM 或代理商采购你的 NVIDIA GPU 服务器 — Dell、Supermicro、GIGABYTE、 HPE、Lenovo 或其他厂商都可以。直接发货到我们的机房,我们的工程团队会负责部署、组网、散热、集群配置、 监控与长期支持。我们不靠卖你服务器赚钱,我们靠帮你把这些服务器跑好赚钱。

任意 OEM 采购你的供应商、你的价格、你的保修。不需要通过我们下单。
直发到我们机房货运直达我们的卸货平台。收货、检验、拍照、逐台登记序列号。
我们负责部署上架、供电、风冷或液冷、结构化布线与 rail-optimized 网络。
我们负责验证固件基线、72 小时烤机、NCCL 基准测试、签署验收报告。
我们负责运维7×24 NOC、监控、代你向 OEM 走 RMA、备件与生命周期管理。

我们提供可选的采购协助 — 配置评审、厂商中立的平台对比、真实交期 情报 — 但你永远没有义务通过 Velyrix 采购硬件,两种方式下你拿到的价格完全一样。

全栈 AI 基础设施

与 Velyrix 合作的九种方式

把你自己的硬件放进我们的机房、按小时租用、包下一个私有集群、让我们把整个 AI 工厂建好 并完成验收 — 或者把这一切挂上你自己的品牌来卖。

📦

BYOG 自带 GPU

NVIDIA 服务器你从任意 OEM 采购并持有资产,我们负责部署、散热、组网、监控与支持 — 不赚硬件差价,也没有捆绑。

  • 任意授权 OEM 或代理商
  • 不影响原厂保修的安装规范
  • 可选的采购协助
了解 BYOG →

GPU 云

按需与预留的 NVIDIA GPU 实例,支持 InfiniBand 多节点训练、Slurm 或 Kubernetes,按秒计费。

  • H100、H200、B200、B300 与 GB300
  • 8 – 4,096 卡集群
  • 90 秒内开通
了解 GPU 云 →

独立 GPU 服务器

按月或按年的单租户裸金属。Root 权限、无虚拟化损耗、无邻居干扰、价格公开透明。

  • 8×H100 / H200 / B200 节点
  • A100、L40S、RTX PRO 6000
  • 1 – 36 个月租期
查看机型与价格 →

AI 机房托管

把你自有的 HGX、DGX、MGX 或 OEM GPU 系统放进为 40–160 kW 机柜设计的液冷机房。

  • 风冷、背板换热器与芯片级液冷
  • 笼位、独立套间或批发式机房
  • 7×24 现场支持
了解机房托管 →

AI 基础设施部署与验收

交钥匙交付:场地勘察、上架布线、网络组建、固件、烤机、NCCL 验证与书面验收测试。

  • 全新 AI 工厂交付
  • InfiniBand 与 Spectrum-X 组网
  • 签署版验收测试报告
查看交付流程 →

私有大模型部署与优化

属于你自己的 DeepSeek、Qwen、Llama、GPT-OSS、Mistral、GLM、Kimi、MiniMax、Gemma 或 Nemotron 推理端点 — 调优、量化,并支持完全离线。

  • vLLM、SGLang 与 TensorRT-LLM
  • FP8 / FP4 / AWQ 量化
  • LoRA 微调与 RAG
部署私有模型 →

存储、网络与托管运维

并行文件系统、对象存储、400G 出口、云专线,以及替你把集群跑起来的 7×24 NOC。

  • WEKA / VAST / Ceph 分层
  • Slurm 与 Kubernetes 托管
  • 可观测性与 SLA 报告
了解平台能力 →

迁移、审计与生命周期

把在运行的 GPU 机队在机房或服务商之间搬迁,或者请一支独立的工程团队告诉你现有集群为什么跑不满。

  • 分阶段迁移,尽量不中断训练
  • 网络、固件与 MFU 健康审计
  • 换代与合规下架
查看生命周期服务 →
🤝

OEM 与渠道合作伙伴

你卖出去的硬件,背后的部署与支持由我们承担 — 可挂你的品牌,配套项目报备与书面的渠道中立政策。

  • 白标部署与验收报告
  • L1–L3 支持、RMA 与备件
  • 我们自己从不转售服务器
合作伙伴计划 →
Velyrix 机队

每一代 NVIDIA 加速卡,同一个运营体系

从用于低成本推理的 Ampere,到用于万亿参数训练的 Blackwell Ultra 整机柜,Velyrix 对整个机队 采用同一套运营模型 — 同样的网络设计、同样的监控、同样的 SLA。

  • Blackwell Ultra:NVIDIA GB300 NVL72 与 HGX B300,部署于芯片级液冷机房
  • Blackwell:HGX B200 八卡节点,单节点 1.4 TB HBM3e
  • Hopper:规模化的 HGX H200 与 H100 SXM,所有区域现货可用
  • Ampere 与 Ada:A100 80GB、L40S 与 RTX PRO 6000 Blackwell,用于推理与图形
GB300 NVL72 — 72 卡整机柜~132 kW
HGX B300 八卡节点~14.3 kW
HGX B200 八卡节点~10.2 kW
HGX H200 八卡节点~10.2 kW
HGX H100 八卡节点~10.2 kW
HGX A100 八卡节点~6.5 kW
L40S / RTX PRO 6000 — 8× PCIe~4.2 kW
Quantum-X800 XDR 叶/脊交换800G
Spectrum-X SN5600 以太网800G

以上为容量规划所用的机柜与节点功耗参考值。实际功耗取决于 OEM 机箱、散热方式与业务负载。

参考价格

价格公开,先看清楚再谈

以下为单租户算力的起步价。多节点预留集群与 12–36 个月合约单独报价 — 承诺量越大, 实际价格明显低于此表。

加速卡显存按需预留 6 个月八卡节点 / 月状态
GB300 NVL72288 GB HBM3e$8.91 起$8.20整机柜 — 单独报价2026 Q4
B300 SXM288 GB HBM3e$8.34 起$7.67$44,800 起少量
B200 SXM180 GB HBM3e$6.61 起$6.08$38,000 起现货
H200 SXM141 GB HBM3e$3.79 起$3.49$23,900 起现货
H100 SXM80 GB HBM3$3.10 起$2.85$18,400 起现货
A100 SXM 80GB80 GB HBM2e$1.90 起$1.75$10,400 起现货

以上为 2026 年 9 月的美元参考标价,不含税。Velyrix 的标价比市场中位价高 15%, 这部分溢价换来的是无阻塞网络、签署版验收报告、四小时硬件更换与凌晨三点也有人接电话的运维团队。价格随 区域、租期、存储与流量方案变化,以书面报价单为准。完整价格见价格页

私有大模型部署

把开源前沿模型跑在你自己的边界之内

Velyrix 在专属硬件、你的托管机房,或完全物理隔离的本地环境中,为你部署、量化并优化 主流开源权重模型 — 提供兼容 OpenAI 接口的 API,并以实测 tokens/s 作为验收标准。

DeepSeekQwen LlamaOpenAI gpt-oss MistralGLM KimiMiniMax GemmaNVIDIA Nemotron
velyrix-inference-endpoint.sh
# 你自己的推理端点 — 数据不出你的 VPC
curl https://llm.internal.acme.com/v1/chat/completions \
  -H "Authorization: Bearer $VELYRIX_KEY" \
  -d '{
    "model": "deepseek-v3-fp8",
    "messages": [{"role":"user","content":"总结第三季度风险报告"}],
    "max_tokens": 1024
  }'

# 运行于 8× NVIDIA H200 上的 vLLM — 交付时实测
throughput  : 14,850 tok/s 总吞吐
ttft_p95    : 218 ms
availability: 99.9% 月度 SLA
厂商中立

不管你买的是哪家,我们都知道怎么部署

对于市场上真正在出货的平台,Velyrix 都有一套经过验证的部署手册 — 机柜立面图、 配电方案、散热方式、布线图与验收测试方案。

Dell TechnologiesPowerEdge XE9680 · XE9712
SupermicroSYS-821GE · GB300 NVL72
GIGABYTEG593 · G894 · XL44
HPECray XD670 · XD685
LenovoSR675 V3 · SR685a V3

同时支持 NVIDIA DGX、ASUS、QCT、Wiwynn 与 Foxconn ORv3 设计。上述平台名称为各自所有者的 商标,此处仅用于说明我们的部署能力。你是 OEM、代理商或经销商? 请看我们的合作伙伴计划

我们的交付范围

18 个国家的 25 个市场 — 每一个都没有出口管制风险

Velyrix 只在「先进 NVIDIA 加速卡可以合法部署、且没有许可风险」的司法辖区放置算力,机房均为 中立、经独立审计的合作数据中心。其中两个市场今天已锁定容量,其余按你的具体需求开通。我们会在你做决定 之前说明区别 — 详见完整状态表

Ashburn(弗吉尼亚)已运营 — 已锁定容量
美国 · 最高 160 kW
US-EAST-1 · H100 / H200 / B200 / GB300
Dallas(得州)已运营 — 已锁定容量
美国 · 最高 160 kW
US-CENTRAL-1 · H200 / B200 / B300
Chicago(伊利诺伊)按需开通
美国 · 最高 80 kW
US-CENTRAL-2 · H100 / H200
Phoenix(亚利桑那)按需开通
美国 · 最高 80 kW
US-WEST-2 · H100 / A100 / L40S
Santa Clara(加州)按需开通
美国 · 最高 60 kW
US-WEST-1 · H100 / H200
Montreal(魁北克)按需开通
加拿大 · 最高 120 kW
CA-EAST-1 · H100 / H200 / B200
Toronto(安大略)按需开通
加拿大 · 最高 60 kW
CA-EAST-2 · H100 / L40S
Querétaro按需开通
墨西哥 · 最高 80 kW
MX-CENTRAL-1 · H100 / H200
Monterrey计划 2027
墨西哥 · 最高 120 kW
MX-NORTH-1 · H200 / B200
London按需开通
英国 · 最高 80 kW
EU-WEST-2 · H100 / H200
Dublin按需开通
爱尔兰 · 最高 60 kW
EU-WEST-1 · H100 / L40S
Paris按需开通
法国 · 最高 100 kW
EU-WEST-3 · H200 / B200
Frankfurt按需开通
德国 · 最高 120 kW
EU-CENTRAL-1 · H200 / B200
Amsterdam按需开通
荷兰 · 最高 60 kW
EU-WEST-4 · H100 / L40S
Madrid按需开通
西班牙 · 最高 80 kW
EU-SOUTH-1 · H100 / H200
Milan计划 2027
意大利 · 最高 80 kW
EU-SOUTH-2 · H200 / B200
Stockholm计划 2027
瑞典 · 最高 160 kW
EU-NORTH-1 · B200 / B300
Helsinki计划 2027
芬兰 · 最高 160 kW
EU-NORTH-3 · B200 / B300
Warsaw计划 2027
波兰 · 最高 80 kW
EU-CENTRAL-2 · H100 / H200
Tokyo按需开通
日本 · 最高 80 kW
AP-NORTHEAST-1 · H100 / H200
Osaka计划 2027
日本 · 最高 120 kW
AP-NORTHEAST-3 · H200 / B200
Seoul按需开通
韩国 · 最高 100 kW
AP-NORTHEAST-2 · H100 / H200
Taipei按需开通
台湾 · 最高 100 kW
AP-EAST-2 · H100 / H200 / B200
Sydney按需开通
澳大利亚 · 最高 80 kW
AP-SOUTHEAST-2 · H100 / H200
Auckland计划 2027
新西兰 · 最高 60 kW
AP-SOUTHEAST-5 · H100 / L40S

"已运营"指 Velyrix 今天已签下空间与电力;"按需开通"指我们会针对你的具体需求去签空间, 通常额外需要两到六周;"计划中"表示仍在谈判,我们不会据此接单。清单上的每一个市场都是我们所部署加速卡的 许可目的地,每一笔订单在发货前都会完成筛查,详见贸易合规我们如何挑选国家

为什么选择 Velyrix

按超大规模数据中心的标准建设,按专业团队的节奏响应

以周计,而不是以季度计

预留集群 4–8 周交付;按需算力几分钟内可用。全新 AI 工厂 12–20 周完成建设与验收。

📊

看有效算力,而不只是峰值 FLOPS

我们以实测集群有效吞吐作为合同指标。每次交付都附带 NCCL 总线带宽与持续 MFU 验收数据。

🔒

默认单租户

独占主机、独占网络分区、客户自持加密密钥,并可选择完全物理隔离的专属区域。

能效优先的设计

目标 PUE 1.15–1.25,采用芯片级液冷,具备条件的机房提供余热回收,并以绿电方式签约。

与其在这里堆客户 logo,我们更愿意把承诺写进合同:付款前实测的验收标准、无需申请即自动生效的 服务赔付、BYOG 托管可按月签约,以及那位亲手建好你集群的工程师的直拨电话。

常见问题

我可以把自己买的 GPU 服务器放到你们这里吗?

可以,这正是我们的主打模式 BYOG(自带 GPU)。你从任何一家授权 OEM 或代理商采购 NVIDIA GPU 服务器,直接发货到 Velyrix 机房,我们的工程团队负责部署、组网、散热、集群配置、监控与长期支持。硬件所有权、保修与 OEM 关系都留在你手里;我们也提供可选的采购协助,但绝不强制。

什么是 neocloud?Velyrix 和超大规模云有什么不同?

neocloud 是专为加速计算而生的云服务商,而不是通用 IT 云。Velyrix 只做 AI 基础设施:高密度液冷机房、NVIDIA GPU 机队、无损 InfiniBand 与 Spectrum-X 网络以及并行存储。因此我们的单机柜 GPU 密度更高、默认提供无阻塞网络、价格公开,并且你可以直接联系到建设你集群的那批工程师。

Velyrix 支持哪些 NVIDIA GPU?

包括 NVIDIA GB300 NVL72、HGX B300、HGX B200、HGX H200、HGX H100、HGX A100、L40S 以及 RTX PRO 6000 Blackwell,覆盖主流 OEM 机型,可作为 GPU 云实例、独立裸金属服务器,或客户自有硬件托管在 Velyrix 机房。

集群多快能交付?

按需 GPU 云实例 90 秒内启动。现有机房中的预留多节点集群通常 4–8 周上线。包含网络、散热与验收的全新 AI 工厂建设一般为 12–20 周,主要取决于硬件交期。

你们能帮我们部署自己的大模型吗?

可以。我们的私有大模型部署与优化服务,会在你可控的基础设施上安装、量化、基准测试并运营 DeepSeek、Qwen、Llama、OpenAI gpt-oss、Mistral、GLM、Kimi、MiniMax、Gemma 与 NVIDIA Nemotron 等开源权重模型,通过兼容 OpenAI 的 API 提供服务,并对吞吐与时延写入合同。