होम/GPU क्लाउड
GPU क्लाउड और AI सुपरकंप्यूटिंगNVIDIA GPU क्लाउड, एक नोड से 4,096 GPU तक
सिंगल-टेनेंट NVIDIA एक्सेलेरेटर प्रति सेकंड प्रोविज़न कीजिए, या अपने प्रशिक्षण रन की अवधि के लिए पूरा InfiniBand-जुड़ा क्लस्टर रिज़र्व कीजिए। वही हार्डवेयर, वही फैब्रिक, वही इंजीनियर — आप जैसे भी खरीदें।
अपना एक्सेलेरेटर चुनिए
हर SKU सिंगल-टेनेंट बेयर-मेटल इंस्टेंस या GPU पासथ्रू वाले वर्चुअलाइज़्ड इंस्टेंस के रूप में उपलब्ध है। मल्टी-नोड SKU मानक रूप से रेल-ऑप्टिमाइज़्ड InfiniBand के साथ आते हैं।
| GPU | आर्किटेक्चर | मेमोरी / बैंडविड्थ | इंटरकनेक्ट | किसके लिए उपयुक्त | से (GPU-घंटा) |
|---|---|---|---|---|---|
| GB300 NVL72 | Blackwell Ultra | 288 GB HBM3e · 8 TB/s | NVLink 5 rack-scale + XDR 800G | ट्रिलियन-पैरामीटर प्रशिक्षण, लॉन्ग-कॉन्टेक्स्ट इन्फरेंस | $8.91 |
| B300 SXM (HGX) | Blackwell Ultra | 288 GB HBM3e · 8 TB/s | NVLink 5 + XDR 800G | फ्रंटियर प्री-ट्रेनिंग, MoE फाइन-ट्यूनिंग | $8.34 |
| B200 SXM (HGX) | Blackwell | 180 GB HBM3e · 8 TB/s | NVLink 5 + NDR/XDR | बड़े पैमाने का प्रशिक्षण, FP4 इन्फरेंस | $6.61 |
| H200 SXM (HGX) | Hopper | 141 GB HBM3e · 4.8 TB/s | NVLink 4 + NDR 400G | 70B–400B प्रशिक्षण और उच्च-थ्रूपुट सर्विंग | $3.79 |
| H100 SXM (HGX) | Hopper | 80 GB HBM3 · 3.35 TB/s | NVLink 4 + NDR 400G | सामान्य प्रशिक्षण, फाइन-ट्यूनिंग, इन्फरेंस | $3.10 |
| H100 NVL / PCIe | Hopper | 94 / 80 GB · 3.9 TB/s | NVLink bridge + 200G | इन्फरेंस घनत्व, मिश्रित वर्कलोड | $2.70 |
| A100 SXM 80GB | Ampere | 80 GB HBM2e · 2.0 TB/s | NVLink 3 + HDR 200G | लागत-अनुकूल प्रशिक्षण और बैच इन्फरेंस | $1.90 |
| A100 SXM 40GB | Ampere | 40 GB HBM2 · 1.6 TB/s | NVLink 3 + HDR 200G | लागत-अनुकूल प्रशिक्षण और बैच इन्फरेंस | $1.47 |
| RTX PRO 6000 Blackwell | Blackwell | 96 GB GDDR7 · 1.8 TB/s | PCIe Gen5 · 200G | इन्फरेंस, सिमुलेशन, ग्राफ़िक्स और Omniverse | $2.18 |
| L40S | Ada Lovelace | 48 GB GDDR6 · 864 GB/s | PCIe Gen4 · 100G | इन्फरेंस, रेंडरिंग, वीडियो, VDI | $1.35 |
| RTX 5090 | Blackwell | 32 GB GDDR7 · 1.8 TB/s | PCIe Gen5 · 100G | अनुसंधान, डिफ्यूज़न, डेवलपमेंट क्लस्टर | $0.75 |
USD में प्रति GPU-घंटा सांकेतिक ऑन-डिमांड सूची मूल्य, कर रहित। रिज़र्व्ड और प्रतिबद्ध अवधियों पर छूट है; अवधि तालिकाओं के लिए देखें मूल्य अवधि तालिकाओं के लिए।
जैसे आपकी परियोजना वित्तपोषित है, वैसे कंप्यूट खरीदिए
ऑन-डिमांड
प्रति-सेकंड बिलिंग, कोई प्रतिबद्धता नहीं। प्रयोग, मूल्यांकन हार्नेस और तात्कालिक फाइन-ट्यूनिंग के लिए आदर्श।
- प्रति इंस्टेंस 1–8 GPU
- तत्काल API / कंसोल प्रोविज़निंग
- स्नैपशॉट और पुनरारंभ
- कोई एग्रेस शुल्क नहीं
रिज़र्व्ड क्लस्टर
1–36 माह के लिए रखे गए समर्पित InfiniBand-जुड़े पॉड, नामित क्षमता और अवधि भर निश्चित दर के साथ।
- 16–4,096 GPU, नॉन-ब्लॉकिंग फैब्रिक
- प्रबंधित Slurm या Kubernetes
- ऑन-डिमांड से 55% तक कम
- अनुबंध में क्षमता गारंटी
प्राइवेट AI क्लाउड
भौतिक रूप से पृथक हॉल, फैब्रिक और स्टोरेज, जिसे Velyrix आपके नामकरण, नीतियों और ऑडिट व्यवस्था के तहत संचालित करता है।
- समर्पित केज या सुइट
- ग्राहक-प्रबंधित एन्क्रिप्शन कुंजियाँ
- एयर-गैप्ड विकल्प
- अनुकूलित SLA और परिवर्तन नियंत्रण
रेल-ऑप्टिमाइज़्ड नेटवर्किंग जो GPU को व्यस्त रखती है
प्रशिक्षण क्लस्टर उतना ही तेज़ है जितना उसका सबसे धीमा all-reduce। Velyrix हर मल्टी-नोड पॉड को समर्पित स्टोरेज और प्रबंधन प्लेन के साथ रेल-ऑप्टिमाइज़्ड, नॉन-ब्लॉकिंग फैट-ट्री पर बनाता है।
- कंप्यूट फैब्रिक: NVIDIA Quantum-2 NDR 400G या Quantum-X800 XDR 800G InfiniBand, 1:1 सब्सक्रिप्शन
- Ethernet विकल्प: RoCEv2, अनुकूली रूटिंग और कंजेशन नियंत्रण के साथ NVIDIA Spectrum-X
- इन-नेटवर्क कंप्यूट: बड़े कलेक्टिव्स पर all-reduce लेटेंसी घटाने के लिए SHARP एग्रीगेशन
- स्टोरेज प्लेन: अलग 200/400G नेटवर्क ताकि चेकपॉइंट कभी ग्रेडिएंट से न टकराएँ
- प्रबंधन प्लेन: आउट-ऑफ-बैंड BMC नेटवर्क, टेनेंट ट्रैफ़िक से पृथक
- सत्यापन: हस्तांतरण से पहले NCCL बस बैंडविड्थ और all-reduce लेटेंसी की रिपोर्ट
# 512x NVIDIA H200 SXM — XDR 800G rail-optimised nccl-tests/all_reduce_perf -b 8 -e 8G -f 2 -g 8 size busbw algbw status 1.00 GB 372.4 GB/s 198.1 GB/s PASS 4.00 GB 381.9 GB/s 203.7 GB/s PASS 8.00 GB 384.6 GB/s 205.1 GB/s PASS fabric : 1:1 non-blocking, 0 link errors / 72h gpu_burnin : 72h @ 100% — 0 XID, 0 ECC row remaps sustained : 48.9% MFU, Llama-class 70B reference run
Velyrix स्वीकृति परीक्षण के प्रतिनिधि आँकड़े। परिणाम टोपोलॉजी, मॉडल, बैच आकार और सॉफ़्टवेयर स्टैक के अनुसार बदलते हैं; आपके क्लस्टर को अलग से मापा और रिपोर्ट किया जाता है।
अपने स्टैक के साथ आइए, माइग्रेशन परियोजना के साथ नहीं
प्रबंधित Slurm
Pyxis/Enroot, फेयर-शेयर अकाउंटिंग, टोपोलॉजी-सचेत शेड्यूलिंग और लंबे प्री-ट्रेनिंग रन के लिए चेकपॉइंट-रीस्टार्ट हुक के साथ पूर्व-निर्मित Slurm।
प्रबंधित Kubernetes
NVIDIA GPU Operator, Network Operator, MIG प्रोफ़ाइल, KubeRay और Kueue के साथ CNCF-अनुरूप क्लस्टर, मल्टी-टेनेंट शेड्यूलिंग हेतु।
बेयर-मेटल API
इमेज डिप्लॉयमेंट, iPXE बूट, BMC नियंत्रण और फैब्रिक विभाजन के लिए Terraform प्रोवाइडर और REST API — ऊपर अपना कंट्रोल प्लेन बनाइए।
कंटेनर रजिस्ट्री
NGC, Docker Hub और निजी इमेज के लिए क्षेत्र-स्थानीय रजिस्ट्री व कैश, ताकि 40 GB पुल 512-GPU जॉब लॉन्च को न रोकें।
ऑब्ज़र्वेबिलिटी
प्रति-जॉब GPU उपयोग, पावर, तापमान, XID घटनाएँ और फैब्रिक काउंटर के साथ DCGM, Prometheus और Grafana — आपके अपने SIEM में निर्यात योग्य।
फ्रेमवर्क
PyTorch, JAX, NeMo, Megatron-LM, DeepSpeed, TorchTitan, vLLM, SGLang और TensorRT-LLM के लिए सत्यापित इमेज, मासिक रूप से अद्यतन।
पहली जॉब चलने से पहले आपको क्या मिलता है
आपके टोकन बजट के अनुरूप उच्च-प्रदर्शन पैरेलल फाइल सिस्टम (WEKA या VAST), साथ ही डेटासेट और चेकपॉइंट के लिए S3-संगत ऑब्जेक्ट स्टोरेज। प्रति नोड 10 TB NVMe स्क्रैच शामिल।
नॉन-ब्लॉकिंग InfiniBand या Spectrum-X कंप्यूट फैब्रिक, दोहरा 100G इंटरनेट ट्रांज़िट, AWS, Azure, GCP और Oracle से प्राइवेट इंटरकनेक्ट, तथा BGP/IP ट्रांज़िट विकल्प। मानक योजनाओं पर कोई एग्रेस शुल्क नहीं।
सिंगल-टेनेंट होस्ट, पृथक VLAN/VRF और फैब्रिक विभाजन, सिक्योर-बूट फर्मवेयर अटेस्टेशन, ग्राहक-प्रबंधित कुंजियाँ, और डीकमीशन पर पूर्ण वाइप-एंड-वेरिफ़ाई (NIST SP 800-88 पर्ज)।
24×7 NOC, नामित समाधान आर्किटेक्ट, 15-मिनट P1 प्रतिक्रिया, साइट पर चार घंटे का हार्डवेयर प्रतिस्थापन लक्ष्य, और अनुबंधित उपलब्धता के विरुद्ध मासिक SLA रिपोर्टिंग।
हस्तांतरण से पहले: 72-घंटे GPU बर्न-इन, मेमोरी व ECC सत्यापन, NCCL बैंडविड्थ परीक्षण, फैब्रिक त्रुटि स्कैन और हस्ताक्षरित स्वीकृति रिपोर्ट जिसे आप अपने ऑडिटरों को सौंप सकते हैं।
GPU आपके। संचालन हमारा।
अपने NVIDIA सर्वर किसी भी अधिकृत OEM या वितरक से खरीदें, उन्हें सीधे Velyrix सुविधा भेजें, और बाकी काम हम संभालते हैं — तैनाती, नेटवर्किंग, कूलिंग, निगरानी और निरंतर सहायता। या हमारे GPU किराए पर लें। दोनों ही स्थितियों में आपको एक कार्यदिवस में योजना मिलती है।
अक्सर पूछे जाने वाले प्रश्न
Velyrix GPU क्लाउड का बिल कैसे बनता है?
ऑन-डिमांड इंस्टेंस प्रति सेकंड बिल होते हैं, बिना न्यूनतम अवधि और मानक योजनाओं पर बिना डेटा एग्रेस शुल्क। रिज़र्व्ड क्लस्टर एक से छत्तीस माह की अवधि के लिए निश्चित अनुबंधित दर पर मासिक बिल होते हैं। एंटरप्राइज़ प्राइवेट क्लाउड निश्चित मासिक प्लेटफ़ॉर्म शुल्क और क्षमता के रूप में कोट किए जाते हैं।
मुझे बेयर मेटल मिलता है या वर्चुअल मशीन?
दोनों उपलब्ध हैं। मल्टी-नोड प्रशिक्षण के लिए डिफ़ॉल्ट सिंगल-टेनेंट बेयर मेटल है, जिसमें GPU, NIC और NVMe तक सीधी पहुँच होती है। जहाँ स्नैपशॉटिंग और तेज़ री-इमेजिंग प्रदर्शन के अंतिम कुछ प्रतिशत से अधिक महत्वपूर्ण हो, वहाँ GPU पासथ्रू वाले वर्चुअलाइज़्ड इंस्टेंस दिए जाते हैं।
मल्टी-नोड प्रशिक्षण क्लस्टर कौन-सा नेटवर्क उपयोग करते हैं?
रेल-ऑप्टिमाइज़्ड नॉन-ब्लॉकिंग InfiniBand - NVIDIA Quantum-2 NDR 400G पर या Quantum-X800 XDR 800G प्रति GPU - SHARP इन-नेटवर्क रिडक्शन के साथ। जहाँ केवल-Ethernet परिचालन मॉडल आवश्यक हो, वहाँ RoCEv2 सहित NVIDIA Spectrum-X Ethernet उपलब्ध है।
क्या मैं एक ही क्लस्टर पर Slurm और Kubernetes चला सकता हूँ?
हाँ। Velyrix आमतौर पर रिज़र्व्ड क्लस्टर को विभाजित करता है ताकि Slurm विभाजन लंबे प्रशिक्षण रन संभाले जबकि Kubernetes विभाजन इन्फ़रेंस दे, दोनों में साझा पैरेलल फाइल सिस्टम के साथ। अवधि के दौरान विभाजन आकार समायोजित किए जा सकते हैं।
क्या बड़े क्लस्टरों के लिए न्यूनतम प्रतिबद्धता है?
256 से अधिक GPU वाले क्लस्टर सामान्यतः न्यूनतम तीन माह के लिए अनुबंधित होते हैं, क्योंकि फैब्रिक निर्माण और केबलिंग का कार्य लगता है। जिन हॉल में समकक्ष पॉड पहले से बना और खाली है, वहाँ छोटी अवधि भी संभव है।