होम/GPU क्लाउड

GPU क्लाउड और AI सुपरकंप्यूटिंग

NVIDIA GPU क्लाउड, एक नोड से 4,096 GPU तक

सिंगल-टेनेंट NVIDIA एक्सेलेरेटर प्रति सेकंड प्रोविज़न कीजिए, या अपने प्रशिक्षण रन की अवधि के लिए पूरा InfiniBand-जुड़ा क्लस्टर रिज़र्व कीजिए। वही हार्डवेयर, वही फैब्रिक, वही इंजीनियर — आप जैसे भी खरीदें।

प्रोविज़निंग
< 90 सेकंड
बिलिंग
प्रति सेकंड, कोई एग्रेस शुल्क नहीं
फैब्रिक
400G / 800G नॉन-ब्लॉकिंग
अधिकतम क्लस्टर
एकल फैब्रिक में 4,096 GPU
अपटाइम SLA
99.99% इंफ्रास्ट्रक्चर
GPU कैटलॉग

अपना एक्सेलेरेटर चुनिए

हर SKU सिंगल-टेनेंट बेयर-मेटल इंस्टेंस या GPU पासथ्रू वाले वर्चुअलाइज़्ड इंस्टेंस के रूप में उपलब्ध है। मल्टी-नोड SKU मानक रूप से रेल-ऑप्टिमाइज़्ड InfiniBand के साथ आते हैं।

GPUआर्किटेक्चरमेमोरी / बैंडविड्थइंटरकनेक्टकिसके लिए उपयुक्तसे (GPU-घंटा)
GB300 NVL72Blackwell Ultra288 GB HBM3e · 8 TB/sNVLink 5 rack-scale + XDR 800Gट्रिलियन-पैरामीटर प्रशिक्षण, लॉन्ग-कॉन्टेक्स्ट इन्फरेंस$8.91
B300 SXM (HGX)Blackwell Ultra288 GB HBM3e · 8 TB/sNVLink 5 + XDR 800Gफ्रंटियर प्री-ट्रेनिंग, MoE फाइन-ट्यूनिंग$8.34
B200 SXM (HGX)Blackwell180 GB HBM3e · 8 TB/sNVLink 5 + NDR/XDRबड़े पैमाने का प्रशिक्षण, FP4 इन्फरेंस$6.61
H200 SXM (HGX)Hopper141 GB HBM3e · 4.8 TB/sNVLink 4 + NDR 400G70B–400B प्रशिक्षण और उच्च-थ्रूपुट सर्विंग$3.79
H100 SXM (HGX)Hopper80 GB HBM3 · 3.35 TB/sNVLink 4 + NDR 400Gसामान्य प्रशिक्षण, फाइन-ट्यूनिंग, इन्फरेंस$3.10
H100 NVL / PCIeHopper94 / 80 GB · 3.9 TB/sNVLink bridge + 200Gइन्फरेंस घनत्व, मिश्रित वर्कलोड$2.70
A100 SXM 80GBAmpere80 GB HBM2e · 2.0 TB/sNVLink 3 + HDR 200Gलागत-अनुकूल प्रशिक्षण और बैच इन्फरेंस$1.90
A100 SXM 40GBAmpere40 GB HBM2 · 1.6 TB/sNVLink 3 + HDR 200Gलागत-अनुकूल प्रशिक्षण और बैच इन्फरेंस$1.47
RTX PRO 6000 BlackwellBlackwell96 GB GDDR7 · 1.8 TB/sPCIe Gen5 · 200Gइन्फरेंस, सिमुलेशन, ग्राफ़िक्स और Omniverse$2.18
L40SAda Lovelace48 GB GDDR6 · 864 GB/sPCIe Gen4 · 100Gइन्फरेंस, रेंडरिंग, वीडियो, VDI$1.35
RTX 5090Blackwell32 GB GDDR7 · 1.8 TB/sPCIe Gen5 · 100Gअनुसंधान, डिफ्यूज़न, डेवलपमेंट क्लस्टर$0.75

USD में प्रति GPU-घंटा सांकेतिक ऑन-डिमांड सूची मूल्य, कर रहित। रिज़र्व्ड और प्रतिबद्ध अवधियों पर छूट है; अवधि तालिकाओं के लिए देखें मूल्य अवधि तालिकाओं के लिए।

उपभोग मॉडल

जैसे आपकी परियोजना वित्तपोषित है, वैसे कंप्यूट खरीदिए

लचीला

ऑन-डिमांड

प्रति-सेकंड बिलिंग, कोई प्रतिबद्धता नहीं। प्रयोग, मूल्यांकन हार्नेस और तात्कालिक फाइन-ट्यूनिंग के लिए आदर्श।

  • प्रति इंस्टेंस 1–8 GPU
  • तत्काल API / कंसोल प्रोविज़निंग
  • स्नैपशॉट और पुनरारंभ
  • कोई एग्रेस शुल्क नहीं
सर्वाधिक लोकप्रिय

रिज़र्व्ड क्लस्टर

1–36 माह के लिए रखे गए समर्पित InfiniBand-जुड़े पॉड, नामित क्षमता और अवधि भर निश्चित दर के साथ।

  • 16–4,096 GPU, नॉन-ब्लॉकिंग फैब्रिक
  • प्रबंधित Slurm या Kubernetes
  • ऑन-डिमांड से 55% तक कम
  • अनुबंध में क्षमता गारंटी
एंटरप्राइज़

प्राइवेट AI क्लाउड

भौतिक रूप से पृथक हॉल, फैब्रिक और स्टोरेज, जिसे Velyrix आपके नामकरण, नीतियों और ऑडिट व्यवस्था के तहत संचालित करता है।

  • समर्पित केज या सुइट
  • ग्राहक-प्रबंधित एन्क्रिप्शन कुंजियाँ
  • एयर-गैप्ड विकल्प
  • अनुकूलित SLA और परिवर्तन नियंत्रण
क्लस्टर फैब्रिक

रेल-ऑप्टिमाइज़्ड नेटवर्किंग जो GPU को व्यस्त रखती है

प्रशिक्षण क्लस्टर उतना ही तेज़ है जितना उसका सबसे धीमा all-reduce। Velyrix हर मल्टी-नोड पॉड को समर्पित स्टोरेज और प्रबंधन प्लेन के साथ रेल-ऑप्टिमाइज़्ड, नॉन-ब्लॉकिंग फैट-ट्री पर बनाता है।

  • कंप्यूट फैब्रिक: NVIDIA Quantum-2 NDR 400G या Quantum-X800 XDR 800G InfiniBand, 1:1 सब्सक्रिप्शन
  • Ethernet विकल्प: RoCEv2, अनुकूली रूटिंग और कंजेशन नियंत्रण के साथ NVIDIA Spectrum-X
  • इन-नेटवर्क कंप्यूट: बड़े कलेक्टिव्स पर all-reduce लेटेंसी घटाने के लिए SHARP एग्रीगेशन
  • स्टोरेज प्लेन: अलग 200/400G नेटवर्क ताकि चेकपॉइंट कभी ग्रेडिएंट से न टकराएँ
  • प्रबंधन प्लेन: आउट-ऑफ-बैंड BMC नेटवर्क, टेनेंट ट्रैफ़िक से पृथक
  • सत्यापन: हस्तांतरण से पहले NCCL बस बैंडविड्थ और all-reduce लेटेंसी की रिपोर्ट
acceptance-report.txt
# 512x NVIDIA H200 SXM — XDR 800G rail-optimised
nccl-tests/all_reduce_perf -b 8 -e 8G -f 2 -g 8

size        busbw       algbw      status
1.00 GB     372.4 GB/s  198.1 GB/s  PASS
4.00 GB     381.9 GB/s  203.7 GB/s  PASS
8.00 GB     384.6 GB/s  205.1 GB/s  PASS

fabric      : 1:1 non-blocking, 0 link errors / 72h
gpu_burnin  : 72h @ 100% — 0 XID, 0 ECC row remaps
sustained   : 48.9% MFU, Llama-class 70B reference run

Velyrix स्वीकृति परीक्षण के प्रतिनिधि आँकड़े। परिणाम टोपोलॉजी, मॉडल, बैच आकार और सॉफ़्टवेयर स्टैक के अनुसार बदलते हैं; आपके क्लस्टर को अलग से मापा और रिपोर्ट किया जाता है।

ऑर्केस्ट्रेशन और सॉफ़्टवेयर

अपने स्टैक के साथ आइए, माइग्रेशन परियोजना के साथ नहीं

प्रबंधित Slurm

Pyxis/Enroot, फेयर-शेयर अकाउंटिंग, टोपोलॉजी-सचेत शेड्यूलिंग और लंबे प्री-ट्रेनिंग रन के लिए चेकपॉइंट-रीस्टार्ट हुक के साथ पूर्व-निर्मित Slurm।

प्रबंधित Kubernetes

NVIDIA GPU Operator, Network Operator, MIG प्रोफ़ाइल, KubeRay और Kueue के साथ CNCF-अनुरूप क्लस्टर, मल्टी-टेनेंट शेड्यूलिंग हेतु।

बेयर-मेटल API

इमेज डिप्लॉयमेंट, iPXE बूट, BMC नियंत्रण और फैब्रिक विभाजन के लिए Terraform प्रोवाइडर और REST API — ऊपर अपना कंट्रोल प्लेन बनाइए।

📦

कंटेनर रजिस्ट्री

NGC, Docker Hub और निजी इमेज के लिए क्षेत्र-स्थानीय रजिस्ट्री व कैश, ताकि 40 GB पुल 512-GPU जॉब लॉन्च को न रोकें।

📈

ऑब्ज़र्वेबिलिटी

प्रति-जॉब GPU उपयोग, पावर, तापमान, XID घटनाएँ और फैब्रिक काउंटर के साथ DCGM, Prometheus और Grafana — आपके अपने SIEM में निर्यात योग्य।

🔧

फ्रेमवर्क

PyTorch, JAX, NeMo, Megatron-LM, DeepSpeed, TorchTitan, vLLM, SGLang और TensorRT-LLM के लिए सत्यापित इमेज, मासिक रूप से अद्यतन।

हर क्लस्टर के साथ शामिल

पहली जॉब चलने से पहले आपको क्या मिलता है

स्टोरेज

आपके टोकन बजट के अनुरूप उच्च-प्रदर्शन पैरेलल फाइल सिस्टम (WEKA या VAST), साथ ही डेटासेट और चेकपॉइंट के लिए S3-संगत ऑब्जेक्ट स्टोरेज। प्रति नोड 10 TB NVMe स्क्रैच शामिल।

नेटवर्किंग

नॉन-ब्लॉकिंग InfiniBand या Spectrum-X कंप्यूट फैब्रिक, दोहरा 100G इंटरनेट ट्रांज़िट, AWS, Azure, GCP और Oracle से प्राइवेट इंटरकनेक्ट, तथा BGP/IP ट्रांज़िट विकल्प। मानक योजनाओं पर कोई एग्रेस शुल्क नहीं।

सुरक्षा

सिंगल-टेनेंट होस्ट, पृथक VLAN/VRF और फैब्रिक विभाजन, सिक्योर-बूट फर्मवेयर अटेस्टेशन, ग्राहक-प्रबंधित कुंजियाँ, और डीकमीशन पर पूर्ण वाइप-एंड-वेरिफ़ाई (NIST SP 800-88 पर्ज)।

सपोर्ट

24×7 NOC, नामित समाधान आर्किटेक्ट, 15-मिनट P1 प्रतिक्रिया, साइट पर चार घंटे का हार्डवेयर प्रतिस्थापन लक्ष्य, और अनुबंधित उपलब्धता के विरुद्ध मासिक SLA रिपोर्टिंग।

स्वीकृति

हस्तांतरण से पहले: 72-घंटे GPU बर्न-इन, मेमोरी व ECC सत्यापन, NCCL बैंडविड्थ परीक्षण, फैब्रिक त्रुटि स्कैन और हस्ताक्षरित स्वीकृति रिपोर्ट जिसे आप अपने ऑडिटरों को सौंप सकते हैं।

AI इन्फ्रास्ट्रक्चर आर्किटेक्ट से बात करें

GPU आपके। संचालन हमारा।

अपने NVIDIA सर्वर किसी भी अधिकृत OEM या वितरक से खरीदें, उन्हें सीधे Velyrix सुविधा भेजें, और बाकी काम हम संभालते हैं — तैनाती, नेटवर्किंग, कूलिंग, निगरानी और निरंतर सहायता। या हमारे GPU किराए पर लें। दोनों ही स्थितियों में आपको एक कार्यदिवस में योजना मिलती है।

अक्सर पूछे जाने वाले प्रश्न

Velyrix GPU क्लाउड का बिल कैसे बनता है?

ऑन-डिमांड इंस्टेंस प्रति सेकंड बिल होते हैं, बिना न्यूनतम अवधि और मानक योजनाओं पर बिना डेटा एग्रेस शुल्क। रिज़र्व्ड क्लस्टर एक से छत्तीस माह की अवधि के लिए निश्चित अनुबंधित दर पर मासिक बिल होते हैं। एंटरप्राइज़ प्राइवेट क्लाउड निश्चित मासिक प्लेटफ़ॉर्म शुल्क और क्षमता के रूप में कोट किए जाते हैं।

मुझे बेयर मेटल मिलता है या वर्चुअल मशीन?

दोनों उपलब्ध हैं। मल्टी-नोड प्रशिक्षण के लिए डिफ़ॉल्ट सिंगल-टेनेंट बेयर मेटल है, जिसमें GPU, NIC और NVMe तक सीधी पहुँच होती है। जहाँ स्नैपशॉटिंग और तेज़ री-इमेजिंग प्रदर्शन के अंतिम कुछ प्रतिशत से अधिक महत्वपूर्ण हो, वहाँ GPU पासथ्रू वाले वर्चुअलाइज़्ड इंस्टेंस दिए जाते हैं।

मल्टी-नोड प्रशिक्षण क्लस्टर कौन-सा नेटवर्क उपयोग करते हैं?

रेल-ऑप्टिमाइज़्ड नॉन-ब्लॉकिंग InfiniBand - NVIDIA Quantum-2 NDR 400G पर या Quantum-X800 XDR 800G प्रति GPU - SHARP इन-नेटवर्क रिडक्शन के साथ। जहाँ केवल-Ethernet परिचालन मॉडल आवश्यक हो, वहाँ RoCEv2 सहित NVIDIA Spectrum-X Ethernet उपलब्ध है।

क्या मैं एक ही क्लस्टर पर Slurm और Kubernetes चला सकता हूँ?

हाँ। Velyrix आमतौर पर रिज़र्व्ड क्लस्टर को विभाजित करता है ताकि Slurm विभाजन लंबे प्रशिक्षण रन संभाले जबकि Kubernetes विभाजन इन्फ़रेंस दे, दोनों में साझा पैरेलल फाइल सिस्टम के साथ। अवधि के दौरान विभाजन आकार समायोजित किए जा सकते हैं।

क्या बड़े क्लस्टरों के लिए न्यूनतम प्रतिबद्धता है?

256 से अधिक GPU वाले क्लस्टर सामान्यतः न्यूनतम तीन माह के लिए अनुबंधित होते हैं, क्योंकि फैब्रिक निर्माण और केबलिंग का कार्य लगता है। जिन हॉल में समकक्ष पॉड पहले से बना और खाली है, वहाँ छोटी अवधि भी संभव है।