الرئيسية/سحابة GPU

سحابة GPU والحوسبة الفائقة للذكاء الاصطناعي

سحابة NVIDIA GPU، من عقدة واحدة إلى 4,096 وحدة GPU

وفّر مسرّعات NVIDIA أحادية المستأجر بالثانية، أو احجز عنقودًا كاملًا مرتبطًا بـ InfiniBand طوال مدة تدريبك. الأجهزة نفسها، والنسيج نفسه، والمهندسون أنفسهم — مهما كانت طريقة الشراء.

التوفير
< 90 ثانية
الفوترة
بالثانية، بلا رسوم خروج
النسيج
400G / 800G بلا اختناق
أقصى عنقود
4,096 وحدة GPU في نسيج واحد
اتفاقية توافر الخدمة
99.99% للبنية التحتية
كتالوج GPU

اختر مسرّعك

كل طراز متاح كمثيل مباشر أحادي المستأجر أو كمثيل افتراضي مع تمرير GPU. وتأتي الطرازات متعددة العقد بـ InfiniBand مُحسَّن حسب المسارات افتراضيًا.

وحدة المعالجةالبنيةالذاكرة / النطاقالربط البينيالأنسب لـابتداءً من (لكل ساعة GPU)
GB300 NVL72Blackwell Ultra288 GB HBM3e · 8 TB/sNVLink 5 rack-scale + XDR 800Gتدريب بتريليونات المعاملات واستدلال بسياق طويل$8.91
B300 SXM (HGX)Blackwell Ultra288 GB HBM3e · 8 TB/sNVLink 5 + XDR 800Gتدريب مسبق متقدم وضبط دقيق لنماذج MoE$8.34
B200 SXM (HGX)Blackwell180 GB HBM3e · 8 TB/sNVLink 5 + NDR/XDRتدريب واسع النطاق واستدلال FP4$6.61
H200 SXM (HGX)Hopper141 GB HBM3e · 4.8 TB/sNVLink 4 + NDR 400Gتدريب 70B–400B وخدمة عالية الإنتاجية$3.79
H100 SXM (HGX)Hopper80 GB HBM3 · 3.35 TB/sNVLink 4 + NDR 400Gتدريب وضبط دقيق واستدلال عام$3.10
H100 NVL / PCIeHopper94 / 80 GB · 3.9 TB/sNVLink bridge + 200Gكثافة استدلال وأحمال مختلطة$2.70
A100 SXM 80GBAmpere80 GB HBM2e · 2.0 TB/sNVLink 3 + HDR 200Gتدريب واستدلال دفعي بتكلفة محسّنة$1.90
A100 SXM 40GBAmpere40 GB HBM2 · 1.6 TB/sNVLink 3 + HDR 200Gتدريب واستدلال دفعي بتكلفة محسّنة$1.47
RTX PRO 6000 BlackwellBlackwell96 GB GDDR7 · 1.8 TB/sPCIe Gen5 · 200Gاستدلال ومحاكاة ورسوميات وOmniverse$2.18
L40SAda Lovelace48 GB GDDR6 · 864 GB/sPCIe Gen4 · 100Gاستدلال وعرض وفيديو وسطح مكتب افتراضي$1.35
RTX 5090Blackwell32 GB GDDR7 · 1.8 TB/sPCIe Gen5 · 100Gبحث وانتشار وعناقيد تطوير$0.75

أسعار قائمة استرشادية عند الطلب بالدولار الأمريكي لكل ساعة GPU، غير شاملة الضرائب. العقود المحجوزة والملتزم بها تحصل على خصم؛ راجع التسعير لجداول المدد.

نماذج الاستهلاك

اشترِ الحوسبة بالطريقة التي يُموَّل بها مشروعك

مرن

عند الطلب

فوترة بالثانية بلا التزام. مثالي للتجريب ومنصات التقييم والضبط الدقيق المؤقت.

  • من 1 إلى 8 وحدات GPU لكل مثيل
  • توفير فوري عبر الواجهة البرمجية أو لوحة التحكم
  • لقطات واستئناف
  • بلا رسوم خروج
الأكثر شيوعًا

عناقيد محجوزة

مجموعات مخصصة مرتبطة بـ InfiniBand محجوزة من 1 إلى 36 شهرًا، بسعة مُسمّاة وسعر ثابت طوال المدة.

  • من 16 إلى 4,096 وحدة GPU، نسيج بلا اختناق
  • ‏Slurm أو Kubernetes مُدار
  • حتى 55% أقل من السعر عند الطلب
  • ضمان السعة في العقد
للمؤسسات

سحابة ذكاء اصطناعي خاصة

قاعة ونسيج وتخزين معزولة فيزيائيًا، تشغّلها Velyrix وفق تسمياتك وسياساتك ونظام التدقيق لديك.

  • قفص أو جناح مخصص
  • مفاتيح تشفير يديرها العميل
  • خيار العزل التام
  • اتفاقية مستوى خدمة وضبط تغيير مخصصان
نسيج العنقود

شبكات مُحسَّنة حسب المسارات تُبقي وحدات GPU مشغولة

سرعة عنقود التدريب لا تتجاوز سرعة أبطأ عملية all-reduce فيه. تبني Velyrix كل مجموعة متعددة العقد على شجرة fat-tree بلا اختناق ومُحسَّنة حسب المسارات، مع مستويي تخزين وإدارة مخصصين.

  • نسيج الحوسبة: ‏NVIDIA Quantum-2 NDR 400G أو Quantum-X800 XDR 800G InfiniBand، باشتراك 1:1
  • خيار Ethernet: ‏NVIDIA Spectrum-X مع RoCEv2 وتوجيه تكيّفي وضبط الازدحام
  • حوسبة داخل الشبكة: تجميع SHARP لخفض زمن all-reduce في العمليات الجماعية الكبيرة
  • مستوى التخزين: شبكة 200/400G منفصلة كي لا تتزاحم نقاط التحقق مع التدرجات
  • مستوى الإدارة: شبكة BMC خارج النطاق، معزولة عن حركة المستأجرين
  • التحقق: يُبلَّغ عن عرض ناقل NCCL وزمن all-reduce قبل التسليم
acceptance-report.txt
# 512x NVIDIA H200 SXM — XDR 800G rail-optimised
nccl-tests/all_reduce_perf -b 8 -e 8G -f 2 -g 8

size        busbw       algbw      status
1.00 GB     372.4 GB/s  198.1 GB/s  PASS
4.00 GB     381.9 GB/s  203.7 GB/s  PASS
8.00 GB     384.6 GB/s  205.1 GB/s  PASS

fabric      : 1:1 non-blocking, 0 link errors / 72h
gpu_burnin  : 72h @ 100% — 0 XID, 0 ECC row remaps
sustained   : 48.9% MFU, Llama-class 70B reference run

أرقام تمثيلية من اختبار قبول لدى Velyrix. تختلف النتائج حسب الطوبولوجيا والنموذج وحجم الدفعة وحزمة البرمجيات؛ ويُقاس عنقودك ويُوثَّق بشكل منفصل.

التنسيق والبرمجيات

احضر بحزمتك، لا بمشروع ترحيل

‏Slurm مُدار

‏Slurm جاهز مع Pyxis/Enroot، ومحاسبة الحصص العادلة، وجدولة واعية بالطوبولوجيا، وخطافات استئناف من نقاط التحقق لعمليات التدريب المسبق الطويلة.

‏Kubernetes مُدار

عناقيد متوافقة مع CNCF مع NVIDIA GPU Operator وNetwork Operator وملفات MIG وKubeRay وKueue للجدولة متعددة المستأجرين.

واجهة برمجية للأجهزة المباشرة

مزوّد Terraform وواجهة REST لنشر الصور وإقلاع iPXE والتحكم بـ BMC وتقسيم النسيج — ابنِ مستوى تحكمك الخاص فوقها.

📦

سجل الحاويات

سجل وذاكرة تخزين محلية لكل منطقة لـ NGC وDocker Hub والصور الخاصة، كي لا تعرقل تنزيلات بحجم 40 غيغابايت إطلاق مهمة بـ 512 وحدة GPU.

📈

المراقبة

‏DCGM وPrometheus وGrafana مع استخدام GPU لكل مهمة والطاقة والحرارة وأحداث XID وعدّادات النسيج — قابلة للتصدير إلى نظام SIEM الخاص بك.

🔧

أطر العمل

صور مُتحقَّق منها لـ PyTorch وJAX وNeMo وMegatron-LM وDeepSpeed وTorchTitan وvLLM وSGLang وTensorRT-LLM، تُحدَّث شهريًا.

مشمول مع كل عنقود

ما تحصل عليه قبل تشغيل أول مهمة

التخزين

نظام ملفات متوازٍ عالي الأداء (WEKA أو VAST) بحجم يناسب ميزانية الرموز لديك، إضافة إلى تخزين كائنات متوافق مع S3 لمجموعات البيانات ونقاط التحقق. ويشمل 10 تيرابايت NVMe مؤقتة لكل عقدة.

الشبكات

نسيج حوسبة InfiniBand أو Spectrum-X بلا اختناق، ونقل إنترنت مزدوج 100G، وربط خاص مع AWS وAzure وGCP وOracle، وخيارات نقل BGP/IP. بلا رسوم خروج في الخطط القياسية.

الأمن

مضيفات أحادية المستأجر، وVLAN/VRF وأقسام نسيج معزولة، وتوثيق برامج ثابتة بإقلاع آمن، ومفاتيح يديرها العميل، ومسح كامل موثَّق عند إيقاف التشغيل (تطهير NIST SP 800-88).

الدعم

مركز عمليات 24×7، ومهندس حلول مُسمّى، واستجابة P1 خلال 15 دقيقة، وهدف استبدال الأجهزة خلال أربع ساعات في الموقع، وتقارير شهرية لمستوى الخدمة مقابل التوافر المتعاقد عليه.

القبول

قبل التسليم: اختبار تحميل GPU لمدة 72 ساعة، والتحقق من الذاكرة وECC، واختبارات عرض NCCL، ومسح أخطاء النسيج، وتقرير قبول موقَّع يمكنك تسليمه لمدققيك.

تحدث إلى مهندس بنية تحتية للذكاء الاصطناعي

وحدات المعالجة ملكك. ونحن نشغّلها.

اشترِ خوادم NVIDIA من أي شركة مصنّعة أو موزّع معتمد، وأرسلها مباشرة إلى مركز بيانات Velyrix، ونتولى نحن الباقي: التركيب والشبكة والتبريد والمراقبة والدعم المستمر. أو استأجر خوادمنا. في الحالتين تحصل على خطة خلال يوم عمل واحد.

الأسئلة الشائعة

كيف تُفوتر سحابة GPU من Velyrix؟

تُفوتر المثيلات عند الطلب بالثانية بلا حد أدنى للمدة وبلا رسوم خروج بيانات في الخطط القياسية. وتُفوتر العناقيد المحجوزة شهريًا بسعر تعاقدي ثابت لمدد من شهر إلى ستة وثلاثين شهرًا. وتُسعَّر السحب الخاصة للمؤسسات كرسم منصة شهري ثابت إضافة إلى السعة.

هل أحصل على أجهزة مباشرة أم آلات افتراضية؟

كلاهما متاح. الوضع الافتراضي للتدريب متعدد العقد هو أجهزة مباشرة أحادية المستأجر مع وصول مباشر إلى وحدات GPU وبطاقات الشبكة وNVMe. وتُقدَّم المثيلات الافتراضية مع تمرير GPU حين تكون اللقطات وإعادة التهيئة السريعة أهم من النسب المئوية الأخيرة من الأداء.

ما الشبكة التي تستخدمها عناقيد التدريب متعددة العقد؟

‏InfiniBand بلا اختناق ومُحسَّن حسب المسارات - NVIDIA Quantum-2 NDR بسرعة 400G أو Quantum-X800 XDR بسرعة 800G لكل وحدة GPU - مع تقليص SHARP داخل الشبكة. ويتوفر NVIDIA Spectrum-X Ethernet مع RoCEv2 حين يُشترط نموذج تشغيل قائم على Ethernet فقط.

هل يمكنني تشغيل Slurm وKubernetes على العنقود نفسه؟

نعم. تقسّم Velyrix عادةً عنقودًا محجوزًا بحيث يتولى قسم Slurm عمليات التدريب الطويلة بينما يخدم قسم Kubernetes الاستدلال، مع نظام ملفات متوازٍ مشترك بينهما. ويمكن تعديل أحجام الأقسام خلال المدة.

هل هناك حد أدنى للالتزام في العناقيد الكبيرة؟

تُتعاقد العناقيد التي تتجاوز 256 وحدة GPU عادةً لثلاثة أشهر على الأقل بسبب أعمال بناء النسيج والكبلات. ويمكن استيعاب فترات أقصر في القاعات التي يوجد فيها مجموعة مماثلة مبنية وغير مستخدمة.