وحدة معالجة الرسوميات NVIDIA H100 NVL بسعة 94 جيجابايت مع بنية Hopper و PCIe 5.0 x16
ملخص المنتج
توفر وحدة معالجة الرسومات NVIDIA H100 NVL 94GB أداء LLM أسرع 12 مرة مقارنة بـ A100، مع ذاكرة HBM3 بسعة 188 جيجابايت في التكوينات المزدوجة. مثالي لطرز GPT-175B، التي تتميز بمحرك Transformer Engine وPCIe 5.0 لاستدلال الذكاء الاصطناعي الفعال والتدريب في الخوادم القياسية.
الخصائص الأساسية
الاسم التجاري:
NVIDIA
رقم الموديل:
900-21010-0020-000
تداول العقارات
الحد الأدنى لكمية الطلب:
10
سعر:
24000USD
شروط الدفع:
تي/تي
وصف المنتج
وحدة معالجة الرسوميات NVIDIA H100 NVL بسعة 94 جيجابايت
NVIDIA MPN: 900-21010-0020-000
تم تصميم وحدة معالجة الرسوميات NVIDIA H100 NVL بسعة 94 جيجابايت خصيصًا لتعميم استدلال وتدريب نماذج اللغة الكبيرة (LLM) من خلال جلب قوة معمارية Hopper إلى أنظمة الخوادم الرئيسية المستندة إلى PCIe. يعالج هذا الإصدار المتخصص متطلبات الذاكرة والحوسبة الفريدة للنماذج التي تصل إلى 175 مليار معلمة، مثل GPT-175B، مما يوفر أداءً استثنائيًا مع الحفاظ على الكفاءة التشغيلية في بيئات مراكز البيانات المقيدة بالطاقة.
عند نشرها في تكوينات مزدوجة لوحدات معالجة الرسوميات مرتبطة عبر جسور NVLink، توفر H100 NVL ذاكرة HBM3 مجمعة بسعة 188 جيجابايت، مما يتيح لزوج وحدات معالجة الرسوميات العمل كمجمع ذاكرة موحد.
المواصفات الفنية
تتميز H100 NVL بذاكرة HBM3 بسعة 94 جيجابايت، محسّنة لأعباء العمل الاستدلالية المكثفة للذاكرة وضبط نماذج اللغة الكبيرة. تستفيد وحدة معالجة الرسوميات من الإمكانيات الكاملة لمعمارية Hopper، بما في ذلك محرك Transformer الذي يسرع عمليات LLM باستخدام الحوسبة ذات الدقة المختلطة.
مقارنة بالأنظمة من الجيل السابق، تُظهر الخوادم المجهزة بوحدات معالجة الرسوميات H100 NVL أداءً أعلى بما يصل إلى 12 مرة على نماذج GPT-175B مقارنة بتكوينات NVIDIA DGX A100، مع تحسينات كبيرة في خصائص زمن الاستجابة. تتصل البطاقة عبر PCIe 5.0 x16 وتدعم تقنية NVLink عبر الجسور، مما يتيح اتصالاً فائق النطاق الترددي بين وحدات معالجة الرسوميات الضروري لتوسيع نطاق توازي النماذج عبر مسرعات متعددة.
التصميم والتوافق
تم تصميم H100 NVL للنشر في مراكز البيانات الرئيسية، وتعتمد على عامل شكل مزدوج الفتحة مع خيارات تبريد نشطة أو سلبية اعتمادًا على تكوين OEM. وحدة معالجة الرسوميات متوافقة تمامًا مع حزمة برامج NVIDIA للمؤسسات، بما في ذلك CUDA و TensorRT ومجموعة NVIDIA AI Enterprise، مما يضمن التكامل السلس في خطوط أنابيب الذكاء الاصطناعي الحالية.
تشمل التطبيقات الرئيسية الاستدلال في الوقت الفعلي للذكاء الاصطناعي المحادثي، وضبط النماذج، وأعباء العمل الخاصة بتوليد الاسترجاع المعزز (RAG). بفضل مزيجها المتوازن من سعة الذاكرة وأداء الحوسبة وكفاءة الطاقة، تمثل H100 NVL نقطة الدخول المثلى للمؤسسات التي تسعى إلى تشغيل نماذج اللغة الكبيرة عبر بنيتها التحتية دون تعقيد أو تكلفة الأنظمة عالية الكثافة المستندة إلى SXM.
تفاصيل المنتج
إبراز:
وحدة معالجة الرسوميات NVIDIA H100 PCIe
,وحدة معالجة الرسوميات PCIe بسعة 94 جيجابايت
,وحدة معالجة الرسوميات PCIe 5.0 x16
منتجات ذات صلة
-
خادم Inspur NF5468M7 مزود بإمدادات طاقة 4 × 2200 واط و120 نواة حسابية وذاكرة DDR5 سعة 6 تيرابايت
Inspur NF5468M7: خادم حامل 4U مزود بمعالج Intel Xeon من الجيل الرابع/الخامس، ويدعم 8 وحدات معالجة رسوميات و6 تيرابايت DDR5. يوفر 2 طاقة PFLOPS AI، وتخزين 24x SSD، و4x 2200W وحدات PSU زائدة عن الحاجة، وتبريد سائل لـ PUE يصل إلى 1.15. -
H3C UniServer R5500 G6 خادم الذكاء الاصطناعي مع وحدة 8-GPU 12TB سعة ذاكرة PCIe 5.0 عرض النطاق الترددي
H3C R5500 G6: خادم AI مزود بـ 8 وحدات معالجة رسوميات بتصميم معياري، يدعم وحدات المعالجة المركزية AMD/Intel، وذاكرة تصل سعتها إلى 12 تيرابايت ومساحة تخزين تصل إلى 200 تيرابايت. يوفر قوة حوسبة 3x، وتدريب GPT-4 أسرع بنسبة 70% مع شبكات PCIe 5.0 و400GE. -
H3C UniServer R5300 G5 4U مزدوج المعالجة خادم الحوسبة المتباينة
H3C UniServer R5300 G5: خادم 4U من الجيل التالي مزود بمعالجات Intel Xeon القابلة للتطوير، ويدعم ما يصل إلى 20 وحدة معالجة رسومات لأحمال عمل الذكاء الاصطناعي. يتميز بتحسين عرض النطاق الترددي للذاكرة بنسبة 60%، وتخزين 24 محرك أقراص، وأدوات إدارة متقدمة. مثالية للتعلم العميق والحوسبة عالية الأداء (HPC) وتحليلات البيانات.