بلاكويل (البنية الدقيقة)

بلاكويل هي بنية دقيقة لوحدة معالجة الرسومات (GPU) طورتها شركة إنفيديا كخليفة للبنى الدقيقة هوبر وآدا لوفليس .

وحدة GB200 مزودة بمعالجات رسوميات Blackwell ووحدة معالجة مركزية Grace

سُمّيت بنية بلاكويل تيمّنًا بالإحصائي والرياضي ديفيد بلاكويل ، وقد سُرّب اسمها في عام 2022، ثمّ تأكّد إطلاق مُسرّعي B40 وB100 في أكتوبر 2023، وذلك من خلال خارطة طريق رسمية لشركة إنفيديا عُرضت خلال عرض تقديمي للمستثمرين. [ 4 ] وأُعلن عنها رسميًا في الكلمة الرئيسية لمؤتمر إنفيديا العالمي للتكنولوجيا 2024 (GTC 2024) في 18 مارس 2024. [ 5 ]

تاريخ

في مارس 2022، أعلنت إنفيديا عن بنية مركز بيانات هوبر لمسرعات الذكاء الاصطناعي. وشهد عام 2023 إقبالاً كثيفاً على منتجات هوبر. [ 6 ] وتراوحت مدة الانتظار بين الطلب والتسليم لخوادم H100 بين 36 و52 أسبوعاً بسبب النقص وارتفاع الطلب. [ 7 ] وذكرت التقارير أن إنفيديا باعت 500 ألف مسرع H100 قائم على هوبر في الربع الثالث من عام 2023 وحده. [ 7 ] وقد أدى تفوق إنفيديا في مجال الذكاء الاصطناعي بفضل منتجات هوبر إلى زيادة قيمتها السوقية إلى أكثر من تريليوني دولار، لتأتي في المرتبة الثالثة بعد مايكروسوفت وآبل . [ 8 ]

سُميت بنية بلاكويل نسبةً إلى عالم الرياضيات الأمريكي ديفيد بلاكويل ، المعروف بإسهاماته في مجالات الرياضيات ، لا سيما نظرية الألعاب ، ونظرية الاحتمالات ، ونظرية المعلومات ، والإحصاء. وقد أثرت هذه المجالات، أو تم تطبيقها، في تصميمات نماذج الذكاء الاصطناعي التوليدية القائمة على المحولات أو في خوارزميات تدريبها . وكان بلاكويل أول باحث أمريكي من أصل أفريقي يُنتخب عضوًا في الأكاديمية الوطنية للعلوم . [ 9 ]

في عرضها التقديمي للمستثمرين في أكتوبر 2023، قامت شركة إنفيديا بتحديث خارطة طريق مراكز البيانات لتشمل الإشارة إلى معالجات B100 وB40 وبنية بلاكويل. [ 10 ] [ 11 ] سابقًا، كان يُشار إلى خليفة هوبر في خرائط الطريق باسم "هوبر-نكست". وقد أكدت خارطة طريق إنفيديا المُحدثة على الانتقال من إصدار منتجات مراكز البيانات كل عامين إلى إصدارات سنوية تستهدف أنظمة x86 و ARM .

في مؤتمر تقنيات الرسومات (GTC) المنعقد في 18 مارس 2024، أعلنت شركة إنفيديا رسميًا عن بنية بلاكويل، مع التركيز على مُسرّعات مراكز البيانات B100 وB200 والمنتجات المرتبطة بها، مثل لوحة HGX B200 ذات الثماني وحدات معالجة رسومية، ونظام NVL72 ذي 72 وحدة معالجة رسومية. [ 12 ] صرّح جينسن هوانغ، الرئيس التنفيذي لشركة إنفيديا ، قائلاً: "مع بلاكويل، ابتكرنا معالجًا لعصر الذكاء الاصطناعي التوليدي "، وأكد على منصة بلاكويل الشاملة التي تجمع بين مُسرّعات بلاكويل ووحدة المعالجة المركزية Grace من إنفيديا القائمة على معمارية ARM. [ 13 ] [ 14 ] وأشادت إنفيديا بتأييد الرؤساء التنفيذيين لشركات جوجل ، وميتا ، ومايكروسوفت ، وأوبن إيه آي ، وأوراكل لبنية بلاكويل . [ 14 ] ولم يتطرق الخطاب الرئيسي إلى مجال الألعاب.

أُفيد في أكتوبر 2024 بوجود خلل تصميمي في بنية بلاكويل، وقد تم إصلاحه بالتعاون مع شركة TSMC. [ 15 ] ووفقًا لهوانغ، كان الخلل التصميمي "وظيفيًا" و"تسبب في انخفاض الإنتاجية". [ 16 ] وبحلول نوفمبر 2024، أفادت مورغان ستانلي بأن "إنتاج عام 2025 بالكامل" من رقائق بلاكويل قد "نُفذ بالكامل". [ 17 ]

خلال الكلمة الرئيسية للشركة في معرض الإلكترونيات الاستهلاكية 2025 ، أعلنت Nvidia أن النماذج الأساسية لـ Blackwell ستتضمن نماذج من Black Forest Labs ( Flux ) و Meta AI و Mistral AI و Stability AI . [ 18 ]

بنيان

بلاكويل عبارة عن بنية مصممة لتطبيقات الحوسبة في مراكز البيانات، ولتطبيقات الألعاب ومحطات العمل مع رقائق مخصصة لكل غرض.

عقدة المعالجة

تُصنّع معالجات بلاكويل باستخدام تقنية 4NP المُخصصة لمنتجات مراكز البيانات، وتقنية 4N المُخصصة للمنتجات الاستهلاكية، من شركة TSMC . تُعدّ تقنية 4NP تطويرًا لتقنية 4N المستخدمة في معماريتي هوبر وآدا لوفليس. من المُرجّح أن تقنية 4NP الخاصة بشركة إنفيديا تُضيف طبقات معدنية إلى تقنية TSMC N4P القياسية. [ 19 ] تحتوي شريحة GB100 على 104 مليارات ترانزستور، بزيادة قدرها 30% عن 80 مليار ترانزستور في شريحة هوبر GH100 من الجيل السابق. [ 20 ] ولأن بلاكويل لا تستطيع الاستفادة من مزايا التطور الكبير في تقنية التصنيع، يجب عليها تحقيق كفاءة الطاقة وتحسين الأداء من خلال تغييرات معمارية أساسية. [ 21 ]

تُعدّ شريحة GB100 على الحد الأقصى لحجم الرقاقة في تصنيع أشباه الموصلات. [ 22 ] يُشير الحد الأقصى لحجم الرقاقة في تصنيع أشباه الموصلات إلى أقصى حجم للعناصر التي يُمكن لآلات الطباعة الحجرية حفرها في رقاقة السيليكون. سابقًا، كادت شركة Nvidia أن تصل إلى الحد الأقصى لحجم الرقاقة لدى TSMC مع شريحة GH100 التي تبلغ مساحتها 814 مم²  . ولتجاوز قيود حجم الرقاقة، يستخدم مُسرّع B100 من Nvidia شريحتين من GB100 في حزمة واحدة، متصلتين برابط بسرعة 10 تيرابايت/ثانية تُطلق عليه Nvidia اسم واجهة النطاق الترددي العالي NV-HBI. تعتمد NV-HBI على بروتوكول NVLink 7. صرّح جينسن هوانغ، الرئيس التنفيذي لشركة Nvidia، في مقابلة مع CNBC أن Nvidia أنفقت حوالي 10 مليارات دولار على البحث والتطوير لوصلة الربط البيني NV-HBI من Blackwell. انتقد جيم كيلر ، مهندس أشباه الموصلات المخضرم الذي عمل على معمارية K7 و K12 و Zen من AMD، هذا الرقم، وزعم أنه يمكن تحقيق النتيجة نفسها مقابل مليار دولار باستخدام تقنية Ultra Ethernet بدلاً من نظام NVLink الخاص. [ 23 ] تستطيع شريحتا GB100 المتصلتان العمل كوحدة سيليكون متجانسة كبيرة مع تماسك كامل لذاكرة التخزين المؤقت بينهما. [ 24 ] يبلغ إجمالي عدد الترانزستورات في حزمة الشريحتين 208 مليارات ترانزستور. [ 22 ] تُوضع شريحتا GB100 فوق طبقة وسيطة من السيليكون مُصنّعة باستخدام تقنية التغليف CoWoS-L ثنائية الأبعاد ونصف من TSMC. [ 25 ]

على صعيد المستهلكين، تبلغ مساحة أكبر شريحة من بلاكويل، GB202، 750 مم²، أي أكبر بنسبة 20 % من AD102، أكبر شريحة من آدا لوفليس. [ 26 ] تحتوي GB202 على 24,576 نواة CUDA، أي بزيادة قدرها 28.5% عن 18,432 نواة CUDA في AD102. تُعد GB202 أكبر شريحة للمستهلكين صممتها إنفيديا منذ شريحة TU102 التي تبلغ مساحتها 754 مم² في عام 2018، والمبنية على معمارية تورينج الدقيقة . كما اتسعت الفجوة بين GB202 وGB203 بشكل ملحوظ مقارنةً بالأجيال السابقة. تتميز GB202 بأكثر من ضعف عدد نوى CUDA الموجودة في GB203، وهو ما لم يكن الحال مع AD102 مقارنةً بـ AD103.

معالج متعدد البث

أنوية CUDA

تمت إضافة قدرات الحوسبة CUDA 10.0 و 12.0 مع Blackwell. [ 27 ]

نوى الموتر

تُقدّم بنية بلاكويل معالجات Tensor Cores من الجيل الخامس للحوسبة في الذكاء الاصطناعي وإجراء العمليات الحسابية ذات الفاصلة العائمة . في مراكز البيانات، تُضيف بلاكويل دعمًا أصليًا لأنواع البيانات ذات الدقة الأقل من 8 بت، بما في ذلك تنسيقات MXFP6 وMXFP4 الجديدة المُعرّفة من قِبل مجتمع مشروع الحوسبة المفتوحة (OCP) لتحسين الكفاءة والدقة في العمليات الحسابية منخفضة الدقة. [ 28 ] [ 29 ] [ 30 ] [ 31 ] [ 32 ] قدّمت بنية هوبر السابقة محرك Transformer Engine، وهو برنامج يُسهّل تكميم النماذج عالية الدقة (مثل FP32) إلى دقة أقل، وهو ما يُتيح لهوبر إنتاجية أعلى. يُضيف محرك Transformer Engine من الجيل الثاني من بلاكويل دعمًا لتنسيقي MXFP4 وMXFP6. يُتيح استخدام بيانات 4 بت كفاءة وإنتاجية أعلى لاستنتاج النموذج أثناء تدريب الذكاء الاصطناعي التوليدي. تدعي شركة Nvidia أن معالج GB200 الفائق ثنائي وحدة معالجة الرسومات يوفر 20 بيتافلوب (باستثناء الزيادة بمقدار الضعف التي تدعيها الشركة بسبب التباعد) من حسابات FP4. [ 33 ]

نوى تتبع الأشعة

تم تقديم الجيل الرابع من نوى تتبع الأشعة في بلاكويل، ويتضمن محرك تقاطع عنقود المثلثات الجديد للهندسة الضخمة والكرات المكتسحة الخطية لتسريع تتبع الأشعة للتفاصيل الدقيقة، مثل الشعر. [ 2 ]

معالج إدارة الذكاء الاصطناعي

تُقدّم بلاكويل معالج إدارة الذكاء الاصطناعي (AMP)، وهو شريحة جدولة مُخصصة مُدمجة في وحدة معالجة الرسومات (GPU) مبنية على معمارية RISC-V . [ 2 ] صُمّم هذا المعالج لتخفيف عبء الجدولة عن وحدة المعالجة المركزية (CPU) بشكل أكبر من الأجيال السابقة، مما يُساعد وحدة معالجة الرسومات على إدارة مواردها بشكل أفضل. ويتم استخدامه من خلال نظام جدولة وحدة معالجة الرسومات المُسرّعة بواسطة الأجهزة (HAGS) في نظام ويندوز.

وفاة بلاكويل

مركز البيانات

متGB100GB102GB200
المتغيراتمجهولمجهولمجهول
تاريخ الافراج عنهديسمبر 2024نوفمبر 2024مجهول
النوىأنوية CUDA18432
وحدات إدارة النقل576
برنامج التدريب على الرماية24
نوى RTمجهولمجهولمجهول
نوى الموتر576
معالجات متعددة البثمجهولمجهولمجهول
مخبأالمستوى 18.25 ميجابايت
المستوى الثاني60 ميجابايت
واجهة الذاكرة8192 بت
حجم القالبمجهولمجهولمجهول
عدد الترانزستورات104 مليار 
كثافة الترانزستورمجهولمجهولمجهول
مقبس العبوةSXM6
منتجاتB200 SXM 192GBB100مجهول

مستهلك

متGB10GB202GB203GB205GB206GB207
المتغيراتGB202-300-A1GB203-200-A1 GB203-300-A1 GB203-400-A1GB205-300-A1GB206-250-A1 GB206-300-A1GB207-300-A1
تاريخ الافراج عنه15 أكتوبر 202530 يناير 202530 يناير 20254 مارس 202516 أبريل 202524 يونيو 2025
النوىأنوية CUDA614424,57610752640046082560
وحدات إدارة النقل38476833620014480
برنامج التدريب على الرماية48192112804832
نوى RT4819284503620
نوى الموتر38476833620014480
رسالة قصيرة4819284503620
GPCs4127532
مخبأالمستوى 16 ميجابايت 24 ميجابايت 10.5 ميجابايت 6.25 ميجابايت 4.5 ميجابايت 2.5 ميجابايت 
المستوى الثاني50 ميجابايت128 ميجابايت 64 ميجابايت 48 ميجابايت 32 ميجابايت 32 ميجابايت 
واجهة الذاكرة256 بت512 بت256 بت192 بت128 بت128 بت
حجم القالبمجهول750 مم 2 378 مم 2 263 مم 2 181 مم 2 149 مم 2
عدد الترانزستوراتمجهول92.2 مليار 45.6 مليار 31.1 مليار 21.9 مليار16.9 مليار
كثافة الترانزستورمجهول122.6 متر مربع/ مم² 120.6 متر مربع/ مم² 118.3 متر مربع/ مم² 121.0 متر مكعب/ مم²113.4 متر مكعب/ مم²
منتجات
مستهلكسطح المكتبغير متوفرRTX 5090 RTX 5090 DRTX 5070 Ti و RTX 5080   RTX 5070RTX 5060 RTX 5060 TiRTX 5050
متحركRTX Sparkغير متوفرلابتوب RTX 5090 لابتوب RTX 5080كمبيوتر محمول RTX 5070 Tiلابتوب RTX 5060 لابتوب RTX 5070كمبيوتر محمول بمعالج رسومات RTX 5050
محطة عملسطح المكتبدي جي إكس سبارك جي بي 20 بيRTX PRO 5000 RTX PRO 6000RTX PRO 4000 RTX PRO 4500غير متوفرغير متوفرغير متوفر
متحركغير متوفرغير متوفرغير متوفرRTX PRO 3000 MobileRTX PRO 2000 MobileRTX PRO 500 Mobile و RTX PRO 1000 Mobile
الخادمإصدار خادم RTX PRO 6000إصدار خادم RTX PRO 4500غير متوفرغير متوفرغير متوفر

انظر أيضاً

مراجع

  1. "موجز تقني لهندسة بلاكويل من إنفيديا" . إنفيديا . تم الاطلاع عليه في 2 فبراير 2025 .
  2. 1 2 3 "معمارية وحدة معالجة الرسومات NVIDIA RTX BLACKWELL" (ملف PDF) . NVIDIA . تم الاطلاع عليه في 2 فبراير 2025 .
  3. 1 2 3 ديكين، دانيال ر. (26 فبراير 2025). "تم حل مشكلات غريبة في اختبارات أداء سلسلة GeForce RTX 50، لكن مشكلة جديدة تظهر للاعبين" . Notebookcheck . تم الاطلاع عليه في 26 فبراير 2025 .
  4. "شركة إنفيديا - عرض إنفيديا للمستثمرين، أكتوبر 2023" . إنفيديا . تم الاطلاع عليه بتاريخ 19 مارس 2024 .
  5. "منصة Nvidia Blackwell تصل لتشغيل حقبة جديدة من الحوسبة" . غرفة أخبار Nvidia . تم الاطلاع عليه في 19 مارس 2024 .
  6. شيفشيك، كريس (18 أغسطس 2023). "الضجة الإعلامية حول الذكاء الاصطناعي تعني أن شركة إنفيديا تجني أرباحًا طائلة" . موقع تومز هاردوير . تم الاطلاع عليه بتاريخ 24 مارس 2024 .
  7. شيلوف ، أنطون ( 28 نوفمبر 2023). "باعت إنفيديا نصف مليون وحدة معالجة رسومية H100 AI في الربع الثالث بفضل ميتا وفيسبوك - تصل فترات التسليم إلى 52 أسبوعًا: تقرير" . تومز هاردوير . تم الاطلاع عليه في 24 مارس 2024 .
  8. كينغ، إيان (19 مارس 2024). "إنفيديا تسعى لتعزيز هيمنتها على الذكاء الاصطناعي برقائق بلاكويل الجديدة" . ياهو! فاينانس . تم الاطلاع عليه في 24 مارس 2024 .
  9. لي، جين لاني (19 مارس 2024). "لماذا تُعدّ شريحة بلاكويل الجديدة من إنفيديا مفتاحًا للمرحلة التالية من الذكاء الاصطناعي؟" . بلومبيرغ . تم الاطلاع عليه في 24 مارس 2024 .
  10. "عرض تقديمي للمستثمرين" (ملف PDF) . إنفيديا . أكتوبر 2023. تم الاطلاع عليه في 24 مارس 2024 .
  11. غاريفا، أنتوني (10 أكتوبر 2023). "معالج الرسوميات من الجيل التالي GB200 'Blackwell' من إنفيديا مُدرج في خارطة طريق مراكز البيانات لعام 2024" . تويك تاون . تم الاطلاع عليه في 24 مارس 2024 .
  12. "Nvidia GB200 NVL72" . Nvidia . تم الاطلاع عليه في 4 يوليو 2024 .
  13. ليسوينغ، كيف (18 مارس 2024). "الرئيس التنفيذي لشركة إنفيديا، جنسن هوانغ، يعلن عن رقائق ذكاء اصطناعي جديدة: "نحن بحاجة إلى وحدات معالجة رسومية أكبر"" . سي إن بي سي . تم الاطلاع عليه في 24 مارس 2024 .
  14. 1 2 كولفيلد، برايان (18 مارس 2024). ""لقد ابتكرنا معالجًا لعصر الذكاء الاصطناعي التوليدي"، هذا ما صرّح به الرئيس التنفيذي لشركة إنفيديا . إنفيديا . تم الاطلاع عليه بتاريخ 24 مارس 2024 .
  15. غرونهولت-بيدرسن، جاكوب؛ موخيرجي، سوبانثا (23 أكتوبر 2024). "الرئيس التنفيذي لشركة إنفيديا يُعلن عن إصلاح عيب التصميم في رقائق بلاكويل للذكاء الاصطناعي" . رويترز . تاريخ الاسترجاع: 17 ديسمبر 2024 .
  16. شيلوف، أنطون (23 أكتوبر 2024). "جنسن هوانغ من شركة إنفيديا يعترف بأن عيب تصميم شريحة الذكاء الاصطناعي كان "خطأ إنفيديا بنسبة 100%" - شركة TSMC ليست مسؤولة، وشرائح بلاكويل المُصلحة قيد الإنتاج الآن" . موقع تومز هاردوير . تم الاطلاع عليه في 17 ديسمبر 2024 .
  17. كان، جيريمي (12 نوفمبر 2024). "ستون موظفًا تحت إدارته المباشرة، ولكن دون اجتماعات فردية: كيف ساعد أسلوب قيادة غير تقليدي جنسن هوانغ من شركة إنفيديا على أن يصبح أحد أقوى الشخصيات في عالم الأعمال" . مجلة فورتشن . تاريخ الاطلاع: 16 نوفمبر 2024 .
  18. تاكاهاشي، دين (7 يناير 2025). "إنفيديا تكشف عن نماذج أساسية للذكاء الاصطناعي تعمل على أجهزة الكمبيوتر الشخصية المزودة بتقنية RTX AI" . فينشر بيت . تم الاطلاع عليه في 19 يناير 2025 .
  19. بيرن، جوزيف (28 مارس 2024). "معالج رسومات بلاكويل العملاق من إنفيديا يعد بزيادة سرعة 30 ضعفًا، لكن توقع 3 أضعاف فقط" . XPU.pub . تم الاطلاع عليه في 4 يوليو 2024 .
  20. سميث، رايان (18 مارس 2024). "الإعلان عن معمارية بلاكويل من إنفيديا ومسرعات B200/B100: تحقيق أداء أكبر ببيانات أصغر" . أناند تك . مؤرشف من الأصل في 18 مارس 2024. تم الاطلاع عليه في 24 مارس 2024 .
  21. بريكيت مورغان، تيموثي (18 مارس 2024). "مع وحدات معالجة الرسومات من بلاكويل، يصبح الذكاء الاصطناعي أرخص وأسهل، وتصبح المنافسة مع إنفيديا أصعب" . المنصة التالية . تم الاسترجاع في 24 مارس 2024 .
  22. 1 2 "منصة Nvidia Blackwell تصل لتشغيل حقبة جديدة من الحوسبة" . غرفة أخبار Nvidia . 18 مارس 2024. تم الاطلاع عليه في 24 مارس 2024 .
  23. غاريفا، أنتوني (14 أبريل 2024). "جيم كيلر يسخر من تكلفة البحث والتطوير البالغة 10 مليارات دولار لشركة إنفيديا بلاكويل، كان من الأجدر استخدام الإيثرنت مقابل مليار دولار" . تويك تاون . تم الاطلاع عليه في 16 أبريل 2024 .
  24. هاغيدوم، هيلبرت (18 مارس 2024). "نظرة عامة تقنية على وحدات معالجة الرسومات Nvidia B200 وGB200 AI: تم الكشف عنها في مؤتمر GTC 2024" . Guru3D . تم الاطلاع عليه في 7 أبريل 2024 .
  25. «بطاقة Nvidia Blackwell "B100" ستضم شريحتين وذاكرة HBM3e بسعة 192 جيجابايت، بينما ستضم B200 ذاكرة بسعة 288 جيجابايت» . VideoCardz . 17 مارس 2024. تم الاطلاع عليه بتاريخ 24 مارس 2024 .
  26. "يُقال إن مساحة شريحة معالج الرسوميات Nvidia GeForce RTX 5090 GB202 تبلغ 744 مم²، أي أكبر بنسبة 20% من AD102" . VideoCardz . 22 نوفمبر 2024. تم الاطلاع عليه في 7 يناير 2025 .
  27. "دليل برمجة CUDA C" . إنفيديا . تم الاطلاع عليه بتاريخ 28 يناير 2025 .
  28. إدواردز، بنج (18 مارس 2024). "إنفيديا تكشف النقاب عن بلاكويل B200، "أقوى شريحة في العالم" مصممة للذكاء الاصطناعي" . آرس تكنيكا . تم الاطلاع عليه في 24 مارس 2024 .
  29. "هندسة بلاكويل" . إنفيديا . تم الاطلاع عليه في 5 فبراير 2025 .
  30. روحاني، بيتا درويش؛ تشاو، ريتشي؛ مور، أنكيت؛ هول، ماثيو؛ خودامورادي، علي رضا؛ دينغ، سمر؛ تشودري، دروف؛ كورنيا، ماريوس؛ ديلينجر، إريك؛ دينولف، كريستوف (2023). "تنسيقات البيانات المصغرة للتعلم العميق". arXiv : 2310.10537 [ cs.LG ].
  31. "مواصفات تنسيقات التوسيع المصغر (MX) الإصدار 1.0 لمشروع الحوسبة المفتوحة " . 2024. تم الاطلاع عليه في 5 فبراير 2025 .
  32. "OpenAI Triton على NVIDIA Blackwell يعزز أداء الذكاء الاصطناعي وقابليته للبرمجة" . مدونة مطوري NVIDIA . NVIDIA. 2024. تم الاطلاع عليه في 5 فبراير 2025 .
  33. "Nvidia GB200 NVL72" . Nvidia . تم الاطلاع عليه في 4 يوليو 2024 .