راهنمای فنی NVIDIA Mellanox MQM9790-NS2F: بهینهسازی اتصال با تأخیر کم برای خوشههای RDMA/HPC/AI
August 24, 2026
راهنمای فنی NVIDIA Mellanox MQM9790-NS2F: بهینهسازی اتصال با تأخیر کم برای خوشههای RDMA/HPC/AI
1. پیشزمینه پروژه و تحلیل الزامات
بار کاری مدرن آموزش هوش مصنوعی و شبیهسازی HPC با الگوهای ارتباطی شدید و همهجانبه مشخص میشوند که تقاضای فوقالعادهای را بر روی زیرساخت شبکه تحمیل میکنند. با مقیاسبندی خوشههای GPU فراتر از 1000 گره، رویکرد سنتی اتکا به اترنت با کنترل ازدحام مبتنی بر نرمافزار ناکافی است. الزامات کلیدی که از این محیطها ظهور میکنند عبارتند از:
- تأخیر فوقالعاده کم و قطعی: تأخیر پورت به پورت زیر میکروثانیه برای به حداقل رساندن زمان تکمیل شغل MPI.
- زیرساخت بدون اتلاف: صفر افت بسته تحت ازدحام برای جلوگیری از اینکست TCP و فروپاشی عملکرد.
- تخلیه محاسباتی در شبکه: کاهش سربار CPU میزبان برای عملیات جمعی (مانند all-reduce، broadcast).
- توپولوژی مقیاسپذیر: پشتیبانی از توپولوژیهای fat-tree و dragonfly+ با پهنای باند کامل تقاطع تا هزاران نقطه پایانی.
NVIDIA Mellanox MQM9790-NS2F به عنوان یک سوئیچ InfiniBand 400Gb/s NDR با 64 پورت OSFP طراحی شده است تا چگالی و عملکرد مورد نیاز برای استقرار در مقیاس Exascale را ارائه دهد.
2. طراحی معماری کلی شبکه
راه حل پیشنهادی از یک توپولوژی دو لایه leaf-spine استفاده میکند که تعادلی از مقیاسپذیری، کنترل بیش از حد اشتراکگذاری و سادگی کابلکشی را فراهم میکند. در لایه leaf، هر رک محاسباتی میزبان یک یا دو واحد MQM9790-NS2F InfiniBand switch است که 64 پورت اتصال 400Gb/s را به سرورهای GPU ارائه میدهد. در لایه spine، لایه دوم سوئیچهای MQM9790-NS2F تمام leafها را به هم متصل میکند و یک زیرساخت بدون مسدود کننده ایجاد میکند.
برای استقرارهای در مقیاس بزرگ فراتر از 2000 گره GPU، میتوان از معماری سه لایه folded-Clos استفاده کرد، که در آن MQM9790-NS2F 400Gb/s NDR 64-port OSFP هم به عنوان leaf و هم به عنوان spine عمل میکند تا عملکرد ثابت در تمام سطوح حفظ شود. این طراحی تضمین میکند که هر سرور میتواند با هر سرور دیگری با سرعت خط، با حداکثر سه هاپ سوئیچ ارتباط برقرار کند.
جدول زیر پارامترهای مقیاسپذیری معمول را برای یک زیرساخت leaf-spine 2 لایه ساخته شده بر اساس MQM9790-NS2F خلاصه میکند:
| مؤلفه | مشخصات | مقدار |
|---|---|---|
| سوئیچهای Leaf | MQM9790-NS2F در هر رک | 1-2 واحد |
| سوئیچهای Spine | MQM9790-NS2F | N/2 (که N = تعداد سوئیچهای leaf) |
| حداکثر نقاط پایانی | سرورهای GPU در هر زیرساخت | تا 4096 |
| پهنای باند تقاطع | غیر مسدود کننده کامل | 51.2 ترابیت بر ثانیه در هر لایه spine |
3. نقش و ویژگیهای کلیدی NVIDIA Mellanox MQM9790-NS2F
در این معماری، NVIDIA Mellanox MQM9790-NS2F به عنوان بلوک سازنده اصلی عمل میکند و چندین قابلیت حیاتی را ارائه میدهد:
- 400Gb/s NDR در هر پورت: هر یک از 64 پورت OSFP از 400Gb/s دو طرفه با تصحیح خطای پیشرو (FEC) برای اتصال قابل اعتماد در مسافت طولانی پشتیبانی میکند.
- SHARPv3 یکپارچه (پروتکل مقیاسپذیر سلسله مراتبی تجمیع و کاهش): عملیات ارتباطی جمعی را از CPUهای میزبان تخلیه میکند و تأخیر all-reduce MPI را تا 40% در کارهای در مقیاس بزرگ کاهش میدهد.
- مسیریابی تطبیقی و کنترل ازدحام: ترافیک را به طور پویا مجدداً هدایت میکند تا از نقاط داغ جلوگیری کند و عملکرد قابل پیشبینی را حتی تحت الگوهای ترافیکی خصمانه تضمین میکند.
- تلهمتری پیشرفته: شمارندههای هر جریان و هر پورت، همراه با نظارت بر اشغال بافر، دید عمیقی به سلامت زیرساخت ارائه میدهند.
طبق MQM9790-NS2F، این سوئیچ تأخیر cut-through زیر 100 نانوثانیه را ارائه میدهد و از ظرفیت سوئیچینگ تجمعی تا 51.2 ترابیت بر ثانیه پشتیبانی میکند. این مشخصات آن را به گزینهای ایدهآل برای استقرارهای جدید و ارتقاء مرحلهای از زیرساخت HDR (200Gb/s) تبدیل میکند.
4. توصیههای استقرار و مقیاسپذیری
برای سازمانهایی که قصد دارند از راه حل سوئیچ InfiniBand MQM9790-NS2F استفاده کنند، دستورالعملهای استقرار زیر توصیه میشود:
- استراتژی کابلکشی: از کابلهای مسی اتصال مستقیم (DAC) OSFP به OSFP برای اتصالات درون رک (تا 3 متر) و کابلهای نوری فعال (AOC) یا فرستندههای نوری برای پیوندهای بین رک و spine-leaf (تا 100 متر) استفاده کنید.
- افزونگی: دو منبع تغذیه و ماژولهای فن قابل تعویض در حین کار را مستقر کنید. هر منبع تغذیه را برای تحمل خطا به PDUs جداگانه وصل کنید.
- سازگاری سفتافزار: اطمینان حاصل کنید که تمام سوئیچها از یک نسخه سفتافزار NVIDIA استفاده میکنند تا از عدم تطابق ویژگیها جلوگیری شود. از ویژگی ارتقاء خودکار سفتافزار UFM برای بهروزرسانیهای غلتان استفاده کنید.
- مقیاسپذیری: برای خوشههای فراتر از 4000 گره، توپولوژی سه لایه folded-Clos یا dragonfly+ را با مسیریابی تطبیقی فعال در نظر بگیرید. اکوسیستم سازگار با MQM9790-NS2F شامل طیف گستردهای از اپتیکها و کابلها برای پشتیبانی از این توپولوژیها است.
هنگام محاسبه کل هزینه مالکیت، تعداد کمتر لایههای سوئیچ و کابلکشی سادهتر را در مقایسه با جایگزینهای با رادیک پایینتر در نظر بگیرید. در حالی که قیمت MQM9790-NS2F در هر واحد بالاتر از سوئیچهای نسل قبل است، هزینه هر پورت و هزینه شبکه هر GPU در استقرارهای در مقیاس بزرگ به طور قابل توجهی کمتر است و آن را به گزینهای مقرون به صرفه برای پروژههای Exascale تبدیل میکند.
5. عملیات، نظارت و عیبیابی
مدیریت مؤثر یک زیرساخت NDR نیازمند یک چارچوب جامع نظارت و عیبیابی است. مدیر یکپارچه زیرساخت (UFM) انویدیا یک نمای واحد برای کل زیرساخت مبتنی بر NVIDIA Mellanox MQM9790-NS2F ارائه میدهد و موارد زیر را ارائه میدهد:
- تجسم توپولوژی: کشف خودکار و نمایش گرافیکی تمام سوئیچها، پیوندها و نقاط پایانی.
- داشبوردهای عملکرد: نمایشهای بیدرنگ استفاده از پورت، نرخ خطا و شاخصهای ازدحام.
- هشدار پیشگیرانه: آلارمهای مبتنی بر آستانه برای تخریب پیوند، ناهنجاریهای دما و خرابی منبع تغذیه.
- جداسازی خطا: گردش کارهای عیبیابی هدایت شده که کابلهای معیوب، فرستندهها یا پورتهای سوئیچ را شناسایی میکنند.
برای عیبیابی پیشرفته، مشخصات MQM9790-NS2F شامل نظارت دقیق بافر و آمار سطح جریان است که میتواند از طریق REST API برای ادغام با پشتههای نظارت سفارشی صادر شود. مهندسان شبکه همچنین باید از ابزارهای تشخیصی داخلی سوئیچ، مانند تستهای loopback و تجزیه و تحلیل BER (نرخ خطای بیت) برای تأیید یکپارچگی پیوند قبل از استقرار بارهای کاری تولیدی استفاده کنند.
مشکلات رایج در استقرارهای اولیه شامل مسیریابی نامناسب ناشی از سرعتهای متفاوت پیوند یا انواع کابل نامتناسب است. فعال کردن مسیریابی تطبیقی و تأیید اینکه همه پیوندها با سرعت 400 گیگابیت بر ثانیه (با فعال بودن FEC) کار میکنند، بیشتر ناهنجاریهای عملکرد را برطرف میکند. راه حل سوئیچ InfiniBand MQM9790-NS2F همچنین شامل پشتیبانی از افزونگی مدیر زیرشبکه است که تضمین میکند بازپیکربندی زیرساخت میتواند بدون مداخله دستی در صورت خرابی گره مدیریت انجام شود.
6. خلاصه و ارزیابی ارزش
MQM9790-NS2F پیشرفت قابل توجهی در شبکه با کارایی بالا را نشان میدهد و پهنای باند 400Gb/s NDR، چگالی 64 پورت و شتابدهنده محاسباتی در شبکه را در یک پلتفرم 1U واحد و قابل مدیریت ارائه میدهد. برای معماران و مهندسان که خوشههای هوش مصنوعی و HPC را طراحی میکنند، این سوئیچ یک مسیر اثبات شده به عملکرد Exascale را فراهم میکند و امکانپذیر میسازد:
- کاهش تا 30% در زمان تکمیل شغل برای بارهای کاری آموزش در مقیاس بزرگ از طریق تخلیه SHARPv3.
- TCO پایینتر در مقایسه با راهحلهای جایگزین، ناشی از رادیک بالاتر و تعداد لایه سوئیچ کمتر.
- عملیات سادهتر از طریق ادغام UFM و تلهمتری جامع برای مدیریت پیشگیرانه خطا.
- مقیاسپذیری آیندهنگر برای پشتیبانی از نسل بعدی اتصالات GPU و شتابدهنده.
برای سازمانهایی که MQM9790-NS2F برای فروش را از طریق شبکه شرکای انویدیا ارزیابی میکنند، توصیه میکنیم برگه داده MQM9790-NS2F را به دقت بررسی کرده و با یک معمار راهحل معتبر در ارتباط باشید تا استقرار را مطابق با نیازهای خاص بار کاری و مقیاس خود تنظیم کنید. NVIDIA Mellanox MQM9790-NS2F اکنون آماده است تا به عنوان ستون فقرات اتصال با کارایی بالا برای دهه آینده اکتشافات علمی و نوآوری هوش مصنوعی عمل کند.

