Cisco UCS C885A M8

سرور Cisco UCS C885A M8 یکی از قدرتمندترین سرورهای رکمونت خانواده Cisco UCS C-Series است که برای اجرای Workloadهای بسیار سنگین AI، یادگیری ماشین، LLM و HPC طراحی شده است.

این سرور با بهره‌گیری از پردازنده‌های نسل جدید AMD EPYC 9005 Series، حافظه DDR5، ارتباطات PCIe Gen5 و پشتیبانی از GPUهای قدرتمند، یک پلتفرم مناسب برای زیرساخت‌های مدرن دیتاسنتر و Applicationهای مبتنی بر پردازش موازی محسوب می‌شود.

C885A M8 با ظرفیت حافظه بالا، امکان نصب تا 6 ترابایت RAM از نوع DDR5 را فراهم می‌سازد. این سرور همچنین قابلیت پشتیبانی از 8 عدد GPU را برای پردازش‌های سنگین هوش مصنوعی و HPC ارائه می‌دهد.

Cisco UCS C885A M8 Physical Layout

مشخصات Cisco UCS C885A M8 در یک نگاه

Cisco UCS C885A M8 یک سرور متراکم GPU با فرم فاکتور 8RU است. این پلتفرم از پردازنده‌های AMD EPYC نسل چهارم و پنجم، حداکثر 24 ماژول DDR5 RDIMM، فضای ذخیره‌سازی NVMe و GPUهای پرقدرت برای بارهای کاری AI و HPC پشتیبانی می‌کند.

گزینه‌های GPU شامل 8 عدد NVIDIA H100 یا H200 و همچنین 8 عدد AMD MI300X است. برای شبکه نیز رابط‌های پرسرعت NVIDIA ConnectX-7 و BlueField-3 برای ترافیک East-West و North-South قابل استفاده هستند.

Cisco UCS C885A M8 Dense GPU Server Specifications

مقایسه Cisco UCS C885A M8 با C845A M8

یکی از تفاوت‌های اصلی این دو پلتفرم در معماری GPU است. C845A M8 بر مبنای معماری NVIDIA MGX طراحی شده و انعطاف‌پذیری بالایی برای انتخاب و توسعه GPU ارائه می‌دهد، در حالی که C885A M8 از معماری NVIDIA HGX برای بارهای کاری بسیار متراکم AI و HPC استفاده می‌کند.

Cisco C845A M8 MGX vs C885A M8 HGX

C845A M8 یک سرور 4RU با امکان استفاده از 2 تا 8 GPU است، در حالی که C885A M8 یک پلتفرم 8RU با 8 GPU مبتنی بر HGX است. معماری C885A M8 برای محیط‌هایی طراحی شده که به حداکثر کارایی GPU، ارتباطات پرسرعت بین GPUها و اجرای مدل‌های بزرگ هوش مصنوعی نیاز دارند.

Cisco Rack Server for AI Workloads C845A M8 and C885A M8

گزینه‌های GPU در سرورهای Cisco UCS M8

خانواده Cisco UCS M8 طیف متنوعی از GPUها را برای Workloadهای مختلف ارائه می‌دهد. بسته به نوع سرور می‌توان از GPUهایی مانند NVIDIA L4، L40S، H100 NVL، H200 NVL و همچنین AMD MI210 استفاده کرد. در C885A M8 گزینه‌های NVIDIA H100/H200 SXM و AMD MI300X OAM برای پردازش‌های بسیار سنگین AI Training، HPC و Data Analytics در نظر گرفته شده‌اند.

Cisco UCS M8 GPU Options

طراحی شبکه Backend برای کلاسترهای بزرگ GPU

در پروژه‌های بزرگ هوش مصنوعی، تنها قدرت پردازشی GPU اهمیت ندارد و شبکه ارتباطی بین GPU Nodeها نیز باید پهنای باند بالا و تأخیر بسیار پایین داشته باشد. برای توسعه کلاسترهای بزرگ می‌توان از معماری Leaf-Spine با شبکه 400GbE استفاده کرد.

نمونه طراحی نشان داده شده، یک شبکه Non-Blocking برای اتصال 256 GPU است که با استفاده از سوئیچ‌های Cisco Nexus 9364D-GX2A با پورت‌های 400GbE پیاده‌سازی می‌شود. این معماری امکان ایجاد Backend GPU Network با پهنای باند بالا برای AI Training در مقیاس بزرگ را فراهم می‌کند.

Cisco GPU Backend Network 400GbE

مدیریت Cisco UCS C885A M8 توسط Cisco Intersight

سرور C885A M8 از طریق Cisco Intersight قابل مدیریت است. Intersight امکان مشاهده وضعیت سلامت سرور، Inventory سخت‌افزار، وضعیت CPU و اجزای سیستم، رخدادها، Alarmها و انجام عملیات مدیریتی و جمع‌آوری Tech Support Bundle را از یک رابط متمرکز فراهم می‌کند.

Cisco UCS C885A M8 Intersight Management