توفر بطاقات AMD Instinct MI350P PCIe للمؤسسات طريقة لتشغيل أحمال عمل الذكاء الاصطناعي على البنية التحتية لمركز البيانات القائمة دون الحاجة إلى ترقيات رئيسية. تُعتبر البطاقات ثنائية الفتحة بمثابة بطاقات plug-and-play توائم خوادم مبردة بالهواء العادي وتدعم نشر الاستدلال ضمن قيود الطاقة والتبريد والرفوف الحالية.

تواجه المؤسسات التي تعتمد الذكاء الاصطناعي اختياراً صعباً: الانتقال إلى خدمات السحابة، مما يُدخل مخاوف الخصوصية والتكاليف غير المتوقعة، أو إعادة تصميم البنية التحتية المحلية لدعم منصات معجلات GPU المخصصة. تعالج بطاقات AMD Instinct MI350P PCIe هذه المشكلة بتقديم أداء الذكاء الاصطناعي في شكل عامل يتوافق مع الأنظمة القائمة.

مواصفات الأداء

تُسلّم بطاقات AMD Instinct MI350P PCIe ما يصل إلى 2,299 تيرافلوب وذروة 4,600 تيرافلوب بدقة MXFP4، وهو أداء موصوف بأنه الأعلى المتاح في بطاقة PCIe للمؤسسات. تتضمن البطاقات 144 جيجابايت من ذاكرة النطاق العريض الثالثة من الجيل الثالث وتعمل بسرعة تصل إلى 4 تيرابايت في الثانية.

تدعم البطاقات نسق MXFP6 و MXFP4 منخفض الدقة بشكل أصلي لإنتاجية عالية، بالإضافة إلى تسريع التناثر لدقة 8-بت و 16-بت. يقلل هذا التصميم استخدام الذاكرة والطاقة، مما يسمح بالنشر في مراكز بيانات مبردة بالهواء القياسي دون ترقيات واسعة للبنية التحتية للتبريد.

النشر والتكامل

يمكن لبطاقات AMD Instinct MI350P PCIe التشغيل مع ما يصل إلى ثماني بطاقات معجل لكل نظام في البيئات المبردة بالهواء. صممتها الشركة للنماذج الصغيرة والمتوسطة والكبيرة للذكاء الاصطناعي التي تركز على الاستدلال وخطوط أنابيب الاسترجاع المعزز.

تتكامل البطاقات مع النظم البيئية الحوسبة الموجودة من خلال معايير مفتوحة. يتضمن الدعم عامل تشغيل Kubernetes GPU للإدارة طوال دورة الحياة، والخدمات الدقيقة لـ AMD Inference الأصلية للسحابة، والدعم الأصلي للأطر مثل PyTorch. يُمكّن هذا التصميم نقل الأحمال مع حد أدنى من تغييرات التعليمات البرمجية، مما يقلل التعقيد التشغيلي.

البرمجيات والنظام البيئي المفتوح

توفر AMD مجموعة مرجعية لبرامج الذكاء الاصطناعي للمؤسسات مفتوحة المصدر للشركاء بدون تكلفة ترخيص. توفر المجموعة شفافية التعليمات البرمجية وتقلل النفقات التشغيلية مقارنة بنماذج الترخيص القائمة على التوكن. عند إقرانها ببطاقات AMD Instinct MI350P PCIe، فإن الجمع بين الاثنين يُمكّن المؤسسات من نشر أنظمة الذكاء الاصطناعي محلياً دون رسوم استخدام جارية.

يمتد نهج النظام البيئي المفتوح إلى دعم مستوى الدقة. تدعم البطاقات تنسيقات FP8 و MXFP8 و MXFP4 إلى جانب خيارات الدقة الأعلى مثل INT8 و BF16 مع تسريع التناثر. تسمح هذه المرونة للمؤسسات بمطابقة مستويات الدقة مع متطلبات الحمل المحددة.

حالات الاستخدام المستهدفة

تستهدف بطاقات AMD Instinct MI350P PCIe المؤسسات التي تتطلب قدرة حوسبة للذكاء الاصطناعي أكثر مما توفره وحدات المعالجة المركزية ولكنها ليست مستعدة للاستثمار في منصات معجل GPU المخصصة. يناسب شكل عامل بطاقة PCIe المؤسسات التي تقيّم استراتيجيات اعتماد الذكاء الاصطناعي أو توسيع أحمال الاستدلال بشكل متدرج.

يتجنب نشر أحمال عمل الذكاء الاصطناعي في مراكز البيانات القائمة النفقات الرأسمالية والتعقيد التشغيلي لإعادة تصميم البنية التحتية. يمكن للمؤسسات الانتقال من التقييم إلى أنظمة جاهزة للإنتاج دون إعادة بناء بيئة الحوسبة الخاصة بها من الصفر.