→ العودة للأخبار EN
AICloudHardwareProduct Release

ModelExpress: توزيع نماذج الذكاء الاصطناعي بسرعة الضوء

تقدم NVIDIA من خلال ModelExpress حلاً لتقليل تكلفة نقل نقاط التحقق الكبيرة للنماذج، مما يسرع توزيع أوزان النماذج عبر العناقيد لأغراض مثل البدء البارد، التوسع التلقائي، والتحديثات التدريجية.

1 دقيقة قراءة

كل بايت يتم نقله له تكلفة. ومع ازدياد حجم نقاط التحقق للنماذج إلى مئات الجيجابايت أو حتى التيرابايت، تتراكم هذه التكلفة بسرعة. يُعد نقل أوزان النماذج عبر العناقيد أمرًا شائعًا للغاية. على سبيل المثال، قد يقوم البدء البارد بسحب الأوزان من التخزين البعيد إلى ذاكرة GPU؛ كما يجب على التوسع التلقائي والتحديثات التدريجية تهيئة كل نسخة جديدة؛ ويستمر التعلم التعزيزي بعد التدريب في تحديث النماذج بشكل مستمر. يعالج ModelExpress من NVIDIA هذه التحديات من خلال تمكين توزيع أسرع وأكثر كفاءة لنماذج الذكاء الاصطناعي الكبيرة، مما يقلل من العبء والكمون المرتبطين بنقل نقاط التحقق الضخمة عبر عناقيد الحوسبة.

اقرأ من المصدر الأصلي ↗