تسريع تدريب النماذج باستخدام JAX وMaxText مع NVFP4 على NVIDIA Blackwell
تقدم NVIDIA دعم دقة NVFP4 في JAX وMaxText لتسريع تدريب النماذج اللغوية الكبيرة على معالجات Blackwell، مما يحسن معدل الإنتاجية ويقلل زمن وتكلفة التدريب.
موجز التقنية المُحدَّث تلقائيًا
تقدم NVIDIA دعم دقة NVFP4 في JAX وMaxText لتسريع تدريب النماذج اللغوية الكبيرة على معالجات Blackwell، مما يحسن معدل الإنتاجية ويقلل زمن وتكلفة التدريب.
حققت NVIDIA انتصاراً كاملاً في MLPerf Training v6.0، مقدمة أسرع أوقات تدريب على نطاق واسع وأعلى أداء لكل معجّل عبر جميع الاختبارات، وكانت المنصة الوحيدة التي قدمت نتائج في كل اختبار.
كشفت NVIDIA عن معالج Vera CPU المصمم لتطوير أعباء عمل الذكاء الاصطناعي الوكلي في مصانع الذكاء الاصطناعي، مستنداً إلى قوانين توسع جديدة تتجاوز التدريب والاستدلال التقليدي المعتمد على وحدات معالجة الرسوميات GPU.
تقدم NVIDIA تقنية DFlash للتخمين التقريري لتعزيز أداء الاستدلال حتى 15 ضعفًا على معالجات Blackwell، مما يحسن تدفقات عمل الذكاء الاصطناعي منخفضة الكمون عبر تحسين توليد رموز النماذج اللغوية التوليدية autoregressive.
تمكّن نماذج Mixture-of-experts (MoE) من زيادة سعة نماذج الذكاء الاصطناعي عبر تفعيل مجموعة فرعية فقط من المعاملات لكل رمز. تستكشف NVIDIA نوى دمج متقدمة لتحسين معدل تدريب MoE في أنظمة الذكاء الاصطناعي واسعة النطاق.
تقدم NVIDIA طريقة لسد الفجوة بين التدريب ونشر نماذج المركبات الذاتية القيادة عبر إعادة التدريب في نظام مغلق باستخدام منصة Alpamayo، مما يعزز نماذج الرؤية واللغة والفعل لمشاهد القيادة المعقدة.
NVIDIA تتصدر أداء الترميز الوكالي في أول معيار متعدد البائعين لوكلاء الذكاء الاصطناعي في الصناعة، Artificial Analysis AgentPerf، الذي يحاكي مهام الترميز الواقعية لوكلاء الذكاء الاصطناعي.
تمكّن نماذج الأساس المدربة مسبقًا على مجموعات بيانات ضخمة من تسلسلات البروتين والجينوم، مثل ESM2 وEvo 2، من أداء مهام متنوعة في علم الأحياء الحاسوبي. تسهّل وصفات NVIDIA BioNeMo عملية الضبط الدقيق لهذه النماذج باستخدام LoRA.
تُعدّ بنى المحولات المحرك الأساسي للعديد من نماذج اللغة الكبيرة والذكاء الاصطناعي التوليدي. مع تزايد حجم هذه النماذج، تزداد متطلبات التدريب من حيث موارد GPU ووقت الهندسة. تحسين نماذج المحولات للتدريب بدقة منخفضة يسرّع التطوير ويخفض التكاليف.
تقدم NVIDIA نظام الذكاء الاصطناعي متعدد الوسائط MiniMax M3 على بنية NVIDIA المسرّعة بما في ذلك NVIDIA Blackwell، مما يمكّن من التفكير طويل السياق ويبسط سير عمل الذكاء الاصطناعي في المؤسسات.
تقدم NVIDIA تقنية Nemotron 3 Ultra لتعزيز الكفاءة وقدرات الاستدلال لوكلاء الذكاء الاصطناعي طويل الأمد الذين يديرون سير عمل معقد مع زيادة عدد الرموز.
كشفت AWS في قمة نيويورك 2026 عن قدرات جديدة لوكلاء الذكاء الاصطناعي، وأدوات أمنية، وترقيات في الأجهزة، وتطبيقات محمولة.