DynoSim: محاكاة حدود باريتو لتحسين تقديم نماذج اللغة الكبيرة
يُعالج DynoSim تعقيدات ضبط نشرات تقديم نماذج اللغة الكبيرة الحديثة من خلال محاكاة حدود باريتو عبر خيارات النظام المتداخلة مثل نموذج الخلفية، شكل التنسور المتوازي، وعوامل التوسع التلقائي.
موجز التقنية المُحدَّث تلقائيًا
يُعالج DynoSim تعقيدات ضبط نشرات تقديم نماذج اللغة الكبيرة الحديثة من خلال محاكاة حدود باريتو عبر خيارات النظام المتداخلة مثل نموذج الخلفية، شكل التنسور المتوازي، وعوامل التوسع التلقائي.
يقدم DiffusionGemma، الذي طورته Google DeepMind وتم تحسينه لمنصات NVIDIA، نهجًا جديدًا لتسريع توليد النصوص حرفًا بحرف لتطبيقات الذكاء الاصطناعي الفورية مثل مساعدي الدردشة والمساعدين، مما يحسن الاستجابة ويخفض تكاليف الخدمة.
حققت بطاقة NVIDIA Blackwell رقماً قياسياً جديداً في معيار STAC-AI لأداء استنتاج نماذج اللغة الكبيرة في التداول المالي، مما يمكّن من تحليل متقدم للبيانات غير المنظمة لتحسين رؤى التداول.
يُعد NVIDIA Cosmos 3 نموذجًا أساسيًا رائدًا يمكّن أنظمة الذكاء الاصطناعي الفيزيائية مثل الروبوتات والمركبات الذاتية القيادة من فهم العالم الحقيقي والتنبؤ به والتفاعل معه.
تدريب نماذج الذكاء الاصطناعي الصوتية على التعرف الدقيق على المصطلحات السريرية يمثل تحديًا كبيرًا. تساعد NVIDIA Nemotron Speech وAgent Skills في تسريع تقييم نماذج التعرف التلقائي على الكلام السريري، مما يحسن من دقة التعرف على أسماء الأدوية المعقدة والمصطلحات الطبية.
تقدم NVIDIA وكلاء الذكاء الاصطناعي وFLARE Auto-FL لتسريع أبحاث التعلم الفيدرالي من خلال أتمتة تصميم التجارب وتقييمها، مما يعالج تحديات تقييم تحسين المقاييس.
تقدم NVIDIA دعم دقة NVFP4 في JAX وMaxText لتسريع تدريب النماذج اللغوية الكبيرة على معالجات Blackwell، مما يحسن معدل الإنتاجية ويقلل زمن وتكلفة التدريب.
تستكشف NVIDIA بناء نماذج أساسية للذكاء المالي باستخدام بيانات المعاملات، مع التركيز على أهمية الأنماط التسلسلية في سجلات العملاء مقارنة بالميزات التقليدية المصممة يدوياً.
حققت NVIDIA انتصاراً كاملاً في MLPerf Training v6.0، مقدمة أسرع أوقات تدريب على نطاق واسع وأعلى أداء لكل معجّل عبر جميع الاختبارات، وكانت المنصة الوحيدة التي قدمت نتائج في كل اختبار.
كشفت NVIDIA عن معالج Vera CPU المصمم لتطوير أعباء عمل الذكاء الاصطناعي الوكلي في مصانع الذكاء الاصطناعي، مستنداً إلى قوانين توسع جديدة تتجاوز التدريب والاستدلال التقليدي المعتمد على وحدات معالجة الرسوميات GPU.
تقدم NVIDIA تقنية DFlash للتخمين التقريري لتعزيز أداء الاستدلال حتى 15 ضعفًا على معالجات Blackwell، مما يحسن تدفقات عمل الذكاء الاصطناعي منخفضة الكمون عبر تحسين توليد رموز النماذج اللغوية التوليدية autoregressive.
تُظهر NVIDIA مثالًا مفتوح المصدر يجمع بين Hermes Agent وNVIDIA NemoClaw لتسريع وتأمين أبحاث المنتجات عبر Outlook وSlack وGitHub، مستفيدة من وكلاء الذكاء الاصطناعي لتركيب البيانات واتخاذ القرارات.