التدريب المسبق للتخيل والتعديل الدقيق للتنفيذ: صعود نماذج World-Action
تستكشف NVIDIA نماذج Vision-Language-Action (VLA) ونماذج World-Action (WAM) التي تستفيد من الأُطُر الكبيرة المدربة مسبقاً في VLM لتمكين الروبوتات من توليد الأفعال بناءً على المدخلات البصرية واللغوية.