مصطلح تقني
نموذج الرؤية واللغة والحركة (VLA)
نموذج الرؤية واللغة والحركة هو نظام ذكاء اصطناعي يجمع بين فهم الصور واللغة وتوليد الأوامر الحركية، بحيث يستطيع الروبوت تفسير المشهد والتعليمات ثم تحويلهما إلى حركات قابلة للتنفيذ.
بالإنجليزية
Vision-Language-Action Model
بالعربية
نموذج الرؤية واللغة والحركة
ظهر أول مرة في
الروبوتات تتوقف كي تفكر، وطريقة جديدة تجعلها تخطط أثناء الحركة