محطة من الخط الزمني
GPT-4o يوحد التفاعل الفوري بالنص والرؤية والصوت
ضمن من الشبكات التوليدية إلى وكلاء الذكاء الاصطناعي: كيف تطور الذكاء الاصطناعي التوليدي
-
Model Launch
GPT-4o يوحد التفاعل الفوري بالنص والرؤية والصوت
عالج GPT-4o مزيجاً من النص والصوت والصور وأنتجه بزمن استجابة أقل من الأنظمة السابقة المركبة من نماذج منفصلة.
OpenAI يشير الحرف “o” إلى “omni” أو الشمول، في انتقال من المحادثة النصية إلى تفاعل متعدد الوسائط أكثر طبيعية. جعل الصوت والرؤية المساعدات الذكية أكثر فورية، وأثارا في الوقت نفسه أسئلة أكبر حول الانتحال والخصوصية والاعتماد العاطفي وضوابط إنشاء الوسائط المباشرة.المصادر والمراجع 1 مصدر