محطة من الخط الزمني
DeepSeek-R1 يتيح الاستدلال المتقدم عبر نماذج مفتوحة الأوزان
ضمن من الشبكات التوليدية التنافسية إلى وكلاء الذكاء الاصطناعي: كيف تطور الذكاء الاصطناعي التوليدي
-
Model Release
DeepSeek-R1 يتيح الاستدلال المتقدم عبر نماذج مفتوحة الأوزان
نشرت DeepSeek نماذج للاستدلال وتفاصيلها التقنية وإصدارات مقطّرة، موضحة أن التعلم المعزز يستطيع تنمية أنماط استدلال متقدمة، ومتيحة دراسة هذه القدرات وتشغيلها خارج خدمة مغلقة.
لم يكن DeepSeek-R1 أول نموذج استدلالي، إذ سبقه o1 من أوبن إيه آي، لكنه غيّر نطاق الجهات القادرة على دراسة هذه النماذج وتشغيلها. طوّر DeepSeek-R1-Zero سلوكيات مثل التحقق الذاتي وتعديل استراتيجية الحل عبر التعلم المعزز واسع النطاق، من دون بدء التدريب بمرحلة ضبط موجّه. وأضاف نموذج R1 الكامل بيانات تمهيدية لتحسين قابلية القراءة وتقليل التكرار وخلط اللغات. كما نشرت DeepSeek الأوزان وإصدارات أصغر مقطّرة اعتماداً على Llama وQwen، ما وسّع الوصول إلى التقنية، مع بقاء غموض بيانات التدريب ومتطلبات تشغيل النموذج الكامل من القيود المهمة.
المصادر والمراجع 2 مصادر
تابع القراءة