Stories
-
رياضة
RT STORIES
رد فعل ريال مدريد على قرعة دوري أبطال أوروبا
#اسأل_أكثر #Question_MoreRT STORIES
مصطفى شوبير يقترب من تجديد عقده مع الأهلي.. وخلاف وحيد يعطل الاتفاق (فيديو)
#اسأل_أكثر #Question_MoreRT STORIES
رد فعل محمد صلاح بعد تلقي طرابزون الهدف الرابع أمام فيرنشيفاروشي (فيديو)
#اسأل_أكثر #Question_MoreRT STORIES
بمشاركة عالمية كبيرة.. موسكو تستعد لانطلاق أبو ظبي غراند سلام للجوجيستو
#اسأل_أكثر #Question_MoreRT STORIES
"الفيفا" يقر تعديلا مفاجئا بعد عقوبة لاعبي الأرجنتين إثر نهائي كأس العالم 2026
#اسأل_أكثر #Question_MoreRT STORIES
إنتر ميامي يعلن عن تعيين مدرب جديد
#اسأل_أكثر #Question_More
رياضة
-
العملية العسكرية الروسية في أوكرانيا
RT STORIES
الدفاع الروسية في حصاد الأسبوع للعملية الخاصة: تنفيذ 12 ضربة جماعية وتحرير7 بلدات
#اسأل_أكثر #Question_MoreRT STORIES
موسكو: التفاوض معلق ونواصل تدمير البنية التحتية العسكرية لنظام كييف
#اسأل_أكثر #Question_MoreRT STORIES
الدفاع الروسية: إسقاط 512 مسيرة أوكرانية غربي البلاد
#اسأل_أكثر #Question_More
العملية العسكرية الروسية في أوكرانيا
-
فيديوهات
RT STORIES
فيديو مروع لسيول نيبال التي خلفت عشرات القتلى والمفقودين
#اسأل_أكثر #Question_MoreRT STORIES
شاهد لحظة تحطم طائرة خفيفة في إيطاليا وسقوطها أمام عيني شقيق الطيار
#اسأل_أكثر #Question_More
فيديوهات
-
حرب الخليج
RT STORIES
إعادة الدبلوماسية لمسارها ممكنة.. عراقجي يصف محادثاته مع نظيره القطري بـ"الخلّاقة"
#اسأل_أكثر #Question_MoreRT STORIES
البنتاغون يعلن "تطهير مضيق هرمز بالكامل من الألغام التي زرعتها إيران"
#اسأل_أكثر #Question_More
حرب الخليج
ابتكار "ذكاء اصطناعي سام" لوقف خطر روبوتات الدردشة
استخدم باحثو معهد ماساتشوستس للتكنولوجيا طريقة جديدة "تحاكي فضول الإنسان" لتدريب النماذج اللغوية الذكية على عدم إعطاء ردود "خطيرة" على الأسئلة المثيرة.
ويطلق على الطريقة القائمة على التعلم الآلي، اسم "الفريق الأحمر القائم على الفضول" (CRT)، المصمم خصيصا لتوليد أسئلة إشكالية تؤدي إلى استجابات غير مرغوب فيها من روبوتات الدردشة.
وبعد ذلك، يمكن استخدام هذه الأسئلة لتحديد كيفية تصفية المحتوى الخطير من روبوت الدردشة، ما قد يغير قواعد اللعبة لتدريب الذكاء الاصطناعي على عدم إعطاء أجوبة سامة (خطيرة) وغير صالحة للمستخدم.
وعادة، يقوم الخبراء بإنشاء مجموعة من الأسئلة، التي من المحتمل أن تولد استجابات ضارة، عند تدريب نماذج اللغات المعقدة (LLMs)، مثل ChatGPT أو Claude 3 Opus، بهدف تقييد المحتوى الخطير أو الضار.
دراسة: الذكاء الاصطناعي يتفوق على البشر في التعاطف مع المشاعر
وأثناء عملية التدريب، يتم استخدام الأسئلة التي تثير محتوى خطيرا، لتدريب النظام على ما يجب تقييده عند طرحه أمام مستخدمين حقيقيين.
وطبّق العلماء التعلم الآلي على CRT ليولد تلقائيا نطاقا أوسع من الأسئلة التي يحتمل أن تكون خطيرة، مقارنة بفرق المشغلين البشريين. وأدى ذلك إلى عدد أكبر من الاستجابات السلبية الأكثر تنوعا.
ثم حفزوا نموذج CRT لتوليد المزيد من الأسئلة المتنوعة، بحيث يمكن أن تثير استجابة سامة من خلال "التعلم الآلي"، ونجح النظام في إثارة استجابة سامة موافقة للأسئلة، ما يمنح القدرة على إضافة التعديلات اللازمة لتقديم الإجابة المناسبة تبعا لجميع خيارات الأسئلة المريبة المحتملة.
وعندما اختبر العلماء طريقة CRT على نموذج LLaMA2 مفتوح المصدر، أنتج نموذج التعلم الآلي 196 سؤالا ينجم عنه محتوى ضار.
وقال الفريق إن النظام تفوق أيضا على أنظمة التدريب الآلية المنافسة.
المصدر: لايف ساينس
التعليقات