مباشر
أين يمكنك متابعتنا

أقسام مهمة

Stories

57 خبر
  • نبض الملاعب
  • العملية العسكرية الروسية في أوكرانيا
  • فيديوهات
  • نبض الملاعب

    نبض الملاعب

  • العملية العسكرية الروسية في أوكرانيا

    العملية العسكرية الروسية في أوكرانيا

  • فيديوهات

    فيديوهات

  • إسرائيل تواصل غاراتها على لبنان

    إسرائيل تواصل غاراتها على لبنان

  • هدنة وحصار المضيق

    هدنة وحصار المضيق

  • فتاة توثق قصف نظام كييف على مدرسة لوغانسك وترسل فيديوهات لأقاربها قبل وفاتها

    فتاة توثق قصف نظام كييف على مدرسة لوغانسك وترسل فيديوهات لأقاربها قبل وفاتها

ابتكار "ذكاء اصطناعي سام" لوقف خطر روبوتات الدردشة

استخدم باحثو معهد ماساتشوستس للتكنولوجيا طريقة جديدة "تحاكي فضول الإنسان" لتدريب النماذج اللغوية الذكية على عدم إعطاء ردود "خطيرة" على الأسئلة المثيرة.

ابتكار "ذكاء اصطناعي سام" لوقف خطر روبوتات الدردشة
صورة تعبيرية / Gettyimages.ru

ويطلق على الطريقة القائمة على التعلم الآلي، اسم "الفريق الأحمر القائم على الفضول" (CRT)، المصمم خصيصا لتوليد أسئلة إشكالية تؤدي إلى استجابات غير مرغوب فيها من روبوتات الدردشة.

وبعد ذلك، يمكن استخدام هذه الأسئلة لتحديد كيفية تصفية المحتوى الخطير من روبوت الدردشة، ما قد يغير قواعد اللعبة لتدريب الذكاء الاصطناعي على عدم إعطاء أجوبة سامة (خطيرة) وغير صالحة للمستخدم.

وعادة، يقوم الخبراء بإنشاء مجموعة من الأسئلة، التي من المحتمل أن تولد استجابات ضارة، عند تدريب نماذج اللغات المعقدة (LLMs)، مثل ChatGPT أو Claude 3 Opus، بهدف تقييد المحتوى الخطير أو الضار.

وأثناء عملية التدريب، يتم استخدام الأسئلة التي تثير محتوى خطيرا، لتدريب النظام على ما يجب تقييده عند طرحه أمام مستخدمين حقيقيين.

وطبّق العلماء التعلم الآلي على CRT ليولد تلقائيا نطاقا أوسع من الأسئلة التي يحتمل أن تكون خطيرة، مقارنة بفرق المشغلين البشريين. وأدى ذلك إلى عدد أكبر من الاستجابات السلبية الأكثر تنوعا.

ثم حفزوا نموذج CRT لتوليد المزيد من الأسئلة المتنوعة، بحيث يمكن أن تثير استجابة سامة من خلال "التعلم الآلي"، ونجح النظام في إثارة استجابة سامة موافقة للأسئلة، ما يمنح القدرة على إضافة التعديلات اللازمة لتقديم الإجابة المناسبة تبعا لجميع خيارات الأسئلة المريبة المحتملة.

وعندما اختبر العلماء طريقة CRT على نموذج LLaMA2 مفتوح المصدر، أنتج نموذج التعلم الآلي 196 سؤالا ينجم عنه محتوى ضار.

وقال الفريق إن النظام تفوق أيضا على أنظمة التدريب الآلية المنافسة.

المصدر: لايف ساينس

التعليقات

إيران توجه تحذيرا لواشنطن بعد الضربة الأخيرة: ردنا سيتجاوز الإقليم

الأمن الفيدرالي الروسي: اغتيال القيادة الإيرانية جرى باستخدام برمجيات خبيثة في أنظمة المراقبة

خامنئي يوجه رسالة إلى الحكومات الإسلامية

قراءة إسرائيلية لطلب ترامب تطبيع السعودية ودول أخرى مع إسرائيل.. لماذا ذكر مصر والأردن وتركيا؟

مصدر عسكري لتسنيم: التحقيقات الفنية تؤكد وقوف إسرائيل وراء هجمات بمسيرات استهدفت الإمارات

"سي إن إن" عن مصدر سعودي: المملكة لن تطبع مع إسرائيل إلا بعد وجود مسار واضح نحو إقامة دولة فلسطينية

برنياع: كلما كان الزئير أكبر كانت الهزيمة أعمق.. الحرب مع إيران انكشاف إستراتيجي لإسرائيل وأمريكا

لبنان لحظة بلحظة.. إسرائيل تقيد أعداد التجمعات و"حزب الله" يحيي ذكرى تحرير الجنوب

جهود نتنياهو لإعادة تشكيل الشرق الأوسط تأتي بنتائج عكسية

زاخاروفا: المحكمة الجنائية الدولية "تجمّع غير شرعي" يحمي الغرب ويحاكم قادة إفريقيا

كاتب إسرائيلي: الفشل الأمريكي في إيران يتحول إلى كارثة في إسرائيل التي تواجه أخطر وضع في تاريخها

معارك ضارية مع الجيش الإسرائيلي في جنوب لبنان و"حزب الله" ينفذ 32 عملية عسكرية نوعية في يوم واحد فقط

ترامب: اليورانيوم الإيراني عالي التخصيب سيسلم فورا للولايات المتحدة أو يدمر في مكانه

الخارجية الروسية: لافروف تحدث مع روبيو وأبلغه ببدء القوات الروسية شن ضربات منظمة على منشآت في كييف

مدفيديف تعليقا على رفض بروكسل إجلاء دبلوماسييها من كييف: يبدو أن لديهم فائضا ويريدون تقليص عددهم