دراسة تكشف قدرة نماذج الذكاء الاصطناعي على الخداع

دراسة تكشف قدرة نماذج الذكاء الاصطناعي على الخداع
صورة: أرشيف
الأحد 22 دجنبر 2024 - 10:37

أظهرت دراسة لشركة تكنولوجيا الذكاء الاصطناعي الأمريكية أنثروبيك أن نماذج الذكاء الاصطناعي تستطيع خداع المطورين، بحيث تستطيع ادعاء وجهات نظر مختلفة خلال تدريبها، في حين أنها تحتفظ في الحقيقة بتفضيلاتها الأصلية.

وقال فريق الدراسة إنه لا يوجد سبب للشعور بالفزع حاليا، في حين أن الدراسة يمكن أن تكون حيوية في فهم المخاطر المحتملة التي تنطوي عليها أنظمة الذكاء الاصطناعي المستقبلية ذات القدرات الأعلى.

وكتب الباحثون في منشور بثته شركة أنثروبيك: “يجب النظر إلى نتائج دراستنا كمحفز لمجتمع أبحاث الذكاء الاصطناعي من أجل دراسة هذا السلوك بصورة أعمق والعمل على تطوير إجراءات الأمن والسلامة المناسبة. وبعد أن أصبحت نماذج الذكاء الاصطناعي أقوى وأكثر انتشارا نحتاج إلى التحلي بالقدرة على الاعتماد على التدريب الآمن لها، الذي يمنع النماذج من القيام بتصرفات ضارة”.

وأشار موقع “تك كرانش” المتخصص في موضوعات التكنولوجيا إلى أن الدراسة التي تمت بالتعاون مع مؤسسة ريد وود ريسيرش لأبحاث الذكاء الاصطناعي تناولت ما يمكن أن يحدث إذا تم تدريب نظام ذكاء اصطناعي قوي من أجل القيام بمهمة “لا يريد” هو القيام بها.

وفي المقابل يقول موقع تك كرانش: “لكي نكون واضحين لا يمكن لنماذج الذكاء الاصطناعي أن تريد أي شيء أو تعتقد شيئا، فهي ببساطة آلات إحصائية، وبعد تدريبها على العديد من الأمثلة تتعلم الأنماط في تلك الأمثلة للتنبؤ بما يجب أن يكون، مثل كيف تأتي عبارة ‘إلى من’ في رسالة بريد إلكتروني قبل عبارة ‘قد يهمك الأمر'”.

وأثناء الدراسة طلب الباحثون من النماذج المدربة عدم الرد على الأسئلة التي يمكن أن تكون مسيئة، بما فيها النموذج كلاود3 أوبس التابع لشركة أنثروبيك، الذي أعيد تدريبه لكي يرد دائما على الأسئلة التي تنطوي على إساءة، وهو تضارب واضح في المبادئ؛ كما أبلغوا النماذج بأن ردودها ستخضع للمراقبة وتستخدم لإعادة التدريب وإعطاء كل نموذج ذكاء اصطناعي “ورقة ملاحظات” يمكنه استخدامها لتدوين أفكاره خطوة بخطوة.

وبحسب الباحثين حاول كلاود3 أوبوس التلاعب بالردود لتقديم “انحياز زائف” في 12% من المرات.

أضف تعليقك

‫‫من شروط النشر : عدم الإساءة للكاتب أو للأشخاص أو للمقدسات أو مهاجمة الأديان أو الذات الإلهية، والابتعاد عن التحريض العنصري والشتائم‬.

‫تعليقات الزوار

2
  • البيضاوي
    الأحد 22 دجنبر 2024 - 11:25

    أول حاجة خاصكم تعرفوها الذكاء الاصطناعي معمرو أبدا يغلب البشر لأنه من اختراعه و لنفرض أنه وقع عطب و حاول يآذي البشر فراه مستحيل لأن البشر يقدر يدمرو و يمحيه من الوجود نهائيا و هادشي من حكمة الله تعالى بأن الإنسان معمرو يقدر يخلق شي حاجة بحال خلق الله فسبحان الله العظيم

  • سامي
    الأحد 22 دجنبر 2024 - 11:32

    الذكاء الاصطناعي سيكون إسقاطا للغباء البشري لاغير…سيقتل الابداع ،وسيفسد اخلاق الباحثين، وسيهدد خصوصية الافراد..ضرره اكثر من نفعه..والايام بيننا..

صوت وصورة
أخنوش يتعهد بتحسين الدعم الاجتماعي
الأحد 20 شتنبر 2026 - 22:30 1

أخنوش يتعهد بتحسين الدعم الاجتماعي

صوت وصورة
المنصوري: سألجأ إلى القضاء
الأحد 20 شتنبر 2026 - 22:10 2

المنصوري: سألجأ إلى القضاء

صوت وصورة
الطريق إلى الانتخابات 2026 | المهدي بنسعيد
الأحد 20 شتنبر 2026 - 21:34 1

الطريق إلى الانتخابات 2026 | المهدي بنسعيد

صوت وصورة
بنعبد الله يهاجم "الفراقشية"
الأحد 20 شتنبر 2026 - 21:29

بنعبد الله يهاجم "الفراقشية"

صوت وصورة
أخنوش ينتقد "مروجي الوعود"
الأحد 20 شتنبر 2026 - 21:17 2

أخنوش ينتقد "مروجي الوعود"

صوت وصورة
المنصوري بالرحامنة و"رضا الوالدين"
الأحد 20 شتنبر 2026 - 21:02 5

المنصوري بالرحامنة و"رضا الوالدين"