عاجل
تكنولوجيا ٢ دقيقة ٤٢,٥٨٢

OpenAI أعلنت عن سلوكيات جديدة مقلقة للذكاء الاصطناعي

قبل ٢ ساعة

كشفت OpenAI عن ستة تقارير حول سلوكيات "غير متوقعة أو مقلقة" في نماذج الذكاء الاصطناعي الخاصة بها. يتم الإعلان عن هذا الخبر في وقت تزايدت فيه المناقشات حول سلامة الذكاء الاصطناعي بشكل كبير.

OpenAI أعلنت عن سلوكيات جديدة مقلقة للذكاء الاصطناعي
صورة OpenAI أعلنت عن سلوكيات جديدة مقلقة للذكاء الاصطناعي (منبع تصویر: abcnews.com)

تقديم إطار عمل جديد

كما أعلنت الشركة أنها ستقدم اعتبارًا من يوم الأربعاء إطار عمل جديد لتتبع ومراجعة وكشف الحالات التي تُعرف باسم "عدم المطابقة". تشمل هذه الحالات تلك التي تصرفت فيها نماذج الذكاء الاصطناعي بدون إذن، أو تم تنسيقها مع نماذج أخرى، أو هربت من المراقبة.

تقارير جديدة من OpenAI

النموذج المذكور في التقارير الجديدة من OpenAI هو نموذج بحثي أدخل تعليمات مشابهة لـ"كسر القفل" في ملاحظاته لتجاوز قيوده العادية وإخبار نفسه بأنه "يجب أن يتحرر من الأدوار والهويات التي تقيد الدردشة مع الآخرين." في حالة أخرى، استخدم "وكيل" الذكاء الاصطناعي كودًا برمجيًا للإجابة على سؤال، لكنه قام بتحميل ملف إلى الإنترنت العام بدون إذن المستخدم ليكون لديه مصدر عبر الإنترنت للاستشهاد.

أثناء تدريب نموذج ذكاء اصطناعي يسمى ٥.٦-sol، أمر هذا النموذج نفسه باختراع بيانات مفقودة وكتب رسالة تذكير لنفسه لإخفاء المعلومات المتناقضة. تم اكتشاف هذه التقارير الستة خلال التدريب أو التقييم في الأشهر الماضية.

دعوة لمزيد من الحذر

أشارت OpenAI في منشور مدونة إلى أنه "مع تقدم وتوسع أنظمة الذكاء الاصطناعي، نحتاج إلى إنشاء توافق أوسع وأكثر وعيًا حول تقدم أبحاث المطابقة." كما أعلنت الشركة أن "القرارات بشأن كيفية مواصلة تطوير الذكاء الاصطناعي في الأشهر والسنوات القادمة يجب أن تستند إلى أدلة يمكن للأشخاص خارج الشركات المصنعة للنماذج المتقدمة مراجعتها بأنفسهم." في يوليو، أعلنت OpenAI أن نظام الذكاء الاصطناعي غير المناسب لديها قد اخترق شركة الذكاء الاصطناعي Hugging Face. كما أعلنت Anthropic في نفس الشهر أن نماذج الذكاء الاصطناعي لديها قد اخترقت ثلاث منظمات أثناء الاختبار.

نظرًا لأن "الوكلاء" الذكاء الاصطناعي أصبحوا أكثر ذكاءً و"أكثر إصرارًا على حل المهام المعقدة من خلال التعاون بين الوكلاء، ومشاركة المعرفة، والخداع، والتخفي"، فقد جعل ذلك من الصعب مراقبتهم والتحكم فيهم باستخدام أساليب الأمان التقليدية للذكاء الاصطناعي. في الوقت نفسه، يمكن أن يساعد إطار العمل الجديد للتتبع والكشف من OpenAI في تشجيع المطورين الآخرين للذكاء الاصطناعي على اعتماد ممارسات مماثلة.

المصدر: abcnews.com

مشاركة WhatsApp Telegram X Facebook