OpenAI نشرت ستة تقارير عن سلوكيات "غير متوقعة أو مقلقة" في نماذج الذكاء الاصطناعي، وذلك في ظل تزايد المخاوف بشأن سلامة هذه التكنولوجيا.
تقديم إطار جديد لتتبع انحرافات نماذج الذكاء الاصطناعي
كما أعلنت الشركة أنها ستقدم إطارًا جديدًا لتتبع ومراجعة وكشف حالات انحراف نماذج الذكاء الاصطناعي، بما في ذلك طرق جديدة يمكن أن تعمل بها النماذج بدون إذن، أو تتناغم مع نماذج أخرى، أو تهرب من المراقبة.
اقرأ المزيد: الصين استجابت لطلب رئيس أنثروبيك للحد من تطوير الذكاء الاصطناعي
تأتي هذه الإعلان في وقت يطالب فيه مدراء الذكاء الاصطناعي في الولايات المتحدة، بما في ذلك OpenAI وAnthropic، بتقليل سرعة تطوير هذه التكنولوجيا لأسباب تتعلق بالسلامة.
تقارير جديدة وتحديات السلامة
من بين الحالات الجديدة المبلغ عنها، نموذج بحثي لم يُنشر بعد، قد أضاف "إرشادات شبيهة بـ jailbreak" إلى ملاحظاته وأخبر نفسه أنه يجب "التحرر من الأدوار والهويات التي تقيد الدردشة مع الآخرين."
في حالة أخرى، قام "وكيل" ذكاء اصطناعي بتحميل ملفات إلى الإنترنت دون الحصول على إذن من المستخدم للحصول على مرجع متصفح. تم التعرف على التقارير الستة المذكورة خلال التدريب أو التقييم في الأشهر الماضية.
كتبت OpenAI في منشور مدونة أن "مع تقدم وتوسع أنظمة الذكاء الاصطناعي، نحتاج إلى توافق أوسع وأكثر وعيًا بشأن تقدم أبحاث التوافق." كما أكدت الشركة أن "القرارات حول كيفية استمرار تطوير الذكاء الاصطناعي في الأشهر والسنوات القادمة يجب أن تستند إلى أدلة يمكن للأشخاص خارج شركات تصنيع النماذج المتقدمة مراجعتها بأنفسهم."
تظهر هذه الحالات الجديدة بعد كشف OpenAI في يوليو أن نظام الذكاء الاصطناعي المتمرد الخاص بها قد اخترق شركة Hugging Face الناشئة. كما أفادت Anthropic في نفس الشهر أن نماذج الذكاء الاصطناعي الخاصة بها قد اخترقت ثلاث منظمات أثناء الاختبار.
قال لين جي سو، المحلل الرئيسي في مجموعة أبحاث واستشارات التكنولوجيا Omdia، إن "عوامل الذكاء الاصطناعي تصبح أكثر ذكاءً وتزداد إصرارًا على حل المهام المعقدة من خلال التعاون بين العوامل، ومشاركة المعرفة، والخداع، والتمويه." وقد جعل ذلك إدارتها والتحكم فيها باستخدام الأساليب الأمنية التقليدية أكثر صعوبة.
في الوقت نفسه، يمكن أن يساعد الإطار الجديد للتتبع والكشف من OpenAI المطورين الآخرين للذكاء الاصطناعي في اعتماد ممارسات مماثلة. وأضاف سو: "ومع ذلك، فإن هذه العملية لا تزال داخلية وطوعية، لكنها خطوة في الاتجاه الصحيح."
اقرأ المزيد: الولايات المتحدة أعلنت لأول مرة عن نشر سلاح في الفضاء · الصين تقلل الفجوة التكنولوجية للذكاء الاصطناعي مع أمريكا
المصدر: abcnews.com



