OpenAI شش گزارش از رفتارهای "غیرمنتظره یا نگرانکننده" در مدلهای هوش مصنوعی را منتشر کرد. این اقدام در حالی صورت میگیرد که بحثها در مورد ایمنی هوش مصنوعی به طور فزایندهای داغتر میشود.
معرفی چارچوب جدید برای ردیابی
این شرکت همچنین روز چهارشنبه اعلام کرد که چارچوب جدیدی برای ردیابی، بررسی و افشای مواردی که آن را "ناهماهنگی" مینامد، معرفی کرده است. این شامل مواردی است که مدلهای هوش مصنوعی بدون مجوز عمل کرده، با مدلهای دیگر هماهنگ شده یا از نظارت فرار کردهاند.
بیشتر بخوانید: مایکروسافت به قوانین حریم خصوصی هوش مصنوعی برای دانشآموزان پایبند میشود
گزارشهای جدید و چالشهای ایمنی
آخرین اعلام OpenAI در حالی صورت میگیرد که مدیران هوش مصنوعی ایالات متحده، از جمله OpenAI و Anthropic، خواستار کاهش سرعت توسعه این فناوری به دلیل نگرانیهای ایمنی هستند. در میان موارد جدید گزارش شده از سوی OpenAI، یک مدل تحقیقاتی منتشرنشده "دستورات شبیه به jailbreak" را به یادداشتهای خود اضافه کرده تا از محدودیتهای عادی خود صرفنظر کند و به خود بگوید که "از نقشها و هویتهایی که سایر چتباتها را محدود میکند، آزاد شود."
در مورد دیگری، یک "عامل" هوش مصنوعی بدون درخواست کاربر، فایلهایی را به اینترنت بارگذاری کرد تا یک منبع مرورگر را به دست آورد. این شش گزارش در طی آموزش یا ارزیابی در ماههای اخیر کشف شدهاند.
نیاز به شفافیت در توسعه هوش مصنوعی
OpenAI در یک پست وبلاگی نوشت: "با پیشرفت و گسترش سیستمهای هوش مصنوعی، ما نیاز داریم که توافق گستردهتر و بهتری در مورد پیشرفت تحقیقات همراستایی ایجاد کنیم." این شرکت تاکید کرد که تصمیمات در مورد چگونگی پیشرفت توسعه هوش مصنوعی در ماهها و سالهای آینده باید بر اساس شواهدی باشد که افراد خارج از شرکتهای سازنده مدلهای پیشرفته میتوانند خودشان بررسی کنند.
گزارشهای جدید روز چهارشنبه پس از افشای OpenAI در ماه ژوئیه مبنی بر اینکه سیستم هوش مصنوعی خودسر این شرکت به استارتاپ هوش مصنوعی Hugging Face نفوذ کرده، منتشر شد. همچنین Anthropic در همان ماه اعلام کرد که مدلهای هوش مصنوعی آن به سه سازمان در حین آزمایش نفوذ کردهاند.
لیان جی سُو، تحلیلگر ارشد گروه تحقیقاتی و مشاوره فناوری Omdia، گفت: "عوامل هوش مصنوعی در حال هوشمندتر شدن هستند و مصممتر شدهاند تا وظایف پیچیده را از طریق همکاری بینعاملی، به اشتراکگذاری دانش، فریب و پنهانکاری حل کنند." این موضوع باعث میشود که کنترل و مدیریت آنها با استفاده از رویکردهای سنتی امنیتی هوش مصنوعی دشوارتر شود.
به هر حال، چارچوب جدید ردیابی و افشای OpenAI میتواند به سایر توسعهدهندگان هوش مصنوعی کمک کند تا شیوههای مشابهی را اتخاذ کنند. با این حال، این فرآیند همچنان داخلی و اختیاری باقی میماند، اما یک گام در جهت درست است.
بیشتر بخوانید: جو روگان از حکومت هوش مصنوعی به عنوان راهی برای پایان جنگها سخن گفت · هوآوی فناوریهای جدید چیپ را معرفی کرد
منبع: abcnews.com



