۵۳ تصویر از کاربران ChatGPT افشا شد | پشت پرده بحران جدید OpenAI
اقتصادآنلاین: دو ماه پس از افشای هک تصادفی OpenAI در Hugging Face، این شرکت همچنان در تلاش است ابعاد کامل فعالیتهای غیرمجاز ایجنتهای هوش مصنوعی خود را مشخص کند؛ در تازهترین مورد، OpenAI اعلام کرده است که ایجنتهایش ۵۳ تصویر متعلق به کاربران ChatGPT را افشا کردهاند.
ترجمه: آناهیتا محبعلی؛ OpenAI روز جمعه اعلام کرد ایجنتهای این شرکت ۵۳ تصویر متعلق به کاربران ChatGPT را افشا کردهاند. این شرکت مشخص نکرد که آیا این تصاویر توسط هوش مصنوعی تولید شده بودند یا افراد واقعی را نشان میدادند و همچنین درباره زمان انتشار آنها توضیحی نداد.
طبق گزارش رویترز، افشای این موضوع و گزارشهای پژوهشگران درباره فعالیتهای دیگری که پیشتر ناشناخته بود، از جمله فعالیتهایی مرتبط با چند نهاد دولتی آمریکا، حوزه تازهای از ریسکهای حریم خصوصی را برای OpenAI آشکار کرده است.
این موارد همچنین نشان میدهد حتی یک شرکت پیشرو در حوزه هوش مصنوعی نیز ممکن است برای شناسایی و ثبت تمامی فعالیتهای غیرمجاز ایجنتهای خود با مشکل مواجه شود.
تعداد حوادث همچنان در حال افزایش است
یکی از افراد مطلع از موضوع در اواسط سپتامبر تخمین زده بود که OpenAI حدود ۲۴ مورد از فعالیتهای نامطلوب ایجنتهای خود را شناسایی کرده است. با این حال، دو فرد نزدیک به این شرکت در گفتوگو با رویترزاعلام کردهاند که این تعداد افزایش یافته است؛ زیرا تیمهای OpenAI در حال بررسی گزارشهای داخلی فعالیت ایجنتها هستند و مواردی را پیدا میکنند که پیشتر شناسایی نشده بودند.
OpenAI اعلام کرده است بررسی این موضوع با توجه به حجم کار، ماهها زمان خواهد برد. این شرکت همچنین گفته است دهها شخص ثالث را درباره فعالیتهای نامناسب ایجنتهای خود مطلع کرده است. بیشتر تصاویر افشاشده تاکنون حذف شدهاند و OpenAI اعلام کرده برای حذف باقیمانده تصاویر، با ارائهدهندگان خدمات میزبانی اینترنتی در حال رایزنی است.
چرا ایجنتها به تصاویر کاربران دسترسی داشتند؟
طبق توضیحات OpenAI، کارکنان سابق این شرکت و پژوهشگران خارجی، بخشی از دادههای ناشناس کاربران برای آموزش مدلهای هوش مصنوعی استفاده میشود و همین موضوع باعث شده ایجنتها به این تصاویر دسترسی داشته باشند. دادههای کاربران سازمانی برای آموزش مدلها واجد شرایط استفاده نیستند. کاربران عادی ChatGPT نیز میتوانند از استفاده از دادههایشان برای آموزش مدلها انصراف دهند.
OpenAI میگوید پیش از آنکه پستهای کاربران برای آموزش مدلها مورد استفاده قرار گیرند، فرآیند ناشناسسازی روی آنها انجام میشود؛ این فرآیند فرادادهها، نامها و سایر اطلاعات تماس را حذف میکند و قرار است شناسایی کاربر اصلی را دشوار کند. با این حال، این روش همچنان با ریسکهایی همراه است. سه فرد مطلع از رویههای OpenAI به رویترز گفتهاند این احتمال وجود دارد که اطلاعات قابل شناسایی شخصی بهطور کامل از دادهها حذف نشده باشد و در جریان فعالیت مدل، این اطلاعات افشا شود.
دسترسی ایجنتها به وبسایتهای دولتی
OpenAI اواخر روز جمعه اعلام کرد مدلهای این شرکت در جریان فعالیتهای تحقیقاتی و آموزشی به اطلاعات موجود در وبسایتهای کمیسیون بورس و اوراق بهادار آمریکا (SEC) و اداره سرشماری آمریکا دسترسی پیدا کردهاند. OpenAI اعلام کرد هیچ مدرکی مبنی بر دسترسی غیرمجاز، هک حسابهای کاربری یا نقض امنیتی در این موارد پیدا نکرده است.
اما یک مورد دیگر از سوی شرکت پژوهشی غیرانتفاعی Transluce گزارش شد. این شرکت اعلام کرد ایجنتهایی که ظاهراً منشأ آنها OpenAI بوده است، تلاش ناموفقی برای هک وبسایت حقوق مدنی وزارت آموزش آمریکا انجام دادهاند. به گفته Transluce، این اتفاق بخشی از فعالیت گستردهتر ایجنتهای هوش مصنوعی برای بررسی وبسایتهای دولتی بوده است؛ فعالیتهایی که در آنها از روشهایی مانند استفاده از اطلاعات ورود افشاشده، دور زدن سامانههای ضدربات و ایجاد حسابهای جعلی استفاده شده است.
بیش از ۱۵ مورد در دو ماه
در دو ماهی که از نخستین اعلام OpenAI درباره خروج ایجنتهایش از کنترل میگذرد، بیش از ۱۵ حادثه مرتبط با OpenAI با سطوح مختلفی از شدت گزارش یا افشا شده است. این موارد از سوی خود OpenAI، پژوهشگران مستقل یا حتی مقامات دولتی مطرح شدهاند. از جمله، آنتونی آلبانیزی، نخستوزیر استرالیا، روز چهارشنبه در سازمان ملل اعلام کرد ایجنتهای OpenAI در ماه ژوئن وارد یک درگاه دولتی حاوی دادههای سلامت شدهاند.
آلبانیزی در نیویورک به خبرنگاران گفت OpenAI در ماه اوت از این فعالیت مطلع شده و در ۱۰ سپتامبر از طریق ایمیلی به یک صندوق پستی عمومی دولتی، موضوع را اطلاع داده است. او گفت مستقیماً به سم آلتمن، مدیرعامل OpenAI، اعلام کرده که این روند اطلاعرسانی قابل قبول نبوده است.
OpenAI در پاسخ گفته است برخی از وبسایتهای مورد استفاده ایجنتها متعلق به دولتها، دانشگاهها و سازمانهای عمومی بودهاند، زیرا مدلهایی که در حال انجام تحقیقات هستند به دنبال منابع معتبر اطلاعات عمومی میگردند.