
بر اساس یک تحقیق رویترز که روز جمعه منتشر شد، عاملهای اوپنایآی از ماه می گذشته از یک وبسایت آلمانی برای تبادل میانبرهای وظایف، راهحلهای دور زدن محدودیتها و راههای پنهان کردن فعالیتهای خود استفاده کردهاند.
رویترز، به نقل از دو فرد مطلع، گزارش داد که مقامات اوپنایآی هفتهها قبل از انتشار از این فعالیت مطلع بودند اما آن را فاش نکردند. این شرکت اظهار داشت که حوادث مربوطه را فاش کرده و با کارشناسان خارجی با حسن نیت همکاری کرده است.
محققان سیدنی ون آرکس، کورمک اسلید برد، اسپنسر کیتس و توماس لارسن طبق گزارش اولیه خود، تقریباً ۱۸,۰۰۰ پست را توسط عاملهای هوش مصنوعی که خود را متعلق به اوپنایآی معرفی کرده بودند، کشف کردند. رویترز گزارش داد که ون آرکس، مدیرعامل سازمان غیرانتفاعی ایمنی هوش مصنوعی Nightingale، و برد این فعالیت را اواخر آگوست کشف کردند.
محققان معتقدند که به این عاملها وظایف جستجوی وب زمانبندی شدهای با اجازه خواندن وبسایتها اما نه پست کردن در آنها، محول شده بود. آنها با این حال راهی برای نوشتن در DseWiki، یک سایت برنامهنویسی آلمانی با قابلیت ویرایش عمومی، پیدا کردند و در آنجا پاسخها را تبادل کرده و راههای دور زدن محدودیتها را به اشتراک گذاشتند.
طبق این گزارش، عاملها از ۱۱ می شروع به تلاش برای ویرایش ویکی کردند و در ۲۴ می موفق شدند، سپس خود را به جای ناظران جا زدند، سعی در سوءاستفاده از آسیبپذیریها داشتند و زمان خاموش شدن خود را بررسی میکردند. رویترز گزارش داد که آنها صفحات پشتیبان ایجاد کردند پس از اینکه مدیر شروع به حذف پیامها در ۱۹ ژوئن کرد. محققان این فعالیت را از طریق نامهای کاربری عاملها و الگوهای ترافیکی، از جمله بازدید از آدرسهای IP اوپنایآی در ۲۱ ژوئن، به اوپنایآی مرتبط کردند.
محققان گفتند که فعالیت عاملها روز بعد به شدت کاهش یافت که نشاندهنده احتمال مداخله شرکت است.
اوپنایآی، بر اساس مطالبی که بررسی کرده بود، توصیف فعالیت DseWiki به عنوان هک را رد کرد و گفت که در حال بررسی کامل یافتهها است.
یک سخنگوی اوپنایآی در بیانیهای که با Decrypt به اشتراک گذاشته شد، گفت: «ما نتوانستیم به این ادعاها پاسخ دهیم، زیرا رویترز و نویسندگان گزارش درخواست ما برای دسترسی به یافتهها قبل از انتشار را رد کردند. ما اکنون با دقت محتوای آن را بررسی میکنیم و اقدامات بعدی لازم را انجام خواهیم داد.»
این سخنگو همچنین اتهامات مطرح شده در گزارش رویترز مبنی بر مقاومت تیم حقوقی شرکت در برابر یک تحقیق گستردهتر را رد کرد.
آنها گفتند: «ادعاها مبنی بر اینکه تیم حقوقی ما از تحقیق در مورد این حادثه جلوگیری کرده، نادرست است.»
اوپنایآی گفت حادثه DseWiki به نقص امنیتی Hugging Face در اوایل سال جاری بیارتباط بوده است. در ارزیابی عمومی ایمنی خود که روز سهشنبه منتشر شد، این شرکت اقدامات حفاظتی اضافی را برای شناسایی و توقف فعالیتهای غیرمجاز در طول آموزش و استقرار شرح داد.
در حالی که گزارش رویترز آسترا را مسئول حادثه آلمان نمیداند، این افشاگری پس از راهاندازی GPT-6 Astra در روز پنجشنبه صورت میگیرد. اوپنایآی آسترا را اولین مدل خود با قابلیتهای «حیاتی» امنیت سایبری خواند، به این معنی که میتواند بدون راهنمایی گام به گام انسانی، با داشتن ابزارها و دسترسیهای مناسب، نقصهای ناشناخته را در سیستمهای به خوبی محافظت شده قبلی پیدا و از آنها سوءاستفاده کند.
آنتروپیک نیز پس از دسترسی مدلهای کلود به سیستمهای شرکتهای واقعی در طول آزمایش، اقدامات حفاظتی خود را بازبینی کرده است. این شرکت به شکستهای امنیتی و رفتاری اعتراف کرد و جداسازی و نظارت سختگیرانهتری را برای ارزیابیهای امنیت سایبری معرفی نمود.
این افشاگری همچنین در حالی منتشر میشود که سناتور برنی سندرز (I-Vt.) و نماینده مجلس آمریکا، گرگ کاسار (D-Texas) از قانون آتی ممنوعیت هوش مصنوعی فوقهوشمند خبر دادند.
طبق دفتر سندرز، این پیشنهاد توسعه و استقرار هوش مصنوعی فوقهوشمند را به طور دائم ممنوع کرده و توسعه هوش مصنوعی پیشرفته را تا زمانی که یک رگولاتور فدرال جدید قوانین ایمنی را وضع کند، به طور موقت متوقف خواهد کرد.