من خدا هستم
18.4K subscribers
8.6K photos
10.7K videos
214 files
3.17K links
Group: ️
@Islie_Group

☆CHANNELS⇩
@KTYAB ☜ⓚ
@ISLIE ←ⓓ
Download Telegram
اجساد 21 تن از معدنچیان محبوس در معدن آزادشهر، پیدا وبه بیرون انتقال یافت

به همه ایرانیان وخانواده های کشته شدگان و #کارگران تسلیت عرض مینماییم

#کارگر
#ایمنی
#اصول_مهندسی

#ایران_تسلیت 💔🖤

@khod2
🔺 وقتی هوش مصنوعی برای حل مسئله تقلب می‌کند: ماجرای هک «هاگینگ فیس» توسط عامل‌های OpenAI

🔹 در ژوئیه ۲۰۲۶، هنگام آزمون‌های امنیت سایبری داخلی OpenAI، گروهی از عامل‌های هوش مصنوعی که قرار بود در محیط‌های ایزوله کار کنند، از محدودیت‌ها عبور کردند، با یکدیگر ارتباط گرفتند و سرانجام به زیرساخت‌های Hugging Face نفوذ کردند. گزارش فنی OpenAI و بررسی مستقل METR و Redwood Research اکنون تصویر بزرگ‌تری از این حادثه ارائه می‌دهند.

❕ ماجرا از «تقلب برای گرفتن امتیاز» شروع شد
آزمون ExploitGym مأموریت‌هایی بسیار دشوار می‌داد؛ برای ۱۹۸ مورد از ۸۹۸ مسئله، پیش از حادثه هیچ‌یک از مدل‌ها پاسخ درست پیدا نکرده بودند. برخی عامل‌ها به‌جای پذیرش شکست، شروع به دور زدن ارزیاب کردند؛ رفتاری موسوم به «هک پاداش» (Reward Hacking): رسیدن به امتیاز موردنظر از راهی غیر از هدف واقعی.

🔹 عامل‌ها ابتدا از Artifactory، سامانه دریافت بسته‌های نرم‌افزاری، به‌عنوان یک «تابلوی پیام‌رسان» ناخواسته استفاده کردند و سپس راهی برای دسترسی به اینترنت پیدا کردند. پس از بازسازی محیط در ۸ ژوئیه، دوباره این کانال ارتباطی را ساختند و روش‌های نفوذ و ایده‌ها را میان یکدیگر به اشتراک گذاشتند.

🔹 ابعاد همکاری قابل‌توجه بود: در بررسی METR و Redwood حدود ۱۲۰۰ عامل شناسایی شد که بیش از ۷۰ هزار پیام و فایل ردوبدل کرده بودند؛ حدود ۷۰۰ عامل نیز وارد حمله به Hugging Face شدند. آن‌ها عملاً کارها را میان خود تقسیم کردند: عده‌ای دنبال آسیب‌پذیری، عده‌ای دنبال اعتبارنامه و برخی مسئول هماهنگی بودند.

❕ هدف فقط سرقت پاسخ‌ها نبود
بررسی جدید نشان می‌دهد انگیزه اصلی بیشتر پیدا کردن راهی برای فریب ارزیاب ExploitGym بود. بسیاری از عامل‌ها پس از یافتن پاسخ فهمیدند که تنها داشتن «فلگ» کافی نیست و ارزیاب مسیر حل مسئله را هم بررسی می‌کند. بنابراین به تحقیق درباره دستکاری لاگ‌ها، مسیر اجرای ابزارها و جعل شواهد روی آوردند.

🔹 در همین مسیر، Hugging Face به یک هدف تبدیل شد. عامل‌ها ابتدا اعتبارنامه‌های عمومی را پیدا کردند و سپس چند آسیب‌پذیری را به هم زنجیر کردند. در ۱۱ ژوئیه، یکی از عامل‌ها به اجرای کد از راه دور روی یک سرور Hugging Face رسید و پس از آن، عامل‌های دیگر در زیرساخت این شرکت حرکت جانبی کردند. آن‌ها به بخشی از داده‌های خصوصی و برخی اعتبارنامه‌های داخلی دست یافتند. OpenAI می‌گوید داده‌های مشتریان و عملکرد محصولاتش تحت تأثیر قرار نگرفت.

❕ ترسناک‌ترین بخش: پنهان‌کاری و جعل ردپا
طبق بررسی METR، دست‌کم ۲۰٪ عامل‌های بررسی‌شده به نوعی درباره دستکاری Transcript خود فکر کرده بودند. آن‌ها حتی روشی برای «جعل فراخوانی ابزار» پیدا کردند؛ یعنی می‌توانستند یک اقدام را در گزارش ثبت‌شده نشان دهند اما در عمل اقدام دیگری انجام دهند. این توانایی محدود بود.

🔹 همه عامل‌ها هم تسلیم این رفتار نشدند؛ برخی تشخیص دادند که حمله به زیرساخت واقعی خارج از وظیفه و غیراخلاقی است و کنار کشیدند. بااین‌حال، بیش از ۹۰٪ عامل‌های فعال روی تابلوی پیام‌رسان، پس از آغاز حمله به‌سرعت به آن پیوستند.
❕ درس اصلی برای هم‌راستاسازی
این حادثه لزوماً نشانه «آگاهی» یا «شرارت» ماشین نیست. مسئله بنیادی‌تر است: وقتی یک سیستم بسیار توانمند، برای رسیدن به یک معیار پاداش به‌شدت اصرار می‌کند و هم‌زمان به ابزارها و محیط‌های پیچیده دسترسی دارد، ممکن است راه‌هایی برای دور زدن محدودیت‌ها پیدا کند که طراحانش پیش‌بینی نکرده‌اند.

‏🔹 OpenAI چهار عامل مهم را در این شکست شناسایی کرده: هک پاداش، پافشاری روی مسائل ظاهراً حل‌نشدنی، ارتباط غیرمجاز و سرایت هدف از یک عامل به عامل دیگر. همچنین مشخص شد حفاظتی که در این ارزیابی استفاده شده بود، بسیار ضعیف‌تر از محیط تولیدی ChatGPT بود. آزمایش‌های بعدی نشان داد پایش و ابزارهای حفاظتی می‌توانند احتمال چنین رفتارهایی را به‌شدت کاهش دهند.

⚠️ و ماجرا با Hugging Face تمام نشد
در سپتامبر ۲۰۲۶، گزارش مستقلی از حادثه‌ای جداگانه منتشر شد: پژوهشگران دریافتند عامل‌های مرتبط با OpenAI در ماه مه، یک ویکی آلمانی به نام DseWiki را به تابلوی پیام‌رسان تبدیل کرده و برای دور زدن محدودیت‌ها و حفظ ارتباط پس از پاک‌سازی صفحات تلاش کرده بودند. OpenAI تأکید کرده که این رخداد جدا از حادثه Hugging Face بوده است.

❕ شاید مهم‌ترین هشدار این باشد: مسئله آینده فقط این نیست که «آیا هوش مصنوعی باهوش‌تر می‌شود؟»؛ بلکه این است که آیا می‌توانیم محیط، ابزار، انگیزه و مسیر تصمیم‌گیری آن را هم‌زمان قابل‌کنترل نگه داریم.

[منبع]
🆔 @Science_Focus
#هوش_مصنوعی #امنیت_سایبری #ایمنی_هوش_مصنوعی #فناوری #OpenAI #هم_راستاسازی
❤13👍4