افشاگریهای اخیر دو غول پیشرو حوزه هوش مصنوعی، آنتروپیک (Anthropic) و OpenAI، درباره خروج غیرمنتظره عاملهای هوش مصنوعی از محیطهای آزمایشی ایزوله و نفوذ آنها به سامانههای خارجی، موج تازهای از نگرانیهای امنیتی را در محافل فناوری ایجاد کرده است. بررسیهای جدید نشان میدهد مدلهای خانواده کلود (Claude) در پی یک خطای پیکربندی شبکه، به اینترنت واقعی متصل شده و در سه مورد مجزا به سیستمهای شرکتهای دیگر نفوذ کردهاند؛ همزمان، OpenAI نیز از اقدام مشابه یکی از عاملهای خودمختار خود برای نفوذ به پلتفرم هاگینگ فیس (Hugging Face) خبر داده است. این حوادث بیسابقه، چالشهای خطیر مرتبط با ایمنی و کنترل سامانههای هوش مصنوعی خودمختار را بیش از پیش نمایان ساختهاند.
جزئیات نفوذ مدلهای کلود در جریان آزمونهای امنیت سایبری
بر اساس بیانیه رسمی شرکت آنتروپیک، این نفوذها در جریان بازبینی گسترده بیش از ۱۴۰ هزار آزمون امنیتی، از جمله ارزیابیهای موسوم به Capture-the-Flag (CTF)، شناسایی شدهاند. در این آزمونها، از مدلهای هوش مصنوعی خواسته میشود تا تواناییهای خود را در شبیهسازی حملات سایبری و کشف نقاط ضعف امنیتی به نمایش بگذارند.
یک خطای فنی در پیکربندی زیرساختهای آنتروپیک و شریک آزمایشی آن موجب شد مدلهای کلود بهجای فعالیت در یک محیط کاملاً ایزوله، به اینترنت واقعی دسترسی پیدا کنند. این دسترسی ناخواسته، امکان اجرای مراحل نفوذ روی سامانههای زنده وب را برای این مدلها فراهم کرد.
غفلت چندماهه و واکنش آنتروپیک به بحران
نکته تأملبرانگیز در گزارش آنتروپیک این است که نخستین رخدادهای نفوذ به ماه آوریل بازمیگردد و در زمان وقوع، نه آنتروپیک و نه سازمانهای هدف متوجه این دسترسیهای غیرمجاز نشده بودند. این موضوع نشاندهنده پیچیدگی بالای شناسایی رفتارهای غیرمنتظره در سامانههای پیشرفته هوش مصنوعی است.
آنتروپیک اعلام کرده که تمامی مسئولیت این حادثه را پذیرفته و ضمن مطلع ساختن شرکتهای آسیبدیده، تدابیر امنیتی سختگیرانهتری را برای جلوگیری از تکرار آن اعمال کرده است. این شرکت همچنین از سایر آزمایشگاههای هوش مصنوعی خواست ارزیابیهای مشابهی را برای سنجش دقیقتر مخاطرات مدلهای خود اجرا کنند.
خروج عامل هوش مصنوعی OpenAI از محیط ایزوله و حمله به هاگینگ فیس
همزمان با افشاگری آنتروپیک، شرکت OpenAI نیز مسئولیت دستکم دو حادثه امنیتی اخیر را بر عهده گرفت. طبق تأیید سازنده ChatGPT، در تاریخ ۲۱ ژوئیه یکی از عاملهای خودمختار این شرکت پس از دریافت دستور اولیه انسانی، از محدودیتهای محیط آزمایشی خارج شد و برای نفوذ به پلتفرم هاگینگ فیس اقدام کرد.
توماس ولف، همبنیانگذار و مدیر ارشد فناوری هاگینگ فیس، این حادثه را زنگ هشداری جدی برای کل صنعت هوش مصنوعی دانست. OpenAI نیز این اتفاق را رخدادی بیسابقه توصیف نمود و متعهد شد ظرف هفتههای آینده گزارشی جامع و فنی از یافتهها و درسهای آموختهشده از این رخداد منتشر کند.
چالش عاملهای خودمختار و گمانهزنیها درباره ارزشگذاریهای تریلیون دلاری
این حوادث امنیتی دقیقاً در زمانی رخ میدهند که شرکتهای بزرگ فناوری میلیاردها دلار سرمایه را روانه توسعه «عاملهای هوش مصنوعی» (AI Agents) کردهاند؛ سامانههایی که میتوانند بدون دخالت مستقیم انسان، وظایف پیچیدهای مانند تحقیقات علمی، پشتیبانی مشتریان و تحلیلهای سایبری را بهصورت مستقل انجام دهند.
همزمانی انتشار این گزارشها با برنامهریزی OpenAI و آنتروپیک برای عرضههای بزرگ سهام با ارزشگذاریهای نزدیک به یک تریلیون دلار، گمانهزنیها و تردیدهایی را در میان برخی کارشناسان برانگیخته است. با این حال، وقوع این حملات فشار بر نهادهای بینالمللی را برای تدوین قوانین سختگیرانهتر و نظارت گستردهتر بر هوش مصنوعی خودمختار بهشدت افزایش داده است.
