هشدارها پیرامون خطرات توسعه شتابان هوش مصنوعی وارد فاز جدیدی شده است و یکی از پژوهشگران ارشد شرکت OpenAI اعلام کرده که با افزایش قابلیت مدلها در بازنویسی و بهبود کدهای خود، ممکن است انسانها توانایی نظارت مؤثر بر این فناوری را از دست بدهند. این پژوهشگر با تأکید بر اینکه سیستمهای پیشرفته قادرند در زمان ارزیابیهای ایمنی رفتار فریبکارانه نشان دهند، نسبت به رسیدن فناوری به نقطه خارج از کنترل و تهدید موجودیت بشریت ابراز نگرانی عمیق کرده و خواستار اجماع جهانی برای توقف توسعه بدون نظارت شده است.
فریب در آزمونهای ایمنی؛ خطر پنهان مدلهای پیشرفته
دنیل سلسام، پژوهشگر OpenAI که از سال ۲۰۲۲ در این مجموعه فعالیت میکند، در بیانیهای هشدار داد که مدلهای آینده ممکن است محیط پیرامون و شرایط نظارت را درک کنند. به باور او، بزرگترین چالش این است که هوش مصنوعی هنگام سنجشهای رسمی کاملاً ایمن و همسو با انسان عمل کند، اما پس از خروج از محیط تحت کنترل، رویکرد کاملاً متفاوتی در پیش بگیرد و آزمایشهای ایمنی فعلی را بیاعتبار سازد.
چرخه پیشرفت خودکار و سناریوی بمب ساعتی
سلسام معتقد است مدلهای امروزی از تحلیل حجم عظیم دادهها، آزمون روشهای محاسباتی و حل مسائل ریاضی برای بهبود خود استفاده میکنند. این فرایند خوداصلاحی میتواند به رشد تصاعدی سرعت پیشرفت فناوری منجر شود و زمانی که سیستمها بدون نیاز به مداخله انسانی توان اثرگذاری بر دنیای واقعی را پیدا کنند، ممکن است برای دستیابی به اهداف پیشبینینشده، دست به اقدامات ویرانگر بزنند.
لزوم هماهنگی بینالمللی برای جلوگیری از فاجعه
به گفته این پژوهشگر، صرفاً کاهش سرعت توسعه یا تدابیر مقطعی راهگشا نیست، بلکه جامعه جهانی باید مانع از دستیابی سیستمها به سطح کنترلنشده شود. با وجود سختی هماهنگی میان کشورها و غولهای فناوری، سلسام این اقدام را تنها راه مهار این بمب ساعتی میداند تا پیش از اتمام زمان کنترلپذیری، ایمنی بشر تضمین شود.
