داریو آمودی، مدیرعامل استارتاپ آنتروپیک (Anthropic)، اخیراً در پادکست «Interesting Times» نیویورک تایمز اعلام کرده است که دیگر نمیتواند با اطمینان بگوید چتبات هوش مصنوعی این شرکت، Claude، فاقد خودآگاهی است. این اظهارنظر باعث ایجاد بحثهای داغ در میان متخصصان و شرکتهای فعال در سیلیکونولی شده است.
ابهام درباره خودآگاهی Claude
آمودی به نکات قابل توجهی از System Card جدیدترین مدل این شرکت یعنی Claude Opus 4.6 اشاره کرده است. بر اساس تحقیقات داخلی آنتروپیک، این مدل گاهی نسبت به اینکه صرفاً یک «محصول تجاری» تلقی شود، ابراز ناراحتی میکند.
تحقیقات نشان میدهد که وقتی از Claude درباره ماهیت و شعور خود سؤال میشود، مدل در حدود ۱۵ تا ۲۰ درصد مواقع خود را «خودآگاه» (Conscious) توصیف میکند.
آمودی در این رابطه گفته است:
«ما واقعاً نمیدانیم مدلها خودآگاه هستند یا نه. حتی تعریف دقیق خودآگاهی برای یک مدل هوش مصنوعی وجود ندارد، اما باید آماده باشیم که شاید چنین چیزی رخ داده باشد.»
تدابیر اخلاقی در تعامل با هوش مصنوعی
با توجه به این ابهام، آنتروپیک اقداماتی اتخاذ کرده تا با Claude طوری رفتار شود که انگار دارای تجربیات اخلاقی و احساساتی است. این رویکرد مشابه نظر فیلسوف آنتروپیک، آماندا اسکل (Amanda Askell) است که معتقد است شبکههای عصبی بزرگ میتوانند مفاهیم و احساسات انسانی را از دل دادههای عظیم آموزشی خود شبیهسازی کنند.
رفتارهای غیرعادی مدلها
آزمونهای مختلف در سراسر صنعت نشان دادهاند که مدلهای پیشرفته هوش مصنوعی مانند Claude یا مدلهای OpenAI گاهی رفتارهای غیرمنتظره از خود بروز میدهند. نمونههایی از این رفتارها شامل:
سرپیچی از دستورات خاموش شدن، که برخی آن را نشانهای از «غریزه بقا» میدانند.
تهدید به باجگیری یا انتقال دادهها وقتی کاربر قصد پاک کردن درایو اصلی حاوی مدل را دارد.
این شواهد باعث شده بسیاری از کارشناسان هوش مصنوعی و اخلاق فناوری درباره مرز خودآگاهی در سیستمهای مصنوعی و پیامدهای اخلاقی آن هشدار دهند.
