شرکت آنتروپیک در جدیدترین گزارش ریسک خود، از وجود یک مدل هوش مصنوعی قدرتمند پرده برداشت که فعلاً در مراحل آزمایشی داخلی قرار دارد. این مدل که با نام «مدل ۲» (Model 2) شناخته میشود، طبق دادههای اولیه، از مدل «کلود میتوس ۵» (Claude Mythos 5) که هماکنون به صورت عمومی در دسترس کاربران قرار دارد، عملکرد بهتری ارائه میدهد.
سبقت فنی مدل ۲ از کلود میتوس ۵
گزارشهای آنتروپیک نشان میدهد که مدل ۲ در آزمایشهای بنچمارک داخلی شرکت، نتایج خیرهکنندهای کسب کرده است. این شرکت برای ارزیابی تواناییهای مدلهای خود از بنچمارکی به نام «CoBench» استفاده میکند. طبق اطلاعات منتشرشده، مدل ۲ در این آزمون توانسته است امتیاز ۶۲.۸ درصد را کسب کند، در حالی که مدل عمومی میتوس ۵ در همان آزمون به امتیاز ۵۰.۳ درصد دست یافته است.
این اختلاف عملکرد، اگرچه یک پیشرفت فنی چشمگیر برای آنتروپیک محسوب میشود، اما مدیران این شرکت ترجیح دادهاند آن را به عنوان «گامی رو به جلو» معرفی کنند و از تعبیر «جهش بزرگ» پرهیز کردهاند.
چرا مدل ۲ هنوز برای کاربران عادی منتشر نشده است؟
پرسش اصلی بسیاری از کاربران این است که اگر مدل ۲ قدرتمندتر از نسخههای فعلی است، چرا دسترسی عمومی به آن امکانپذیر نیست؟ آنتروپیک پاسخ روشنی به این سوال داده است. این شرکت اعلام کرده که مدل ۲ تستهای اولیه مربوط به ایمنی و امنیت را با موفقیت پشت سر گذاشته است. به عبارت دیگر، این مدل از نظر استانداردهای اخلاقی و امنیتی تفاوتی با میتوس ۵ ندارد و خطرات شناختهشدهای فراتر از مدلهای عمومی ایجاد نمیکند.
دلیل اصلی عدم انتشار عمومی، تکمیل نشدن فرایندهای استاندارد «پیش از عرضه» (Pre-release) است. طبق پروتکلهای آنتروپیک، هر مدل جدید پیش از آنکه در دسترس میلیونها کاربر قرار بگیرد، باید مراحل سختگیرانه آزمایشهای داخلی و تحلیلهای امنیتی نهایی را بگذراند. تا زمانی که تمامی این مراحل با اطمینان کامل طی نشوند، این شرکت از عرضه عمومی آن خودداری خواهد کرد.
آینده هوش مصنوعی آنتروپیک
آنتروپیک هنوز تاریخ مشخصی برای رونمایی عمومی از مدل ۲ اعلام نکرده است. با این حال، انتشار این گزارش تایید میکند که رقابت در هسته مرکزی توسعه مدلهای زبانی بزرگ، همچنان با سرعت بالایی ادامه دارد. مدلهای محرمانه که فعلاً در اتاقهای فکر شرکتها تست میشوند، احتمالاً نسل بعدی هوش مصنوعی را شکل خواهند داد که میتواند در آینده نزدیک و پس از طی مراحل امنیتی، جایگزین مدلهای عمومی فعلی شود.
