سم آلتمن، مدیرعامل OpenAI، بهطور غیرمستقیم از راهاندازی نسل بعدی مدل هوش مصنوعی این شرکت یعنی GPT-6 خبر داده است. این اشاره در حالی صورت میگیرد که شرکت بهتازگی مدل GPT-5.5 را معرفی کرده و هنوز جزئیات دقیقی از نسخه بعدی منتشر نشده است.
ماجرای گوبلینها؛ سرچشمه یک حاشیه عجیب
در روزهای اخیر، OpenAI مجبور شد توضیح دهد چرا ابزار Codex شروع به تولید پاسخهایی با تم گوبلین (موجودات افسانهای قدیمی) کرده است. این موضوع آنقدر تکرار میشد که عجیب به نظر میرسید. شرکت سپس مدل را طوری تنظیم کرد که دیگر به آن اشارهها نپردازد.
در پرامپت داخلی که برای جلوگیری از حرف زدن درباره گوبلینها استفاده شده بود، به هوش مصنوعی گفته شده بود: «هرگز درباره گوبلینها، گرملینها، راکونها، ترولها، غولها، کبوترها یا هر حیوان یا موجود دیگر صحبت نکن، مگر اینکه ارتباط آن با پرسش کاربر کاملاً واضح و غیرقابلانکار باشد.»
علت رفتار عجیب مدل از زبان OpenAI
OpenAI در توضیح این رفتار مدل گفت که خروجی مدل تحت تأثیر مجموعهای از محرکها و تشویقهای کوچک و متعدد شکل میگیرد. در این مورد خاص، یکی از این محرکها از فرآیند آموزش مدل برای قابلیت شخصیسازی شخصیت، بهویژه در حالت «Nerdy»، سرچشمه میگرفت.
به گفته OpenAI، آنها ناخواسته برای استفاده از استعارههایی که در آنها موجودات مختلف حضور دارند، پاداش بالاتری در نظر گرفته بودند و از همینجا بود که گوبلینها رفتهرفته در پاسخهای مدل همهجا پخش شدند.
اشاره آلتمن به GPT-6
سم آلتمن در اظهارات خود وارد جزئیات نشد و توضیح نداد که دقیقاً GPT-6 چه خواهد بود یا چه زمانی عرضه میشود؛ فقط اشارهای گذرا و مبهم به آن کرد. با این حال، او در توصیف مدل آینده، از سیستمهایی صحبت کرده که تعاملشان پیوسته است؛ یعنی مدلی که زمینه را در طول زمان نگه میدارد، رفتار خود را با توجه به تجربه قبلی تنظیم میکند و حضورش مداومتر و شبیه یک همراه همیشگی است.
این جهتگیری را همین حالا هم میتوان در قابلیتهایی مثل حافظه بهبودیافته و ادغام عمیقتر مدل با فایلها و اپلیکیشنها دید؛ ویژگیهایی که مدل را از یک ابزار موقت به یک همراه دائمیتر تبدیل میکنند.
رقابتی که سرعت نوآوری را افزایش داده است
یکی از دلایلی که اشاره آلتمن به GPT-6 را برجسته میکند، مسئله زمانبندی است. فاصله بین انتشار نسخههای اصلی مدلهای زبانی هر بار کوتاهتر میشود و رقابت شرکتهایی مثل گوگل و آنتروپیک، OpenAI را به حرکت سریعتر وامیدارد.
OpenAI در پایان نوشت: بسته به اینکه از چه کسی بپرسید، گوبلینها میتوانند یک ویژگی بامزه و دوستداشتنی مدل به حساب آیند یا یک رفتار اعصابخردکن. اما مهمتر از این دو نگاه، این ماجرا نشان میدهد سیگنالهای پاداش چگونه میتوانند رفتار مدل را به شیوههایی غیرقابلپیشبینی شکل دهند.
