شرکت OpenAI در تاریخ ۱۴ مهر ۱۴۰۵ با هدف ارتقای سطح شفافیت در دنیای هوش مصنوعی، از فناوری جدیدی به نام «TextGrain» رونمایی کرد. این فناوری در واقع یک واترمارک نامرئی است که در خروجیهای متنی مدلهای ChatGPT و Codex قرار میگیرد تا امکان تشخیص ماشینیِ محتوای تولیدشده توسط هوش مصنوعی را فراهم کند. این قابلیت در هفتههای پیشرو ابتدا برای کاربران واجد شرایط در اتحادیه اروپا فعال خواهد شد.
جایگاه TextGrain در میان رقبا
اوپنایآی عملکرد TextGrain را در سطحی برابر یا حتی بهتر از فناوریهای مشابه ارزیابی میکند. این واترمارک که برای چشم انسان کاملاً غیرقابلتشخیص است، شباهتهای عملکردی با فناوری SynthID گوگل دیپمایند دارد. لازم به ذکر است که همان فناوریِ پایه SynthID، پیشتر توسط آنتروپیک نیز برای واترمارکگذاری متنی استفاده شده بود.
رویکرد مرحلهبندی شده برای عرضه
برخلاف بسیاری از قابلیتهای جهانی، اوپنایآی تصمیم گرفته است عرضه این فناوری را با رویکردی منطقهای آغاز کند. در حال حاضر، این قابلیت برای کاربران ChatGPT و Codex در اتحادیه اروپا فعال میشود تا شرکت بتواند در محیطی واقعی و محدود، بازخوردها را دریافت و عملکرد سیستم را بهینهسازی کند. با این حال، برای کاربران API در سراسر جهان، امکان فعالسازی اختیاری این واترمارک از امروز فراهم شده است؛ تصمیمی که به مشتریان اجازه میدهد بسته به نیازهای خود برای شفافیت و تجربه کاربری، از این قابلیت استفاده کنند. همچنین، همکاری با شرکای ابری برای در دسترس قرار دادن واترمارکگذاری روی مدلهای میزبانیشده در فضای ابری، در دستور کار هفتههای آینده قرار دارد.
محدودیتهای مهم در تشخیص محتوا
اوپنایآی با شفافیت کامل تأکید کرده است که TextGrain نباید بهعنوان ابزاری قطعی برای تشخیص محتوا تلقی شود. این شرکت صراحتاً اعلام کرده که واترمارک متنی جدید نمیتواند صحت محتوا را تضمین کند، مالک اصلی متن را مشخص نماید یا میزان مداخله انسان در تولید محتوا را به دقت اندازهگیری کند. بنابراین، این ابزار صرفاً یک لایه نشانهگذاری برای شناسایی منشأ متن است و نه ابزاری برای اثبات هویت یا اعتبار نوشته.
دسترسی به ابزار تشخیص برای پژوهشگران
در کنار عرضه این فناوری، اوپنایآی فرایند درخواست دسترسی به ابزار تشخیص واترمارک را برای پژوهشگران تأییدشده و سازمانهای تخصصی باز کرده است. این ابزار صرفاً اعلام میکند که آیا در متنِ ارائهشده، واترمارکِ اوپنایآی شناسایی شده است یا خیر. نکته حائز اهمیت این است که این ابزار هیچگونه دسترسی به پرامپتها، مکالمات کاربران یا اطلاعات هویتی آنها ندارد و صرفاً بر تحلیل فنی متن تمرکز دارد.
به نظر شما آیا این واترمارکهای نامرئی میتوانند در بلندمدت اعتماد کاربران را به محتوای دیجیتال بازگردانند یا ممکن است راه را برای کپیرایتهای پیچیدهتر باز کنند؟ همچنین کنجکاوم بدانم به نظر شما این فناوری تا چه حد در برابر روشهای «پاکسازی واترمارک» توسط کاربران، مقاوم باقی خواهد ماند؟
