گوگل «Gemini 3.5 Live Translate» را معرفی کرد؛ ترجمه زنده مکالمات با ۷۰ زبان

تیم پلازا - انتشار: 20 خرداد 1405 17:44
ز.م مطالعه: 2 دقیقه
-

گوگل از مدل جدید خود با نام Gemini 3.5 Live Translate پرده برداشت؛ سیستمی پیشرفته برای ترجمه زنده صوتی از گفتار به گفتار که قرار است تجربه ارتباط میان افراد با زبان‌های مختلف را متحول کند.

این فناوری جدید قادر است مکالمات را به‌صورت هم‌زمان و پیوسته ترجمه کند و به‌جای توقف برای پایان صحبت گوینده، ترجمه را در حین گفتار ارائه دهد؛ قابلیتی که آن را از بسیاری از سیستم‌های ترجمه سنتی متمایز می‌کند.

ترجمه طبیعی با حفظ لحن و سرعت گفتار

به گفته گوگل، Gemini 3.5 Live Translate می‌تواند بیش از ۷۰ زبان مختلف را به‌طور خودکار تشخیص دهد. علاوه بر این، ترجمه‌های صوتی تولیدشده تلاش می‌کنند ویژگی‌های صدای گوینده از جمله لحن، سرعت بیان و زیر و بمی صدا را حفظ کنند تا مکالمه طبیعی‌تر به نظر برسد.

ورود به Google Meet با بیش از ۲۰۰۰ ترکیب زبانی

این فناوری قرار است به‌تدریج در سرویس Google Meet عرضه شود. با اضافه شدن آن، کاربران می‌توانند در جلسات آنلاین از بیش از ۲۰۰۰ ترکیب زبانی مختلف استفاده کنند؛ پیشرفتی قابل‌توجه نسبت به قابلیت فعلی که تنها ترجمه به زبان انگلیسی و از انگلیسی را پشتیبانی می‌کرد.

همچنین گوگل اعلام کرده رابط کاربری Google Meet به‌روزرسانی خواهد شد تا دسترسی به ابزار ترجمه گفتار سریع‌تر و ساده‌تر انجام شود.

عرضه اولیه برای کاربران سازمانی

نسخه جدید ترجمه گفتار ابتدا به‌صورت پیش‌نمایش خصوصی برای برخی مشتریان تجاری Google Workspace در دسترس قرار می‌گیرد. این مرحله آزمایشی قرار است در اواخر همین ماه آغاز شود و سپس در ادامه سال برای کاربران بیشتری منتشر خواهد شد.

حضور در اپلیکیشن Google Translate

Gemini 3.5 Live Translate علاوه بر Google Meet، به‌صورت جهانی در اپلیکیشن Google Translate برای اندروید و iOS نیز عرضه می‌شود. هم‌زمان با این انتشار، گوگل قابلیت جدیدی به نام Listening Mode را در نسخه اندروید معرفی می‌کند که امکان شنیدن ترجمه زنده را از طریق هدفون یا بلندگوی گوشی فراهم می‌کند.

استفاده از واترمارک برای جلوگیری از سوءاستفاده

گوگل اعلام کرده خروجی صوتی تولیدشده توسط این مدل با واترمارک نامرئی SynthID علامت‌گذاری می‌شود. این فناوری برای شناسایی محتوای تولیدشده توسط هوش مصنوعی و کاهش خطر انتشار اطلاعات جعلی طراحی شده و مستقیماً درون فایل صوتی قرار می‌گیرد.

دیدگاه های کاربران
هیچ دیدگاهی موجود نیست