گوگل از مدل جدید خود با نام Gemini 3.5 Live Translate پرده برداشت؛ سیستمی پیشرفته برای ترجمه زنده صوتی از گفتار به گفتار که قرار است تجربه ارتباط میان افراد با زبانهای مختلف را متحول کند.
این فناوری جدید قادر است مکالمات را بهصورت همزمان و پیوسته ترجمه کند و بهجای توقف برای پایان صحبت گوینده، ترجمه را در حین گفتار ارائه دهد؛ قابلیتی که آن را از بسیاری از سیستمهای ترجمه سنتی متمایز میکند.
ترجمه طبیعی با حفظ لحن و سرعت گفتار
به گفته گوگل، Gemini 3.5 Live Translate میتواند بیش از ۷۰ زبان مختلف را بهطور خودکار تشخیص دهد. علاوه بر این، ترجمههای صوتی تولیدشده تلاش میکنند ویژگیهای صدای گوینده از جمله لحن، سرعت بیان و زیر و بمی صدا را حفظ کنند تا مکالمه طبیعیتر به نظر برسد.
ورود به Google Meet با بیش از ۲۰۰۰ ترکیب زبانی
این فناوری قرار است بهتدریج در سرویس Google Meet عرضه شود. با اضافه شدن آن، کاربران میتوانند در جلسات آنلاین از بیش از ۲۰۰۰ ترکیب زبانی مختلف استفاده کنند؛ پیشرفتی قابلتوجه نسبت به قابلیت فعلی که تنها ترجمه به زبان انگلیسی و از انگلیسی را پشتیبانی میکرد.
همچنین گوگل اعلام کرده رابط کاربری Google Meet بهروزرسانی خواهد شد تا دسترسی به ابزار ترجمه گفتار سریعتر و سادهتر انجام شود.
عرضه اولیه برای کاربران سازمانی
نسخه جدید ترجمه گفتار ابتدا بهصورت پیشنمایش خصوصی برای برخی مشتریان تجاری Google Workspace در دسترس قرار میگیرد. این مرحله آزمایشی قرار است در اواخر همین ماه آغاز شود و سپس در ادامه سال برای کاربران بیشتری منتشر خواهد شد.
حضور در اپلیکیشن Google Translate
Gemini 3.5 Live Translate علاوه بر Google Meet، بهصورت جهانی در اپلیکیشن Google Translate برای اندروید و iOS نیز عرضه میشود. همزمان با این انتشار، گوگل قابلیت جدیدی به نام Listening Mode را در نسخه اندروید معرفی میکند که امکان شنیدن ترجمه زنده را از طریق هدفون یا بلندگوی گوشی فراهم میکند.
استفاده از واترمارک برای جلوگیری از سوءاستفاده
گوگل اعلام کرده خروجی صوتی تولیدشده توسط این مدل با واترمارک نامرئی SynthID علامتگذاری میشود. این فناوری برای شناسایی محتوای تولیدشده توسط هوش مصنوعی و کاهش خطر انتشار اطلاعات جعلی طراحی شده و مستقیماً درون فایل صوتی قرار میگیرد.
