گوگل مدل جمینای ۳.۵ را برای تبدیل صوت به متن معرفی کرد. این مدل با پشتیبانی از ۸۵ زبان، گامی مهم در حوزه فناوری پردازش صوت و هوش مصنوعی محسوب میشود.
از ویژگیهای بارز این مدل میتوان به ویرایش صوتی و تشخیص چند گوینده اشاره کرد که آن را به ابزاری حرفهای برای کاربردهای مختلف مانند تولید محتوا، ترجمه و تحلیل دادههای صوتی تبدیل میکند.
این توسعه نشاندهنده رقابت جدی گوگل با سایر شرکتهای فناوری در زمینه هوش مصنوعی و پردازش زبان است و میتواند تأثیر قابلتوجهی بر صنایع مرتبط با فناوری بگذارد.
🤖خلاصه با هوش مصنوعی تهیه شده —تحریریه پالس ایران