گوگل از مدلهای صوتی Gemini 3.8 برای تبدیل حرفهای متن به صدا رونمایی کرد. این ابزارها با استفاده از دستور متنی، امکان خلق صداهای واقعگرایانه را فراهم میکنند.
بر اساس این گزارش، مدلهای جدید Gemini 3.8 قادرند لحن دیالوگها را کنترل کرده و در بیش از ۱۰۰ زبان مختلف خروجی صوتی ارائه دهند. تمرکز اصلی این فناوری بر تولید صدای طبیعی و متناسب با متن ورودی است.
این رونمایی نشاندهنده ادامه رقابت گوگل در حوزه هوش مصنوعی مولد صوتی است، هرچند جزئیات بیشتر درباره دسترسی یا کاربردهای تجاری آن در متن ارائه نشده است.
🤖خلاصه با هوش مصنوعی تهیه شده —تحریریه پالس ایران