ساخت صدای سفارشی در بیش از ۱۰۰ زبان / گوگل مدل‌های صوتی جدید Gemini را عرضه کرد

هوش مصنوعی

اقتصاد‌آنلاین: گوگل دو مدل صوتی جدید Gemini را معرفی کرده که امکان ساخت صدای سفارشی در بیش از ۱۰۰ زبان و انتخاب از میان بیش از ۲ هزار صدای آماده را فراهم می‌کنند.

گوگل دو مدل صوتی Gemini ۳.۸ Flash TTS و Gemini ۳.۸ Flash-Lite TTS را معرفی کرد، این دو بیانگرترین مدل‌های صوتی این شرکت تا امروز به شمار می‌روند.

کاربران با این مدل‌ها می‌توانند در بیش از ۱۰۰ زبان صدای سفارشی بسازند یا از میان بیش از ۲۰۰۰ صدای آماده‌ی استفاده انتخاب کنند. امکان هدایت گفت‌و‌گو‌های رفت‌وبرگشتی و کنترل نحوه‌ی بیان جملات نیز از دیگر قابلیت‌های این مدل‌هاست.

به زبان ساده، گوگل ابزار ساخت و تنظیم صدا‌های طبیعی را در اختیار توسعه‌دهندگان و کاربران عادی قرار داده است.

دسترسی فعلی به این دو مدل به این شکل است:

Gemini ۳.۸ Flash TTS در Gemini Notebook

Gemini ۳.۸ Flash-Lite TTS در Google Vids

هر دو مدل در Gemini API

هر دو مدل به‌زودی در Gemini Enterprise نیز عرضه خواهند شد.

منبع: زومیت
x