Google: Gemini 3.8 Flash TTS
Gemini 3.8 Flash TTS یک مدل تبدیل متن به گفتار از Google و مدل خلاقانهتر خانواده Gemini 3.8 TTS است. این مدل برای روایت، تولید صدای شخصیتها و مکالمات چندگوینده مناسب است؛ بهویژه در سناریوهایی که کیفیت و ظرافت اجرای صدا، fidelity و پوشش لهجهها اهمیت بیشتری از کمترین latency دارند. مدل از ۳۰ صدای آماده و قابلیتهای Voice Design و Voice Replication پشتیبانی میکند.

دسترسی API، ساختهشده برای برنامهنویسها
مشخصات اصلی مدل هوش مصنوعی
| نام مدل | google/gemini-3.8-flash-tts |
| تاریخ ساخت | ۱۳۴۸/۱۰/۱۱ |
| حداکثر ورودی | 8192 |
| سرعت مدل | 1.64 / 5 |
| Tokenizer | Other |
| Reasoning | فعال |
| هزینه ورودی متن | $0.5 به ازای هر یک میلیون کاراکتر |
| هزینه خروجی صوت | $9 به ازای هر یک میلیون توکن |
Google: Gemini 3.8 Flash TTS
هر ماه مدلهای هوش مصنوعی متنوعی از شرکتهای مختلف ارائه میشود. ثبت نام، راهاندازی و مدیریت اکانتها و مدیریت مالی مدلهای مختلف کار دشواریست. هوش مصنوعی لیارا، مدلهای برتر دنیا را از طریق یک اکانت و یک کلید دسترسی در اختیار شما قرار میدهد.
مانیتورینگ پیشرفته
تعداد درخواستها، توکنهای مصرفی و هزینههای خود را بهتر مدیریت کنید.
توکن رایگان روزانه
با استفاده از توکنهای رایگان، هزینههای هوشمندسازی نرمافزار خود را کاهش دهید.
مدلهای متنوع
ما به سرعت در حال اضافهکردن مدلهای برتر دنیا هستیم. از OpenAI و DeepSeek گرفته تا Grok و Meta.
معماری مدل
| ورودیها | text |
| خروجی | speech |
| Structured Outputs | غیرفعال |
| Function Calling | غیرفعال |
| Tuning | غیرفعال |
| Streaming | فعال |
پارامترهای قابل تنظیم | voiceresponse_format |
ما سعی میکنیم قابلیتهایی که بهطور مشترک در اکثر مدلها وجود دارد را در قالب OpenAI API پیادهسازی کنیم تا نیازی نباشد برای جابهجایی بین مدلهای مختلف، کدهای خود را تغییر دهید.

