Gemini 2.5 models will shut down in October 2026. To avoid service disruptions,
update to a newer model (like
gemini-3.7-flash or gemini-3.1-flash-image).
Any stable Gemini Live API 2.5 models are not impacted.
Learn more.
هر دو مدل تبدیل متن به گفتار (TTS) و مدلهای Live API ، مدلهای تولید گفتار با تأخیر کم هستند که میتوانند برای صداها و زبانهای مختلف پاسخ پیکربندی شوند. با این حال، آنها موارد استفاده بسیار متفاوتی را ارائه میدهند.
تولید متن به گفتار (TTS) یک تعامل یکطرفه و درخواست-پاسخ (ورودی متن، خروجی صدا) است. این فناوری برای سناریوهایی طراحی شده است که نیاز به قرائت دقیق متن ارائه شده با کنترل دقیق بر سبک و صدا دارند، مانند روایت پادکست، کتابهای صوتی یا خواندن مقالات با صدای بلند.
تولید Live API از جریان دو طرفه برای مکالمات صوتی بلادرنگ (ورودی صدا، خروجی صدا) پشتیبانی میکند. این قابلیت در زمینههای مکالمه پویا که در آن مدل تصمیم میگیرد گفتار مربوطه را برگرداند، عالی عمل میکند. توجه داشته باشید که جدیدترین مدلهای Live API از ورودی ویدیو و تصویر نیز پشتیبانی میکنند.
تاریخ آخرین بهروزرسانی 2026-08-27 بهوقت ساعت هماهنگ جهانی.
[[["درک آسان","easyToUnderstand","thumb-up"],["مشکلم را برطرف کرد","solvedMyProblem","thumb-up"],["غیره","otherUp","thumb-up"]],[["اطلاعاتی که نیاز دارم وجود ندارد","missingTheInformationINeed","thumb-down"],["بیشازحد پیچیده/ مراحل بسیار زیاد","tooComplicatedTooManySteps","thumb-down"],["قدیمی","outOfDate","thumb-down"],["مشکل ترجمه","translationIssue","thumb-down"],["مشکل کد / نمونهها","samplesCodeIssue","thumb-down"],["غیره","otherDown","thumb-down"]],["تاریخ آخرین بهروزرسانی 2026-08-27 بهوقت ساعت هماهنگ جهانی."],[],[]]