آشنایی با مدل‌های پشتیبانی‌شده

برای برنامه‌های تلفن همراه و وب، Firebase AI Logic کیت‌های توسعه نرم‌افزار به شما امکان می‌دهند مستقیماً از برنامه‌تان با Gemini مدل پشتیبانی‌شده تعامل داشته باشید.

مدل‌های Gemini چندحالته درنظر گرفته می‌شوند زیرا می‌توانند چندین حالت، ازجمله نوشتار، کد، PDF، تصویر، ویدیو، و صدا را پردازش و حتی تولید کنند.

همچنین، پرسشگان ما را درباره همه مدل‌هایی که Firebase AI Logic پشتیبانی می‌کند و پشتیبانی نمی‌کند مرور کنید.

سریع و هوشمند

gemini-3.8-flash

عملکرد در سطح پیشرفته که با کسری از هزینه مدل‌های بزرگ‌تر رقابت می‌کند. (صدور صورت‌حساب الزامی نیست)

ULTRA FAST

gemini-3.5-flash-lite

مدل پرکاربرد و حساس به هزینه با عملکرد و کیفیت سری Gemini 3. (صدور صورت‌حساب الزامی نیست)

تولید تصویر

gemini-3.1-flash-image

مدل قدرتمند و با کارایی بالای تولید و ویرایش تصویر که برای سرعت و موارد استفاده با حجم بالا بهینه‌سازی شده است. (صورت‌حساب الزامی است)

مدل‌های استفاده عمومی

رفتن به جدول‌های دارای جزئیات مدل

gemini-3.1-pro-preview

هوش پیشرفته، مهارت‌های حل مسئله پیچیده، و قابلیت‌های قدرتمند کدنویسی عامل‌گرا و حس‌وحال. (صورت‌حساب الزامی است)

gemini-3.8-flash

عملکرد در سطح پیشرفته که با کسری از هزینه مدل‌های بزرگ‌تر رقابت می‌کند. (صدور صورت‌حساب الزامی نیست)

gemini-3.5-flash-lite

مدل پرکاربرد و حساس به هزینه با عملکرد و کیفیت سری Gemini 3. (صدور صورت‌حساب الزامی نیست)

مدل‌های پایدار قدیمی‌تر با کاربرد عمومی
  • ‫Gemini 3.7 Flash (gemini-3.7-flash): مدل Gemini 3.x Flash قبلی برای عملکرد در سطح مرزشکن که با هزینه بسیار کمتر با مدل‌های بزرگ‌تر رقابت می‌کند. (عدم نیاز به صورت‌حساب)

  • ‫Gemini 3.6 Flash (gemini-3.6-flash): مدل Gemini 3.x Flash قبلی برای عملکرد در سطح مرزشکن که با هزینه بسیار کمتر با مدل‌های بزرگ‌تر رقابت می‌کند. (عدم نیاز به صورت‌حساب)

  • ‫Gemini 3.5 Flash (gemini-3.5-flash): مدل Gemini 3.x Flash قبلی برای عملکرد در سطح مرزشکن که با هزینه بسیار کمتر با مدل‌های بزرگ‌تر رقابت می‌کند. (عدم نیاز به صورت‌حساب)

  • ‫Gemini 3.1 Flash‑Lite (gemini-3.1-flash-lite): مدل Gemini 3.x Flash‑Lite قبلی برای حجم بالا، وظایف کاری حساس به هزینه. (عدم نیاز به صورت‌حساب)

مدل‌های تولید تصویر

رفتن به جدول‌های دارای جزئیات مدل

gemini-3-pro-image

مدل تولید و ویرایش تصویر پیشرفته برای ایجاد تصویر بومی بسیار زمینه‌ای. (صورت‌حساب الزامی است)

gemini-3.1-flash-image

مدل قدرتمند و با کارایی بالای تولید و ویرایش تصویر که برای سرعت و موارد استفاده با حجم بالا بهینه‌سازی شده است. (صورت‌حساب الزامی است)

gemini-3.1-flash-lite-image

مدل تولید و ویرایش تصویر با تأخیر بسیار کم و مقرون‌به‌صرفه که برای موارد استفاده تعاملی با حجم بالا طراحی شده است. (صورت‌حساب الزامی است)

مدل‌های تولید صدا

مدل‌های نوشتار به گفتار (TTS)

با Gemini مدل «نوشتار به گفتار» می‌توانید از ورودی نوشتار گفتار تولید کنید.

رفتن به جدول‌های دارای جزئیات مدل

gemini-3.1-flash-tts-preview

تولید گفتار قدرتمند با تأخیر کم از ورودی نوشتاری. (صدور صورت‌حساب الزامی نیست)

مدل‌های Live API

می‌توانید با مدل‌هایی که از Gemini Live API پشتیبانی می‌کنند، صدای جاری‌سازی دوطرفه تولید کنید.

رفتن به جدول‌های دارای جزئیات مدل

Gemini Developer API:
gemini-3.1-flash-live-preview

میانای برنامه‌سازی کاربردی پلاتفرم عامل Gemini:
پشتیبانی نمی‌شود

تعامل‌های صوتی و تصویری هم‌زمان با تأخیر کم با مدل Gemini که دوطرفه است را فعال می‌کند. (صدور صورت‌حساب الزامی نیست)

Gemini Developer API:
gemini-2.5-flash-native-audio-preview-12-2025

پلاتفرم Agent Gemini API:
gemini-live-2.5-flash-native-audio

تعامل‌های صوتی و تصویری هم‌زمان با تأخیر کم با مدل Gemini که دوطرفه است را فعال می‌کند. (صدور صورت‌حساب الزامی نیست)


بقیه این صفحه اطلاعات دقیقی درباره مدل‌های پشتیبانی‌شده توسط Firebase AI Logic ارائه می‌دهد.

در پایین این صفحه، می‌توانید اطلاعات دقیق درباره مدل‌های نسل قبلی را مشاهده کنید.



مقایسه مدل‌ها

هر مدل قابلیت‌های متفاوتی برای پشتیبانی از موارد استفاده مختلف دارد. توجه داشته باشید که هریک از جدول‌های این بخش هر مدل را هنگام استفاده با Firebase AI Logic توصیف می‌کند. هر مدل ممکن است قابلیت‌های اضافی داشته باشد که هنگام استفاده از کیت‌های توسعه نرم‌افزار ما دردسترس نیستند.

اگر نمی‌توانید اطلاعاتی را که به‌دنبال آن هستید در زیربخش‌های زیر پیدا کنید، می‌توانید اطلاعات بیشتری را در اسناد ارائه‌دهنده API انتخابی‌تان پیدا کنید: Gemini Developer API یا Agent Platform Gemini API (formerly Vertex AI).

ورودی و خروجی پشتیبانی‌شده

جدول زیر انواع ورودی و خروجی پشتیبانی‌شده را هنگام استفاده از هر مدل با Firebase AI Logic فهرست می‌کند.

برای آشنایی با انواع فایل‌های پشتیبانی‌شده، به فایل‌های ورودی پشتیبانی‌شده و الزامات مراجعه کنید.

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
انواع ورودی
نوشتار
کد
اسناد
(PDF یا نوشتار ساده)
تصاویر
ویدیو
صوتی
انواع برونداد
نوشتار
نوشتار (جاری‌سازی)
کد
برونداد ساختاریافته
(مثل JSON)
تصاویر
ویدیو
صوتی

قابلیت‌ها و ویژگی‌های پشتیبانی‌شده

جدول زیر قابلیت‌ها و ویژگی‌های پشتیبانی‌شده را هنگام استفاده از هر مدل با Firebase AI Logic فهرست می‌کند.

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
درحال فکر کردن
تولید نوشتار از ورودی‌های فقط نوشتاری یا چندحالته درهم‌تنیده یا به‌عنوان بخشی از تصویر درهم‌تنیده یا به‌عنوان بخشی از تصویر درهم‌تنیده یا به‌عنوان بخشی از تصویر ترانویسی
تولید تصاویر
ویرایش کردن تصاویر
تولید کردن صدا گفتار جاری‌سازی صدا
تولید برونداد ساختاریافته
(مانند JSON)
تجزیه‌وتحلیل اسناد
(PDF یا نوشتار ساده)
(برونداد نوشتاری | برونداد تصویری)
تحلیل تصاویر
(برونداد نوشتاری | برونداد تصویری)
تجزیه‌وتحلیل ویدیو
(برونداد نوشتاری | برونداد تصویری)
ویدیو جاری‌سازی‌شده
تحلیل صدا جاری‌سازی صدا
گپ چندنوبتی
جاری‌سازی چندحالته دوطرفه
ابزارهای پشتیبانی‌شده
فراخوانی تابع
اجرای کد
بافت نشانی وب
آرامش با Google Search
آرامش با Google Maps

مشخصات و محدودیت‌ها

جدول زیر مشخصات و محدودیت‌های استفاده از هر مدل با Firebase AI Logic را فهرست می‌کند.

دارایی Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
محدودیت داده‌واحد ورودی * ‫۱٬۰۴۸٬۵۷۶ داده‌واحد ‫۶۵٬۵۳۶ داده‌واحد ‫۱۳۱٬۰۷۲ داده‌واحد ‫۶۵٬۵۳۶ داده‌واحد ‫۸٬۱۹۲ داده‌واحد دیدن اسناد
محدودیت داده‌واحد برونداد * ‫۶۵٬۵۳۶ داده‌واحد ‫۳۲٬۷۶۸ داده‌واحد ‫۳۲٬۷۶۸ داده‌واحد ‫۴٬۰۹۶ داده‌واحد ‫۱۶۳۸۴ داده‌واحد
فایل‌های PDF (به‌ازای هر درخواست)
حداکثر تعداد
فایل‌های PDF ورودی **
‫۹۰۰ فایل ‫۱۴ فایل ‫۱۴ فایل ‫۱۴ فایل --- دیدن اسناد
حداکثر تعداد
صفحات
برای هر فایل PDF ورودی **
۹۰۰ صفحه ‫۱۴ صفحه ‫۱۴ صفحه ‫۱۴ صفحه ---
حداکثر اندازه
برای هر فایل PDF ورودی
‫۵۰ مگابایت ‫۵۰ مگابایت ‫۵۰ مگابایت ‫۵۰ مگابایت ---
تصاویر (به‌ازای هر درخواست)
حداکثر تعداد
تصویر ورودی
‫۱٬۰۰۰ تصویر ‫۱۴ تصویر ‫۱۴ تصویر ‫۱۴ تصویر --- دیدن اسناد
حداکثر اندازه
برای هر تصویر ورودی کدبندی‌شده با base64
‫۷ مگابایت ‫۷ مگابایت ‫۷ مگابایت ‫۷ مگابایت ---
حداکثر تعداد
تصاویر برونداد
--- تا حد مجاز داده‌واحد برونداد تا حد مجاز داده‌واحد برونداد تا حد مجاز داده‌واحد برونداد ---
ویدیو (به‌ازای هر درخواست)
حداکثر تعداد
فایل ویدیو ورودی
‫۱۰ فایل --- تا حد مجاز کد ورودی تا حد مجاز کد ورودی --- دیدن اسناد
حداکثر طول
همه ویدیوهای ورودی
(فقط قاب‌ها)
تقریباً ۶۰ دقیقه --- تقریباً ۲۵ دقیقه تقریباً ۱۲ دقیقه ---
حداکثر طول
همه ویدیوهای ورودی
(قاب+صدا)
تقریباً ۴۵ دقیقه --- --- --- ---
صدا (به‌ازای هر درخواست)
حداکثر تعداد
فایل‌های صوتی ورودی
۱ فایل --- --- --- --- دیدن اسناد
حداکثر طول
همه صدای ورودی
تقریباً ۸٫۴ ساعت --- --- --- ---

* برای همه مدل‌های Gemini، یک داده‌واحد (توکن) معادل حدود ۴ نویسه است، بنابراین ۱۰۰ داده‌واحد (توکن) حدود ۶۰ تا ۸۰ کلمه انگلیسی است. برای Gemini مدل، می‌توانید تعداد کل داده‌واحدها را در درخواست‌هایتان بااستفاده از countTokens تعیین کنید.

** فایل‌های PDF به‌عنوان تصویر درنظر گرفته می‌شوند، بنابراین یک صفحه از فایل PDF به‌عنوان یک تصویر درنظر گرفته می‌شود. تعداد صفحه‌های مجاز در یک درخواست به تعداد تصاویری که مدل می‌تواند پشتیبانی کند محدود است.

یافتن اطلاعات دقیق بیشتر



الگوهای نام‌گذاری و نسخه‌بندی مدل

مدل‌ها در نسخه‌های پایدار، پیش‌نمایش، و آزمایشی ارائه می‌شوند. برای راحتی، نام‌های مستعار -latest پشتیبانی می‌شوند، اما به‌دلیل ناسازگاری در نسخه مدلی که به آن اشاره می‌کنند، توصیه نمی‌شوند.

حتماً روال‌های مطلوب ما برای استفاده از نسخه‌های مدل را مرور کنید.

برای یافتن نام‌های مدل خاص برای استفاده در کد خود، به بخش «نام‌های مدل دردسترس» در ادامه این صفحه مراجعه کنید.

نوع نسخه /
مرحله انتشار
شرح الگوی نام مدل
پایدار نسخه‌های پایدار برای استفاده در تولید از تاریخ انتشار دردسترس و پشتیبانی می‌شوند.
  • نسخه مدل پایدار معمولاً با تاریخ بازنشستگی منتشر می‌شود که نشان‌دهنده آخرین روزی است که مدل دردسترس است. پس‌از این تاریخ، مدل دیگر دردسترس نخواهد بود یا Google از آن پشتیبانی نخواهد کرد.
  • اکثر مدل‌های پایدار تا ۱۲ ماه پس‌از تاریخ انتشارشان دردسترس هستند (حتی اگر مدل جایگزینی منتشر شود).
  • برای Agent Platform Gemini API (formerly Vertex AI)، برخی‌از مدل‌های پایدار فقط دسترسی کوتاه‌مدت دارند، که یعنی ممکن است آن‌ها را (بازنشسته) زودتر از ۴۵ روز پس‌از انتشار مدل جایگزین خاموش کنند.

نام‌های مدل نسخه‌های پایدار هیچ پسوندی ندارند

مثال:
gemini-3.8-flash

پیش‌نمایش نسخه‌های پیش‌نمایش قابلیت‌های جدیدی دارند و پایدار درنظر گرفته نمی‌شوند.
  • این مدل‌ها برای استفاده تولیدی توصیه نمی‌شوند، حد نرخ محدودکننده‌تری دارند، و ممکن است الزامات صورت‌حساب داشته باشند.
  • این مدل‌ها ظرف چند هفته یا چند ماه پس‌از انتشار نسخه پایدار مرتبط با آن‌ها، خاموش (بازنشسته) می‌شوند.
  • برای Agent Platform Gemini API (formerly Vertex AI)، مدل‌های پیش‌نمایش فقط در global مکان دردسترس است.

نام‌های مدل نسخه‌های پیش‌نمایش با -preview ضمیمه می‌شود

مثال:
gemini-3-pro-preview

آزمایشی نسخه‌های آزمایشی قابلیت‌های جدیدی دارند و پایدار درنظر گرفته نمی‌شوند.
  • این مدل‌ها برای استفاده در تولید توصیه نمی‌شوند و حد نرخ محدودکننده‌تری دارند. مدل‌های آزمایشی برای جمع‌آوری بازخورد و فعال کردن آزمایش با جدیدترین ویژگی‌های ما درنظر گرفته شده‌اند.
  • این مدل‌ها ظرف چند هفته یا چند ماه پس‌از انتشار نسخه پایدار مرتبط با آن‌ها، خاموش (بازنشسته) می‌شوند.
  • برای Agent Platform Gemini API (formerly Vertex AI)، مدل‌های آزمایشی فقط در global مکان دردسترس هستند.

نام‌های مدل نسخه‌های آزمایشی با -exp به‌همراه تاریخ انتشار مدل (-MM-DD) پیوست می‌شود

مثال:
gemini-2.5-pro-exp-03-25
(منتشرشده در ۲۵ مارس ۲۰۲۵)

خاموش کردن (بازنشسته) نسخه‌های خاموش (بازنشسته) از تاریخ خاموش شدن (بازنشستگی) خود گذشته‌اند و به‌طور دائمی غیرفعال شده‌اند.
  • مدل‌های خاموش (بازنشسته) دیگر دردسترس نیستند یا ازسوی Google پشتیبانی نمی‌شوند، و درخواست بااستفاده از نام مدل بازنشسته خطای ۴۰۴ برمی‌گرداند.

---

روال‌های مطلوب برای استفاده از نسخه‌های مدل

  • در برنامه‌های تولید، از نام مدل صریح برای جدیدترین نسخه پایدار استفاده کنید.

    برای Agent Platform Gemini API (formerly Vertex AI)، اگر تصمیم بگیرید در برنامه تولیدتان از مدل دردسترس بودن کوتاه‌مدت استفاده کنید، بسیار مهم است که از Firebase Remote Config یا الگوهای پیام‌واره سرور برای کنترل نام مدل استفاده‌شده برای ویژگی هوش مصنوعی‌تان استفاده کنید.

  • فقط درطول نمونه‌سازی از نسخه‌های پیش‌نمایش و آزمایشی استفاده کنید. توصیه می‌کنیم هنگام شروع توسعه و آزمایش برای مورد استفاده تولید، از نسخه پایدار استفاده کنید.

  • توصیه می‌کنیم از نام‌های مستعار -latest استفاده نکنید (حتی درطول توسعه). این نام مستعار به جدیدترین نسخه پخش برای یک مدل خاص اشاره می‌کند (که می‌تواند نسخه پایدار، پیش‌نمایش، یا آزمایشی باشد). این نام مستعار با هر نسخه جدید از یک مدل خاص جایگزین می‌شود و فقط برای تغییرات اساسی، ایمیل اعلان ۲ هفته قبل ارسال می‌شود. این بی‌ثباتی در اینکه واقعاً از کدام مدل استفاده می‌کنید می‌تواند منجر به تغییرات غیرمنتظره در عملکرد ویژگی هوش مصنوعی شما شود.



نام‌های مدل دردسترس

نام‌های مدل مقادیر صریحی هستند که درطول مقداردهی اولیه مدل در کد خود می‌گنجانید.

برای نمونه‌های مقداردهی اولیه برای پلاتفرم خود، به راهنمای شروع به کار مراجعه کنید.

برای جزئیات مراحل انتشار (به‌ویژه برای موارد استفاده، صورت‌حساب، و خاموش کردن)، به الگوهای نام‌گذاری و نسخه‌بندی مدل مراجعه کنید.

فهرست کردن برنامه‌ریزی‌شده همه مدل‌های دردسترس

بااستفاده از REST API می‌توانید نام همه مدل‌های دردسترس را فهرست کنید:

توجه داشته باشید که این فهرست برگشتی شامل همه مدل‌های پشتیبانی‌شده توسط ارائه‌دهندگان API خواهد بود، اما Firebase AI Logic فقط از مدل‌های Gemini که در این صفحه توضیح داده شده است پشتیبانی می‌کند.

مدل‌های استفاده عمومی

‫Gemini 3.x Pro نام مدل

صرف‌نظر از ارائه‌دهنده Gemini API شما، طرح قیمت‌گذاری Blaze با پرداخت براساس مصرف را الزامی می‌کند.

نام مدل شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-3.1-pro-preview جدیدترین نسخه پیش‌نمایش Gemini 3.x Pro پیش‌نمایش 2026-02-19 اعلام خواهد شد

‫Gemini 3.x Flash نام مدل

اگر از Gemini Developer API استفاده می‌کنید، به طرح قیمت‌گذاری Blaze با پرداخت به اندازه استفاده نیاز ندارد.

نام مدل شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-3.8-flash جدیدترین نسخه پایدار Gemini 3.x Flash
این یک مدل دردسترس بودن کوتاه‌مدت است (به الگوهای نام‌گذاری و نسخه‌بندی مدل مراجعه کنید).
رده 2026-09-02 اعلام خواهد شد
gemini-3.7-flash نسخه پایدار Gemini 3.x Flash
این یک مدل دردسترس بودن کوتاه‌مدت است (به الگوهای نام‌گذاری و نسخه‌بندی مدل مراجعه کنید).
رده 2026-08-13 اعلام خواهد شد
gemini-3.6-flash نسخه پایدار Gemini 3.x Flash
این یک مدل دردسترس بودن کوتاه‌مدت است (به الگوهای نام‌گذاری و نسخه‌بندی مدل مراجعه کنید).
رده 2026-07-21 اعلام خواهد شد
gemini-3.5-flash نسخه پایدار Gemini 3.x Flash رده 2026-05-19 زودتر از
۲۰۲۷-۰۵-۱۹ نباشد
gemini-3-flash-preview نسخه پیش‌نمایش Gemini 3.x Flash پیش‌نمایش 2025-12-17 اعلام خواهد شد

‫Gemini 3.x Flash‑Lite نام مدل

اگر از Gemini Developer API استفاده می‌کنید، به طرح قیمت‌گذاری Blaze با پرداخت به اندازه استفاده نیاز ندارد.

نام مدل شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-3.5-flash-lite جدیدترین نسخه پایدار Gemini 3.x Flash‑Lite رده 2026-07-21 زودتر از
۲۰۲۷-۰۷-۲۱ نباشد
gemini-3.1-flash-lite نسخه پایدار Gemini 3.x Flash‑Lite رده 2026-05-07 زودتر از
۲۰۲۷-۰۵-۰۷ نباشد

مدل‌های تولید تصویر

نام‌های مدل Gemini 3.x Pro Image (معروف به «Nano Banana Pro»)

صرف‌نظر از ارائه‌دهنده Gemini API شما، طرح قیمت‌گذاری Blaze با پرداخت براساس مصرف را الزامی می‌کند.

نام مدل شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-3-pro-image نسخه پایدار Gemini 3.x Pro Image
(با نام مستعار «Nano Banana Pro»)
رده 2026-05-28 زودتر از
۲۰۲۷-۰۵-۲۸ نباشد
gemini-3-pro-image-preview نسخه پیش‌نمایش Gemini 3.x Pro Image
(با نام مستعار «Nano Banana Pro»)
پیش‌نمایش 2025-11-20 از
۲۵ ژوئن ۲۰۲۶

نام مدل Gemini 3.x Flash Image (معروف به «Nano Banana 2»)

صرف‌نظر از ارائه‌دهنده Gemini API شما، طرح قیمت‌گذاری Blaze با پرداخت براساس مصرف را الزامی می‌کند.

نام مدل شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-3.1-flash-image نسخه پایدار Gemini 3.x Flash Image
(معروف به «Nano Banana 2»)
رده 2026-05-28 زودتر از
۲۰۲۷-۰۵-۲۸ نباشد
gemini-3.1-flash-image-preview نسخه پیش‌نمایش Gemini 3.x Flash Image
(با نام مستعار «Nano Banana 2»)
پیش‌نمایش 2026-02-26 از
۲۵ ژوئن ۲۰۲۶

نام مدل Gemini 3.x Flash‑Lite Image (معروف به «Nano Banana 2 Lite»)

صرف‌نظر از ارائه‌دهنده Gemini API شما، طرح قیمت‌گذاری Blaze با پرداخت براساس مصرف را الزامی می‌کند.

نام مدل شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-3.1-flash-lite-image نسخه پایدار Gemini 3.x Flash‑Lite Image
(با نام مستعار «Nano Banana 2 Lite»)
این یک مدل با دردسترس بودن کوتاه‌مدت است (به الگوهای نام‌گذاری و نسخه‌بندی مدل مراجعه کنید).
رده 2026-06-30 اعلام خواهد شد

مدل‌های صوتی - نوشتار به گفتار (TTS)

‫Gemini 3.x Flash TTS نام مدل

اگر از Gemini Developer API استفاده می‌کنید، به طرح قیمت‌گذاری Blaze با پرداخت به اندازه استفاده نیاز ندارد.

نام مدل شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-3.1-flash-tts-preview نسخه پیش‌نمایش برای Gemini 3.x Flash TTS پیش‌نمایش 2026-06-17 اعلام خواهد شد

صدا - Live API مدل

‫Gemini 3.x Flash Live نام مدل

Gemini Developer API
نام مدل
شرح مرحله انتشار تاریخ انتشار تاریخ توقف
‫gemini-3.1-flash-live-preview ۱ نسخه پیش‌نمایش برای Live API در Gemini Developer API پیش‌نمایش 2026-03-26 اعلام خواهد شد
Agent Platform Gemini API (formerly Vertex AI)
نام مدل
شرح مرحله انتشار تاریخ انتشار تاریخ توقف
‫Agent Platform Gemini API (formerly Vertex AI) از هیچ‌یک از مدل‌های Gemini Live 3.x پشتیبانی نمی‌کند.

۱ فقط توسط Gemini Developer API پشتیبانی می‌شود. همچنین، با اینکه این مدل پیش‌نمایش است، در «سطح رایگان» Gemini Developer API دردسترس است.

‫Gemini 2.5 Flash Live نام مدل

اگر از Gemini Developer API استفاده می‌کنید، به طرح قیمت‌گذاری Blaze با پرداخت براساس مصرف نیاز ندارد (معمولاً مدل‌های پیش‌نمایش به طرح پولی نیاز دارند).

اگرچه مدل‌های زیر بسته به ارائه‌دهنده Gemini API نام‌های مدل متفاوتی دارند، ویژگی‌های مدل یکسان است.

Gemini Developer API
نام مدل
شرح مرحله انتشار تاریخ انتشار تاریخ توقف
‫gemini-2.5-flash-native-audio-preview-12-2025 ۱ نسخه پیش‌نمایش برای Live API در Gemini Developer API پیش‌نمایش 2025-12-12 اعلام خواهد شد
‫gemini-2.5-flash-native-audio-preview-09-2025 ۱ نسخه پیش‌نمایش اولیه برای Live API در Gemini Developer API پیش‌نمایش 2025-09-18 اعلام خواهد شد
Agent Platform Gemini API (formerly Vertex AI)
نام مدل
شرح مرحله انتشار تاریخ انتشار تاریخ توقف
gemini-live-2.5-flash-native-audio ۲ نسخه پایدار برای Live API در Agent Platform Gemini API (formerly Vertex AI) رده 2025-12-12 زودتر از
۲۰۲۶-۱۲-۱۲ نباشد
gemini-live-2.5-flash-preview-native-audio-09-2025 ۲ نسخه پیش‌نمایش برای Live API در Agent Platform Gemini API (formerly Vertex AI) پیش‌نمایش 2025-09-18 اعلام خواهد شد

۱ فقط توسط Gemini Developer API پشتیبانی می‌شود. همچنین، با اینکه این‌ها مدل‌های پیش‌نمایش هستند، در «سطح رایگان» Gemini Developer API دردسترس هستند.
۲ فقط توسط Agent Platform Gemini API (formerly Vertex AI) پشتیبانی می‌شود. همچنین، این مدل‌ها در global مکان دردسترس نیستند.



زبان‌های پشتیبانی‌شده

مدل‌های استفاده عمومی

همه مدل‌های Gemini با کاربرد عمومی (مثل Gemini 3.8 Flash، Gemini 3.5 Flash-Lite،‏ Gemini 3.1 Pro، و مدل‌های 3.x قبلی) می‌توانند به بیش‌از ۱۰۰ زبان متوجه شوند و پاسخ دهند:

آفریقایی (af)، آلبانیایی (sq)، امهری (am)، عربی (ar)، ارمنی (hy)، آسامی (as)، آذربایجانی (az)، باسکی (eu)، بلاروسی (be)، بنگالی (bn)، بوسنیایی (bs)، بلغاری (bg)، کاتالان (ca)، سبوانو (ceb)، چینی ساده و سنتی (zh)، کورسیکایی (co)، کرواتی (hr)، چکی (cs)، دانمارکی (da)، دیوهی (dv)، هلندی (nl)، انگلیسی (en)، اسپرانتو (eo)، استونیایی (et)، فیلیپینی (تاگالوگ) (fil)، فنلاندی (fi)، فرانسوی (fr)، فریزی (fy)، گالیسیایی (gl)، گرجی (ka)، آلمانی (de)، یونانی (el)، گجراتی (gu)، کریول هائیتی (ht)، هوسه (ha)، هاوایی (haw)، عبری (iw)، هندی (hi)، همونگ (hmn)، مجاری (hu)، ایسلندی (is)، ایگبو (ig)، اندونزیایی (id)، ایرلندی (ga)، ایتالیایی (it)، ژاپنی (ja)، جاوه (jv)، کانادایی (kn)، قزاقی (kk)، خمر (km)، کره‌ای (ko)، کریو (kri)، کردی (ku)، قرقیزی (ky)، لائو (lo)، لاتین (la)، لتونیایی (lv)، لیتوانیایی (lt)، لوکزامبورگی (lb)، مقدونی (mk)، مالاگاسی (mg)، مالایی (ms)، مالایالام (ml)، مالتی (mt)، مائوری (mi)، مراثی (mr)، میتایلون (مانیپوری) (mni-Mtei)، مغولی (mn)، میانماری (برمه‌ای) (my)، نپالی (ne)، نروژی (no)، نیانجا (چیچوا) (ny)، اودیا (اوریه) (or)، پشتو (ps)، فارسی (fa)، لهستانی (pl)، پرتغالی (pt)، پنجابی (pa)، رومانیایی (ro)، روسی (ru)، ساموآیی (sm)، گیلیک اسکاتلندی (gd)، صربی (sr)، سسوتو (st)، شونا (sn)، سندی (sd)، سینهالی (si)، اسلواکی (sk)، اسلوونیایی (sl)، سومالیایی (so)، اسپانیایی (es)، سوندانی (su)، سواحیلی (sw)، سوئدی (sv)، تاجیکی (tg)، تامیل (ta)، تلوگو (te)، تایلندی (th)، ترکی (tr)، اوکراینی (uk)، اردو (ur)، اویغوری (ug)، ازبکی (uz)، ویتنامی (vi)، ولزی (cy)، خوسایی (xh)، یدی (yi)، یوروبایی (yo)، و زولو (zu).

مدل‌های تولید تصویر

مدل‌های Gemini 3.x Image می‌توانند پیام‌واره‌های نوشتاری را به زبان‌های مختلف بپذیرند. بااین‌حال، این مدل برای بهترین عملکرد (هم برای پیام‌واره‌های نوشتاری و هم برای پرداز زدن نوشتار در تصاویر تولیدشده) در زبان‌ها و منطقه‌های زیر بهینه‌سازی شده است:

آلمانی (de-DE)، اسپانیایی (es-MX)، اندونزیایی (id-ID)، انگلیسی (EN)، ایتالیایی (it-IT)، پرتغالی (pt-BR)، چینی ساده‌شده (zh-CN)، روسی (ru-RU)، عربی (ar-EG)، فرانسوی (fr-FR)، کره‌ای (ko-KR)، اوکراینی (uk-UA)، ویتنامی (vi-VN)، و هندی (hi-IN).ja-JP

برای کسب اطلاعات بیشتر درباره روال‌های مطلوب پیام‌واره و تولید نوشتار در تصاویر، به زبان‌های پشتیبانی‌شده برای تولید تصویر مراجعه کنید.

مدل‌های تولیدکننده صدا (TTS و Live API)

مدل‌های تولید صدا از مجموعه‌های زبان تخصصی بهینه‌سازی‌شده برای ترکیب گفتار و (برای Live API) گفتگوی دوطرفه هم‌زمان پشتیبانی می‌کنند:

  • مدل‌های نوشتار به گفتار (TTS): مدل‌های Gemini 3.x TTS می‌توانند به‌طور خودکار گفتار را در نزدیک به ۸۰ زبان و گویش تشخیص دهند و تولید کنند.

    برای مشاهده فهرست کامل زبان‌های پشتیبانی‌شده و کدهای مکان BCP-47 موجود، به زبان‌های پشتیبانی‌شده برای تولید گفتار مراجعه کنید.

  • مدل‌های Live API: مدل‌های Live API از تعاملات صوتی دوطرفه و هم‌زمان در تقریباً ۸۰ زبان و گویش پشتیبانی می‌کنند.

    برای مشاهده فهرست کامل زبان‌های پشتیبانی‌شده و آشنایی با نحوه تأثیرگذاری بر زبان پاسخ گفتاری، به زبان‌های پشتیبانی‌شده برای Live API مراجعه کنید.



اطلاعات درباره مدل‌های قبلی

موارد زیر فعال هستند، اما مدل‌های نسل قبلی هستند. توصیه می‌کنیم درصورت امکان از یکی از جدیدترین مدل‌ها استفاده کنید.

اگر نمی‌توانید اطلاعاتی را که به‌دنبال آن هستید در زیربخش‌های زیر پیدا کنید، می‌توانید اطلاعات بیشتری را در اسناد ارائه‌دهنده API انتخابی‌تان پیدا کنید: Gemini Developer API یا Agent Platform Gemini API (formerly Vertex AI)

مدل‌های قدیمی‌تر Gemini

  • gemini-2.5-pro
  • gemini-2.5-flash
  • gemini-2.5-flash-lite
  • ‫gemini-2.5-flash-image (با نام مستعار «نانو موز»)
  • ‫gemini-2.0-flash-001 (و نام مستعار به‌روزرسانی خودکار آن gemini-2.0-flash)
  • ‫gemini-2.0-flash-lite-001 (و نام مستعار به‌روزرسانی خودکار آن gemini-2.0-flash-lite)

برای کسب اطلاعات درباره مدل‌های قدیمی‌تر Gemini Live API، به مستندات ارائه‌دهنده Gemini API مراجعه کنید:

مدل‌های قدیمی‌تر Imagen

  • imagen-4.0-ultra-generate-001
  • imagen-4.0-generate-001
  • imagen-4.0-fast-generate-001
  • imagen-3.0-capability-001
  • imagen-3.0-generate-002
  • imagen-3.0-generate-001
  • imagen-3.0-fast-generate-001

مشاهده جزئیات درباره مدل‌های قبلی



مراحل بعدی

امکانات Gemini API را امتحان کنید