برای برنامههای تلفن همراه و وب، Firebase AI Logic کیتهای توسعه نرمافزار به شما امکان میدهند مستقیماً از برنامهتان با Gemini مدل پشتیبانیشده تعامل داشته باشید.
مدلهای Gemini چندحالته درنظر گرفته میشوند زیرا میتوانند چندین حالت، ازجمله نوشتار، کد، PDF، تصویر، ویدیو، و صدا را پردازش و حتی تولید کنند.
همچنین، پرسشگان ما را درباره همه مدلهایی که Firebase AI Logic پشتیبانی میکند و پشتیبانی نمیکند مرور کنید.
مدلهای ویژه
Gemini 3.8 Flash
gemini-3.8-flash
عملکرد در سطح پیشرفته که با کسری از هزینه مدلهای بزرگتر رقابت میکند.
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
مدل پرکاربرد و حساس به هزینه با عملکرد و کیفیت سری Gemini 3.
تصویر Gemini 3.1 Flash (Nano Banana 2)
gemini-3.1-flash-image
مدل قدرتمند و با کارایی بالای تولید و ویرایش تصویر که برای سرعت و موارد استفاده با حجم بالا بهینهسازی شده است.
مدلهای استفاده عمومی
رفتن به جدولهای دارای جزئیات مدل
Gemini 3.1 Pro
gemini-3.1-pro-preview
هوش پیشرفته، مهارتهای حل مسئله پیچیده، و قابلیتهای قدرتمند کدنویسی
عاملگرا و حسوحال.
Gemini 3.8 Flash
gemini-3.8-flash
عملکرد در سطح پیشرفته که با کسری از هزینه مدلهای بزرگتر رقابت میکند.
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
مدل پرکاربرد و حساس به هزینه با عملکرد و کیفیت سری Gemini 3.
مدلهای پایدار قدیمیتر با کاربرد عمومی
Gemini 3.7 Flash (
gemini-3.7-flash): مدل Gemini 3.x Flash قبلی برای عملکرد در سطح مرزشکن که با هزینه بسیار کمتر با مدلهای بزرگتر رقابت میکند. (عدم نیاز به صورتحساب)Gemini 3.6 Flash (
gemini-3.6-flash): مدل Gemini 3.x Flash قبلی برای عملکرد در سطح مرزشکن که با هزینه بسیار کمتر با مدلهای بزرگتر رقابت میکند. (عدم نیاز به صورتحساب)Gemini 3.5 Flash (
gemini-3.5-flash): مدل Gemini 3.x Flash قبلی برای عملکرد در سطح مرزشکن که با هزینه بسیار کمتر با مدلهای بزرگتر رقابت میکند. (عدم نیاز به صورتحساب)Gemini 3.1 Flash‑Lite (
gemini-3.1-flash-lite): مدل Gemini 3.x Flash‑Lite قبلی برای حجم بالا، وظایف کاری حساس به هزینه. (عدم نیاز به صورتحساب)
مدلهای تولید تصویر
رفتن به جدولهای دارای جزئیات مدل
تصویر Gemini 3 Pro (Nano Banana Pro)
gemini-3-pro-image
مدل تولید و ویرایش تصویر پیشرفته برای ایجاد تصویر بومی بسیار زمینهای.
تصویر Gemini 3.1 Flash (Nano Banana 2)
gemini-3.1-flash-image
مدل قدرتمند و با کارایی بالای تولید و ویرایش تصویر که برای سرعت و موارد استفاده با حجم بالا بهینهسازی شده است.
تصویر Gemini 3.1 Flash-Lite (Nano Banana 2 Lite)
gemini-3.1-flash-lite-image
مدل تولید و ویرایش تصویر با تأخیر بسیار کم و مقرونبهصرفه که برای موارد استفاده تعاملی با حجم بالا طراحی شده است.
مدلهای تولید صدا
مدلهای نوشتار به گفتار (TTS)
با Gemini مدل «نوشتار به گفتار» میتوانید از ورودی نوشتار گفتار تولید کنید.
رفتن به جدولهای دارای جزئیات مدل
Gemini 3.x Flash TTS
gemini-3.1-flash-tts-preview
تولید گفتار قدرتمند با تأخیر کم از ورودی نوشتاری.
مدلهای Live API
میتوانید با مدلهایی که از Gemini Live API پشتیبانی میکنند، صدای جاریسازی دوطرفه تولید کنید.
رفتن به جدولهای دارای جزئیات مدل
Gemini 3.x Flash با صدای بومی Gemini Live API
Gemini Developer API:gemini-3.1-flash-live-preview
میانای برنامهسازی کاربردی پلاتفرم عامل Gemini:
پشتیبانی نمیشود
تعاملهای صوتی و تصویری همزمان با تأخیر کم با مدل Gemini که دوطرفه است را فعال میکند.
Gemini 2.5 Flash با صدای بومی Gemini Live API
Gemini Developer API:gemini-2.5-flash-native-audio-preview-12-2025
پلاتفرم Agent Gemini API:gemini-live-2.5-flash-native-audio
تعاملهای صوتی و تصویری همزمان با تأخیر کم با مدل Gemini که دوطرفه است را فعال میکند.
بقیه این صفحه اطلاعات دقیقی درباره مدلهای پشتیبانیشده توسط Firebase AI Logic ارائه میدهد.
-
- ورودی و خروجی پشتیبانیشده
- مقایسه سطح بالای قابلیتهای پشتیبانیشده
- مشخصات و محدودیتها، برای مثال حداکثر تعداد نشان ورودی یا حداکثر طول ویدیو ورودی
شرح نحوه نسخهبندی مدلها، بهویژه نسخههای پایدار، پیشنمایش، و آزمایشی آنها
فهرستهای نامهای مدل دردسترس برای افزودن به کد شما درطول مقداردهی اولیه
فهرستهای زبانهای پشتیبانیشده برای مدلها
در پایین این صفحه، میتوانید اطلاعات دقیق درباره مدلهای نسل قبلی را مشاهده کنید.
مقایسه مدلها
هر مدل قابلیتهای متفاوتی برای پشتیبانی از موارد استفاده مختلف دارد. توجه داشته باشید که هریک از جدولهای این بخش هر مدل را هنگام استفاده با Firebase AI Logic توصیف میکند. هر مدل ممکن است قابلیتهای اضافی داشته باشد که هنگام استفاده از کیتهای توسعه نرمافزار ما دردسترس نیستند.
اگر نمیتوانید اطلاعاتی را که بهدنبال آن هستید در زیربخشهای زیر پیدا کنید، میتوانید اطلاعات بیشتری را در اسناد ارائهدهنده API انتخابیتان پیدا کنید: Gemini Developer API یا Agent Platform Gemini API (formerly Vertex AI).
ورودی و خروجی پشتیبانیشده
جدول زیر انواع ورودی و خروجی پشتیبانیشده را هنگام استفاده از هر مدل با Firebase AI Logic فهرست میکند.
برای آشنایی با انواع فایلهای پشتیبانیشده، به فایلهای ورودی پشتیبانیشده و الزامات مراجعه کنید.
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| انواع ورودی | ||||||
| نوشتار | ||||||
| کد | ||||||
| اسناد (PDF یا نوشتار ساده) |
||||||
| تصاویر | ||||||
| ویدیو | ||||||
| صوتی | ||||||
| انواع برونداد | ||||||
| نوشتار | ||||||
| نوشتار (جاریسازی) | ||||||
| کد | ||||||
| برونداد ساختاریافته (مثل JSON) |
||||||
| تصاویر | ||||||
| ویدیو | ||||||
| صوتی | ||||||
قابلیتها و ویژگیهای پشتیبانیشده
جدول زیر قابلیتها و ویژگیهای پشتیبانیشده را هنگام استفاده از هر مدل با Firebase AI Logic فهرست میکند.
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| درحال فکر کردن | ||||||
| تولید نوشتار از ورودیهای فقط نوشتاری یا چندحالته | درهمتنیده یا بهعنوان بخشی از تصویر | درهمتنیده یا بهعنوان بخشی از تصویر | درهمتنیده یا بهعنوان بخشی از تصویر | ترانویسی | ||
| تولید تصاویر | ||||||
| ویرایش کردن تصاویر | ||||||
| تولید کردن صدا | گفتار | جاریسازی صدا | ||||
|
تولید
برونداد ساختاریافته
(مانند JSON) |
||||||
|
تجزیهوتحلیل اسناد
(PDF یا نوشتار ساده) (برونداد نوشتاری | برونداد تصویری) |
||||||
|
تحلیل تصاویر (برونداد نوشتاری | برونداد تصویری) |
||||||
|
تجزیهوتحلیل ویدیو (برونداد نوشتاری | برونداد تصویری) |
ویدیو جاریسازیشده | |||||
| تحلیل صدا | جاریسازی صدا | |||||
| گپ چندنوبتی | ||||||
| جاریسازی چندحالته دوطرفه | ||||||
| ابزارهای پشتیبانیشده | ||||||
| فراخوانی تابع | ||||||
| اجرای کد | ||||||
| بافت نشانی وب | ||||||
|
آرامش با
|
||||||
|
آرامش با
|
||||||
مشخصات و محدودیتها
جدول زیر مشخصات و محدودیتهای استفاده از هر مدل با Firebase AI Logic را فهرست میکند.
| دارایی |
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|---|---|---|---|---|---|---|
| محدودیت دادهواحد ورودی * | ۱٬۰۴۸٬۵۷۶ دادهواحد | ۶۵٬۵۳۶ دادهواحد | ۱۳۱٬۰۷۲ دادهواحد | ۶۵٬۵۳۶ دادهواحد | ۸٬۱۹۲ دادهواحد | دیدن اسناد |
| محدودیت دادهواحد برونداد * | ۶۵٬۵۳۶ دادهواحد | ۳۲٬۷۶۸ دادهواحد | ۳۲٬۷۶۸ دادهواحد | ۴٬۰۹۶ دادهواحد | ۱۶۳۸۴ دادهواحد | |
| فایلهای PDF (بهازای هر درخواست) | ||||||
| حداکثر تعداد فایلهای PDF ورودی ** |
۹۰۰ فایل | ۱۴ فایل | ۱۴ فایل | ۱۴ فایل | --- | دیدن اسناد |
| حداکثر تعداد صفحات برای هر فایل PDF ورودی ** |
۹۰۰ صفحه | ۱۴ صفحه | ۱۴ صفحه | ۱۴ صفحه | --- | |
| حداکثر اندازه برای هر فایل PDF ورودی |
۵۰ مگابایت | ۵۰ مگابایت | ۵۰ مگابایت | ۵۰ مگابایت | --- | |
| تصاویر (بهازای هر درخواست) | ||||||
| حداکثر تعداد تصویر ورودی |
۱٬۰۰۰ تصویر | ۱۴ تصویر | ۱۴ تصویر | ۱۴ تصویر | --- | دیدن اسناد |
| حداکثر اندازه برای هر تصویر ورودی کدبندیشده با base64 |
۷ مگابایت | ۷ مگابایت | ۷ مگابایت | ۷ مگابایت | --- | |
| حداکثر تعداد تصاویر برونداد |
--- | تا حد مجاز دادهواحد برونداد | تا حد مجاز دادهواحد برونداد | تا حد مجاز دادهواحد برونداد | --- | |
| ویدیو (بهازای هر درخواست) | ||||||
| حداکثر تعداد فایل ویدیو ورودی |
۱۰ فایل | --- | تا حد مجاز کد ورودی | تا حد مجاز کد ورودی | --- | دیدن اسناد |
| حداکثر طول همه ویدیوهای ورودی (فقط قابها) |
تقریباً ۶۰ دقیقه | --- | تقریباً ۲۵ دقیقه | تقریباً ۱۲ دقیقه | --- | |
| حداکثر طول همه ویدیوهای ورودی (قاب+صدا) |
تقریباً ۴۵ دقیقه | --- | --- | --- | --- | |
| صدا (بهازای هر درخواست) | ||||||
| حداکثر تعداد فایلهای صوتی ورودی |
۱ فایل | --- | --- | --- | --- | دیدن اسناد |
| حداکثر طول همه صدای ورودی |
تقریباً ۸٫۴ ساعت | --- | --- | --- | --- | |
*
برای همه مدلهای Gemini، یک دادهواحد (توکن) معادل حدود ۴ نویسه است،
بنابراین ۱۰۰ دادهواحد (توکن) حدود ۶۰ تا ۸۰ کلمه انگلیسی است. برای Gemini مدل، میتوانید
تعداد کل دادهواحدها را در درخواستهایتان بااستفاده از
countTokens تعیین کنید.
** فایلهای PDF بهعنوان تصویر درنظر گرفته میشوند، بنابراین یک صفحه از فایل PDF بهعنوان یک تصویر درنظر گرفته میشود. تعداد صفحههای مجاز در یک درخواست به تعداد تصاویری که مدل میتواند پشتیبانی کند محدود است.
یافتن اطلاعات دقیق بیشتر
سهمیهها و قیمتگذاری برای هر مدل متفاوت است. قیمتگذاری به ورودی و خروجی نیز بستگی دارد.
در فایلهای ورودی پشتیبانیشده و الزامات با انواع فایل ورودی پشتیبانیشده، نحوه تعیین نوع MIME، و نحوه اطمینان از اینکه فایلهای ورودی و درخواستهای چندوجهی شما الزامات را برآورده میکنند و از روشهای مطلوب پیروی میکنند آشنا شوید.
الگوهای نامگذاری و نسخهبندی مدل
مدلها در نسخههای پایدار، پیشنمایش، و آزمایشی ارائه میشوند. برای
راحتی، نامهای مستعار -latest
حتماً روالهای مطلوب ما برای استفاده از نسخههای مدل را مرور کنید.
برای یافتن نامهای مدل خاص برای استفاده در کد خود، به بخش «نامهای مدل دردسترس» در ادامه این صفحه مراجعه کنید.
| نوع نسخه / مرحله انتشار |
شرح | الگوی نام مدل | |
|---|---|---|---|
| پایدار |
نسخههای پایدار برای استفاده در تولید از تاریخ انتشار دردسترس و پشتیبانی میشوند.
|
نامهای مدل نسخههای پایدار هیچ پسوندی ندارند
مثال: |
|
| پیشنمایش |
نسخههای پیشنمایش قابلیتهای جدیدی دارند و
پایدار درنظر گرفته نمیشوند.
|
نامهای مدل نسخههای پیشنمایش با
مثال: |
|
| آزمایشی |
نسخههای آزمایشی قابلیتهای جدیدی دارند
و پایدار درنظر گرفته نمیشوند.
|
نامهای مدل نسخههای آزمایشی با
مثال: |
|
| خاموش کردن (بازنشسته) |
نسخههای خاموش (بازنشسته) از تاریخ خاموش شدن (بازنشستگی) خود گذشتهاند و بهطور دائمی غیرفعال شدهاند.
|
--- |
|
روالهای مطلوب برای استفاده از نسخههای مدل
در برنامههای تولید، از نام مدل صریح برای جدیدترین نسخه پایدار استفاده کنید.
برای Agent Platform Gemini API (formerly Vertex AI)، اگر تصمیم بگیرید در برنامه تولیدتان از مدل دردسترس بودن کوتاهمدت استفاده کنید، بسیار مهم است که از Firebase Remote Config یا الگوهای پیامواره سرور برای کنترل نام مدل استفادهشده برای ویژگی هوش مصنوعیتان استفاده کنید.
فقط درطول نمونهسازی از نسخههای پیشنمایش و آزمایشی استفاده کنید. توصیه میکنیم هنگام شروع توسعه و آزمایش برای مورد استفاده تولید، از نسخه پایدار استفاده کنید.
توصیه میکنیم از نامهای مستعار
استفاده نکنید (حتی درطول توسعه). این نام مستعار به جدیدترین نسخه پخش برای یک مدل خاص اشاره میکند (که میتواند نسخه پایدار، پیشنمایش، یا آزمایشی باشد). این نام مستعار با هر نسخه جدید از یک مدل خاص جایگزین میشود و فقط برای تغییرات اساسی، ایمیل اعلان ۲ هفته قبل ارسال میشود. این بیثباتی در اینکه واقعاً از کدام مدل استفاده میکنید میتواند منجر به تغییرات غیرمنتظره در عملکرد ویژگی هوش مصنوعی شما شود.-latest
نامهای مدل دردسترس
نامهای مدل مقادیر صریحی هستند که درطول مقداردهی اولیه مدل در کد خود میگنجانید.
مدلهای استفاده عمومی (مانند
gemini-3.8-flash)مدلهای تولید تصویر (مثل
gemini-3.1-flash-image، معروف به مدلهای «نانو بنانا»)مدلهای تولیدکننده صدا:
- مدلهای نوشتار به گفتار (TTS)
(مثل
gemini-3.1-flash-tts-preview) - Live API مدل
(مثل
gemini-live-2.5-flash-native-audio)
- مدلهای نوشتار به گفتار (TTS)
(مثل
برای نمونههای مقداردهی اولیه برای پلاتفرم خود، به راهنمای شروع به کار مراجعه کنید.
برای جزئیات مراحل انتشار (بهویژه برای موارد استفاده، صورتحساب، و خاموش کردن)، به الگوهای نامگذاری و نسخهبندی مدل مراجعه کنید.
فهرست کردن برنامهریزیشده همه مدلهای دردسترس
بااستفاده از REST API میتوانید نام همه مدلهای دردسترس را فهرست کنید:
Gemini Developer API: تماس با نقطه پایان
models.listAgent Platform Gemini API (formerly Vertex AI): تماس با نقطه پایان
publishers.models.list
توجه داشته باشید که این فهرست برگشتی شامل همه مدلهای پشتیبانیشده توسط ارائهدهندگان API خواهد بود، اما Firebase AI Logic فقط از مدلهای Gemini که در این صفحه توضیح داده شده است پشتیبانی میکند.
مدلهای استفاده عمومی
Gemini 3.x Pro نام مدل
صرفنظر از ارائهدهنده Gemini API شما، طرح قیمتگذاری Blaze با پرداخت براساس مصرف را الزامی میکند.
| نام مدل | شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3.1-pro-preview |
جدیدترین نسخه پیشنمایش Gemini 3.x Pro | پیشنمایش | 2026-02-19 | اعلام خواهد شد |
Gemini 3.x Flash نام مدل
اگر از Gemini Developer API استفاده میکنید، به طرح قیمتگذاری Blaze با پرداخت به اندازه استفاده نیاز ندارد.
| نام مدل | شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3.8-flash |
جدیدترین نسخه پایدار Gemini 3.x Flash این یک مدل دردسترس بودن کوتاهمدت است (به الگوهای نامگذاری و نسخهبندی مدل مراجعه کنید). |
رده | 2026-09-02 | اعلام خواهد شد |
gemini-3.7-flash |
نسخه پایدار Gemini 3.x Flash این یک مدل دردسترس بودن کوتاهمدت است (به الگوهای نامگذاری و نسخهبندی مدل مراجعه کنید). |
رده | 2026-08-13 | اعلام خواهد شد |
gemini-3.6-flash |
نسخه پایدار Gemini 3.x Flash این یک مدل دردسترس بودن کوتاهمدت است (به الگوهای نامگذاری و نسخهبندی مدل مراجعه کنید). |
رده | 2026-07-21 | اعلام خواهد شد |
gemini-3.5-flash |
نسخه پایدار Gemini 3.x Flash | رده | 2026-05-19 | زودتر از ۲۰۲۷-۰۵-۱۹ نباشد |
gemini-3-flash-preview |
نسخه پیشنمایش Gemini 3.x Flash | پیشنمایش | 2025-12-17 | اعلام خواهد شد |
Gemini 3.x Flash‑Lite نام مدل
اگر از Gemini Developer API استفاده میکنید، به طرح قیمتگذاری Blaze با پرداخت به اندازه استفاده نیاز ندارد.
| نام مدل | شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3.5-flash-lite |
جدیدترین نسخه پایدار Gemini 3.x Flash‑Lite | رده | 2026-07-21 | زودتر از ۲۰۲۷-۰۷-۲۱ نباشد |
gemini-3.1-flash-lite |
نسخه پایدار Gemini 3.x Flash‑Lite | رده | 2026-05-07 | زودتر از ۲۰۲۷-۰۵-۰۷ نباشد |
مدلهای تولید تصویر
نامهای مدل Gemini 3.x Pro Image (معروف به «Nano Banana Pro»)
صرفنظر از ارائهدهنده Gemini API شما، طرح قیمتگذاری Blaze با پرداخت براساس مصرف را الزامی میکند.
| نام مدل | شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3-pro-image |
نسخه پایدار Gemini 3.x Pro Image (با نام مستعار «Nano Banana Pro») |
رده | 2026-05-28 | زودتر از ۲۰۲۷-۰۵-۲۸ نباشد |
gemini-3-pro-image-preview |
نسخه پیشنمایش Gemini 3.x Pro Image (با نام مستعار «Nano Banana Pro») |
پیشنمایش | 2025-11-20 | از ۲۵ ژوئن ۲۰۲۶ |
نام مدل Gemini 3.x Flash Image (معروف به «Nano Banana 2»)
صرفنظر از ارائهدهنده Gemini API شما، طرح قیمتگذاری Blaze با پرداخت براساس مصرف را الزامی میکند.
| نام مدل | شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3.1-flash-image |
نسخه پایدار Gemini 3.x Flash Image (معروف به «Nano Banana 2») |
رده | 2026-05-28 | زودتر از ۲۰۲۷-۰۵-۲۸ نباشد |
gemini-3.1-flash-image-preview |
نسخه پیشنمایش Gemini 3.x Flash Image (با نام مستعار «Nano Banana 2») |
پیشنمایش | 2026-02-26 | از ۲۵ ژوئن ۲۰۲۶ |
نام مدل Gemini 3.x Flash‑Lite Image (معروف به «Nano Banana 2 Lite»)
صرفنظر از ارائهدهنده Gemini API شما، طرح قیمتگذاری Blaze با پرداخت براساس مصرف را الزامی میکند.
| نام مدل | شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3.1-flash-lite-image |
نسخه پایدار Gemini 3.x Flash‑Lite Image (با نام مستعار «Nano Banana 2 Lite») این یک مدل با دردسترس بودن کوتاهمدت است (به الگوهای نامگذاری و نسخهبندی مدل مراجعه کنید). |
رده | 2026-06-30 | اعلام خواهد شد |
مدلهای صوتی - نوشتار به گفتار (TTS)
Gemini 3.x Flash TTS نام مدل
اگر از Gemini Developer API استفاده میکنید، به طرح قیمتگذاری Blaze با پرداخت به اندازه استفاده نیاز ندارد.
| نام مدل | شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3.1-flash-tts-preview |
نسخه پیشنمایش برای Gemini 3.x Flash TTS | پیشنمایش | 2026-06-17 | اعلام خواهد شد |
صدا - Live API مدل
Gemini 3.x Flash Live نام مدل
| Gemini Developer API نام مدل |
شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-3.1-flash-live-preview ۱ |
نسخه پیشنمایش برای Live API در Gemini Developer API | پیشنمایش | 2026-03-26 | اعلام خواهد شد |
| Agent Platform Gemini API (formerly Vertex AI) نام مدل |
شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
| Agent Platform Gemini API (formerly Vertex AI) از هیچیک از مدلهای Gemini Live 3.x پشتیبانی نمیکند. | ||||
۱ فقط توسط Gemini Developer API پشتیبانی میشود.
همچنین، با اینکه این مدل پیشنمایش است، در
«سطح رایگان» Gemini Developer API دردسترس است.
Gemini 2.5 Flash Live نام مدل
اگر از Gemini Developer API استفاده میکنید، به طرح قیمتگذاری Blaze با پرداخت براساس مصرف نیاز ندارد (معمولاً مدلهای پیشنمایش به طرح پولی نیاز دارند).
اگرچه مدلهای زیر بسته به ارائهدهنده Gemini API نامهای مدل متفاوتی دارند، ویژگیهای مدل یکسان است.
| Gemini Developer API نام مدل |
شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-2.5-flash-native-audio-preview-12-2025 ۱ |
نسخه پیشنمایش برای Live API در Gemini Developer API | پیشنمایش | 2025-12-12 | اعلام خواهد شد |
gemini-2.5-flash-native-audio-preview-09-2025 ۱ |
نسخه پیشنمایش اولیه برای Live API در Gemini Developer API | پیشنمایش | 2025-09-18 | اعلام خواهد شد |
| Agent Platform Gemini API (formerly Vertex AI) نام مدل |
شرح | مرحله انتشار | تاریخ انتشار | تاریخ توقف |
|---|---|---|---|---|
gemini-live-2.5-flash-native-audio ۲ |
نسخه پایدار برای Live API در Agent Platform Gemini API (formerly Vertex AI) | رده | 2025-12-12 | زودتر از ۲۰۲۶-۱۲-۱۲ نباشد |
gemini-live-2.5-flash-preview-native-audio-09-2025 ۲ |
نسخه پیشنمایش برای Live API در Agent Platform Gemini API (formerly Vertex AI) | پیشنمایش | 2025-09-18 | اعلام خواهد شد |
۱ فقط توسط Gemini Developer API پشتیبانی میشود.
همچنین، با اینکه اینها مدلهای پیشنمایش هستند، در
«سطح رایگان» Gemini Developer API دردسترس هستند.
۲ فقط توسط Agent Platform Gemini API (formerly Vertex AI) پشتیبانی میشود.
همچنین، این مدلها در global
مکان دردسترس نیستند.
زبانهای پشتیبانیشده
مدلهای استفاده عمومی
همه مدلهای Gemini با کاربرد عمومی (مثل Gemini 3.8 Flash، Gemini 3.5 Flash-Lite، Gemini 3.1 Pro، و مدلهای 3.x قبلی) میتوانند به بیشاز ۱۰۰ زبان متوجه شوند و پاسخ دهند:
آفریقایی (af)، آلبانیایی (sq)، امهری (am)، عربی (ar)،
ارمنی (hy)، آسامی (as)، آذربایجانی (az)، باسکی (eu)،
بلاروسی (be)، بنگالی (bn)، بوسنیایی (bs)، بلغاری (bg)،
کاتالان (ca)، سبوانو (ceb)، چینی ساده و سنتی (zh)،
کورسیکایی (co)، کرواتی (hr)، چکی (cs)، دانمارکی (da)، دیوهی (dv)،
هلندی (nl)، انگلیسی (en)، اسپرانتو (eo)، استونیایی (et)،
فیلیپینی (تاگالوگ) (fil)، فنلاندی (fi)، فرانسوی (fr)، فریزی (fy)،
گالیسیایی (gl)، گرجی (ka)، آلمانی (de)، یونانی (el)، گجراتی (gu)،
کریول هائیتی (ht)، هوسه (ha)، هاوایی (haw)، عبری (iw)،
هندی (hi)، همونگ (hmn)، مجاری (hu)، ایسلندی (is)، ایگبو (ig)،
اندونزیایی (id)، ایرلندی (ga)، ایتالیایی (it)، ژاپنی (ja)،
جاوه (jv)، کانادایی (kn)، قزاقی (kk)، خمر (km)، کرهای (ko)،
کریو (kri)، کردی (ku)، قرقیزی (ky)، لائو (lo)، لاتین (la)،
لتونیایی (lv)، لیتوانیایی (lt)، لوکزامبورگی (lb)، مقدونی (mk)،
مالاگاسی (mg)، مالایی (ms)، مالایالام (ml)، مالتی (mt)، مائوری (mi)،
مراثی (mr)، میتایلون (مانیپوری) (mni-Mtei)، مغولی (mn)،
میانماری (برمهای) (my)، نپالی (ne)، نروژی (no)،
نیانجا (چیچوا) (ny)، اودیا (اوریه) (or)، پشتو (ps)، فارسی (fa)،
لهستانی (pl)، پرتغالی (pt)، پنجابی (pa)، رومانیایی (ro)،
روسی (ru)، ساموآیی (sm)، گیلیک اسکاتلندی (gd)، صربی (sr)،
سسوتو (st)، شونا (sn)، سندی (sd)، سینهالی (si)،
اسلواکی (sk)، اسلوونیایی (sl)، سومالیایی (so)، اسپانیایی (es)،
سوندانی (su)، سواحیلی (sw)، سوئدی (sv)، تاجیکی (tg)، تامیل (ta)،
تلوگو (te)، تایلندی (th)، ترکی (tr)، اوکراینی (uk)، اردو (ur)،
اویغوری (ug)، ازبکی (uz)، ویتنامی (vi)، ولزی (cy)، خوسایی (xh)،
یدی (yi)، یوروبایی (yo)، و زولو (zu).
مدلهای تولید تصویر
مدلهای Gemini 3.x Image میتوانند پیاموارههای نوشتاری را به زبانهای مختلف بپذیرند. بااینحال، این مدل برای بهترین عملکرد (هم برای پیاموارههای نوشتاری و هم برای پرداز زدن نوشتار در تصاویر تولیدشده) در زبانها و منطقههای زیر بهینهسازی شده است:
آلمانی (de-DE)، اسپانیایی (es-MX)، اندونزیایی (id-ID)، انگلیسی (EN)،
ایتالیایی (it-IT)، پرتغالی (pt-BR)، چینی سادهشده (zh-CN)، روسی (ru-RU)،
عربی (ar-EG)، فرانسوی (fr-FR)، کرهای (ko-KR)،
اوکراینی (uk-UA)، ویتنامی (vi-VN)، و هندی (hi-IN).ja-JP
برای کسب اطلاعات بیشتر درباره روالهای مطلوب پیامواره و تولید نوشتار در تصاویر، به زبانهای پشتیبانیشده برای تولید تصویر مراجعه کنید.
مدلهای تولیدکننده صدا (TTS و Live API)
مدلهای تولید صدا از مجموعههای زبان تخصصی بهینهسازیشده برای ترکیب گفتار و (برای Live API) گفتگوی دوطرفه همزمان پشتیبانی میکنند:
مدلهای نوشتار به گفتار (TTS): مدلهای Gemini 3.x TTS میتوانند بهطور خودکار گفتار را در نزدیک به ۸۰ زبان و گویش تشخیص دهند و تولید کنند.
برای مشاهده فهرست کامل زبانهای پشتیبانیشده و کدهای مکان BCP-47 موجود، به زبانهای پشتیبانیشده برای تولید گفتار مراجعه کنید.
مدلهای Live API: مدلهای Live API از تعاملات صوتی دوطرفه و همزمان در تقریباً ۸۰ زبان و گویش پشتیبانی میکنند.
برای مشاهده فهرست کامل زبانهای پشتیبانیشده و آشنایی با نحوه تأثیرگذاری بر زبان پاسخ گفتاری، به زبانهای پشتیبانیشده برای Live API مراجعه کنید.
اطلاعات درباره مدلهای قبلی
موارد زیر فعال هستند، اما مدلهای نسل قبلی هستند. توصیه میکنیم درصورت امکان از یکی از جدیدترین مدلها استفاده کنید.
اگر نمیتوانید اطلاعاتی را که بهدنبال آن هستید در زیربخشهای زیر پیدا کنید، میتوانید اطلاعات بیشتری را در اسناد ارائهدهنده API انتخابیتان پیدا کنید: Gemini Developer API یا Agent Platform Gemini API (formerly Vertex AI)
مدلهای قدیمیتر Gemini
gemini-2.5-progemini-2.5-flashgemini-2.5-flash-lite-
gemini-2.5-flash-image(با نام مستعار «نانو موز») -
gemini-2.0-flash-001(و نام مستعار بهروزرسانی خودکار آنgemini-2.0-flash) -
gemini-2.0-flash-lite-001(و نام مستعار بهروزرسانی خودکار آنgemini-2.0-flash-lite)
برای کسب اطلاعات درباره مدلهای قدیمیتر Gemini Live API، به مستندات ارائهدهنده Gemini API مراجعه کنید:
مدلهای قدیمیتر Imagen
imagen-4.0-ultra-generate-001imagen-4.0-generate-001imagen-4.0-fast-generate-001imagen-3.0-capability-001imagen-3.0-generate-002imagen-3.0-generate-001imagen-3.0-fast-generate-001
مشاهده جزئیات درباره مدلهای قبلی
مراحل بعدی
امکانات Gemini API را امتحان کنید
- مکالمههای چند نوبتی (گپ) بسازید.
- تولید نوشتار از پیاموارههای فقط نوشتاری.
- با پیامواره دادن با انواع مختلف فایل، مثل تصاویر، PDF، ویدیو، و صوت، نوشتار تولید کنید.
- تولید برونداد ساختاریافته (مثل JSON) از پیاموارههای نوشتاری و چندحالته.
- تولید و ویرایش تصاویر از پیاموارههای نوشتاری و چندحالته.
- تولید گفتار (هم تکگوینده و هم چندگوینده) بااستفاده از مدلهای Gemini نوشتار به گفتار (TTS).
- جاریسازی ورودی و خروجی (ازجمله صدا) بااستفاده از Gemini Live API.
-
از ابزارها (مثل فراخوانی تابع
و «پایهگذاری» با
Google Search یاGoogle Maps ) برای متصل کردن مدل Gemini به بخشهای دیگر برنامه و سیستمها و اطلاعات خارجی استفاده کنید.