بالنسبة إلى تطبيقات الأجهزة الجوّالة وتطبيقات الويب، تتيح لك Firebase AI Logic حِزم تطوير البرامج (SDK) التفاعل مع Gemini النماذج المتوافقة مباشرةً من تطبيقك.
تُعدّ نماذج Gemini متعددة الوسائط لأنّها قادرة على معالجة وحتى إنشاء وسائط متعددة، بما في ذلك النصوص والرموز البرمجية وملفات PDF والصور والفيديوهات والمحتوى الصوتي.
يمكنك أيضًا مراجعة الأسئلة الشائعة حول جميع الطُرز التي تتوافق مع Firebase AI Logic وتلك التي لا تتوافق معها.
النماذج المميزة
Gemini 3.8 Flash
gemini-3.8-flash
أداء فائق يضاهي النماذج الأكبر حجمًا بجزء بسيط من التكلفة.
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
نموذج قوي ومناسب للأحجام الكبيرة من البيانات والحالات التي تتطلّب تكلفة منخفضة، ويقدّم الأداء والجودة نفسها التي توفّرها سلسلة Gemini 3.
Gemini 3.1 Flash Image (Nano Banana 2)
gemini-3.1-flash-image
نموذج قوي وعالي الكفاءة لإنشاء الصور وتعديلها،
تم تحسينه ليكون سريعًا ومناسبًا لحالات الاستخدام التي تتطلّب عددًا كبيرًا من الصور.
النماذج ذات الاستخدام العام
الانتقال إلى الجداول التي تتضمّن تفاصيل النموذج
Gemini 3.1 Pro
gemini-3.1-pro-preview
ذكاء متقدّم ومهارات معقّدة في حل المشاكل وقدرات قوية على
كتابة الرموز البرمجية المتعلقة بالوكلاء والأسلوب
Gemini 3.8 Flash
gemini-3.8-flash
أداء فائق يضاهي النماذج الأكبر حجمًا بجزء بسيط من التكلفة.
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
نموذج قوي ومناسب للأحجام الكبيرة من البيانات والحالات التي تتطلّب تكلفة منخفضة، ويقدّم الأداء والجودة نفسها التي توفّرها سلسلة Gemini 3.
النماذج الثابتة القديمة ذات الاستخدام العام
Gemini 3.7 Flash (
gemini-3.7-flash): الجيل السابق من نموذج Gemini 3.x Flash الذي يقدّم أداءً فائقًا ينافس النماذج الأكبر حجمًا بتكلفة أقل بكثير. (لا يلزم إعداد الفوترة)Gemini 3.6 Flash (
gemini-3.6-flash): الجيل السابق من نموذج Gemini 3.x Flash الذي يقدّم أداءً فائقًا ينافس النماذج الأكبر حجمًا بتكلفة أقل بكثير. (لا يلزم إعداد الفوترة)Gemini 3.5 Flash (
gemini-3.5-flash): الجيل السابق من نموذج Gemini 3.x Flash الذي يقدّم أداءً فائقًا ينافس النماذج الأكبر حجمًا بتكلفة أقل بكثير. (لا يلزم إعداد الفوترة)Gemini 3.1 Flash‑Lite (
gemini-3.1-flash-lite): هو نموذج Gemini 3.x Flash‑Lite السابق الذي يتيح تنفيذ مهام تتطلّب حجمًا كبيرًا من البيانات وتراعي التكلفة. (لا يلزم إعداد الفوترة)
نماذج إنشاء الصور
الانتقال إلى الجداول التي تتضمّن تفاصيل النموذج
Gemini 3 Pro Image (Nano Banana Pro)
gemini-3-pro-image
نموذج متطوّر لإنشاء الصور وتعديلها، ما يتيح إنشاء صور أصلية عالية الصلة بالسياق.
Gemini 3.1 Flash Image (Nano Banana 2)
gemini-3.1-flash-image
نموذج قوي وعالي الكفاءة لإنشاء الصور وتعديلها،
تم تحسينه للسرعة وحالات الاستخدام ذات الحجم الكبير.
Gemini 3.1 Flash-Lite Image (Nano Banana 2 Lite)
gemini-3.1-flash-lite-image
نموذج لإنشاء الصور وتعديلها بوقت استجابة فائق السرعة وفعّال من حيث التكلفة، مصمّم لحالات الاستخدام التفاعلية ذات الحجم الكبير.
نماذج إنشاء الصوت
نماذج تحويل النص إلى كلام (TTS)
يمكنك إنشاء كلام من إدخال نصي باستخدام نماذج Gemini لتحويل النص إلى كلام.
الانتقال إلى الجداول التي تتضمّن تفاصيل النموذج
Gemini 3.x Flash TTS
gemini-3.1-flash-tts-preview
إنشاء محتوى صوتي قوي وبزمن استجابة منخفض من النص المُدخَل
طرُز Live API
يمكنك إنشاء محتوى صوتي ثنائي الاتجاه باستخدام النماذج التي تتوافق مع Gemini Live API.
الانتقال إلى الجداول التي تتضمّن تفاصيل النموذج
Gemini 3.x Flash مع الصوت الأصلي لواجهة برمجة التطبيقات Gemini Live
Gemini Developer API:gemini-3.1-flash-live-preview
Agent Platform Gemini API:
غير متوافق
تتيح هذه الميزة التفاعل مع نموذج Gemini ثنائي الاتجاه من خلال الصوت والفيديو في الوقت الفعلي وبزمن استجابة منخفض.
Gemini 2.5 Flash مع ميزة الصوت الأصلية في Gemini Live API
Gemini Developer API:gemini-2.5-flash-native-audio-preview-12-2025
Agent Platform Gemini API:gemini-live-2.5-flash-native-audio
تتيح هذه الميزة التفاعل مع نموذج Gemini ثنائي الاتجاه من خلال الصوت والفيديو في الوقت الفعلي وبزمن استجابة منخفض.
تقدّم بقية هذه الصفحة معلومات تفصيلية حول النماذج المتوافقة مع Firebase AI Logic.
-
- الإدخال والإخراج المتوافقان
- مقارنة عالية المستوى بين الإمكانات المتاحة
- المواصفات والقيود، مثل الحد الأقصى لعدد الرموز المميزة التي يمكن إدخالها أو الحد الأقصى لطول الفيديو الذي يمكن إدخاله
وصف كيفية تحديد إصدارات النماذج، وتحديدًا إصداراتها الثابتة والتجريبية والحصرية
قوائم أسماء الطُرز المتاحة لتضمينها في الرمز البرمجي أثناء عملية الإعداد
قوائم اللغات المتاحة للنماذج
في أسفل هذه الصفحة، يمكنك الاطّلاع على معلومات تفصيلية حول طُرز الجيل السابق.
مقارنة النماذج
يتمتّع كل نموذج بقدرات مختلفة لتلبية حالات استخدام متنوّعة. يُرجى العِلم أنّ كل جدول في هذا القسم يصف كل نموذج عند استخدامه مع Firebase AI Logic. قد يتضمّن كل نموذج إمكانات إضافية غير متاحة عند استخدام حِزم تطوير البرامج (SDK).
إذا لم تتمكّن من العثور على المعلومات التي تبحث عنها في الأقسام الفرعية التالية، يمكنك العثور على المزيد من المعلومات في مستندات مزوّد واجهة برمجة التطبيقات الذي اخترته: Gemini Developer API أو Agent Platform Gemini API (formerly Vertex AI).
الإدخال والإخراج المتوافقان
يسرد الجدول التالي أنواع الإدخال والإخراج المتوافقة عند استخدام كل نموذج مع Firebase AI Logic.
للتعرّف على أنواع الملفات المتوافقة، يُرجى الاطّلاع على ملفات الإدخال المتوافقة والمتطلبات.
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| أنواع الإدخال | ||||||
| نص | ||||||
| الرمز | ||||||
| المستندات (ملفات PDF أو نص عادي) |
||||||
| الصور | ||||||
| فيديو | ||||||
| الصوت | ||||||
| أنواع النتائج | ||||||
| نص | ||||||
| النص (البث) | ||||||
| الرمز | ||||||
| الناتج المنظَّم (مثل JSON) |
||||||
| الصور | ||||||
| فيديو | ||||||
| الصوت | ||||||
الميزات والإمكانات المتوفّرة
يسرد الجدول التالي الإمكانات والميزات المتوافقة عند استخدام كل نموذج مع Firebase AI Logic.
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| التفكير | ||||||
| نصّ من إنشاء الذكاء الاصطناعي من مدخلات نصية فقط أو متعددة الوسائط | متداخلة أو كجزء من الصورة | متداخلة أو كجزء من الصورة | متداخلة أو كجزء من الصورة | تحويل الصوت إلى نص | ||
| إنشاء الصور | ||||||
| تعديل الصور | ||||||
| إنشاء محتوى صوتي | speech | المحتوى الصوتي الذي يتم بثّه | ||||
|
إنشاء
ناتج منظَّم
(مثل JSON) |
||||||
|
تحليل المستندات
(ملفات PDF أو نص عادي) (text-output | image-output) |
||||||
|
تحليل الصور (text-output | image-output) |
||||||
|
Analyze video (text-output | image-output) |
فيديو مباشر | |||||
| تحليل الصوت | المحتوى الصوتي الذي يتم بثّه | |||||
| محادثة متعدّدة الجولات | ||||||
| البث المتزامن الثنائي الاتجاه | ||||||
| الأدوات المتوافقة | ||||||
| استدعاء الدوال | ||||||
| تنفيذ الرموز البرمجية | ||||||
| سياق عنوان URL | ||||||
|
تحديد المصدر باستخدام
|
||||||
|
تحديد المصدر باستخدام
|
||||||
المواصفات والقيود
يسرد الجدول التالي المواصفات والقيود عند استخدام كل نموذج مع Firebase AI Logic.
| الموقع |
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|---|---|---|---|---|---|---|
| الحدّ الأقصى لعدد الرموز المميزة في الإدخال * | 1,048,576 رمزًا مميّزًا | 65,536 رمزًا مميّزًا | 131,072 رمزًا مميّزًا | 65,536 رمزًا مميّزًا | 8,192 رمزًا مميّزًا | عرض المستندات |
| الحد الأقصى لعدد الرموز المميزة للناتج * | 65,536 رمزًا مميّزًا | 32,768 رمزًا مميّزًا | 32,768 رمزًا مميّزًا | 4,096 رمزًا مميّزًا | 16,384 رمزًا مميّزًا | |
| ملفات PDF (لكل طلب) | ||||||
| الحد الأقصى لعدد ملفات PDF المدخلة ** |
900 ملف | 14 ملفًا | 14 ملفًا | 14 ملفًا | --- | عرض المستندات |
| الحدّ الأقصى لعدد الصفحات في كل ملف PDF مصدر ** |
900 صفحة | 14 صفحة | 14 صفحة | 14 صفحة | --- | |
| الحد الأقصى لحجم ملف PDF واحد |
50 ميغابايت | 50 ميغابايت | 50 ميغابايت | 50 ميغابايت | --- | |
| الصور (لكل طلب) | ||||||
| الحدّ الأقصى لعدد صور الإدخال |
1,000 صورة | 14 صورة | 14 صورة | 14 صورة | --- | عرض المستندات |
| الحدّ الأقصى للحجم لكل صورة مشفّرة بتنسيق base64 |
7 ميغابايت | 7 ميغابايت | 7 ميغابايت | 7 ميغابايت | --- | |
| الحدّ الأقصى لعدد صور الناتج |
--- | حتى الحد الأقصى لعدد الرموز المميزة للناتج | حتى الحد الأقصى لعدد الرموز المميزة للناتج | حتى الحد الأقصى لعدد الرموز المميزة للناتج | --- | |
| الفيديو (لكل طلب) | ||||||
| الحدّ الأقصى لعدد ملفات الفيديو المُدخَلة |
10 ملفات | --- | الحدّ الأقصى لعدد الرموز المميزة للإدخال | الحدّ الأقصى لعدد الرموز المميزة للإدخال | --- | عرض المستندات |
| الحدّ الأقصى لطول جميع فيديوهات الإدخال (الإطارات فقط) |
60 دقيقة تقريبًا | --- | 25 دقيقة تقريبًا | 12 دقيقة تقريبًا | --- | |
| الحدّ الأقصى لطول جميع فيديوهات الإدخال (اللقطات + الصوت) |
45 دقيقة تقريبًا | --- | --- | --- | --- | |
| الصوت (لكل طلب) | ||||||
| الحد الأقصى لعدد ملفات الصوت المدخلة |
ملف واحد | --- | --- | --- | --- | عرض المستندات |
| الحدّ الأقصى لطول كل الصوت المُدخَل |
8.4 ساعة تقريبًا | --- | --- | --- | --- | |
*
في جميع نماذج Gemini، يعادل الرمز المميز الواحد حوالي 4 أحرف،
وبالتالي فإنّ 100 رمز مميز تعادل حوالي 60 إلى 80 كلمة باللغة الإنجليزية. بالنسبة إلى نماذج Gemini، يمكنك تحديد العدد الإجمالي للرموز المميزة في طلباتك باستخدام countTokens.
** يتم التعامل مع ملفات PDF كصور، لذا يتم التعامل مع صفحة واحدة من ملف PDF كصورة واحدة. يقتصر عدد الصفحات المسموح به في الطلب على عدد الصور التي يمكن للنموذج معالجتها.
العثور على معلومات تفصيلية إضافية
تختلف الحصص والأسعار باختلاف النموذج. تعتمد الأسعار أيضًا على المدخلات والمخرجات.
يمكنك الاطّلاع على أنواع ملفات الإدخال المتوافقة، وكيفية تحديد نوع MIME، وكيفية التأكّد من أنّ ملفات الإدخال والطلبات المتعدّدة الوسائط تستوفي المتطلبات وتتّبع أفضل الممارسات في ملفات الإدخال المتوافقة والمتطلبات.
أنماط تسمية الإصدارات
تتوفّر النماذج بإصدارات ثابتة ومعاينة وتجريبية. لتسهيل الأمر، تتوفّر أسماء مستعارة -latest
احرص على مراجعة أفضل الممارسات لاستخدام إصدارات النماذج.
للعثور على أسماء طُرز معيّنة لاستخدامها في الرمز، راجِع قسم "أسماء الطُرز المتاحة" في وقت لاحق من هذه الصفحة.
| نوع الإصدار / مرحلة الإصدار |
الوصف | نمط اسم الطراز | |
|---|---|---|---|
| مستقر |
تتوفّر إصدارات ثابتة ويمكن استخدامها في عملية الإنتاج اعتبارًا من تاريخ الإصدار.
|
لا تحتوي أسماء طُرز الإصدارات الثابتة على لاحقة
مثال: |
|
| معاينة |
تتضمّن إصدارات المعاينة إمكانات جديدة، ويُصنّف هذا الإصدار على أنّه غير ثابت.
|
تتم إضافة اللاحقة
مثال: |
|
| تجريبي |
تتضمّن إصدارات تجريبية إمكانات جديدة
ويتم تصنيفها على أنّها غير ثابتة.
|
يتم إلحاق أسماء طُرز الإصدارات التجريبية بالرمز
مثال: |
|
| الإيقاف (تم إيقافه نهائيًا) |
تجاوزت إصدارات الإيقاف (الإيقاف النهائي) تاريخ إيقافها (إيقافها النهائي) وتم إيقافها نهائيًا.
|
--- |
|
أفضل الممارسات لاستخدام إصدارات النماذج
في تطبيقات الإصدار العلني، استخدِم اسم النموذج الصريح لأحدث إصدار ثابت.
بالنسبة إلى Agent Platform Gemini API (formerly Vertex AI)، إذا اخترت استخدام نموذج إتاحة لفترة قصيرة في تطبيقك العلني، يصبح من الضروري أكثر استخدام Firebase Remote Config أو نماذج الطلبات على الخادم للتحكّم في اسم النموذج المستخدَم لميزة تستخدم الذكاء الاصطناعي.
استخدِم إصدارات المعاينة والتجريبية أثناء إنشاء النماذج الأولية فقط. ننصحك باستخدام إصدار ثابت عند البدء في تطوير واختبار حالة استخدام في بيئة الإنتاج.
لا ننصح باستخدام الأسماء المستعارة
(حتى أثناء التطوير). يشير هذا الاسم المستعار إلى أحدث إصدار من أحد أشكال النموذج المحدّدة (قد يكون إصدارًا ثابتًا أو إصدارًا تجريبيًا أو إصدارًا مبكرًا). سيتم استبدال هذا الاسم المستعار بكل إصدار جديد من صيغة نموذج معيّن، ولن يتم إرسال إشعار عبر البريد الإلكتروني قبل أسبوعَين إلا في حال حدوث تغيير قد يؤدي إلى عطل. ويمكن أن يؤدي عدم الاستقرار في النموذج الذي تستخدمه فعليًا إلى حدوث تغييرات غير متوقّعة في سلوك ميزة تستخدم الذكاء الاصطناعي.-latest
أسماء الطُرز المتاحة
أسماء النماذج هي القيم الواضحة التي تُدرجها في الرمز البرمجي أثناء عملية تهيئة النموذج.
النماذج ذات الاستخدام العام (مثل
gemini-3.8-flash)نماذج إنشاء الصور (مثل
gemini-3.1-flash-image، المعروفة أيضًا باسم نماذج "Nano Banana")نماذج إنشاء الصوت:
- نماذج تحويل النص إلى كلام (TTS)
(مثل
gemini-3.1-flash-tts-preview) - نماذج Live API(مثل
gemini-live-2.5-flash-native-audio)
- نماذج تحويل النص إلى كلام (TTS)
(مثل
للاطّلاع على أمثلة حول عملية الإعداد الخاصة بمنصتك، راجِع دليل البدء.
للحصول على تفاصيل حول مراحل الإصدار (خاصةً حالات الاستخدام والفوترة والإيقاف)، يُرجى الاطّلاع على أنماط إصدار النماذج وتسميتها.
إدراج جميع النماذج المتاحة آليًا
يمكنك إدراج جميع أسماء النماذج المتاحة باستخدام واجهة REST API:
Gemini Developer API: الاتصال بنقطة النهاية
models.listAgent Platform Gemini API (formerly Vertex AI): الاتصال بنقطة النهاية
publishers.models.list
يُرجى العِلم أنّ هذه القائمة التي يتم عرضها ستتضمّن جميع الطُرز المتوافقة مع مقدّمي خدمات واجهات برمجة التطبيقات، ولكن Firebase AI Logic لا يتوافق إلا مع طُرز Gemini الموضّحة في هذه الصفحة.
النماذج ذات الاستخدام العام
Gemini 3.x Pro أسماء النماذج
يتطلّب خطة Blaze المَرِنة للدفع حسب الاستخدام بغض النظر عن موفّر خدمة Gemini API.
| اسم النموذج | الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3.1-pro-preview |
أحدث إصدار مبكر حصري من Gemini 3.x Pro | معاينة | 2026-02-19 | لم يحدد بعد |
Gemini 3.x Flash أسماء النماذج
لا يتطلّب خطة أسعار Blaze بنظام الدفع حسب الاستخدام إذا كنت تستخدم Gemini Developer API.
| اسم النموذج | الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3.8-flash |
أحدث إصدار ثابت من Gemini 3.x Flash هذا نموذج توفّر قصير الأمد (راجِع أنماط تسمية وإصدار النماذج). |
مستقر | 2026-09-02 | لم يحدد بعد |
gemini-3.7-flash |
الإصدار الثابت من Gemini 3.x Flash هذا نموذج توفّر قصير الأمد (راجِع أنماط تسمية إصدارات النماذج). |
مستقر | 2026-08-13 | لم يحدد بعد |
gemini-3.6-flash |
الإصدار الثابت من Gemini 3.x Flash هذا نموذج توفّر قصير الأمد (راجِع أنماط تسمية إصدارات النماذج). |
مستقر | 2026-07-21 | لم يحدد بعد |
gemini-3.5-flash |
الإصدار الثابت من "Gemini 3.x Flash" | مستقر | 2026-05-19 | ليس قبل 2027-05-19 |
gemini-3-flash-preview |
إصدار مبكر حصري من "Gemini 3.x Flash" | معاينة | 2025-12-17 | لم يحدد بعد |
Gemini 3.x Flash‑Lite أسماء النماذج
لا يتطلّب خطة أسعار Blaze بنظام الدفع حسب الاستخدام إذا كنت تستخدم Gemini Developer API.
| اسم النموذج | الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3.5-flash-lite |
أحدث إصدار ثابت من Gemini 3.x Flash‑Lite | مستقر | 2026-07-21 | ليس قبل 2027-07-21 |
gemini-3.1-flash-lite |
الإصدار الثابت من "Gemini 3.x Flash‑Lite" | مستقر | 2026-05-07 | في موعد لا يسبق 2027-05-07 |
نماذج إنشاء الصور
أسماء نماذج Gemini 3.x Pro Image (المعروفة أيضًا باسم "Nano Banana Pro")
يتطلّب خطة Blaze المَرِنة للدفع حسب الاستخدام بغض النظر عن موفّر خدمة Gemini API.
| اسم النموذج | الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3-pro-image |
الإصدار الثابت من Gemini 3.x Pro Image (المعروف أيضًا باسم "Nano Banana Pro") |
مستقر | 2026-05-28 | لا يمكن أن يكون تاريخ الإصدار قبل 2027-05-28 |
gemini-3-pro-image-preview |
إصدار مبكر حصري من Gemini 3.x Pro Image (المعروف أيضًا باسم Nano Banana Pro) |
معاينة | 2025-11-20 | في أقرب وقت ممكن 2026-06-25 |
أسماء نماذج Gemini 3.x Flash Image (المعروفة أيضًا باسم "Nano Banana 2")
يتطلّب خطة Blaze المَرِنة للدفع حسب الاستخدام بغض النظر عن موفّر خدمة Gemini API.
| اسم النموذج | الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3.1-flash-image |
الإصدار الثابت من Gemini 3.x Flash Image (المعروف أيضًا باسم "Nano Banana 2") |
مستقر | 2026-05-28 | لا يمكن أن يكون تاريخ الإصدار قبل 2027-05-28 |
gemini-3.1-flash-image-preview |
إصدار مبكر حصري من Gemini 3.x Flash Image (المعروف أيضًا باسم "Nano Banana 2") |
معاينة | 2026-02-26 | في أقرب وقت ممكن 2026-06-25 |
أسماء نماذج Gemini 3.x Flash‑Lite Image (المعروفة أيضًا باسم "Nano Banana 2 Lite")
يتطلّب خطة Blaze المَرِنة للدفع حسب الاستخدام بغض النظر عن موفّر خدمة Gemini API.
| اسم النموذج | الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3.1-flash-lite-image |
الإصدار الثابت من Gemini 3.x Flash‑Lite Image (المعروف أيضًا باسم "Nano Banana 2 Lite") هذا نموذج متاح لفترة قصيرة (راجِع أنماط تسمية وإصدار النماذج). |
مستقر | 2026-06-30 | لم يحدد بعد |
نماذج تحويل النص إلى كلام (TTS)
Gemini 3.x Flash TTS أسماء النماذج
لا يتطلّب خطة أسعار Blaze بنظام الدفع حسب الاستخدام إذا كنت تستخدم Gemini Developer API.
| اسم النموذج | الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3.1-flash-tts-preview |
إصدار مبكر حصري من "Gemini 3.x Flash TTS" | معاينة | 2026-06-17 | لم يحدد بعد |
المحتوى الصوتي - نماذج Live API
Gemini 3.x Flash Live أسماء النماذج
| Gemini Developer API اسم النموذج |
الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-3.1-flash-live-preview 1 |
إصدار مبكر حصري من "Live API" على "Gemini Developer API" | معاينة | 2026-03-26 | لم يحدد بعد |
| Agent Platform Gemini API (formerly Vertex AI) اسم النموذج |
الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
| لا تتوافق Agent Platform Gemini API (formerly Vertex AI) مع أي من طُرز Gemini Live 3.x. | ||||
1 يتم دعم Gemini Developer API فقط.
بالإضافة إلى ذلك، على الرغم من أنّ هذا النموذج هو نموذج معاينة، إلا أنّه متاح في "المستوى المجاني" من Gemini Developer API.
Gemini 2.5 Flash Live أسماء النماذج
لا تتطلّب خطة Blaze المَرِنة للدفع حسب الاستخدام إذا كنت تستخدم Gemini Developer API (عادةً ما تتطلّب نماذج المعاينة خطة مدفوعة).
على الرغم من أنّ الطُرز التالية لها أسماء طُرز مختلفة حسب موفِّر واجهة برمجة التطبيقات Gemini، إلا أنّ ميزات الطراز هي نفسها.
| Gemini Developer API اسم النموذج |
الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-2.5-flash-native-audio-preview-12-2025 1 |
إصدار مبكر حصري من "Live API" على "Gemini Developer API" | معاينة | 2025-12-12 | لم يحدد بعد |
gemini-2.5-flash-native-audio-preview-09-2025 1 |
الإصدار الأوّلي من معاينة "Live API" على "Gemini Developer API" | معاينة | 2025-09-18 | لم يحدد بعد |
| Agent Platform Gemini API (formerly Vertex AI) اسم النموذج |
الوصف | مرحلة الإصدار | تاريخ الإصدار | تاريخ إيقاف التشغيل |
|---|---|---|---|---|
gemini-live-2.5-flash-native-audio 2 |
الإصدار الثابت من تطبيق "Live API" على جهاز "Agent Platform Gemini API (formerly Vertex AI)" | مستقر | 2025-12-12 | يجب أن يكون تاريخ الإصدار 12-12-2026 أو بعده |
gemini-live-2.5-flash-preview-native-audio-09-2025 2 |
إصدار مبكر حصري من "Live API" على "Agent Platform Gemini API (formerly Vertex AI)" | معاينة | 2025-09-18 | لم يحدد بعد |
1 يتم دعم Gemini Developer API فقط.
بالإضافة إلى ذلك، على الرغم من أنّ هذه النماذج هي نماذج معاينة، إلا أنّها متاحة في "المستوى المجاني" من Gemini Developer API.
2 يتم دعمها فقط من خلال Agent Platform Gemini API (formerly Vertex AI).
بالإضافة إلى ذلك، هذه الطُرز غير متاحة في الموقع الجغرافي global.
اللغات المتاحة
النماذج ذات الاستخدام العام
يمكن لجميع Gemini نماذج الاستخدام العام (مثل Gemini 3.8 Flash وGemini 3.5 Flash-Lite وGemini 3.1 Pro ونماذج 3.x السابقة) فهم أكثر من 100 لغة والرد بها:
الأفريكانية (af) والألبانية (sq) والأمهرية (am) والعربية (ar) والأرمينية (hy) والآسامية (as) والأذربيجانية (az) والباسكية (eu) والبيلاروسية (be) والبنغالية (bn) والبوسنية (bs) والبلغارية (bg) والكتالونية (ca) والسيبوانية (ceb) والصينية المبسّطة والتقليدية (zh) والكورسيكية (co) والكرواتية (hr) والتشيكية (cs) والدانمركية (da) والديفيهية (dv) والهولندية (nl) والإنجليزية (en) والإسبرانتو (eo) والإستونية (et) والفلبينية (التاغالوغية) (fil) والفنلندية (fi) والفرنسية (fr) والفريزية (fy) والجاليكية (gl) والجورجية (ka) والألمانية (de) واليونانية (el) والغوجاراتية (gu) والكريولية الهايتية (ht) والهوسا (ha) والهاوايانية (haw) والعبرية (iw) والهندية (hi) والهمونغية (hmn) والهنغارية (hu) والأيسلندية (is) والإيغبو (ig) والإندونيسية (id) والأيرلندية (ga) والإيطالية (it) واليابانية (ja) والجاوية (jv) والكانادية (kn) والكازاخستانية (kk) والخميرية (km) والكورية (ko) والكريولية (kri) والكردية (ku) والقيرغيزية (ky) واللاوية (lo) واللاتينية (la) واللاتفية (lv) والليتوانية (lt) واللوكسمبورغية (lb) والمقدونية (mk) والمدغشقرية (mg) والماليزية (ms) والمالايالامية (ml) والمالطية (mt) والماورية (mi) والمهاراتية (mr) والميتيلونية (المانيبورية) (mni-Mtei) والمنغولية (mn) والبورمية (my) والنيبالية (ne) والنرويجية (no) والنيانجا (تشيشيوا) (ny) والأودية (الأورية) (or) والبشتونية (ps) والفارسية (fa) والبولندية (pl) والبرتغالية (pt) والبنجابية (pa) والرومانية (ro) والروسية (ru) والساموية (sm) والغالية الاسكتلندية (gd) والصربية (sr) والسيسوتو (st) والشونا (sn) والسندية (sd) والسنهالية (si) والسلوفاكية (sk) والسلوفينية (sl) والصومالية (so) والإسبانية (es) والسوندانية (su) والسواحيلية (sw) والسويدية (sv) والطاجيكية (tg) والتاميلية (ta) والتيلوغوية (te) والتايلاندية (th) والتركية (tr) والأوكرانية (uk) والأردية (ur) والأويغورية (ug) والأوزبكية (uz) والفيتنامية (vi) والويلزية (cy) والخوسا (xh) واليديشية (yi) واليوروبا (yo) والزولو (zu)
نماذج إنشاء الصور
يمكن لنماذج Gemini 3.x Image قبول طلبات نصية بلغات متعددة. ومع ذلك، تم تحسينها لتحقيق أفضل أداء (سواء بالنسبة إلى الطلبات النصية أو عرض النصوص داخل الصور من إنشاء الذكاء الاصطناعي التوليدي) باللغات والمواقع الجغرافية التالية:
الألمانية (de-DE) والإنجليزية (EN) والإسبانية (es-MX) والفرنسية (fr-FR) والهندية (hi-IN) والإندونيسية (id-ID) والإيطالية (it-IT) واليابانية (ja-JP) والكورية (ko-KR) والبرتغالية (pt-BR) والروسية (ru-RU) والأوكرانية (uk-UA) والفيتنامية (vi-VN) والصينية المبسّطة (zh-CN) والعربية (ar-EG).
لمزيد من المعلومات حول أفضل الممارسات المتعلّقة بتوجيه الطلبات وإنشاء النصوص في الصور، يُرجى الاطّلاع على اللغات المتوافقة مع ميزة "إنشاء الصور".
نماذج إنشاء الصوت (تحويل النص إلى كلام وLive API)
تتيح النماذج التي تنشئ المحتوى الصوتي مجموعات لغوية متخصصة تم تحسينها لتناسب تركيب الكلام و (بالنسبة إلى Live API) الحوار الثنائي الاتجاه في الوقت الفعلي:
نماذج تحويل النص إلى كلام (TTS): يمكن لنماذج Gemini 3.x TTS رصد الكلام وإنشائه تلقائيًا بما يقارب 80 لغة ولهجة.
للاطّلاع على القائمة الكاملة باللغات المتاحة ورموز BCP-47 المتوفرة، يُرجى الاطّلاع على اللغات المتاحة لإنشاء الكلام.
نماذج Live API: تتيح نماذج Live API إجراء تفاعلات صوتية ثنائية الاتجاه في الوقت الفعلي بما يقارب 80 لغة ولهجة.
للاطّلاع على القائمة الكاملة باللغات المتاحة ومعرفة كيفية التأثير في لغة الرد المنطوق، يُرجى الاطّلاع على اللغات المتاحة في Live API.
معلومات عن الطُرز السابقة
في ما يلي أجهزة نشطة، ولكنها من الطرازات السابقة. ننصحك باستخدام أحد أحدث الطُرز بدلاً من ذلك عند الإمكان.
إذا لم تتمكّن من العثور على المعلومات التي تبحث عنها في الأقسام الفرعية التالية، يمكنك العثور على المزيد من المعلومات في مستندات مزوّد واجهة برمجة التطبيقات الذي اخترته: Gemini Developer API أو Agent Platform Gemini API (formerly Vertex AI)
النماذج الأقدم Gemini
gemini-2.5-progemini-2.5-flashgemini-2.5-flash-lite-
gemini-2.5-flash-image(المعروفة أيضًا باسم "Nano Banana") -
gemini-2.0-flash-001(والاسم المستعارgemini-2.0-flashالذي يتم تعديله تلقائيًا) -
gemini-2.0-flash-lite-001(والاسم المستعارgemini-2.0-flash-liteالذي يتم تعديله تلقائيًا)
للحصول على معلومات حول طُرز Gemini Live API القديمة، يُرجى الاطّلاع على مستندات موفّر Gemini API:
النماذج الأقدم Imagen
imagen-4.0-ultra-generate-001imagen-4.0-generate-001imagen-4.0-fast-generate-001imagen-3.0-capability-001imagen-3.0-generate-002imagen-3.0-generate-001imagen-3.0-fast-generate-001
عرض تفاصيل حول الطُرز السابقة
الخطوات التالية
تجربة إمكانات Gemini API
- إنشاء محادثات مترابطة (محادثة)
- إنشاء نصّ من إنشاء الذكاء الاصطناعي من طلبات نصية فقط
- إنشاء نص من خلال تقديم طلبات تتضمّن أنواع ملفات مختلفة، مثل الصور و ملفات PDF و الفيديوهات و الملفات الصوتية
- إنشاء ناتج منظَّم (مثل JSON) من الطلبات النصية وطلبات الوسائط المتعددة
- إنشاء الصور وتعديلها من الطلبات النصية وطلبات الوسائط المتعددة
- إنشاء محتوى صوتي (بصوت متحدث واحد أو عدة متحدثين) باستخدام نماذج Gemini لتحويل النص إلى كلام
- إدخال المحتوى وبثه (بما في ذلك الصوت) باستخدام Gemini Live API
-
استخدِم أدوات (مثل استدعاء الدوال
وGrounding باستخدام
Google Search أوGoogle Maps ) لربط نموذج Gemini بأجزاء أخرى من تطبيقك وأنظمة ومعلومات خارجية.