Pour les applications mobiles et Web, les SDK Firebase AI Logic vous permettent d'interagir avec les modèles Gemini compatibles directement depuis votre application.
Les modèles Gemini sont considérés comme multimodaux, car ils sont capables de traiter et même de générer plusieurs modalités, y compris du texte, du code, des PDF, des images, des vidéos et de l'audio.
Consultez également nos questions fréquentes pour connaître tous les modèles compatibles et non compatibles avec Firebase AI Logic.
Modèles à la une
Gemini 3.8 Flash
gemini-3.8-flash
Des performances de pointe rivalisant avec celles des modèles plus grands, pour un coût bien inférieur.
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Modèle de travail à volume élevé et sensible aux coûts, avec les performances et la qualité de la série Gemini 3.
Gemini 3.1 Flash Image (Nano Banana 2)
gemini-3.1-flash-image
Modèle puissant et très efficace de génération et de retouche d'images, optimisé pour la vitesse et les cas d'utilisation à fort volume.
Modèles à usage général
Accéder aux tableaux contenant les détails des modèles
Gemini 3.1 Pro
gemini-3.1-pro-preview
Intelligence avancée, compétences en résolution de problèmes complexes et puissantes capacités de codage d'agentivité et d'ambiance.
Gemini 3.8 Flash
gemini-3.8-flash
Des performances de pointe rivalisant avec celles des modèles plus grands, pour un coût bien inférieur.
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
Modèle de travail à volume élevé et sensible aux coûts, avec les performances et la qualité de la série Gemini 3.
Anciens modèles stables à usage général
Gemini 3.7 Flash (
gemini-3.7-flash) : modèle Gemini 3.x Flash précédent pour des performances de pointe rivalisant avec les modèles plus grands à une fraction du coût. (aucune facturation requise)Gemini 3.6 Flash (
gemini-3.6-flash) : modèle Gemini 3.x Flash précédent pour des performances de pointe rivalisant avec les modèles plus grands à une fraction du coût. (aucune facturation requise)Gemini 3.5 Flash (
gemini-3.5-flash) : modèle Gemini 3.x Flash précédent pour des performances de pointe rivalisant avec les modèles plus grands à une fraction du coût. (aucune facturation requise)Gemini 3.1 Flash‑Lite (
gemini-3.1-flash-lite) : ancien modèle Gemini 3.x Flash‑Lite pour les tâches de référence à volume élevé et sensibles aux coûts. (aucune facturation requise)
Modèles de génération d'images
Accéder aux tableaux contenant les détails des modèles
Gemini 3 Pro Image (Nano Banana Pro)
gemini-3-pro-image
Modèle de pointe pour la génération et la retouche d'images permettant de créer des images natives très contextuelles.
Gemini 3.1 Flash Image (Nano Banana 2)
gemini-3.1-flash-image
Modèle puissant et très efficace de génération et de retouche d'images, optimisé pour la vitesse et les cas d'utilisation à fort volume.
Image Gemini 3.1 Flash-Lite (Nano Banana 2 Lite)
gemini-3.1-flash-lite-image
Modèle de génération et de retouche d'images à latence ultrafaible et économique, conçu pour les cas d'utilisation interactifs à fort volume.
Modèles de génération audio
Modèles de synthèse vocale
Vous pouvez générer un discours à partir d'une entrée de texte avec les modèles TTS Gemini.
Accéder aux tableaux contenant les détails des modèles
Gemini 3.x Flash TTS
gemini-3.1-flash-tts-preview
Génération de voix puissante et à faible latence à partir d'une entrée textuelle.
Live API modèles
Vous pouvez générer de l'audio bidirectionnel en streaming avec des modèles compatibles avec Gemini Live API.
Accéder aux tableaux contenant les détails des modèles
Gemini 3.x Flash avec audio natif de l'API Gemini Live
API Gemini Developer :gemini-3.1-flash-live-preview
API Gemini Agent Platform :
non acceptée
Permet des interactions vocales et vidéo en temps réel et à faible latence avec un modèle Gemini bidirectionnel.
Gemini 2.5 Flash avec l'audio natif de l'API Gemini Live
API Gemini Developer :gemini-2.5-flash-native-audio-preview-12-2025
API Gemini Agent Platform :gemini-live-2.5-flash-native-audio
Permet des interactions vocales et vidéo en temps réel et à faible latence avec un modèle Gemini bidirectionnel.
Le reste de cette page fournit des informations détaillées sur les modèles compatibles avec Firebase AI Logic.
-
- Entrées et sorties acceptées
- Comparaison générale des fonctionnalités compatibles
- Spécifications et limites, par exemple le nombre maximal de jetons d'entrée ou la longueur maximale de la vidéo d'entrée
Description du versionnage des modèles, en particulier de leurs versions stable, preview et experimental
Listes des noms de modèles disponibles à inclure dans votre code lors de l'initialisation
Listes des langues disponibles pour les modèles
En bas de cette page, vous pouvez consulter des informations détaillées sur les modèles de génération précédente.
Comparer des modèles
Chaque modèle possède des capacités différentes pour prendre en charge divers cas d'utilisation. Notez que chaque tableau de cette section décrit chaque modèle lorsqu'il est utilisé avec Firebase AI Logic. Chaque modèle peut disposer de fonctionnalités supplémentaires qui ne sont pas disponibles lorsque vous utilisez nos SDK.
Si vous ne trouvez pas les informations que vous recherchez dans les sous-sections suivantes, vous pouvez en trouver d'autres dans la documentation du fournisseur d'API de votre choix : Gemini Developer API ou Agent Platform Gemini API (formerly Vertex AI).
Entrées et sorties acceptées
Le tableau suivant répertorie les types d'entrée et de sortie compatibles lors de l'utilisation de chaque modèle avec Firebase AI Logic.
Pour en savoir plus sur les types de fichiers acceptés, consultez Fichiers d'entrée et exigences acceptés.
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| Types d'entrée | ||||||
| Texte | ||||||
| Code | ||||||
| Documents (PDF ou texte brut) |
||||||
| Images | ||||||
| Vidéo | ||||||
| Audio | ||||||
| Types de sortie | ||||||
| Texte | ||||||
| Texte (streaming) | ||||||
| Code | ||||||
| Sortie structurée (comme JSON) |
||||||
| Images | ||||||
| Vidéo | ||||||
| Audio | ||||||
Fonctionnalités et capacités prises en charge
Le tableau suivant répertorie les capacités et les fonctionnalités compatibles lorsque vous utilisez chaque modèle avec Firebase AI Logic.
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| Raisonnement | ||||||
| Générer du texte à partir d'entrées textuelles ou multimodales | entrelacé ou intégré à l'image | entrelacé ou intégré à l'image | entrelacé ou intégré à l'image | transcription de l'audio | ||
| Générer des images | ||||||
| Modifier des images | ||||||
| Générer de l'audio | speech | contenu audio en streaming | ||||
|
Générer une sortie structurée
(comme JSON) |
||||||
|
Analyser des documents
(PDF ou texte brut) (text-output | image-output) |
||||||
|
Analyser des images (text-output | image-output) |
||||||
|
Analyser la vidéo (text-output | image-output) |
vidéo en streaming | |||||
| Analyser l'audio | contenu audio en streaming | |||||
| Chat multitour | ||||||
| Streaming multimodal bidirectionnel | ||||||
| Outils compatibles | ||||||
| Appel de fonction | ||||||
| Exécution de code | ||||||
| Contexte de l'URL | ||||||
|
Ancrage avec |
||||||
|
Ancrage avec |
||||||
Spécifications et limites
Le tableau suivant liste les spécifications et les limites lors de l'utilisation de chaque modèle avec Firebase AI Logic.
| Propriété |
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|---|---|---|---|---|---|---|
| Limite de jetons d'entrée* | 1 048 576 jetons | 65 536 jetons | 131 072 jetons | 65 536 jetons | 8 192 jetons | Consulter la documentation |
| Limite de jetons de sortie* | 65 536 jetons | 32 768 jetons | 32 768 jetons | 4 096 jetons | 16 384 jetons | |
| PDF (sur demande) | ||||||
| Nombre maximal de fichiers PDF d'entrée** |
900 fichiers | 14 fichiers | 14 fichiers | 14 fichiers | --- | Consulter la documentation |
| Nombre maximal de pages par fichier PDF d'entrée** |
900 pages | 14 pages | 14 pages | 14 pages | --- | |
| Taille maximale par fichier PDF d'entrée |
50 Mo | 50 Mo | 50 Mo | 50 Mo | --- | |
| Images (par demande) | ||||||
| Nombre maximal d'images d'entrée |
1 000 images | 14 images | 14 images | 14 images | --- | Consulter la documentation |
| Taille maximale par image encodée en base64 |
7 Mo | 7 Mo | 7 Mo | 7 Mo | --- | |
| Nombre maximal d'images générées |
--- | Jusqu'à la limite de jetons de sortie | Jusqu'à la limite de jetons de sortie | Jusqu'à la limite de jetons de sortie | --- | |
| Vidéo (par demande) | ||||||
| Nombre maximal de fichiers vidéo d'entrée |
10 fichiers | --- | Jusqu'à la limite de jetons d'entrée | Jusqu'à la limite de jetons d'entrée | --- | Consulter la documentation |
| Durée maximale de toutes les vidéos (images uniquement) |
Environ 60 minutes | --- | 25 minutes environ | Environ 12 minutes | --- | |
| Durée maximale de toutes les vidéos saisies (images et audio) |
45 minutes environ | --- | --- | --- | --- | |
| Audio (par requête) | ||||||
| Nombre maximal de fichiers audio d'entrée |
1 fichier | --- | --- | --- | --- | Consulter la documentation |
| Durée maximale de l'ensemble de l'entrée audio |
~8,4 heures | --- | --- | --- | --- | |
*
Pour tous les modèles Gemini, un jeton équivaut à environ quatre caractères. 100 jetons correspondent donc à environ 60 à 80 mots en anglais. Pour les modèles Gemini, vous pouvez déterminer le nombre total de jetons dans vos requêtes à l'aide de countTokens.
** Les PDF sont traités comme des images. Ainsi, une seule page d'un PDF est traitée comme une seule image. Le nombre de pages autorisées dans une requête est limité au nombre d'images que le modèle peut accepter.
Obtenir des informations détaillées supplémentaires
Les quotas et les tarifs sont différents pour chaque modèle. La tarification dépend également des entrées et des sorties.
Découvrez les types de fichiers d'entrée acceptés, comment spécifier le type MIME et comment vous assurer que vos fichiers d'entrée et vos requêtes multimodales répondent aux exigences et suivent les bonnes pratiques décrites dans Fichiers d'entrée acceptés et exigences.
Gestion des versions et schémas de nommage des modèles
Les modèles sont proposés en versions stable, preview et expérimentale. Pour plus de commodité, les alias -latest
Assurez-vous de consulter nos bonnes pratiques pour utiliser les versions de modèle.
Pour trouver des noms de modèles spécifiques à utiliser dans votre code, consultez la section Noms de modèles disponibles plus loin sur cette page.
| Type de version / Étape de lancement |
Description | Format du nom du modèle | |
|---|---|---|---|
| Stable |
Les versions stables sont disponibles et compatibles avec une utilisation en production à partir de la date de sortie.
|
Les noms de modèle des versions stables ne comportent aucun suffixe.
Exemple : |
|
| Aperçu |
Les versions Preview disposent de nouvelles fonctionnalités et sont considérées comme instables.
|
Les noms de modèles des versions Preview sont suivis de
Exemple : |
|
| Expérimental |
Les versions expérimentales proposent de nouvelles fonctionnalités et sont considérées comme instables.
|
Les noms des versions expérimentales des modèles sont suivis de
Exemple : |
|
| Arrêt (fonctionnalité abandonnée) |
Les versions arrêtées (obsolètes) ont dépassé leur date d'arrêt (d'obsolescence) et ont été définitivement désactivées.
|
--- |
|
Bonnes pratiques pour utiliser les versions de modèle
Dans vos applications de production, utilisez le nom explicite du modèle pour la dernière version stable.
Pour Agent Platform Gemini API (formerly Vertex AI), si vous choisissez d'utiliser un modèle de disponibilité à court terme dans votre application de production, il est encore plus important d'utiliser Firebase Remote Config ou des modèles d'invite de serveur pour contrôler le nom du modèle utilisé pour votre fonctionnalité d'IA.
N'utilisez les versions preview et expérimentales que lors du prototypage. Nous vous recommandons d'utiliser une version stable lorsque vous commencez à développer et à tester un cas d'utilisation en production.
Nous vous déconseillons d'utiliser les alias
(même pendant le développement). Cet alias pointe vers la dernière version d'une variante de modèle spécifique (qui peut être une version stable, preview ou expérimentale). Cet alias sera remplacé à chaque nouvelle version d'une variante de modèle spécifique. Un e-mail de notification sera envoyé deux semaines à l'avance uniquement en cas de modifications destructives. Cette instabilité du modèle que vous utilisez réellement peut entraîner des changements de comportement inattendus pour votre fonctionnalité d'IA.-latest
Noms de modèles disponibles
Les noms de modèles sont les valeurs explicites que vous incluez dans votre code lors de l'initialisation du modèle.
Modèles à usage général (comme
gemini-3.8-flash)Modèles de génération d'images (comme
gemini-3.1-flash-image, alias les modèles "Nano Banana")Modèles de génération audio :
- Modèles de synthèse vocale (comme
gemini-3.1-flash-tts-preview) - Live API modèles
(comme
gemini-live-2.5-flash-native-audio)
- Modèles de synthèse vocale (comme
Pour obtenir des exemples d'initialisation pour votre plate-forme, consultez le guide de démarrage.
Pour en savoir plus sur les étapes de publication (en particulier pour les cas d'utilisation, la facturation et l'arrêt), consultez Modèles de nommage et de versionnage des modèles.
Lister tous les modèles disponibles de manière programmatique
Vous pouvez lister tous les noms de modèles disponibles à l'aide de l'API REST :
Gemini Developer API : appeler le point de terminaison
models.listAgent Platform Gemini API (formerly Vertex AI) : appeler le point de terminaison
publishers.models.list
Notez que la liste renvoyée inclura tous les modèles compatibles avec les fournisseurs d'API, mais que Firebase AI Logic n'est compatible qu'avec les modèles Gemini décrits sur cette page.
Modèles à usage général
Noms des modèles Gemini 3.x Pro
Nécessite le forfait Blaze avec paiement à l'usage, quel que soit votre fournisseur Gemini API.
| Nom du modèle | Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3.1-pro-preview |
Dernière version preview de Gemini 3.x Pro | Aperçu | 2026-02-19 | À déterminer |
Noms des modèles Gemini 3.x Flash
Ne nécessite pas le forfait Blaze avec paiement à l'usage si vous utilisez Gemini Developer API.
| Nom du modèle | Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3.8-flash |
Dernière version stable de Gemini 3.x Flash Il s'agit d'un modèle de disponibilité à court terme (voir Modèles de nommage et de gestion des versions). |
Stable | 2026-09-02 | À déterminer |
gemini-3.7-flash |
Version stable de Gemini 3.x Flash Il s'agit d'un modèle de disponibilité à court terme (voir Modèles de nommage et de versionnage des modèles). |
Stable | 2026-08-13 | À déterminer |
gemini-3.6-flash |
Version stable de Gemini 3.x Flash Il s'agit d'un modèle de disponibilité à court terme (voir Modèles de nommage et de versionnage des modèles). |
Stable | 2026-07-21 | À déterminer |
gemini-3.5-flash |
Version stable de Gemini 3.x Flash | Stable | 2026-05-19 | Au plus tôt le 19/05/2027 |
gemini-3-flash-preview |
Version preview de Gemini 3.x Flash | Aperçu | 2025-12-17 | À déterminer |
Noms des modèles Gemini 3.x Flash‑Lite
Ne nécessite pas le forfait Blaze avec paiement à l'usage si vous utilisez Gemini Developer API.
| Nom du modèle | Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3.5-flash-lite |
La dernière version stable de Gemini 3.x Flash‑Lite | Stable | 2026-07-21 | Au plus tôt le 21/07/2027 |
gemini-3.1-flash-lite |
Version stable de Gemini 3.x Flash‑Lite | Stable | 2026-05-07 | Au plus tôt le 7 mai 2027 |
Modèles de génération d'images
Noms des modèles Gemini 3.x Pro Image (alias "Nano Banana Pro")
Nécessite le forfait Blaze avec paiement à l'usage, quel que soit votre fournisseur Gemini API.
| Nom du modèle | Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3-pro-image |
Version stable de Gemini 3.x Pro Image (alias "Nano Banana Pro") |
Stable | 2026-05-28 | Au plus tôt le 2027-05-28 |
gemini-3-pro-image-preview |
Version preview de Gemini 3.x Pro Image (alias "Nano Banana Pro") |
Aperçu | 2025-11-20 | Dès le 2026-06-25 |
Noms des modèles Gemini 3.x Flash Image (alias "Nano Banana 2")
Nécessite le forfait Blaze avec paiement à l'usage, quel que soit votre fournisseur Gemini API.
| Nom du modèle | Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3.1-flash-image |
Version stable de Gemini 3.x Flash Image (alias "Nano Banana 2") |
Stable | 2026-05-28 | Au plus tôt le 2027-05-28 |
gemini-3.1-flash-image-preview |
Version preview de Gemini 3.x Flash Image (alias "Nano Banana 2") |
Aperçu | 2026-02-26 | Dès le 2026-06-25 |
Gemini 3.x Flash‑Lite Image noms de modèles (par exemple, "Nano Banana 2 Lite")
Nécessite le forfait Blaze avec paiement à l'usage, quel que soit votre fournisseur Gemini API.
| Nom du modèle | Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3.1-flash-lite-image |
Version stable de Gemini 3.x Flash‑Lite Image (alias "Nano Banana 2 Lite") Il s'agit d'un modèle de disponibilité à court terme (voir Modèles de nommage et de gestion des versions). |
Stable | 2026-06-30 | À déterminer |
Modèles audio de synthèse vocale
Noms des modèles Gemini 3.x Flash TTS
Ne nécessite pas le forfait Blaze avec paiement à l'usage si vous utilisez Gemini Developer API.
| Nom du modèle | Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3.1-flash-tts-preview |
Version preview de Gemini 3.x Flash TTS | Aperçu | 2026-06-17 | À déterminer |
Audio : modèles Live API
Noms des modèles Gemini 3.x Flash Live
| Gemini Developer API Nom du modèle |
Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-3.1-flash-live-preview 1 |
Version preview de Live API sur Gemini Developer API | Aperçu | 2026-03-26 | À déterminer |
| Agent Platform Gemini API (formerly Vertex AI) Nom du modèle |
Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
| Agent Platform Gemini API (formerly Vertex AI) n'est compatible avec aucun modèle Gemini Live 3.x. | ||||
1 Uniquement compatible avec Gemini Developer API.
De plus, même s'il s'agit d'un modèle en version preview, il est disponible dans le Gemini Developer API de niveau sans frais.
Noms des modèles Gemini 2.5 Flash Live
Ne nécessite pas le forfait Blaze avec paiement à l'usage si vous utilisez Gemini Developer API (les modèles en version bêta nécessitent généralement un forfait payant).
Même si les modèles suivants ont des noms différents selon le fournisseur d'API Gemini, les fonctionnalités du modèle sont les mêmes.
| Gemini Developer API Nom du modèle |
Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-2.5-flash-native-audio-preview-12-2025 1 |
Version preview de Live API sur Gemini Developer API | Aperçu | 2025-12-12 | À déterminer |
gemini-2.5-flash-native-audio-preview-09-2025 1 |
Version preview initiale de Live API sur Gemini Developer API | Aperçu | 2025-09-18 | À déterminer |
| Agent Platform Gemini API (formerly Vertex AI) Nom du modèle |
Description | Étape de lancement | Date de disponibilité | Date d'arrêt |
|---|---|---|---|---|
gemini-live-2.5-flash-native-audio 2 |
Version stable de Live API sur Agent Platform Gemini API (formerly Vertex AI) | Stable | 2025-12-12 | Au plus tôt le 12/12/2026 |
gemini-live-2.5-flash-preview-native-audio-09-2025 2 |
Version preview de Live API sur Agent Platform Gemini API (formerly Vertex AI) | Aperçu | 2025-09-18 | À déterminer |
1 Uniquement compatible avec Gemini Developer API.
De plus, même s'il s'agit de modèles en preview, ils sont disponibles dans le niveau sans frais de Gemini Developer API.
2 Seulement compatible avec Agent Platform Gemini API (formerly Vertex AI).
De plus, ces modèles ne sont pas disponibles dans la zone global.
Langues disponibles
Modèles à usage général
Tous les modèles à usage général Gemini (comme Gemini 3.8 Flash, Gemini 3.5 Flash-Lite, Gemini 3.1 Pro et les modèles 3.x antérieurs) peuvent comprendre et répondre dans plus de 100 langues :
Afrikaans (af), albanais (sq), amharique (am), arabe (ar),
arménien (hy), assamais (as), azéri (az), basque (eu),
biélorusse (be), bengali (bn), bosnien (bs), bulgare (bg),
catalan (ca), cebuano (ceb), chinois simplifié et traditionnel (zh),
corse (co), croate (hr), tchèque (cs), danois (da), divehi (dv),
néerlandais (nl), anglais (en), espéranto (eo), estonien (et),
filipino (tagalog) (fil), finnois (fi), français (fr), frison (fy),
galicien (gl), géorgien (ka), allemand (de), grec (el), gujarati (gu),
créole haïtien (ht), haoussa (ha), hawaïen (haw), hébreu (iw),
hindi (hi), hmong (hmn), hongrois (hu), islandais (is), igbo (ig),
indonésien (id), irlandais (ga), italien (it), japonais (ja),
javanais (jv), kannada (kn), kazakh (kk), khmer (km), coréen (ko),
krio (kri), kurde (ku), kirghize (ky), lao (lo), latin (la),
letton (lv), lituanien (lt), luxembourgeois (lb), macédonien (mk),
malgache (mg), malais (ms), malayalam (ml), maltais (mt), maori (mi),
marathi (mr), meitei (manipuri) (mni-Mtei), mongol (mn),
birman (my), népalais (ne), norvégien (no),
nyanja (chichewa) (ny), odia (oriya) (or), pachtou (ps), persan (fa),
polonais (pl), portugais (pt), pendjabi (pa), roumain (ro),
russe (ru), samoan (sm), gaélique écossais (gd), serbe (sr),
sesotho (st), shona (sn), sindhi (sd), singhalais (si),
slovaque (sk), slovène (sl), somali (so), espagnol (es),
soundanais (su), swahili (sw), suédois (sv), tadjik (tg), tamoul (ta),
télougou (te), thaï (th), turc (tr), ukrainien (uk), ourdou (ur),
ouïghour (ug), ouzbek (uz), vietnamien (vi), gallois (cy), xhosa (xh),
yiddish (yi), yoruba (yo) et zoulou (zu).
Modèles de génération d'images
Les modèles Gemini 3.x Image peuvent accepter des prompts textuels dans de nombreuses langues. Toutefois, elles sont optimisées pour offrir les meilleures performances (à la fois pour les prompts textuels et pour le rendu du texte dans les images génératives) dans les langues et les paramètres régionaux suivants :
Allemand (de-DE), anglais (EN), arabe (ar-EG), chinois simplifié (zh-CN), coréen (ko-KR), espagnol (es-MX), français (fr-FR), hindi (hi-IN), indonésien (id-ID), italien (it-IT), japonais (ja-JP), portugais (pt-BR), russe (ru-RU), ukrainien (uk-UA) et vietnamien (vi-VN).
Pour en savoir plus sur les bonnes pratiques concernant les requêtes et la génération de texte dans les images, consultez Langues acceptées pour la génération d'images.
Modèles de génération audio (TTS et Live API)
Les modèles de génération audio sont compatibles avec des ensembles de langues spécialisés et optimisés pour la synthèse vocale et (pour Live API) le dialogue bidirectionnel en temps réel :
Modèles de synthèse vocale : les modèles Gemini 3.x TTS peuvent détecter et générer automatiquement de la parole dans près de 80 langues et dialectes.
Pour afficher la liste complète des langues disponibles et des codes de paramètres régionaux BCP-47, consultez Langues acceptées pour la génération vocale.
Les modèles Live API : Les modèles Live API sont compatibles avec les interactions vocales bidirectionnelles en temps réel dans près de 80 langues et dialectes.
Pour afficher la liste complète des langues disponibles et découvrir comment influencer la langue de la réponse vocale, consultez Langues disponibles pour Live API.
Informations sur les modèles précédents
Les modèles suivants sont actifs, mais de l'ancienne génération. Dans la mesure du possible, nous vous recommandons d'utiliser l'un des derniers modèles.
Si vous ne trouvez pas les informations que vous recherchez dans les sous-sections suivantes, vous pouvez en trouver d'autres dans la documentation du fournisseur d'API de votre choix : Gemini Developer API ou Agent Platform Gemini API (formerly Vertex AI).
Anciens modèles Gemini
gemini-2.5-progemini-2.5-flashgemini-2.5-flash-litegemini-2.5-flash-image(alias "Nano Banana")gemini-2.0-flash-001(et son alias mis à jour automatiquementgemini-2.0-flash)gemini-2.0-flash-lite-001(et son alias mis à jour automatiquementgemini-2.0-flash-lite)
Pour en savoir plus sur les anciens modèles Gemini Live API, consultez la documentation du fournisseur Gemini API :
Modèles Imagen plus anciens
imagen-4.0-ultra-generate-001imagen-4.0-generate-001imagen-4.0-fast-generate-001imagen-3.0-capability-001imagen-3.0-generate-002imagen-3.0-generate-001imagen-3.0-fast-generate-001
Afficher des informations sur les modèles précédents
Étapes suivantes
Tester les fonctionnalités de Gemini API
- Créez des conversations multitours (chat).
- Générez du texte à partir de requêtes textuelles uniquement.
- Générez du texte en utilisant différents types de fichiers comme images, PDF, vidéos et fichiers audio.
- Générez des résultats structurés (comme JSON) à partir de requêtes textuelles et multimodales.
- Générez et modifiez des images à partir de requêtes textuelles et multimodales.
- Générez des voix (à un ou plusieurs intervenants) à l'aide des modèles de synthèse vocale (TTS) Gemini.
- Entrée et sortie de flux (y compris audio) à l'aide de Gemini Live API.
-
Utilisez des outils (comme l'appel de fonction et l'ancrage avec
Google Search ouGoogle Maps ) pour connecter un modèle Gemini à d'autres parties de votre application, ainsi qu'à des systèmes et informations externes.