Más información sobre los modelos compatibles

En el caso de las apps para dispositivos móviles y las apps web, los SDKs de Firebase AI Logic te permiten interactuar con los modelos de Gemini compatibles directamente desde tu app.

Los modelos Gemini se consideran multimodales porque son capaces de procesar y hasta generar múltiples modalidades, como texto, código, PDFs, imágenes, video y audio.

Además, revisa nuestras preguntas frecuentes sobre todos los modelos que Firebase AI Logic admite y no admite.

RÁPIDO E INTELIGENTE

gemini-3.8-flash

Rendimiento de clase Frontier que compite con modelos más grandes a una fracción del costo. (no se requiere facturación)

ULTRA RÁPIDO

gemini-3.5-flash-lite

Modelo de uso general de gran volumen y sensible a los costos con el rendimiento y la calidad de la serie Gemini 3. (no se requiere facturación)

GENERACIÓN DE IMÁGENES

gemini-3.1-flash-image

Modelo potente y de alta eficiencia para la generación y edición de imágenes, optimizado para la velocidad y los casos de uso de gran volumen. (se requiere facturación)

Modelos de uso general

Ir a las tablas con detalles del modelo

gemini-3.1-pro-preview

Inteligencia avanzada, habilidades para resolver problemas complejos y potentes capacidades de codificación de agentes y ambiente. (se requiere facturación)

gemini-3.8-flash

Rendimiento de clase Frontier que compite con modelos más grandes a una fracción del costo. (no se requiere facturación)

gemini-3.5-flash-lite

Modelo de uso general de gran volumen y sensible a los costos con el rendimiento y la calidad de la serie Gemini 3. (no se requiere facturación)

Modelos estables anteriores de uso general
  • Gemini 3.7 Flash (gemini-3.7-flash): Modelo Gemini 3.x Flash anterior para el rendimiento de clase de vanguardia que compite con modelos más grandes a una fracción del costo. (no se requiere facturación)

  • Gemini 3.6 Flash (gemini-3.6-flash): Modelo Gemini 3.x Flash anterior para el rendimiento de clase de vanguardia que compite con modelos más grandes a una fracción del costo. (no se requiere facturación)

  • Gemini 3.5 Flash (gemini-3.5-flash): Modelo Gemini 3.x Flash anterior para el rendimiento de clase de vanguardia que compite con modelos más grandes a una fracción del costo. (no se requiere facturación)

  • Gemini 3.1 Flash‑Lite (gemini-3.1-flash-lite): Modelo Gemini 3.x Flash‑Lite anterior para tareas de gran volumen y sensibles a los costos. (no se requiere facturación)

Modelos de generación de imágenes

Ir a las tablas con detalles del modelo

gemini-3-pro-image

Modelo de vanguardia para la generación y edición de imágenes que permite crear imágenes nativas altamente contextuales. (se requiere facturación)

gemini-3.1-flash-image

Modelo potente y de alta eficiencia para la generación y edición de imágenes, optimizado para la velocidad y los casos de uso de gran volumen. (se requiere facturación)

gemini-3.1-flash-lite-image

Modelo de generación y edición de imágenes rentable y de latencia ultrabaja, diseñado para casos de uso interactivos de gran volumen. (se requiere facturación)

Modelos de generación de audio

Modelos de texto a voz (TTS)

Puedes generar voz a partir de una entrada de texto con los modelos de Gemini TTS.

Ir a las tablas con detalles del modelo

gemini-3.1-flash-tts-preview

Generación de voz potente y de baja latencia a partir de entrada de texto. (no se requiere facturación)

Live API modelos

Puedes generar audio transmitido de forma bidireccional con modelos que admitan Gemini Live API.

Ir a las tablas con detalles del modelo

API de Gemini Developer:
gemini-3.1-flash-live-preview

API de Gemini en Agent Platform:
no compatible

Permite interacciones de voz y video en tiempo real y de baja latencia con un modelo de Gemini bidireccional. (no se requiere facturación)

API de Gemini Developer:
gemini-2.5-flash-native-audio-preview-12-2025

API de Gemini en Agent Platform:
gemini-live-2.5-flash-native-audio

Permite interacciones de voz y video en tiempo real y de baja latencia con un modelo de Gemini bidireccional. (no se requiere facturación)


En el resto de esta página, se proporciona información detallada sobre los modelos compatibles con Firebase AI Logic.

  • Compara modelos:

    • Entrada y salida admitidas
    • Comparación general de las capacidades admitidas
    • Especificaciones y limitaciones, por ejemplo, cantidad máxima de tokens de entrada o duración máxima del video de entrada
  • Descripción de cómo se versionan los modelos, específicamente sus versiones estables, de vista previa y experimentales

  • Listas de nombres de modelos disponibles para incluir en tu código durante la inicialización

  • Listas de idiomas admitidos para los modelos

En la parte inferior de esta página, puedes ver información detallada sobre los modelos de generaciones anteriores.



Comparar modelos

Cada modelo tiene diferentes capacidades para admitir varios casos de uso. Ten en cuenta que cada una de las tablas de esta sección describe cada modelo cuando se usa con Firebase AI Logic. Cada modelo puede tener capacidades adicionales que no están disponibles cuando se usan nuestros SDKs.

Si no encuentras la información que buscas en las siguientes subsecciones, puedes encontrar aún más información en la documentación del proveedor de la API que elijas: Gemini Developer API o Agent Platform Gemini API (formerly Vertex AI).

Entrada y salida admitidas

En la siguiente tabla, se enumeran los tipos de entrada y salida admitidos cuando se usa cada modelo con Firebase AI Logic.

Para obtener información sobre los tipos de archivo admitidos, consulta Archivos de entrada y requisitos admitidos.

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
Tipos de entrada
Texto
Código
Documentos
(PDF o texto sin formato)
Imágenes
Video
Audio
Tipos de salida
Texto
Texto (transmisión)
Código
Resultados estructurados
(como JSON)
Imágenes
Video
Audio

Funciones y capacidades admitidas

En la siguiente tabla, se enumeran las capacidades y funciones admitidas cuando se usa cada modelo con Firebase AI Logic.

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
Pensamiento
Generar texto a partir de entradas de solo texto o multimodales Intercalado o como parte de la imagen Intercalado o como parte de la imagen Intercalado o como parte de la imagen Transcripción de audio
Genera imágenes
Edita imágenes
Generar audio speech audio transmitido
Generar resultados estructurados
(como JSON)
Analizar documentos
(PDF o texto sin formato)
(text-output | image-output)
Analiza imágenes
(text-output | image-output)
Analizar video
(text-output | image-output)
video transmitido
Analizar audio audio transmitido
Chat de varios turnos
Transmisión multimodal bidireccional
Herramientas compatibles
Llamada a función
Ejecución de código
Contexto de la URL
Fundamentación con Google Search
Fundamentación con Google Maps

Especificaciones y limitaciones

En la siguiente tabla, se indican las especificaciones y limitaciones cuando se usa cada modelo con Firebase AI Logic.

Propiedad Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
Límite de tokens de entrada * 1,048,576 tokens 65,536 tokens 131,072 tokens 65,536 tokens 8,192 tokens Ver documentos
Límite de tokens de salida * 65,536 tokens 32,768 tokens 32,768 tokens 4,096 tokens 16,384 tokens
PDFs (por solicitud)
Cantidad máxima
de archivos PDF de entrada **
900 archivos 14 archivos 14 archivos 14 archivos --- Ver documentos
Cantidad máxima
de páginas
por archivo PDF de entrada **
900 páginas 14 páginas 14 páginas 14 páginas ---
Tamaño máximo
por archivo PDF de entrada
50 MB 50 MB 50 MB 50 MB ---
Imágenes (por solicitud)
Cantidad máxima
de imágenes de entrada
1,000 imágenes 14 imágenes 14 imágenes 14 imágenes --- Ver documentos
Tamaño máximo
por imagen de entrada codificada en Base64
7 MB 7 MB 7 MB 7 MB ---
Cantidad máxima de imágenes de salida
--- Hasta el límite de tokens de salida Hasta el límite de tokens de salida Hasta el límite de tokens de salida ---
Video (por solicitud)
Cantidad máxima de archivos de video de entrada
10 archivos --- Hasta el límite de tokens de entrada Hasta el límite de tokens de entrada --- Ver documentos
Longitud máxima
de todo el video de entrada
(solo fotogramas)
Aprox. 60 minutos --- 25 minutos aprox. Aprox. 12 minutos ---
Longitud máxima
de todo el video de entrada
(fotogramas y audio)
45 minutos aprox. --- --- --- ---
Audio (por solicitud)
Cantidad máxima
de archivos de audio de entrada
1 archivo --- --- --- --- Ver documentos
Longitud máxima
de todo el audio de entrada
Aprox. 8.4 horas --- --- --- ---

* Para todos los modelos Gemini, un token equivale a alrededor de 4 caracteres, por lo que 100 tokens equivalen a entre 60 y 80 palabras en inglés. En el caso de los modelos Gemini, puedes determinar el recuento total de tokens en tus solicitudes con countTokens.

** Los PDFs se tratan como imágenes, por lo que una sola página de un PDF se considera una imagen. La cantidad de páginas permitidas en una solicitud se limita a la cantidad de imágenes que el modelo puede admitir.

Encuentra información detallada adicional

  • Las cuotas y los precios son diferentes para cada modelo. Los precios también dependen de la entrada y la salida.

  • Obtén información sobre los tipos de archivos de entrada admitidos, cómo especificar el tipo de MIME y cómo asegurarte de que tus archivos de entrada y solicitudes multimodales cumplan con los requisitos y sigan las prácticas recomendadas que se indican en Requisitos y archivos de entrada admitidos.



Patrones de nomenclatura y control de versiones de modelos

Los modelos se ofrecen en versiones estables, de vista previa y experimentales. Para mayor comodidad, se admiten los alias -latest, pero no se recomiendan debido a la inconsistencia en la versión del modelo a la que apuntan.

Asegúrate de revisar nuestras prácticas recomendadas para usar versiones de modelos.

Para encontrar nombres de modelos específicos que puedes usar en tu código, consulta la sección "nombres de modelos disponibles" más adelante en esta página.

Tipo de versión /
Etapa de lanzamiento
Descripción Patrón del nombre del modelo
Estable Las versiones estables están disponibles y se admiten para su uso en producción a partir de la fecha de lanzamiento.
  • Por lo general, las versiones de modelos estables se lanzan con una fecha de retiro, que indica el último día en que el modelo está disponible. Después de esta fecha, Google ya no admitirá el modelo ni se podrá acceder a él.
  • La mayoría de los modelos estables están disponibles durante 12 meses después de su fecha de lanzamiento (incluso si se lanza un modelo de reemplazo).
  • En el caso de Agent Platform Gemini API (formerly Vertex AI), algunos modelos estables solo tienen disponibilidad a corto plazo, lo que significa que se pueden cerrar (retirar) tan solo 45 días después de que se lance un modelo de reemplazo.

Los nombres de los modelos de versiones estables no tienen sufijo

Ejemplo:
gemini-3.8-flash

Vista previa Las versiones de versión preliminar tienen nuevas capacidades y se consideran inestables.
  • Estos modelos no se recomiendan para el uso en producción, tienen límites de frecuencia más restrictivos y pueden tener requisitos de facturación.
  • Estos modelos se cierran (se retiran) en un plazo de semanas o meses después del lanzamiento de su versión estable asociada.
  • En el caso de Agent Platform Gemini API (formerly Vertex AI), los modelos de vista previa solo están disponibles en la ubicación de global.

Los nombres de los modelos de las versiones preliminares se agregan con -preview.

Ejemplo:
gemini-3-pro-preview

Experimental Las versiones experimentales tienen nuevas capacidades y se consideran inestables.
  • Estos modelos no se recomiendan para su uso en producción y tienen límites de frecuencia más restrictivos. Los modelos experimentales están diseñados para recopilar comentarios y permitir la experimentación con nuestras funciones más recientes.
  • Estos modelos se cierran (se retiran) en un plazo de semanas o meses después del lanzamiento de su versión estable asociada.
  • En el caso de Agent Platform Gemini API (formerly Vertex AI), los modelos experimentales solo están disponibles en la ubicación global.

Los nombres de los modelos de las versiones experimentales se agregan con -exp junto con la fecha de lanzamiento del modelo (-MM-DD).

Ejemplo:
gemini-2.5-pro-exp-03-25
(se lanzó el 25 de marzo de 2025)

Cierre (retirado) Las versiones dadas de baja (retiradas) ya pasaron su fecha de baja (retiro) y se desactivaron de forma permanente.
  • Google ya no admite los modelos que se cerraron (retiraron) ni se puede acceder a ellos, y una solicitud que use el nombre de un modelo retirado devuelve un error 404.

---

Prácticas recomendadas para usar versiones del modelo

  • En tus apps de producción, usa el nombre explícito del modelo para la versión estable más reciente.

    En el caso de Agent Platform Gemini API (formerly Vertex AI), si eliges usar un modelo de disponibilidad a corto plazo en tu app de producción, es aún más importante que uses Firebase Remote Config o plantillas de instrucciones del servidor para controlar el nombre del modelo que se usa para tu función de IA.

  • Usa las versiones preliminar y experimental solo durante el prototipado. Te recomendamos que uses una versión estable cuando comiences a desarrollar y probar un caso de uso de producción.

  • No recomendamos usar los alias -latest (ni siquiera durante el desarrollo). Este alias apunta a la versión más reciente de una variante de modelo específica (que podría ser una versión estable, de vista previa o experimental). Este alias se intercambiará en caliente con cada nueva versión de una variación de modelo específica, y solo se enviará una notificación por correo electrónico 2 semanas antes en el caso de cambios rotundos. Esta inestabilidad del modelo que realmente usas puede generar cambios inesperados en el comportamiento de tu función potenciada por IA.



Nombres de modelos disponibles

Los nombres de los modelos son los valores explícitos que incluyes en tu código durante la inicialización del modelo.

Si deseas ver ejemplos de inicialización para tu plataforma, consulta la guía de introducción.

Para obtener detalles sobre las etapas de lanzamiento (en especial, para los casos de uso, la facturación y la desactivación permanente), consulta los patrones de control de versiones y nombres de modelos.

Enumera todos los modelos disponibles de forma programática

Puedes enumerar todos los nombres de modelos disponibles con la API de REST:

Ten en cuenta que esta lista devuelta incluirá todos los modelos compatibles con los proveedores de la API, pero Firebase AI Logic solo admite los modelos Gemini que se describen en esta página.

Modelos de uso general

Nombres de los modelos Gemini 3.x Pro

Requiere el plan de precios Blaze de pago por uso, independientemente de tu proveedor de Gemini API.

Nombre del modelo Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3.1-pro-preview La versión preliminar más reciente de Gemini 3.x Pro Vista previa 2026-02-19 Sin establecer

Nombres de los modelos Gemini 3.x Flash

No requiere el plan de precios Blaze de pago por uso si usas Gemini Developer API.

Nombre del modelo Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3.8-flash Versión estable más reciente de Gemini 3.x Flash
Este es un modelo de disponibilidad a corto plazo (consulta Patrones de nomenclatura y control de versiones de modelos).
Estable 2026-09-02 Sin establecer
gemini-3.7-flash Versión estable de Gemini 3.x Flash
Este es un modelo de disponibilidad a corto plazo (consulta Patrones de nomenclatura y versiones de modelos).
Estable 2026-08-13 Sin establecer
gemini-3.6-flash Versión estable de Gemini 3.x Flash
Este es un modelo de disponibilidad a corto plazo (consulta Patrones de nomenclatura y versiones de modelos).
Estable 2026-07-21 Sin establecer
gemini-3.5-flash Versión estable de Gemini 3.x Flash Estable 2026-05-19 A partir del
2027-05-19
gemini-3-flash-preview Versión preliminar de Gemini 3.x Flash Vista previa 2025-12-17 Sin establecer

Nombres de los modelos Gemini 3.x Flash‑Lite

No requiere el plan de precios Blaze de pago por uso si usas Gemini Developer API.

Nombre del modelo Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3.5-flash-lite La versión estable más reciente de Gemini 3.x Flash‑Lite Estable 2026-07-21 A partir del
2027-07-21
gemini-3.1-flash-lite Versión estable de Gemini 3.x Flash‑Lite Estable 2026-05-07 A partir del
7/5/2027

Modelos de generación de imágenes

Nombres de los modelos de Gemini 3.x Pro Image (también conocido como "Nano Banana Pro")

Requiere el plan de precios Blaze de pago por uso, independientemente de tu proveedor de Gemini API.

Nombre del modelo Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3-pro-image Versión estable de Gemini 3.x Pro Image
(también conocida como "Nano Banana Pro")
Estable 2026-05-28 A partir del
2027-05-28
gemini-3-pro-image-preview Versión preliminar de Gemini 3.x Pro Image
(también conocida como "Nano Banana Pro")
Vista previa 2025-11-20 A partir del
2026-06-25

Nombres de los modelos de Gemini 3.x Flash Image (también conocidos como "Nano Banana 2")

Requiere el plan de precios Blaze de pago por uso, independientemente de tu proveedor de Gemini API.

Nombre del modelo Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3.1-flash-image Versión estable de Gemini 3.x Flash Image
(también conocido como "Nano Banana 2")
Estable 2026-05-28 A partir del
2027-05-28
gemini-3.1-flash-image-preview Versión preliminar de Gemini 3.x Flash Image
(también conocida como "Nano Banana 2")
Vista previa 2026-02-26 A partir del
2026-06-25

Nombres de los modelos de Gemini 3.x Flash‑Lite Image (también conocidos como "Nano Banana 2 Lite")

Requiere el plan de precios Blaze de pago por uso, independientemente de tu proveedor de Gemini API.

Nombre del modelo Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3.1-flash-lite-image Versión estable de Gemini 3.x Flash‑Lite Image
(también conocido como "Nano Banana 2 Lite")
Este es un modelo de disponibilidad a corto plazo (consulta Patrones de nomenclatura y versiones de modelos).
Estable 2026-06-30 Sin establecer

Modelos de audio y texto a voz (TTS)

Nombres de los modelos Gemini 3.x Flash TTS

No requiere el plan de precios Blaze de pago por uso si usas Gemini Developer API.

Nombre del modelo Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3.1-flash-tts-preview Versión preliminar de Gemini 3.x Flash TTS Vista previa 2026-06-17 Sin establecer

Audio: Modelos Live API

Nombres de los modelos Gemini 3.x Flash Live

Gemini Developer API
Nombre del modelo
Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-3.1-flash-live-preview 1 Versión preliminar de Live API en Gemini Developer API Vista previa 2026-03-26 Sin establecer
Agent Platform Gemini API (formerly Vertex AI)
Nombre del modelo
Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
El Agent Platform Gemini API (formerly Vertex AI) no admite ningún modelo de Gemini Live 3.x.

1 Solo es compatible con Gemini Developer API. Además, aunque este es un modelo en versión preliminar, está disponible en el "nivel gratuito" de Gemini Developer API.

Nombres de los modelos Gemini 2.5 Flash Live

No requiere el plan de precios Blaze de pago por uso si usas Gemini Developer API (por lo general, los modelos de vista previa requieren un plan pagado).

Aunque los siguientes modelos tienen nombres diferentes según el proveedor de la API de Gemini, las características del modelo son las mismas.

Gemini Developer API
Nombre del modelo
Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-2.5-flash-native-audio-preview-12-2025 1 Versión preliminar de Live API en Gemini Developer API Vista previa 2025-12-12 Sin establecer
gemini-2.5-flash-native-audio-preview-09-2025 1 Versión preliminar inicial de Live API en el Gemini Developer API Vista previa 2025-09-18 Sin establecer
Agent Platform Gemini API (formerly Vertex AI)
Nombre del modelo
Descripción Etapa de lanzamiento Fecha de lanzamiento Fecha de cierre
gemini-live-2.5-flash-native-audio 2 Versión estable de Live API en Agent Platform Gemini API (formerly Vertex AI) Estable 2025-12-12 A partir del
12-12-2026
gemini-live-2.5-flash-preview-native-audio-09-2025 2 Versión preliminar de Live API en Agent Platform Gemini API (formerly Vertex AI) Vista previa 2025-09-18 Sin establecer

1 Solo es compatible con Gemini Developer API. Además, aunque estos son modelos de vista previa, están disponibles en el "nivel gratuito" de Gemini Developer API.
2 Solo compatible con Agent Platform Gemini API (formerly Vertex AI). Además, estos modelos no están disponibles en la ubicación global.



Lenguajes compatibles

Modelos de uso general

Todos los modelos de uso general Gemini (como Gemini 3.8 Flash, Gemini 3.5 Flash-Lite, Gemini 3.1 Pro y modelos 3.x anteriores) pueden comprender y responder en más de 100 idiomas:

Afrikaans (af), albanés (sq), amhárico (am), árabe (ar), armenio (hy), asamés (as), azerí (az), euskera (eu), bielorruso (be), bengalí (bn), bosnio (bs), búlgaro (bg), catalán (ca), cebuano (ceb), chino (simplificado y tradicional) (zh), corso (co), croata (hr), checo (cs), danés (da), divehi (dv), neerlandés (nl), inglés (en), esperanto (eo), estonio (et), filipino (tagalo) (fil), finlandés (fi), francés (fr), frisio (fy), gallego (gl), georgiano (ka), alemán (de), griego (el), guyaratí (gu), criollo haitiano (ht), hausa (ha), hawaiano (haw), hebreo (iw), hindi (hi), hmong (hmn), húngaro (hu), islandés (is), igbo (ig), indonesio (id), irlandés (ga), italiano (it), japonés (ja), javanés (jv), kannada (kn), kazajo (kk), jemer (km), coreano (ko), krio (kri), kurdo (ku), kirguís (ky), laosiano (lo), latín (la), letón (lv), lituano (lt), luxemburgués (lb), macedonio (mk), malgache (mg), malayo (ms), malayalam (ml), maltés (mt), maorí (mi), marathi (mr), meiteilon (manipuri) (mni-Mtei), mongol (mn), birmano (my), nepalí (ne), noruego (no), nyanja (chichewa) (ny), odia (oriya) (or), pashto (ps), persa (fa), polaco (pl), portugués (pt), panyabí (pa), rumano (ro), ruso (ru), samoano (sm), gaélico escocés (gd), serbio (sr), sesotho (st), shona (sn), sindhi (sd), cingalés (si), eslovaco (sk), esloveno (sl), somalí (so), español (es), sundanés (su), suajili (sw), sueco (sv), tayiko (tg), tamil (ta), telugu (te), tailandés (th), turco (tr), ucraniano (uk), urdu (ur), uigur (ug), uzbeko (uz), vietnamita (vi), galés (cy), xhosa (xh), yidis (yi), yoruba (yo) y zulú (zu).

Modelos de generación de imágenes

Los modelos Gemini 3.x Image pueden aceptar instrucciones de texto en muchos idiomas. Sin embargo, están optimizados para ofrecer el mejor rendimiento (tanto para las instrucciones de texto como para la renderización de texto en las imágenes creadas con tecnología generativa) en los siguientes idiomas y configuraciones regionales:

Alemán (de-DE), árabe (ar-EG), español (es-MX), francés (fr-FR), hindi (hi-IN), indonesio (id-ID), inglés (EN), italiano (it-IT), japonés (ja-JP), coreano (ko-KR), portugués (pt-BR), ruso (ru-RU), ucraniano (uk-UA), vietnamita (vi-VN) y chino simplificado (zh-CN).

Para obtener más información sobre las prácticas recomendadas para las instrucciones y la generación de texto en imágenes, consulta Idiomas admitidos para la generación de imágenes.

Modelos de generación de audio (TTS y Live API)

Los modelos que generan audio admiten conjuntos de idiomas especializados y optimizados para la síntesis de voz y (en el caso de Live API) el diálogo bidireccional en tiempo real:

  • Modelos de texto a voz (TTS): Los modelos Gemini 3.x TTS pueden detectar y generar automáticamente voz en casi 80 idiomas y dialectos.

    Para ver la lista completa de idiomas admitidos y códigos de configuración regional BCP-47 disponibles, consulta Idiomas admitidos para la generación de voz.

  • Modelos de Live API: Los modelos de Live API admiten interacciones de voz bidireccionales en tiempo real en casi 80 idiomas y dialectos.

    Para ver la lista completa de idiomas admitidos y obtener información sobre cómo influir en el idioma de la respuesta hablada, consulta Idiomas admitidos para Live API.



Información sobre modelos anteriores

Los siguientes son modelos activos, pero de generaciones anteriores. Te recomendamos que uses uno de los modelos más recientes cuando sea posible.

Si no encuentras la información que buscas en las siguientes subsecciones, puedes encontrar aún más información en la documentación del proveedor de la API que elijas: Gemini Developer API o Agent Platform Gemini API (formerly Vertex AI)

Modelos Gemini más antiguos

  • gemini-2.5-pro
  • gemini-2.5-flash
  • gemini-2.5-flash-lite
  • gemini-2.5-flash-image (también conocido como "Nano Banana")
  • gemini-2.0-flash-001 (y su alias actualizado automáticamente gemini-2.0-flash)
  • gemini-2.0-flash-lite-001 (y su alias actualizado automáticamente gemini-2.0-flash-lite)

Para obtener información sobre los modelos Gemini Live API anteriores, consulta la documentación del proveedor de Gemini API:

Modelos Imagen más antiguos

  • imagen-4.0-ultra-generate-001
  • imagen-4.0-generate-001
  • imagen-4.0-fast-generate-001
  • imagen-3.0-capability-001
  • imagen-3.0-generate-002
  • imagen-3.0-generate-001
  • imagen-3.0-fast-generate-001

Ver detalles sobre modelos anteriores



Próximos pasos

Prueba las capacidades de Gemini API