Informacje o obsługiwanych modelach

W przypadku aplikacji mobilnych i internetowych pakiety SDK Firebase AI Logic umożliwiają interakcję z obsługiwanymi Gemini modelami bezpośrednio z aplikacji.

Modele Gemini są uważane za wielomodalne, ponieważ potrafią przetwarzać, a nawet generować różne typy treści, w tym tekst, kod, pliki PDF, obrazy, filmy i dźwięk.

Zapoznaj się też z naszymi odpowiedziami na najczęstsze pytania na temat wszystkich modeli, które Firebase AI Logic obsługuje i których nie obsługuje.

SZYBKI I INTELIGENTNY

gemini-3.8-flash

Wydajność klasy Frontier porównywalna z większymi modelami przy ułamku kosztów. (płatności nie są wymagane)

ULTRA FAST

gemini-3.5-flash-lite

Wydajny model do zadań wymagających dużych nakładów pracy, w których istotne są koszty, o wydajności i jakości serii Gemini 3. (płatności nie są wymagane)

GENEROWANIE OBRAZÓW

gemini-3.1-flash-image

Wydajny model do generowania i edytowania obrazów o wysokiej skuteczności, zoptymalizowany pod kątem szybkości i zastosowań wymagających dużych nakładów pracy. (wymagane rozliczenie)

Modele ogólnego zastosowania

 Przejdź do tabel ze szczegółami modelu

gemini-3.1-pro-preview

Zaawansowana inteligencja, umiejętności rozwiązywania złożonych problemów i zaawansowane możliwości kodowania agentowego i vibe coding. (wymagane rozliczenie)

gemini-3.8-flash

Wydajność klasy Frontier porównywalna z większymi modelami przy ułamku kosztów. (płatności nie są wymagane)

gemini-3.5-flash-lite

Wydajny model do zadań wymagających dużych nakładów pracy, w których istotne są koszty, o wydajności i jakości serii Gemini 3. (płatności nie są wymagane)

Starsze stabilne modele ogólnego zastosowania
  • Gemini 3.7 Flash (gemini-3.7-flash): poprzedni model Gemini 3.x Flash o wydajności porównywalnej z najlepszymi modelami, ale za ułamek ceny. (płatności nie są wymagane)

  • Gemini 3.6 Flash (gemini-3.6-flash): poprzedni model Gemini 3.x Flash o wydajności porównywalnej z najlepszymi modelami, ale za ułamek ceny. (płatności nie są wymagane)

  • Gemini 3.5 Flash (gemini-3.5-flash): poprzedni model Gemini 3.x Flash o wydajności porównywalnej z najlepszymi modelami, ale za ułamek ceny. (płatności nie są wymagane)

  • Gemini 3.1 Flash‑Lite (gemini-3.1-flash-lite): poprzedni model Gemini 3.x Flash‑Lite do zadań wymagających dużych nakładów pracy i wrażliwych na koszty. (płatności nie są wymagane)

Modele generujące obrazy

 Przejdź do tabel ze szczegółami modelu

gemini-3-pro-image

Najnowocześniejszy model do generowania i edytowania obrazów, który umożliwia tworzenie wysoce kontekstowych obrazów natywnych. (wymagane rozliczenie)

gemini-3.1-flash-image

Wydajny model do generowania i edytowania obrazów o wysokiej skuteczności, zoptymalizowany pod kątem szybkości i zastosowań wymagających dużych nakładów pracy. (wymagane rozliczenie)

gemini-3.1-flash-lite-image

Model do generowania i edytowania obrazów z bardzo małym opóźnieniem i przystępną ceną, zaprojektowany z myślą o interaktywnych zastosowaniach wymagających dużych nakładów pracy. (wymagane rozliczenie)

Modele generujące dźwięk

Modele zamiany tekstu na mowę (TTS)

Możesz generować mowę na podstawie tekstu za pomocą Gemini modeli TTS.

 Przejdź do tabel ze szczegółami modelu

gemini-3.1-flash-tts-preview

Zaawansowane generowanie mowy z niskim czasem oczekiwania na podstawie tekstu. (płatności nie są wymagane)

Live API modelu

Możesz generować dwukierunkowy strumieniowy dźwięk za pomocą modeli, które obsługują Gemini Live API.

 Przejdź do tabel ze szczegółami modelu

Gemini Developer API:
gemini-3.1-flash-live-preview

Interfejs Agent Platform Gemini API:
nie jest obsługiwany

Umożliwia interakcje głosowe i wideo w czasie rzeczywistym z niewielkimi opóźnieniami przy użyciu modelu Gemini, który jest dwukierunkowy. (płatności nie są wymagane)

Gemini Developer API:
gemini-2.5-flash-native-audio-preview-12-2025

Agent Platform Gemini API:
gemini-live-2.5-flash-native-audio

Umożliwia interakcje głosowe i wideo w czasie rzeczywistym z niewielkimi opóźnieniami przy użyciu modelu Gemini, który jest dwukierunkowy. (płatności nie są wymagane)


W dalszej części tej strony znajdziesz szczegółowe informacje o modelach obsługiwanych przez Firebase AI Logic.

  • Porównaj modele:

    • Obsługiwane wejścia i wyjścia
    • Ogólne porównanie obsługiwanych funkcji
    • Specyfikacje i ograniczenia, np. maksymalna liczba tokenów wejściowych lub maksymalna długość filmu wejściowego
  • Opis sposobu obsługi wersji modeli, a w szczególności ich wersji stabilnych, wersji zapoznawczych i eksperymentalnych.

  • Listy dostępnych nazw modeli, które można uwzględnić w kodzie podczas inicjowania.

  • Listy obsługiwanych języków w przypadku modeli

U dołu tej strony możesz wyświetlić szczegółowe informacje o modelach poprzedniej generacji.



Porównanie modeli

Każdy model ma inne możliwości, które pozwalają obsługiwać różne przypadki użycia. Pamiętaj, że każda tabela w tej sekcji opisuje poszczególne modele w przypadku użycia z Firebase AI Logic. Każdy model może mieć dodatkowe możliwości, które nie są dostępne podczas korzystania z naszych pakietów SDK.

Jeśli nie możesz znaleźć potrzebnych informacji w tych podsekcjach, więcej informacji znajdziesz w dokumentacji wybranego dostawcy interfejsu API:Gemini Developer API lub Agent Platform Gemini API (formerly Vertex AI).

Obsługiwane wejścia i wyjścia

W tabeli poniżej znajdziesz listę obsługiwanych typów danych wejściowych i wyjściowychw przypadku korzystania z poszczególnych modeli w Firebase AI Logic.

Więcej informacji o obsługiwanych typach plików znajdziesz w artykule Obsługiwane pliki wejściowe i wymagania.

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
Typy danych wejściowych
Tekst
Kod
Dokumenty
(pliki PDF lub zwykły tekst)
Obrazy
Wideo
Dźwięk
Typy danych wyjściowych
Tekst
Tekst (strumieniowanie)
Kod
Uporządkowane dane wyjściowe
(np. JSON)
Obrazy
Wideo
Dźwięk

Obsługiwane możliwości i funkcje

W tabeli poniżej znajdziesz listę obsługiwanych funkcji i możliwościw przypadku korzystania z poszczególnych modeli z Firebase AI Logic.

Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
Myślenie
Generowanie tekstu na podstawie danych wejściowych zawierających tylko tekst lub danych multimodalnych przeplatany lub jako część obrazu przeplatany lub jako część obrazu przeplatany lub jako część obrazu transkrypcja dźwięku,
Generowanie obrazów
Edytowanie obrazów
Wygeneruj dźwięk speech streamowane audio
Generowanie danych wyjściowych w formacie strukturalnym
(np. JSON)
Analizowanie dokumentów
(plików PDF lub zwykłego tekstu)
(dane wyjściowe w formie tekstu | dane wyjściowe w formie obrazu)
Analizuj obrazy
(text-output | image-output)
Analizuj film
(text-output | image-output)
film strumieniowany,
Analizowanie dźwięku streamowane audio
Czat wieloetapowy
Dwukierunkowe odtwarzanie multimodalne
Obsługiwane narzędzia
Wywoływanie funkcji
Wykonanie kodu
Kontekst adresu URL
Grounding z użyciemGoogle Search
Grounding z użyciemGoogle Maps

Specyfikacje i ograniczenia

W tabeli poniżej znajdziesz specyfikacje i ograniczeniadotyczące korzystania z poszczególnych modeli w przypadku Firebase AI Logic.

Właściwość Gemini 3.x
Pro, Flash, Flash‑Lite
Gemini 3.x
Pro
Image
Gemini 3.x
Flash
Image
Gemini 3.x
Flash‑Lite
Image
Gemini 3.x
Flash
TTS
Gemini
Live
Limit tokenów wejściowych* 1 048 576 tokenów 65 536 tokenów 131 072 tokeny 65 536 tokenów 8192 tokeny zobacz dokumentację,
Limit tokenów wyjściowych* 65 536 tokenów 32 768 tokenów 32 768 tokenów 4096 tokenów 16 384 tokeny
Pliki PDF (na żądanie)
Maksymalna liczba
wejściowych plików PDF **
900 plików 14 plików 14 plików 14 plików --- zobacz dokumentację,
Maksymalna liczba
stron
w wejściowym pliku PDF **
900 stron 14 stron 14 stron 14 stron ---
Maksymalny rozmiar
na wejściowy plik PDF
50 MB 50 MB 50 MB 50 MB ---
Grafika (z uwzględnieniem żądań)
Maksymalna liczba
obrazów wejściowych
1000 obrazów 14 obrazów 14 obrazów 14 obrazów --- zobacz dokumentację,
Maksymalny rozmiar
na wejściowy obraz zakodowany w formacie Base64
7 MB 7 MB 7 MB 7 MB ---
Maksymalna liczba
obrazów wyjściowych
--- Do limitu tokenów wyjściowych Do limitu tokenów wyjściowych Do limitu tokenów wyjściowych ---
Wideo (z uwzględnieniem żądań)
Maksymalna liczba
plików wideo wejściowych
10 plików --- Do limitu tokenów wejściowych Do limitu tokenów wejściowych --- zobacz dokumentację,
Maksymalna długość
wszystkich filmów wejściowych
(tylko klatki)
~60 minut --- ~25 minut ~12 minut ---
Maksymalna długość
wszystkich filmów wejściowych
(klatki + dźwięk)
~45 minut --- --- --- ---
Dźwięk (z uwzględnieniem żądań)
Maksymalna liczba
wejściowych plików audio
1 plik --- --- --- --- zobacz dokumentację,
Maksymalna długość
wszystkich wejściowych plików audio
Ok.8,4 godziny --- --- --- ---

* W przypadku wszystkich modeli Gemini token odpowiada około 4 znakom, więc 100 tokenów to około 60–80 słów w języku angielskim. W przypadku modeli Gemini możesz określić łączną liczbę tokenów w żądaniach za pomocą countTokens.

** Pliki PDF są traktowane jako obrazy, więc jedna strona pliku PDF jest traktowana jako jeden obraz. Liczba stron dozwolonych w żądaniu jest ograniczona do liczby obrazów, które może obsługiwać model.

Znajdowanie dodatkowych szczegółowych informacji

  • Limity i ceny są różne w przypadku poszczególnych modeli. Ceny zależą też od danych wejściowych i wyjściowych.

  • Więcej informacji o obsługiwanych typach plików wejściowych, sposobie określania typu MIME oraz o tym, jak upewnić się, że pliki wejściowe i żądania multimodalne spełniają wymagania i są zgodne ze sprawdzonymi metodami, znajdziesz w artykule Obsługiwane pliki wejściowe i wymagania.



Wersje modeli i wzorce nazewnictwa

Modele są dostępne w wersjach stabilnej, testowej i eksperymentalnej. Dla wygody obsługiwane są aliasy -latest, ale nie są one zalecane ze względu na niespójność w zakresie wersji modelu, do których się odnoszą.

Zapoznaj się z naszymi sprawdzonymi metodami korzystania z wersji modelu.

Aby znaleźć konkretne nazwy modeli do użycia w kodzie, zapoznaj się z sekcją „Dostępne nazwy modeli” poniżej.

Typ wersji /
Etap publikacji
Opis Wzorzec nazwy modelu
Stabilny Stabilne wersje są dostępne i obsługiwane do użytku produkcyjnego od daty premiery.
  • Wersja stabilna modelu jest zwykle udostępniana z datą wycofania, która oznacza ostatni dzień, w którym model jest dostępny. Po tej dacie model nie będzie już dostępny ani obsługiwany przez Google.
  • Większość stabilnych modeli jest dostępna przez 12 miesięcy od daty ich premiery (nawet jeśli pojawi się model zastępczy).
  • W przypadku Agent Platform Gemini API (formerly Vertex AI) niektóre stabilne modele są dostępne tylko krótkoterminowo, co oznacza, że mogą zostać wycofane już po 45 dniach od wprowadzenia modelu zastępczego.

Nazwy modeli wersji stabilnych nie mają sufiksu

Przykład:
gemini-3.8-flash

Podgląd Wersje przedpremierowe mają nowe funkcje i są uważane za niestabilne.
  • Te modele nie są zalecane do użytku w środowisku produkcyjnym, mają bardziej restrykcyjne ograniczenia liczby żądań i mogą podlegać wymaganiom dotyczącym płatności.
  • Te modele są wyłączane (wycofywane) w ciągu kilku tygodni lub miesięcy od wydania powiązanej z nimi wersji stabilnej.
  • W przypadku Agent Platform Gemini API (formerly Vertex AI) modele podglądu są dostępne tylko w global.

Nazwy modeli w wersjach testowych mają na końcu symbol -preview.

Przykład:
gemini-3-pro-preview

Eksperymentalne Wersje eksperymentalne mają nowe funkcje i są uważane za niestabilne.
  • Te modele nie są zalecane do użytku produkcyjnego i mają bardziej restrykcyjne ograniczenia liczby żądań. Modele eksperymentalne są przeznaczone do zbierania opinii i umożliwiania eksperymentowania z naszymi najnowszymi funkcjami.
  • Te modele są wyłączane (wycofywane) w ciągu kilku tygodni lub miesięcy od wydania powiązanej z nimi wersji stabilnej.
  • W przypadku Agent Platform Gemini API (formerly Vertex AI) modele eksperymentalne są tylko dostępne w global.

Nazwy modeli wersji eksperymentalnych są uzupełniane o symbol -exp oraz datę wydania modelu (-MM-DD).

Przykład:
gemini-2.5-pro-exp-03-25
(wydany 25 marca 2025 r.)

Wyłącz (wycofane) Wersje wyłączone (wycofane) przekroczyły datę wyłączenia (wycofania) i zostały trwale dezaktywowane.
  • Modele wyłączone (wycofane) nie są już dostępne ani obsługiwane przez Google, a żądanie z użyciem nazwy wycofanego modelu zwraca błąd 404.

---

Sprawdzone metody korzystania z wersji modelu

  • W aplikacjach produkcyjnych używaj nazwy modelu w przypadku najnowszej stabilnej wersji.

    W przypadku Agent Platform Gemini API (formerly Vertex AI), jeśli w aplikacji produkcyjnej zdecydujesz się użyć modelu dostępności krótkoterminowej, tym ważniejsze jest, aby używać Firebase Remote Config lub szablonów promptów na serwerze, aby kontrolować nazwę modelu używaną w funkcji AI.

  • Wersji testowych i eksperymentalnych używaj tylko podczas tworzenia prototypów. Zalecamy używanie wersji stabilnej podczas rozpoczynania programowania i testowania w przypadku zastosowania produkcyjnego.

  • Nie zalecamy używania aliasów -latest (nawet podczas tworzenia aplikacji). Ten alias wskazuje najnowszą wersję konkretnego wariantu modelu (może to być wersja stabilna, podglądowa lub eksperymentalna). Ten alias będzie wymieniany na gorąco z każdą nową wersją konkretnego modelu. E-mail z powiadomieniem o zmianach powodujących niezgodność będzie wysyłany 2 tygodnie wcześniej. Ta niestabilność, która polega na tym, że nie wiesz, z którego modelu korzystasz, może prowadzić do nieoczekiwanych zmian w działaniu funkcji AI.



Dostępne nazwy modeli

Nazwy modeli to jawne wartości, które umieszczasz w kodzie podczas inicjowania modelu.

Przykłady inicjowania na Twojej platformie znajdziesz w przewodniku dla początkujących.

Szczegółowe informacje o etapach udostępniania (zwłaszcza przypadki użycia, rozliczenia i wyłączanie) znajdziesz w artykule Wersjonowanie modeli i wzorce nazewnictwa.

Programowe wyświetlanie listy wszystkich dostępnych modeli

Za pomocą interfejsu REST API możesz wyświetlić listę nazw wszystkich dostępnych modeli:

Pamiętaj, że zwrócona lista będzie zawierać wszystkie modele obsługiwane przez dostawców interfejsu API, ale Firebase AI Logic obsługuje tylko modele Gemini opisane na tej stronie.

Modele ogólnego zastosowania

Gemini 3.x Pro nazwy modeli

Wymaga abonamentu Blaze z płatnością według wykorzystania niezależnie od dostawcy Gemini API.

Nazwa modelu Opis Etap publikacji Data premiery Data wyłączenia
gemini-3.1-pro-preview Najnowsza wersja testowa Gemini 3.x Pro Podgląd 2026-02-19 Jeszcze nieznany

Gemini 3.x Flash nazwy modeli

Niewymaga abonamentu Blaze w modelu płatności według wykorzystania, jeśli korzystasz z Gemini Developer API.

Nazwa modelu Opis Etap publikacji Data premiery Data wyłączenia
gemini-3.8-flash Najnowsza stabilna wersja Gemini 3.x Flash
Jest to model o krótkoterminowej dostępności (patrz Wersjonowanie i nazewnictwo modeli).
Stabilny 2026-09-02 Jeszcze nieznany
gemini-3.7-flash Stabilna wersja Gemini 3.x Flash
Jest to model o krótkoterminowej dostępności (patrz Wersjonowanie modeli i wzorce nazewnictwa).
Stabilny 2026-08-13 Jeszcze nieznany
gemini-3.6-flash Wersja stabilna Gemini 3.x Flash
Jest to model o krótkoterminowej dostępności (patrz Wersje modeli i wzorce nazewnictwa).
Stabilny 2026-07-21 Jeszcze nieznany
gemini-3.5-flash Wersja stabilna Gemini 3.x Flash Stabilny 2026-05-19 Nie wcześniej niż
19 maja 2027 r.
gemini-3-flash-preview Wersja testowa modelu Gemini 3.x Flash Podgląd 2025-12-17 Jeszcze nieznany

Gemini 3.x Flash‑Lite nazwy modeli

Niewymaga abonamentu Blaze w modelu płatności według wykorzystania, jeśli korzystasz z Gemini Developer API.

Nazwa modelu Opis Etap publikacji Data premiery Data wyłączenia
gemini-3.5-flash-lite Najnowsza stabilna wersja Gemini 3.x Flash‑Lite Stabilny 2026-07-21 Nie wcześniej niż
2027-07-21
gemini-3.1-flash-lite Wersja stabilna Gemini 3.x Flash‑Lite Stabilny 2026-05-07 Nie wcześniej niż
7 maja 2027 r.

Modele generujące obrazy

Nazwy modeli Gemini 3.x Pro Image (czyli „Nano Banana Pro”)

Wymaga abonamentu Blaze z płatnością według wykorzystania niezależnie od dostawcy Gemini API.

Nazwa modelu Opis Etap publikacji Data premiery Data wyłączenia
gemini-3-pro-image Wersja stabilna Gemini 3.x Pro Image
(znana też jako „Nano Banana Pro”)
Stabilny 2026-05-28 Nie wcześniej niż
28 maja 2027 r.
gemini-3-pro-image-preview Wersja testowa modelu Gemini 3.x Pro Image
(znanego też jako „Nano Banana Pro”)
Podgląd 2025-11-20 Najwcześniej
25.06.2026

Nazwy modeli Gemini 3.x Flash Image (znane też jako „Nano Banana 2”)

Wymaga abonamentu Blaze z płatnością według wykorzystania niezależnie od dostawcy Gemini API.

Nazwa modelu Opis Etap publikacji Data premiery Data wyłączenia
gemini-3.1-flash-image Wersja stabilna Gemini 3.x Flash Image
(znana też jako „Nano Banana 2”)
Stabilny 2026-05-28 Nie wcześniej niż
28 maja 2027 r.
gemini-3.1-flash-image-preview Wersja testowa modelu Gemini 3.x Flash Image
(znanego też jako „Nano Banana 2”)
Podgląd 2026-02-26 Najwcześniej
25.06.2026

Nazwy modeli Gemini 3.x Flash‑Lite Image (czyli „Nano Banana 2 Lite”)

Wymaga abonamentu Blaze z płatnością według wykorzystania niezależnie od dostawcy Gemini API.

Nazwa modelu Opis Etap publikacji Data premiery Data wyłączenia
gemini-3.1-flash-lite-image Stabilna wersja Gemini 3.x Flash‑Lite Image
(znana też jako „Nano Banana 2 Lite”)
Jest to model o krótkoterminowej dostępności (patrz Wersje modeli i wzorce nazewnictwa).
Stabilny 2026-06-30 Jeszcze nieznany

Modele audio – zamiana tekstu na mowę (TTS)

Gemini 3.x Flash TTS nazwy modeli

Niewymaga abonamentu Blaze w modelu płatności według wykorzystania, jeśli korzystasz z Gemini Developer API.

Nazwa modelu Opis Etap publikacji Data premiery Data wyłączenia
gemini-3.1-flash-tts-preview Wersja testowa: Gemini 3.x Flash TTS Podgląd 2026-06-17 Jeszcze nieznany

Dźwięk – Live API modeli

Gemini 3.x Flash Live nazwy modeli

Gemini Developer API
Nazwa modelu
Opis Etap publikacji Data premiery Data wyłączenia
gemini-3.1-flash-live-preview 1 Wersja testowa Live API na urządzeniu Gemini Developer API Podgląd 2026-03-26 Jeszcze nieznany
Agent Platform Gemini API (formerly Vertex AI)
Nazwa modelu
Opis Etap publikacji Data premiery Data wyłączenia
Agent Platform Gemini API (formerly Vertex AI) nie obsługuje żadnych modeli Gemini Live 3.x.

1 Tylko obsługiwane przez Gemini Developer API. Chociaż jest to model w wersji testowej, jest on dostępny w ramach „poziomu bezpłatnego” Gemini Developer API.

Gemini 2.5 Flash Live nazwy modeli

Nie wymaga planu cenowego Blaze w przypadku płatności według wykorzystania, jeśli korzystasz z Gemini Developer API (zwykle modele w wersji podglądowej wymagają płatnego planu).

Chociaż poniższe modele mają różne nazwy w zależności od dostawcy interfejsu APIGemini, ich funkcje są takie same.

Gemini Developer API
Nazwa modelu
Opis Etap publikacji Data premiery Data wyłączenia
gemini-2.5-flash-native-audio-preview-12-2025 1 Wersja testowa Live API na urządzeniu Gemini Developer API Podgląd 2025-12-12 Jeszcze nieznany
gemini-2.5-flash-native-audio-preview-09-2025 1 Wstępna wersja podglądu Live API na urządzeniu Gemini Developer API Podgląd 2025-09-18 Jeszcze nieznany
Agent Platform Gemini API (formerly Vertex AI)
Nazwa modelu
Opis Etap publikacji Data premiery Data wyłączenia
gemini-live-2.5-flash-native-audio 2 Wersja stabilna Live API na Agent Platform Gemini API (formerly Vertex AI) Stabilny 2025-12-12 Nie wcześniej niż
12 grudnia 2026 r.
gemini-live-2.5-flash-preview-native-audio-09-2025 2 Wersja testowa Live API na urządzeniu Agent Platform Gemini API (formerly Vertex AI) Podgląd 2025-09-18 Jeszcze nieznany

1 Tylko obsługiwane przez Gemini Developer API. Chociaż są to modele w wersji testowej, są one dostępne w ramach „poziomu bezpłatnego” Gemini Developer API.
2 Tylko obsługiwane przez Agent Platform Gemini API (formerly Vertex AI). Poza tym te modele nie są dostępne w lokalizacji global.



Obsługiwane języki

Modele ogólnego zastosowania

Wszystkie Geminimodele ogólnego zastosowania (takie jak Gemini 3.8 Flash, Gemini 3.5 Flash-Lite, Gemini 3.1 Pro i starsze modele z serii 3.x) rozumieją ponad 100 języków i potrafią w nich odpowiadać:

afrikaans (af), albański (sq), amharski (am), arabski (ar), armeński (hy), asamski (as), azerbejdżański (az), baskijski (eu), białoruski (be), bengalski (bn), bośniacki (bs), bułgarski (bg), kataloński (ca), cebuański (ceb), chiński uproszczony i tradycyjny (zh), korsykański (co), chorwacki (hr), czeski (cs), duński (da), malediwski (dv), holenderski (nl), angielski (en), esperanto (eo), estoński (et), filipiński (tagalski) (fil), fiński (fi), francuski (fr), fryzyjski (fy), galicyjski (gl), gruziński (ka), niemiecki (de), grecki (el), gudżarati (gu), kreolski haitański (ht), hausa (ha), hawajski (haw), hebrajski (iw), hindi (hi), hmong (hmn), węgierski (hu), islandzki (is), igbo (ig), indonezyjski (id), irlandzki (ga), włoski (it), japoński (ja), jawajski (jv), kannada (kn), kazachski (kk), khmerski (km), koreański (ko), krio (kri), kurdyjski (ku), kirgiski (ky), laotański (lo), łaciński (la), łotewski (lv), litewski (lt), luksemburski (lb), macedoński (mk), malgaski (mg), malajski (ms), malajalam (ml), maltański (mt), maoryski (mi), marathi (mr), meitei (manipuri) (mni-Mtei), mongolski (mn), birmański (my), nepalski (ne), norweski (no), nyanja (chichewa) (ny), odia (orija) (or), paszto (ps), perski (fa), polski (pl), portugalski (pt), pendżabski (pa), rumuński (ro), rosyjski (ru), samoański (sm), szkocki gaelicki (gd), serbski (sr), sesotho (st), shona (sn), sindhi (sd), syngaleski (si), słowacki (sk), słoweński (sl), somalijski (so), hiszpański (es), sundajski (su), suahili (sw), szwedzki (sv), tadżycki (tg), tamilski (ta), telugu (te), tajski (th), turecki (tr), ukraiński (uk), urdu (ur), ujgurski (ug), uzbecki (uz), wietnamski (vi), walijski (cy), xhosa (xh), jidysz (yi), joruba (yo) i zulu (zu).

Modele generujące obrazy

Modele Gemini 3.x Image akceptują prompty tekstowe w wielu językach. Są one jednak zoptymalizowane pod kątem najlepszej skuteczności (zarówno w przypadku promptów tekstowych, jak i renderowania tekstu w obrazach wygenerowanych przez AI) w tych językach i lokalizacjach:

arabski (ar-EG), angielski (EN), francuski (fr-FR), hindi (hi-IN), hiszpański (es-MX), indonezyjski (id-ID), japoński (ja-JP), koreański (ko-KR), niemiecki (de-DE), portugalski (pt-BR), rosyjski (ru-RU), ukraiński (uk-UA), wietnamski (vi-VN), włoski (it-IT) i chiński uproszczony (zh-CN).

Więcej informacji o sprawdzonych metodach dotyczących promptów i generowania tekstu na obrazach znajdziesz w artykule Obsługiwane języki generowania obrazów.

Modele generujące dźwięk (TTS i Live API)

Modele generujące dźwięk obsługują specjalistyczne zestawy językowe zoptymalizowane pod kątem syntezy mowy i (w przypadku Live API) dwukierunkowego dialogu w czasie rzeczywistym:

  • Modele zamiany tekstu na mowę (TTS): modele Gemini 3.x TTS mogą automatycznie wykrywać i generować mowę w prawie 80 językach i dialektach.

    Pełną listę obsługiwanych języków i dostępnych kodów ustawień regionalnych w standardzie BCP-47 znajdziesz w artykule Obsługiwane języki do generowania mowy.

  • Live API modele:Live API modele obsługują dwukierunkowe interakcje głosowe w czasie rzeczywistym w prawie 80 językach i dialektach.

    Aby zobaczyć pełną listę obsługiwanych języków i dowiedzieć się, jak wpływać na język odpowiedzi głosowej, zapoznaj się z artykułem Obsługiwane języki w przypadku Live API.



Informacje o poprzednich modelach

Są to aktywne modele starszej generacji. W miarę możliwości zalecamy korzystanie z jednego z najnowszych modeli.

Jeśli nie możesz znaleźć potrzebnych informacji w tych podsekcjach, więcej informacji znajdziesz w dokumentacji wybranego dostawcy interfejsu API:Gemini Developer API lub Agent Platform Gemini API (formerly Vertex AI)

Starsze modele Gemini

  • gemini-2.5-pro
  • gemini-2.5-flash
  • gemini-2.5-flash-lite
  • gemini-2.5-flash-image (znany też jako „Nano Banana”)
  • gemini-2.0-flash-001 (i jego automatycznie aktualizowany alias gemini-2.0-flash)
  • gemini-2.0-flash-lite-001 (i jego automatycznie aktualizowany alias gemini-2.0-flash-lite)

Informacje o starszych modelach Gemini Live API znajdziesz w dokumentacji dostawcy Gemini API:

Starsze modele Imagen

  • imagen-4.0-ultra-generate-001
  • imagen-4.0-generate-001
  • imagen-4.0-fast-generate-001
  • imagen-3.0-capability-001
  • imagen-3.0-generate-002
  • imagen-3.0-generate-001
  • imagen-3.0-fast-generate-001

Wyświetlanie szczegółów poprzednich modeli



Dalsze kroki

Wypróbuj możliwości Gemini API