Limity i kwoty

Kliknij Gemini API dostawcę, aby wyświetlić na tej stronie treści i kod dostawcy.


Limity częstotliwości (zwane też limitami) regulują liczbę żądań, które możesz wysłać do Gemini API w określonym przedziale czasu. Te limity pomagają zapewnić sprawiedliwe korzystanie z usługi, chronić przed nadużyciami i utrzymywać wydajność systemu dla wszystkich użytkowników.

Gdy używasz Firebase AI Logic do uzyskiwania dostępu do modeli Gemini, limity ograniczania liczby żądań projektu zależą od wybranego dostawcy Gemini API. Firebase AI Logic umożliwia też ustawianie limitów liczby żądań „na użytkownika”.

Wyświetlanie limitów żądań dla Gemini Developer API

Jeśli przekroczysz limit lub jeśli pojemność modelu, do którego masz dostęp, zostanie wyczerpana, otrzymasz komunikat o błędzie 429.

Jak działają limity liczby żądań (limity)

Limity szybkości (limity) są mierzone w 4 wymiarach:

  • Żądania na minutę (RPM)
  • Żądania dziennie (RPD)
  • Tokeny na minutę (TPM)
  • Tokeny dziennie (TPD)

Wykorzystanie jest oceniane na podstawie każdego limitu, a przekroczenie któregokolwiek z nich spowoduje błąd 429 (przekroczono limit). Jeśli na przykład limit RPM wynosi 20, wysłanie 21 żądań w ciągu minuty spowoduje błąd, nawet jeśli nie przekroczysz limitu TPM ani innych limitów.

Limity liczby żądań są stosowane na poziomie projektu i dotyczą wszystkich aplikacji oraz adresów IP, które korzystają z tego projektu Firebase.

Limity różnią się w zależności od używanego modelu, a niektóre z nich dotyczą tylko określonych modeli.

W przypadku modeli eksperymentalnych i wersji zapoznawczych limity liczby żądań są bardziej restrykcyjne.

Prośba o zwiększenie limitu częstotliwości

Jeśli korzystasz z Gemini Developer API w ramach „płatnej wersji”, możesz poprosić o zwiększenie limitu szybkości.

Ustawianie limitów „na użytkownika”

Aby korzystać z usługi Firebase AI Logic, musisz mieć włączonego wybranego dostawcę Gemini API, ale także włączony interfejs API Firebase AI Logic, który działa jako brama między naszymi pakietami SDK klienta a dostawcą Gemini API. Ten interfejs API jest włączany podczas wstępnej konfiguracjiFirebase AI Logic w projekcie w Firebase.

Możesz używać limitu liczby żądań interfejsu Firebase AI Logic API (limitu) jako limitu liczby żądań „na użytkownika” w przypadku aplikacji, zwłaszcza w przypadku funkcji AI, które korzystają z Firebase AI Logic. Ustaw ten limit na poziomie, który umożliwi jednemu użytkownikowi korzystanie z funkcji opartych na AI, a jednocześnie zapewni, że żaden użytkownik nie przekroczy limitów dostawcy Gemini API (które są przeznaczone dla wszystkich użytkowników).

Szczegóły limitu „na użytkownika”

Oto kilka ważnych informacji o Firebase AI Logicograniczaniu liczby żądań interfejsu API (limitach) – a konkretnie o liczbie żądań na minutę (RPM):

  • Jest ona obliczana na podstawie „Żądań generowania treści” na użytkownika, region i minutę i nie zależy od modelu.

  • Jest to limit liczby wiadomości na minutę stosowany do wszystkich użytkowników. Obecnie nie ma możliwości ustawienia limitu szybkości dla konkretnego użytkownika lub konkretnej grupy użytkowników*.

  • Obowiązuje na poziomie projektu i dotyczy wszystkich aplikacji oraz adresów IP, które korzystają z tego projektu w Firebase.

  • Dotyczy to każdego wywołania, które pochodzi z dowolnego pakietu SDK.Firebase AI Logic

  • Domyślny limit to 100 zapytań na minutę na użytkownika.
    Pamiętaj, że nadal musisz uwzględniać limity Gemini API dostawcy (patrz wyżej), które mają wyższy priorytet niż Firebase AI Logic interfejs API.

* Jeśli korzystasz z Agent Platform Gemini API (formerly Vertex AI), a Twoja aplikacja kieruje użytkowników do różnych regionów (np. za pomocą Firebase Remote Config), możesz ustawić określony limit szybkości dla użytkowników w danym regionie.

Dostosowywanie limitu „na użytkownika”

Aby dostosować limit szybkości (limit), musisz mieć uprawnienie serviceusage.quotas.update, które jest domyślnie zawarte w rolach właściciela i edytującego.

Aby edytować limit szybkości (limit) lub poprosić o jego zwiększenie:

  1. W konsoli Google Cloud otwórz stronę Firebase AI Logic API.

  2. Kliknij Zarządzaj.

  3. W dolnej części strony kliknij kartę Limity przydziału i limity systemu.

  4. Przefiltruj tabelę, aby wyświetlić interesujące Cię limity, np. dotyczące możliwości (żądania generowania treści) i regionu.

    Jeśli na przykład chcesz wyświetlić limity dotyczące żądań generowania treści dla poszczególnych użytkowników w dowolnym z obsługiwanych regionów Azji, filtr będzie wyglądać podobnie do tego:Generate content requests + Dimension:region:asia

  5. Zaznacz pole wyboru po lewej stronie każdego limitu, który Cię interesuje.

  6. Na końcu wiersza limitu kliknij , a potem wybierz Edytuj limit.

  7. W formularzu Zmiany limitów wykonaj te czynności:

    1. W polu Nowa wartość wpisz zwiększony limit.

      Ten limit jest stosowany na poziomie projektu i jest wspólny dla wszystkich aplikacji i adresów IP, które korzystają z tego projektu w Firebase.

    2. Wypełnij wszelkie dodatkowe pola w formularzu i kliknij Gotowe.

    3. Kliknij Prześlij prośbę.