ספירת טוקנים במודלים של Gemini

מודלים של Gemini מעבדים קלט ופלט ביחידות שנקראות טוקנים.

האסימונים יכולים להיות תווים בודדים כמו z או מילים שלמות כמו cat. מילים ארוכות מפוצלות לכמה טוקנים. קבוצת כל האסימונים שבהם נעשה שימוש במודל נקראת אוצר המילים, והתהליך של פיצול טקסט לאסימונים נקרא טוקניזציה.

במודלים של Gemini, טוקן שווה בערך ל-4 תווים. ‫100 טוקנים שווים בערך ל-60 עד 80 מילים באנגלית.

לכל מודל יש מספר טוקנים מקסימלי שהוא יכול לטפל בו בהנחיה ובתשובה. אם יודעים כמה טוקנים יש בהנחיה, אפשר לדעת אם חרגתם מהמגבלה. בנוסף, העלות של בקשה נקבעת בחלקה לפי מספר הטוקנים של הקלט והפלט, ולכן כדאי לדעת איך לספור טוקנים.

מודלים נתמכים

  • gemini-3.1-pro-preview
  • ‫gemini-3.8-flash (וגרסאות ישנות יותר: gemini-3.7-flash,‏ gemini-3.6-flash ו-gemini-3.5-flash)
  • ‫gemini-3.5-flash-lite (וגם gemini-3.1-flash-lite)
  • ‫gemini-3-pro-image (או Nano Banana Pro)
  • ‫gemini-3.1-flash-image (נקרא גם Nano Banana 2)
  • ‫gemini-3.1-flash-lite-image (נקרא גם Nano Banana 2 Lite)
  • gemini-3.1-flash-tts-preview

מודלים של Gemini 2.5 לשימוש כללי וליצירת תמונות תומכים ביכולת הזו, אבל כולם הוצאו משימוש.

אפשרויות לספירת טוקנים

כל הקלט והפלט של Gemini API עוברים טוקניזציה, כולל טקסט, קובצי תמונות וסוגים אחרים של נתונים שאינם טקסט. אלה האפשרויות לספירת טוקנים:

בודקים את מספר הטוקנים של הבקשות בלבד (לפני ששולחים אותן למודל).
מתקשרים אל countTokens עם הקלט של הבקשה לפני ששולחים אותה אל המודל. הפלט שמתקבל:
  • ‫total_tokens: כמות הטוקנים של הקלט בלבד
בודקים את מספר הטוקנים גם בבקשות וגם בתשובות.
ניגשים למאפיין usageMetadata באובייקט התגובה. זה כולל:
  • ‫prompt_token_count: כמות הטוקנים בקלט בלבד
  • ‫candidates_token_count: כמות הטוקנים בפלט בלבד (לא כולל טוקנים של חשיבה)
  • ‫thoughts_token_count: מספר הטוקנים של החשיבה ששימשו ליצירת התשובה
  • ‫total_token_count: ספירה כוללת של הטוקנים עבור הקלט והפלט (כולל טוקנים של חשיבה)

כשמבצעים סטרימינג של פלט, המאפיין usageMetadata מופיע רק בחלק האחרון של הסטרימינג. הוא nil עבור חלקים ביניים.

חשוב לשים לב לנקודות הבאות לגבי האפשרויות שלמעלה:

  • הם לא יספרו את מספר תמונות הקלט או את מספר השניות בקובצי קלט של וידאו או אודיו. עם זאת, מספר האסימונים לכל אחת מהשיטות האלה יהיה קשור לערכים האלה.
  • ספירת האסימונים של הקלט כוללת את ההנחיה (טקסט וכל קובצי הקלט), וגם את כל ההוראות והכלים של המערכת.
  • כמות הטוקנים בפלט לא כוללת טוקנים של חשיבה, כי הם מופיעים בשדה נפרד.
  • בהמשך הדף מופיע מידע נוסף שספציפי לכל סוג בקשה.
  • מודלים של Gemini Live API לא תומכים ב-countTokens. בנוסף, Firebase AI Logic עדיין לא תומך במאפיין usageMetadata בתשובה ממודלים של Live API, אבל זה יקרה בקרוב.

המחירים של האפשרויות האלה

  • קריאה ל-countTokens: אין חיוב על קריאה ל-countTokens (ה-API של Count Tokens). המכסה המקסימלית של Count Tokens API היא 3,000 בקשות לדקה (RPM).

  • שימוש במאפיין usageMetadata: המאפיין הזה תמיד מוחזר כחלק מהתשובה, ולא כרוך בשימוש בטוקנים או בחיוב.

מידע נוסף

הנה מידע נוסף על עבודה עם סוגים ספציפיים של בקשות.

ספירת טוקנים של קלט טקסט

אין מידע נוסף.

ספירת טוקנים בשיחה עם זיכרון

כשמתקשרים אל countTokens בצ'אט, חשוב לשים לב לנקודות הבאות:

  • אם מתקשרים אל countTokens עם היסטוריית הצ'אט, הפונקציה מחזירה את המספר הכולל של הטוקנים משני התפקידים בצ'אט (total_tokens).
  • כדי להבין מה יהיה גודל התגובה הבאה שלכם בשיחה, צריך לצרף אותה להיסטוריה כשמתקשרים אל countTokens.

ספירת טוקנים של קלט מולטי-מודאלי

חשוב לשים לב לנקודות הבאות לגבי ספירת טוקנים עם קלט מולטימודאלי:

  • אפשר גם להתקשר אל countTokens בנפרד לגבי הטקסט והקובץ.
  • בשתי האפשרויות לספירת טוקנים, תקבלו את אותו מספר טוקנים בין אם תספקו את הקובץ כנתונים מוטבעים או באמצעות כתובת ה-URL שלו.

קובצי קלט של תמונות

קובצי קלט של תמונות מומרים לטוקנים על סמך המידות שלהם:

  • תשומות של תמונות ששני הממדים שלהן קטנים מ-384 פיקסלים או שווים להן: כל תמונה נספרת כ-258 טוקנים.
  • תמונות קלט שגדולות יותר באחד מהממדים או בשניהם: כל תמונה נחתכת ומשנה את הגודל לפי הצורך לאריחים בגודל 768x768 פיקסלים, ואז כל אריח נספר כ-258 טוקנים.

קובצי קלט של וידאו ואודיו

קובצי וידאו ואודיו להזנה מומרים לטוקנים בשיעורים הקבועים הבאים:

  • סרטון: 263 טוקנים לשנייה
  • אודיו: 32 טוקנים לשנייה

קבצי קלט של מסמכים (כמו קובצי PDF)

קובצי PDF שמוזנים נחשבים לתמונות, ולכן כל דף בקובץ PDF עובר טוקניזציה באותו אופן כמו תמונה.