สำหรับแอปบนอุปกรณ์เคลื่อนที่และเว็บ Firebase AI Logic SDK จะช่วยให้คุณโต้ตอบ กับGeminiโมเดลที่รองรับได้โดยตรงจากแอป
Gemini โมเดลถือเป็นมัลติโมดัลเนื่องจากสามารถ ประมวลผลและแม้กระทั่งสร้างมัลติโมดัลหลายรายการ ซึ่งรวมถึงข้อความ โค้ด PDF รูปภาพ วิดีโอ และเสียง
นอกจากนี้ โปรดอ่านคำถามที่พบบ่อย เกี่ยวกับโมเดลทั้งหมดที่ Firebase AI Logic รองรับและไม่รองรับ
โมเดลแนะนำ
Gemini 3.8 Flash
gemini-3.8-flash
ประสิทธิภาพระดับแนวหน้าเทียบเท่าโมเดลขนาดใหญ่กว่าในราคาที่ถูกกว่า
มาก
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
โมเดลที่ทำงานหนักซึ่งมีปริมาณมากและคำนึงถึงต้นทุน พร้อมประสิทธิภาพและ
คุณภาพของซีรีส์ Gemini 3
รูปภาพ Gemini 3.1 Flash (Nano Banana 2)
gemini-3.1-flash-image
โมเดลการสร้างและแก้ไขรูปภาพที่มีประสิทธิภาพสูง
ซึ่งเพิ่มประสิทธิภาพสำหรับ Use Case ที่มีความเร็วสูงและมีปริมาณมาก
โมเดลอเนกประสงค์
ไปที่ตารางที่มีรายละเอียดโมเดล
Gemini 3.1 Pro
gemini-3.1-pro-preview
ความสามารถด้านสติปัญญาขั้นสูง ทักษะการแก้ปัญหาที่ซับซ้อน และความสามารถในการเขียนโค้ดแบบเอเจนต์และแบบไวบ์ที่ทรงพลัง
Gemini 3.8 Flash
gemini-3.8-flash
ประสิทธิภาพระดับแนวหน้าเทียบเท่าโมเดลขนาดใหญ่กว่าในราคาที่ถูกกว่า
มาก
Gemini 3.5 Flash-Lite
gemini-3.5-flash-lite
โมเดลที่ทำงานหนักซึ่งมีปริมาณมากและคำนึงถึงต้นทุน พร้อมประสิทธิภาพและ
คุณภาพของซีรีส์ Gemini 3
โมเดลแบบเสถียรรุ่นเก่าที่ใช้ได้ทั่วไป
Gemini 3.7 Flash (
gemini-3.7-flash): โมเดล Gemini 3.x Flash รุ่นก่อนหน้าสำหรับประสิทธิภาพระดับแนวหน้า เทียบเท่าโมเดลขนาดใหญ่กว่าในราคาที่ถูกกว่า (ไม่ต้องมีการเรียกเก็บเงิน)Gemini 3.6 Flash (
gemini-3.6-flash): โมเดล Gemini 3.x Flash รุ่นก่อนหน้าสำหรับประสิทธิภาพระดับแนวหน้า เทียบเท่าโมเดลขนาดใหญ่กว่าในราคาที่ถูกกว่า (ไม่ต้องมีการเรียกเก็บเงิน)Gemini 3.5 Flash (
gemini-3.5-flash): โมเดล Gemini 3.x Flash รุ่นก่อนหน้าสำหรับประสิทธิภาพระดับแนวหน้า เทียบเท่าโมเดลขนาดใหญ่กว่าในราคาที่ถูกกว่า (ไม่ต้องมีการเรียกเก็บเงิน)Gemini 3.1 Flash‑Lite (
gemini-3.1-flash-lite): โมเดล Gemini 3.x Flash‑Lite รุ่นก่อนหน้าสำหรับงานที่มีปริมาณมากและคำนึงถึงต้นทุน (ไม่ต้องมีการเรียกเก็บเงิน)
โมเดลสร้างรูปภาพ
ไปที่ตารางที่มีรายละเอียดโมเดล
รูปภาพ Gemini 3 Pro (Nano Banana Pro)
gemini-3-pro-image
โมเดลการสร้างและแก้ไขรูปภาพที่ล้ำสมัยที่สุดสำหรับการสร้างรูปภาพเนทีฟที่มีบริบทสูง
รูปภาพ Gemini 3.1 Flash (Nano Banana 2)
gemini-3.1-flash-image
โมเดลการสร้างและแก้ไขรูปภาพที่มีประสิทธิภาพสูง
ซึ่งเพิ่มประสิทธิภาพสำหรับความเร็วและ Use Case ที่มีปริมาณมาก
รูปภาพ Gemini 3.1 Flash-Lite (Nano Banana 2 Lite)
gemini-3.1-flash-lite-image
โมเดลการสร้างและแก้ไขรูปภาพที่มีเวลาในการตอบสนองต่ำมากและคุ้มค่า
ซึ่งออกแบบมาสำหรับกรณีการใช้งานแบบอินเทอร์แอกทีฟที่มีปริมาณสูง
โมเดลสร้างเสียง
โมเดลการอ่านออกเสียงข้อความ (TTS)
คุณสร้างคำพูดจากข้อความที่ป้อนได้ด้วยGeminiโมเดล TTS
ไปที่ตารางที่มีรายละเอียดโมเดล
TTS ของ Gemini 3.x Flash
gemini-3.1-flash-tts-preview
การสร้างคำพูดจากข้อความที่ป้อนโดยมีเวลาในการตอบสนองต่ำและมีประสิทธิภาพ
รุ่น Live API
คุณสามารถสร้างเสียงสตรีมแบบ 2 ทางด้วยโมเดลที่รองรับ Gemini Live API
ไปที่ตารางที่มีรายละเอียดโมเดล
Gemini 3.x Flash พร้อมเสียงดั้งเดิมของ Gemini Live API
Gemini Developer API:gemini-3.1-flash-live-preview
Gemini API ของแพลตฟอร์ม Agent:
ไม่รองรับ
เปิดใช้การโต้ตอบด้วยเสียงและการทำงานกับวิดีโอแบบเรียลไทม์ที่มีเวลาในการตอบสนองต่ำกับโมเดล Gemini ที่สื่อสารได้ทั้ง 2 ทาง
Gemini 2.5 Flash พร้อมเสียงดั้งเดิมของ Gemini Live API
Gemini Developer API:gemini-2.5-flash-native-audio-preview-12-2025
Agent Platform Gemini API:gemini-live-2.5-flash-native-audio
เปิดใช้การโต้ตอบด้วยเสียงและการทำงานกับวิดีโอแบบเรียลไทม์ที่มีเวลาในการตอบสนองต่ำกับโมเดล Gemini ที่สื่อสารได้ทั้ง 2 ทาง
ส่วนที่เหลือของหน้านี้จะให้ข้อมูลโดยละเอียดเกี่ยวกับโมเดลที่ Firebase AI Logic รองรับ
-
- อินพุตและเอาต์พุตที่รองรับ
- การเปรียบเทียบความสามารถที่รองรับในระดับสูง
- ข้อกำหนดและข้อจำกัด เช่น โทเค็นอินพุตสูงสุดหรือความยาวสูงสุด ของวิดีโออินพุต
คำอธิบายวิธีกำหนดเวอร์ชันของโมเดล โดยเฉพาะเวอร์ชันเสถียร ตัวอย่าง และทดลอง
รายการชื่อโมเดลที่ใช้ได้เพื่อรวมไว้ใน โค้ดระหว่างการเริ่มต้น
รายการภาษาที่รองรับสำหรับโมเดล
ที่ด้านล่างของหน้านี้ คุณจะดูข้อมูลโดยละเอียดเกี่ยวกับโมเดลรุ่นก่อนหน้าได้
เปรียบเทียบโมเดล
แต่ละโมเดลมีความสามารถแตกต่างกันเพื่อรองรับกรณีการใช้งานที่หลากหลาย โปรดทราบว่า ตารางแต่ละรายการในส่วนนี้จะอธิบายโมเดลแต่ละรายการ เมื่อใช้กับ Firebase AI Logic โมเดลแต่ละรายการอาจมีความสามารถเพิ่มเติม ที่ใช้ไม่ได้เมื่อใช้ SDK ของเรา
หากไม่พบข้อมูลที่ต้องการในส่วนย่อยต่อไปนี้ คุณจะดูข้อมูลเพิ่มเติมได้ในเอกสารประกอบของผู้ให้บริการ API ที่เลือก Gemini Developer API หรือ Agent Platform Gemini API (formerly Vertex AI)
อินพุตและเอาต์พุตที่รองรับ
ตารางต่อไปนี้แสดงประเภทอินพุตและเอาต์พุตที่รองรับ เมื่อใช้แต่ละโมเดลกับ Firebase AI Logic
ดูข้อมูลเกี่ยวกับประเภทไฟล์ที่รองรับได้ที่ไฟล์อินพุตที่รองรับและข้อกำหนด
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| ประเภทอินพุต | ||||||
| ข้อความ | ||||||
| รหัส | ||||||
| เอกสาร (PDF หรือข้อความธรรมดา) |
||||||
| รูปภาพ | ||||||
| วีดีโอ | ||||||
| เสียง | ||||||
| ประเภทเอาต์พุต | ||||||
| ข้อความ | ||||||
| ข้อความ (สตรีมมิง) | ||||||
| รหัส | ||||||
| เอาต์พุตที่มีโครงสร้าง (เช่น JSON) |
||||||
| รูปภาพ | ||||||
| วีดีโอ | ||||||
| เสียง | ||||||
ความสามารถและฟีเจอร์ที่รองรับ
ตารางต่อไปนี้แสดงความสามารถและฟีเจอร์ที่รองรับ เมื่อใช้โมเดลแต่ละรายการกับ Firebase AI Logic
|
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|
|---|---|---|---|---|---|---|
| การคิด | ||||||
| สร้างข้อความที่สร้างขึ้นจาก อินพุตที่เป็นข้อความเท่านั้นหรืออินพุตแบบหลายรูปแบบ | แทรกสลับกับข้อความหรือเป็นส่วนหนึ่งของรูปภาพ | แทรกสลับกับข้อความหรือเป็นส่วนหนึ่งของรูปภาพ | แทรกสลับกับข้อความหรือเป็นส่วนหนึ่งของรูปภาพ | การถอดเสียงเป็นคำ | ||
| สร้างรูปภาพ | ||||||
| แก้ไขรูปภาพ | ||||||
| สร้างเสียง | speech | เสียงที่สตรีม | ||||
|
สร้าง
เอาต์พุตที่มีโครงสร้าง
(เช่น JSON) |
||||||
|
วิเคราะห์เอกสาร
(PDF หรือข้อความธรรมดา) (text-output | image-output) |
||||||
|
วิเคราะห์รูปภาพ (text-output | image-output) |
||||||
|
วิเคราะห์วิดีโอ (text-output | image-output) |
วิดีโอที่สตรีม | |||||
| วิเคราะห์เสียง | เสียงที่สตรีม | |||||
| แชทแบบหลายรอบ | ||||||
| การสตรีมแบบหลายรูปแบบแบบ 2 ทาง | ||||||
| เครื่องมือที่รองรับ | ||||||
| การเรียกใช้ฟังก์ชัน | ||||||
| การเรียกใช้โค้ด | ||||||
| บริบท URL | ||||||
|
การอ้างอิงจาก
|
||||||
|
การอ้างอิงจาก
|
||||||
ข้อกำหนดและข้อจำกัด
ตารางต่อไปนี้แสดงข้อกำหนดและข้อจำกัด เมื่อใช้แต่ละโมเดลกับ Firebase AI Logic
| พร็อพเพอร์ตี้ |
Gemini 3.x Pro, Flash, Flash‑Lite |
Gemini 3.x Pro Image |
Gemini 3.x Flash Image |
Gemini 3.x Flash‑Lite Image |
Gemini 3.x Flash TTS |
Gemini Live |
|---|---|---|---|---|---|---|
| ขีดจำกัดโทเค็นอินพุต * | 1,048,576 โทเค็น | 65,536 โทเค็น | 131,072 โทเค็น | 65,536 โทเค็น | 8,192 โทเค็น | ดูเอกสาร |
| ขีดจำกัดโทเค็นเอาต์พุต * | 65,536 โทเค็น | 32,768 โทเค็น | 32,768 โทเค็น | 4,096 โทเค็น | 16,384 โทเค็น | |
| PDF (ตามคำขอ) | ||||||
| จำนวนไฟล์ PDF อินพุตสูงสุด ** |
900 ไฟล์ | 14 ไฟล์ | 14 ไฟล์ | 14 ไฟล์ | --- | ดูเอกสาร |
| จำนวนหน้าสูงสุด ต่อไฟล์ PDF ที่ป้อน ** |
900 หน้า | 14 หน้า | 14 หน้า | 14 หน้า | --- | |
| ขนาดสูงสุด ต่อไฟล์ PDF อินพุต |
50 MB | 50 MB | 50 MB | 50 MB | --- | |
| Google รูปภาพ (ต่อคำขอ) | ||||||
| จำนวนรูปภาพ อินพุตสูงสุด |
1,000 รูปภาพ | รูปภาพ 14 รูป | รูปภาพ 14 รูป | รูปภาพ 14 รูป | --- | ดูเอกสาร |
| ขนาดสูงสุด ต่อรูปภาพที่เข้ารหัส Base64 ที่ป้อน |
7 MB | 7 MB | 7 MB | 7 MB | --- | |
| จำนวนรูปภาพ เอาต์พุตสูงสุด |
--- | ไม่เกินขีดจำกัดโทเค็นเอาต์พุต | ไม่เกินขีดจำกัดโทเค็นเอาต์พุต | ไม่เกินขีดจำกัดโทเค็นเอาต์พุต | --- | |
| วิดีโอ (ต่อคำขอ) | ||||||
| จำนวนไฟล์วิดีโออินพุตสูงสุด |
10 ไฟล์ | --- | สูงสุดตามขีดจำกัดโทเค็นอินพุต | สูงสุดตามขีดจำกัดโทเค็นอินพุต | --- | ดูเอกสาร |
| ความยาวสูงสุด ของวิดีโออินพุตทั้งหมด (เฉพาะเฟรม) |
ประมาณ 60 นาที | --- | ~25 นาที | ประมาณ 12 นาที | --- | |
| ความยาวสูงสุด ของวิดีโออินพุตทั้งหมด (เฟรม + เสียง) |
~45 นาที | --- | --- | --- | --- | |
| เสียง (ต่อคำขอ) | ||||||
| จำนวนไฟล์เสียงอินพุตสูงสุด |
1 ไฟล์ | --- | --- | --- | --- | ดูเอกสาร |
| ความยาวสูงสุด ของเสียงอินพุตทั้งหมด |
ประมาณ 8.4 ชั่วโมง | --- | --- | --- | --- | |
*
สำหรับโมเดล Gemini ทั้งหมด โทเค็น 1 รายการจะเทียบเท่ากับอักขระประมาณ 4 ตัว
ดังนั้นโทเค็น 100 รายการจึงเทียบเท่ากับคำภาษาอังกฤษประมาณ 60-80 คำ สำหรับโมเดล Gemini คุณสามารถ
กำหนดจำนวนโทเค็นทั้งหมดในคำขอได้โดยใช้
countTokens
** ระบบจะถือว่า PDF เป็นรูปภาพ ดังนั้นหน้า PDF 1 หน้าจึงถือเป็นรูปภาพ 1 รูป ระบบจำกัดจำนวนหน้าในคำขอตามจำนวนรูปภาพที่โมเดลรองรับได้
ดูข้อมูลโดยละเอียดเพิ่มเติม
โควต้าและราคาจะแตกต่างกันไป ในแต่ละโมเดล นอกจากนี้ ราคาจะขึ้นอยู่กับอินพุตและเอาต์พุตด้วย
ดูข้อมูลเกี่ยวกับประเภทไฟล์อินพุตที่รองรับ วิธีระบุประเภท MIME และวิธีตรวจสอบว่าไฟล์อินพุตและคำขอแบบมัลติโมดัลเป็นไปตามข้อกำหนดและแนวทางปฏิบัติแนะนำในไฟล์อินพุตและข้อกำหนดที่รองรับ
รูปแบบการตั้งชื่อและการกำหนดเวอร์ชันของโมเดล
โมเดลมีให้บริการในเวอร์ชันเสถียร ตัวอย่าง และทดลอง เพื่อความสะดวก ระบบรองรับชื่อแทน -latest
อย่าลืมอ่าน แนวทางปฏิบัติแนะนำสำหรับการใช้เวอร์ชันโมเดล
หากต้องการดูชื่อโมเดลที่เฉพาะเจาะจงเพื่อใช้ในโค้ด โปรดดูส่วน"ชื่อโมเดลที่ใช้ได้"ในหน้านี้
| ประเภทเวอร์ชัน / ระยะการเผยแพร่ |
คำอธิบาย | รูปแบบชื่อโมเดล | |
|---|---|---|---|
| เสถียร |
เวอร์ชันเสถียรพร้อมให้บริการและรองรับสำหรับการใช้งานจริงตั้งแต่วันที่ออก
|
ชื่อโมเดลของเวอร์ชันเสถียรจะไม่มีคำต่อท้าย
ตัวอย่าง |
|
| ตัวอย่าง |
เวอร์ชันตัวอย่างมีฟีเจอร์ใหม่ๆ และถือว่าไม่เสถียร
|
ชื่อโมเดลของเวอร์ชันตัวอย่างจะต่อท้ายด้วย
ตัวอย่าง |
|
| ทดลอง |
เวอร์ชันทดลองมีฟีเจอร์ใหม่ๆ
และถือว่าไม่เสถียร
|
ชื่อรุ่นของเวอร์ชันทดลองจะต่อท้ายด้วย
ตัวอย่าง |
|
| ปิดตัว (เลิกใช้งาน) |
เวอร์ชันที่ปิดตัวลง (เลิกใช้งาน) มีวันที่ปิดตัวลง (เลิกใช้งาน) ผ่านมาแล้วและถูกปิดใช้งานอย่างถาวร
|
--- |
|
แนวทางปฏิบัติแนะนำในการใช้เวอร์ชันโมเดล
ในแอปเวอร์ชันที่ใช้งานจริง ให้ใช้ชื่อโมเดลที่ชัดเจนสำหรับเวอร์ชันเสถียรล่าสุด
สำหรับ Agent Platform Gemini API (formerly Vertex AI) หากเลือกใช้โมเดลความพร้อมใช้งานระยะสั้นในแอปเวอร์ชันที่ใช้งานจริง การใช้Firebase Remote Configหรือเทมเพลตพรอมต์ของเซิร์ฟเวอร์ เพื่อควบคุมชื่อโมเดลที่ใช้สำหรับฟีเจอร์ AI จะมีความสำคัญมากยิ่งขึ้น
ใช้เวอร์ชันตัวอย่างและทดลองระหว่างการสร้างต้นแบบเท่านั้น เราขอแนะนำให้ใช้เวอร์ชันเสถียรเมื่อเริ่มพัฒนาและทดสอบสำหรับกรณีการใช้งานจริง
เราไม่แนะนำให้ใช้ชื่อแทน
(แม้ในระหว่างการพัฒนา) นามแฝงนี้ชี้ไปยังรุ่นล่าสุดของโมเดลรูปแบบหนึ่งๆ (ซึ่งอาจเป็นเวอร์ชันเสถียร ตัวอย่าง หรือเวอร์ชันทดลอง) ระบบจะสลับแทนที่นามแฝงนี้เมื่อมีการเผยแพร่รุ่นใหม่ของโมเดลรูปแบบหนึ่งๆ และจะส่งอีเมลแจ้งเตือนล่วงหน้า 2 สัปดาห์เฉพาะในกรณีที่มีการเปลี่ยนแปลงที่ส่งผลกับส่วนอื่นในระบบ ความไม่เสถียรของโมเดลที่คุณใช้จริงอาจทำให้ฟีเจอร์ AI มีการเปลี่ยนแปลงพฤติกรรมที่ไม่คาดคิด-latest
ชื่อโมเดลที่พร้อมใช้งาน
ชื่อโมเดลคือค่าที่ชัดเจนซึ่งคุณใส่ในโค้ดระหว่างการเริ่มต้นโมเดล
โมเดลอเนกประสงค์ (เช่น
gemini-3.8-flash)โมเดลสร้างรูปภาพ (เช่น
gemini-3.1-flash-imageหรือที่เรียกว่าโมเดล "Nano Banana")โมเดลสร้างเสียง:
- โมเดลการอ่านออกเสียงข้อความ (TTS)
(เช่น
gemini-3.1-flash-tts-preview) - Live API โมเดล
(เช่น
gemini-live-2.5-flash-native-audio)
- โมเดลการอ่านออกเสียงข้อความ (TTS)
(เช่น
ดูตัวอย่างการเริ่มต้นใช้งานสำหรับแพลตฟอร์มของคุณได้ในคู่มือเริ่มต้นใช้งาน
ดูรายละเอียดเกี่ยวกับขั้นตอนการเผยแพร่ (โดยเฉพาะกรณีการใช้งาน การเรียกเก็บเงิน และ การปิดตัว) ได้ที่ การกำหนดเวอร์ชันและการตั้งชื่อโมเดล
แสดงรายการโมเดลที่มีทั้งหมดโดยใช้โปรแกรม
คุณแสดงชื่อโมเดลทั้งหมดที่พร้อมใช้งานได้โดยใช้ REST API ดังนี้
Gemini Developer API: โทรหา
models.listAgent Platform Gemini API (formerly Vertex AI): โทรหา
publishers.models.list
โปรดทราบว่ารายการที่แสดงนี้จะมีรุ่นทั้งหมดที่ผู้ให้บริการ API รองรับ แต่ Firebase AI Logic รองรับเฉพาะรุ่น Gemini ที่อธิบายไว้ในหน้านี้
โมเดลอเนกประสงค์
Gemini 3.x Pro ชื่อโมเดล
ต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้ ไม่ว่าคุณจะใช้ผู้ให้บริการ Gemini API รายใดก็ตาม
| ชื่อโมเดล | คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3.1-pro-preview |
Gemini 3.x Pro เวอร์ชันตัวอย่างล่าสุด | แสดงตัวอย่าง | 2026-02-19 | จะแจ้งให้ทราบภายหลัง |
Gemini 3.x Flash ชื่อโมเดล
ไม่จำเป็นต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้หากคุณใช้ Gemini Developer API
| ชื่อโมเดล | คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3.8-flash |
Gemini 3.x Flash เวอร์ชันเสถียรล่าสุด นี่คือรูปแบบความพร้อมใช้งานระยะสั้น (ดู การกำหนดเวอร์ชันและการตั้งชื่อโมเดล) |
สังกัด | 2026-09-02 | จะแจ้งให้ทราบภายหลัง |
gemini-3.7-flash |
Gemini 3.x Flash เวอร์ชันเสถียร นี่คือโมเดลความพร้อมใช้งานระยะสั้น (ดู รูปแบบการตั้งชื่อและการกำหนดเวอร์ชันของโมเดล) |
สังกัด | 2026-08-13 | จะแจ้งให้ทราบภายหลัง |
gemini-3.6-flash |
Gemini 3.x Flash เวอร์ชันเสถียร นี่คือโมเดลความพร้อมใช้งานระยะสั้น (ดู รูปแบบการตั้งชื่อและการกำหนดเวอร์ชันของโมเดล) |
สังกัด | 2026-07-21 | จะแจ้งให้ทราบภายหลัง |
gemini-3.5-flash |
เวอร์ชันเสถียรของ Gemini 3.x Flash | สังกัด | 2026-05-19 | ไม่เร็วกว่า 2027-05-19 |
gemini-3-flash-preview |
เวอร์ชันตัวอย่างของ Gemini 3.x Flash | แสดงตัวอย่าง | 2025-12-17 | จะแจ้งให้ทราบภายหลัง |
Gemini 3.x Flash‑Lite ชื่อโมเดล
ไม่จำเป็นต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้หากคุณใช้ Gemini Developer API
| ชื่อโมเดล | คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3.5-flash-lite |
Gemini 3.x Flash‑Lite เวอร์ชันเสถียรล่าสุด | สังกัด | 2026-07-21 | ไม่เร็วกว่า 2027-07-21 |
gemini-3.1-flash-lite |
เวอร์ชันเสถียรของ Gemini 3.x Flash‑Lite | สังกัด | 2026-05-07 | ไม่เร็วกว่า 2027-05-07 |
โมเดลสร้างรูปภาพ
ชื่อโมเดล Gemini 3.x Pro Image (หรือที่เรียกว่า "Nano Banana Pro")
ต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้ ไม่ว่าคุณจะใช้ผู้ให้บริการ Gemini API รายใดก็ตาม
| ชื่อโมเดล | คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3-pro-image |
เวอร์ชันเสถียรของ Gemini 3.x Pro Image (หรือที่เรียกว่า "Nano Banana Pro") |
สังกัด | 2026-05-28 | ไม่เร็วกว่า 2027-05-28 |
gemini-3-pro-image-preview |
เวอร์ชันตัวอย่างของ Gemini 3.x Pro Image (หรือที่เรียกว่า "Nano Banana Pro") |
แสดงตัวอย่าง | 2025-11-20 | เร็วที่สุดคือ 2026-06-25 |
ชื่อโมเดล Gemini 3.x Flash Image (หรือที่เรียกว่า "Nano Banana 2")
ต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้ ไม่ว่าคุณจะใช้ผู้ให้บริการ Gemini API รายใดก็ตาม
| ชื่อโมเดล | คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3.1-flash-image |
เวอร์ชันเสถียรของ Gemini 3.x Flash Image (หรือที่เรียกว่า "Nano Banana 2") |
สังกัด | 2026-05-28 | ไม่เร็วกว่า 2027-05-28 |
gemini-3.1-flash-image-preview |
เวอร์ชันตัวอย่างของ Gemini 3.x Flash Image (หรือที่เรียกว่า "Nano Banana 2") |
แสดงตัวอย่าง | 2026-02-26 | เร็วที่สุดคือ 2026-06-25 |
ชื่อโมเดล Gemini 3.x Flash‑Lite Image (หรือที่เรียกว่า "Nano Banana 2 Lite")
ต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้ ไม่ว่าคุณจะใช้ผู้ให้บริการ Gemini API รายใดก็ตาม
| ชื่อโมเดล | คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3.1-flash-lite-image |
เวอร์ชันเสถียรของ Gemini 3.x Flash‑Lite Image (หรือที่เรียกว่า "Nano Banana 2 Lite") นี่คือโมเดลความพร้อมใช้งานระยะสั้น (ดู รูปแบบการกำหนดเวอร์ชันและการตั้งชื่อโมเดล) |
สังกัด | 2026-06-30 | จะแจ้งให้ทราบภายหลัง |
โมเดลเสียง - การอ่านออกเสียงข้อความ (TTS)
Gemini 3.x Flash TTS ชื่อโมเดล
ไม่จำเป็นต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้หากคุณใช้ Gemini Developer API
| ชื่อโมเดล | คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3.1-flash-tts-preview |
เวอร์ชันตัวอย่างสำหรับ Gemini 3.x Flash TTS | แสดงตัวอย่าง | 2026-06-17 | จะแจ้งให้ทราบภายหลัง |
เสียง - Live API โมเดล
Gemini 3.x Flash Live ชื่อโมเดล
| Gemini Developer API ชื่อโมเดล |
คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-3.1-flash-live-preview 1 |
เวอร์ชันตัวอย่างสำหรับ Live API ใน Gemini Developer API | แสดงตัวอย่าง | 2026-03-26 | จะแจ้งให้ทราบภายหลัง |
| Agent Platform Gemini API (formerly Vertex AI) ชื่อโมเดล |
คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
| Agent Platform Gemini API (formerly Vertex AI) ไม่รองรับโมเดล Gemini Live 3.x | ||||
1 รองรับเท่านั้นโดย Gemini Developer API
นอกจากนี้ แม้ว่าจะเป็นโมเดลเวอร์ชันตัวอย่าง แต่ก็พร้อมใช้งานใน "รุ่นฟรี" ของ Gemini Developer API
Gemini 2.5 Flash Live ชื่อโมเดล
ไม่จำเป็นต้องใช้แพ็กเกจราคา Blaze แบบจ่ายเมื่อใช้หากคุณ ใช้ Gemini Developer API (โดยปกติแล้วโมเดลเวอร์ชันตัวอย่างต้องใช้แพ็กเกจแบบชำระเงิน )
แม้ว่าโมเดลต่อไปนี้จะมีชื่อรุ่นแตกต่างกันไปตาม Gemini ผู้ให้บริการ API แต่ฟีเจอร์ของโมเดลจะเหมือนกัน
| Gemini Developer API ชื่อโมเดล |
คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-2.5-flash-native-audio-preview-12-2025 1 |
เวอร์ชันตัวอย่างสำหรับ Live API ใน Gemini Developer API | แสดงตัวอย่าง | 2025-12-12 | จะแจ้งให้ทราบภายหลัง |
gemini-2.5-flash-native-audio-preview-09-2025 1 |
เวอร์ชันตัวอย่างเริ่มต้นสำหรับ Live API ใน Gemini Developer API | แสดงตัวอย่าง | 2025-09-18 | จะแจ้งให้ทราบภายหลัง |
| Agent Platform Gemini API (formerly Vertex AI) ชื่อโมเดล |
คำอธิบาย | ขั้นตอนการเผยแพร่ | วันที่วางจำหน่าย | วันที่ปิด |
|---|---|---|---|---|
gemini-live-2.5-flash-native-audio 2 |
เวอร์ชันเสถียรสำหรับ Live API ใน Agent Platform Gemini API (formerly Vertex AI) | สังกัด | 2025-12-12 | ไม่เร็วกว่า 12-12-2026 |
gemini-live-2.5-flash-preview-native-audio-09-2025 2 |
เวอร์ชันตัวอย่างสำหรับ Live API ใน Agent Platform Gemini API (formerly Vertex AI) | แสดงตัวอย่าง | 2025-09-18 | จะแจ้งให้ทราบภายหลัง |
1 รองรับเท่านั้นโดย Gemini Developer API
นอกจากนี้ แม้ว่าจะเป็นโมเดลเวอร์ชันตัวอย่าง แต่โมเดลเหล่านี้ก็พร้อมใช้งานใน "รุ่นฟรี" ของ Gemini Developer API
2 รองรับโดย Agent Platform Gemini API (formerly Vertex AI) เท่านั้น
นอกจากนี้ โมเดลเหล่านี้ไม่พร้อมใช้งานในglobal
ภาษาที่สนับสนุน
โมเดลอเนกประสงค์
Geminiโมเดลอเนกประสงค์ทั้งหมด (เช่น Gemini 3.8 Flash, Gemini 3.5 Flash-Lite, Gemini 3.1 Pro และโมเดล 3.x รุ่นก่อนหน้า) สามารถทำความเข้าใจและตอบกลับได้ในกว่า 100 ภาษา
แอฟริกาใต้ (af), แอลเบเนีย (sq), อัมฮารา (am), อารบิก (ar),
อาร์เมเนีย (hy), อัสสัม (as), อาเซอร์ไบจาน (az), บาสก์ (eu),
เบลารุส (be), เบงกาลี (bn), บอสเนีย (bs), บัลแกเรีย (bg),
คาตาลัน (ca), เซบูอาโน (ceb), จีน (ตัวย่อและตัวเต็ม) (zh),
คอร์ซิกา (co), โครเอเชีย (hr), เช็ก (cs), เดนมาร์ก (da), มัลดีฟส์ (dv),
ดัตช์ (nl), อังกฤษ (en), เอสเปรันโต (eo), เอสโตเนีย (et),
ฟิลิปปินส์ (ตากาล็อก) (fil), ฟินแลนด์ (fi), ฝรั่งเศส (fr), ฟรีเซีย (fy),
กาลิเซีย (gl), จอร์เจีย (ka), เยอรมัน (de), กรีก (el), คุชราต (gu),
ครีโอลเฮติ (ht), เฮาซา (ha), ฮาวาย (haw), ฮีบรู (iw),
ฮินดี (hi), ม้ง (hmn), ฮังการี (hu), ไอซ์แลนด์ (is), อิกโบ (ig),
อินโดนีเซีย (id), ไอริช (ga), อิตาลี (it), ญี่ปุ่น (ja),
ชวา (jv), กันนาดา (kn), คาซัค (kk), เขมร (km), เกาหลี (ko),
คริโอ (kri), เคิร์ด (ku), คีร์กีซ (ky), ลาว (lo), ละติน (la),
ลัตเวีย (lv), ลิทัวเนีย (), ลักเซมเบิร์ก (lb), มาซิโดเนีย (mk),
มาลากาซี (mg), มาเลย์ (ms), มาลายาลัม (ml), มอลตา (mt), เมารี (mi),
มราฐี (mr), เมเตลอน (มณีปุระ) (mni-Mtei), มองโกเลีย (mn),
พม่า (my), เนปาล (ne), นอร์เวย์ (no),
ญานจา (ชิเชวา) (ny), โอเดีย (โอริยา) (be), ปาทาน (bn), เปอร์เซีย (fa),
โปแลนด์ (bg), โปรตุเกส (pt), ปัญจาบ (pa), โรมาเนีย (zh),
รัสเซีย (co), ซามัว (sm), สก็อตแลนด์ (gd), เซอร์เบีย (sr),
โซโท (st), โชนา (sn), สินธี (sd), สิงหล (si),
สโลวัก (sk), สโลวีเนีย (sl), โซมาเลีย (so), สเปน (es),
ซุนดา (su), สวาฮิลี (sw), สวีเดน (sv), ทาจิก (tg), ทมิฬ (ta),
เตลูกู (te), ไทย (th), ตุรกี (tr), ยูเครน (uk), อูรดู (ur),
อุยกูร์ (ug), อุซเบก (uz), เวียดนาม (vi), เวลส์ (cy), โคซา (xh),
ยิดดิช (yi), โยรูบา (yo) และซูลู (zu)ltorpsplroru
โมเดลสร้างรูปภาพ
Gemini 3.x Image โมเดลสามารถรับพรอมต์ข้อความได้หลายภาษา อย่างไรก็ตาม ระบบจะเพิ่มประสิทธิภาพเพื่อให้ได้ประสิทธิภาพสูงสุด (ทั้งสำหรับพรอมต์ข้อความและสำหรับการแสดงข้อความภายในรูปภาพจาก Generative AI ที่สร้างขึ้น) ในภาษาและภาษาต่อไปนี้
อาหรับ (ar-EG), เยอรมัน (de-DE), อังกฤษ (EN), สเปน (es-MX),
ฝรั่งเศส (fr-FR), ฮินดี (hi-IN), อินโดนีเซีย (id-ID), อิตาลี (it-IT),
ญี่ปุ่น (ja-JP), เกาหลี (ko-KR), โปรตุเกส (pt-BR), รัสเซีย (ru-RU),
ยูเครน (uk-UA), เวียดนาม (vi-VN) และจีนตัวย่อ (zh-CN)
ดูข้อมูลเพิ่มเติมเกี่ยวกับแนวทางปฏิบัติแนะนำสำหรับพรอมต์และการสร้างข้อความในรูปภาพได้ที่ภาษาที่รองรับสำหรับการสร้างรูปภาพ
โมเดลการสร้างเสียง (TTS และ Live API)
โมเดลการสร้างเสียงรองรับชุดภาษาเฉพาะทางที่ได้รับการเพิ่มประสิทธิภาพสำหรับการสังเคราะห์เสียงพูดและ (สำหรับ Live API) บทสนทนาแบบสองทางแบบเรียลไทม์
โมเดลการอ่านออกเสียงข้อความ (TTS): Gemini 3.x TTS โมเดลสามารถตรวจหาและสร้างเสียงพูดในภาษาและภาษาถิ่นเกือบ 80 ภาษาได้โดยอัตโนมัติ
หากต้องการดูรายชื่อภาษาที่รองรับทั้งหมดและรหัสภาษา BCP-47 ที่มี ให้ โปรดดูภาษาที่รองรับสำหรับการสร้างคำพูด
โมเดลLive API: โมเดลLive APIรองรับการโต้ตอบด้วยเสียงแบบเรียลไทม์และแบบ 2 ทิศทางในภาษาและภาษาถิ่นเกือบ 80 ภาษา
หากต้องการดูรายการภาษาที่รองรับทั้งหมดและดูวิธีเปลี่ยนภาษาที่ พูดตอบ โปรดดู ภาษาที่รองรับสำหรับ Live API
ข้อมูลเกี่ยวกับรุ่นก่อนหน้า
รุ่นต่อไปนี้ยังใช้งานได้ แต่เป็นรุ่นก่อนหน้า เราขอแนะนำให้ใช้โมเดลล่าสุดแทนหากเป็นไปได้
หากไม่พบข้อมูลที่ต้องการในส่วนย่อยต่อไปนี้ คุณจะดูข้อมูลเพิ่มเติมได้ในเอกสารประกอบของผู้ให้บริการ API ที่เลือก Gemini Developer API หรือ Agent Platform Gemini API (formerly Vertex AI)
Gemini รุ่นเก่า
gemini-2.5-progemini-2.5-flashgemini-2.5-flash-litegemini-2.5-flash-image(หรือที่เรียกว่า "Nano Banana")gemini-2.0-flash-001(และนามแฝงที่อัปเดตโดยอัตโนมัติgemini-2.0-flash)gemini-2.0-flash-lite-001(และนามแฝงที่อัปเดตโดยอัตโนมัติgemini-2.0-flash-lite)
ดูข้อมูลเกี่ยวกับGemini Live APIรุ่นเก่าได้ในเอกสารประกอบของผู้ให้บริการGemini API
โมเดล Imagen รุ่นเก่า
imagen-4.0-ultra-generate-001imagen-4.0-generate-001imagen-4.0-fast-generate-001imagen-3.0-capability-001imagen-3.0-generate-002imagen-3.0-generate-001imagen-3.0-fast-generate-001
ดูรายละเอียดเกี่ยวกับโมเดลก่อนหน้า
ขั้นตอนถัดไป
ลองใช้ความสามารถของ Gemini API
- สร้างการสนทนาแบบหลายรอบ (แชท)
- สร้างข้อความที่สร้างขึ้นจากพรอมต์ข้อความเท่านั้น
- สร้างข้อความโดยการป้อนพรอมต์ด้วยไฟล์ประเภทต่างๆ เช่น รูปภาพ PDF วิดีโอ และ เสียง
- สร้างเอาต์พุตที่มีโครงสร้าง (เช่น JSON) จากทั้งข้อความและพรอมต์หลายรูปแบบ
- สร้างและแก้ไขรูปภาพ จากทั้งพรอมต์ข้อความและพรอมต์หลายรูปแบบ
- สร้างคำพูด (ทั้งแบบผู้พูดคนเดียวและ หลายคน) โดยใช้Geminiโมเดลการอ่านออกเสียงข้อความ (TTS)
- สตรีมอินพุตและเอาต์พุต (รวมถึงเสียง) โดยใช้ Gemini Live API
-
ใช้เครื่องมือ (เช่น การเรียกใช้ฟังก์ชัน
และการอ้างอิงกับ
Google Search หรือGoogle Maps ) เพื่อเชื่อมต่อโมเดล Gemini กับส่วนอื่นๆ ของแอปและระบบภายนอก รวมถึงข้อมูล