Gemini 2.5 models will shut down in October 2026. To avoid service disruptions,
update to a newer model (like
gemini-3.7-flash or gemini-3.1-flash-image).
Any stable Gemini Live API 2.5 models are not impacted.
Learn more.
Google utilizza la tecnologia AI per tradurre i contenuti nella tua lingua preferita. Le traduzioni generate dall'AI potrebbero contenere errori.
Sia i modelli di sintesi vocale (TTS) sia i modelli Live API sono modelli a bassa latenza,
che generano parlato e possono essere configurati per diverse voci di risposta
e lingue. Tuttavia, servono casi d'uso molto diversi.
La generazione di sintesi vocale (TTS) è un'interazione
unidirezionale di richiesta-risposta (testo in, audio out). È pensata per scenari che richiedono la recitazione esatta del testo fornito con un controllo granulare su stile e suono, come la narrazione di podcast, audiolibri o la lettura di articoli ad alta voce.
Live API generazione supporta
bidirezionale streaming per conversazioni vocali in tempo reale (voce in,
voce out). È ideale in contesti conversazionali dinamici in cui il modello decide il parlato applicabile da restituire. Tieni presente che i modelli più recenti Live API
supportano anche l'input di video e immagini.
[[["Facile da capire","easyToUnderstand","thumb-up"],["Il problema è stato risolto","solvedMyProblem","thumb-up"],["Altra","otherUp","thumb-up"]],[["Mancano le informazioni di cui ho bisogno","missingTheInformationINeed","thumb-down"],["Troppo complicato/troppi passaggi","tooComplicatedTooManySteps","thumb-down"],["Obsoleti","outOfDate","thumb-down"],["Problema di traduzione","translationIssue","thumb-down"],["Problema relativo a esempi/codice","samplesCodeIssue","thumb-down"],["Altra","otherDown","thumb-down"]],["Ultimo aggiornamento 2026-08-23 UTC."],[],[]]