Kubeez · Audio · Gemini 3.8 Flash TTS
Două voci, o interpretare pentru fiecare replică, 70 de voci la alegere
Gemini 3.8 Flash TTS transformă un scenariu într-o conversație. Scrii una sau două voci ca o listă ordonată de replici, dai fiecărei replici propriul stil de interpretare și adaugi oricare dintre cele 40 de etichete, precum <laugh>, <sigh>, <whispers> sau <short pause>, pe care modelul le interpretează în loc să le citească. Alegi dintre 70 de voci grupate pe cazuri de utilizare, limba se recunoaște direct din text, iar o generare poate avea până la 5.000 de caractere, cu ieșire WAV. Se facturează din același portofel Kubeez ca muzica și video. Imaginile de mai jos sunt materiale ilustrative; toate clipurile din secțiunea de mostre sunt rezultate reale.
Showcase




































































































































































































































Fiecare clip de mai jos este rezultat real de la Gemini 3.8 Flash TTS, nu o machetă. Ascultă mai întâi scena cu două voci, apoi încearcă voci din cazuri de utilizare diferite.
O singură generare cu două voci, Alnilam și Laomedeia, cu un stil de interpretare pe fiecare replică, etichete în text și cuvinte de umplutură activate.
Scenariul așa cum a fost scris (cuvintele de umplutură le adaugă modelul)
Scrii replicile, stabilești interpretarea pentru fiecare și pui etichetele exact acolo unde se potrivește râsul, respirația sau pauza.

Fiecare replică are propriul stil, de exemplu „prezentator de radio obosit, tură de noapte, lent și sec”, așa că aceeași voce își poate schimba starea de la o replică la alta.

Etichetele între semne mai mic și mai mare, precum <laugh>, <sigh>, <gasp> și <long pause>, sunt interpretate, nu citite, așa că replica sună cu expresivitate reală.

Alegi dintre 70 de voci grupate pe cazuri de utilizare: tutor, voce pentru reclame, podcast, povestitor, call center și altele. Limba se detectează din text.
Apelează instrumentul MCP „generate_dialogue” cu furnizorul „gemini-3.8” pentru audio automatizat cu una sau două voci, cu aceleași voci și limite ca în Audio → Dialog.
Transformă notițele într-o discuție. Cuvintele de umplutură adaugă ezitări firești între cele două voci, iar o replică rescrisă înseamnă doar încă o generare.

Alege din cazul de utilizare care ți se potrivește, voce pentru reclame, concierge sau agent de suport tehnic, și păstrează un scenariu întreg într-o singură generare de până la 5.000 de caractere.

Apelezi generate_dialogue cu furnizorul „gemini-3.8”, o listă de voci și replici ordonate: același flux ca în studioul Dialog.

Deschide Audio → Dialog, alege modelul 3.8 Flash și distribuie vocile. Creditele rămân într-un singur portofel, alături de muzică și video.