Kubeez · Audio · Gemini 3.8 Flash TTS
Dos voces, una interpretación para cada línea, 70 voces para elegir
Gemini 3.8 Flash TTS convierte un guion en una conversación. Escribe una o dos voces como una lista ordenada de líneas, da a cada línea su propio estilo de interpretación y añade cualquiera de las 40 etiquetas, como <laugh>, <sigh>, <whispers> o <short pause>, que el modelo interpreta en lugar de leerlas en voz alta. Elige entre 70 voces agrupadas por caso de uso, deja que el idioma salga directamente del texto y genera hasta 5.000 caracteres por vez, con salida WAV. Se factura desde la misma cartera de Kubeez que la música y el vídeo. Las imágenes de abajo son ilustraciones de marketing; todos los clips de la sección de muestras son resultados reales.
Showcase




































































































































































































































Cada clip de abajo es un resultado real de Gemini 3.8 Flash TTS, no una maqueta. Escucha primero la escena a dos voces y después prueba voces de distintos casos de uso.
Una sola generación con dos voces, Alnilam y Laomedeia, un estilo de interpretación en cada línea, etiquetas dentro del texto y muletillas activadas.
Guion tal como se escribió (las muletillas las añade el modelo)
Escribe las líneas, fija la interpretación de cada una y coloca las etiquetas justo donde van la risa, la respiración o la pausa.

Cada línea lleva su propio estilo, por ejemplo «locutor de radio cansado del turno de noche, lento y seco», así que una misma voz puede cambiar de ánimo de una línea a otra.

Las etiquetas entre ángulos, como <laugh>, <sigh>, <gasp> y <long pause>, se interpretan en vez de leerse, y la línea suena con expresividad real.

Elige entre 70 voces agrupadas por caso de uso: tutor, locución comercial, podcast, narrador, call center y más. El idioma se detecta a partir del texto.
Llama a la herramienta MCP «generate_dialogue» con el proveedor «gemini-3.8» para audio automatizado con una o dos voces, con las mismas voces y límites que Audio → Diálogo.
Convierte tus notas en una conversación. Las muletillas añaden dudas naturales entre las dos voces, y reescribir una línea es solo una generación más.

Elige el caso de uso que encaje, una locución comercial, una conserjería o un agente de soporte técnico, y mantén un guion entero en una sola generación de hasta 5.000 caracteres.

Llama a generate_dialogue con el proveedor «gemini-3.8», una lista de voces y turnos de diálogo ordenados: el mismo flujo que el estudio de Diálogo.

Abre Audio → Diálogo, elige el modelo 3.8 Flash y reparte las voces. Los créditos siguen en una sola cartera, junto con la música y el vídeo.