Kubeez · Audio · Seed 1.0 Audio (ByteDance)
Un prompt, una escena completa: voces, efectos de sonido y música juntos
Seed 1.0 Audio de ByteDance está basado en prompts: describes la escena y genera las voces, los efectos de sonido y la música de fondo juntos, no solo una voz leyendo una línea. Clona una voz a partir de hasta tres clips de referencia cortos (etiquétalos @Voice1-3) o guía la interpretación con una sola imagen. Ideal para audiolibros, doblaje de video, videojuegos y sketches de radioteatro. Cobrado por segundo de salida desde el mismo monedero de Kubeez que ElevenLabs, Gemini, música y video. Las imágenes de las secciones siguientes son materiales de marketing de Nano Banana 2; el audio proviene del motor de diálogo.
Muestra






























































































































































































































Describe el entorno, la música, la acción y cada voz, y Seed interpreta toda la escena a la vez.

Desde un solo prompt libre, Seed genera las líneas habladas, los efectos de sonido y la música de fondo juntos, así la escena queda terminada en lugar de plana.

Sube hasta tres clips de referencia (30s cada uno), etiquétalos @Voice1, @Voice2, @Voice3 en tu prompt, y Seed dice cada personaje con la voz clonada.

Adjunta una sola imagen y Seed la usa para dar forma a la voz y al ambiente, sin necesidad de un selector de voz aparte.
Usa la herramienta MCP "generate_dialogue" con el proveedor Seed para audio automático basado en prompts y clonación de voz, con el mismo espacio de trabajo que Audio → Diálogo.
Convierte un capítulo en una escena interpretada, con ambiente y música, por una fracción del costo de grabar en estudio, y revísalo editando el prompt.

Clona una voz o descríbela, luego genera líneas más efectos de sonido para doblajes, tráilers y escenas de juegos, todo desde un solo prompt.

Genera audio de Seed desde agentes con el mismo pipeline generate_dialogue: selecciona el proveedor Seed, escribe un prompt y pasa referencias de imagen o audio.

Abre Audio → Diálogo, elige Seed y describe el audio que quieres: voces, efectos y música desde un solo prompt; los créditos quedan en un solo monedero con ElevenLabs, Gemini, música y video.