IA

Suno ahora lee tus textos en voz alta y les compone música en una sola pista

Susan Hill
Añádenos en Google

Suno, la aplicación que se hizo conocida por convertir una instrucción de una sola línea en una canción, ahora hace algo más curioso con tus palabras: las lee en voz alta y compone la música que las acompaña en la misma pasada. Escribe un poema, un brindis o un cuento para dormir, describe la voz y el ambiente que quieres, y Speech te entrega una sola pista en la que la narración y la música se crearon juntas, en lugar de superponerse después. En una producción de audio casera, lo difícil casi nunca ha sido conseguir la voz. Lo complicado ha sido lograr que la voz y la música suenen como si pertenecieran al mismo espacio.

Para quienes preparan brindis de boda, videos cortos, meditaciones guiadas o introducciones para pódcast, esto elimina un paso que normalmente requiere dos aplicaciones y una línea de tiempo de edición. Hoy, el proceso implica producir la narración en un lugar, buscar música de fondo libre de regalías en otro y luego ajustar los niveles de volumen hasta que la música deje de tapar las palabras. La propuesta de Suno es que un solo modelo se encargue de ambas partes, de modo que la banda sonora se componga alrededor del discurso, en vez de añadirse debajo.

Speech tiene dos modos. En el modo Simple, describes una idea —por ejemplo, un capitán pirata que arenga a su tripulación— y Suno escribe las palabras y también las interpreta. El modo Advanced toma un guion escrito por ti y añade controles para elegir el género de la voz, el estilo al hablar y cuánto varía la interpretación de una versión a otra. Las pistas duran alrededor de ocho minutos, suficiente para un cuento completo para dormir o una meditación breve. La música viene activada de forma predeterminada, pero hay una opción para quitarla si solo quieres la narración.

Jack Brody, director de producto de Suno, la describe como el primer modelo de audio que genera voz y música juntas, en una sola pista coherente. La narración sintética por sí sola no es nueva. ElevenLabs, Adobe y Google DeepMind ofrecen tecnologías de conversión de texto a voz que suenan humanas, pero dejan la banda sonora en manos del usuario, que debe producirla por separado y mezclarla manualmente. Suno entra en este terreno desde el lado opuesto: como una compañía musical que incorpora voz, y no como una compañía de voz que incorpora música.

Las limitaciones son reales, y Suno reconoce algunas. La compañía advierte que un acento británico puede desviarse hacia uno australiano y volver, y que las pausas dramáticas pueden ser muy dramáticas. No hay controles para definir la duración exacta ni el momento de cada palabra, y Suno no ha dicho si las voces personalizadas que los usuarios ya pueden grabar para sus canciones funcionan en Speech. Tampoco ha publicado qué idiomas admite la función, una omisión importante para quienes escuchan fuera de los mercados angloparlantes, ni cuántos créditos cuesta una pista narrada. En el plan gratuito, las condiciones estándar de Suno establecen que la compañía conserva la propiedad de lo que generan los usuarios y prohíben el uso comercial; por eso, quienes planeen hacer un pódcast de pago o un anuncio deberían leer primero la letra pequeña.

Speech se habilitó para todos los usuarios de Suno en la web y en las aplicaciones para iOS y Android el 1 de octubre, después de cerca de un mes de pruebas con un grupo reducido. La función todavía lleva la etiqueta de versión beta, utiliza los mismos planes de créditos que la generación de canciones y Suno no ha anunciado cuándo estará lista la versión definitiva.

El lanzamiento también llega en medio de una disputa legal. Warner Music Group llegó a un acuerdo con Suno y le otorgó una licencia en noviembre de 2025, pero Universal Music Group y Sony Music presentaron una nueva demanda en septiembre por los modelos musicales v6. Acusan a la compañía de copiar más de 60.000 grabaciones y reclaman hasta 9.000 millones de dólares en indemnizaciones legales. El caso sigue pendiente ante un tribunal federal de Boston, lo que significa que la música de fondo de tu cuento para dormir proviene de una compañía que todavía debe defender cómo aprendió a crear música.

Etiquetas: , , , , ,

Añádenos en Google

Discussion

There are 0 comments.