Adobe Firefly acaba de lanzar tres nuevas herramientas de audio basadas en IA para creadores y especialistas en marketing; las probé todas para ver si valen la pena
Las funciones "Generar música", «Generar voz» y "Generar efectos de sonido" de Adobe Firefly se lanzan hoy al público en general, pero una herramienta de IA se robó el show durante mis pruebas
- Adobe lanza tres nuevas herramientas de audio con IA en Firefly
- Los creadores ya pueden usar "Generate Music", "Generate Speech" y "Generate Sound Effects"
- Las probé para ver cómo funcionan en la creación de videos
Después de estar en fase beta por un tiempo, Adobe Firefly ahora ha puesto a disposición de todos los creadores tres nuevas herramientas de audio con IA que prometen un «sonido con calidad de estudio». Probé cada una de ellas para ver si los resultados eran tan buenos como prometían, y en general cumplieron con las expectativas, aunque con algunas peculiaridades.
Generar música, Generar efectos de sonido y Generar voz son las últimas funciones de audio que llegan a la plataforma de IA basada en navegador de Adobe (no hace falta ser un genio para adivinar para qué sirve cada una).
Según mi experiencia con las tres, Generar música es lo más destacado; es mucho mejor de lo que esperaba y creo que los especialistas en marketing y los creadores le sacarán mucho provecho. Puedes probarlas tú mismo haciendo clic aquí.
Entonces, ¿qué hay de nuevo?
Actualmente hay tres herramientas de IA disponibles para todos. Todas son bastante fáciles de entender, pero esto es lo que necesitas saber.
- Generate Music te permite crear pistas con licencia que se adapten a la duración y al ambiente de tus videos.
- Generate Speech toma guiones y los convierte en voces en off.
- Generate Sound Effects genera —lo adivinaste— efectos de sonido que se adaptan a la acción y al ritmo de un video.
¿Pero son buenos?
Ya he escrito antes sobre mi agnosticismo respecto a la IA en general y mis dudas a la hora de usarla para el trabajo creativo. Es una imitación del arte.
Aun así, las herramientas de Adobe han impresionado incluso a los más escépticos de mi equipo respecto a la IA, en particular funciones como Generative Extend en su software de edición de video. Y yo soy, si algo, de mente abierta. Así que decidí probar estas herramientas por mí mismo para averiguar de qué se trata realmente.
El enfoque aquí, al menos por ahora, gira en torno a acelerar los flujos de trabajo creativos para profesionales como los especialistas en mercadotecnia y los creadores de contenido.
Suscríbete a la newsletter TechRadar Pro para estar al día sobre noticias, análisis, opiniones y más para que tu empresa pueda tener éxito.
Creación de música con IA
Empecé con Generate Music, donde puedes escribir una descripción libre o subir un video, y la IA intenta adivinar qué tipo de música quieres. Usé un clip corto de 27 segundos que grabé para mi reseña del reMarkable Paper Pure (sobre todo porque todavía estaba en mi carpeta de descargas).
Basándose en eso, Firefly sugirió una indicación para «una canción tranquila y reflexiva con un estilo electrónico ambiental para una demostración de producto».
Pulsé «Generar» y, en un par de segundos —la verdad es que es impresionantemente rápido—, me presentó cuatro pistas para elegir, todas diferentes pero con la misma vibra. Estaban… bien. Un poco genéricas, pero servirían en caso de apuro. O para terminar un proyecto a toda prisa.
Decidí agregar algunos términos más a la indicación, como «jazz» y «cinemático», para usarla en un «vlog» y un «tráiler». Cambié la «Energía» de «baja» a «media». Los resultados mejoraron mucho.
Como con todas las herramientas de IA, cuanto más detallada sea la solicitud, mejor será el resultado, y existe la opción de describir tú mismo el ambiente, el estilo y el propósito si tienes una idea en mente.
Puedes descargar la música y el video, o solo la música, desde aquí.
Creación de voces en off con IA
Al pasar a la función «Generar voz», primero utilicé la barra lateral para determinar qué modelo de IA usar; al momento de escribir este artículo, están disponibles Firefly de Adobe, que es una opción comercialmente segura, y el modelo asociado ElevenLabs Multilingual V2.
Luego elegí una voz de una lista de 45, cada una descrita de manera variable como masculina, femenina, no binaria, de adulto joven, de mediana edad, de persona mayor, y así sucesivamente.
Por último, pegué mi texto en el campo de texto; Firefly puede detectar qué idioma estoy usando, pero tienes la opción de elegirlo tú mismo. Utilicé el poema «Ozymandias» (con mis más sinceras disculpas a Shelley).
Lo que me gustó aquí fue que, una vez que el texto está en su lugar, puedes optar por agregar texto adicional o indicarle a la IA que haga una pausa en ciertos puntos.
Para ver una vista previa, tuve que seleccionar todo el pasaje y usar el menú contextual (ahí es donde también se corrige la pronunciación y se ajusta el tono de voz).
A pesar de todo lo que se habla de agilizar los flujos de trabajo, esto me parece un paso en falso. Solo se necesita un botón de reproducción en la parte inferior de la pantalla.
Tuve que ajustar las pausas para darle a mi texto espacio para respirar y, una vez configuradas, pude modificar los tiempos haciendo clic en la pausa en la pantalla de vista previa. Y, por alguna razón, la palabra «land», precisamente, fue la que le dio problemas a la IA, ya que la pronunció como «lan».
Creación de efectos especiales con IA
Para esta prueba, volví a usar un video grabado para mi reseña del reMarkable; esta vez, un clip de 12 segundos en el que se compara el reMarkable 2 con el Paper Pure.
Este proceso es mucho más detallado, en el sentido de que la IA no va a adivinar cuáles deberían ser los efectos de sonido probables. Tuve que describir manualmente lo que quería. Después de eso, hice clic en “Mejorar la indicación”, lo que agregó más descripciones.
Así, terminamos con: «Un silbido deslizante que desciende suavemente con un timbre metálico y una resonancia suave». Al hacer clic en «Generar», el servicio produjo rápidamente cuatro variaciones ensordecedoras. No te haré sufrir esos resultados. No es justo para nadie.
En cambio, cambié la indicación a una más relajante: «grillos en un campo» con una duración de 12 segundos, para completar la duración del video.
Lo bueno de la opción de efectos de sonido (SFX) es que puedes agregar múltiples pistas de audio y usar los controles para ajustar su posición.
Con una línea de tiempo que se extiende en la parte inferior de la pantalla, se siente más como un editor de audio real (al menos hasta cierto punto). Al arrastrar los controles del audio, puedes ajustar aún más el volumen o eliminar la pista.
¿Vale la pena?
En general, me gustaría que se hicieran algunos ajustes en la interfaz de usuario para agilizar los flujos de trabajo de producción.
No creo que vayan a sustituir a los diseñadores de sonido, compositores y músicos profesionales en el corto plazo. Pero, habiendo trabajado en mercadotecnia, veo que tienen su lugar para los profesionales del marketing y la creación de videos cotidianos.
La voz sintética está a años luz de los días en que sonaba como el robótico Microsoft Sam, pero para una interpretación matizada de las líneas, nada va a superar a un actor en una cabina de grabación.
Sin embargo, la sección de efectos de sonido tiene mucha más utilidad. Entre diferentes generaciones, no pude notar la diferencia entre los sonidos generados por IA y los que se reproducen en un viejo CD de efectos de sonido que tengo.
El verdadero ganador aquí es «Generate Music». Incluso con la indicación básica, el audio resultaba adecuado para una demostración de producto, una reseña, un video explicativo de negocios o algo similar. Y mejoraba con cada generación que creaba.
Una actualización que vale la pena explorar, entonces, para la producción rápida de videos.
Sigue a TechRadar en Google Noticias y añádenos como fuente preferida para recibir nuestras noticias, reseñas y opiniones de expertos en tus feeds.
- Steve Clark B2B Editor - Creative & Hardware