Análisis de Adobe Firefly: ¿Son buenas estas tres nuevas herramientas de audio con inteligencia artificial?
Hemos probado las tres nuevas herramientas de audio con inteligencia artificial de Adobe Firefly. Descubre su eficacia y si merece la pena probarlas en tu negocio.
Las cosas más importantes que necesitas saber
- Generate Music es la "verdadera ganadora" entre las herramientas, ya que produce pistas inicialmente aceptables que mejoran drásticamente al usar comandos de texto precisos que definen el estado de ánimo, el estilo, el propósito y el nivel de energía.
- La herramienta Generar efectos de sonido es muy útil, requiere comandos de texto manuales precisos y permite añadir varias pistas de audio con control sobre su posición y nivel a lo largo de una línea de tiempo.
- Generate Speech 45 ofrece a los locutores opciones de control de pausa, lo cual resulta útil para los profesionales del marketing y los creadores de contenido para agilizar la producción diaria de vídeos, pero no sustituye la locución profesional.
- Adobe lanza tres nuevas herramientas de audio. con inteligencia artificial Dentro de la luciérnaga
- Los creadores ahora pueden usar las funciones Generar música, Generar voz y Generar efectos de sonido.
- Lo probé para ver cómo funciona en la creación de vídeos.
Tras un periodo de pruebas beta, Adobe Firefly ha lanzado tres nuevas herramientas de audio con inteligencia artificial que prometen un sonido de calidad profesional, disponibles para todos los creadores. Probé cada una de ellas para comprobar si los resultados cumplían con las expectativas y, en general, sí, salvo algunos pequeños inconvenientes.

Generar música, generar efectos de sonido y generar voz son las últimas funciones de audio que se han incorporado a la plataforma de IA basada en navegador de Adobe (sus funciones quedan claras a partir de sus nombres).
Según mi experiencia con las tres herramientas, Generate Music destaca; es mucho mejor de lo que esperaba y creo que tanto los profesionales del marketing como los creadores se beneficiarán enormemente de ella. Puedes probarla tú mismo haciendo clic aquí.
¿Y qué hay de nuevo?
Tres herramientas de IA ya están disponibles para todos. Sus funciones son en gran medida autoexplicativas, pero esto es lo que necesitas saber:
- Generar música Te permite crear pistas de música con licencia que se ajusten a la duración y el ambiente de tus vídeos.
- Generar discurso Los textos escritos se convierten en comentarios de voz.
- Generar efectos de sonido Como ya habrás adivinado, genera efectos de sonido que coinciden con el movimiento y el ritmo del vídeo.
¿Pero es realmente tan bueno?
Ya he escrito anteriormente sobre mi escepticismo hacia la inteligencia artificial en general y mis preocupaciones sobre su uso en obras creativas. No es más que una imitación del arte.
Sin embargo, las herramientas de Adobe impresionaron incluso a los más escépticos de la IA en mi equipo, especialmente funciones como Generative Extend en su software de edición de video. Y como soy una persona de mente abierta, decidí probar estas herramientas por mí mismo y ver qué tal eran en realidad.
El objetivo principal, al menos por el momento, es acelerar el flujo de trabajo creativo tanto para los profesionales del marketing como para los creadores de contenido .
Crear música con inteligencia artificial

Comencé usando la herramienta Generar música , donde puedes ingresar comandos de texto o subir un videoclip, y la IA intentará adivinar el tipo de música que deseas. Usé un clip corto de 27 segundos que había grabado para mi reseña del reMarkable Paper Pure (porque aún estaba en mi carpeta de descargas).
Basándose en esto, Firefly sugirió un comando de script para "una canción electrónica tranquila, profunda y ambiental para la presentación de un producto".
Pulsé el botón Generar y, en cuestión de segundos —la velocidad fue realmente asombrosa—, me aparecieron cuatro pistas para elegir, todas diferentes pero con la misma onda. Eran… aceptables. Un poco genéricas, pero podrían servir en un apuro o para terminar un proyecto rápidamente. (Para más información sobre el impacto de la IA en la industria musical, lee nuestro artículo sobre la exigencia de Apple Music a los artistas de etiquetar la música generada por IA ).
Decidí añadir otros términos al comando del script, como "jazz" y "cinemático", para usarlos en el "vlog" y el "tráiler". Cambié la configuración de "Energía" de "baja" a "media". Los resultados fueron mucho mejores.
Como ocurre con todas las herramientas de IA, cuanto más precisos sean los comandos de texto, mejor será el resultado. También existe la opción de describir la atmósfera, el estilo y el propósito si tienes una idea específica.
Desde aquí puedes descargar música y vídeos, o solo música.
Creación de locuciones generadas por IA

Pasando a la herramienta Generar voz , primero utilicé la barra lateral para seleccionar el modelo de IA que iba a usar; en el momento de escribir esto, estaban disponibles el modelo Firefly de Adobe, comercialmente seguro, y el modelo Multilingual V2 de su socio ElevenLabs.
Luego elegí a un orador de una lista de 45 opciones, cada una de las cuales se describía de forma variable como hombre, mujer, no binario, joven, de mediana edad, anciano, etc.
Finalmente, pegué mi texto en el campo de texto; Firefly puede detectar el idioma que estoy usando, pero tienes la opción de elegirlo tú mismo. Usé el poema "Ozymandias" (con mis más sinceras disculpas a Shelley).
Lo que me gustó aquí es que, una vez que ingresas tu texto, puedes optar por agregar texto adicional o indicarle a la IA que se detenga en ciertos lugares.
Para previsualizar el audio, tuve que seleccionar el clip completo y usar el menú contextual, donde también se puede corregir la pronunciación y ajustar el tono de voz.
Con tanta charla sobre cómo agilizar los flujos de trabajo, esto me parece un error. Lo único que necesita es un botón de inicio en la parte inferior de la pantalla.
Tuve que ajustar los intervalos de pausa para darle espacio al texto, y una vez configurados, podía cambiar los tiempos haciendo clic en el botón de pausa en la pantalla de vista previa. Por alguna razón, fue la palabra "land" la que confundió a la IA, que la pronunció " lan ".
Creación de efectos de sonido (SFX) con inteligencia artificial.

Para esta prueba, volví a usar un vídeo que había grabado para mi reseña del reMarkable; esta vez, se trataba de un clip de 12 segundos que comparaba el reMarkable 2 y el Paper Pure.
Este proceso es mucho más complejo, lo que significa que la IA no adivinará cuáles son los posibles efectos de sonido (SFX). Tuve que describir manualmente lo que quería. Luego, hice clic en "Mejorar solicitud", lo que agregó más descripciones.
Así pues, acabamos con un «silbato deslizante que cae suavemente con un leve tintineo metálico». Al pulsar «Generar», aparecieron rápidamente cuatro variaciones distintas y ensordecedoras. No os voy a mostrar esos resultados. No sería justo para nadie.
En cambio, la afirmación se cambió por un sonido más suave, similar al de un grillo en un campo, durante 12 segundos, para completar la duración del vídeo.
La gran ventaja de la opción de Efectos de Sonido (SFX) es que permite añadir varias pistas de sonido y utilizar controles para ajustar su posición.
Con una línea de tiempo que recorre la parte inferior de la pantalla, se asemeja más a un editor de audio real (al menos hasta cierto punto). Arrastrando los controles de volumen, puedes ajustar el volumen o eliminar una pista.
¿Merece la pena el esfuerzo?
En general, me gustaría ver algunos ajustes en la interfaz de usuario para agilizar el flujo de trabajo de producción.
No creo que vaya a reemplazar a los diseñadores de sonido, compositores y músicos profesionales en un futuro próximo. Pero después de mi experiencia en marketing, veo su utilidad para los profesionales del marketing y la creación de vídeos cotidianos.
El lenguaje hablado ha evolucionado mucho desde los tiempos de las voces robóticas tipo Microsoft Sam, pero para una interpretación vocal precisa, nada supera a un intérprete profesional en un estudio.
Sin embargo, los efectos de sonido (SFX) ofrecen una ventaja mucho mayor. En un amplio rango de generaciones, no pude distinguir entre los sonidos generados por IA y los que se reproducían en un antiguo disco de efectos de sonido que tenía.
La verdadera joya de la corona es la función "Generar música". Incluso la función básica produjo un sonido que no desentonaba en una demostración de producto, una reseña, una explicación comercial o cualquier otra situación similar. Y mejoró con cada generación que realicé.
Por lo tanto, es una actualización que vale la pena explorar para la producción de vídeo a ritmo acelerado.
Los comentarios están cerrados.