Test d'Adobe Firefly : les trois nouveaux outils audio basés sur l'IA sont-ils performants ?

Nous avons testé les trois nouveaux outils audio d'Adobe Firefly basés sur l'IA. Découvrez leur efficacité et s'ils méritent d'être utilisés dans votre travail.

Les choses les plus importantes que vous devez savoir

  • Parmi les outils, Generate Music est le « véritable gagnant », produisant des morceaux initialement acceptables qui s'améliorent considérablement grâce à des commandes textuelles précises définissant l'ambiance, le style, l'objectif et le niveau d'énergie.
  • L'outil Générer des effets sonores est très utile, nécessite des commandes textuelles manuelles précises et permet l'ajout de plusieurs pistes audio avec un contrôle sur leur position et leur niveau sur une chronologie.
  • Generate Speech 45 offre aux locuteurs des options de contrôle de la pause, ce qui est utile aux spécialistes du marketing et aux créateurs de contenu pour accélérer la production vidéo quotidienne, mais ne remplace pas le doublage professionnel.

  • Adobe lance trois nouveaux outils audio Avec l'intelligence artificielle Dans Firefly
  • Les créateurs peuvent désormais utiliser les fonctions Générer de la musique, Générer de la parole et Générer des effets sonores.
  • Je l'ai testé pour voir comment il fonctionne dans la création vidéo.

Après une phase de test bêta, Adobe Firefly a lancé trois nouveaux outils audio basés sur l'IA, promettant un son de qualité studio, accessibles à tous les créateurs. Je les ai testés un par un pour vérifier si les résultats étaient à la hauteur des attentes ; globalement, c'est le cas, malgré quelques petits problèmes.

Les fonctionnalités audio « Générer de la musique », « Générer des effets sonores » et « Générer de la parole » sont les dernières nouveautés à arriver sur la plateforme d'IA d'Adobe basée sur navigateur (leurs fonctions sont claires d'après leurs noms).

D'après mon expérience avec ces trois outils, Generate Music se distingue nettement ; il est bien meilleur que ce à quoi je m'attendais, et je suis convaincu que les spécialistes du marketing et les créateurs en tireront un grand profit. Vous pouvez l'essayer vous-même en cliquant ici.

Alors, quoi de neuf ?

Trois outils d'IA sont désormais accessibles à tous. Leurs fonctions sont en grande partie intuitives, mais voici ce qu'il faut savoir :

  • Générer de la musique Il vous permet de créer des pistes musicales sous licence qui correspondent à la durée et à l'ambiance de vos vidéos.
  • Générer de la parole Les textes écrits sont convertis en commentaires vocaux.
  • Générer des effets sonores Il génère – comme vous l'avez deviné – des effets sonores qui correspondent aux mouvements et au rythme de la vidéo.

Mais est-ce vraiment si bon ?

J'ai déjà écrit sur mon scepticisme envers l'intelligence artificielle en général, et sur mes inquiétudes quant à son utilisation dans les œuvres créatives. Elle n'est qu'une simulation de l'art.

Pourtant, les outils d'Adobe ont impressionné même les plus sceptiques de mon équipe en matière d'IA, notamment des fonctionnalités comme Generative Extend dans son logiciel de montage vidéo. Curieux de nature, j'ai décidé de les tester moi-même pour me faire une idée.

L’objectif ici, du moins pour le moment, est d’accélérer le flux de travail créatif pour les spécialistes du marketing et les créateurs de contenu .

Créer de la musique avec l'intelligence artificielle

Adobe Firefly utilise trois nouveaux outils audio basés sur l'IA pour générer de la musique, de la parole et des effets sonores.

J'ai commencé par utiliser l' outil Générer de la musique , qui permet de saisir librement des commandes textuelles ou d'importer un clip vidéo ; l'IA tente alors de deviner le style de musique souhaité. J'ai utilisé un court extrait de 27 secondes que j'avais enregistré pour mon test de la reMarkable Paper Pure (car il se trouvait encore dans mon dossier Téléchargements).

Partant de ce constat, Firefly a suggéré une commande de script pour « une chanson électronique ambiante, calme et profonde pour une présentation de produit ».

J'ai appuyé sur le bouton Générer et, en quelques secondes – la rapidité était vraiment étonnante –, quatre morceaux m'ont été proposés. Tous différents, mais avec la même ambiance. Ils étaient… acceptables. Un peu génériques, certes, mais ils pourraient dépanner, ou permettre de boucler un projet rapidement. (Pour en savoir plus sur l'impact de l'IA sur l'industrie musicale, consultez notre article sur l'obligation pour les artistes d'étiqueter leur musique générée par IA sur Apple Music .)

J'ai décidé d'ajouter d'autres termes à la commande du script, tels que « jazz » et « cinématique », pour les utiliser dans le « vlog » et la « bande-annonce ». J'ai modifié le paramètre « Énergie » de « faible » à « moyen ». Les résultats étaient bien meilleurs.

Comme pour tous les outils d'IA, plus les commandes textuelles sont précises, meilleur sera le résultat. Vous pouvez également décrire vous-même l'ambiance, le style et l'objectif si vous avez une idée précise.

Vous pouvez télécharger de la musique et des vidéos, ou seulement de la musique, à partir d'ici.

Création de voix off générées par IA

Adobe Firefly utilise trois nouveaux outils audio basés sur l'IA pour générer de la musique, de la parole et des effets sonores.

Passons à l' outil Générer de la parole : j'ai d'abord utilisé la barre latérale pour sélectionner le modèle d'IA à utiliser ; au moment de la rédaction, il y avait le modèle Firefly d'Adobe, commercialement sûr, et le modèle ElevenLabs Multilingual V2 du partenaire.

J'ai ensuite choisi un intervenant parmi une liste de 45 options, chacune étant décrite de manière variable comme homme, femme, non binaire, jeune, d'âge moyen, âgée, etc.

Enfin, j'ai collé mon texte dans le champ prévu à cet effet ; Firefly détecte automatiquement la langue, mais vous pouvez la choisir vous-même. J'ai utilisé le poème « Ozymandias » (avec toutes mes excuses à Shelley).

Ce que j'ai apprécié, c'est qu'une fois le texte saisi, on peut choisir d'ajouter du texte supplémentaire ou de demander à l'IA de s'arrêter à certains endroits.

Pour prévisualiser l'audio, j'ai dû sélectionner l'intégralité du clip et utiliser le menu contextuel ; c'est là que l'on peut également corriger la prononciation et ajuster le ton de la voix.

Avec tous ces discours sur l'accélération des flux de travail, cela me semble une erreur. Il suffirait d'un bouton de démarrage en bas de l'écran.

J'ai dû ajuster les intervalles de pause pour aérer le texte, et une fois réglés, je pouvais modifier les durées en cliquant sur le bouton pause de l'écran d'aperçu. Curieusement, c'est le mot « land » qui a perturbé l'IA, qui l'a prononcé « lan ».

Création d'effets sonores (SFX) alimentés par l'IA

Adobe Firefly utilise trois nouveaux outils audio basés sur l'IA pour générer de la musique, de la parole et des effets sonores.

Pour ce test, j'ai de nouveau utilisé une vidéo que j'avais tournée pour mon test de la reMarkable – cette fois-ci, il s'agissait d'un clip de 12 secondes comparant la reMarkable 2 et la Paper Pure.

Ce processus est bien plus complexe, car l'IA ne devine pas les effets sonores possibles. J'ai dû décrire manuellement ce que je souhaitais. Ensuite, j'ai cliqué sur « Améliorer l'invite », ce qui a ajouté des descriptions supplémentaires.

Nous avons donc obtenu un « sifflement glissé qui retombe doucement avec un léger tintement métallique ». Un clic sur « Générer » a rapidement produit quatre variations différentes, assourdissantes. Je ne vous montrerai pas ces résultats. Ce serait injuste envers tout le monde.

Au lieu de cela, le texte a été modifié en un bruit plus discret de « grillons dans un champ » pendant 12 secondes, pour compléter la durée de la vidéo.

L'atout majeur de l'option Effets sonores (SFX) est la possibilité d'ajouter plusieurs pistes sonores et d'utiliser des poignées pour ajuster leur position.

Avec une barre de progression en bas de l'écran, l'interface ressemble davantage à celle d'un véritable éditeur audio (du moins en partie). En faisant glisser les poignées de volume, vous pouvez ajuster le volume ou supprimer une piste.

L'effort en vaut-il la peine ?

Globalement, j'aimerais voir quelques améliorations de l'interface utilisateur afin d'accélérer le flux de production.

Je ne pense pas que cela remplacera les concepteurs sonores, les compositeurs et les musiciens professionnels de sitôt. Mais après mon expérience en marketing, je vois bien son utilité pour les spécialistes du marketing et la création vidéo au quotidien.

La voix parlée a beaucoup évolué depuis l'époque des voix robotiques à la Microsoft Sam, mais pour une interprétation vocale fidèle, rien ne vaut un comédien professionnel en studio.

Cependant, les effets sonores offrent un avantage bien plus important. Sur plusieurs générations d'appareils, je n'ai pas pu faire la différence entre les sons générés par l'IA et ceux lus sur un vieux disque d'effets sonores que je possédais.

Le véritable atout de cette fonctionnalité est « Générer de la musique ». Même la version de base a produit un son parfaitement adapté à une démonstration de produit, un test, une explication commerciale ou tout autre exercice similaire. Et la qualité s'est améliorée à chaque génération.

Il s'agit donc d'une mise à jour intéressante à explorer pour la production vidéo à rythme soutenu.

 

 

Les commentaires sont fermés.