Abstrakte KI-Visualisierung fuer ein neues Sprachmodell

Google met la musique AI dans l’application Gemini avec Lyria 3.5

Google a activé Lyria 3.5, son modèle de génération de musique, pour tous les utilisateurs Gemini début septembre, transformant une invite de texte en une chanson complète.

La société déploie le modèle dans le monde entier sur le web et dans l’application mobile Gemini, et l’offre également à travers l’API Gemini, Google AI Studio, Google Flow Music et Google Vids. Google appelle Lyria 3.5 son modèle musical le plus sonore encore, avec des voix plus expressives et des arrangements plus riches que son prédécesseur.

Chansons complètes, pas seulement des clips

Le changement majeur est la longueur. Là où l’ancienne Lyria 3 Clip produit des extraits de 30 secondes fixes, Lyria 3.5 génère des pistes multiminutes avec des vers, des chœurs et des ponts – jusqu’à environ trois minutes, selon Google. À l’intérieur de l’application Gemini, des contrôles guidés permettent aux utilisateurs de suivre le processus :

  • Choisir un genre ou un style, ou en décrire un dans vos propres mots
  • Choisissez entre une version vocale ou instrumentale
  • Commencez par des modèles pour la musique de fond, les jingles, les sonneries ou les chansons d’anniversaire

Chaque fichier généré porte un filigrane SynthID que Google dit est inaudible pour les humains et signe l’audio comme AI-made. En ce qui concerne les données de formation, Google indique que le modèle Lyria n’a été formé qu’au contenu sous licence, mais ne divulgue aucune précision. La société n’a pas annoncé le prix de l’API au lancement.

En mettant la génération de chansons dans une application mainstream utilisée par des centaines de millions, Google est susceptible de ranimer le débat sur le droit d’auteur et comment les musiciens sont compensés quand AI imite leur métier.

Sources : Le décoder · Unité. AI

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *

Mastodon
Retour en haut