Abstrakte KI-Visualisierung fuer ein neues Sprachmodell

Google pone música AI en la aplicación Gemini con Lyria 3.5

Google ha cambiado en Lyria 3.5, su modelo de generación de música, para todos los usuarios de Gemini a principios de septiembre, convirtiendo un mensaje de texto en una canción completa.

La compañía está desarrollando el modelo globalmente en la web y en la aplicación Gemini móvil, y también lo ofrece a través de la API Gemini, Google AI Studio, Google Flow Music y Google Vids. Google llama a Lyria 3.5 su mejor modelo de música todavía, con voces más expresivas y arreglos más ricos que su predecesor.

Canciones completas, no sólo clips

El cambio de titular es longitud. Cuando el viejo Lyria 3 Clip produjo snippets fijos de 30 segundos, Lyria 3.5 genera pistas de varios minutos con versículos, coros y puentes – hasta aproximadamente tres minutos, según Google. Dentro de la aplicación Gemini, los controles guiados recorren los usuarios a través del proceso:

  • Escoja un género o estilo, o describa uno en sus propias palabras
  • Elija entre voces o una versión instrumental
  • Inicio de plantillas para música de fondo, jingles, tonos o canciones de cumpleaños

Cada archivo generado lleva una marca de agua SynthID que Google dice que es inaudible para los humanos y marca el audio como AI. En los datos de entrenamiento, Google afirma que el modelo de Lyria fue entrenado sólo en el contenido licenciado, pero no revela ninguna especificación. La compañía no anunció los precios de API en el lanzamiento.

Al poner la generación de canciones dentro de una aplicación principal utilizada por cientos de millones, Google es probable que reinite el debate sobre los derechos de autor y cómo los músicos son compensados cuando AI imita su artesanía.

Fuentes: El Decoder · Unite. AI

Deja un comentario

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Mastodon
Scroll al inicio