
Google DeepMind ha lanzado Lyria 3, su modelo más avanzado de generación musical con IA, directamente en la app de Gemini. La herramienta crea pistas de 30 segundos con letras generadas automáticamente, carátulas personalizadas y marca de agua SynthID a partir de simples indicaciones de texto o imágenes subidas, y ya está disponible en versión beta para todos los usuarios mayores de 18 años.
El sector musical con IA ha evolucionado a un ritmo notable, con herramientas como Suno y Udio que amplían los límites de la generación de texto a música. El año pasado, analizamos este desarrollo en detalle en nuestro resumen de generadores musicales con IA. Ahora, Google entra en el mercado de cara al consumidor con Lyria 3 de forma más agresiva, llevando sus capacidades de generación musical de los laboratorios de investigación al alcance de los usuarios habituales de Gemini, incluyendo cineastas que buscan soluciones rápidas para bandas sonoras.
Qué aporta Lyria 3
Lyria 3 representa un avance significativo respecto a los anteriores proyectos de Google en generación musical. Quienes recuerden las versiones toscas de MusicLM de 2023, que Google ya retiró, descubrirán que Lyria 3 funciona a un nivel completamente diferente. El modelo puede generar pistas completas con voz, letra e instrumentación en capas a partir de una simple descripción de texto. No es necesario que proporciones tus propias letras; el sistema las escribe según tus indicaciones.
Google destaca tres mejoras fundamentales respecto a sus modelos Lyria anteriores. Primero, la generación automática de letras según las indicaciones del usuario. Segundo, un mayor control creativo sobre el estilo, las características vocales y el tempo. Tercero, un resultado musical más realista y complejo en general. Los usuarios pueden describir un género, un estado de ánimo, un recuerdo o incluso un chiste, y Lyria 3 producirá un clip pulido de 30 segundos. El sistema también acepta fotos y vídeos como aportación creativa, analizando el contenido visual para componer una banda sonora a juego.
Cada pista generada incluye una portada personalizada creada con el modelo de imágenes Nano Banana de Google. Las pistas se pueden descargar o compartir mediante un enlace, lo que facilita su distribución.

Implicaciones cinematográficas y flujos de trabajo creativos
Para los cineastas, la pregunta práctica es si Lyria 3 puede ser una herramienta útil en los flujos de trabajo de producción reales. Con 30 segundos por clip, claramente no está diseñada para la banda sonora de un largometraje. El propio Google presenta la herramienta como un medio de expresión creativa personal, más que como una producción musical profesional. La publicación del blog de la compañía afirma que el objetivo es ofrecer una forma divertida de expresarse, no crear una obra maestra musical.
Dicho esto, existen escenarios en los que los clips musicales generados rápidamente por IA podrían resultar útiles en el contexto cinematográfico. Se me ocurren pistas temporales para cortes preliminares, referencias de atmósfera durante la preproducción, contenido de redes sociales para marketing cinematográfico o audio de marcador de posición para presentaciones. La posibilidad de subir una imagen fija o un videoclip corto y recibir una banda sonora con la tonalidad adecuada en segundos es un flujo de trabajo que podría ahorrar tiempo durante las primeras etapas creativas.
Competidores como Suno y Udio aún mantienen una ventaja en cuanto a producción de formato más largo y controles creativos más profundos. Suno genera canciones de varios minutos con una estructura adecuada de estrofa, estribillo y puente, mientras que Udio (cuyo equipo está formado por antiguos investigadores de Google DeepMind) ofrece funciones como controles deslizantes de intensidad de las indicaciones e indicaciones negativas. El límite de 30 segundos de Lyria 3 y su posicionamiento más informal sugieren que Google, por ahora, se centra en un caso de uso diferente.
En nuestro resumen de 2024, exploramos el panorama más amplio de las herramientas de IA para cineastas, y la trayectoria es clara: la música generada por IA está pasando de ser una novedad a una auténtica utilidad de producción, aunque aún no hayamos llegado a ese punto con todas las herramientas.
Marca de agua SynthID y verificación de audio
Un área en la que Google se está adelantando a la competencia es la transparencia y la procedencia del contenido. Todas las pistas generadas a través de Lyria 3 en la aplicación Gemini incorporan SynthID, la tecnología de marca de agua imperceptible de Google DeepMind para identificar el contenido generado por IA. La marca de agua se integra en el audio desde el momento de su creación y puede detectarse posteriormente sin afectar la experiencia auditiva.
Google también ha ampliado las funciones de verificación de Gemini para incluir audio, además de imágenes y vídeo. Los usuarios pueden subir un archivo de audio y preguntar si se generó con la IA de Google. El sistema buscará marcadores SynthID y aplicará su propio razonamiento antes de mostrar un resultado. Para una industria cada vez más preocupada por la procedencia de los medios sintéticos, este es un avance positivo. Anteriormente, hemos analizado cómo Google también integra SynthID en sus salidas de vídeo de Veo 3, lo que demuestra un enfoque coherente en todas sus herramientas de medios generativos.
Garantías de derechos de autor y desarrollo responsable
Google afirma que Lyria 3 se desarrolló prestando atención a los derechos de autor y a los acuerdos con socios. El modelo está diseñado para la expresión original en lugar de imitar a artistas existentes. Si la solicitud de un usuario menciona a un artista específico, Gemini lo interpreta como una inspiración creativa general y genera una pista que comparte un estilo o ambiente similar, en lugar de intentar replicar una voz o sonido reconocible.
La compañía también afirma contar con filtros para comparar los resultados con el contenido existente, aunque reconoce que este enfoque puede no ser infalible. Los usuarios pueden denunciar contenido que pueda infringir derechos, y todo uso se rige por las Condiciones de Servicio de Google y las políticas de uso prohibido de la IA generativa. Esto es relevante en el contexto de la continua tensión en la industria en torno a los datos de entrenamiento de la IA; informes de principios de 2024 indicaban que Google había entrenado previamente modelos musicales de IA con grabaciones protegidas por derechos de autor antes de contactar con los titulares de los derechos para obtener las licencias. El reciente acuerdo de licencia entre Universal Music Group y YouTube, que incluye restricciones en torno al contenido de IA generativa, sugiere que la industria está trabajando hacia marcos más claros.

Integración con YouTube Dream Track
Lyria 3 no se limita a la app de Gemini. El modelo también impulsa la función Dream Track de YouTube, que les permite a los creadores generar bandas sonoras personalizadas para YouTube Shorts. Dream Track, que anteriormente solo estaba disponible en Estados Unidos, ahora está disponible para creadores en otros países. La integración les brinda a los creadores de videos cortos acceso a versos líricos generados por IA y pistas instrumentales adaptadas a su contenido.
Esto posiciona a Lyria 3 como parte de un ecosistema más amplio de Google, conectando la app de Gemini para la creación musical informal con YouTube para los flujos de trabajo de los creadores de contenido. Para los cineastas activos en YouTube, esto podría ofrecer una forma conveniente de generar audio único para contenido promocional de formato corto sin problemas de licencia.
Disponibilidad y acceso
Lyria 3 está disponible en la app de Gemini para todos los usuarios mayores de 18 años en inglés, alemán, español, francés, hindi, japonés, coreano y portugués. Google planea ampliar la cobertura de idiomas con el tiempo. La función se implementará primero en computadoras de escritorio y, en los próximos días, estará disponible en la app móvil. Los suscriptores de Google AI Plus, Pro y Ultra tienen límites de uso más altos, aunque Google no ha especificado las cifras exactas.
Para desarrolladores y usuarios más técnicos, Google también ofrece Lyria a través de su plataforma Vertex AI y la API de Gemini, aunque la versión en la nube actualmente se ejecuta en Lyria 2 (lyria-002) en lugar del último modelo Lyria 3. Esta versión genera pistas instrumentales y genera archivos WAV.
La generación de música con IA ha avanzado mucho desde las producciones apenas escuchables de hace tan solo dos años atrás. Lyria 3 supone un avance, aunque su límite de 30 segundos y su posicionamiento informal dejan espacio para herramientas especializadas en flujos de trabajo profesionales. ¿Te imaginas usando música generada por IA para pistas temporales, redes sociales o materiales de lanzamiento? Cuéntanos en los comentarios.





































