Lyria es el modelo de inteligencia artificial desarrollado por Google DeepMind para generar música instrumental profesional a partir de comandos de texto. Diseñado con la colaboración de músicos y compositores, este sistema permite crear composiciones completas con calidad de estudio, utilizando tecnología avanzada de síntesis de audio. En este artículo, exploraremos en detalle cómo funciona Lyria, sus versiones disponibles, costos, requisitos técnicos, ejemplos prácticos, comparativas con otras herramientas, y consejos para optimizar su uso en proyectos musicales y comerciales.
¿Qué es Lyria y cómo funciona?
Lyria es un modelo de inteligencia artificial especializado en la generación de música instrumental. A diferencia de otras herramientas, Lyria se enfoca en producir audio estéreo de 48kHz, calidad equivalente a la utilizada en producciones musicales profesionales. Esto significa que el audio generado puede usarse directamente en proyectos sin necesidad de postprocesamiento.
El sistema funciona mediante la interpretación de comandos de texto. Cuando un usuario describe una pieza musical, Lyria analiza elementos como:
- Género musical (jazz, electrónica, clásica, etc.).
- Instrumentación (piano, guitarra, sintetizadores, etc.).
- Tempo (velocidad en BPM).
- Tonalidad (Do mayor, La menor, etc.).
- Características emocionales (relajante, enérgica, melancólica, etc.).
Además, Google DeepMind incorpora SynthID, una marca de agua digital imperceptible que identifica el contenido como generado por IA. Esto garantiza la transparencia y autenticidad del audio producido.
Es importante destacar que, en sus versiones públicas actuales, Lyria solo genera música instrumental. No produce voces cantadas ni letras. La duración de las composiciones varía según la versión: Lyria 2 genera clips de 32 segundos, mientras que Lyria RealTime permite generación continua en sesiones interactivas.
Versiones disponibles y costos reales
| Versión | Costo | Duración generada | Calidad de audio | Plataforma |
|---|---|---|---|---|
| Lyria 2 | \$0.06 USD por 30 segundos | 32 segundos por generación | 48kHz estéreo profesional | Google Cloud Vertex AI |
| Lyria RealTime | Incluido en API Gemini (según plan) | Generación continua en tiempo real | 48kHz estéreo profesional | API Gemini, AI Studio |
Desglose detallado de costos
A continuación, te presentamos un desglose de costos estimados para diferentes escenarios de uso:
- 10 generaciones de 32 segundos: \$0.60 USD (aproximadamente 5 minutos de música total). Ideal para probar diferentes estilos o crear una biblioteca de samples.
- 100 generaciones: \$6 USD (aproximadamente 53 minutos de música). Perfecto para proyectos más grandes, como bandas sonoras para videos o podcasts.
- Proyecto típico de video corto: \$0.12-0.24 USD (2-4 generaciones para elegir la mejor opción). Ideal para creadores de contenido que necesitan música de fondo.
- Banda sonora completa para video de 5 minutos: \$1-2 USD (múltiples iteraciones y ajustes). Recomendado para proyectos profesionales que requieren música personalizada.
La API de Gemini ofrece un nivel gratuito limitado con 1,500 solicitudes por día sin costo financiero. Una vez superado este límite, se aplican cargos según el plan contratado. Te recomendamos consultar la documentación oficial de precios de Gemini API para obtener información actualizada sobre límites específicos.
Requisitos técnicos previos
Para usar Lyria 2 en Vertex AI
Si deseas utilizar Lyria 2 en Google Cloud Vertex AI, necesitarás cumplir con los siguientes requisitos:
- Cuenta de Google Cloud: Debes tener una cuenta activa de Google Cloud Platform. Si no la tienes, puedes crearla en Google Cloud.
- Proyecto de Google Cloud: Crea un nuevo proyecto o selecciona uno existente desde la consola de Google Cloud.
- Habilitar Vertex AI API: Activa la API de Vertex AI desde la consola de Google Cloud. Esto es esencial para acceder a las funcionalidades de Lyria.
- Configurar facturación: Vincula un método de pago válido a tu proyecto. Google Cloud requiere esto para habilitar servicios pagos.
- Permisos IAM necesarios: Asegúrate de tener el rol Service Usage Admin para habilitar APIs y gestionar permisos.
- Configurar autenticación: Instala Google Cloud CLI y ejecuta el comando de autenticación para vincular tu cuenta local con Google Cloud.
Para usar Lyria RealTime con API Gemini
Si prefieres utilizar Lyria RealTime a través de la API de Gemini, estos son los requisitos:
- Clave API de Gemini: Obtén una clave API desde AI Studio de Google. Esta clave es necesaria para autenticarte en la API.
- Conocimientos de programación: Necesitarás familiaridad básica con lenguajes como Python o JavaScript para interactuar con la API.
- Bibliotecas necesarias: Instala el cliente oficial de Google Generative AI para tu lenguaje de programación. Puedes encontrar las bibliotecas en la documentación oficial.
- Conexión a internet estable: Una conexión estable es crucial para la comunicación en tiempo real con la API.
Nivel de conocimiento recomendado
Lyria está diseñado para adaptarse a diferentes niveles de experiencia:
- Principiante: Usa la interfaz web de Vertex AI Studio. No requiere conocimientos de programación y es ideal para explorar las capacidades básicas de Lyria.
- Intermedio: Implementa Lyria con código básico siguiendo los ejemplos de la documentación oficial. Perfecto para desarrolladores que buscan integrar la herramienta en proyectos simples.
- Avanzado: Integra Lyria en aplicaciones complejas con control fino de parámetros. Recomendado para profesionales que necesitan personalización avanzada.
¿Cómo usar Lyria 2 desde la interfaz web?
Paso 1: Acceder a Vertex AI Studio
Inicia sesión en la consola de Google Cloud y navega a Vertex AI Studio desde el menú principal. Selecciona la pestaña Media Studio y luego elige el modelo Lyria o la opción de generación de música.
Paso 2: Escribir el comando de texto
En el campo de texto, describe la música que deseas generar. Sé lo más específico posible. Por ejemplo:
- “Piano jazz suave con ritmo lento, ambiente contemplativo, uso de acordes de séptima mayor.”
- “Música electrónica con sintetizadores brillantes, bajo potente y ritmo de 128 BPM.”
- “Orquesta sinfónica con cuerdas expresivas y metales potentes, tempo allegro.”
Paso 3: Configurar parámetros opcionales
Ajusta parámetros adicionales si están disponibles en la interfaz, como:
- Tonalidad específica (Do mayor, La menor, etc.).
- Tempo en pulsaciones por minuto (BPM).
- Brillo (brightness) para ajustar el tono general.
Paso 4: Generar y descargar
Presiona el botón Generar y espera aproximadamente 1 minuto mientras el modelo procesa tu solicitud. Una vez completado, reproduce el audio generado. Si el resultado es satisfactorio, descarga el archivo de audio en formato estándar (WAV o MP3).
¿Cómo usar Lyria RealTime con código?
Ejemplo completo en Python
A continuación, te mostramos un ejemplo de cómo generar música con Lyria RealTime usando Python:
import asyncio
from google import genai
from google.genai import types
async def generar_musica():
client = genai.Client(api_key='TU_CLAVE_API_AQUI')
async with client.aio.live.music.connect() as session:
# Configurar
await session.set_weighted_prompts(
prompts=[
{"text": "Piano", "weight": 2.0},
types.WeightedPrompt(text="Meditation", weight=0.5),
types.WeightedPrompt(text="Live Performance", weight=1.0)
]
)
# Configurar parámetros musicales
await session.set_music_generation_config(
config=types.MusicGenerationConfig(
key=types.MusicalKey.C_MAJOR_A_MINOR,
tempo=90,
brightness=0.6
)
)
# Iniciar generación
await session.play()
# Recibir audio generado
async for chunk in session.receive():
if chunk.audio:
# Procesar audio aquí
print(f"Recibido fragmento de audio: {len(chunk.audio)} bytes")
asyncio.run(generar_musica())
Ejemplo completo en JavaScript
Si prefieres usar JavaScript, aquí tienes un ejemplo equivalente:
const { GoogleGenAI } = require('@google/generative-ai');
async function generarMusica() {
const client = new GoogleGenAI({ apiKey: 'TU_CLAVE_API_AQUI' });
Copiar
const session = await client.live.music.connect();
// Configurar comandos con pesos
await session.setWeightedPrompts({
prompts: [
{ text: "Piano", weight: 2.0 },
{ text: "Meditation", weight: 0.5 },
{ text: "Live Performance", weight: 1.0 }
]
});
// Configurar parámetros musicales
await session.setMusicGenerationConfig({
key: 'C_MAJOR_A_MINOR',
tempo: 90,
brightness: 0.6
});
// Iniciar generación
await session.play();
// Recibir audio generado
for await (const chunk of session.receive()) {
if (chunk.audio) {
console.log(`Recibido fragmento de audio: ${chunk.audio.length} bytes`);
}
}
}
generarMusica();
Ejemplos de comandos efectivos y resultados esperados
| Comando de texto | Resultado esperado | Nivel |
|---|---|---|
| “Piano suave para estudiar” | Piano acústico con melodías simples, ritmo lento, dinámicas bajas, ambiente relajante. | Principiante |
| “Música de danza electrónica enérgica con tempo rápido, sintetizadores prominentes y batería electrónica. Producción de alta calidad” | Pista electrónica con sintetizadores brillantes, bajo potente, ritmo de 128 BPM, estructura repetitiva bailable. | Intermedio |
| “Conjunto de jazz acústico con piano, contrabajo y batería con escobillas. Tempo moderado de 110 BPM en tonalidad de Fa mayor. Estilo swing tradicional con improvisación de piano” | Trío de jazz con interacción entre instrumentos, swing pronunciado, solos de piano, dinámicas variadas, sonido cálido y orgánico. | Avanzado |
| “Guitarra acústica fingerstyle con melodía contemplativa, afinación estándar, técnica arpegios, ambiente íntimo” | Guitarra solista con arpegios detallados, sonido acústico natural, dinámicas sutiles, atmósfera introspectiva. | Intermedio |
| “Orquesta sinfónica interpretando pieza dramática con cuerdas expresivas, metales potentes, percusión orquestal. Tempo allegro con cambios dinámicos marcados” | Composición orquestal completa con secciones bien diferenciadas, crescendos dramáticos, textura rica, producción cinematográfica. | Avanzado |
Técnica de comandos negativos
Lyria 2 permite especificar comandos negativos para excluir elementos no deseados. Esto es útil para refinar los resultados y evitar elementos que no encajen con tu visión creativa.
<mui\:table-metadata title=”Ejemplos de comandos negativos” />
| Comando positivo | Comando negativo | Efecto |
|---|---|---|
| “Piano calmado y relajante para estudiar” | “melodías complejas, dinámicas altas, cambios repentinos, batería, voces” | Piano simple y constante sin elementos que distraigan. |
| “Música ambiental atmosférica” | “ritmo marcado, percusión, melodías definidas” | Texturas suaves sin estructura rítmica evidente. |
Estudio de caso: Creación de una banda sonora para un video
Imagina que estás creando un video corporativo de 5 minutos y necesitas una banda sonora original. Aquí te mostramos cómo podrías abordar este proyecto con Lyria:
Paso 1: Definir el estilo musical
Decide el estilo que mejor se adapte al tono del video. Por ejemplo, si el video es inspirador, podrías optar por una música orquestal con cuerdas y piano. Si es moderno y dinámico, una pista electrónica con sintetizadores podría ser ideal.
Paso 2: Generar múltiples opciones
Usa Lyria 2 para generar varias opciones de 32 segundos cada una. Por ejemplo:
- “Orquesta sinfónica con cuerdas emotivas, piano suave y tempo moderado de 90 BPM.”
- “Música electrónica con sintetizadores cálidos, bajo suave y ritmo constante de 110 BPM.”
- “Jazz acústico con piano, contrabajo y batería suave, tempo de 100 BPM.”
Paso 3: Seleccionar y editar
Escucha cada opción y selecciona la que mejor se adapte al video. Si es necesario, usa herramientas de edición de audio como Audacity o Adobe Audition para ajustar la duración, añadir efectos o mezclar múltiples clips.
Paso 4: Integrar en el video
Importa el archivo de audio a tu software de edición de video (como Adobe Premiere o Final Cut Pro) y sincronízalo con las imágenes. Ajusta el volumen para que la música complemente la narrativa sin distraer.
Comparativa con otras herramientas de IA musical
<mui\:table-metadata title=”Comparativa con herramientas de IA musical” />
| Característica | Lyria 2 | Suno | Udio |
|---|---|---|---|
| Generación de voces | No (solo instrumental) | Sí (voces sintéticas con letras) | Sí (voces sintéticas con letras) |
| Calidad de audio | 48kHz estéreo profesional | 44.1kHz estándar | 44.1kHz estándar |
| Duración por generación | 32 segundos | Hasta 2-4 minutos | Hasta 3 minutos |
| Control técnico | Alto (tonalidad, tempo, brillo) | Medio (principalmente descriptivo) | Alto (edición y extensión de secciones) |
| Interfaz | API técnica y consola web | Aplicación web intuitiva | Aplicación web intuitiva |
| Mejor para | Música instrumental profesional, integración técnica | Canciones completas con letras, uso inmediato | Control creativo detallado, extensión de pistas |
| Curva de aprendizaje | Alta (requiere conocimientos técnicos) | Baja (interfaz amigable) | Media (interfaz intuitiva con opciones avanzadas) |
¿Cuándo elegir Lyria?
Lyria es la mejor opción si:
- Necesitas música instrumental exclusivamente: Sin voces ni letras.
- Requieres calidad de audio profesional: 48kHz para producción comercial.
- Buscas : Tonalidad y tempo específicos.
- Planeas integración programática: API para aplicaciones y servicios.
- Trabajas con Google Cloud: Integración natural con otros servicios.
¿Cuándo elegir alternativas?
- Suno: Si necesitas canciones completas con voces y letras, interfaz simple sin programación.
- Udio: Si deseas extender pistas, editar secciones específicas, control creativo con interfaz gráfica.
Errores comunes y soluciones
Error: “Permission denied” al usar la API
Causa: Permisos IAM insuficientes en Google Cloud o API no habilitada.
Solución: Verifica que tienes el rol Service Usage Admin. Ve a IAM en Google Cloud Console y confirma los permisos. Asegúrate de haber habilitado Vertex AI API desde la sección APIs y servicios.
Error: “Invalid API key” en Lyria RealTime
Causa: Clave API incorrecta o no configurada como variable de entorno.
Solución: Obtén una nueva clave desde AI Studio de Google. Verifica que la clave esté correctamente asignada en tu código. No incluyas espacios adicionales al copiar la clave.
Problema: Audio generado no coincide con el comando
Causa: Comando demasiado vago o ambiguo.
Solución: Reformula el comando con mayor especificidad. Incluye género, instrumentos específicos, tempo numérico y características emocionales concretas. Usa .
Problema: Audio con artefactos o distorsión
Causa: Comando con elementos contradictorios o configuración de parámetros extremos.
Solución: Simplifica el comando eliminando contradicciones. Ajusta parámetros como brillo a valores moderados entre 0.3 y 0.7. Evita combinaciones incompatibles como “música relajante” con “tempo muy rápido”.
Problema: Conexión interrumpida en Lyria RealTime
Causa: Conexión a internet inestable o tiempo de espera excedido.
Solución: Verifica tu conexión a internet. Implementa manejo de reconexión automática en tu código. Reduce el tiempo de sesión continua y reinicia conexiones periódicamente.
Derechos y uso comercial de la música generada
Según la documentación oficial de Google, . El audio de calidad profesional cumple con los estándares de la industria para aplicaciones comerciales. Sin embargo, hay consideraciones importantes:
- : No puedes incluir nombres de músicos específicos en los comandos. En su lugar, describe el estilo, género y características.
- Uso responsable: El contenido debe cumplir con las políticas de uso aceptable de Google Cloud.
- : Aunque no es obligatorio, considera indicar que el audio fue generado con inteligencia artificial.
Todo el contenido generado incluye SynthID, la . Esta tecnología permite identificar el audio como generado por IA mediante análisis técnico, aunque no afecta la calidad audible del contenido.
Recursos oficiales y documentación
Para profundizar en el uso de Lyria, te recomendamos consultar los siguientes recursos oficiales:
- Documentación oficial Lyria 2: Documentación Lyria 2
- Documentación Lyria RealTime: Documentación Lyria RealTime
- : Guía de comandos
- Información sobre el modelo: Modelo Lyria
- Precios de Vertex AI: Precios Vertex AI
- Precios API Gemini: Precios API Gemini
Mejores prácticas para resultados óptimos
Para obtener los mejores resultados con Lyria, sigue estas recomendaciones:
- Comienza con comandos simples: Usa descripciones claras y específicas antes de agregar complejidad. Por ejemplo, “piano jazz suave con ritmo lento” es un buen punto de partida.
- : Registra los comandos que produzcan resultados satisfactorios junto con los parámetros utilizados. Esto te ayudará a replicar estilos exitosos en proyectos futuros.
- : Asigna diferentes pesos a los comandos para crear combinaciones únicas. Por ejemplo, 70% a un estilo y 30% a otro puede generar fusiones interesantes.
- : Aunque Lyria produce audio de alta calidad, el uso de herramientas de edición como Audacity o Adobe Audition puede ayudarte a personalizar aún más el resultado.
- : Modifica un parámetro a la vez para entender cómo cada elemento afecta el resultado final. Esto te dará un mayor control sobre la generación de música.
Conclusión
Lyria de Google DeepMind es una herramienta poderosa para la generación de música instrumental profesional mediante inteligencia artificial. Su enfoque en la calidad de audio y el control técnico preciso la convierte en una opción ideal para productores, creadores de contenido y desarrolladores que buscan integrar música de alta fidelidad en sus proyectos.
Ya sea que utilices la interfaz web de Vertex AI o la API de Gemini para integraciones programáticas, Lyria ofrece flexibilidad y calidad para satisfacer una amplia gama de necesidades creativas. Con este tutorial, esperamos haberte proporcionado las herramientas y conocimientos necesarios para comenzar a explorar el potencial de Lyria en tus proyectos musicales.