Anche Google ora offre strumenti per creare musica con l’AI con ultimo modello di audio-generativo, Lyria 3, disponibile nell’app Gemini. Il mnumero “3” è il riferimento alla versione, strumenti che finora erano ssfrutatbili solo da svilupaptori (con API dedicate) o disponibili all’interno di servizi specializzati come Music AI Sandbox.
Basta descrivere un’idea o caricare una foto o un video per creare una traccia divertente e orecchiabile. La funzionalità è in fase di rilascio per gli utenti di età superiore ai 18 anni (anche in Italia e in italiano) offrendo la gerazione automatica di brevi tracce audio personalizzate direttamente dall’assistente.
Come funziona?
Si parte da qui: basta descrivere ciò che si vuole ascoltare, ad esempio “un lento R&B comico su un calzino che trova la sua anima gemella” in vista di San Valentino, e in pochi secondi Gemini tradurrà il nostro prompt in una traccia di alta qualità. È anche possibile persino chiedere a Gemini di trarre ispirazione da un’immagine caricata.
È possibile descrivere un genere o un mood specifico per creare tracce uniche con testi o audio strumentali che si adattino al nostro stato d’animo, es. “Crea una traccia jazz rilassante, con un pianoforte delicato, accordi jazz e un tempo lento”.
Come accennato è possibile ottenere brani caricando una foto, un PDF, una slide o un documento per comporre una traccia con testi che si adattano all’atmosfera, esempio: “Usa queste foto per creare una traccia sul mio cane Giacomino durante le escursioni nei boschi”.
Qualsiasi idea può essere trasformata in traccia partendo da un argomento o una battuta, con prompt del tipo: “Crea una traccia punk rock skate anni ’90 per dire al mio coinquilino Mauro di lavare i piatti, con molta energia e batteria veloce”. Chiedendo: “Scrivi una canzone romantica su una donna 40enne che si chiama Fausta e vive in casa con un gatto che si chiama Giuliano”, abbiamo in pochi secondo ottenuto un brano pop moderno e romantico che racconta la vita di questa donna e della compagnia del suo fedele gatto”, con i pulsanti per mostare sottotitoli, condividere o scaricare la traccia.
L’app Gemini crea al volo brani di 30 secondi con copertine personalizzate generate da Nano Banana. Le creazioni possono essere condivise con gli amici scaricando o semplicemente facendo clic sul link di condivisione.
Google spiega che Lyria 3 migliora la generazione audio rispetto alla versione precedente in vari modi: non è necessario fornire testi (verranno generati per noi in base al nostro prompt), maggiore controllo creativo su elementi come lo stile, la voce e il numero di battiti al minuto (BPM) desiderati ed evidenziando ancora la possibilità di creare tracce più realistiche e musicalmente complesse.
Limiti e vincoli
Google fa sapere che tutte le tracce generate nell’app Gemini sono incorporate con SynthID, una “filigrana impercettibile” per l’identificazione dei contenuti generati dall’AI. Big G offre strumenti per aiutare a identificare contenuti creati con l’AI, ampliando le funzionalità di verifica per includere l’audio. Basta caricare un file e chiedere se è stato generato utilizzando Google AI. Gemini cercherà SynthID e sfrutterà il proprio ragionamento per offrire una risposta.
Tutte le notizie e gli approfondimenti sull’Intelligenza Artificiale sono disponibili a partire da questa pagina di Macitynet.













