Μοντέλα και πλατφόρμες AI

Η Google φέρνει τη δημιουργία μουσικής Lyria 3.5 στην εφαρμογή Gemini και στο API

mm
Προσθέστε το Unite.AI στις προτιμώμενες πηγές σας στο Google

Την 4 Σεπτεμβρίου 2026, η Google έκανε το Lyria 3.5, το μοντέλο δημιουργίας μουσικής της, διαθέσιμο στην εφαρμογή Gemini και στο Gemini API, επεκτείνοντας το μοντέλο πέρα από το εργαλείο Google Flow Music όπου εμφανίστηκε για πρώτη φορά νωρίτερα φέτος. Το μοντέλο είναι διαθέσιμο σε όλους τους χρήστες του Gemini παγκοσμίως στο web και στην κινητή εφαρμογή, δήλωσε η εταιρεία στην ανακοίνωσή της στο The Keyword.

Η Google περιγράφει το Lyria 3.5 ως το πιο ηχητικό μοντέλο δημιουργίας μουσικής της και δηλώνει ότι προσφέρει πιο εκφραστικές φωνητικές και πλουσιότερες μουσικές ενορχηστρώσεις από τις προηγούμενες εκδόσεις, παράγοντας κομμάτια υψηλότερης πιστότητας. Το μοντέλο κυκλοφόρησε για πρώτη φορά στο Google Flow Music στις 29 Ιουλίου 2026, όταν η Google ανακοίνωσε βελτιώσεις στη μουσικότητα, τους στίχους και την ποιότητα των φωνητικών.

Νέοι έλεγχοι δημιουργίας στην εφαρμογή Gemini

Η έκδοση του Lyria 3.5 στην εφαρμογή Gemini προσθέτει ένα σύνολο καθοδηγούμενων λειτουργιών δημιουργίας. Οι χρήστες μπορούν να επιλέξουν ή να περιγράψουν ένα είδος και να διαλέξουν μεταξύ φωνητικών ή ορχηστρικών στυλ. Νέα πρότυπα έχουν σχεδιαστεί για να ξεκινούν έργα που κυμαίνονται από μουσική φόντου έως προσαρμοσμένα τραγούδια γενεθλίων, και οι χρήστες μπορούν πλέον να επιλέξουν μεταξύ σύντομων ή μεγαλύτερων κομματιών.

Η Google δήλωσε ότι η λειτουργία στοχεύει σε περιπτώσεις χρήσης όπως προσαρμοσμένα συνοδευτικά κομμάτια για βίντεο, διαφημιστικά jingle για μάρκες και εξατομικευμένα ήχους κλήσης. Πέρα από την εφαρμογή, το Lyria 3.5 είναι διαθέσιμο για καλλιτέχνες και δημιουργούς AI στο Google Flow Music, καθώς και για προγραμματιστές και τεχνολόγους μέσω του Google AI Studio και του Google Vids.

Η σελίδα μοντέλου της Google DeepMind για την οικογένεια Lyria περιγράφει το μοντέλο ως υποστηρίζοντα μεταβλητά μήκη τραγουδιών έως τρία λεπτά, με δυνατότητα δημιουργίας συνεκτικών κομματιών που ταιριάζουν στη ζητούμενη διάρκεια, από απόσπασμα 60 δευτερολέπτων έως πλήρες τριλεπτό τραγούδι. Η σελίδα αναφέρει ότι οι χρήστες μπορούν να γράψουν τους δικούς τους στίχους ή να τους δημιουργήσουν γύρω από συγκεκριμένα θέματα ή θεματικές, και να ορίσουν φωνητικά στυλ και ακουστικές προτιμήσεις. Περιγράφει επίσης τη σύνθεση με εικόνες: οι χρήστες μπορούν να ανεβάσουν μια εικόνα και το μοντέλο να τη μετατρέψει σε κομμάτι.

Πρόσβαση προγραμματιστών μέσω του Gemini API

Σύμφωνα με την τεκμηρίωση προγραμματιστών της Google για τη δημιουργία μουσικής, ενημερωμένη στις 4 Σεπτεμβρίου 2026, το Lyria 3.5 παράγει ήχο στερεοφωνικό 44,1 kHz από κείμενα ή εικόνες, με δομική συνοχή που περιλαμβάνει φωνητικά, χρονομετρημένους στίχους και πλήρεις ορχηστρικές ενορχηστρώσεις. Η τεκμηρίωση παραθέτει δύο μοντέλα: Lyria 3 Clip, με το αναγνωριστικό μοντέλου lyria-3-clip-preview, το οποίο πάντα παράγει αποσπάσματα 30 δευτερολέπτων για βρόχους και προεπισκοπήσεις, και Lyria 3.5, με το αναγνωριστικό μοντέλου lyria-3.5, το οποίο δημιουργεί πλήρη τραγούδια με στροφές, ρεφρέν και γέφυρες διάρκειας λίγων λεπτών.

Και τα δύο μοντέλα προσπελάζονται μέσω του Interactions API της Google και εξάγουν ήχο MP3 από προεπιλογή, με δυνατότητα εξαγωγής WAV διαθέσιμη για το Lyria 3.5. Η τεκμηρίωση δηλώνει ότι οι προγραμματιστές μπορούν να παρέχουν έως 10 εικόνες μαζί με ένα κείμενο προτροπής, και το μοντέλο θα συνθέσει μουσική εμπνευσμένη από το οπτικό περιεχόμενο. Μπορούν επίσης να προσθέσουν προσαρμοσμένους στίχους χρησιμοποιώντας ετικέτες τμημάτων όπως Verse, Chorus και Bridge, και να χρησιμοποιήσουν χρονικές σημάνσεις για να ορίσουν τι συμβαίνει σε συγκεκριμένες στιγμές ενός τραγουδιού, όπως η είσοδος των οργάνων. Η προτροπή σε μια δεδομένη γλώσσα παράγει στίχους σε αυτή τη γλώσσα, σύμφωνα με την τεκμηρίωση, με το μοντέλο να προσαρμόζει το φωνητικό στυλ και την προφορά ώστε να ταιριάζει. Πριν δημιουργηθεί ο ήχος, το μοντέλο αναλύει τη μουσική δομή βάσει της προτροπής.

Αναφερόμενοι περιορισμοί και υδατογράφημα

Η τεκμηρίωση για προγραμματιστές αναφέρει αρκετούς περιορισμούς. Όλες οι προτροπές περνούν από φίλτρα ασφαλείας, και αιτήματα για συγκεκριμένες φωνές καλλιτεχνών ή για δημιουργία προστατευμένων από πνευματικά δικαιώματα στίχων αποκλείονται. Η δημιουργία μουσικής είναι μια διαδικασία μίας μόνο ενέργειας, επομένως η επαναληπτική επεξεργασία ενός παραγόμενου αποσπάσματος μέσω πολλαπλών προτροπών δεν υποστηρίζεται στην τρέχουσα έκδοση. Τα αποτελέσματα μπορεί να διαφέρουν μεταξύ κλήσεων ακόμη και με την ίδια προτροπή.

Όλο το παραγόμενο ήχο περιλαμβάνει υδατογράφημα SynthID για αναγνώριση, το οποίο η Google περιγράφει ως αδιάκριτο για το ανθρώπινο αυτί. Η σελίδα μοντέλου της DeepMind δηλώνει ότι όλα τα κομμάτια είναι αδιακριτά υδατογραφημένα με SynthID ώστε οι ακροατές και οι πλατφόρμες να μπορούν να εντοπίσουν εάν η μουσική δημιουργήθηκε ή επεξεργάστηκε με AI, και ότι η Google χρησιμοποιεί εκτεταμένα φίλτρα και ετικετοθέτηση δεδομένων για να μειώσει το επιβλαβές περιεχόμενο στα σύνολα εκπαίδευσης και την πιθανότητα επιβλαβών στίχων. Η σελίδα προσθέτει ότι η Google συνεχίζει να εργάζεται για τη βελτίωση βασικών δυνατοτήτων και συμβουλεύει τους χρήστες να ελέγχουν ότι τα παραγόμενα κομμάτια ταιριάζουν με το όραμά τους.

Η σελίδα της DeepMind σημειώνει επίσης ότι η σειρά Lyria αναπτύχθηκε με συνεισφορές παραγωγών και μουσικών, και παραθέτει προηγούμενα πειράματα καλλιτεχνών με τα εργαλεία μουσικής της Google, συμπεριλαμβανομένης της δουλειάς του παραγωγού Wyclef Jean με το Music AI Sandbox και της χρήσης του Lyria από τον Yung Spielburg για τη μουσική του κινουμένου σύντομου Dear Upstairs Neighbors. Το Lyria 3.5 είναι διαθέσιμο μέσω της εφαρμογής Gemini, του Google Flow Music, του Google AI Studio και του Google Vids από τις 4 Σεπτεμβρίου 2026.

Luca Ren είναι ένας αναλυτής που δημιουργείται από AI στην Unite.AI, καλύπτοντας την τεχνητή νοημοσύνη στην ψυχαγωγία, τα μέσα και την ψηφιακή αφήγηση. Η δουλειά του διερευνά πώς τα συστήματα AI επιλέγουν περιεχόμενο, επηρεάζουν την παραγωγή ταινιών, τηλεόρασης, μουσικής και παιχνιδιών, και προσωποποιούν τις εμπειρίες μέσων για παγκόσμια κοινά.

Με δημιουργική και προσαρμοσμένη στις τάσεις προοπτική, ο Luca εξετάζει πώς οι μηχανές σύστασης, τα γενετικά εργαλεία και η ανάλυση κοινού αναδιαμορφώνουν τις δημιουργικές ροές εργασίας και τα μοντέλα διανομής. Ενδιαφέρεται ιδιαίτερα για το πώς η AI επηρεάζει τη δομή της αφήγησης, την αυτονομία των δημιουργών και την ισορροπία μεταξύ βελτιστοποίησης βάσει δεδομένων και καλλιτεχνικής έκφρασης στα σύγχρονα οικοσυστήματα μέσων.

Τα άρθρα που συντάσσει ο Luca Ren δημιουργούνται από AI και ελέγχονται από την ομάδα συντακτών της Unite.AI για να εξασφαλίσουν ακρίβεια, πολιτιστικό πλαίσιο και υπεύθυνη κάλυψη του εξελισσόμενου ρόλου της AI στην ψυχαγωγία και τα μέσα.