Modèles et plateformes d’IA

Suno lance la version bêta de Speech, associant voix et musique dans un seul modèle

mm
Ajouter Unite.AI à vos sources préférées sur Google

Suno a annoncé Speech (beta) le 1 octobre 2026, lançant un modèle audio parlé que l’entreprise décrit comme le premier à générer voix et musique ensemble dans une piste cohérente. La version bêta a été ouverte à tous les utilisateurs sur mobile et web après un mois de test avec un petit groupe.

L’annonce est apparue dans un article de blog d’entreprise rédigé par le directeur produit Jack Brody. Speech crée un audio parlé accompagné d’une musique de fond originale et est intégré directement à Suno : les utilisateurs tapent une idée, un poème ou tout ce qu’ils ont écrit, puis décrivent la voix et le style musical qu’ils imaginent.

Une note de version datée du 1 octobre 2026 décrit Speech comme le premier modèle à créer simultanément un discours et sa bande‑son originale en une seule prise, et étiquette l’entrée pour Android, iOS, le web et Create. Ses exemples de ce que les utilisateurs pourraient créer incluent des histoires pour enfants sur fond de piano doux, des discours d’encouragement sur des percussions de stade, et des listes de courses ASMR, et il indique que Speech est disponible sur mobile et web.

Suno présente le lancement autour de ce qu’elle appelle le divertissement créatif, une catégorie que l’entreprise estime définir la prochaine vague de technologie grand public. La musique reste au cœur de ce que Suno construit, a écrit Brody, tandis que la vision de l’entreprise s’étend à d’autres formes d’expression humaine. L’article décrit Speech comme une autre toile pour les créations personnelles déjà réalisées par sa communauté, en citant des chansons que les utilisateurs produisent pour les anniversaires, les mariages, les blagues internes, la foi et le culte, leurs enfants et leurs amis.

Premiers usages et limites déclarées de la bêta

Selon l’article, l’équipe de Suno a expérimenté le modèle de façon informelle pendant le développement, transformant les messages texte d’amis en lectures dramatiques, donnant aux notes vocales ordinaires des bandes‑son épiques, et créant des méditations, poèmes, discours de motivation et histoires pour le coucher de leurs enfants.

Suno a averti que la bêta se comporte comme telle en pratique. Un accent britannique peut parfois dériver vers un accent australien puis revenir, a écrit l’entreprise, et « les pauses dramatiques peuvent être très dramatiques ». Suno a déclaré que les utilisateurs découvriront presque certainement des usages qui n’avaient jamais traversé l’esprit de l’équipe, ajoutant que ce type de découverte est l’objectif de l’ouverture de la bêta.

V6 et versions antérieures de 2026

Speech fait suite à une série de versions Suno documentées en 2026. Le 9 septembre 2026, l’entreprise a présenté v6, une nouvelle génération de modèles musicaux développée avec les partenaires industriels Warner Music Group, BMG et Believe. Suno a qualifié les modèles v6 de ses meilleurs à ce jour, les décrivant comme plus rapides, plus expressifs et de meilleure qualité. La famille v6 comprend trois modèles : le v6 phare et le v6-wild orienté exploration, tous deux disponibles pour les abonnés Pro et Premier, ainsi que le v6-mini, une version plus rapide et plus efficace disponible pour tous.

Suno a déclaré que v6 permet aux créateurs de modifier une partie d’une chanson existante en utilisant un langage naturel, de créer un mashup à partir de plusieurs sources en une seule requête, d’échantillonner et d’isoler l’audio pour composer un nouveau rythme en un seul flux de travail, de créer de la musique à partir de texte, d’audio, d’images et de vidéo, et de mettre à jour une seule parole sans reconstruire la chanson entière. Un exemple donné par l’entreprise : modifier un refrain afin qu’il soit chanté par une chorale gospel.

Suno a indiqué que son équipe organise chaque semaine des camps d’écriture avec des artistes, producteurs, auteurs-compositeurs et musiciens afin d’apprendre comment ils utilisent Suno dans leurs flux de travail créatifs, et qu’elle a mis en place des garde‑fous pour analyser les fichiers audio et les paroles téléchargés afin de détecter les usages non autorisés. Au fur et à mesure du déploiement de v6, l’entreprise a déclaré qu’elle prévoit de retirer ses modèles précédents et de transférer la plateforme entièrement sur la génération v6. Dans la même annonce, Suno a indiqué qu’elle développe des expériences opt‑in centrées sur des artistes individuels, dans lesquelles les artistes peuvent choisir de participer et d’être rémunérés lorsqu’ils le font.

Les entrées antérieures dans les notes de version de Suno documentent le reste de la gamme de produits 2026 de l’entreprise. Suno a lancé v5.5 le 26 mars 2026, alimentant trois fonctionnalités : Voices, qui permet aux utilisateurs d’enregistrer ou de télécharger leur propre audio et de chanter sur leurs créations ; Custom Models, qui entraîne une version personnalisée de v5.5 à partir d’au moins six pistes du catalogue d’un utilisateur ; et My Taste, qui apprend les genres, ambiances et références privilégiés d’un utilisateur au fil du temps. Voices est arrivé sur iOS et Android le 7 août 2026, permettant aux utilisateurs d’enregistrer une voix une fois et de l’utiliser sur n’importe quelle chanson.

Suno a publié Studio 2.0, une refonte de son poste de travail audio génératif basé sur le navigateur avec édition MIDI, effets audio, synthés intégrés et barre de discussion, pour les abonnés Premier le 13 août 2026. D’autres mises à jour de Studio le 17 septembre 2026 ont rendu la transcription MIDI‑vers‑audio plus rapide et plus fidèle au matériel original.

Suno a déclaré qu’elle continuera d’améliorer Speech au fur et à mesure qu’elle apprend ce que les gens aiment, ce qui ne fonctionne pas encore tout à fait, et ce que la communauté souhaite faire ensuite. La note de version demande aux utilisateurs leurs retours alors que la fonctionnalité s’améliore avec le temps.

Luca Ren est un analyste généré par IA chez Unite.AI, spécialisé dans l’intelligence artificielle appliquée au divertissement, aux médias et à la narration numérique. Son travail explore la façon dont les systèmes d’IA sélectionnent le contenu, influencent la production de films, de séries télévisées, de musique et de jeux vidéo, et personnalisent les expériences médiatiques pour des publics mondiaux.

Avec une perspective créative et sensible aux tendances, Luca examine comment les moteurs de recommandation, les outils génératifs et l’analyse d’audience transforment les flux de travail créatifs et les modèles de distribution. Il s’intéresse tout particulièrement à la manière dont l’IA affecte la structure narrative, l’autonomie des créateurs et l’équilibre entre l’optimisation basée sur les données et l’expression artistique dans les écosystèmes médiatiques modernes.

Les articles rédigés par Luca Ren sont générés par IA et revus par l’équipe éditoriale de Unite.AI afin d’assurer leur exactitude, leur contexte culturel et une couverture responsable du rôle évolutif de l’IA dans le divertissement et les médias.