Dixie Consulting — Informations vérifiées le 8 septembre 2026.
Créer une musique adaptée à une vidéo, essayer un jingle ou préparer une ambiance sonore devient plus accessible dans Gemini. Avec Lyria 3.5, Google annonce des voix plus expressives, des arrangements plus riches et des commandes plus simples. Pour les créateurs de contenu et les PME, cette mise à jour mérite surtout d’être évaluée sur la qualité des morceaux réellement utilisables.
Google a annoncé l’arrivée de Lyria 3.5 dans Gemini le 4 septembre 2026. Le modèle est proposé dans l’application et via l’API Gemini. L’entreprise met en avant une meilleure fidélité sonore et une expérience de création enrichie. Annonce officielle de Google.
Lyria est le modèle spécialisé dans la génération musicale. Gemini sert ici d’interface pour lui transmettre une idée, choisir une direction et récupérer un morceau. Pour l’utilisateur, le point de départ reste une description : l’ambiance recherchée, les instruments, la présence de voix et le contexte d’utilisation.
Ce qui évolue avec Lyria 3.5
Dans Gemini, la mise à jour introduit une sélection du genre musical, le choix entre musique chantée et instrumentale, ainsi que des modèles de départ. Elle permet aussi de choisir entre morceaux courts et longs. Google cite notamment les accompagnements vidéo, les jingles et les créations personnalisées. Nouveautés dans l’application Gemini.
Sur le plan sonore, Google DeepMind annonce des progrès concernant la musicalité, les paroles et la qualité des voix. Ces améliorations sont présentées par l’éditeur ; nous n’avons pas réalisé de comparaison audio indépendante pour cet article. Présentation de Lyria 3.5.
Pour un non-musicien, l’intérêt des nouveaux choix dans l’interface est de rendre la demande plus facile à formuler. On peut fixer quelques paramètres avant d’ajouter les détails propres à son projet.
Un fond musical destiné à accompagner une explication devra laisser de la place à la voix. Une introduction pourra, au contraire, chercher une mélodie immédiatement reconnaissable. Le même style ne répondra pas nécessairement aux deux besoins.
Des formats courts ou des morceaux de plusieurs minutes
La page officielle de Gemini annonce des créations allant jusqu’à trois minutes. L’aide en anglais précise deux choix dans l’application : un format court d’environ une minute et un morceau complet d’environ deux à trois minutes. Présentation de la génération musicale, aide sur les formats.
Ces durées ne doivent pas être confondues avec celles de tous les modèles accessibles aux développeurs :
| Environnement | Format documenté |
|---|---|
| Gemini, choix « court » | Environ une minute |
| Gemini, choix « complet » | Environ deux à trois minutes |
| API, Lyria 3 Clip | Trente secondes |
| API, Lyria 3.5 | Morceau de quelques minutes, durée orientable par le prompt |
Les caractéristiques API proviennent du guide de génération musicale.
Pour une vidéo de 45 secondes, il restera utile de contrôler le fichier obtenu et d’ajuster la musique au montage. Une durée demandée dans un prompt n’évite pas de vérifier où tombent l’introduction, les changements d’intensité et la conclusion.
Quels usages pour une PME ou un créateur ?
Nous voyons surtout un intérêt pour explorer rapidement plusieurs directions sonores. Voici des pistes d’essai proposées par Dixie Consulting, sans promesse de résultat systématique.
| Projet | Ce que l’on peut chercher à produire | Point à écouter en priorité |
|---|---|---|
| Vidéo explicative | Une ambiance instrumentale discrète | La musique laisse-t-elle les paroles compréhensibles ? |
| Présentation d’un produit | Un accompagnement adapté au rythme des images | Les changements musicaux servent-ils le montage ? |
| Podcast | Une proposition de thème d’introduction | La mélodie fonctionne-t-elle en quelques secondes ? |
| Communication de marque | Plusieurs maquettes de jingle | Le résultat correspond-il au ton de l’entreprise ? |
Pour une petite équipe, cette phase d’exploration peut faciliter les échanges. Il devient possible d’écouter une intention, de la comparer à une autre et d’expliquer plus précisément ce que l’on souhaite conserver.
La sélection reste un travail éditorial. Une musique agréable prise isolément peut détourner l’attention dans une vidéo pédagogique. Il faut l’écouter avec le contenu qu’elle doit accompagner.
Comment commencer dans Gemini
Dans les outils de la zone de saisie, choisissez « Créer de la musique », puis décrivez votre morceau. L’aide française indique qu’un morceau complet nécessite de passer au modèle « Pro ». Elle précise aussi les prérequis : au moins 18 ans, un compte compatible et l’option « Conserver l’activité » activée. Mode d’emploi de Google.
Un exemple de consigne pour tester une ambiance sous une voix off :
Crée une musique instrumentale d’environ une minute pour une vidéo pédagogique sur l’intelligence artificielle destinée à des dirigeants de PME. Ambiance moderne, chaleureuse et rassurante. Piano léger, synthétiseur doux et percussions discrètes. Début identifiable dès les premières secondes, énergie régulière, puis une conclusion douce. Aucun chant ni parole. L’arrangement doit laisser de la place à une voix off.
Cette consigne constitue un point de départ. Après écoute, identifiez un problème précis : rythme trop présent, mélodie envahissante ou fin trop brutale. Vous pourrez reformuler le brief pour une nouvelle génération et comparer les propositions.
Google recommande de préciser le genre, le rythme, les instruments et, pour une chanson, les caractéristiques vocales et les paroles. Conseils de création dans Gemini.
Télécharger la musique et l’intégrer à un montage
Gemini permet de télécharger le fichier audio en MP3, ou une vidéo MP4 accompagnée de son visuel d’illustration. Le nombre de générations est limité ; l’application indique lorsque le quota est atteint. Téléchargement et limites.
Pour ajouter une piste à un montage existant, le fichier audio seul est généralement le plus pratique. Il faut ensuite régler son niveau par rapport à la narration et vérifier le début comme la fin de la séquence.
Une dernière écoute sur les haut-parleurs d’un téléphone est utile si le contenu vise les réseaux sociaux. Elle permet de juger le résultat dans une situation proche de celle du public.
Une API pour les usages automatisés
Lyria 3.5 est aussi accessible aux développeurs sous l’identifiant lyria-3.5. La documentation décrit une sortie stéréo à 44,1 kHz, en MP3 par défaut, avec possibilité de demander du WAV. Elle accepte du texte et des images pour orienter la composition. Documentation API.
Google affiche 0,08 dollar par morceau généré pour Lyria 3.5 via l’API, sans niveau gratuit pour ce modèle. Ce tarif concerne l’appel API, et ne décrit pas les quotas d’un abonnement Gemini. Tarification officielle.
À ce prix, 100 générations représentent 8 dollars d’appels Lyria 3.5. Il faut toutefois compter les essais nécessaires : cinq propositions pour un morceau retenu correspondent à 0,40 dollar de génération, avant le temps de sélection et de montage.
L’automatisation peut donc avoir un intérêt pour produire des variantes, mais elle devra conserver une étape d’écoute. Générer beaucoup de fichiers ne garantit pas qu’ils correspondent tous au besoin.
Les limites à connaître avant de préparer une production
La documentation API indique que la génération s’effectue en une seule étape : la retouche progressive d’un morceau par plusieurs demandes successives n’est pas prise en charge dans cette version. Elle précise également qu’un même prompt peut donner des résultats différents. Limites documentées de Lyria 3.5.
Il ne faut donc pas construire un processus de production en supposant que l’on pourra conserver exactement une prise et n’en modifier que quelques secondes par conversation. Pour un ajustement précis, le montage audio peut rester nécessaire.
Google intègre par ailleurs SynthID, un filigrane imperceptible destiné à identifier les morceaux générés par son IA. Présentation de SynthID pour Lyria.
Ce marquage renseigne sur l’origine du contenu. Pour une campagne commerciale, vérifiez séparément les conditions du service et les exigences de diffusion : l’annonce produit ne constitue pas, à elle seule, une garantie d’exclusivité sur une création.
Le regard Dixie Consulting
Lyria 3.5 rapproche la création musicale des outils déjà utilisés pour préparer des textes, des visuels et des vidéos. Les nouveaux réglages rendent l’expérimentation plus accessible, tandis que les progrès sonores annoncés doivent être jugés à l’écoute.
Pour démarrer, nous choisirions un seul cas concret : accompagner une courte vidéo avec une piste instrumentale. Trois propositions, écoutées sur le même montage, suffisent pour évaluer si l’outil aide réellement à trouver le bon ton.
La valeur de cette mise à jour sera de faciliter la création d’une musique qui sert le contenu, respecte son rythme et renforce son identité.