Choisissez ce que l’auditeur doit entendre
Décrivez librement votre idée ou partez d’un modèle facultatif modifiable pour une narration, un dialogue, un podcast, une scène sonore, des effets ou une ambiance. Une explication parlée nécessite un prompt différent d’une forêt vide à l’aube. Décrivez d’abord l’événement essentiel, puis ajoutez la voix, l’humeur et le cadre acoustique. Une demande ciblée permet de juger le résultat plus clairement.
Pour les paroles, écrivez les mots à prononcer et utilisez des noms d’intervenants cohérents. Pour les extraits purement sonores, indiquez que vous ne souhaitez pas de paroles et décrivez l’enchaînement des événements. Gardez des indications lisibles plutôt qu’une accumulation d’adjectifs contradictoires. Le texte combiné, y compris les indications des personnages sélectionnés, est limité à 3 000 caractères par requête.
Écoutez, comparez et modifiez un élément
Générez une première version, puis écoutez la prononciation, le rythme, les changements d’intervenants et les sons inattendus. Gardez une ancienne version disponible lorsque vous essayez une nouvelle direction. Si une pause paraît précipitée, précisez l’interprétation ; si une scène paraît chargée, réduisez ses événements. Modifier un détail important à la fois rend la comparaison plus utile.
Avant la génération, notez le détail qui ferait réussir cet extrait : une question compréhensible, une émotion retenue ou une fin sonore nette sans paroles. Ce petit objectif d’écoute vous aide à choisir entre conserver la version, réécrire le prompt ou passer au segment suivant.
Construisez une œuvre complète à partir de courts extraits
Divisez les idées longues en segments que vous pouvez examiner séparément. Le modèle prend en charge les podcasts jusqu’à quatre minutes et les autres audios jusqu’à deux minutes. Ce sont des durées maximales ; le résultat peut être plus court. Assemblez les versions choisies dans l’ordre, réglez les pauses entre segments et exportez jusqu’à 30 minutes, pauses comprises, en WAV ou MP3. Un ZIP d’extraits contient les WAV individuels traités, le script et un manifeste d’assemblage pour poursuivre le montage.