
En tant que partenaire stratégique d’ElevenLabs, Omtera, aide les entreprises à dépasser la simple phase d’expérimentation avec les technologies vocales basées sur l’intelligence artificielle et à les intégrer dans de véritables processus métier, expériences client et opérations de production de contenu. L’une des fonctionnalités les plus créatives de l’écosystème ElevenLabs, Voice Design, vous permet de créer une nouvelle voix IA entièrement de zéro simplement en décrivant la voix que vous souhaitez obtenir, sans copier une voix humaine existante.
Imaginez que vous ayez besoin d’un narrateur chaleureux et rassurant pour votre marque, d’un assistant digital énergique pour votre application mobile ou d’une voix calme et facile à comprendre pour vos contenus de formation. Lorsque vous ne trouvez pas la voix recherchée dans la Voice Library existante, vous pouvez décrire les caractéristiques de la voix souhaitée avec un prompt au lieu de passer des heures à parcourir différents enregistrements.
Voice Design a précisément été développé pour résoudre ce problème.
Qu’est-ce qu’ElevenLabs Voice Design ?
ElevenLabs Voice Design est une fonctionnalité d’ElevenLabs qui permet aux utilisateurs de créer une voix synthétique unique en rédigeant un text prompt (invite textuelle). Au lieu de sélectionner l’une des voix existantes dans la Voice Library, vous pouvez créer une nouvelle voix en décrivant en langage naturel des caractéristiques telles que l’âge, l’accent, le ton, le rythme, l’émotion et le style de parole.
Par exemple, vous pouvez définir une voix de cette manière :
« Une voix féminine chaleureuse et rassurante d’une femme à la fin de la trentaine. Léger accent britannique, rythme de parole moyen, ton naturel et professionnel. Une diction claire et calme pour des vidéos de formation en entreprise. »
Voice Design analyse cette description et génère différentes alternatives vocales correspondant à vos critères.
Dans l’expérience actuelle d’ElevenLabs Voice Design, trois voice previews différentes sont générées à chaque génération. L’utilisateur peut écouter ces alternatives, sélectionner la plus adaptée et l’enregistrer dans la collection de voix de son compte ElevenLabs.
Cette approche est particulièrement importante pour les équipes qui souhaitent créer une nouvelle identité vocale adaptée à une personnalité de marque ou à un cas d’usage spécifique plutôt que d’utiliser simplement l’une des voix prêtes à l’emploi disponibles.
Comment fonctionne ElevenLabs Voice Design ?
Le fonctionnement de Voice Design peut essentiellement être divisé en trois étapes : définir la voix, générer les exemples et enregistrer la voix la plus adaptée.
1. Définissez le caractère vocal que vous souhaitez créer
La première étape consiste à déterminer dans quel objectif la voix sera utilisée.
Par exemple :
- Narrateur pour formations en entreprise
- Narrator pour vidéos de marque
- Animateur de podcast
- AI assistant intégré à une application mobile
- Personnage de jeu
- Personnage d’audiobook
- Système IVR
- Conversational AI agent
- Vidéos de présentation produit
- Contenus pour les réseaux sociaux
L’usage prévu de la voix influence directement les détails qui doivent être prioritaires dans le prompt.
Alors qu’un agent de support client nécessite une voix rassurante, claire et mesurée, un personnage de jeu peut nécessiter un ton dramatique, inhabituel ou exagéré.
2. Rédigez un Voice Prompt
L’entrée principale de Voice Design est le voice prompt.
Selon la documentation d’ElevenLabs, des caractéristiques telles que l’âge, le gender, l’accent, le ton, le pacing, l’émotion, le speaking style et l’audio quality peuvent être définies dans le prompt. Des descriptions plus détaillées peuvent souvent aider le modèle à interpréter plus précisément la voix souhaitée.
Un bon Voice Design prompt peut inclure les éléments suivants :
Âge : jeune, âge moyen, âgé, etc.
Caractère de la voix : chaleureux, puissant, doux, autoritaire, énergique.
Accent : neutral American, British, French, Turkish accent, etc.
Rythme : rapide, lent, measured ou conversational.
Émotion : calme, enthousiaste, rassurante, chaleureuse.
Cas d’usage : audiobook, publicité, AI agent ou vidéo corporate.
Audio quality : qualité studio propre ou effets créatifs spécifiques.
ElevenLabs indique qu’avec Voice Design v3, des éléments comme l’audio quality peuvent également être spécifiés directement dans le prompt.
Exemple de Prompt ElevenLabs Voice Design
Lorsque vous utilisez Voice Design, il est possible d’écrire une description très générale comme « professional male voice ». Toutefois, ajouter du contexte peut constituer un meilleur point de départ pour obtenir des résultats plus contrôlés.
Par exemple, le prompt suivant pourrait être utilisé pour les vidéos de présentation produit d’une entreprise SaaS :
Voice Design prompt :
Perfect audio quality. A confident male speaker in his late 30s with a neutral international English accent. Warm, professional and trustworthy tone. Medium speaking pace with clear pronunciation and subtle enthusiasm. Designed for enterprise SaaS product videos and executive presentations.
Ici, le modèle apprend non seulement l’âge et le type de voix, mais aussi dans quel contexte elle sera utilisée et quelle impression elle doit produire sur l’auditeur.
Pour un AI agent de service client, une approche différente peut être utilisée :
A friendly female voice in her early 30s. Calm, patient and reassuring personality. Neutral English accent, natural conversational pacing and clear pronunciation. The voice should sound professional but never robotic, suitable for customer support conversations.
Ces types de prompts sont particulièrement importants dans les projets de Conversational AI (IA conversationnelle), car l’une des premières impressions qu’un client se fait d’un agent provient directement du caractère de sa voix.
Quelles caractéristiques vocales peuvent être définies avec Voice Design ?
ElevenLabs Voice Design n’est pas simplement un outil permettant de « créer une voix masculine ou féminine ». De nombreuses dimensions qui composent le caractère d’une voix peuvent être définies simultanément.
Âge et caractère vocal
Les caractéristiques permettant à une voix d’être perçue comme jeune, d’âge moyen ou âgée peuvent être spécifiées dans le prompt.
Par exemple :
“Energetic young adult voice”
ou
“Calm elderly storyteller with a warm, textured voice.”
Accent et style de parole
Les marques peuvent décrire des caractéristiques d’accent précises lorsqu’elles produisent du contenu destiné à différents marchés.
Par exemple :
“Neutral American accent”
“Light French accent”
“British English speaker”
peuvent être utilisés.
ElevenLabs indique que Voice Design v3 intègre des améliorations permettant de traiter des combinaisons d’accents plus détaillées et des descriptions vocales plus nuancées.
Ton et émotion
Un même texte peut créer une expérience utilisateur totalement différente selon le ton utilisé.
Alors qu’une application financière peut avoir besoin d’une voix rassurante et maîtrisée, une marque de gaming peut préférer une voix énergique et théâtrale.
Dans le prompt, des descriptions telles que :
- Warm
- Confident
- Calm
- Friendly
- Serious
- Assertive
- Joyful
- Anxious
peuvent être utilisées.
Vitesse de parole
Voice Design permet également de décrire le pacing, c’est-à-dire le rythme de parole, directement dans le prompt.
Par exemple :
“slow and reflective”
“fast-paced and energetic”
“measured professional delivery”
peuvent être utilisés.
Quelle est la différence entre Voice Design et Voice Cloning ?
Ces deux fonctionnalités peuvent parfois être confondues.
Voice Design vise à créer une nouvelle voix synthétique qui n’existe pas encore. L’utilisateur décrit en langage naturel la voix qu’il souhaite obtenir et le système génère de nouvelles alternatives vocales.
Voice Cloning, en revanche, correspond à un processus différent visant à recréer numériquement une voix humaine existante en utilisant ses caractéristiques spécifiques.
Ainsi, si vous souhaitez créer une toute nouvelle « brand voice » pour votre entreprise, Voice Design peut constituer une option adaptée. Si vous souhaitez utiliser numériquement la voix d’un intervenant spécifique et autorisé, Voice Cloning répond à un autre cas d’usage.
ElevenLabs ne positionne pas non plus Professional Voice Clone et Voice Design comme des fonctionnalités interchangeables. Professional Voice Clone répond notamment à un besoin différent lorsqu’il est nécessaire de recréer la voix d’un intervenant spécifique disposant des autorisations nécessaires.
Comment utiliser Voice Design ?
Le processus est relativement simple dans l’application web ElevenLabs.
Étapes d’utilisation d’ElevenLabs Voice Design
Dans ElevenLabs :
Voices → My Voices → Add a new voice → Voice Design
Vous pouvez suivre ce chemin.
Ensuite :
- Décrivez la voice que vous souhaitez créer.
- Définissez le texte que vous souhaitez faire lire pendant la preview.
- Lancez le processus de voice generation.
- Écoutez les trois alternatives différentes générées.
- Sélectionnez celle qui correspond le mieux à votre cas d’usage.
- Enregistrez la voice sélectionnée dans votre collection de voix.
- Utilisez-la dans Text to Speech, dans des contenus créatifs ou dans d’autres workflows ElevenLabs adaptés.
Le point essentiel ici est de tester la voix générée dans différents scénarios au lieu de transférer directement le premier résultat dans un environnement de production.
Voice Design peut-il être utilisé via une API ?
Oui. Voice Design ne doit pas nécessairement être utilisé uniquement via l’interface web d’ElevenLabs.
ElevenLabs propose un support API pour Voice Design. Dans le workflow API officiel, des voice previews sont d’abord générées à partir d’un prompt, puis le generated voice ID sélectionné est utilisé pour enregistrer la voix et l’utiliser dans d’autres processus API.
Cela représente un avantage important, notamment pour les équipes de développement.
Par exemple, au lieu de créer manuellement une voix pour chaque nouveau personnage, une entreprise de jeux vidéo peut développer un système qui génère automatiquement des prompts en fonction de paramètres spécifiques au personnage.
De la même manière, une plateforme de contenu peut concevoir un workflow tel que :
Content brief → Voice persona → Voice Design API → Voice selection → Text to Speech
À ce stade, un partenaire stratégique spécialisé dans ElevenLabs comme Omtera peut faire évoluer Voice Design d’un outil de contenu utilisé de manière indépendante vers un composant d’une architecture voice AI plus large, connectée aux applications, workflows et systèmes d’entreprise existants.
Où les entreprises peuvent-elles utiliser Voice Design ?
L’un des principaux avantages de Voice Design est qu’il n’est pas limité à un seul secteur.
Créer une Brand Voice
Tout comme les marques standardisent les couleurs, les polices et les design systems dans leur identité visuelle, elles peuvent également standardiser leur identité vocale.
Par exemple, vous pouvez créer une voice synthétique personnalisée pour votre entreprise avec les caractéristiques suivantes :
- calme,
- innovante,
- rassurante,
- professionnelle,
- technologique.
La possibilité d’utiliser des custom voices pour la production de contenu et la cohérence de marque au sein d’ElevenCreative fait également partie des cas d’usage pris en charge par ElevenLabs.
Contenus Marketing
Les équipes Marketing peuvent utiliser Voice Design pour créer des caractères vocaux adaptés à différentes campagnes et différents formats.
Par exemple, une même entreprise peut utiliser :
une voix plus sérieuse pour un webinar corporate,
une voix plus énergique pour une vidéo Instagram,
une voix plus explicative pour une démonstration produit,
une voix plus chaleureuse pour une customer story.
AI Voice Agents
Dans les systèmes de Conversational AI, l’expérience ne dépend pas uniquement de ce que dit l’agent, mais aussi de la manière dont il le dit.
Une voix calme et rassurante peut être créée pour un customer support voice agent, tandis qu’une voix plus énergique mais toujours professionnelle peut être préférée pour un sales agent.
Contenus de Formation et Learning
Pour les contenus de formation longs, il est important que la voix reste claire, cohérente et agréable à écouter.
Avec Voice Design, un narrator spécifiquement conçu pour les contenus de formation de l’entreprise peut être créé afin d’utiliser le même caractère vocal dans différents modules.
Jeux et Personnages Digitaux
Voice Design v3 est positionné par ElevenLabs pour les scénarios de création de realistic voice et de character voice. Il est donc possible de prototyper rapidement différentes voix de personnages pour des projets créatifs allant des personnages de jeux aux histoires interactives.
Quels éléments faut-il prendre en compte dans les projets Enterprise Voice Design ?
Techniquement, créer une voice peut ne prendre que quelques minutes. Cependant, une « belle voix » ne suffit pas pour une voice d’entreprise destinée à être utilisée dans un environnement de production.
Définissez d’abord une Voice Persona
Avant de passer à Voice Design, il convient de répondre aux questions suivantes :
Comment notre marque s’exprime-t-elle ?
Qui est notre audience cible ?
Sur quels canaux la voice sera-t-elle utilisée ?
Doit-elle être formelle ou chaleureuse ?
Énergique ou calme ?
Dans quelles langues sera-t-elle utilisée ?
Pendant combien de minutes l’utilisateur interagira-t-il avec la voix ?
Si ces questions ne sont pas traitées avant la création de la voix, les équipes risquent de tester continuellement de nouvelles voix et de rencontrer des problèmes de standardisation.
Testez avec de vrais textes
Au lieu d’évaluer la voix uniquement à partir d’une seule phrase de démonstration, il est nécessaire de la tester dans de véritables scénarios d’utilisation.
Par exemple, si un voice agent est utilisé, différents exemples doivent être testés :
Message d’accueil,
longue explication,
question,
message d’excuse,
termes techniques,
chiffres,
noms de produits.
Préservez la cohérence de la marque
Si la voice utilisée par l’équipe Marketing et celle utilisée par l’équipe customer support ont des personnalités totalement différentes, l’expérience de marque peut devenir fragmentée.
Il peut donc être utile de créer une AI voice guideline commune à toute l’organisation.
Cette guideline peut définir par exemple :
- approved voices,
- voice prompt,
- tone,
- pronunciation rules,
- cas d’usage,
- usages interdits,
- critères de test.
Projets ElevenLabs Voice Design avec Omtera
Les capacités d’ElevenLabs ne se limitent pas à la voice generation. La plateforme permet de créer des scénarios basés sur la génération de speech par intelligence artificielle, le Conversational AI, la transcription, la localization et la voice intelligence basée sur API.
Dans un projet d’entreprise, la véritable valeur ne vient donc pas uniquement de la création d’une nouvelle voix, mais de son intégration dans le bon business workflow.
En tant que partenaire stratégique d’ElevenLabs, Omtera peut accompagner les entreprises dans des domaines tels que :
- Identification des cas d’usage Voice AI,
- création d’une voice persona adaptée,
- développement d’une stratégie de prompt Voice Design,
- intégration de l’API ElevenLabs,
- scénarios de Conversational AI,
- intégration avec les systèmes d’entreprise existants,
- préparation aux phases de test et de production,
- mise à l’échelle des processus voice AI.
Par exemple, une entreprise peut créer une voix personnalisée pour son service client à l’aide de Voice Design. Cependant, dans un véritable scénario de production, cette voice doit être conçue avec le Conversational AI agent, les sources de connaissances, les données client, la business logic et les processus de transfert vers un agent humain lorsque cela est nécessaire.
C’est précisément à ce niveau que la véritable valeur enterprise de la technologie ElevenLabs apparaît.
ElevenLabs Voice Design permet aux entreprises de créer des voix IA adaptées à leurs propres cas d’usage sans être limitées aux voix prêtes à l’emploi. D’une simple description de quelques mots jusqu’à une voice persona détaillée comprenant l’âge, l’accent, le tone, le pacing, l’emotion et le cas d’usage, il est possible de concevoir de nouvelles voix à partir de prompts présentant différents niveaux de détail.
Cependant, notamment dans les projets enterprise, l’objectif ne doit pas se limiter à créer une voice impressionnante. La bonne voix doit fonctionner avec le bon contenu, le bon workflow, le bon agent, la bonne API et le bon business system. En tant que partenaire stratégique d’ElevenLabs, Omtera peut aider à mettre en place cette architecture de manière adaptée, de Voice Design jusqu’aux applications de Conversational AI et d’enterprise voice AI.
Prêt à créer une expérience AI voice réaliste et scalable ? Planifiez un échange rapide avec Omtera et donnez vie à votre cas d’usage ElevenLabs dès aujourd’hui.
Questions fréquemment posées
Qu’est-ce qu’ElevenLabs Voice Design ?
ElevenLabs Voice Design est une fonctionnalité qui permet aux utilisateurs de créer de zéro une nouvelle voix IA synthétique en rédigeant un text prompt. Des caractéristiques telles que l’âge, l’accent, le ton, le rythme, l’émotion et le style de parole peuvent être définies.
Comment utiliser ElevenLabs Voice Design ?
Dans ElevenLabs, accédez à Voices → My Voices → Add a new voice → Voice Design, décrivez la voix que vous souhaitez créer, définissez le texte de preview et choisissez parmi les alternatives vocales générées.
Combien de voix différentes Voice Design génère-t-il ?
Dans l’expérience actuelle de Voice Design, trois voice previews différentes sont générées à chaque processus de génération. L’utilisateur peut choisir l’alternative souhaitée et l’enregistrer.
Peut-on créer une brand voice avec Voice Design ?
Oui. En définissant l’âge, le ton, l’accent, le rythme de parole et la personnalité de la voix, il est possible de concevoir une voice synthétique adaptée au style de communication de la marque. ElevenLabs positionne également l’utilisation de custom voices comme l’un des cas d’usage permettant de créer une brand voice cohérente.
Voice Design et Voice Cloning sont-ils identiques ?
Non. Voice Design crée une nouvelle voice synthétique, tandis que Voice Cloning vise à créer une voice digitale à partir des caractéristiques d’une voix humaine existante.
Voice Design peut-il être utilisé via une API ?
Oui. Avec l’API ElevenLabs Voice Design, vous pouvez générer des voice previews à partir d’un prompt, enregistrer le generated voice ID sélectionné puis l’utiliser dans d’autres workflows API ElevenLabs.
Pour quels projets Voice Design peut-il être utilisé ?
Voice Design peut être utilisé pour les marketing voiceovers, les audiobooks, les podcasts, les personnages de jeux, les AI voice agents, les contenus de formation, les systèmes IVR, les brand voices et différents types d’expériences digitales.
.webp)

