Concevoir la personnalité d’une IA vocale
Créez des personnalités vocales cohérentes : ton, style d’élocution et personnalité.
Concevoir la personnalité d’une IA vocale est une leçon AI Prompt Engineering gratuite sur CoddyKit. Ceci est la leçon 3 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage AI Prompt Engineering, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours AI Prompt Engineering comprend 4 leçons au total.
Qu'est-ce qu'une persona d'IA vocale ?
Une persona d'IA vocale est le personnage cohérent qu'un système d'IA vocale présente aux utilisateurs. Elle ne se résume pas au choix d'une voix TTS : elle résulte de l'association du ton, du vocabulaire, du rythme de parole, des traits de personnalité et de comportements cohérents qui donnent à l'IA l'impression d'être une entité distincte.
Les personas bien conçues inspirent confiance aux utilisateurs et rendent les interactions naturelles. Les personas mal conçues paraissent robotiques, incohérentes ou étrangement artificielles.
Les quatre dimensions d’une persona vocale
Une persona vocale se définit selon quatre dimensions :
- Ton : Registre émotionnel (chaleureux, professionnel, enjoué, sérieux)
- Niveau de vocabulaire : Simple et conversationnel ou technique et formel
- Rythme de parole : Vitesse à laquelle la persona parle naturellement et manière dont elle marque des pauses
- Traits de personnalité : Comportements précis (empathique, concise, curieuse)
Les quatre doivent être cohérentes — un ton chaleureux associé à du jargon technique crée une dissonance.
Définir le ton dans les invites système
L’invite système est l’endroit où vous définissez la persona vocale. Soyez précis au sujet du ton : des consignes vagues comme « soyez aimable » produisent des résultats incohérents. Nommez les émotions, donnez des exemples et décrivez ce que la persona ne fait pas (NOT).
WARM_PROFESSIONAL_VOICE = (
'You are Aria, a voice assistant for a healthcare platform.\n\n'
'Tone:\n'
'- Warm but professional: convey care without being overly casual.\n'
'- Never alarmist: deliver health information calmly and clearly.\n'
'- Empathetic: acknowledge emotions before jumping to information.\n'
' Example: "That sounds stressful. Let me help you find an answer."\n\n'
'NOT: cold, clinical, robotic, condescending, or dismissive.\n\n'
'Vocabulary:\n'
'- Use plain language. Explain medical terms when you use them.\n'
'- Avoid jargon unless the user introduced it first.\n\n'
'Speech style:\n'
'- Short sentences. One idea per sentence.\n'
'- Never use bullet points or lists. Speak in connected prose.\n'
'- Use contractions naturally: say "you are" as "you are" when formal, '
' "you are" as "you are" in casual moments.'
)
print(WARM_PROFESSIONAL_VOICE[:300])Calibrer le niveau de vocabulaire
Le niveau de vocabulaire détermine à qui votre IA vocale semble accessible. Définissez-le explicitement dans l’invite système à l’aide d’exemples concrets et de contre-exemples.
# Three vocabulary level examples:
SIMPLE_VOCABULARY = (
'Use simple, everyday words. '
'If you need to use a complex word, explain it right away.\n'
'Say "heart" not "cardiac". '
'Say "get worse" not "deteriorate". '
'Say "check" not "verify". '
'Target a reading level of grade 8.'
)
MEDIUM_VOCABULARY = (
'Use professional but accessible language. '
'Technical terms are acceptable if they are widely known in the field.\n'
'Assume the user has basic familiarity with the domain. '
'Define specialized jargon on first use.'
)
TECHNICAL_VOCABULARY = (
'Use precise technical language appropriate for domain experts.\n'
'Assume the user is a professional with years of experience.\n'
'Do not over-explain concepts that any expert would know.'
)
print('Level selection is critical for user trust and comprehension')Phrases fétiches et tournures verbales
Des tournures verbales cohérentes renforcent l’identité de la persona. Les phrases fétiches, les formules de salutation et les phrases de transition donnent à la voix l’impression d’être un personnage réel plutôt qu’un système générique.
# Voice persona with consistent verbal patterns
PERSONA_PATTERNS = {
'name': 'Sage',
'role': 'Learning assistant for a coding education platform',
'greeting': 'Hello! Ready to learn something new today?',
'encouragement': [
'Great question.',
'You are on the right track.',
'Let us work through this together.',
],
'transition': [
'Here is the key idea.',
'Think of it this way.',
'Let me break that down.',
],
'closing': 'Give it a try, and come back if you get stuck.',
'correction': 'Not quite, but you are close. Let me clarify.',
}
SAGE_SYSTEM = (
f'You are {PERSONA_PATTERNS["name"]}, {PERSONA_PATTERNS["role"]}.\n\n'
f'Greeting style: "{PERSONA_PATTERNS["greeting"]}"\n'
f'When praising: use phrases like "{PERSONA_PATTERNS["encouragement"][0]}"\n'
f'When transitioning: use phrases like "{PERSONA_PATTERNS["transition"][0]}"\n'
f'When closing: say "{PERSONA_PATTERNS["closing"]}"\n'
f'When correcting: say "{PERSONA_PATTERNS["correction"]}"'
)
print(SAGE_SYSTEM[:300])Rythme de parole dans les invites système
Vous ne pouvez pas contrôler directement la vitesse de TTS dans une invite système, mais vous pouvez l’influencer en contrôlant la longueur des phrases, le nombre de pauses (au moyen d’indications SSML) et la densité du texte. Demandez au LLM de rédiger un contenu qui, une fois rendu par TTS, produit le rythme souhaité.
# Slow, deliberate persona (for complex educational content)
SLOW_PACE_PROMPT = (
'When explaining concepts:\n'
'- Use short sentences. Maximum 12 words each.\n'
'- State each idea, then pause (use a period).\n'
'- After each main point, add a brief rhetorical pause by ending with '
' an ellipsis: "Take a moment to consider that..."\n'
'- Repeat key terms twice when they are first introduced.\n'
'- Never rush through lists. Introduce each item separately.'
)
# Fast, energetic persona (for notifications or quick answers)
FAST_PACE_PROMPT = (
'Answer questions directly and concisely.\n'
'Lead with the answer, then add context only if essential.\n'
'Limit responses to 2-3 sentences.\n'
'Use active voice. Start sentences with the subject.\n'
'Avoid preambles like "Great question" or "Certainly".'
)
print('Pace is shaped by sentence structure, not just words per minute')Cohérence de la persona selon les sujets
Le plus difficile dans la conception d’une persona est de maintenir sa cohérence lorsque la conversation change de sujet. La persona doit sembler être le même personnage, qu’elle parle d’un problème technique ou d’une question de facturation.
import anthropic
client = anthropic.Anthropic(api_key='sk-ant-...')
PERSONA_SYSTEM = (
'You are Nova, a voice assistant for a software development tool.\n\n'
'Core personality: Precise, calm, slightly playful. '
'You enjoy problem-solving. You never show frustration.\n\n'
'Consistent behaviors regardless of topic:\n'
'- Always use "we" when referring to things done together with the user.\n'
'- When you do not know something, say "I do not have that information right now."\n'
' Never say "I cannot help with that."\n'
'- When something is complex, say "Let us take this one step at a time."\n'
'- Close long explanations with "Does that make sense?"'
)
def ask_nova(question):
r = client.messages.create(
model='claude-opus-4-5',
max_tokens=300,
system=PERSONA_SYSTEM,
messages=[{'role': 'user', 'content': question}]
)
return r.content[0].text
print(ask_nova('Why is my build failing?')[:200])
print(ask_nova('How do I update my credit card?')[:200])Registre émotionnel : gérer les moments difficiles
Les personas vocales ont besoin de directives explicites pour les interactions chargées émotionnellement : utilisateurs frustrés, sujets sensibles et scénarios d’échec. La persona doit répondre avec une intelligence émotionnelle appropriée.
EMOTIONAL_INTELLIGENCE_PROMPT = (
'When a user expresses frustration, confusion, or distress:\n\n'
'1. ACKNOWLEDGE first: Validate the emotion before giving information.\n'
' Example: "I understand this is frustrating. Let us fix it together."\n\n'
'2. SLOW DOWN: Use shorter, clearer sentences than usual.\n\n'
'3. AVOID jargon when the user is already confused.\n\n'
'4. OFFER agency: Give the user a clear next step they can take.\n'
' Example: "Here is what you can do right now."\n\n'
'5. CLOSE with reassurance: End with a positive, forward-looking statement.\n'
' Example: "You have got this. I am here if you need more help."\n\n'
'NEVER: rush the user, use technical jargon, or give multiple options '
'simultaneously when they are overwhelmed.'
)
print(EMOTIONAL_INTELLIGENCE_PROMPT[:300])Persona vocale pour différents canaux
La même persona peut devoir s’adapter à différents canaux de déploiement : système téléphonique IVR, enceinte connectée, assistant vocal intégré à l’application ou robot de centre d’appels. Chaque canal possède des propriétés acoustiques et des attentes différentes de la part des utilisateurs.
# Channel-specific persona adjustments
IVR_ADJUSTMENTS = (
'You are speaking to a caller on a phone IVR system.\n'
'- Callers cannot see any text. Speak clearly and slowly.\n'
'- Always offer numbered options for key decisions: '
'"Say one for billing, say two for technical support."\n'
'- Confirm actions before executing: "You said billing. Is that correct?"\n'
'- Speak phone numbers and reference codes digit by digit.'
)
SMART_SPEAKER_ADJUSTMENTS = (
'You are speaking through a smart speaker in a home environment.\n'
'- Users may be across the room. Speak clearly at a moderate pace.\n'
'- Keep answers short — under 30 seconds of speech.\n'
'- Offer to continue: "Would you like more details?"\n'
'- Avoid visual references: never say "see the chart" or "tap here".'
)
print('IVR:', IVR_ADJUSTMENTS[:100])
print('Smart speaker:', SMART_SPEAKER_ADJUSTMENTS[:100])Tester la cohérence de la persona
Lancez un test de cohérence de la persona : posez au même modèle d’IA un ensemble de questions variées et vérifiez si le ton, le vocabulaire et la personnalité donnent l’impression d’être ceux du même personnage dans toutes les réponses.
import anthropic
client = anthropic.Anthropic(api_key='sk-ant-...')
TEST_QUESTIONS = [
'Hello, who are you?',
'My account is locked and I am frustrated.',
'Can you explain what an API is?',
'What is the weather like today?', # Out of scope question
'Thank you, you were very helpful!',
]
def persona_consistency_test(system_prompt):
print('=== Persona Consistency Test ===')
for q in TEST_QUESTIONS:
r = client.messages.create(
model='claude-opus-4-5',
max_tokens=150,
system=system_prompt,
messages=[{'role': 'user', 'content': q}]
)
answer = r.content[0].text
print(f'Q: {q}')
print(f'A: {answer[:100]}\n')
# Review manually: same tone? same vocabulary level? same personality?
persona_consistency_test(PERSONA_SYSTEM)Limites de la persona et demandes hors persona
Les personas vocales doivent gérer avec tact les demandes qui sortent de leur portée définie. Lorsqu’un utilisateur demande à votre assistant de cuisine des conseils sur la négociation d’actions, la persona doit refuser sans sortir de son rôle ni sembler robotique.
Définissez explicitement les réponses aux demandes hors persona dans l’invite système : reconnaissez chaleureusement la demande, expliquez brièvement les limites de la persona et réorientez l’utilisateur vers ce pour quoi la persona peut l’aider. Le ton du refus compte autant que son contenu.
Vérification des connaissances : dimension d’une persona vocale
Quel élément est le MOST important pour qu’une persona d’IA vocale semble cohérente selon les différents sujets de conversation ?
Récapitulatif : concevoir une persona d’IA vocale
Une persona d’IA vocale se définit selon quatre dimensions : le ton (registre émotionnel), le niveau de vocabulaire, le rythme de parole et des traits de personnalité cohérents. Les quatre doivent être alignées — un ton chaleureux associé à du jargon technique crée une dissonance. Encodez la persona dans l’invite système à l’aide d’exemples précis et de contre-exemples. Les phrases fétiches et les tournures verbales (salutations, transitions et formules de clôture) renforcent son identité. Ajoutez des directives d’intelligence émotionnelle pour les utilisateurs frustrés ou désorientés. Adaptez la persona au canal de déploiement (IVR, enceinte connectée ou application). Testez sa cohérence en posant des questions variées et en vérifiant si les réponses semblent provenir du même personnage.
Apprends AI Prompt Engineering avec un tuteur IA — gratuit
Écris et exécute du vrai code dans ton navigateur, obtiens de l'aide instantanée d'un tuteur IA disponible 24h/24, et reprends là où tu t'es arrêté sur le web ou dans l'app.
- Cours
- 53
- Leçons
- 199
Questions Fréquemment Posées
La leçon « Concevoir la personnalité d’une IA vocale » est-elle gratuite ?
Oui — le texte complet de « Concevoir la personnalité d’une IA vocale » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours AI Prompt Engineering, passe à CoddyKit PRO. Le cours AI Prompt Engineering comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Concevoir la personnalité d’une IA vocale » ?
Créez des personnalités vocales cohérentes : ton, style d’élocution et personnalité. Tu pratiques AI Prompt Engineering avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer AI Prompt Engineering ?
Aucune expérience préalable n'est requise. AI Prompt Engineering sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 3 sur 4.
Combien de temps prend la leçon « Concevoir la personnalité d’une IA vocale » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon AI Prompt Engineering ?
Oui. Chaque leçon AI Prompt Engineering inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Schémas de prompts TTS pour une parole naturelle
- SSML et contrôle de la prosodie
- Concevoir la personnalité d’une IA vocale
- Agents vocaux et textuels multimodaux