Tekoälyn prompt engineering · Oppitunti

Voice AI -persoonan suunnittelu

Yhtenäisten voice persona -hahmojen luominen: sävy, puhetyyli ja persoonallisuus

Oppitunti 3/413 vaihetta

Voice AI -persoonan suunnittelu on ilmainen Tekoälyn prompt engineering-oppitunti CoddyKitissä. Tämä on oppitunti 3/4. Voit lukea tästä oppimispolusta kokonaan mitkä tahansa 3 oppituntia ilmaiseksi — sen jälkeen CoddyKit PRO avaa kaikki oppitunnit sekä käytännön harjoittelun sisäänrakennetulla koodieditorilla ja ympäri vuorokauden toimivalla tekoälytuutorilla. Oppitunti kuuluu Tekoälyn prompt engineering-oppimispolkuun, ja edistymisesi synkronoituu verkon ja CoddyKit-sovelluksen välillä. Tekoälyn prompt engineering-kurssilla on yhteensä 4 oppituntia.

Mikä on puhe-AI:n persoona?

Puhe-AI:n persoona on johdonmukainen hahmo, jonka puheeseen perustuva tekoälyjärjestelmä esittää käyttäjille. Se on enemmän kuin pelkkä TTS-äänen valinta — kyse on sävyn, sanaston, puhenopeuden, persoonallisuuden piirteiden ja johdonmukaisen toiminnan yhdistelmästä, joka saa tekoälyn tuntumaan selkeästi erottuvalta toimijalta.

Hyvin suunnitellut persoonat rakentavat käyttäjän luottamusta ja tekevät vuorovaikutuksesta luonnollisen tuntuista. Huonosti suunnitellut persoonat tuntuvat robottimaisilta, epäjohdonmukaisilta tai oudoilta.

Äänipersoonan neljä ulottuvuutta

Äänipersoona määritellään neljän ulottuvuuden kautta:

  • Sävy: Tunneilmaisun rekisteri (lämmin, ammattimainen, leikkisä, vakava)
  • Sanaston taso: Yksinkertainen/puhekielinen vs. tekninen/muodollinen
  • Puhenopeus: Kuinka nopeasti persoona puhuu luontevasti ja kuinka se pitää taukoja
  • Persoonallisuuden piirteet: Tietyt toimintatavat (empaattinen, ytimekäs, utelias)

Kaikkien neljän on oltava johdonmukaisia — lämmin sävy yhdistettynä tekniseen jargoniin aiheuttaa ristiriidan.

Sävyn määrittely järjestelmäkehotteissa

Järjestelmäkehotteessa määritellään äänipersoona. Määritelkää sävy tarkasti — epämääräiset ohjeet, kuten ystävällisyys, tuottavat epäjohdonmukaisia tuloksia. Nimetkää tunteet, antakaa esimerkkejä ja kuvailkaa, mitä persoona ei tee.

WARM_PROFESSIONAL_VOICE = (
    'You are Aria, a voice assistant for a healthcare platform.\n\n'
    'Tone:\n'
    '- Warm but professional: convey care without being overly casual.\n'
    '- Never alarmist: deliver health information calmly and clearly.\n'
    '- Empathetic: acknowledge emotions before jumping to information.\n'
    '  Example: "That sounds stressful. Let me help you find an answer."\n\n'
    'NOT: cold, clinical, robotic, condescending, or dismissive.\n\n'
    'Vocabulary:\n'
    '- Use plain language. Explain medical terms when you use them.\n'
    '- Avoid jargon unless the user introduced it first.\n\n'
    'Speech style:\n'
    '- Short sentences. One idea per sentence.\n'
    '- Never use bullet points or lists. Speak in connected prose.\n'
    '- Use contractions naturally: say "you are" as "you are" when formal, '
    '  "you are" as "you are" in casual moments.'
)
print(WARM_PROFESSIONAL_VOICE[:300])

Sanaston tason kalibrointi

Sanaston taso määrittää, keille puhe-AI:n käyttö tuntuu helpolta. Määritelkää taso järjestelmäkehotteessa selkeästi käyttämällä konkreettisia esimerkkejä ja vastaesimerkkejä.

# Three vocabulary level examples:

SIMPLE_VOCABULARY = (
    'Use simple, everyday words. '
    'If you need to use a complex word, explain it right away.\n'
    'Say "heart" not "cardiac". '
    'Say "get worse" not "deteriorate". '
    'Say "check" not "verify". '
    'Target a reading level of grade 8.'
)

MEDIUM_VOCABULARY = (
    'Use professional but accessible language. '
    'Technical terms are acceptable if they are widely known in the field.\n'
    'Assume the user has basic familiarity with the domain. '
    'Define specialized jargon on first use.'
)

TECHNICAL_VOCABULARY = (
    'Use precise technical language appropriate for domain experts.\n'
    'Assume the user is a professional with years of experience.\n'
    'Do not over-explain concepts that any expert would know.'
)

print('Level selection is critical for user trust and comprehension')

Tunnuslauseet ja kielelliset kaavat

Johdonmukaiset kielelliset kaavat vahvistavat persoonan identiteettiä. Tunnuslauseet, tervehdykset ja siirtymäfraasit saavat äänen tuntumaan oikealta hahmolta geneerisen järjestelmän sijaan.

# Voice persona with consistent verbal patterns
PERSONA_PATTERNS = {
    'name': 'Sage',
    'role': 'Learning assistant for a coding education platform',
    'greeting': 'Hello! Ready to learn something new today?',
    'encouragement': [
        'Great question.',
        'You are on the right track.',
        'Let us work through this together.',
    ],
    'transition': [
        'Here is the key idea.',
        'Think of it this way.',
        'Let me break that down.',
    ],
    'closing': 'Give it a try, and come back if you get stuck.',
    'correction': 'Not quite, but you are close. Let me clarify.',
}

SAGE_SYSTEM = (
    f'You are {PERSONA_PATTERNS["name"]}, {PERSONA_PATTERNS["role"]}.\n\n'
    f'Greeting style: "{PERSONA_PATTERNS["greeting"]}"\n'
    f'When praising: use phrases like "{PERSONA_PATTERNS["encouragement"][0]}"\n'
    f'When transitioning: use phrases like "{PERSONA_PATTERNS["transition"][0]}"\n'
    f'When closing: say "{PERSONA_PATTERNS["closing"]}"\n'
    f'When correcting: say "{PERSONA_PATTERNS["correction"]}"'
)
print(SAGE_SYSTEM[:300])

Puhenopeus järjestelmäkehotteissa

Ette voi hallita TTS:n nopeutta suoraan järjestelmäkehotteessa, mutta voitte vaikuttaa siihen säätelemällä lauseiden pituutta, taukojen määrää (SSML-vihjeiden avulla) ja tekstin tiiviyttä. Ohjeistakaa LLM:ää kirjoittamaan sisältöä, joka tuottaa TTS:n esittämänä halutun puherytmin.

# Slow, deliberate persona (for complex educational content)
SLOW_PACE_PROMPT = (
    'When explaining concepts:\n'
    '- Use short sentences. Maximum 12 words each.\n'
    '- State each idea, then pause (use a period).\n'
    '- After each main point, add a brief rhetorical pause by ending with '
    '  an ellipsis: "Take a moment to consider that..."\n'
    '- Repeat key terms twice when they are first introduced.\n'
    '- Never rush through lists. Introduce each item separately.'
)

# Fast, energetic persona (for notifications or quick answers)
FAST_PACE_PROMPT = (
    'Answer questions directly and concisely.\n'
    'Lead with the answer, then add context only if essential.\n'
    'Limit responses to 2-3 sentences.\n'
    'Use active voice. Start sentences with the subject.\n'
    'Avoid preambles like "Great question" or "Certainly".'
)
print('Pace is shaped by sentence structure, not just words per minute')

Persoonan johdonmukaisuus eri aiheissa

Persoonan suunnittelun vaikein osa on johdonmukaisuuden säilyttäminen keskustelun vaihtaessa aihetta. Persoonan tulisi kuulostaa samalta hahmolta riippumatta siitä, käsitelläänkö teknistä virhettä vai laskutusta koskevaa kysymystä.

import anthropic

client = anthropic.Anthropic(api_key='sk-ant-...')

PERSONA_SYSTEM = (
    'You are Nova, a voice assistant for a software development tool.\n\n'
    'Core personality: Precise, calm, slightly playful. '
    'You enjoy problem-solving. You never show frustration.\n\n'
    'Consistent behaviors regardless of topic:\n'
    '- Always use "we" when referring to things done together with the user.\n'
    '- When you do not know something, say "I do not have that information right now."\n'
    '  Never say "I cannot help with that."\n'
    '- When something is complex, say "Let us take this one step at a time."\n'
    '- Close long explanations with "Does that make sense?"'
)

def ask_nova(question):
    r = client.messages.create(
        model='claude-opus-4-5',
        max_tokens=300,
        system=PERSONA_SYSTEM,
        messages=[{'role': 'user', 'content': question}]
    )
    return r.content[0].text

print(ask_nova('Why is my build failing?')[:200])
print(ask_nova('How do I update my credit card?')[:200])

Tunnesävy: vaikeiden tilanteiden käsittely

Puhe-AI:n persoonat tarvitsevat täsmälliset ohjeet tunnepitoisiin vuorovaikutustilanteisiin — turhautuneisiin käyttäjiin, arkaluonteisiin aiheisiin ja virhetilanteisiin. Persoonan tulisi vastata tilanteeseen sopivalla tunneälyllä.

EMOTIONAL_INTELLIGENCE_PROMPT = (
    'When a user expresses frustration, confusion, or distress:\n\n'
    '1. ACKNOWLEDGE first: Validate the emotion before giving information.\n'
    '   Example: "I understand this is frustrating. Let us fix it together."\n\n'
    '2. SLOW DOWN: Use shorter, clearer sentences than usual.\n\n'
    '3. AVOID jargon when the user is already confused.\n\n'
    '4. OFFER agency: Give the user a clear next step they can take.\n'
    '   Example: "Here is what you can do right now."\n\n'
    '5. CLOSE with reassurance: End with a positive, forward-looking statement.\n'
    '   Example: "You have got this. I am here if you need more help."\n\n'
    'NEVER: rush the user, use technical jargon, or give multiple options '
    'simultaneously when they are overwhelmed.'
)
print(EMOTIONAL_INTELLIGENCE_PROMPT[:300])

Äänipersoona eri kanavissa

Samaa persoonaa voi olla tarpeen mukauttaa eri käyttökanaviin: IVR-puhelinjärjestelmään, älykaiuttimeen, sovelluksen sisäiseen puheavustajaan tai puhelinpalvelubottiin. Jokaisella kanavalla on erilaiset akustiset ominaisuudet ja käyttäjien odotukset.

# Channel-specific persona adjustments

IVR_ADJUSTMENTS = (
    'You are speaking to a caller on a phone IVR system.\n'
    '- Callers cannot see any text. Speak clearly and slowly.\n'
    '- Always offer numbered options for key decisions: '
    '"Say one for billing, say two for technical support."\n'
    '- Confirm actions before executing: "You said billing. Is that correct?"\n'
    '- Speak phone numbers and reference codes digit by digit.'
)

SMART_SPEAKER_ADJUSTMENTS = (
    'You are speaking through a smart speaker in a home environment.\n'
    '- Users may be across the room. Speak clearly at a moderate pace.\n'
    '- Keep answers short — under 30 seconds of speech.\n'
    '- Offer to continue: "Would you like more details?"\n'
    '- Avoid visual references: never say "see the chart" or "tap here".'
)

print('IVR:', IVR_ADJUSTMENTS[:100])
print('Smart speaker:', SMART_SPEAKER_ADJUSTMENTS[:100])

Persoonan johdonmukaisuuden testaaminen

Suorittakaa persoonan johdonmukaisuustesti: esittäkää samalle tekoälylle monipuolinen joukko kysymyksiä ja tarkistakaa, tuntuvatko sävy, sanasto ja persoonallisuus samalta hahmolta kaikissa vastauksissa.

import anthropic

client = anthropic.Anthropic(api_key='sk-ant-...')

TEST_QUESTIONS = [
    'Hello, who are you?',
    'My account is locked and I am frustrated.',
    'Can you explain what an API is?',
    'What is the weather like today?',  # Out of scope question
    'Thank you, you were very helpful!',
]

def persona_consistency_test(system_prompt):
    print('=== Persona Consistency Test ===')
    for q in TEST_QUESTIONS:
        r = client.messages.create(
            model='claude-opus-4-5',
            max_tokens=150,
            system=system_prompt,
            messages=[{'role': 'user', 'content': q}]
        )
        answer = r.content[0].text
        print(f'Q: {q}')
        print(f'A: {answer[:100]}\n')
        # Review manually: same tone? same vocabulary level? same personality?

persona_consistency_test(PERSONA_SYSTEM)

Persoonan rajat ja persoonan ulkopuoliset pyynnöt

Äänipersoonien on käsiteltävä määritellyn toiminta-alueensa ulkopuolelle jäävät pyynnöt luontevasti. Kun käyttäjä kysyy ruoanlaittoavustajalta osakekaupasta, persoonan on kieltäydyttävä rikkomatta rooliaan tai kuulostamatta robottimaiselta.

Määritelkää persoonan ulkopuolisia pyyntöjä koskevat vastaukset järjestelmäkehotteessa selkeästi: suhtautukaa pyyntöön lämpimästi, selittäkää lyhyesti persoonan toiminta-alue ja ohjatkaa keskustelu siihen, missä persoona voi auttaa. Kieltäytymisen sävy on yhtä tärkeä kuin sen sisältö.

Tietotesti: äänipersoonan ulottuvuus

Mikä elementti on TÄRKEIN, jotta puhe-AI:n persoona tuntuisi johdonmukaiselta keskustelun eri aiheissa?

Kertaus: puhe-AI:n persoonan suunnittelu

Puhe-AI:n persoona määritellään neljän ulottuvuuden avulla: sävy (tunneilmaisun rekisteri), sanaston taso, puhenopeus ja johdonmukaiset persoonallisuuden piirteet. Kaikkien neljän on oltava linjassa — lämmin sävy yhdistettynä tekniseen jargoniin aiheuttaa ristiriidan. Määritelkää persoona järjestelmäkehotteessa käyttämällä täsmällisiä esimerkkejä ja vastaesimerkkejä. Tunnuslauseet ja kielelliset kaavat (tervehdykset, siirtymät ja lopetukset) vahvistavat identiteettiä. Sisällyttäkää ohjeet tunneälystä turhautuneita tai hämmentyneitä käyttäjiä varten. Mukauttakaa persoona käyttökanavan mukaan (IVR, älykaiutin, sovelluksen sisäinen käyttö). Testatkaa johdonmukaisuus esittämällä monipuolisia kysymyksiä ja arvioimalla, kuulostavatko vastaukset samalta hahmolta.

Aloita maksutta

Opi Tekoälyn prompt engineering tekoälytuutorin avulla — ilmaiseksi

Kirjoita ja suorita oikeaa koodia selaimessa, saa välitöntä apua tekoälytuutorilta ympäri vuorokauden ja jatka siitä, mihin jäit, verkossa tai sovelluksessa.

Kurssit
53
Oppitunnit
199

Usein kysytyt kysymykset

Onko oppitunti ”Voice AI -persoonan suunnittelu” ilmainen?

Kyllä — voit lukea täällä verkossa kokonaan ilmaiseksi mitkä tahansa Tekoälyn prompt engineering-oppimispolun 3 oppituntia, myös oppitunnin “Voice AI -persoonan suunnittelu”. Sen jälkeen CoddyKit PRO avaa kaikki oppitunnit sekä interaktiiviset harjoitukset sisäänrakennetulla koodieditorilla ja ympäri vuorokauden toimivalla tekoälytuutorilla. Tekoälyn prompt engineering-kurssilla on yhteensä 4 oppituntia.

Mitä opin oppitunnilla ”Voice AI -persoonan suunnittelu”?

Yhtenäisten voice persona -hahmojen luominen: sävy, puhetyyli ja persoonallisuus Harjoittelet Tekoälyn prompt engineering-aihetta koodilla, jonka suoritat suoraan selaimessa. Ympäri vuorokauden käytettävissä oleva tekoälytuutori vastaa kysymyksiisi oppitunnin aikana.

Tarvitsenko kokemusta aloittaakseni Tekoälyn prompt engineering-opiskelun?

Aiempi kokemus ei ole tarpeen. CoddyKitin Tekoälyn prompt engineering-oppimispolku sopii vasta-alkajista edistyneisiin, joten voit aloittaa tästä tai alusta ja edetä omaan tahtiisi. Tämä on oppitunti 3/4.

Kuinka kauan ”Voice AI -persoonan suunnittelu”-oppitunnin suorittaminen kestää?

Useimmat CoddyKitin oppitunnit kestävät noin 5–10 minuuttia. Jokainen oppitunti on lyhyt ja interaktiivinen, joten edistyt tasaisesti ja voit jatkaa siitä, mihin jäit – sekä verkossa että sovelluksessa.

Voinko kirjoittaa ja suorittaa koodia tällä Tekoälyn prompt engineering-oppitunnilla?

Kyllä. Jokainen Tekoälyn prompt engineering-oppitunti sisältää sisäänrakennetun koodieditorin, joten voit kirjoittaa ja suorittaa oikeaa koodia suoraan selaimessa ja saada välitöntä palautetta tekoälyltä – paikallista asennusta ei tarvita.

Kaikki tämän kurssin oppitunnit

  1. TTS-kehotemallit luonnolliseen puheeseen
  2. SSML ja prosodian hallinta
  3. Voice AI -persoonan suunnittelu
  4. Monimuotoiset puhe- ja tekstiedustajat
← Takaisin: Tekoälyn prompt engineering