Skip to main content
  1. Hjem
  2. API
  3. Slik støtter Speechify Text to Speech API 13 følelser
Updated on API

Slik støtter Speechify Text to Speech API 13 følelser

Cliff Weitzman

Administrerende direktør og grunnlegger av Speechify

Speechify API leverer 300 ms 
latens, stemmer i menneskekvalitet 
og 50+ språk

Apple Design Award 2025
50M+ brukere

Hvorfor følelser er det nye innen talesyntese

Vil du lage dette selv? Speechify Text-to-Speech- og stemmeklonings-API-et finner du på speechify.ai, med dokumentasjon og gratis nøkkel på docs.speechify.ai.

Moderne TTS løste forståelighet for flere år siden. Blizzard Challenge, en årlig benchmark for talesyntese siden 2005, rapporterte at syntetisk tale i 2021 var like tydelig som ekte tale – og nesten like naturlig (Perrotin et al., 2024). Nå har fagfeltet beveget seg videre. Spørsmålet er ikke lenger om man forstår stemmen, men om stemmen høres ut som den mener det den sier. Nå tilbyr Speechify både text to speech og følelsesbasert talesyntese.

Speechify tilbyr følelsesbasert talesyntese

Speechifys følelsespalett dekker sint, munter, trist, livredd, avslappet, engstelig, overrasket, rolig, bestemt, energisk, varm, direkte og lys. Utvalget dekker hele stemningsregisteret en forteller, skuespiller eller programleder kan trenge i ett og samme prosjekt. En produktvideo kan starte lyst, gå over i en rolig tone i den tekniske delen og avslutte varmt. En spillfigur kan gå fra bestemt til livredd på to replikker.

Slik bruker du følelser i Speechify AI Voice Generator

AI Voice Generator finnes i Speechify Studio og er verktøyet for å lage voiceovere, markedsførings-videoer, lydbøker og podkastsegmenter. Lim inn manuset ditt, velg en stemme og bruk en følelsesstil på hele klippet eller utvalgte deler. Fordi følelser kan brukes på utvalg, kan samme voiceover ha en munter start, et bestemt hovedpoeng og en varm avslutning – med én og samme stemme.

Noen eksempler på når dette utgjør en forskjell:

Markedsførings-videoer laget i verktøy som CapCut trenger ofte flere tonefall, som oppmerksomhet, løfte og oppfordring. I stedet for tre ulike stemmeopptak kan du lage én voiceover med ulik følelse for hver del. Lydbøker og skjønnlitterær innlesning har enda større nytte av dette, siden dialogen kan variere i uttrykk uten at du trenger flere innlesere. I forklaringsvideoer gir én rolig stemme ofte bedre tydelighet enn å prøve å være «engasjerende» hele veien.

Slik bruker du følelser i Speechify API

For utviklere er de samme 13 følelsene tilgjengelige i Speechify API via SSML-taggen <speechify:style>. Pakk inn teksten du vil style, angi følelsen, og API-et genererer lyd bare for det aktuelle utvalget. Slik kan virtuelle assistenter høres bestemte ut når de bekrefter betaling, og varme når de ønsker velkommen, uten å bytte stemme midt i økten.

E-lærings-plattformer bruker det samme for å markere tilbakemeldinger i quiz: munter for riktige svar, direkte for rettelser, rolig for hint. Interaktive fortellingsmotorer bruker følelsestagger på replikker via API-et, slik at én enkelt klonet stemme kan dekke alle karakterene.

Speechify AI Voice Generator vs. Speechify API: Hva bør du velge?

Bruksområde

AI Voice Generator (Studio)

API

Voiceovere, markedsføring, lydbøker

Ja, visuelt grensesnitt, følelser per utvalg

Mulig, men ofte unødvendig

Innebygd stemme i apper, assistenter, e-læring

Mindre egnet

Ja, med SSML <speechify:style>-tagger

Format

Nettgrensesnitt

REST API

Best når

Du lager et ferdig lydprodukt

Du genererer lyd ved behov i ditt eget produkt

Hvordan følelsesstemmer kan utvide det du kan lage

Følelsesbasert TTS er prikken over i-en i kreative prosjekter. Én kjendislignende stemme kan lese inn hele lydbøker, en animert karakter kan formidle både humor og sorg, og en podkastintro kan treffe helt riktig stemning — alt dette er vanskelig med monotone stemmer. Dette fungerer nå fordi følelsen ligger i stemmen, ikke i teksten. For deg som allerede bruker Speechifys kjendis- og karakterstemmer, er følelsesstilene det som skiller en stemme som ligner originalen, fra en stemme som faktisk spiller rollen.

Forbedrer følelsesformidling faktisk forståelsen?

Ja, og dette måles også utenfor AI-verdenen. En studie fra 2022 med 11–13-åringer og en replikasjon i 2025 viste at lyttere svarte riktigere på innholdsspørsmål når de hørte fakta lest med positivt følelsesuttrykk, sammenlignet med nøytral tone (Dylman et al., 2025). Forbedringen i forståelse var betydelig og gjaldt både rett etterpå og senere. For læring, produktopplæring og alle lange lydprosjekter der hukommelse er viktig, kan en følelsesmessig treffsikker stemme gi en reell gevinst i forståelse.

FAQ

Hva er text to speech med følelser?

Det er syntetisk tale med en valgt følelsesstil, for eksempel munter eller trist, slik at samme setning kan leveres med ulikt uttrykk. Med Speechify kan du velge følelse per utvalg.

Hvor mange følelser støtter Speechify?

Tretten: sint, munter, trist, livredd, avslappet, engstelig, overrasket, rolig, bestemt, energisk, varm, direkte og lys – alle tilgjengelige både i Speechify AI Voice Generator og Speechify API.

Hvor styrer jeg følelsene i AI Voice Generator?

I Speechify Studio dukker det opp en følelsesvelger ved siden av stemmevalget etter at du har limt inn manuset. Bruk den på hele klippet eller et utvalg, og generer ny lyd.

Hvordan bruker jeg følelser i Speechify API?

Pakk inn teksten i en <speechify:style>-SSML-tag med følelsesnavnet som attributt. API-et returnerer lyd med denne følelsen bare for den merkede delen.

Kan jeg kombinere flere følelser i én voiceover?

Ja. Følelser kan brukes per utvalg i Speechify Studio og per SSML-span i API-et, så én voiceover eller økt kan skifte tone linje for linje uten å bytte stemme.

Høres følelsesstemmer like naturlige ut som nøytrale?

Nesten helt. Forskning viser at følelsesbaserte TTS-modeller scorer omtrent 3,94/5,0 på uttrykk og 3,98/5,0 på naturlighet, altså nesten identisk.

Bidrar følelsesformidling faktisk til bedre forståelse?

Forskning på mennesker tyder på det. Positiv tone gir bedre hukommelse for faktainnhold i studier. Det samme gjelder for gode AI voiceovers.

Kan jeg bruke følelsesstemmer kommersielt?

Speechify-lisensen dekker kommersiell bruk av genererte voiceovere, inkludert følelser. Sjekk planen din for lengdebegrensninger.

Fungerer følelser med klonede eller kjendisstemmer?

Ja. Følelsesstiler legges på den valgte stemmen i Speechify, slik at én klonet stemme kan ha alle 13 følelser uten ekstra innspilling.

Hva er forskjellen på følelser og bare å justere hastighet eller tonehøyde?

Følelser endrer hele talemelodien, inkludert pauser, trykk, intonasjon og energi. En «sint» variant høres derfor ikke ut som bare en raskere eller lysere versjon av en nøytral stemme.


Få tilgang til Speechifys mest populære stemmer via API – raskt, skalerbart og utviklervennlig

Få API-tilgang

Del denne artikkelen

Cliff Weitzman

Administrerende direktør og grunnlegger av Speechify

Cliff Weitzman er en forkjemper for dysleksi og administrerende direktør og grunnlegger av Speechify — verdens mest populære tekst-til-tale-app, med over 100 000 femstjerners anmeldelser og som har toppet App Store-kategorien Nyheter og magasiner. I 2017 kom Weitzman på Forbes' «30 under 30»-liste for sitt arbeid med å gjøre internett mer tilgjengelig for personer med lærevansker. Cliff Weitzman har blant annet vært omtalt i EdSurge, Inc., PCMag, Entrepreneur og Mashable.

Speechify logo

Om Speechify

#1 tekst-til-tale-leser

Speechify er verdens ledende tekst-til-tale-plattform, med over 50 millioner brukere og mer enn 500 000 femstjerners vurderinger på sine tekst-til-tale-iOS-, Android-, Chrome-utvidelse-, webapp- og Mac-desktop-apper. I 2025 ga Apple Speechify den prestisjetunge Apple Design AwardWWDC, og kalte det «en kritisk ressurs som hjelper folk å leve livene sine». Speechify tilbyr over 1 000 naturtro stemmer på mer enn 60 språk, og brukes i nærmere 200 land. Kjendisstemmer inkluderer Snoop Dogg og Gwyneth Paltrow. For skapere og bedrifter gir Speechify Studio avanserte verktøy, inkludert AI voice generator, AI-stemmekloning, AI-dubbing og AI-stemmebytter. Speechify driver også ledende produkter med sitt høykvalitets, kostnadseffektive tekst-til-tale-API. Omtalt i The Wall Street Journal, CNBC, Forbes, TechCrunch og andre store nyhetskanaler, er Speechify verdens største tekst-til-tale-leverandør. Besøk speechify.com/news, speechify.com/blog og speechify.com/press for å lære mer.