Skip to main content
  1. Hjem
  2. API
  3. Sådan understøtter Speechify Text-to-Speech API 13 følelser
Updated on •API

Sådan understøtter Speechify Text-to-Speech API 13 følelser

Cliff Weitzman

CEO og grundlægger af Speechify

Speechify API leverer 300ms 
latens, stemmer i menneskekvalitet, 
og 50+ sprog

Apple2025 Apple Design Award
50M+ brugere

Hvorfor følelser er det næste skridt inden for talesyntese

Bygger du selv? Speechify text-to-speech og voice cloning API findes på speechify.ai. Dokumentation og en gratis nøgle findes på docs.speechify.ai.

Moderne TTS løste forståelighed for mange år siden. Blizzard Challenge, et årligt benchmark for talesyntese siden 2005, rapporterede, at syntetisk tale i 2021 var umulig at skelne fra naturlig tale, når det gjaldt forståelighed, og næsten umulig at skelne fra den i naturlighed (Perrotin et al., 2024). Derfor har feltet flyttet sig videre. Det interessante spørgsmål er nu ikke længere om man kan forstå stemmen, men om stemmen lyder, som om den mener det, den siger. Nu tilbyder Speechify ikke kun text-to-speech, men også emotionel text-to-speech.

Speechify tilbyder emotionel text-to-speech

Speechifys emotionelle udvalg omfatter Vred, Munter, Trist, Skræmt, Afslappet, Frygtsom, Overrasket, Rolig, Bestemt, Energisk, Varm, Direkte og Lys. De dækker den tonale variation, som en rigtig oplæser, skuespiller eller præsentator bevæger sig igennem i ét projekt. Et produktpitch kan starte lyst, blive roligt i en teknisk passage og slutte varmt. En NPC i et spil kan skifte fra Bestemt til Skræmt på bare to replikker.

Sådan bruges følelser i Speechify AI Voice Generator

AI Voice Generator findes i Speechify Studio og bruges af indholdsskabere til speak, marketing-videoer, lydbøger og podcasts. Indsæt manuskriptet, vælg en stemme, og anvend en følelsesstil på hele klippet eller et udvalgt afsnit. Da følelser kan vælges for hvert afsnit, kan ét speak skifte tone – f.eks. Munter intro, Bestemt værditilbud og Varm afrunding – uden at skifte stemme undervejs.

Her er nogle konkrete arbejdsgange, hvor det gør en forskel:

Marketing-videoer lavet f.eks. i CapCut har ofte brug for to-tre følelsesmæssige lag: opmærksomhed, løfte, call to action. I stedet for tre forskellige speaks kan man nu lave ét speak, hvor følelsen skifter linje for linje. Lydbøger og fiktionsoplæsning har endnu mere at vinde – dialoger kan få forskellig følelsesmæssig tyngde uden flere oplæsere. I forklaringsvideoer bliver et langt teknisk afsnit tydeligere med en rolig stemme end ved at forsøge at være 'spændende' hele vejen igennem.

Sådan bruges følelser i Speechify API

For udviklere er de samme 13 følelser tilgængelige i Speechify API via SSML-tagget <speechify:style>. Sæt tagget omkring teksten, angiv følelsen, og API'et returnerer lyd med netop den følelse i den pågældende passage. Sådan kan virtuelle assistenter lyde Bestemt, når de bekræfter betaling, og Varm, når de byder brugere velkommen, uden at skifte stemme under sessionen.

E-læring-platforme bruger samme metode til feedback i quizzer: Munter ved korrekte svar, Direkte ved rettelser, Rolig ved hints. Interaktive fiktionmotorer sender dialog gennem API’et med følelse markeret på hver replik, så én stemme kan dække mange karakterer.

Speechify AI Voice Generator vs Speechify API: Hvilken skal du vælge?

Brugsscenarie

AI Voice Generator (Studio)

API

Speak, marketing, lydbøger

Ja, visuelt værktøj, følelser pr. afsnit

Muligt, men ofte unødvendigt

Indbygget stemme i apps, assistenter, e-læring

Ikke det oplagte valg

Ja, med SSML <speechify:style>-tags

Format

Webgrænseflade

REST API

Bedst når

Du producerer et færdigt lydprodukt

Du genererer lyd on demand i dit eget produkt

Hvordan følelsesladede stemmer udvider mulighederne

Emotionel TTS er det manglende led i kreative projekter. Én kendisagtig stemme gennem en hel lydbog, en animeret karakter med både morsomme og sørgelige replikker, en podcastintro med den helt rigtige tone – alt dette fungerede ikke med flad syntese. Nu gør det, fordi følelsen ligger i stemmen, ikke kun i manuskriptet. For dem, der allerede bruger Speechifys kendis- eller karakterstemmer, er emotionelle stilarter forskellen på en stemme, der lyder som kilden, og en stemme, der opfører sig som den.

Forbedrer følelsesmæssig levering virkelig forståelsen?

Ja, og det kan måles – også uden for AI-verdenen. I et studie fra 2022 med 11–13-årige og en gentagelse i 2025 fandt forskerne Dylman og Champoux-Larsson, at lyttere svarede rigtigt på flere indholdsspørgsmål, når det samme faktuelle indhold blev læst med positiv følelsesmæssig prosodi frem for neutral tone (Dylman et al., 2025). Gevinsten i forståelse var tydelig og holdt både umiddelbart og ved forsinket recall. Til undervisningsindhold, produktvejledninger og al længere lyd, hvor hukommelse er vigtig, kan en følelsestilpasset stemme faktisk styrke forståelsen.

FAQ

Hvad er text-to-speech med følelser?

Det er syntetisk tale, der også bærer en valgt følelsesmæssig tone (f.eks. munter eller trist) ud over selve ordene, så den samme sætning kan leveres på mange måder. Med Speechify kan du vælge følelse for hver passage.

Hvor mange følelser understøtter Speechify?

Tretten: Vred, Munter, Trist, Skræmt, Afslappet, Frygtsom, Overrasket, Rolig, Bestemt, Energisk, Varm, Direkte og Lys. De er tilgængelige i både Speechify AI Voice Generator og Speechify API.

Hvor styrer jeg følelser i AI Voice Generator?

I Speechify Studio vises en følelsesvælger ved siden af stemmevælgeren, når du har indsat dit manuskript. Brug den på hele klippet eller kun et markeret afsnit, og gengiv igen.

Hvordan bruger jeg følelser i Speechify API?

Omslut teksten med SSML-tagget <speechify:style> med navnet på den ønskede følelse som attribut. API’et returnerer lyd, hvor kun de taggede passager har følelsen.

Kan jeg kombinere følelser i et speak?

Ja. Følelser vælges pr. passage i Speechify Studio og pr. SSML-tag i API’en, så ét speak eller én session kan skifte tone linje for linje uden at skifte stemme.

Lyder følelsesmæssige stemmer lige så naturlige som neutrale?

Meget tæt på. Peer-reviewed emotionelle TTS-modeller scorer nu ca. 3,94/5,0 for udtryksfuldhed og 3,98/5,0 for naturlighed. Lyttere vurderer dem næsten ens på begge områder.

Hjælper følelsesmæssig levering lyttere med at huske indholdet?

Forskning på menneskelige oplæsere peger på ja. Positiv prosodi gav bedre recall af faktuelt indhold i kontrollerede studier. Det samme gælder for velinstruerede AI-speaks.

Kan jeg bruge følelsesstemmer til kommercielle speaks?

Speechify-licensen dækker kommerciel brug af genererede speaks, inkl. emotionelle stilarter. Se din plan for eventuelle grænser for outputlængde.

Virker følelser med klonede eller kendisstemmer?

Ja. Emotionelle stilarter lægges oven på basisstemmen i Speechify, så en klonet stemme kan udtrykke alle 13 følelser uden, at hver enkelt skal optages særskilt.

Hvordan adskiller dette sig fra at justere hastighed eller tonehøjde?

Følelser ændrer hele prosodien: pauser, tryk, intonationskurve og energi. Derfor lyder en 'vred' version ikke bare som en hurtig, lys neutral stemme.


Få adgang til Speechifys populære stemmer via API – hurtigt, skalerbart og udviklervenligt

Få API-adgang
Sparse JavaScript keywords import, from, const, await on a white background

Del denne artikel

Cliff Weitzman

CEO og grundlægger af Speechify

Cliff Weitzman er forkæmper for ordblinde og administrerende direktør og grundlægger af Speechify, verdens førende tekst-til-tale-app med over 100.000 5-stjernede anmeldelser og en 1.-plads i App Store i kategorien Nyheder & Magasiner. I 2017 kom Weitzman på Forbes' 30 Under 30 for sit arbejde med at gøre internettet mere tilgængeligt for mennesker med læsevanskeligheder. Cliff Weitzman er blandt andet blevet omtalt i EdSurge, Inc., PC Mag, Entrepreneur og Mashable.

Speechify

Om Speechify

#1 Tekst-til-tale læser

Speechify er verdens førende tekst-til-tale-platform, betroet af over 50 millioner brugere og med mere end 500.000 femstjernede anmeldelser på sine tekst-til-tale iOS-, Android-, Chrome-udvidelse-, webapp- og Mac desktop-apps. I 2025 tildelte Apple Speechify den prestigefyldte Apple Design Award ved WWDC og kaldte det “en uvurderlig ressource, der hjælper folk med at leve deres liv.” Speechify tilbyder over 1.000 naturligt lydende stemmer på mere end 60 sprog og bruges i næsten 200 lande. Kendte stemmer inkluderer Snoop Dogg, Mr. Beast og Gwyneth Paltrow. For skabere og virksomheder tilbyder Speechify Studio avancerede værktøjer, herunder AI Voice Generator, AI Voice Cloning, AI Dubbing og AI Voice Changer. Speechify driver også førende produkter med sin høj-kvalitets og omkostningseffektive tekst-til-tale API. Omtalt i The Wall Street Journal, CNBC, Forbes, TechCrunch og andre store nyhedsmedier, er Speechify verdens største tekst-til-tale-udbyder. Besøg speechify.com/news, speechify.com/blog og speechify.com/press for at lære mere.