Speechify tilbyder et lille udvalg af text-to-speech-modeller. Når du vælger model, handler det om at balancere hastighed, sprogunderstøttelse og stemmekvalitet. Denne guide hjælper dig med at matche hver model til den rette opgave, så du slipper for at teste alt.
Indlæggene på speechify.ai går mere i dybden med hver version. Læs også annonceringen af Simba 3.2 for at forstå, hvorfor den nu er den anbefalede model.
Læs vores quickstart-guide, hvis du vil i gang med Speechifys text-to-speech API.
Hvilke modeller tilbyder Speechify?
To aktuelle modeller og et ældre sæt, der er på vej ud.
- Simba 3.2: den anbefalede model til engelsk. Streaming-native, hurtigste svartid og udvalgte engelske stemmer. Ideel til alt interaktivt.
- Simba 3.0: nuværende API-standard. Streaming-native og flersproget: engelsk samt tysk, spansk, fransk, italiensk og brasiliansk portugisisk. Lidt højere latenstid end 3.2, men bredere sprogunderstøttelse.
- Forældede modeller (simba-english, simba-multilingual): Simba 1.6-parret. Udgår fra API-version 2026-09-21 og lukkes 2026-11-21. Brug dem kun, hvis en eksisterende integration kræver en bestemt ældre stemme eller et bestemt sprog, og planlæg skiftet nu.
Hvilken model er hurtigst?
Simba 3.2. Den er bygget til streaming, så den første lyd kommer så hurtigt som muligt. Til engelsksprogede stemmeassistenter er det det bedste standardvalg.
Simba 3.0 er tæt på, men har lidt højere latenstid på grund af flersproget understøttelse. De forældede modeller er de langsomste og bør udfases, hvor det er muligt.
Hvilken model dækker flest sprog?
Simba 3.0. Den understøtter officielt engelsk, tysk, spansk (Spanien og Mexico), fransk, italiensk og brasiliansk portugisisk. Angiv parameteren language i POST /v1/audio/speech for at vælge sprog, så får du en stemme på det pågældende sprog. Den forældede simba-multilingual dækker over 30 sprogvarianter, men udgår fra API-version 2026-09-21 og lukkes 2026-11-21.
Hvis dit produkt kun bruger ét sprog, vinder Simba 3.2 på hastighed og kvalitet. Hvis det skal dække flere sprog, er Simba 3.0 lige nu det bedste valg på dækning.
Læs mere om sprogunderstøttelse i dokumentationen.
Hvilken model lyder bedst?
Kvaliteten følger modelgenerationen. Simba 3.2 er førende, når det gælder naturlighed på engelsk. Simba 3.0 leverer stærk kvalitet på alle sine sprog. De ældre modeller lyder mest robotagtige.
Til kundevendt tale bør du vælge Simba 3.2 eller Simba 3.0.
Hvordan får jeg en liste over tilgængelige stemmer?
Kald GET /v1/voices. Filtrer efter type, sprog, køn og model for at finde den rette stemme, før du syntetiserer tale. Indlæg om stemmer og modeller på speechify.ai viser også responsens struktur.
Streaming eller batch?
Begge Simba 3-modeller understøtter streaming. Brug POST /v1/audio/stream til liveafspilning, POST /v1/audio/stream/with-timestamps til live-lyd med tidskoder på ordniveau og POST /v1/audio/speech til en enkelt fil. Valget af model er uafhængigt af leveringsmetoden.
FAQ
Hvilken Speechify TTS-model anbefales?
Simba 3.2. Det er standardvalget til nye projekter: streaming-native, hurtigste første lyd og bedst kvalitet på engelsk.
Hvilken model bruger API'et som standard?
Simba 3.0. Hvis du ikke angiver model, bruger API'et Simba 3.0, så sæt model: "simba-3.2" eksplicit for at vælge 3.2 til engelsk.
Understøtter Speechify TTS flere sprog?
Ja. Simba 3.0 understøtter en language-parameter og leverer stemmer på engelsk, tysk, spansk (Spanien og Mexico), fransk, italiensk og brasiliansk portugisisk. Simba 3.2 fokuserer på udvalgte engelske stemmer.
Bør jeg stadig bruge de forældede modeller?
Kun hvis en eksisterende integration kræver en bestemt ældre stemme. simba-english og simba-multilingual udgår fra API-version 2026-09-21 og lukkes 2026-11-21, så migrér til Simba 3.2 eller Simba 3.0 inden da.
Hvilken model bør jeg bruge til en stemmeassistent?
Vælg Simba 3.2 for hurtigst mulig første byte, og stream output til livebrug.

