1. Hjem
  2. TTS
  3. Speechify TTS API-modeller forklaret: vælg den rette model til opgaven
Published on TTS

Speechify TTS API-modeller forklaret: vælg den rette model til opgaven

Luke Oliff

Luke Oliff

Luke Oliff er Developer Experience-ingeniør og har brugt størstedelen af det seneste årti på at bygge udviklerværktøjer, SDK'er og fællesskaber for virksomheder inden for stemme- og realtids-API'er.

#1 Tekst-til-tale læser.
Lad Speechify læse for dig.

apple logo2025 Apple Design Award
50M+ brugere

Speechify tilbyder et mindre udvalg af tekst-til-tale-modeller. Det rigtige valg afhænger af latenstid, sprogunderstøttelse og stemmekvalitet. Denne guide hjælper dig med at matche hver model til den rette anvendelse, så du slipper for selv at teste dem alle.

Indlæggene på speechify.ai går i dybden med hver version. Se lanceringen af Simba 3.2 for at forstå, hvorfor den nu anbefales.

Læs vores quickstart-guide, hvis du vil hurtigt i gang med Speechifys tekst-til-tale-API.

Hvilke modeller tilbyder Speechify?

Tre modelserier.

  • Simba 3.2
  • : Den anbefalede model til engelsk. Bygget til streaming, hurtigst til levering og med udvalgte engelske stemmer. Velegnet til alt, der kræver interaktivitet.
  • Simba 3.0
  • : API'ets standardvalg. Bygget til streaming og flersproget: engelsk, tysk, spansk, fransk, italiensk og brasiliansk portugisisk. Lidt højere latenstid end 3.2, men bredere sprogunderstøttelse.
  • Ældre modeller (
  • simba-english
  • ,
  • simba-multilingual
  • ): Simba 1.6-parret. Udfases fra API-version 2026-09-21 og slukkes 2026-11-21. Brug dem kun, hvis din integration afhænger af en ældre stemme eller et ældre sprogvalg – planlæg skiftet nu.

Hvilken model er hurtigst?

Simba 3.2. Den er bygget til streaming, så lyden leveres så hurtigt som muligt. Til engelske stemmeassistenter er den det oplagte standardvalg.

Simba 3.0 er næsten lige så hurtig, men tilbyder flersproget funktionalitet. De ældre modeller er langsomst og bør udfases, hvor det er muligt.

Hvilken model dækker flest sprog?

Simba 3.0. Den understøtter officielt engelsk samt tysk, spansk (Spanien og Mexico), fransk, italiensk og brasiliansk portugisisk. Brug parameteren language i POST /v1/audio/speech til at vælge sprog og få en indfødt stemme. Den ældre simba-multilingual dækkede 30+ sprog, men udfases fra API-version 2026-09-21 og slukkes 2026-11-21.

Hvis dit produkt kun udgives på ét sprog, er Simba 3.2 det bedste valg til hastighed og kvalitet. Skal du understøtte flere sprog, er Simba 3.0 det stærkeste valg lige nu.

Læs mere om sprogunderstøttelse i vores dokumentation.

Hvilken model lyder bedst?

Kvaliteten følger modelgenerationen. Simba 3.2 leverer den mest naturlige engelske tale. Simba 3.0 klarer sig godt på flere sprog. De ældre modeller lyder mest robotagtige.

Til kundevendte stemmer bør du vælge Simba 3.2 eller Simba 3.0.

Hvordan ser jeg tilgængelige stemmer?

Kald GET /v1/voices. Filtrér efter type, sprog, køn og model for at finde den rette stemme før syntesen. Indlæg om stemmer og modeller på speechify.ai viser svarets struktur.

Streaming eller batch?

Begge Simba 3-modeller understøtter streaming. Brug POST /v1/audio/stream til live-afspilning, POST /v1/audio/stream/with-timestamps til live-lyd med tidsstempler og ordmærkning og POST /v1/audio/speech til en enkelt lydfil. Valget af model er uafhængigt af leveringsmetoden.

FAQ

Hvilken Speechify TTS-model anbefales?

Simba 3.2. Det anbefalede valg til nye projekter: bygget til streaming, hurtigst til første lyd og højeste kvalitet på engelsk.

Simba 3.2 til engelsk: bygget til streaming, hurtigst til første lyd og højeste kvalitet. Hvis model ikke angives i API-forespørgsler, vælges Simba 3.0 som standard – angiv model: "simba-3.2" for at bruge 3.2.

Ja. Simba 3.0 bruger en sprogparameter og tilbyder indfødte stemmer på flere sprog. Simba 3.2 fokuserer på udvalgte engelske stemmer.

Ja. Simba 3.0 har en sprogparameter og leverer naturlige stemmer på engelsk og seks europæiske sprog. Simba 3.2 fokuserer på udvalgte engelske stemmer.

Kun hvis en eksisterende integration kræver en ældre stemme. Ellers bør du skifte til Simba 3.2 eller Simba 3.0.

Kun så længe en integration afhænger af en ældre stemme. De udfases fra API-version 2026-09-21 og slukkes 2026-11-21, så migrér til Simba 3.2 eller Simba 3.0 inden da.

Vælg Simba 3.2 for kortest tid til første byte. Stream outputtet til live-brug.

Nyd de mest avancerede AI-stemmer, ubegrænsede filer og 24/7 support

Prøv gratis
tts banner for blog

Del denne artikel

Luke Oliff

Luke Oliff

Luke Oliff er Developer Experience-ingeniør og har brugt størstedelen af det seneste årti på at bygge udviklerværktøjer, SDK'er og fællesskaber for virksomheder inden for stemme- og realtids-API'er.

Luke Oliff er en ekspert i Developer Relations med base i Storbritannien. I snart et årti har han arbejdet med stemmeteknologi, udviklerværktøjer og open source – og været med til at løfte udvikleroplevelsen hos kendte brands.

Han har udformet open source-strategier, startet udviklerfællesskaber, bygget værktøjer og lanceret konversationelle AI-stemmeprototyper flere år, før mainstream API'er var tilgængelige. Som ingeniør helt ind til benet skriver og taler han om stemme-AI, udvikleroplevelse og realtids-API'er på udviklernes egne præmisser – med fokus på anvendelighed og brugeroplevelse.

Han er nu en del af Speechifys AI Labs-team, hvor SIMBA 3.0 ligger på en 7.-plads på Artificial Analysis TTS-leaderboardet ud af næsten 80 modeller.

speechify logo

Om Speechify

#1 Tekst-til-tale læser

Speechify er verdens førende tekst-til-tale-platform, betroet af over 50 millioner brugere og med mere end 500.000 femstjernede anmeldelser på sine tekst-til-tale iOS-, Android-, Chrome-udvidelse-, webapp- og Mac desktop-apps. I 2025 tildelte Apple Speechify den prestigefyldte Apple Design Award ved WWDC og kaldte det “en uvurderlig ressource, der hjælper folk med at leve deres liv.” Speechify tilbyder over 1.000 naturligt lydende stemmer på mere end 60 sprog og bruges i næsten 200 lande. Kendte stemmer inkluderer Snoop Dogg, Mr. Beast og Gwyneth Paltrow. For skabere og virksomheder tilbyder Speechify Studio avancerede værktøjer, herunder AI Voice Generator, AI Voice Cloning, AI Dubbing og AI Voice Changer. Speechify driver også førende produkter med sin høj-kvalitets og omkostningseffektive tekst-til-tale API. Omtalt i The Wall Street Journal, CNBC, Forbes, TechCrunch og andre store nyhedsmedier, er Speechify verdens største tekst-til-tale-udbyder. Besøg speechify.com/news, speechify.com/blog og speechify.com/press for at lære mere.