Speechify tilbyr et lite utvalg text-to-speech-modeller. Å velge riktig handler om å finne balansen mellom responstid, språkstøtte og stemmekvalitet. Denne veiledningen viser hvilke modeller som passer til ulike behov, så du slipper å teste alt selv.
Innleggene på speechify.ai gir mer innsikt i hver lansering. Nyheten om Simba 3.2 forklarer hvorfor den nå anbefales.
Les hurtigstartguiden for å komme i gang med Speechify text-to-speech-API.
Hvilke modeller tilbyr Speechify?
Tre hovedfamilier.
- Simba 3.2
- : anbefalt modell for engelsk. Strømming fra start, lavest responstid og kuraterte engelske stemmer. Brukes der interaktivitet er viktig.
- Simba 3.0
- : dagens API-standard. Støtter strømming og flere språk: engelsk, tysk, spansk, fransk, italiensk og brasiliansk portugisisk. Litt høyere latenstid enn 3.2, men dekker flere språk.
- Eldre modeller (
- simba-english
- ,
- simba-multilingual
- ): Simba 1.6-paret. Fjernes fra API-et fra 2026-09-21 og slås av 2026-11-21. Bruk dem kun i eksisterende integrasjoner som krever en spesifikk eldre stemme eller et språk, og planlegg migrering nå.
Hvilken modell er raskest?
Simba 3.2. Den er laget for strømming og gir raskest første lyd. For engelske stemmeagenter er dette det riktige valget.
Simba 3.0 er nesten like rask, men flerspråklig støtte gir litt høyere latenstid. Eldre modeller er tregest og bør fases ut.
Hvilken modell støtter flest språk?
Simba 3.0. Den støtter offisielt engelsk, tysk, spansk (Spania og Mexico), fransk, italiensk og brasiliansk portugisisk. Bruk parameteren language i POST /v1/audio/speech for å velge språk, så får du en naturlig stemme tilpasset språket du har valgt. Den eldre simba-multilingual dekker over 30 språkvarianter, men fjernes fra API-et 2026-09-21 og avvikles 2026-11-21.
Hvis produktet ditt bare trenger ett språk, er Simba 3.2 best på hastighet og kvalitet. Trenger du flere språk, gir Simba 3.0 best dekning nå.
Les mer om språkstøtte i dokumentasjonen.
Hvilken modell låter best?
Kvaliteten følger generasjonen. Simba 3.2 gir den mest naturtro engelsken. Simba 3.0 holder høy kvalitet på språkene den støtter. Eldre modeller låter mer robotaktig.
For kundevendt bruk bør du velge Simba 3.2 eller Simba 3.0.
Hvordan viser jeg tilgjengelige stemmer?
Kall GET /v1/voices. Filtrer på type, språk, kjønn og modell for å finne riktig stemme før du syntetiserer tale. Blogginnleggene på speechify.ai viser hvordan svaret ser ut.
Strømming eller batch?
Begge Simba 3-modellene støtter strømming. Bruk POST /v1/audio/stream for direkte avspilling, POST /v1/audio/stream/with-timestamps for sanntidslyd med tidsstempler og ordmarkering, og POST /v1/audio/speech for én lydfil. Modellvalget er uavhengig av leveringsmåte.
FAQ
Hva er den anbefalte Speechify TTS-modellen?
Simba 3.2. Det er standardvalget for nye prosjekter: strømmeoptimalisert, raskest til første lyd og høyest kvalitet på engelsk.
Simba 3.2 er best for engelsk: strømmeoptimalisert, raskest til første lyd og høyest kvalitet på engelsk. API-et bruker Simba 3.0 som standard hvis forespørselen ikke spesifiserer model, så sett model: "simba-3.2" eksplisitt for å velge den.
Ja. Simba 3.0 bruker språkparameteren og gir naturlige stemmer på flere språk. Simba 3.2 fokuserer på kuratert engelsk.
Ja. Simba 3.0 bruker språkparameteren og gir naturlige stemmer på engelsk og seks europeiske språk. Simba 3.2 fokuserer på kuratert engelsk.
Kun hvis en eksisterende integrasjon krever en eldre stemme. Ellers bør du bytte til Simba 3.2 eller Simba 3.0.
Bare ved eksisterende integrasjoner som er avhengige av en eldre stemme. De fjernes fra API-et 2026-09-21 og slås av 2026-11-21, så migrer til Simba 3.2 eller Simba 3.0 innen da.
Velg Simba 3.2 for lavest responstid til første byte. Strøm utdataene ved bruk i sanntid.

