Speechify tilbyr et begrenset utvalg Text-to-Speech-modeller. Å velge riktig handler om å balansere forsinkelse, språkstøtte og stemmekvalitet. Denne guiden viser hvilken modell som passer ulike behov, så du slipper å teste dem alle.
Innleggene på speechify.ai går i dybden på hver lansering. Innlegget om Simba 3.2 forklarer hvorfor den nå er den anbefalte modellen.
Vil du komme i gang med Speechify Text-to-Speech API, kan du lese hurtigstartguiden vår.
Hvilke modeller tilbyr Speechify?
To aktuelle modeller, pluss et eldre modellpar som er på vei ut.
- Simba 3.2: den anbefalte modellen for engelsk. Bygget for streaming, med raskest oppstartstid og utvalgte engelske stemmer. Ideell for alt som krever interaktiv lyd.
- Simba 3.0: standardmodellen i dagens API. Streamingbasert og flerspråklig: engelsk, tysk, spansk, fransk, italiensk og brasiliansk portugisisk. Litt høyere forsinkelse enn 3.2, men støtte for flere språk.
- Eldre modeller (simba-english, simba-multilingual): Simba 1.6. Støtten opphører fra API-versjon 2026-09-21, og modellene stenges 2026-11-21. Bruk dem bare hvis en eksisterende integrasjon er avhengig av en eldre stemme eller et eldre språkvalg – planlegg overgangen nå.
Hvilken modell er raskest?
Simba 3.2. Den er utviklet for streaming, så første lyd kommer raskest. For engelske stemmeassistenter er dette standardvalget.
Simba 3.0 er nesten like rask, men den flerspråklige støtten gir litt ekstra forsinkelse. De eldre modellene er tregest og bør fases ut der det er mulig.
Hvilken modell støtter flest språk?
Simba 3.0. Den har offisiell støtte for engelsk, tysk, spansk (Spania og Mexico), fransk, italiensk og brasiliansk portugisisk. Bruk language-parameteren med POST /v1/audio/speech for å velge språk — da får du en tilpasset stemme. Den eldre simba-multilingual støtter over 30 språk, men fases ut fra API-versjon 2026-09-21 og stenges 2026-11-21.
Har produktet ditt bare ett språk, gir Simba 3.2 best hastighet og kvalitet. Har du flere språk, gir Simba 3.0 best dekning akkurat nå.
Les mer om språkstøtte i dokumentasjonen.
Hvilken modell høres best ut?
Kvaliteten følger generasjonen. Simba 3.2 har den mest naturtro engelske stemmen. Simba 3.0 leverer solide resultater på tvers av språkene. De eldre modellene er mest utdaterte og låter også mest robotisk.
For kundevendte stemmer bør du velge Simba 3.2 eller Simba 3.0.
Hvordan viser jeg tilgjengelige stemmer?
Kall GET /v1/voices. Filtrer på type, språk, kjønn og modell for å finne riktig stemme før syntese. Innleggene om stemmer og modeller på speechify.ai viser responsformatet.
Streaming eller batch?
Begge Simba 3-modellene støtter streaming. Bruk POST /v1/audio/stream for direktelyd, POST /v1/audio/stream/with-timestamps for lyd med tidsmerking per ord, og POST /v1/audio/speech for én enkelt fil. Valg av modell er uavhengig av leveringsmåten.
FAQ
Hvilken Speechify TTS-modell anbefales?
Simba 3.2. Standardvalget for nytt arbeid: bygget for streaming, raskest første lyd og best kvalitet på engelsk.
Hvilken modell bruker API-et som standard?
Simba 3.0. Hvis du ikke angir model, bruker API-et Simba 3.0. Sett model: "simba-3.2" eksplisitt for å bruke 3.2 på engelsk.
Støtter Speechify TTS flere språk?
Ja. Simba 3.0 bruker language-parameteren og gir lokale stemmer for engelsk, tysk, spansk (Spania og Mexico), fransk, italiensk og brasiliansk portugisisk. Simba 3.2 fokuserer på utvalgte engelske stemmer.
Bør jeg fortsatt bruke eldre modeller?
Bare hvis en eksisterende integrasjon trenger en bestemt eldre stemme. simba-english og simba-multilingual fases ut fra API-versjon 2026-09-21 og stenges 2026-11-21, så migrer til Simba 3.2 eller Simba 3.0 før den tid.
Hvilken modell bør jeg bruke for en stemmeassistent?
Velg Simba 3.2 for kortest oppstartstid, og bruk streaming for direkte lyd.

