Speechify tilbyr et lite utvalg av text-to-speech-modeller. Valget handler om å balansere responstid, språkstøtte og stemmekvalitet. Denne guiden viser hvilken modell som passer best til ulike behov, så du slipper å teste alt selv.
Innleggene om speechify.ai-modellene går mer i dybden på hver lansering. Lanseringen av Simba 3.2 forklarer hvorfor dette nå er den anbefalte modellen.
Vil du komme raskt i gang med Speechify text-to-speech API? Les hurtigstartguiden vår.
Vil du bygge dette selv? Speechify text-to-speech- og voice cloning-API finner du på speechify.ai, med dokumentasjon og gratis nøkkel på docs.speechify.ai.
Hvilke modeller tilbyr Speechify?
Tre modellfamilier.
- Simba 3.2
- : anbefalt modell for engelsk. Bygget for streaming, med lavest responstid og et utvalg engelske stemmer. Bruk den til alt som er interaktivt.
- Simba 3.0
- : dagens API-standard. Streaming-basert og flerspråklig: engelsk, tysk, spansk, fransk, italiensk og brasiliansk portugisisk. Litt høyere ventetid enn 3.2, men støtte for flere språk.
- Eldre modeller (
- simba-english
- ,
- simba-multilingual
- ): Simba 1.6-paret. Fjernes fra API-versjon 2026-09-21 og skrus av 2026-11-21. Bruk dem bare hvis en eksisterende integrasjon krever en bestemt eldre stemme eller et språk, og planlegg migrering nå.
Hvilken modell er raskest?
Simba 3.2. Den er bygget for streaming, slik at første lyd kommer raskest. For engelskspråklige opplevelser er dette det beste utgangspunktet.
Simba 3.0 er nesten like rask, men har ekstra flerspråklig prosessering. De eldre modellene er tregest og bør fases ut der det er mulig.
Hvilken modell støtter flest språk?
Simba 3.0. Den støtter offisielt engelsk, tysk, spansk (Spania og Mexico), fransk, italiensk og brasiliansk portugisisk. Send language-parameteren med POST /v1/audio/speech for å velge språkvariant, så får du en naturlig stemme for det språket. Den eldre simba-multilingual støtter over 30 språk totalt, men fjernes fra API-et 2026-09-21 og deaktiveres 2026-11-21.
Hvis produktet ditt bare skal støtte ett språk, gir Simba 3.2 best hastighet og kvalitet. Trenger du flere språk, velger du Simba 3.0 for bredest språkdekning akkurat nå.
Les mer om språkstøtte i dokumentasjonen vår.
Hvilken modell låter best?
Kvaliteten følger modellgenerasjonen. Simba 3.2 er best på naturlig engelsk. Simba 3.0 leverer god kvalitet på språkene den støtter. De eldre modellene er klart eldste generasjon og låter mest robotaktig.
Velg Simba 3.2 eller Simba 3.0 til kundevendte løsninger.
Hvordan får jeg oversikt over tilgjengelige stemmer?
Kall GET /v1/voices. Filtrer på type, språk, kjønn og modell for å finne riktig stemme før du syntetiserer. Modell- og stemmeinnleggene på speechify.ai viser hvordan svaret ser ut.
Streaming eller batch?
Begge Simba 3-modellene støtter streaming. Bruk POST /v1/audio/stream for direkte avspilling, POST /v1/audio/stream/with-timestamps for lyd med tidskoder og ordmarkering, og POST /v1/audio/speech for én lydfil. Modellvalget er uavhengig av leveringsmåten.
FAQ
Hvilken Speechify TTS-modell anbefales?
Simba 3.2. Standardvalget for nye prosjekter: bygget for streaming, raskest lydstart og høyest kvalitet på engelsk.
Simba 3.2 for engelsk: streaming-basert, raskest lydstart og best kvalitet på engelsk. Standardmodellen i API-et hvis model ikke er angitt, er Simba 3.0. Sett model: "simba-3.2" eksplisitt for å velge den.
Ja. Simba 3.0 bruker en språkparameter og gir naturlige stemmer på mange språk. Simba 3.2 fokuserer på et utvalg engelske stemmer.
Ja. Simba 3.0 støtter språkvalg og tilbyr naturlige stemmer på engelsk og seks europeiske språk. Simba 3.2 fokuserer på et utvalg engelske stemmer.
Bare hvis en eksisterende integrasjon krever en bestemt eldre stemme. Ellers bør du gå over til Simba 3.2 eller Simba 3.0.
Bruk dem bare så lenge integrasjonen krever en bestemt eldre stemme. De fjernes fra API-et 2026-09-21 og skrus av 2026-11-21, så migrer til Simba 3.2 eller Simba 3.0 i god tid.
Velg Simba 3.2 for lavest responstid. Strøm utdata for bruk i sanntid.

