Skip to main content
  1. Hjem
  2. Tekst-til-tale
  3. Speechify TTS API-modelloversikt forklart: slik velger du riktig modell
Published on Tekst-til-tale

Speechify TTS API-modelloversikt forklart: slik velger du riktig modell

Luke Oliff

Luke Oliff er utvikleropplevelsesingeniør og har tilbrakt mesteparten av det siste tiåret med å bygge utviklerverktøy, SDK-er og fellesskap for selskaper som tilbyr tale- og sanntids-API-er.

Apple Design Award 2025
50M+ brukere

Speechify tilbyr et lite utvalg av text-to-speech-modeller. Valget handler om å balansere responstid, språkstøtte og stemmekvalitet. Denne guiden viser hvilken modell som passer best til ulike behov, så du slipper å teste alt selv.

Innleggene om speechify.ai-modellene går mer i dybden på hver lansering. Lanseringen av Simba 3.2 forklarer hvorfor dette nå er den anbefalte modellen.

Vil du komme raskt i gang med Speechify text-to-speech API? Les hurtigstartguiden vår.

Vil du bygge dette selv? Speechify text-to-speech- og voice cloning-API finner du på speechify.ai, med dokumentasjon og gratis nøkkel på docs.speechify.ai.

Hvilke modeller tilbyr Speechify?

Tre modellfamilier.

  • Simba 3.2
  • : anbefalt modell for engelsk. Bygget for streaming, med lavest responstid og et utvalg engelske stemmer. Bruk den til alt som er interaktivt.
  • Simba 3.0
  • : dagens API-standard. Streaming-basert og flerspråklig: engelsk, tysk, spansk, fransk, italiensk og brasiliansk portugisisk. Litt høyere ventetid enn 3.2, men støtte for flere språk.
  • Eldre modeller (
  • simba-english
  • ,
  • simba-multilingual
  • ): Simba 1.6-paret. Fjernes fra API-versjon 2026-09-21 og skrus av 2026-11-21. Bruk dem bare hvis en eksisterende integrasjon krever en bestemt eldre stemme eller et språk, og planlegg migrering nå.

Hvilken modell er raskest?

Simba 3.2. Den er bygget for streaming, slik at første lyd kommer raskest. For engelskspråklige opplevelser er dette det beste utgangspunktet.

Simba 3.0 er nesten like rask, men har ekstra flerspråklig prosessering. De eldre modellene er tregest og bør fases ut der det er mulig.

Hvilken modell støtter flest språk?

Simba 3.0. Den støtter offisielt engelsk, tysk, spansk (Spania og Mexico), fransk, italiensk og brasiliansk portugisisk. Send language-parameteren med POST /v1/audio/speech for å velge språkvariant, så får du en naturlig stemme for det språket. Den eldre simba-multilingual støtter over 30 språk totalt, men fjernes fra API-et 2026-09-21 og deaktiveres 2026-11-21.

Hvis produktet ditt bare skal støtte ett språk, gir Simba 3.2 best hastighet og kvalitet. Trenger du flere språk, velger du Simba 3.0 for bredest språkdekning akkurat nå.

Les mer om språkstøtte i dokumentasjonen vår.

Hvilken modell låter best?

Kvaliteten følger modellgenerasjonen. Simba 3.2 er best på naturlig engelsk. Simba 3.0 leverer god kvalitet på språkene den støtter. De eldre modellene er klart eldste generasjon og låter mest robotaktig.

Velg Simba 3.2 eller Simba 3.0 til kundevendte løsninger.

Hvordan får jeg oversikt over tilgjengelige stemmer?

Kall GET /v1/voices. Filtrer på type, språk, kjønn og modell for å finne riktig stemme før du syntetiserer. Modell- og stemmeinnleggene på speechify.ai viser hvordan svaret ser ut.

Streaming eller batch?

Begge Simba 3-modellene støtter streaming. Bruk POST /v1/audio/stream for direkte avspilling, POST /v1/audio/stream/with-timestamps for lyd med tidskoder og ordmarkering, og POST /v1/audio/speech for én lydfil. Modellvalget er uavhengig av leveringsmåten.

FAQ

Hvilken Speechify TTS-modell anbefales?

Simba 3.2. Standardvalget for nye prosjekter: bygget for streaming, raskest lydstart og høyest kvalitet på engelsk.

Simba 3.2 for engelsk: streaming-basert, raskest lydstart og best kvalitet på engelsk. Standardmodellen i API-et hvis model ikke er angitt, er Simba 3.0. Sett model: "simba-3.2" eksplisitt for å velge den.

Ja. Simba 3.0 bruker en språkparameter og gir naturlige stemmer på mange språk. Simba 3.2 fokuserer på et utvalg engelske stemmer.

Ja. Simba 3.0 støtter språkvalg og tilbyr naturlige stemmer på engelsk og seks europeiske språk. Simba 3.2 fokuserer på et utvalg engelske stemmer.

Bare hvis en eksisterende integrasjon krever en bestemt eldre stemme. Ellers bør du gå over til Simba 3.2 eller Simba 3.0.

Bruk dem bare så lenge integrasjonen krever en bestemt eldre stemme. De fjernes fra API-et 2026-09-21 og skrus av 2026-11-21, så migrer til Simba 3.2 eller Simba 3.0 i god tid.

Velg Simba 3.2 for lavest responstid. Strøm utdata for bruk i sanntid.

Nyt de mest avanserte AI-stemmene, ubegrensede filer og support døgnet rundt

Prøv gratis

Del denne artikkelen

Luke Oliff

Luke Oliff er utvikleropplevelsesingeniør og har tilbrakt mesteparten av det siste tiåret med å bygge utviklerverktøy, SDK-er og fellesskap for selskaper som tilbyr tale- og sanntids-API-er.

Luke Oliff er en ekspert på utviklerrelasjoner, basert i Storbritannia. I nærmere ti år har han jobbet med taleteknologi, utviklerverktøy og åpen kildekode – og bidratt til å forbedre utvikleropplevelsen for kjente merkevarer.

Han har utformet strategier for åpen kildekode, lansert utviklerfellesskap, bygget verktøy og levert prototyper for konversasjonsbasert tale-AI flere år før de store API-ene ble tilgjengelige. Som ingeniør innerst inne skriver og snakker han om tale-AI, utvikleropplevelse og sanntids-API-er slik en utvikler ville gjort – med fokus på konkret nytte og god opplevelse.

Han har nå sluttet seg til Speechifys AI Labs-team, der SIMBA 3.0 er rangert som nummer 7 på Artificial Analysis TTS-ledertavlen av nærmere 80 modeller.

Speechify logo

Om Speechify

#1 tekst-til-tale-leser

Speechify er verdens ledende tekst-til-tale-plattform, med over 50 millioner brukere og mer enn 500 000 femstjerners vurderinger på sine tekst-til-tale-iOS-, Android-, Chrome-utvidelse-, webapp- og Mac-desktop-apper. I 2025 ga Apple Speechify den prestisjetunge Apple Design AwardWWDC, og kalte det «en kritisk ressurs som hjelper folk å leve livene sine». Speechify tilbyr over 1 000 naturtro stemmer på mer enn 60 språk, og brukes i nærmere 200 land. Kjendisstemmer inkluderer Snoop Dogg og Gwyneth Paltrow. For skapere og bedrifter gir Speechify Studio avanserte verktøy, inkludert AI voice generator, AI-stemmekloning, AI-dubbing og AI-stemmebytter. Speechify driver også ledende produkter med sitt høykvalitets, kostnadseffektive tekst-til-tale-API. Omtalt i The Wall Street Journal, CNBC, Forbes, TechCrunch og andre store nyhetskanaler, er Speechify verdens største tekst-til-tale-leverandør. Besøk speechify.com/news, speechify.com/blog og speechify.com/press for å lære mer.