1. Početna
  2. Vijesti
  3. Simba iz Speechifyja proglašen najboljim AI glasovnim modelom na Artificial Analysis ljestvici
6. srpnja 2026.

Simba iz Speechifyja proglašen najboljim AI glasovnim modelom na Artificial Analysis ljestvici

Glavni model za pretvaranje teksta u govor, Simba 3.2, sada je broj 1 AI glasovni model na svijetu.

Speechify je objavio da je njihov vodeći streaming model za pretvaranje teksta u govor, Simba 3.2, zauzeo 1. mjesto na Artificial Analysis ljestvici modela za pretvaranje teksta u govor – najopsežnijem neovisnom mjerenju dostupnih komercijalnih AI glasova. Time je Simba 3.2 nadmašio vodeće modele ElevenLabsa, Cartesie, OpenAI-ja, Google DeepMinda i xAI-ja, što je prvi put da je tvrtka usmjerena na korisnike preuzela globalno vodstvo. Prema industrijskim mjerilima za ocjenu AI glasova, Simba 3.2 sada se široko smatra najboljim AI glasom na tržištu. Uz to, Simba 3.2 drži 1. mjesto i na Voice Arena ljestvici za modele u stvarnom vremenu, čime Speechify potvrđuje vodstvo na dva ključna referentna mjerila za developere i poslovne korisnike.

O Artificial Analysisu

Artificial Analysis ljestvica referenca je koju developeri i poslovni korisnici koriste za procjenu stanja na tržištu AI glasova. Provodi dosljednu i objektivnu evaluaciju svih komercijalnih modela, kontinuirano se ažurira i prate je timovi koji razvijaju glasovne aplikacije. Za razliku od mjerila koje objavljuju sami proizvođači, ljestvica ne koristi samoprijavljene rezultate. Po tom kriteriju, Simba 3.2 trenutačno je najbolji dostupni TTS model za developere.

Što rang na Artificial Analysisu znači za pristupačnost

Najvažniji aspekt vodeće pozicije nije samo ocjena kvalitete, nego i cijena modela. Simba 3.2 stoji 10 $ po milijunu znakova u osnovnom Speechify paketu, a cijena pada na 6 $ po milijunu znakova u Scale tarifi, što ga čini najisplativijim modelom u top 10 na Artificial Analysis ljestvici. Vodstvo Speechifyja navodi da je cijena oko 15 puta niža od ElevenLabsa i šest puta niža od Cartesie uz jednaku ili višu kvalitetu — čime Simba 3.2 postaje najpristupačniji AI glasovni API za produkciju.

Kombinacija visoke kvalitete i pristupačne cijene dosad se smatrala gotovo nemogućom u sintezi govora. Premium segment nudio je realistične AI glasove po cijenama namijenjenima korporacijama, dok su povoljnije opcije bile slabije kvalitete. Simba 3.2 uklanja taj kompromis i donosi najbolji AI glas svakom developeru, startupu ili poduzeću, bez obzira na budžet.

Osnivač Speechifyja o postizanju trostruke izvrsnosti

"Simba 3.2 je naš najbolji model dosad, a sada je dostupan na Speechify.ai," rekao je Cliff Weitzman, osnivač i CEO Speechifyja, na LinkedInu. "Model je napravljen za glasovne agente u velikom opsegu i usavršen kroz milijune A/B testova na našem korisničkom sustavu. Kod TTS API-ja važne su tri stvari: cijena, kvaliteta i latencija. Simba 3.2 je sada najbolji u sve tri. Veselim se da ga i sami isprobate."

Ta 'trifecta' na koju se Weitzman poziva dugo je bila granica za većinu pružatelja AI glasova. Optimizacija jedne značajke gotovo je uvijek značila žrtvovanje drugih, pa se većina proizvođača fokusirala samo na jedno područje. Istinski vrh u sve tri odjednom godinama se smatrao istraživačkom utopijom. Rangiranje na Artificial Analysisu prvi je neovisni dokaz da se taj kompromis može izbjeći, a Simba 3.2 postavlja novi standard za AI glas za sve koji razvijaju govorne aplikacije.

Pet godina od Stanforda do vrha

Obitelj modela Simba proizašla je iz istraživačkog rada koji je pokrenuo suosnivač i voditelj AI-ja u Speechifyju, Tyler Weitzman, tijekom preddiplomskog studija na Stanfordu. Njegovi prvi eksperimenti s neuralnim govorom na kolegiju strojnog učenja tijekom pet godina prerasli su u model koji danas pokreće glasovne usluge u svim proizvodima Speechifyja, svrstavajući tvrtku među vodeće AI laboratorije za glas.

Osvrćući se na ovaj uspjeh, Tyler Weitzman objavio je na X-u: "Tijekom studija na Stanfordu, kolegij CS229 s Andrewom Ngom probudio je moj interes za ML. Moj projekt bila je prilagodba Tacotrona 2. Naš novi model u Speechifyju danas je SOTA, pet godina kasnije. Nevjerojatno je osvrnuti se unatrag."

Rohan Pavuluri, poslovni direktor Speechifyja i dugogodišnji prijatelj Tylera Weitzmana, opisao je rangiranje kao rezultat ranih arhitektonskih odluka u nedavnoj objavi: "Možda smo mogli brže napredovati da smo se fokusirali samo na kvalitetu, ali naš korisnički DNK i poslovni model tražili su rana arhitektonska rješenja kako bismo korisnicima mogli nuditi gotovo neograničeno pretvaranje teksta u govor za 139 $ godišnje. Danas to znači SOTA TTS model po najboljoj cijeni, što je rijetkost u AI istraživanju, gdje bolji rezultati obično znače i veće troškove."

Potrošačka skala kao pokretač AI kvalitete za poslovne korisnike

Sposobnost Speechifyja da ponudi najbolji AI glas po najnižoj cijeni u top 10 temelji se na ekonomiji poslovanja s krajnjim korisnicima. Platformu koristi više od 60 milijuna ljudi diljem svijeta, a ove je godine osvojila i Apple Design Award na WWDC 2025, što potvrđuje da se proizvod smatra vrhunskim AI govornim iskustvom današnjice. Da bi za 139 $ godišnje zadovoljio toliku bazu korisnika, istraživački tim morao je od početka dizajnirati model za učinkovitu inferenciju, a ne to ostaviti za kasniju optimizaciju. Ta disciplina omogućuje isporuku najbolje ocijenjenog modela po cijenama dostupnima developerima.

"Ovo je priča o autsajderu među API providerima," rekao je Luke Oliff, voditelj odnosa s developerima u Speechifyju u priopćenju za medije. "Godinama smo razvijali modele s fokusom na učinkovitost jer su to od nas tražili korisnici diljem svijeta – deseci milijuna korisnika i neki od najboljih glasova. Upravo zato sada možemo ponuditi najbolje ocijenjeni model na API-ju po najnižoj cijeni. Većina laboratorija cilja benchmarke i cijene za poduzeća. Mi gradimo za korisnike i cijene za stvarnu upotrebu."

Dostupnost

Simba 3.2 je već dostupan putem SpeechifyAI Build API-ja za pretvorbu teksta u govor i kloniranje glasova te pokreće novu SpeechifyAI Agents platformu za produkcijsku izradu govora. Sve je dostupno na speechify.ai uz TypeScript i Python SDK-ove, podršku za streaming, brzi početak rada, detaljnu emocionalnu kontrolu i SSML prozodiju. Platforma uključuje i vrhunsku tehnologiju kloniranja glasa, pružajući developerima jedinstvenu platformu za vrhunski AI glas i trenutačno kloniranje po istoj cijeni. Uskoro stižu podrška za više jezika i još povoljniji modeli.