Speechify telah mengumumkan model penstriman teks-ke-suara utamanya, Simba 3.2, kini menduduki tempat No. 1 keseluruhan di papan kedudukan teks-ke-suara Artificial Analysis, penanda aras bebas paling menyeluruh untuk menilai model AI suara komersial. Keputusan ini meletakkan Simba 3.2 mengatasi tawaran utama daripada ElevenLabs, Cartesia, OpenAI, Google DeepMind, dan xAI, menandakan kali pertama syarikat berfokuskan pengguna mendahului kedudukan global. Berdasarkan ukuran utama industri untuk menilai AI suara, Simba 3.2 kini diiktiraf secara meluas sebagai model suara AI terbaik di pasaran. Selain itu, Simba 3.2 juga menduduki No. 1 di Voice Arena untuk model masa nyata, sekali gus mengukuhkan kedudukan Speechify di dua penanda aras utama yang dipercayai pembangun dan pembeli perusahaan.
Tentang Artificial Analysis
Papan kedudukan Artificial Analysis ialah rujukan utama bagi pembangun dan perusahaan untuk menilai pasaran suara AI. Ia menjalankan penilaian yang seragam dan objektif ke atas setiap model komersial, sentiasa dikemas kini dengan model baharu, dan dipantau rapi oleh pasukan produk. Tidak seperti penanda aras vendor, papan ini tidak menggunakan skor yang dilaporkan sendiri. Berdasarkan itu, Simba 3.2 ialah model teks-ke-suara terbaik untuk pembangun pada masa ini.
Apa Maksud Kedudukan Artificial Analysis untuk Keterjangkauan Harga
Aspek paling penting dalam ranking ini bukan sekadar skor kualiti. Yang lebih utama ialah gabungan skor dan harga model tersebut. Simba 3.2 disenaraikan pada harga $10 bagi sejuta aksara di peringkat permulaan Speechify, turun ke $6 bagi setiap sejuta aksara di peringkat Scale, menjadikannya model paling menjimatkan dalam sepuluh teratas papan kedudukan Artificial Analysis. Pimpinan Speechify menyatakan harga ini kira-kira lima belas kali lebih murah daripada ElevenLabs dan enam kali lebih murah daripada Cartesia untuk mutu yang setara atau lebih baik, sekali gus meletakkan Simba 3.2 sebagai API suara AI paling berbaloi dengan mutu bertaraf pengeluaran pada hari ini.
Gabungan ini secara tradisinya dianggap mustahil dari sudut struktur dalam sintesis suara. Segmen premium menghasilkan suara AI yang realistik pada harga perusahaan, manakala segmen mampu milik pula menyasarkan pembangun yang sanggup berkompromi pada kualiti. Simba 3.2 menghapuskan kompromi ini dengan menawarkan suara AI terbaik kepada semua pembangun, startup, dan perusahaan tanpa mengira bajet.
Pengasas Speechify Tentang Pencapaian Tiga Serangkai
"Simba 3.2 ialah model terbaik kami setakat ini, dan kini boleh diakses di Speechify.ai," kata Cliff Weitzman, pengasas dan CEO Speechify di LinkedIn. "Ia dibina untuk ejen suara berskala dan dipertingkat melalui jutaan ujian A/B di platform pengguna kami. Dalam API TTS, tiga perkara paling penting ialah kos, kualiti, dan latensi. Simba 3.2 mencapai SOTA bagi ketiga-tiganya. Kami teruja untuk anda mencubanya sendiri bagi merasai pengalamannya."
Tiga serangkai yang disebut Weitzman itu ialah had yang sering dikejar oleh penyedia suara AI. Mengoptimumkan satu biasanya mengorbankan dua yang lain, dan kebanyakan vendor hanya fokus pada satu aspek. Menjadi peneraju dalam semua dimensi serentak sering dianggap mustahil dalam industri ini. Kedudukan Artificial Analysis ialah bukti bebas bahawa kompromi ini boleh diatasi, sekali gus menetapkan Simba 3.2 sebagai model AI suara terbaik untuk pasukan yang membina perisian berasaskan suara.
Lima Tahun Dari Stanford ke Tahap Terkini
Keluarga model Simba bermula daripada penyelidikan yang dimulakan oleh pengasas bersama dan Ketua AI Speechify, Tyler Weitzman, semasa pengajian sarjana mudanya di Universiti Stanford. Eksperimen awal beliau dengan seni bina suara neural untuk kursus pembelajaran mesin berkembang sepanjang lima tahun lalu menjadi keluarga model yang kini menjana suara penstriman untuk produk pengguna dan perusahaan Speechify, sekali gus meletakkan Speechify sebagai makmal penyelidikan AI suara terkemuka.
Mengimbas detik penting ini, Tyler Weitzman berkongsi dalam pos di X, "Sebagai pelajar di Stanford, CS229 bersama Andrew Ng membangkitkan minat saya terhadap ML. Projek kursus saya ialah penalaan halus Tacotron 2. Model baharu pasukan saya di Speechify kini mencapai SOTA, lima tahun kemudian. Memang luar biasa bila dikenang semula."
Rohan Pavuluri, Ketua Pegawai Perniagaan Speechify dan rakan lama Tyler Weitzman, menyifatkan ranking itu sebagai hasil keputusan seni bina yang dibuat lebih awal dalam pengumuman terkini. "Walaupun kami boleh bergerak lebih pantas dengan hanya fokus pada mutu, DNA pengguna dan model perniagaan kami menuntut keputusan seni bina awal supaya kami dapat menawarkan pertuturan tanpa had pada $139/tahun kepada pengguna. Ini menghasilkan model TTS SOTA pada harga terbaik, sesuatu yang jarang berlaku dalam dunia AI di mana prestasi lebih baik biasanya bermaksud kos lebih tinggi."
Skala Pengguna Pacu AI Bertaraf Perusahaan
Keupayaan Speechify untuk menyediakan suara AI terbaik di pasaran pada harga paling rendah dalam kalangan sepuluh teratas terhasil daripada ekonomi perniagaan penggunanya. Platform mereka digunakan oleh lebih 60 juta pengguna di seluruh dunia dan diiktiraf tahun ini menerusi Apple Design Award di WWDC 2025, satu petanda bahawa produk pengguna Speechify ialah antara pengalaman AI suara terbaik hari ini. Untuk melayani jutaan pengguna dengan langganan $139 setahun, pasukan R&D perlu mengutamakan inferens yang cekap sejak awal. Disiplin ini membolehkan mereka menawarkan model No. 1 di papan kedudukan Artificial Analysis pada harga yang kini mampu dicapai oleh pembangun.
"Ini kisah underdog bagi penyedia API," kata Luke Oliff, Ketua Perhubungan Pembangun Speechify dalam kenyataan media. "Selama bertahun-tahun kami memastikan model kami cekap kerana perniagaan pengguna kami memang menuntutnya — puluhan juta pendengar, dengan suara terbaik di pasaran. Itulah sebabnya kini kami boleh menawarkan model terbaik dunia di API pada harga yang sangat rendah. Kebanyakan makmal membangunkan model untuk penanda aras dan menetapkan harga untuk perusahaan. Kami membinanya untuk pendengar dan menetapkan harga untuk penggunaan sebenar."
Ketersediaan
Simba 3.2 kini tersedia melalui SpeechifyAI Build, API teks-ke-suara dan klon suara Speechify, serta menggerakkan platform SpeechifyAI Agents yang baru dilancarkan untuk membina ejen suara produksi. Kedua-duanya tersedia di speechify.ai, dengan SDK TypeScript dan Python tersendiri, sokongan penstriman dengan masa mula yang rendah, kawalan emosi terperinci, dan prosodi SSML. Platform ini menawarkan teknologi klon suara terbaik di pasaran, membolehkan pembangun menggunakan satu rangkaian untuk model suara AI terbaik dunia dan klon suara segera terbaik pada harga yang sama. Bahasa tambahan dan model yang lebih mampu milik akan hadir dalam pelan hala tuju syarikat.