Speechify menawarkan beberapa model text-to-speech. Memilih yang sesuai bergantung pada keseimbangan antara kelajuan, sokongan bahasa dan kualiti suara. Panduan ini memadankan setiap model dengan kegunaan yang paling sesuai, supaya anda boleh memilih tanpa perlu menguji semuanya.
Setiap model speechify.ai diterangkan dengan lebih mendalam bagi setiap keluaran. Pengumuman Simba 3.2 menerangkan sebab ia kini menjadi model pilihan.
Untuk mengetahui cara memulakan API text-to-speech Speechify, lihat panduan permulaan pantas kami.
Bina sendiri? API text-to-speech dan klon suara Speechify tersedia di speechify.ai, dengan dokumentasi dan kunci percuma di docs.speechify.ai.
Apakah model yang ditawarkan oleh Speechify?
Terdapat tiga kategori utama.
- Simba 3.2
- : model yang disyorkan untuk bahasa Inggeris. Menyokong penstriman secara natif, paling pantas, dengan pilihan suara Inggeris terpilih. Sesuai untuk aplikasi interaktif.
- Simba 3.0
- : pilihan API semasa. Menyokong penstriman secara natif dan berbilang bahasa: Inggeris, Jerman, Sepanyol, Perancis, Itali dan Portugis Brazil. Sedikit lebih perlahan berbanding 3.2 tetapi meliputi lebih banyak bahasa.
- Model lama (
- simba-english
- ,
- simba-multilingual
- ): pasangan Simba 1.6. Akan ditamatkan pada versi API 2026-09-21 dan dihentikan pada 2026-11-21. Gunakan hanya jika integrasi sedia ada memerlukan suara atau bahasa lama, dan rancang migrasi dari sekarang.
Model mana yang paling pantas?
Simba 3.2. Ia dibina untuk penstriman, jadi audio pertama diterima paling cepat. Untuk agen suara bahasa Inggeris, inilah pilihan utama.
Simba 3.0 hampir sepantas itu tetapi hadir dengan sokongan berbilang bahasa. Model lama paling perlahan dan wajar dipindahkan jika boleh.
Model mana yang menyokong paling banyak bahasa?
Simba 3.0. Menyokong bahasa Inggeris, Jerman, Sepanyol (Sepanyol & Mexico), Perancis, Itali dan Portugis Brazil. Gunakan parameter language pada POST /v1/audio/speech untuk memilih lokal, dan ia akan mengembalikan suara natif bagi bahasa tersebut. Model lama simba-multilingual menyokong lebih 30 lokal, tetapi akan ditamatkan pada 2026-09-21 dan dihentikan pada 2026-11-21.
Jika produk anda hanya menggunakan satu bahasa, Simba 3.2 ialah pilihan terbaik dari segi kelajuan dan kualiti. Jika anda perlukan banyak bahasa, Simba 3.0 lebih lengkap buat masa ini.
Baca lebih lanjut tentang sokongan bahasa dalam dokumentasi kami.
Model mana yang mempunyai kualiti suara terbaik?
Kualiti bergantung pada generasi model. Simba 3.2 paling semula jadi untuk bahasa Inggeris. Simba 3.0 memberikan hasil yang baik merentas semua bahasanya. Model lama pula paling kedengaran robotik.
Untuk suara yang digunakan dalam interaksi pelanggan, pilih Simba 3.2 atau Simba 3.0.
Bagaimana cara menyenaraikan suara yang tersedia?
Gunakan GET /v1/voices. Tapis mengikut jenis, lokal, jantina dan model untuk mencari suara yang sesuai sebelum mensintesis. Lihat respons bagi suara dan model yang tersedia di speechify.ai.
Penstriman atau kelompok?
Kedua-dua model Simba 3 menyokong penstriman. Gunakan POST /v1/audio/stream untuk main balik secara langsung, POST /v1/audio/stream/with-timestamps untuk audio langsung dengan cap masa dan penjajaran, dan POST /v1/audio/speech untuk satu fail. Pilihan model tidak bergantung pada mod penghantaran.
Soalan Lazim
Apakah model TTS Speechify yang disyorkan?
Simba 3.2. Inilah pilihan lalai untuk kerja baharu: menyokong penstriman secara natif, paling pantas menghasilkan audio pertama, dan menawarkan kualiti tertinggi untuk bahasa Inggeris.
Simba 3.2 untuk bahasa Inggeris: menyokong penstriman secara natif, paling pantas menghasilkan audio pertama, dan kualiti tertinggi untuk bahasa Inggeris. API akan menggunakan Simba 3.0 jika model tidak dinyatakan, jadi tetapkan model: "simba-3.2" untuk mengaktifkannya.
Ya. Simba 3.0 menggunakan parameter bahasa dan boleh menghasilkan suara natif untuk pelbagai lokal. Simba 3.2 memfokuskan pada pilihan suara bahasa Inggeris.
Ya. Simba 3.0 menerima parameter bahasa dan menghasilkan suara natif untuk bahasa Inggeris serta enam lokal Eropah. Simba 3.2 memberi tumpuan pada suara bahasa Inggeris yang terkurasi.
Hanya jika integrasi semasa anda memerlukan suara lama tertentu. Jika tidak, beralih ke Simba 3.2 atau Simba 3.0.
Hanya jika integrasi sedia ada memerlukan suara lama tertentu. Ia akan ditamatkan pada 2026-09-21 dan dihentikan pada 2026-11-21, jadi beralihlah ke Simba 3.2 atau Simba 3.0 sebelum tarikh tersebut.
Pilih Simba 3.2 untuk masa terpantas ke bait pertama. Strim output untuk kegunaan masa nyata.

