1. Laman Utama
  2. TTS
  3. Penerangan barisan model API TTS Speechify: pilih model yang tepat untuk keperluan anda
Diterbitkan pada TTS

Penerangan barisan model API TTS Speechify: pilih model yang tepat untuk keperluan anda

Luke Oliff

Luke

Luke Oliff is a Developer Relations leader who has spent the better part of a decade building products and improving developer experience for well known brands.

apple logoAnugerah Reka Bentuk Apple 2025
50J+ Pengguna

Speechify menawarkan beberapa model text-to-speech. Pemilihan model yang tepat bergantung pada imbangan antara kependaman, sokongan bahasa dan kualiti suara. Panduan ini memadankan setiap model dengan kegunaan yang paling sesuai, supaya anda boleh memilih tanpa perlu menguji semuanya.

Setiap keluaran model dihuraikan dengan mendalam dalam siaran di speechify.ai. Pengumuman Simba 3.2 menerangkan mengapa ia kini menjadi model yang disyorkan.

Untuk maklumat lanjut tentang cara memulakan API text-to-speech Speechify, lihat panduan ringkas kami.

Apakah model yang ditawarkan oleh Speechify?

Dua model terkini, serta dua model legasi yang akan ditamatkan.

  • Simba 3.2
  • : model yang disyorkan untuk Bahasa Inggeris. Dioptimumkan untuk penstriman, masa respons paling pantas, dengan pilihan suara Bahasa Inggeris terpilih. Sesuai untuk kegunaan interaktif.
  • Simba 3.0
  • : tetapan lalai API semasa. Dioptimumkan untuk penstriman, berbilang bahasa: Inggeris, Jerman, Sepanyol, Perancis, Itali dan Portugis Brazil. Kependamannya sedikit lebih tinggi daripada 3.2 tetapi liputan bahasanya lebih luas.
  • Model legasi (
  • simba-english
  • ,
  • simba-multilingual
  • ): pasangan Simba 1.6. Akan ditamatkan dalam API versi 2026-09-21 dan dimatikan pada 2026-11-21. Gunakan hanya jika integrasi sedia ada memerlukan suara atau bahasa lama, dan rancang migrasi dari sekarang.

Model mana yang paling pantas?

Simba 3.2. Model ini direka khusus untuk penstriman, jadi audio pertama tiba paling cepat. Untuk agen suara Bahasa Inggeris, inilah pilihan lalai terbaik.

Simba 3.0 hampir setanding, tetapi menambah sedikit kependaman kerana sokongan berbilang bahasanya. Pasangan legasi ialah yang paling perlahan dan wajar digantikan jika boleh.

Model mana yang meliputi paling banyak bahasa?

Simba 3.0. Menyokong secara rasmi Bahasa Inggeris, Jerman, Sepanyol (Sepanyol dan Mexico), Perancis, Itali dan Portugis Brazil. Gunakan parameter language pada POST /v1/audio/speech untuk memilih bahasa, dan model ini akan menghasilkan suara asli untuk bahasa tersebut. simba-multilingual legasi meliputi lebih 30 bahasa, tetapi akan ditamatkan dalam API versi 2026-09-21 dan dimatikan pada 2026-11-21.

Jika produk anda hanya menggunakan satu bahasa, Simba 3.2 ialah pilihan terbaik dari segi kelajuan dan kualiti. Jika anda menyokong beberapa bahasa, Simba 3.0 kini merupakan pilihan yang tepat untuk liputan bahasa.

Baca lanjut tentang sokongan bahasa dalam dokumentasi kami.

Model manakah yang kedengaran paling semula jadi?

Kualiti suara selari dengan generasi model. Simba 3.2 paling menyerlah dari segi keaslian suara Bahasa Inggeris. Simba 3.0 pula mantap merentas bahasa yang disokongnya. Model legasi kedengaran paling robotik.

Untuk suara yang berorientasikan pelanggan, utamakan Simba 3.2 atau Simba 3.0.

Bagaimana cara menyenaraikan suara yang tersedia?

Panggil GET /v1/voices. Tapis mengikut jenis, lokal, jantina dan model untuk mencari suara yang sesuai sebelum mensintesis. Siaran tentang suara dan model di speechify.ai turut menunjukkan bentuk respons.

Penstriman atau kelompok?

Kedua-dua model Simba 3 menyokong penstriman. Gunakan POST /v1/audio/stream untuk main balik secara langsung, POST /v1/audio/stream/with-timestamps untuk audio langsung dengan cap masa pada setiap perkataan, dan POST /v1/audio/speech untuk satu fail. Pilihan model tidak bergantung pada mod penyampaian.

FAQ

Apakah model TTS Speechify yang disyorkan?

Simba 3.2. Pilihan lalai untuk kerja baharu: dioptimumkan untuk penstriman, paling pantas menghasilkan audio, dan menawarkan kualiti tertinggi untuk Bahasa Inggeris.

Model apa yang digunakan API secara lalai?

Simba 3.0. Jika permintaan tidak menyatakan model, API akan menggunakan Simba 3.0. Tetapkan model: "simba-3.2" secara eksplisit untuk menggunakan 3.2 bagi Bahasa Inggeris.

Adakah Speechify TTS menyokong pelbagai bahasa?

Ya. Simba 3.0 menerima parameter language dan menghasilkan suara asli dalam Bahasa Inggeris, Jerman, Sepanyol (Sepanyol dan Mexico), Perancis, Itali serta Portugis Brazil. Simba 3.2 pula memfokuskan pada suara Inggeris terpilih.

Perlukah saya terus menggunakan model legasi?

Gunakan hanya jika integrasi sedia ada memerlukan suara lama tertentu. simba-english dan simba-multilingual akan ditamatkan dalam API versi 2026-09-21 dan dimatikan pada 2026-11-21, jadi beralihlah ke Simba 3.2 atau Simba 3.0 sebelum itu.

Model mana patut saya guna untuk agen suara?

Pilih Simba 3.2 untuk masa terpantas ke bait pertama, dan strim output untuk kegunaan langsung.

Nikmati suara AI tercanggih, fail tanpa had, dan sokongan 24/7

Cuba Percuma
tts banner for blog

Kongsi Artikel Ini

Luke Oliff

Luke

Luke Oliff is a Developer Relations leader who has spent the better part of a decade building products and improving developer experience for well known brands.

Luke Oliff is a Developer Relations leader based in the UK. For the better part of a decade he has been working with voice technology, developer tooling, and open-source — improving developer experience for well known brands.

He has architected open-source strategy, launched developer communities, built tools, and shipped conversational AI voice prototypes years before mainstream APIs were available. As an engineer at heart, he writes and speaks about voice AI, developer experience, and real-time APIs as a developer would, focussing on utility and experience.

He has now joined Speechify's AI Labs team, where SIMBA 3.0 ranks 7th on the Artificial Analysis TTS leaderboard out of nearly 80 models.

speechify logo

Tentang Speechify

Pembaca Teks ke Ucapan #1

Speechify ialah platform teks ke ucapan terkemuka dunia, dipercayai oleh lebih 50 juta pengguna dan disokong oleh lebih daripada 500,000 ulasan lima bintang merentasi aplikasi teks ke ucapannya iOS, Android, Pemalam Chrome, aplikasi web, dan aplikasi desktop Mac. Pada tahun 2025, Apple telah menganugerahkan Speechify dengan Anugerah Reka Bentuk Apple yang berprestij di WWDC, menyifatkannya sebagai “sumber penting yang membantu orang menjalani hidup mereka.” Speechify menawarkan lebih 1,000 suara semula jadi dalam lebih 60 bahasa dan digunakan di hampir 200 negara. Suara selebriti termasuk Snoop Dogg dan Gwyneth Paltrow. Untuk pencipta dan perniagaan, Speechify Studio menyediakan alat canggih termasuk Penjana Suara AI, Penduaan Suara AI, Alih Suara AI, dan Penukar Suara AI. Speechify juga memacu produk terkemuka dengan API teks ke ucapan berkualiti tinggi dan kos efektif. Pernah dipaparkan dalam The Wall Street Journal, CNBC, Forbes, TechCrunch, dan media utama lain, Speechify ialah penyedia teks ke ucapan terbesar di dunia. Lawati speechify.com/news, speechify.com/blog, dan speechify.com/press untuk maklumat lanjut.