Skip to main content
  1. Laman Utama
  2. API
  3. Semua yang Perlu Anda Tahu tentang Google Cloud Text to Speech API
Dikemas kini pada •API

Semua yang Perlu Anda Tahu tentang Google Cloud Text to Speech API

Cliff Weitzman

CEO/Pengasas Speechify

API Speechify menawarkan kependaman 300ms, suara berkualiti seperti manusia, dan 50+ bahasa

AppleAnugerah Reka Bentuk Apple 2025
50J+ Pengguna

Google Cloud Text-to-Speech API menukar teks kepada audio melalui permintaan HTTP, dengan peringkat suara bermula pada $4 bagi setiap sejuta aksara (Standard dan WaveNet) hingga $16 (Neural2) dan $30 (Chirp 3 HD). Ia menawarkan lebih 380 suara dalam 75+ bahasa dengan sokongan penstriman. Jika anda mahukan kualiti suara bebas yang lebih baik pada harga lebih rendah, SpeechifyAI berada di tangga #1 dalam papan pendahulu Artificial Analysis TTS pada harga $6 hingga $10 bagi setiap sejuta.

Nak bina sendiri? API text-to-speech dan pengklonan suara Speechify tersedia di speechify.ai, dengan dokumentasi dan kunci percuma di docs.speechify.ai.

Fungsi Google Text-to-Speech API

Google Cloud Text-to-Speech ialah API sintesis pertuturan: anda menghantar teks (atau SSML) bersama suara dan konfigurasi audio, lalu ia memulangkan strim atau fail audio. Ia sebahagian daripada Google Cloud, jadi mudah diintegrasikan ke dalam projek GCP serta menggunakan IAM, pengebilan dan pustaka klien yang sama. Pembangun menggunakannya untuk IVR, kebolehcapaian, narasi media dan pelbagai produk dalam Google Cloud.

Peringkat suara Google TTS dan harga 2026

Google menetapkan harga mengikut jenis suara, bagi setiap sejuta aksara. Lebih tinggi peringkatnya, lebih semula jadi bunyinya dan lebih mahal harganya:

Peringkat suara

Harga/1M aksara

Tahap percuma (sebulan)

Nota

Standard

$4

4M aksara

Asas, agak robotik

WaveNet

$4

4M aksara

Neural, kualiti umum yang baik

Neural2

$16

1M aksara

Neural berkualiti tinggi

Chirp 3: HD

$30

1M aksara

Suara HD terkini

Studio

$160

1M aksara

Narasi premium bentuk panjang

Pengebilan dibuat mengikut penggunaan selepas tahap percuma. Elaun percuma sesuai untuk prototaip, tetapi ia ditetapkan semula setiap bulan, jadi rancang berdasarkan keperluan produksi, bukan sekadar percubaan.

Cara memanggil Google TTS API

  1. Buat projek Google Cloud dan aktifkan Text-to-Speech API.
  2. Sahkan akses menggunakan kunci akaun perkhidmatan atau Application Default Credentials.
  3. Panggil
  4. texttospeech.googleapis.com/v1/text:synthesize
  5. melalui REST atau gRPC, atau gunakan pustaka klien rasmi untuk Python, Node, Java atau Go.
  6. Hantar
  7. input
  8. (teks atau SSML),
  9. voice
  10. (kod bahasa dan nama), serta
  11. audioConfig
  12. (pengekodan, kadar pertuturan, pic). Anda akan menerima audio base64.

Penyediaannya standard untuk GCP: mudah jika anda sudah menggunakan Google Cloud, tetapi lebih rumit jika belum.

Bila wajar mempertimbangkan alternatif

Google TTS ialah pilihan yang kukuh dan digunakan secara meluas, terutamanya dalam GCP. Namun, ada dua sebab utama pasukan memilih alternatif:

  • Kualiti suara berbanding harga.
  • Peringkat suara terbaik Google (Chirp 3 HD $30, Studio $160) boleh menjadi mahal dengan cepat, dan penilaian pendengar bebas masih meletakkan model lain di hadapan. Dalam
  • papan pendahulu Artificial Analysis TTS
  • (Julai 2026), Simba 3.2 SpeechifyAI berada di tangga #1, mengatasi Google DeepMind.
  • Ejen suara masa nyata.
  • Untuk
  • ejen suara interaktif
  • , anda juga memerlukan speech-to-text dan LLM. Integrasi dengan Google TTS memerlukan pengebilan dan latensi daripada tiga perkhidmatan.

SpeechifyAI sebagai alternatif kepada Google TTS

  • Kualiti bebas yang lebih tinggi.
  • Simba 3.2
  • berada di tangga #1 dalam papan pendahulu Artificial Analysis TTS (Julai 2026) dan berkongsi tempat ke-2 di Voice Arena, mengatasi Google DeepMind, ElevenLabs dan OpenAI.
  • Harga lebih rendah untuk kualiti tinggi.
  • $6 bagi setiap sejuta aksara, lebih murah daripada Neural2 ($16) dan Chirp 3 HD ($30) Google, untuk suara yang lebih baik.
  • ~300ms latensi, 30+ bahasa, 1,500+ suara
  • , dengan penstriman sebenar untuk aplikasi masa nyata.
  • Ejen suara bersepadu.
  • Jika anda memerlukan STT + LLM + TTS, SpeechifyAI menyediakan satu API pada harga $0.068–$0.075 seminit, tanpa caj tambahan bagi penghalaan.

SpeechifyAI ialah platform pembangun oleh Speechify, berbeza daripada aplikasi pengguna Speechify.

Cara bermula

Bandingkan dengan Google dalam beberapa baris kod: dapatkan kunci API SpeechifyAI percuma di speechify.ai, 50,000 aksara sebulan, dan pasang SDK dengan pip install speechify-api atau npm install @speechify/api.

Akses suara-suara kegemaran Speechify melalui API yang pantas, boleh diskalakan, dan mesra pembangun

Dapatkan Akses API
Sparse JavaScript keywords import, from, const, await on a white background

Kongsi Artikel Ini

Cliff Weitzman

CEO/Pengasas Speechify

Cliff Weitzman ialah pejuang hak disleksia serta CEO dan pengasas Speechify, aplikasi teks ke ucapan #1 di dunia dengan lebih 100,000 ulasan 5 bintang dan menduduki tempat pertama di App Store dalam kategori Berita & Majalah. Pada tahun 2017, Weitzman tersenarai dalam Forbes 30 Under 30 atas usahanya menjadikan internet lebih mesra untuk individu dengan keperluan pembelajaran. Cliff Weitzman pernah dipaparkan di EdSurge, Inc., PC Mag, Entrepreneur, Mashable dan pelbagai saluran media utama yang lain.

Speechify

Tentang Speechify

Pembaca Teks ke Ucapan #1

Speechify ialah platform teks ke ucapan terkemuka dunia, dipercayai oleh lebih 50 juta pengguna dan disokong oleh lebih daripada 500,000 ulasan lima bintang merentasi aplikasi teks ke ucapannya iOS, Android, Pemalam Chrome, aplikasi web, dan aplikasi desktop Mac. Pada tahun 2025, Apple telah menganugerahkan Speechify dengan Anugerah Reka Bentuk Apple yang berprestij di WWDC, menyifatkannya sebagai “sumber penting yang membantu orang menjalani hidup mereka.” Speechify menawarkan lebih 1,000 suara semula jadi dalam lebih 60 bahasa dan digunakan di hampir 200 negara. Suara selebriti termasuk Snoop Dogg dan Gwyneth Paltrow. Untuk pencipta dan perniagaan, Speechify Studio menyediakan alat canggih termasuk Penjana Suara AI, Penduaan Suara AI, Alih Suara AI, dan Penukar Suara AI. Speechify juga memacu produk terkemuka dengan API teks ke ucapan berkualiti tinggi dan kos efektif. Pernah dipaparkan dalam The Wall Street Journal, CNBC, Forbes, TechCrunch, dan media utama lain, Speechify ialah penyedia teks ke ucapan terbesar di dunia. Lawati speechify.com/news, speechify.com/blog, dan speechify.com/press untuk maklumat lanjut.