1. Início
  2. Ler texto em voz alta
  3. Portfólio de modelos da API Speechify TTS: escolha o ideal para seu projeto" description: "Modelos TTS da Speechify explicados: quando usar Simba 3.2, Simba 3.0 e modelos legados avaliando latência, idioma e qualidade.
Published on Ler texto em voz alta

Portfólio de modelos da API Speechify TTS: escolha o ideal para seu projeto" description: "Modelos TTS da Speechify explicados: quando usar Simba 3.2, Simba 3.0 e modelos legados avaliando latência, idioma e qualidade.

Luke Oliff

Luke Oliff

Luke Oliff é engenheiro de Experiência do Desenvolvedor e passou grande parte da última década criando ferramentas, SDKs e comunidades para empresas de APIs de voz e de tempo real.

apple logoApple Design Award 2025
50M+ usuários

A Speechify oferece um portfólio enxuto de modelos de texto para fala. Escolher o mais adequado é uma questão de equilibrar latência, cobertura de idiomas e qualidade de voz. Este guia mostra em que tipo de trabalho cada modelo se encaixa melhor, para que você decida sem precisar testar todos.

As postagens sobre modelos em speechify.ai detalham cada versão. O anúncio do Simba 3.2 explica por que ele é hoje o modelo recomendado.

Para começar a usar a API de texto para fala da Speechify, confira nosso guia rápido.

Quais modelos a Speechify oferece?

Dois modelos atuais, além de um par legado já descontinuado.

  • Simba 3.2
  • : modelo recomendado para inglês. Nativo para streaming, com menor tempo até o primeiro áudio, e com vozes selecionadas em inglês. Ideal para experiências interativas.
  • Simba 3.0
  • : modelo padrão da API. Nativo para streaming e multilíngue: inglês, alemão, espanhol, francês, italiano e português brasileiro. Tem latência um pouco maior que o 3.2, mas oferece mais idiomas.
  • Modelos legados (
  • simba-english
  • ,
  • simba-multilingual
  • ): dupla Simba 1.6. Saem da API na versão 2026-09-21 e serão desativados em 2026-11-21. Use-os apenas se uma integração antiga exigir uma voz ou idioma específico, e já planeje a migração.

Qual modelo é mais rápido?

Simba 3.2. Foi desenvolvido para streaming e entrega áudio mais rápido. Para agentes de voz em inglês, é a escolha padrão.

Simba 3.0 é quase tão rápido, mas carrega o custo adicional do suporte multilíngue. A dupla legada é a mais lenta e deve ser substituída sempre que possível.

Qual modelo cobre mais idiomas?

Simba 3.0. Ele oferece suporte oficial a inglês, alemão, espanhol (Espanha e México), francês, italiano e português brasileiro. Envie o parâmetro language em POST /v1/audio/speech para escolher o idioma; a resposta retorna uma voz nativa. O legado simba-multilingual cobre mais de 30 idiomas, mas sairá da API na versão 2026-09-21 e será desativado em 2026-11-21.

Se o seu produto opera em um único idioma, o Simba 3.2 se destaca em velocidade e qualidade. Para vários idiomas, o Simba 3.0 é hoje a opção com maior cobertura.

Saiba mais sobre o suporte a idiomas na documentação.

Qual modelo tem a melhor voz?

A qualidade acompanha a geração do modelo. Simba 3.2 lidera em naturalidade no inglês. Simba 3.0 mantém alta qualidade nos idiomas compatíveis. Os modelos legados são mais antigos e soam mais mecânicos.

Para vozes voltadas ao cliente, prefira Simba 3.2 ou Simba 3.0.

Como listar as vozes disponíveis?

Faça uma chamada a GET /v1/voices. Filtre por tipo, idioma, gênero e modelo para encontrar a voz ideal antes da síntese. As postagens em speechify.ai mostram o formato da resposta.

Streaming ou em lote?

Os dois modelos Simba 3 oferecem streaming em tempo real. Use POST /v1/audio/stream para reprodução ao vivo, POST /v1/audio/stream/with-timestamps para áudio ao vivo com marcação por palavra e POST /v1/audio/speech para gerar um arquivo único. A escolha do modelo independe do modo de entrega.

Perguntas frequentes

Qual é o modelo TTS recomendado pela Speechify?

Simba 3.2. É o padrão para novos projetos: nativo para streaming, entrega o áudio mais rápido e oferece a melhor qualidade em inglês.

Qual modelo a API usa por padrão?

Simba 3.0. Quando o campo model não é informado, a API assume o Simba 3.0. Para usar o 3.2 em inglês, defina model: "simba-3.2" explicitamente.

O Speechify TTS oferece suporte a vários idiomas?

Sim. Simba 3.0 aceita o parâmetro language e gera vozes nativas em inglês, alemão, espanhol (Espanha e México), francês, italiano e português brasileiro. Simba 3.2 é focado em um conjunto selecionado de vozes em inglês.

Ainda devo usar modelos legados?

Só se alguma integração antiga exigir uma voz específica. simba-english e simba-multilingual sairão da API a partir da versão 2026-09-21 e serão desativados em 2026-11-21. Migre para Simba 3.2 ou Simba 3.0 antes dessas datas.

Qual modelo usar para um assistente de voz?

Escolha Simba 3.2 para obter o menor tempo de resposta e transmitir o áudio ao vivo.

Aproveite vozes de IA avançadas, arquivos ilimitados e suporte 24/7

Teste grátis
tts banner for blog

Compartilhar este artigo

Luke Oliff

Luke Oliff

Luke Oliff é engenheiro de Experiência do Desenvolvedor e passou grande parte da última década criando ferramentas, SDKs e comunidades para empresas de APIs de voz e de tempo real.

Luke Oliff é especialista em Relações com Desenvolvedores e mora no Reino Unido. Há quase uma década trabalha com tecnologia de voz, ferramentas para desenvolvedores e open-source — sempre aprimorando a experiência do desenvolvedor para grandes marcas.

Ele já criou estratégias open-source, lançou comunidades de desenvolvedores, desenvolveu ferramentas e entregou protótipos de IA de voz conversacional anos antes de APIs populares chegarem ao mercado. Como engenheiro nato, escreve e fala sobre voz com IA, experiência do desenvolvedor e APIs em tempo real como um desenvolvedor de verdade, sempre focado em utilidade e experiência.

Atualmente, faz parte do time AI Labs da Speechify, onde o SIMBA 3.0 ocupa o 7º lugar no ranking Artificial Analysis TTS, entre quase 80 modelos.

speechify logo

Sobre a Speechify

Leitor de Texto em Voz Alta nº 1

Speechify é a principal plataforma de leitura de texto em voz alta do mundo, confiada por mais de 50 milhões de usuários e com mais de 500.000 avaliações cinco estrelas em seus aplicativos de leitura em voz alta para iOS, Android, extensão para Chrome, web app e para Mac. Em 2025, a Apple premiou a Speechify com o prestigiado Apple Design Award na WWDC, chamando a plataforma de “um recurso essencial que ajuda as pessoas a viverem suas vidas.” A Speechify oferece mais de 1.000 vozes naturais em mais de 60 idiomas, sendo usada em quase 200 países. Vozes de celebridades incluem Snoop Dogg e Gwyneth Paltrow. Para criadores e empresas, o Speechify Studio oferece ferramentas avançadas, incluindo Gerador de Voz IA, Clonagem de Voz IA, Dublagem IA e seu Modificador de Voz IA. A Speechify também impulsiona produtos líderes de mercado com sua solução de API de leitura em voz alta de alta qualidade e baixo custo. Destaque em The Wall Street Journal, CNBC, Forbes, TechCrunch e outros grandes veículos de imprensa, a Speechify é a maior provedora de leitura em voz alta do mundo. Acesse speechify.com/news, speechify.com/blog e speechify.com/press para saber mais.