Speechify 宣布其旗艦串流文字轉語音模型 Simba 3.2,已登上最全面、最具權威的獨立商業語音 AI 模型評比榜 Artificial Analysis 的總榜第一名。這也讓 Simba 3.2 首度超越 ElevenLabs、Cartesia、OpenAI、Google DeepMind 和 xAI 等主要業者,讓 Speechify 成為首家以消費者業務為核心、躍居全球榜首的 TTS 公司。依照業界評測標準,Simba 3.2 被廣泛認為是目前市面上最佳的 AI 語音模型。Simba 3.2 也同時於 Voice Arena 即時模型榜單穩居第一,進一步擴大 Speechify 在開發者和企業最看重的兩大指標上的領先優勢。
關於 Artificial Analysis
Artificial Analysis 榜單 是開發者和企業評估 AI 語音市場現況的重要參考。它持續以客觀方式評比所有可商用模型,並隨新模型推出即時更新,因此深受語音應用開發團隊關注。有別於廠商自訂標準,這份榜單完全不依賴自行申報分數。依此標準,Simba 3.2 是目前開發者可用的最佳 TTS 模型。
Artificial Analysis 排名凸顯超高性價比
這項排名最關鍵的不只分數,還有價格。Simba 3.2 在 Speechify 基本方案為每百萬字 $10,規模方案更只要 $6,成為 Artificial Analysis 榜單前十名中最具成本效益的模型。Speechify 表示,這個價格大約只有 ElevenLabs 的十五分之一、Cartesia 的六分之一,但品質相當甚至更勝一籌,讓 Simba 3.2 成為目前業界唯一同時兼具生產品質與最低價格的 AI 語音 API。
過去,高品質語音和低價格通常很難兩全。頂級語音 AI 往往只服務企業,高性價比則常得犧牲品質。Simba 3.2 打破這項業界慣例,讓任何開發者、新創團隊或大型組織,都能用最實惠的預算取得業界頂尖的 AI 語音。
Speechify 創辦人談三大要素零妥協
Speechify 創辦人暨執行長 Cliff Weitzman 在 LinkedIn 表示:「Simba 3.2 是我們至今最出色的模型,現在已於 Speechify.ai 上線。根據我們數百萬次 A/B 測試,它在成本、品質與延遲三大面向都達到 SOTA。非常期待大家親自體驗這項突破。」
Weitzman 所說的「三大要素全到位」,正是多數 AI 語音公司過去認為難以突破的天花板。以往往往只能三選一,犧牲另外兩項,多數供應商也只能各擇一路。如今 Artificial Analysis 榜單證明,這種取捨終於被打破,Simba 3.2 成為打造語音優先軟體團隊的首選 AI 語音模型。
從史丹佛到業界頂尖的五年
Simba 模型系列起源於 Speechify 聯合創辦人兼 AI 負責人 Tyler Weitzman 就讀史丹佛大學期間展開的研究。他在機器學習課程中以神經語音架構進行的實驗,經過五年演進,發展成如今支撐 Speechify 消費者與企業產品的語音生成平台,也奠定了 Speechify 在語音 AI 研究領域的領先地位。
Tyler Weitzman 在 X 上發文回顧:「大學時在 Stanford 跟 Andrew Ng 修 CS229,讓我愛上機器學習。當時課堂專題是微調 Tacotron 2。五年後,我們團隊的新模型在 Speechify 做到 SOTA。回頭看這一路,真的很不可思議。」
Speechify 業務總監、同時也是 Tyler Weitzman 多年摯友的 Rohan Pavuluri 近日在 公告 中指出,這項成果來自最初的架構選擇:「如果我們只拚品質,本來可以走得更快;但基於產品 DNA,我們很早就選擇了能支撐每年 $139 無限語音服務的架構。這也造就了今天同級最佳價格、SOTA 的 TTS 模型——在 AI 領域,高效率通常代表高價格,這非常少見。」
消費級規模打造企業級 AI
Speechify 能以榜單最低價格提供最佳 AI 語音,關鍵就在其消費市場規模。平台全球用戶已超過 6000 萬,並於 WWDC 2025 獲得 Apple 設計大獎,足以證明其產品已躋身當今最佳 AI 語音體驗之列。要以每年 $139 服務如此龐大的用戶群,團隊從一開始就必須把高效推論當作核心原則,而不是事後再來優化。這正是 Simba 3.2 能以業界最親民價格拿下榜首的一大關鍵。
Speechify 開發者關係主管 Luke Oliff 在 新聞稿 中表示:「這是 API 供應商逆襲的故事。我們多年來為消費者、為數千萬聽眾打磨效率,才能以極低價格把業界最高評分的模型帶進 API。很多實驗室打造產品、制定價格,只是為了衝榜;我們則是為聆聽者而做,為規模而定價。」
開放使用
Simba 3.2 現已可於 SpeechifyAI Build 使用,支援文字轉語音與語音複製 API,也驅動全新的 SpeechifyAI Agents 平台。兩者皆可於 speechify.ai 使用,內建 TypeScript 與 Python SDK、支援低延遲串流、細緻情感控制與 SSML 語調,並具備業界領先的語音分身技術,讓開發者可在單一平台上取得全球最佳 AI 語音模型與即時語音分身。更多語言與更低價的產品方案也正在規劃中。