Speechify宣布,其旗舰流式文本转语音模型Simba 3.2在目前最全面、最独立的商用语音AI评测榜单 Artificial Analysis 上登顶总榜第一。Simba 3.2力压ElevenLabs、Cartesia、OpenAI、Google DeepMind和xAI的主打产品,让Speechify成为首家登顶全球榜首的消费级语音公司。按业界评测标准,Simba 3.2已被广泛视为当前市面上最出色的AI语音模型。此外,Simba 3.2还在Voice Arena实时模型榜单中位列第一,进一步巩固了Speechify在开发者和企业买家最看重的两大榜单上的领先地位。
关于 Artificial Analysis
Artificial Analysis 榜单是开发者和企业评估AI语音市场的重要基准。它以持续、客观、统一的方式测试每一款商用语音模型,并随着新产品发布及时更新,因此深受语音产品团队关注。不同于厂商自报的榜单,Artificial Analysis不采信企业自评,因此从目前来看,Simba 3.2是开发者可用的最佳文本转语音模型。
Artificial Analysis 排名意味着更高性价比
这份排名最关键的不只是质量分数,更是分数与价格的综合表现。Simba 3.2在Speechify入门档定价为每百万字符$10,Scale档低至$6,成为榜单前十里性价比最高的模型。Speechify团队表示,这一价格约为ElevenLabs的1/15、Cartesia的1/6,在同等甚至更优质量下便宜得多,是同级中少有的高质量低价AI语音API。
在语音合成行业,兼顾高质量和低价格一直被视为难以两全。高端市场主打为企业提供逼真语音,价格往往居高不下;低价模型则常常要牺牲音质。Simba 3.2打破了这一局面,把顶级AI语音带给所有开发者、初创公司和企业,不受预算高低限制。
Speechify创始人谈“三重突破”
Speechify创始人兼CEO Cliff Weitzman在LinkedIn表示:“Simba 3.2是我们迄今最出色的模型,现已上线 Speechify.ai。我们围绕大规模语音代理打造它,并通过海量A/B测试持续优化。在TTS API领域,成本、质量和延迟决定一切。Simba 3.2如今在这三方面都做到了业界领先。欢迎大家体验!”
Weitzman提到的“三重突破”一直是AI语音领域公认的难题。过去,一项指标的提升往往要以牺牲另外两项为代价,大多数公司也只能偏向其中一端。三项同时做到行业领先,一直被认为极难实现。Artificial Analysis的独立排名证明了这条路走得通,也进一步确立了Simba 3.2作为顶尖语音团队代表模型的地位。
五年从斯坦福到行业顶尖
Simba模型家族最初由Speechify联合创始人兼AI负责人Tyler Weitzman在斯坦福大学读本科时发起。最早只是他在机器学习课程中对神经语音架构的一次尝试,经过五年持续演进,如今已成为支撑Speechify消费级和企业级产品的核心,也为Speechify跻身顶尖AI语音实验室打下了基础。
回顾这一里程碑,Tyler Weitzman在X平台发文称:“我在斯坦福读本科时,Ng老师的CS229点燃了我对机器学习的兴趣,当时的课程项目是微调Tacotron 2。五年后,我们团队的新模型做到了业界最优。现在回头看,真的很不可思议。”
Speechify首席商务官、也是Tyler Weitzman多年好友的Rohan Pavuluri在近期公告中表示,这一成绩是早期架构决策长期积累的结果。“如果只求快,我们也许能更早做到高质量。但我们的产品基因和商业模式决定了,我们从一开始就必须确保能以$139/年的价格,为用户提供近乎无限的语音。这也让我们能以行业顶级的低价,做出最强TTS,这在AI领域非常少见。”
消费级规模驱动企业级AI
Speechify之所以能以行业低价提供顶级AI语音,根源在于其消费级经济模型。平台在全球拥有超6000万用户,并于2025年在WWDC前荣获Apple设计奖,被视为当下最佳AI语音体验之一。这样的用户规模,加上$139年订价位,要求研究团队从一开始就把高效推理作为产品核心,而不是事后补优化。正是这种自我约束,才让No.1模型能以开发者看得见的低价登上榜单。
Speechify开发者关系负责人Luke Oliff在新闻稿中表示:“这就是一个API厂商逆袭的故事。过去几年,我们一直在让模型运行得更高效,因为消费端需求非常强,服务的是数千万听众,其中一些声音已是全球顶尖水准。所以今天,我们才能把顶级模型以超低价格开放给API用户。大多数实验室是为榜单做模型、按企业价格收费;我们是为听众做产品、按生产成本定价。”
可用性
Simba 3.2现已通过SpeechifyAI Build、Speechify文本转语音与语音克隆API上线,并为新发布的SpeechifyAI Agents生产级语音代理平台提供支持。两者均可在 speechify.ai获取,提供TypeScript和Python原生SDK、低首响延迟的流式支持、细腻的情感控制以及SSML韵律。平台还提供业内公认顶尖的语音克隆技术,开发者一次接入,即可使用全球领先的AI语音和高速语音克隆。更多语种和更低价位也在规划中。