تقدم Speechify مجموعة محدودة من نماذج تحويل النص إلى كلام. ويعتمد اختيار النموذج المناسب على الموازنة بين زمن الاستجابة، ودعم اللغات، وجودة الصوت. يوضح لك هذا الدليل حالات الاستخدام الأنسب لكل نموذج، لتختار المناسب من دون الحاجة إلى تجربة الجميع.
تتناول منشورات النماذج على speechify.ai كل إصدار بمزيد من التفصيل. كما يوضح إعلان Simba 3.2 سبب كونه النموذج الموصى به حالياً.
للمزيد حول بدء استخدام Speechify في تحويل النص إلى كلام، اطّلع على دليل البدء السريع.
هل تريد البناء بنفسك؟ واجهة برمجة التطبيقات لتحويل النص إلى كلام والاستنساخ الصوتي من Speechify متاحة عبر speechify.ai، مع التوثيق ومفتاح مجاني عبر docs.speechify.ai.
ما النماذج التي تقدمها Speechify؟
هناك ثلاث عائلات.
- Simba 3.2: النموذج الموصى به للغة الإنجليزية. يدعم البث المباشر، ويوفر أسرع زمن استجابة، مع مجموعة منتقاة من الأصوات الإنجليزية. استخدمه لأي تفاعل مباشر.
- Simba 3.0: الإعداد الافتراضي الحالي للواجهة. يدعم البث المباشر وتعدد اللغات: الإنجليزية، والألمانية، والإسبانية، والفرنسية، والإيطالية، والبرتغالية البرازيلية. زمن استجابته أعلى قليلاً من 3.2، لكنه يوفر تغطية لغوية أوسع.
- النماذج القديمة (simba-english، simba-multilingual): تستند إلى Simba 1.6. سيتوقف دعمها مع إصدار الواجهة بتاريخ 2026-09-21، وسيتم تعطيلها نهائياً في 2026-11-21. استخدمها فقط إذا كان التكامل الحالي يتطلب صوتاً أو لغة قديمة بعينها، وابدأ التخطيط للانتقال من الآن.
أي نموذج هو الأسرع؟
Simba 3.2. صُمم للبث المباشر، لذلك يصل أول جزء من الصوت بسرعة كبيرة. وإذا كنت تبني وكيلاً صوتياً باللغة الإنجليزية، فهو الخيار الأفضل.
Simba 3.0 قريب منه، لكن زمن الاستجابة فيه أعلى قليلاً بسبب دعمه لعدة لغات. أما النماذج القديمة فهي الأبطأ، ويُنصح بالانتقال منها متى أمكن.
أي نموذج يغطي أكبر عدد من اللغات؟
Simba 3.0. فهو يدعم رسمياً الإنجليزية، والألمانية، والإسبانية (إسبانيا والمكسيك)، والفرنسية، والإيطالية، والبرتغالية البرازيلية. يمكنك تمرير المعامل language مع POST /v1/audio/speech لاختيار اللغة، وسيعيد النظام صوتاً مناسباً لها. أما النموذج القديم simba-multilingual فيدعم أكثر من 30 لغة، لكنه سيتوقف مع إصدار 2026-09-21 وسيُعطّل في 2026-11-21.
إذا كان منتجك يعمل بلغة واحدة، فإن Simba 3.2 يتفوق في السرعة والجودة. أما إذا كان يدعم عدة لغات، فـSimba 3.0 هو الخيار الأوسع حالياً.
اطلع على المزيد حول دعم اللغات في توثيقاتنا.
أي نموذج يقدم أعلى جودة صوتية؟
ترتبط الجودة بجيل النموذج. يتفوق Simba 3.2 في طبيعية الصوت باللغة الإنجليزية، بينما يقدم Simba 3.0 أداءً قوياً عبر جميع اللغات التي يدعمها. أما النماذج القديمة فهي أقدم وتبدو أكثر اصطناعية في الصوت.
بالنسبة للأصوات الموجهة للعملاء، يُفضل استخدام Simba 3.2 أو Simba 3.0.
كيف أستعرض الأصوات المتاحة؟
استخدم GET /v1/voices. يمكنك التصفية حسب النوع، واللغة، والجنس، والنموذج لاختيار الصوت المناسب قبل التحويل. كما توضح منشورات الأصوات والنماذج على speechify.ai شكل الاستجابة.
بث مباشر أم معالجة دفعة واحدة؟
يدعم كلا نموذجي Simba 3 البث المباشر. استخدم POST /v1/audio/stream للتشغيل المباشر، وPOST /v1/audio/stream/with-timestamps للبث مع التوقيتات ومحاذاة الكلمات، وPOST /v1/audio/speech للحصول على ملف صوتي واحد. واختيار النموذج مستقل عن طريقة التسليم.
الأسئلة الشائعة
ما نموذج تحويل النص إلى كلام الموصى به في Speechify؟
Simba 3.2. فهو الخيار الافتراضي للمشاريع الجديدة: يدعم البث المباشر، ويوفر أسرع وصول لأول جزء من الصوت، ويقدم أعلى جودة للغة الإنجليزية.
Simba 3.2 هو الخيار الأفضل للغة الإنجليزية: يدعم البث المباشر، وهو الأسرع استجابة، ويقدم أعلى جودة صوتية لها. وبما أن الإعداد الافتراضي للواجهة عند عدم تحديد model هو Simba 3.0، فاحرص على تعيين model: "simba-3.2" يدوياً إذا كنت تريد استخدامه.
نعم. يدعم Simba 3.0 معامل اللغة ويقدم أصواتاً محلية عبر عدة لغات. أما Simba 3.2 فيركز على مجموعة منتقاة من الأصوات الإنجليزية.
نعم. يدعم Simba 3.0 تحديد اللغة ويقدم أصواتاً محلية للإنجليزية وست لغات أوروبية. أما Simba 3.2 فيركز على مجموعة منتقاة من الأصوات الإنجليزية.
فقط إذا كان التكامل الحالي يتطلب صوتاً قديماً بعينه. بخلاف ذلك، انتقل إلى Simba 3.2 أو Simba 3.0.
فقط إذا كان التكامل الحالي يتطلب صوتاً قديماً بعينه. ستتوقف هذه النماذج مع إصدار 2026-09-21، وسيتم تعطيلها نهائياً في 2026-11-21، لذا انتقل إلى Simba 3.2 أو Simba 3.0 قبل ذلك.
اختر Simba 3.2 إذا كنت تريد أسرع استجابة، واستخدم البث المباشر للتطبيقات الحية.

