تقدّم Speechify مجموعة محدودة من نماذج تحويل النص إلى كلام. ويتطلب اختيار النموذج المناسب الموازنة بين زمن الاستجابة، وتغطية اللغات، وجودة الصوت. يوضح هذا الدليل النموذج الأنسب لكل نوع من الأعمال، حتى تختار بثقة من دون الحاجة إلى تجربة كل الخيارات.
تشرح منشورات speechify.ai كل إصدار بالتفصيل. كما يوضح إعلان Simba 3.2 سبب كونه النموذج الموصى به حالياً.
لمعرفة المزيد حول بدء استخدام Speechify API لتحويل النص إلى كلام، راجع دليل البدء السريع.
ما النماذج التي توفّرها Speechify؟
ثلاث مجموعات.
- Simba 3.2: النموذج الموصى به للغة الإنجليزية. يدعم البث، وهو الأسرع في بدء تشغيل الصوت، ويقدّم أصواتاً إنجليزية مختارة بعناية. استخدمه لأي تطبيق تفاعلي.
- Simba 3.0: النموذج الافتراضي الحالي في الـ API. يدعم البث بعدة لغات: الإنجليزية، والألمانية، والإسبانية، والفرنسية، والإيطالية، والبرتغالية البرازيلية. زمن استجابته أعلى قليلاً من 3.2، لكنه يوفّر تغطية أوسع.
- النماذج القديمة (simba-english، simba-multilingual): تنتمي إلى مجموعة Simba 1.6. ستتوقف عن العمل في إصدار API بتاريخ 2026-09-21، وسيتوقف دعمها نهائياً في 2026-11-21. استخدمها فقط إذا كان تكاملك الحالي يعتمد على صوت أو لغة قديمة محددة، وابدأ التخطيط للانتقال من الآن.
أي نموذج هو الأسرع؟
Simba 3.2. صُمم للبث المباشر، لذا يصل أول جزء من الصوت بأسرع وقت ممكن. وللتطبيقات الصوتية باللغة الإنجليزية، فهو الخيار الافتراضي الأنسب.
Simba 3.0 قريب منه في الأداء، لكن ذلك يأتي على حساب دعم تعدد اللغات. أما النماذج القديمة فأبطأ، ويُفضّل الاستغناء عنها متى أمكن.
أي نموذج يدعم أكبر عدد من اللغات؟
Simba 3.0. يدعم رسمياً الإنجليزية، والألمانية، والإسبانية (إسبانيا والمكسيك)، والفرنسية، والإيطالية، والبرتغالية البرازيلية. مرّر المعامل language في POST /v1/audio/speech لاختيار اللغة، وسيُرجع صوتاً مخصصاً لها. أما النموذج القديم simba-multilingual فيدعم أكثر من 30 لغة، لكنه سيتوقف نهائياً في 2026-11-21.
إذا كان منتجك يعمل بلغة واحدة، فإن Simba 3.2 يتفوّق من حيث السرعة والجودة. أما إذا كان متعدد اللغات، فإن Simba 3.0 يوفّر أفضل تغطية حالياً.
تعرّف على المزيد حول دعم اللغات في مستنداتنا.
أي نموذج يقدّم أفضل جودة صوت؟
ترتبط جودة الصوت بجيل النموذج. يتفوّق Simba 3.2 في طبيعية الصوت باللغة الإنجليزية. أما Simba 3.0 فيقدّم أداءً جيداً في اللغات التي يدعمها. وتبقى النماذج القديمة أقل جودة وأكثر اصطناعية.
وبالنسبة إلى الأصوات الموجّهة للعملاء، يُفضّل استخدام Simba 3.2 أو Simba 3.0.
كيف أستعرض الأصوات المتاحة؟
استخدم GET /v1/voices. يمكنك التصفية حسب النوع، أو اللغة، أو الجنس، أو النموذج لاختيار الصوت المناسب قبل التحويل. كما توضّح منشورات speechify.ai شكل الاستجابة.
البث المباشر أم المعالجة الدفعية؟
يدعم كل من نموذجي Simba 3 البث المباشر. استخدم POST /v1/audio/stream للتشغيل الفوري، وPOST /v1/audio/stream/with-timestamps للصوت مع التوقيتات ومحاذاة الكلمات، وPOST /v1/audio/speech للحصول على ملف صوتي واحد. واختيار النموذج مستقل عن طريقة التسليم.
الأسئلة الشائعة
ما نموذج تحويل النص إلى كلام الذي توصي به Speechify؟
Simba 3.2. فهو الخيار الموصى به للمشروعات الجديدة: يدعم البث، ويوفّر أسرع وقت للوصول إلى أول جزء صوتي، ويقدّم أفضل جودة للإنجليزية.
Simba 3.2 هو الخيار الأفضل للإنجليزية: يدعم البث، ويوفّر أسرع وصول إلى أول جزء صوتي، ويقدّم أعلى جودة لهذه اللغة. أما النموذج الافتراضي في API عند عدم تحديد model فهو Simba 3.0، لذا حدّد model: "simba-3.2" صراحةً إذا أردت استخدامه.
نعم، يدعم Simba 3.0 تحديد اللغة ويقدّم أصواتاً أصلية لعدة لغات. أما Simba 3.2 فيركّز على الإنجليزية فقط.
نعم، يدعم Simba 3.0 تحديد اللغة ويقدّم أصواتاً أصلية بالإنجليزية وست لغات أوروبية. أما Simba 3.2 فيركّز على الإنجليزية فقط.
فقط إذا كان تكاملك الحالي يعتمد على صوت قديم محدد. بخلاف ذلك، انتقل إلى Simba 3.2 أو Simba 3.0.
فقط إذا كان تكاملك الحالي يعتمد على صوت قديم محدد. ستتوقف هذه النماذج في إصدار API بتاريخ 2026-09-21، وسيتوقف دعمها نهائياً في 2026-11-21، لذا انتقل إلى Simba 3.2 أو Simba 3.0 قبل ذلك.
اختر Simba 3.2 إذا كنت تبحث عن أقل زمن استجابة وأفضل أداء. وللتشغيل الفوري، استخدم البث المباشر.

