Skip to main content
  1. דף הבית
  2. API
  3. איך ממשק ה-API של Speechify לטקסט לדיבור תומך ב-13 רגשות
עודכן בתאריך API

איך ממשק ה-API של Speechify לטקסט לדיבור תומך ב-13 רגשות

קליף ויצמן

מנכ"ל ומייסד Speechify

Speechify API מספק השהיה של 300ms, קולות באיכות אנושית ויותר מ-50 שפות

Apple Design Award 2025
מעל 50 מיליון משתמשים

למה רגש נמצא בחזית סינתזת הדיבור

בונים את זה בעצמכם? ממשק ה-API של Speechify לסינתזת דיבור ולשכפול קולות זמין ב-speechify.ai, עם תיעוד ומפתח חינמי ב-docs.speechify.ai.

טכנולוגיית TTS מודרנית פתרה את סוגיית המובנות כבר לפני שנים. Blizzard Challenge, מדד שנתי שעוקב אחר ההתקדמות בסינתזת דיבור מאז 2005, דיווח שב-2021 כבר היה קשה להבחין בין דיבור סינתטי לדיבור טבעי מבחינת מובנות, וגם ברמת הטבעיות (Perrotin ואחרים, 2024). לכן התחום התקדם. השאלה המעניינת כבר אינה האם אפשר להבין את הקול אלא האם הקול נשמע כאילו הוא באמת מתכוון למה שהוא אומר. כיום Speechify מציעה לא רק טקסט לדיבור, אלא גם טקסט לדיבור עם רגש.

Speechify מציעה טקסט לדיבור עם רגש

מגוון הרגשות של Speechify כולל כעס, שמחה, עצב, פחד, רוגע, חשש, הפתעה, שלווה, אסרטיביות, אנרגטיות, חמימות, ישירות ובהירות. הרשימה נבחרה כדי לכסות את טווח הטונים שמקריין, שחקן או מציג אמיתי עוברים בו לאורך פרויקט אחד. לדוגמה, סרטון מוצר יכול להתחיל בטון בהיר, לעבור לטון שליו ולהסתיים בטון חמים. דמות במשחק יכולה לעבור מאסרטיביות לפחד תוך שתי שורות בלבד.

שימוש ברגשות ב-AI Voice Generator של Speechify

מחולל הקול מבוסס ה-AI פועל בתוך Speechify Studio והוא הכלי של יוצרי תוכן לקריינות, סרטוני שיווק, ספרי שמע וקטעי פודקאסט. פשוט מדביקים את התסריט, בוחרים קול ואז מחילים סגנון רגשי על כל הקטע או על חלק מסוים. מכיוון שרגשות ניתנים להגדרה לכל בחירה, אפשר לשלב באותו אודיו פתיחה שמחה, הצעת ערך אסרטיבית ובסיום קול חמים – בלי להחליף קריין.

הנה כמה דוגמאות למצבים שבהם זה באמת משנה:

סרטוני שיווק שנערכים בכלי כמו CapCut דורשים לרוב שתיים או שלוש נקודות טון שונות: משיכת תשומת לב, הבטחה וקריאה לפעולה. במקום שלושה קריינים, אפשר להפיק קריינות אחת שמחליפה רגש בין השורות. ספרי שמע וסיפורת מרוויחים מזה אפילו יותר, כי דיאלוג בין דמויות יכול לשאת רגשות שונים בלי צורך בכמה מדבבים. בחומרי הסבר, קריינות שלווה אחת על רקע עמוס נשמעת ברורה יותר מניסיון לשמור על עניין באותו טון לאורך כל ההקלטה.

שימוש ברגשות ב-API של Speechify

למפתחים, אותם 13 רגשות זמינים ב-Speechify API דרך תגית SSML <speechify:style>. עוטפים את הטקסט הרצוי, מציינים את שם הרגש, וה-API מחזיר אודיו שמכיל את הרגש רק בקטע הזה. כך עוזרי קול וירטואליים יכולים להישמע אסרטיביים בעת אישור תשלום וחמים כשמקבלים בחזרה משתמש חוזר – בלי להחליף קול באמצע החוויה.

פלטפורמות למידה דיגיטלית מסמנות משוב על מבחנים באותו אופן: שמח לתשובה נכונה, ישיר בתיקון ושליו ברמז. מנועי סיפורת אינטראקטיבית מעבירים דיאלוגים דרך ה-API עם תגי רגש לכל שורה, כך שקול משוכפל אחד יכול לכסות מגוון דמויות.

Speechify AI Voice Generator לעומת Speechify API – במה לבחור

מקרה שימוש

מחולל קול מבוסס AI (Studio)

API

קריינות, שיווק, ספרי שמע

כן, עם עורך חזותי ורגשות לכל בחירה

אפשרי, אך לרוב מיותר

קול במוצר לאפליקציות, עוזרים דיגיטליים, e-learning

פחות מתאים

כן, עם תגי SSML <speechify:style>

פורמט

ממשק ווב

REST API

הכי מתאים כש

אתם מפיקים קובץ אודיו מוגמר

אתם יוצרים אודיו דינמי ישירות בתוך המוצר שלכם

איפה קולות רגשיים באמת מרחיבים את מה שאפשר ליצור

TTS רגשי הוא החלק שהיה חסר ליוצרים: קול ידוען אחד לספר שלם, דמות מונפשת שמביאה גם הומור וגם עצב, או פתיח לפודקאסט שפוגע בדיוק בטון הנכון. כשלא היה רגש מובנה, זה פשוט לא עבד. עכשיו, כשהרגש חי בתוך הקול ולא רק בתסריט, זה כן עובד. למי שכבר משתמש בקולות מפורסמים ובדמויות ב-Speechify, סגנונות רגש הם ההבדל בין קול שרק מקריא לבין קול שבאמת מבצע.

האם הגשה רגשית באמת משפרת הבנה?

כן, וזה נמדד גם מחוץ לעולם הבינה המלאכותית. במחקר מ-2022 על תלמידים בני 11–13 ובשחזור מ-2025, החוקרים דילמן ושאמפו-לארסון מצאו שמאזינים ענו נכון יותר על שאלות אחרי שהאזינו לאותו תוכן כשהוא מוקרא עם פרוזודיה רגשית חיובית, לעומת קריאה ניטרלית (Dylman ואחרים, 2025). השיפור בהבנה לא היה שולי, והוא נשמר גם בטווח המיידי וגם לאחר זמן. לתוכן לימודי, מדריכי מוצר וכל אודיו ארוך שבו שימור מידע חשוב – קול רגשי הוא באמת כלי עזר להבנה.

שאלות ותשובות

מה זה טקסט לדיבור עם רגשות?

זה דיבור סינתטי שמעביר רגש נבחר, למשל שמחה או עצב, על גבי הטקסט, כך שאפשר להשמיע את אותה שורה בכמה סגנונות. ב-Speechify אפשר לבחור רגש לכל קטע שתרצו.

כמה רגשות נתמכים ב-Speechify?

שלושה עשר: כועס, שמח, עצוב, מפוחד, רגוע, חושש, מופתע, שליו, אסרטיבי, נמרץ, חמים, ישיר ובהיר – זמינים גם במחולל הקול של Speechify וגם ב-API.

היכן שולטים ברגש במחולל הקול?

בתוך Speechify Studio, אחרי שמזינים את התסריט, יופיע בורר רגשות ליד בחירת הקול. אפשר להחיל אותו על כל הקטע או רק על חלק מסומן, ואז ליצור מחדש.

איך משתמשים ברגשות ב-API?

עוטפים את הטקסט בתגית SSML <speechify:style> ומציינים את שם הרגש כתכונה. ה-API יחזיר שמע עם הרגש הזה רק לקטע המתויג.

האם אפשר לשלב רגשות בקריינות אחת?

כן. רגשות מוחלים על כל קטע ב-Speechify Studio ועל כל טווח SSML ב-API, כך שאותו קטע אודיו יכול לעבור בין טונים בלי צורך להחליף קול.

האם קולות רגשיים נשמעים טבעיים כמו קולות ניטרליים?

כמעט לחלוטין. מודלים של TTS רגשי מקבלים דירוגי הבעה של 3.94/5.0 וטבעיות של 3.98/5.0 – כלומר המאזינים מדרגים אותם כמעט באותה רמה.

האם קריינות רגשית באמת משפרת זכירת תוכן?

מחקרים על דיבור אנושי מצביעים שכן. פרוזודיה חיובית שיפרה זכירה של עובדות בניסויים מבוקרים. אותו עיקרון פועל גם בקריינות AI מונחית.

האם אפשר להשתמש בקולות רגשיים לקריינות מסחרית?

רישוי Speechify כולל שימוש מסחרי בקריינות, כולל סגנונות רגשיים. בדקו את מגבלת האורך בתוכנית שלכם.

האם רגש עובד גם בקולות משוכפלים או בדמויות מפורסמות?

כן. סגנונות רגש מוחלים על בסיס הקול הראשי ב-Speechify, כך שקול משוכפל יכול להעביר את כל 13 הרגשות בלי להקליט כל גרסה בנפרד.

איך זה שונה מהאצת קצב או משינוי גובה הצליל?

רגשות משנים את הפרוזודיה כולה: עצירות, הדגשה, אינטונציה ואנרגיה. לכן קול "כועס" לא נשמע פשוט כמו גרסה מהירה יותר או גבוהה יותר של הקול הניטרלי.


גשו לקולות האהובים של Speechify דרך API מהיר, גמיש וידידותי למפתחים

קבלו גישה ל-API

שתפו את המאמר הזה

קליף ויצמן

מנכ"ל ומייסד Speechify

קליף ויצמן הוא פעיל למען דיסלקסיה, מנכ"ל ומייסד Speechify, אפליקציית טקסט־לדיבור המובילה בעולם, עם למעלה מ-100,000 דירוגי חמישה כוכבים ודירוג ראשון ב-App Store בקטגוריית חדשות ומגזינים. ב-2017 נבחר לרשימת פורבס "30 מתחת ל-30" בזכות קידום הנגישות לאנשים עם לקויות למידה. הופיע ב-EdSurge, Inc., PC Mag, Entrepreneur, Mashable ועוד.

Speechify logo

אודות Speechify

הקורא הטוב בעולם לטקסט לדיבור

Speechify היא הפלטפורמה המובילה בעולם לטקסט לדיבור, שנשענת על למעלה מ-50 מיליון משתמשים ומגובה ביותר מ-500,000 ביקורות חמישה כוכבים על מוצרי הטקסט לדיבור שלה ל-iOS, Android, הרחבת כרום, אפליקציית ווב ואפליקציית דסקטופ למק. ב-2025, אפל העניקה ל-Speechify את פרס ה-Apple Design Award היוקרתי ב-WWDC, ותיארה אותה כ"משאב חיוני שעוזר לאנשים לחיות את חייהם." Speechify מציעה יותר מ-1,000 קולות טבעיים ביותר מ-60 שפות, ונמצאת בשימוש כמעט ב-200 מדינות. בין קולות הסלבריטאים ניתן למצוא את Snoop Dogg ו-Gwyneth Paltrow. ליוצרים ולעסקים, Speechify Studio מספקת כלים מתקדמים, כולל מחולל קולות AI, שיבוטי קול AI, דיבוב AI וגם מחליף קולות AI. Speechify גם מספקת יכולות טקסט לדיבור מתקדמות, איכותיות ומשתלמות למוצרים מובילים באמצעות ה-API לטקסט לדיבור שלה. הופיעה ב-The Wall Street Journal, CNBC, Forbes, TechCrunch וגופי חדשות נוספים, Speechify היא ספקית טקסט לדיבור הגדולה בעולם. בקרו ב-speechify.com/news, speechify.com/blog ו-speechify.com/press למידע נוסף.