במדריך הזה מפורטות הגדרות מתקדמות נוספות לתכונות של דיבור. כדי להפעיל או להשבית את ההגדרות המתקדמות האלה, עוברים אל הגדרות הסוכן > דיבור ותגובה קולית אינטראקטיבית > המרת דיבור לטקסט > הגדרות מתקדמות של דיבור.
ההגדרות האלה זמינות בהגדרות הסוכן (חלות על הסוכן כולו), בהגדרות התהליך (חלות על התהליך כולו ומבטלות את הגדרות הסוכן), בהגדרות הדף (חלות על הדף ומבטלות את הגדרות התהליך והסוכן) ובהגדרות ההשלמה (חלות על ההשלמה ומבטלות את הגדרות הדף, התהליך והסוכן). קבוצת משנה של ההגדרות האלה זמינה בכל רמה, בהתאם לרלוונטיות של ההגדרה לרמה. *כדי להגדיר את ההגדרות האלה ברמה נמוכה יותר, צריך קודם לסמן את התיבה הפעלת הגדרות מתקדמות של דיבור ברמת הסוכן (הגדרות הסוכן > דיבור ו-IVR > המרת דיבור לטקסט > הגדרות מתקדמות של דיבור)*.
ההגדרות המעודכנות ברמת הסוכן לא מועברות לרמת התהליך, הדף וההשלמה אם האפשרות התאמה אישית נבחרה ברמות הנמוכות האלה. אם האפשרות התאמה אישית כוללת כמה הגדרות ואתם רוצים לעדכן רק חלק מהן, יכול להיות שתצטרכו לעדכן גם הגדרות אחרות כדי שהן יהיו זהות להגדרות ברמת הסוכן.
הגדרת הזמינות לפי רמה
בטבלה הבאה אפשר לראות אילו הגדרות מתקדמות של דיבור זמינות בכל רמה:
| שם ההגדרה | סוכן | Flow | דף | טיפול בהזמנות |
|---|---|---|---|---|
| בחירת מודל (המרת דיבור לטקסט) | ✔ | ✔ | ✔ | |
| רגישות לסיום הדיבור | ✔ | ✔ | ✔ | |
| רגישות מתקדמת לסיום הדיבור על סמך פסק זמן | ✔ | ✔ | ✔ | |
| הפעלת קביעת נקודות סיום חכמה | ✔ | |||
| אין זמן קצוב לתפוגה לדיבור | ✔ | ✔ | ✔ | |
| התפרצות לשיחה | ✔ | ✔ | ✔ | |
| אפשר לבטל את ההפעלה של חלק מהתשובה | ✔ | |||
| באקט לייצוא אודיו | ✔ | ✔ | ||
| DTMF | ✔ | ✔ | ✔ |
בחירת מודל (המרת דיבור לטקסט)
אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך והדף.
הגדרת מודל הדיבור שמשמש לזיהוי דיבור. ההגדרה הזו היא ספציפית לשפה, כך שאפשר לבחור מודלים שונים לשפות שונות. אפשר גם לסמן את התיבה Override request-level speech model (החלפת מודל דיבור ברמת הבקשה). אם תסמנו אותה, המודל שנבחר ישמש גם אם קריאה ל-API בזמן הריצה תציין מודל אחר.
במאמר בנושא Dialogflow CX Phone Gateway מפורטות מגבלות. מידע נוסף זמין במאמר בנושא מודלים של דיבור.
רגישות לסיום הדיבור
אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך והדף.
קובעת את הרגישות לזיהוי סוף הדיבור בקלט אודיו של משתמש הקצה. הערך נע בין 0 (רגישות נמוכה, פחות סיכוי לסיום הדיבור) לבין 100 (רגישות גבוהה, יותר סיכוי לסיום הדיבור).
רגישות מתקדמת לסיום הדיבור על סמך פסק זמן
אפשר להגדיר את ההגדרה הזו ברמת הסוכן ולהשבית אותה ברמת התהליך וברמת הדף.
אם ההגדרה הזו מופעלת, הערך של ההגדרה רגישות לסיום הדיבור משמש כמדד לקביעת פסק זמן יחסי של שקט באודיו, כדי לקבוע את סיום הדיבור. אם ההגדרה הזו מושבתת (ברירת המחדל), הערך של ההגדרה רגישות לסיום הדיבור משמש לקביעת סיום הדיבור על ידי מודל ה-ML שסופק על ידי Google Cloud Speech-to-Text.
ההגדרה End of speech sensitivity (רגישות לסיום הדיבור) תומכת כברירת מחדל רק במודל הדיבור של תג en-US השפה phone_call. ההגדרה Enable advanced timeout-based end of speech sensitivity (הפעלת רגישות מתקדמת לסיום הדיבור על סמך זמן קצוב לתפוגה) מאפשרת להגדיר רגישות לסיום הדיבור לכל השפות ולכל מודלי הדיבור שנתמכים על ידי Dialogflow.
הפעלת קביעת נקודות סיום חכמה
אפשר להגדיר את ההגדרה הזו רק ברמת הסוכן.
אם ההגדרה הזו מופעלת, מערכת Dialogflow CX תנתח קלט של משתמשים חלקי כדי לקבוע את סוף הדיבור. לדוגמה, אם המשתמש אומר "I would like to" (אני רוצה) ועוצר, Dialogflow CX ימתין שהמשתמש ימשיך את המשפט.
האפשרות הזו שימושית במיוחד לאיסוף פרמטרים מספריים, למשל אם המשתמש אומר "1234" ועוצר לפני שהוא אומר "5678". כדי להחיל את ההגדרה הזו על פרמטר ספציפי, צריך להגדיר ניתוב חכם לנקודות קצה בטופס של הפרמטר.
ההגדרה הזו זמינה רק לתג השפה en-US ומושבתת כברירת מחדל.
אין זמן קצוב לתפוגה לדיבור
אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך והדף.
משך הזמן בשניות שבו מערכת Dialogflow CX תמתין לקלט אודיו של משתמש קצה. ברירת המחדל היא 5 שניות, והערך המקסימלי הוא 60 שניות. במקרה של פסק זמן כזה, מערכת Dialogflow CX מפעילה אירוע ללא קלט.
התפרצות לשיחה
אפשר להגדיר את ההגדרה הזו ברמת הסוכן, התהליך וההשלמה.
כשהאפשרות הזו מופעלת, משתמשי קצה יכולים להפסיק את האודיו של התשובה ב-Dialogflow CX. אם יש הפרעה, מערכת Dialogflow CX תפסיק לשלוח אודיו ותעבד את הקלט הבא של משתמש הקצה.
אם יש כמה הודעות בתור ההודעות, והודעה מסוימת הוכנסה לתור על ידי מילוי משויך לדף, לתהליך או לסוכן שהאפשרות 'הצטרפות לשיחה' מופעלת בהם, אז גם האפשרות הזו תופעל בכל ההודעות הבאות בתור. במקרה כזה, השילוב יפסיק להשמיע אודיו לכל ההודעות בתור עם האפשרות 'התפרצות לשיחה' מופעלת.
אפשר לבטל את ההפעלה של חלק מהתשובה
אפשר להגדיר את המאפיין הזה רק ברמת המימוש.
אפשר להפעיל את ההגדרה הזו אם תיבת הסימון הפעלת הגדרות מתקדמות של דיבור מסומנת בהגדרות הסוכן > דיבור ו-IVR ומילוי חלקי מופעלת ברמת מילוי הבקשה. ההגדרה הזו מאפשרת לבטל את ההפעלה של תגובה חלקית.
אם הודעה בתור ההודעות נוצרה על ידי מילוי בקשה שמאפשר ביטול, ההפעלה של ההודעה תבוטל אם תתווסף לתור הודעה אחרת. האפשרות הזו שימושית כשרוצים שהודעה ראשונית תתחיל את ההפעלה, אבל שההפעלה הזו תבוטל אם webhook פעיל יפיק הודעה אחרת לפני שההפעלה של ההודעה הראשונית תסתיים.
באקט לייצוא אודיו
אפשר להגדיר את ההגדרה הזו ברמת הסוכן וברמת התהליך.
אם מסופקים נתונים, כל נתוני האודיו שמשויכים לבקשה יישמרו בקטגוריה של Cloud Storage:
| האודיו נשמר | בקשות רלוונטיות |
|---|---|
| קלט אודיו של משתמשי קצה | DetectIntent, StreamingDetectIntent, AnalyzeContent, StreamingAnalyzeContent |
| אודיו מסונתז של המרת טקסט לדיבור (TTS) לתשובה | AnalyzeContent, StreamingAnalyzeContent |
מקצים את התפקיד יצירת אובייקטים באחסון לחשבונות השירות הבאים בפרויקט:
לחשבון השירות בפורמט
one-click@df-cx-ALPHANUMERIC_VALUE-ALPHANUMERIC_VALUE.iam.gserviceaccount.comאם משתמשים בשילוב טלפוני מובנה של שותף.לחשבון השירות בפורמט
service-PROJECT_NUMBER@gcp-sa-dialogflow.iam.gserviceaccount.comאם משתמשים בשילוב Dialogflow CX Phone Gateway. כדי למצוא את חשבון השירות הזה ב-IAM, מסמנים את האפשרות Include Google-provided role grants.
DTMF
מידע נוסף על התכונה הזו מופיע במסמכי התיעוד בנושא DTMF (איתות רב-תדר כפול).