במקרה הצורך, אפשר לבקש להגדיל את המכסה. מידע נוסף על הצגה וניהול של המכסות זמין Google Cloud בדף המכסות.
אחרי שתשלחו את הבקשה, יכול להיות ש-Google תיצור איתכם קשר כדי לקבל מידע נוסף, ותודיע לכם אם הבקשה אושרה או נדחתה.
הגבלות תוכן
בקשות סינכרוניות
בקשות סינכרוניות לזיהוי (באמצעות השיטה Recognize) מקבלות נתוני אודיו מוטבעים בשדה content של הבקשה או כ-
URI של Cloud Storage בשדה uri של הבקשה. האודיו שנשלח לבקשה סינכרונית מוגבל ל-10MB או לדקה אחת של משך האודיו (המוגבלות חלות לפי מה שקורה קודם). מידע נוסף על זיהוי סינכרוני מופיע בסקירה הכללית על זיהוי סינכרוני.
בקשות לסטרימינג
בקשות לזיהוי סטרימינג (באמצעות השיטה StreamingRecognize) מקבלות רק אודיו מוטבע בשדה audio של הבקשה. כל בקשה בסטרימינג מוגבלת ל-25KB של אודיו. הסטרימינג יכול להישאר פתוח למשך 5 דקות לכל היותר, והאודיו צריך להישלח בקצב שקרוב לזמן אמת. אם אתם צריכים להזרים תוכן למשך יותר מ-5 דקות, כדאי לעיין במדריך להזרמת תוכן ללא הפסקה. מידע נוסף על זיהוי בסטרימינג זמין בסקירה הכללית על זיהוי בסטרימינג.
בקשות באצווה
בקשות לזיהוי קבוצתי (באמצעות השיטה BatchRecognize) מקבלות רק אודיו כ- Cloud Storage URI בשדה uri של הבקשה. כל BatchRecognizeRequest יכול להכיל עד 5 files לתמלול (השיטה המומלצת היא להשתמש בקובץ אחד לכל בקשה, כדי שאפשר יהיה לבצע סקר של מזהה פעולה נפרד לכל קובץ). בעבר, המגבלה הייתה 15 קבצים לכל בקשה, ובעתיד היא תצומצם לקובץ אחד לכל בקשה.
כל קובץ יכול להיות באורך של עד 8 שעות. מידע נוסף על זיהוי אסינכרוני זמין במאמר סקירה כללית על זיהוי באצווה.
זיהוי של כמה שפות
זיהוי של כמה שפות זמין רק בנקודות הקצה הגלובליות של Cloud Speech-to-Text בארה"ב ובאיחוד האירופי.
עיבוד
בכל בקשה אפשר גם לספק משאבי PhraseSet וCustomClass. המגבלות הבאות חלות על המשאבים האלה:
| מגבלת התאמה של דיבור | ערך |
|---|---|
| הערך המקסימלי המותר של הגברת הביטוי | 20 |
| ביטויים ב-PhraseSet | 1,200 |
| ביטויים לכל בקשה | 5,000 |
| תווים לכל ביטוי | 100 |
| מספר התווים הכולל לכל בקשה | 100,000 |
| מספר הפריטים המקסימלי ב-CustomClass | 500 |
| מספר התווים המקסימלי לכל פריט CustomClass | 500 |
| מספר מקסימלי של PhraseSets לכל SpeechAdaptation | 20 |
| מספר מקסימלי של CustomClasses לכל SpeechAdaptation | 20 |
מגבלות על משאבים
אלה המגבלות הנוכחיות על משאבי API ב-Cloud Speech-to-Text (המגבלות האלה עשויות להשתנות):
| סוג המגבלה | מכסת שימוש |
|---|---|
| מספר המזהים (לכל אזור) | 5,000 |
| מספר הכיתות המותאמות אישית (לכל אזור) | 5,000 |
| מספר קבוצות הביטויים (לכל אזור) | 5,000 |
מגבלות על בקשות
אלה מגבלות השימוש הנוכחיות ב-Cloud Speech-to-Text API (המגבלות עשויות להשתנות):
| סוג המגבלה | מכסת שימוש |
|---|---|
| בקשות למשאבים כל 60 שניות (לכל אזור) | 100 |
| בקשות לפעולות לכל 60 שניות (לכל אזור) | 150 |
| בקשות סנכרוניות לזיהוי כל 60 שניות (לכל אזור) | 300 |
| בקשות לזיהוי בסטרימינג כל 60 שניות (לכל אזור) * | 1,000,000 |
| מספר הסשנים המקסימלי של StreamingRecognize בו-זמנית (לכל אזור) * | 300 |
| בקשות לזיהוי קבוצתי לכל 60 שניות (לכל אזור) | 150 |
* לזיהוי בסטרימינג יש מכסה של 300 סשנים בו-זמניים לכל 5 דקות ומגבלה של 3,000 בקשות לדקה, שחלה על כל הסשנים בו-זמנית. בקשת ההגדרה הראשונית של סשן לא נספרת במכסת הבקשות.
המגבלות האלה חלות על כל פרויקט פיתוח של Cloud Speech-to-Text, והן משותפות לכל האפליקציות וכתובות ה-IP שמשתמשות בפרויקט פיתוח נתון.