הפניית API של המרת דיבור לטקסט (STT) RPC
קל לארגן דפים בעזרת אוספים
אפשר לשמור ולסווג תוכן על סמך ההעדפות שלך.
זוהי הפניית gRPC API ל-Speech-to-Text. זהו אחד מממשקי ה-API של Vertex AI שעברו אימון מראש וזמינים ב-Google Distributed Cloud במודל Air-gapped (GDC).
במדריך הזה מוסבר איך לשלב באופן פרוגרמטי טכנולוגיות לזיהוי דיבור באפליקציות של מפתחים. שליחת אודיו וקבלת תמלול טקסט משירות Vertex AI Speech-to-Text API. לדוגמה, אם שולחים אודיו בספרדית, התוצאה היא תמליל טקסט תואם בספרדית.
שיטות להמרת דיבור לטקסט
יש שתי שיטות ב-GDC:
Recognize: מבצע זיהוי דיבור סינכרוני. Recognize מקבל תוצאות אחרי שכל האודיו נשלח ועבר עיבוד.
StreamingRecognize: מבצע זיהוי דיבור דו-כיווני בסטרימינג. StreamingRecognize מקבל תוצאות בזמן שליחת אודיו.
[[["התוכן קל להבנה","easyToUnderstand","thumb-up"],["התוכן עזר לי לפתור בעיה","solvedMyProblem","thumb-up"],["סיבה אחרת","otherUp","thumb-up"]],[["התוכן קשה להבנה","hardToUnderstand","thumb-down"],["שגיאות בקוד לדוגמה או במידע","incorrectInformationOrSampleCode","thumb-down"],["חסרים לי פרטים או דוגמאות","missingTheInformationSamplesINeed","thumb-down"],["בעיה בתרגום","translationIssue","thumb-down"],["סיבה אחרת","otherDown","thumb-down"]],["עדכון אחרון: 2026-07-12 (שעון UTC)."],[],[]]