Gemini Enterprise מציע API שמאפשר ליצור פודקאסטים על סמך מסמכי מקור. הפלט דומה מאוד לפודקאסטים שמשתמשי קצה יכולים ליצור מתוך המחברות שלהם.
יצירת פודקאסטים באמצעות ה-API מתאימה במיוחד לעבודות אצווה שבהן יש עשרות או מאות ספרים, מאמרים או קורסים, ואתם רוצים ליצור פודקאסט לכל אחד מהם.
Podcast API הוא API עצמאי. כלומר, לא צריך מחברת Gemini Notebook Enterprise, רישיון ל-Gemini Enterprise או מאגר נתונים. כל מה שצריך זה פרויקט עם Google Cloud מופעל ותפקיד המשתמש ב-Podcast API.
קלט
הקלט ל-API הוא מערך של רכיבי context. זהו חומר המקור שממנו נוצר הפודקאסט. הקלט יכול להיות טקסט, תמונות, אודיו או וידאו. המספר הכולל של הטוקנים במערך ההקשר חייב להיות קטן מ-100,000.
רשימה של סוגי הקבצים הנתמכים מופיעה במפרטים הטכניים של תמונות, מסמכים, סרטונים ואודיו בדף הזה בנושא Gemini 2.5 Flash.
תשובה
הפלט של ה-API הוא הפודקאסט, בפורמט MP3.
לפני שמתחילים
כדי ליצור פודקאסט באמצעות ה-API, צריך לוודא שיש לכם את הדברים הבאים:
Google Cloud פרויקט שמופעל בו Discovery Engine API. איך יוצרים פרויקט ומפעילים את ה-API
תפקיד ניהול זהויות והרשאות גישה (IAM) של משתמש Podcast API (
roles/discoveryengine.podcastApiUser). מידע כללי על הענקת תפקידים זמין במאמר הגדרת Gemini Notebook Enterprise.
יצירת פודקאסט על סמך קלט של הקשר
כדי ליצור פודקאסט באמצעות קריאה לשיטה podcast, משתמשים בפקודה הבאה.
הקלט הוא מערך של אובייקטים של מולטימדיה, כמו טקסט, תמונות, קטעי אודיו וסרטונים.
REST
כדי ליצור ולייצא פודקאסט:
מריצים את פקודת ה-curl הבאה:
curl -X POST \ -H "Authorization: Bearer $(gcloud auth print-access-token)" \ -H "Content-Type: application/json" \ "https://discoveryengine.googleapis.com/v1/projects/PROJECT_ID/locations/global/podcasts" \ -d '{ "podcastConfig": { "focus": "FOCUS", "length": "LENGTH", "languageCode": "LANGUAGE_CODE" }, "contexts": [ { "text": "TEXT_CONTENT" }, { "inlineData": { "mimeType": "MIME_TYPE", "data": "BASE64_ENCODED_DATA" } } ], "title": "PODCAST_TITLE", "description": "PODCAST_DESCRIPTION" }'מחליפים את מה שכתוב בשדות הבאים:
-
PROJECT_ID: מזהה הפרויקט. FOCUS: הנחיה שבה מציעים את הנושא של הפודקאסט.-
LENGTH: יש שתי אפשרויות:SHORT(בדרך כלל 4-5 דקות)-
STANDARD(בדרך כלל כ-10 דקות, אבל יכול להיות פחות אם מדובר במערכי נתונים קטנים יותר)
-
LANGUAGE_CODE: אופציונלי. מציינים את קוד השפה של הפודקאסט. צריך להשתמש בתגי שפה שמוגדרים על ידי BCP47. אם לא מספקים את קוד השפה, הפודקאסט נוצר באנגלית. -
TEXT_CONTENT: תוכן הטקסט שרוצים לכלול. -
inlineData: אובייקט של מדיה שאינה טקסט. -
MIME_TYPE: סוג ה-MIME של נתוני ה-blob (לדוגמה, image/png). -
BASE64_ENCODED_DATA: הבייטים הגולמיים של נתוני המדיה בקידוד base64. PODCAST_TITLE: שם הפודקאסט. המידע הזה יכול להיות לשימוש פנימי, או שתוכלו לבחור להציג אותו למשתמשי הקצה.PODCAST_DESCRIPTION: תיאור של הפודקאסט. אפשר להשתמש במידע הזה לצרכים פנימיים, או לבחור להציג אותו למשתמשי הקצה.
יצירת הפודקאסט נמשכת כמה דקות.
-
רושמים את שם הפעולה. תצטרכו אותו כדי להוריד את הפודקאסט בשלב 4. בדוגמה שלמעלה, שם הפעולה הוא
projects/123456/locations/global/operations/create-podcast-54321.זה שינוי אופציונלי. בודקים את הסטטוס של פעולת יצירת הפודקאסט. איך מקבלים פרטים על פעולה ממושכת
אחרי שהפעולה מסתיימת, מריצים את פקודת ה-curl הבאה כדי להוריד את הפודקאסט:
curl -v \ -H "Authorization: Bearer $(gcloud auth print-access-token)" \ "https://discoveryengine.googleapis.com/v1/OPERATION_NAME:download?alt=media" \ --output FILENAME.mp3 -L
מחליפים את מה שכתוב בשדות הבאים:
-
OPERATION_NAME: השם של הפעולה שרשמתם בשלב 2. -
FILENAME: שם הקובץ של הפודקאסט.
הפקודה הזו מורידה את הפודקאסט לקובץ MP3 בספרייה המקומית.
-
תאימות
Podcast API לא תואם למפתחות הצפנה בניהול הלקוח (CMEK), CMEK ל-Gemini Enterprise.