מודלים של OpenAI

מודלים של OpenAI זמינים לשימוש כ-API מנוהל וכמודלים שמוטמעים באופן עצמאי ב-Gemini Enterprise Agent Platform. אתם יכולים להזרים את התשובות כדי לצמצם את זמן האחזור שנתפס על ידי משתמשי הקצה. תגובה שמוזרמת משתמשת באירועים שנשלחים מהשרת (SSE) כדי להזרים את התגובה באופן מצטבר.

gpt-oss 120B

‫OpenAI gpt-oss 120B הוא מודל שפה במשקל 120B בקוד פתוח, שפורסם ברישיון Apache 2.0. הוא מתאים במיוחד לתרחישי שימוש של נימוקים וקריאה לפונקציות. המודל מותאם לפריסה בחומרה לצרכנים.

מודל 120B משיג ביצועים כמעט זהים ל-o4-mini של OpenAI במדדי השוואה של ליבת ההיגיון, בזמן שהוא פועל על GPU יחיד של 80GB.

עוברים לכרטיס המודל gpt-oss 120B

gpt-oss 20B

‫OpenAI gpt-oss 20B הוא מודל שפה במשקל 20B שפורסם ברישיון Apache 2.0. הוא מתאים במיוחד לתרחישי שימוש של נימוקים וקריאה לפונקציות. המודל מותאם לפריסה בחומרה לצרכנים.

מודל 20B מספק תוצאות דומות ל-OpenAI o3-mini במדדים נפוצים, ויכול לפעול במכשירים עם 16GB זיכרון. לכן הוא אידיאלי לתרחישי שימוש במכשיר, להסקת מסקנות מקומית או לאיטרציה מהירה בלי תשתית יקרה.

לכרטיס המודל gpt-oss 20B

שימוש במודלים של OpenAI

במודלים מנוהלים, אפשר להשתמש בפקודות curl כדי לשלוח בקשות לנקודת הקצה של Gemini Enterprise Agent Platform באמצעות שמות המודלים הבאים:

  • ‫gpt-oss 120B, ‏ gpt-oss-120b-maas
  • ‫gpt-oss 20B, ‏ gpt-oss-20b-maas

במאמר קריאה לממשקי API של מודלים פתוחים מוסבר איך לבצע קריאות לסטרימינג וקריאות שלא מבוססות על סטרימינג למודלים של OpenAI.

כדי להשתמש במודל של Gemini Enterprise Agent Platform שפרסתם בעצמכם:

  1. עוברים אל מסוף Model Garden.
  2. מאתרים את המודל הרלוונטי של Gemini Enterprise Agent Platform.
  3. לוחצים על הפעלה וממלאים את הטופס שמופיע כדי לקבל את הרישיונות הנדרשים לשימוש מסחרי.

מידע נוסף על פריסה ושימוש במודלים של שותפים זמין במאמר פריסת מודל של שותף ושליחת בקשות לחיזוי .

זמינות אזורית של מודלים של OpenAI

מודלים של OpenAI זמינים באזורים הבאים:

דגם אזורים
gpt-oss 120B
  • global
gpt-oss 20B
  • us-central1

המאמרים הבאים

איך קוראים לממשקי API של מודלים פתוחים