מודלים של OpenAI זמינים לשימוש כ-API מנוהל וכמודלים שמוטמעים באופן עצמאי ב-Gemini Enterprise Agent Platform. אתם יכולים להזרים את התשובות כדי לצמצם את זמן האחזור שנתפס על ידי משתמשי הקצה. תגובה שמוזרמת משתמשת באירועים שנשלחים מהשרת (SSE) כדי להזרים את התגובה באופן מצטבר.
gpt-oss 120B
OpenAI gpt-oss 120B הוא מודל שפה במשקל 120B בקוד פתוח, שפורסם ברישיון Apache 2.0. הוא מתאים במיוחד לתרחישי שימוש של נימוקים וקריאה לפונקציות. המודל מותאם לפריסה בחומרה לצרכנים.
מודל 120B משיג ביצועים כמעט זהים ל-o4-mini של OpenAI במדדי השוואה של ליבת ההיגיון, בזמן שהוא פועל על GPU יחיד של 80GB.
עוברים לכרטיס המודל gpt-oss 120Bgpt-oss 20B
OpenAI gpt-oss 20B הוא מודל שפה במשקל 20B שפורסם ברישיון Apache 2.0. הוא מתאים במיוחד לתרחישי שימוש של נימוקים וקריאה לפונקציות. המודל מותאם לפריסה בחומרה לצרכנים.
מודל 20B מספק תוצאות דומות ל-OpenAI o3-mini במדדים נפוצים, ויכול לפעול במכשירים עם 16GB זיכרון. לכן הוא אידיאלי לתרחישי שימוש במכשיר, להסקת מסקנות מקומית או לאיטרציה מהירה בלי תשתית יקרה.
לכרטיס המודל gpt-oss 20Bשימוש במודלים של OpenAI
במודלים מנוהלים, אפשר להשתמש בפקודות curl כדי לשלוח בקשות לנקודת הקצה של Gemini Enterprise Agent Platform באמצעות שמות המודלים הבאים:
- gpt-oss 120B,
gpt-oss-120b-maas - gpt-oss 20B,
gpt-oss-20b-maas
במאמר קריאה לממשקי API של מודלים פתוחים מוסבר איך לבצע קריאות לסטרימינג וקריאות שלא מבוססות על סטרימינג למודלים של OpenAI.
כדי להשתמש במודל של Gemini Enterprise Agent Platform שפרסתם בעצמכם:
- עוברים אל מסוף Model Garden.
- מאתרים את המודל הרלוונטי של Gemini Enterprise Agent Platform.
- לוחצים על הפעלה וממלאים את הטופס שמופיע כדי לקבל את הרישיונות הנדרשים לשימוש מסחרי.
מידע נוסף על פריסה ושימוש במודלים של שותפים זמין במאמר פריסת מודל של שותף ושליחת בקשות לחיזוי .
זמינות אזורית של מודלים של OpenAI
מודלים של OpenAI זמינים באזורים הבאים:
| דגם | אזורים |
|---|---|
| gpt-oss 120B |
|
| gpt-oss 20B |
|
המאמרים הבאים
איך קוראים לממשקי API של מודלים פתוחים