מודלים של xAI Grok

מודלים של xAI Grok זמינים לשימוש כ-API מנוהל ב-Gemini Enterprise Agent Platform. אתם יכולים להזרים את התשובות כדי לצמצם את זמן האחזור שנתפס על ידי משתמשי הקצה. תגובה שמוזרמת משתמשת באירועים שנשלחים מהשרת (SSE) כדי להזרים את התגובה באופן מצטבר.

מודלים מנוהלים של xAI

המודלים הבאים זמינים מ-xAI לשימוש ב-Gemini Enterprise Agent Platform. כדי לגשת למודל xAI, עוברים לכרטיס המודל שלו ב-Model Garden.

Grok 4.6

‫Grok 4.6 הוא המודל הכי משוכלל של xAI, שנועד לכתיבת קוד, למשימות שדורשות סוכנים ולעבודות שמבוססות על ידע.

מעבר לכרטיס המודל של Grok 4.6

Grok 4.3

‫Grok 4.3 הוא מודל הדגל של xAI.

מעבר לכרטיס המודל של Grok 4.3

Grok 4.20 (Reasoning)

‫Grok 4.20 (Reasoning) הוא המודל המוביל של xAI, עם שיעור הזיות נמוך שמוביל בתעשייה. מצטיין במשימות של הבנת מסמכים ובהפעלת כלים ארוכת טווח על ידי סוכנים.

מעבר לכרטיס המודל Grok 4.20 (Reasoning)

Grok 4.20 (Non-reasoning)

‫Grok 4.20 (Non-reasoning) הוא מודל הדגל של xAI שלא מבוסס על חשיבה, והוא מתאפיין בשיעור נמוך של הזיות בהשוואה למודלים אחרים בתחום. הוא מצטיין בתרחישי שימוש שרגישים לזמן האחזור, כמו תמיכת לקוחות וסיווג.

מעבר לכרטיס של מודל Grok 4.20 (ללא נימוק)

‫Grok 4.1 Fast (הסקת מסקנות)

‫Grok 4.1 Fast (Reasoning) הוא המודל הכי משתלם של xAI, עם יכולות חזקות של הפעלת כלים וסינתזה יעילה של מאגר ידע. מצטיין במשימות חיפוש שכוללות נתונים מהאינטרנט וכלים פנימיים של מאגר ידע.

מעבר לכרטיס המודל Grok 4.1 Fast (Reasoning)

‫Grok 4.1 Fast (ללא נימוקים)

‫Grok 4.1 Fast (Non-reasoning) הוא המודל הכי חסכוני של xAI שלא מבוסס על חשיבה, והוא מותאם לביצועים עם זמן אחזור נמוך. מצטיין במשימות בהיקף גדול כמו סיכום וסיווג.

מעבר לכרטיס מודל Grok 4.1 Fast (Non-reasoning)

שימוש במודלים של xAI

במודלים מנוהלים, אפשר להשתמש בפקודות curl כדי לשלוח בקשות לנקודת הקצה של Gemini Enterprise Agent Platform באמצעות שמות המודלים הבאים. מידע נוסף על יצירת שיחות עם מודלים של xAI, עם או בלי סטרימינג, זמין במאמר קריאה לממשקי API של מודלים פתוחים.

במודלים מנוהלים, אפשר להשתמש בפקודות curl כדי לשלוח בקשות לנקודת הקצה של Gemini Enterprise Agent Platform באמצעות שמות המודלים הבאים:

  • ל-Grok 4.6, משתמשים ב-grok-4.6
  • ל-Grok 4.3, משתמשים ב-grok-4.3
  • ‫Grok 4.20 (Reasoning), ‏ grok-4.20-reasoning
  • ל-Grok 4.20 (ללא נימוקים), משתמשים ב-grok-4.20-non-reasoning
  • כדי להשתמש ב-Grok 4.1 Fast (Reasoning), ‏ משתמשים ב-grok-4.1-fast-reasoning
  • כדי להשתמש ב-Grok 4.1 Fast (Non-reasoning), צריך להשתמש ב-grok-4.1-fast-non-reasoning

מכסות של Grok

למודלים של Grok יש מכסה גלובלית. המכסה מצוינת בשאילתות לדקה (QPM) ובטוקנים לדקה (TPM). המדד TPM כולל גם אסימוני קלט וגם אסימוני פלט.

כדי לשמור על ביצועים כלליים של השירות ועל שימוש מקובל, יכול להיות שהמכסות המקסימליות ישתנו בהתאם לחשבון, ובמקרים מסוימים הגישה עשויה להיות מוגבלת. אפשר לראות את המכסות של הפרויקט בדף Quotas & Systems Limits במסוף Google Cloud . צריך גם לוודא שיש לכם את המכסות הבאות:

  • global_generate_content_requests_per_minute_per_project_per_base_model מגדיר את מכסת השאילתות לדקה.

  • ב-TPM, יש שני ערכי מכסה שחלים על דגמים מסוימים: ‫global_generate_content_input_tokens_per_minute_per_base_model מגדיר את מכסת הקלט של TPM ו- ‫global_generate_content_output_tokens_per_minute_per_base_model מגדיר את מכסת הפלט של TPM.

כדי לראות אילו מודלים סופרים את טוקני הקלט והפלט בנפרד, אפשר לעיין בדפים של המודלים הספציפיים.

המאמרים הבאים