מודלים של חשיבה יוצרים תהליך פנימי של 'חשיבה' לפני שהם מחזירים תשובה. היכולת הזו עוזרת למודל לתכנן תוכניות מורכבות שכוללות כמה שלבים, לפתור בעיות מתמטיות וליצור קוד מדויק.
בדף הזה נסביר איך:
- הגדרת רמות חשיבה ותקציבי טוקנים
- צפייה בסיכומי המחשבות
- שמירה על מצב הנימוקים בשיחות מרובות תפניות באמצעות חתימות מחשבה
מודלים נתמכים
החשיבה נתמכת בדגמים הבאים:
כדי להרחיב את רשימת המודלים הנתמכים, לוחצים כאן
- Gemini Omni Flash
- Gemini Omni 1.1 Flash
- Gemini 3.8 Flash Cyber
- Gemini 3.8 Flash
- Gemini 3.7 Flash
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
- Gemini 3.5 Flash
- Gemini 3.1 Pro
- תמונה של Gemini 3.1 Flash-Lite (Nano Banana 2 Lite)
- Gemini 3.1 Flash-Lite
- Gemini 3.1 Flash Image
- Gemini 3 Pro Image
- Gemini 3 Flash
- Gemini 2.5 Pro
- Gemini 2.5 Flash-Lite
- Gemini 2.5 Flash
שליטה בתהליך החשיבה של המודל
התכונה 'חשיבה' מופעלת כברירת מחדל במודלים נתמכים של Gemini. ב-Agent Studio, אפשר לבדוק את תהליך החשיבה המלא לצד התגובה שנוצרה.
אופן ההגדרה של החשיבה תלוי בגרסת המודל:
מודלים של Gemini 3 ומודלים מתקדמים יותר
מודלים של Gemini 3 משתמשים בפרמטר thinking_level. הפרמטר הזה מגדיר רמות נפרדות של חשיבה רציונלית, כדי שתוכלו לבצע אופטימיזציה בין זמן טעינה לבין עומק החשיבה הרציונלית.
המסוף
-
עוברים אל Agent Studio ובוחרים באפשרות New > Chat (חדש > צ'אט) ומרחיבים את חלונית המודל.
- בחלונית Model settings (הגדרות המודל), בוחרים מודל נתמך מהתפריט Model (מודל).
- בוחרים ערך מהתפריט הנפתח רמת החשיבה.
Python
from google import genai
from google.genai import types
client = genai.Client()
response = client.models.generate_content(
model="gemini-3.5-flash",
contents="How does AI work?",
config=types.GenerateContentConfig(
thinking_config=types.ThinkingConfig(
# Options: MINIMAL, LOW, MEDIUM, HIGH
thinking_level=types.ThinkingLevel.THINKING_LEVEL_VALUE
)
),
)
print(response.text)ערכים של רמת ההעמקה
אפשר להגדיר את thinking_level לאחד מהערכים הבאים:
-
MINIMAL: משתמש בכמה שפחות טוקנים לצורך חשיבה. הבחירה המתאימה למשימות פשוטות שלא דורשות הסקת מסקנות מורכבת. הפונקציהMINIMALמחייבת חתימות מחשבה בשיחות רב-שלביות. אם לא מציינים אותן, המודל מחזיר שגיאה400: INVALID_ARGUMENT. -
LOW: נעשה שימוש בפחות אסימוני חשיבה כדי לספק תשובות מהירות יותר. הכי מתאים לאפליקציות עם תפוקה גבוהה ומורכבות נמוכה של משימות. -
MEDIUM: מאזן בין איכות הנימוקים לבין זמן האחזור. מתאים למשימות ברמת מורכבות בינונית, שמועילות משלבי ביניים של נימוקים. -
HIGH: שימוש בקיבולת החשיבה המקסימלית. המודל הכי מתאים לפרומפטים מורכבים שדורשים חשיבה רציונלית מעמיקה, פתרון בעיות רב-שלבי, אימות רשמי של קוד או הרצה של כלים במספר שלבים.
רמות חשיבה נתמכות לפי מודל
בטבלה הבאה מפורטים ערכי thinking_level הנתמכים והגדרות ברירת המחדל לפי דגם:
| דגם | ערכים נתמכים של thinking_level |
ברירת מחדל |
|---|---|---|
| Gemini 3.8 Flash Cyber | LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.8 Flash | LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.7 Flash | LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.6 Flash | MINIMAL, LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.5 Flash-Lite | MINIMAL, LOW, MEDIUM, HIGH |
MINIMAL |
| Gemini 3.5 Flash | MINIMAL, LOW, MEDIUM, HIGH |
MEDIUM |
| Gemini 3.1 Pro | LOW, MEDIUM, HIGH |
HIGH |
| תמונה של Gemini 3.1 Flash-Lite (Nano Banana 2 Lite) | MINIMAL, HIGH |
MINIMAL |
| Gemini 3.1 Flash-Lite | MINIMAL, LOW, MEDIUM, HIGH |
MINIMAL |
| Gemini 3.1 Flash Image | MINIMAL, HIGH |
MINIMAL |
| Gemini 3 Pro Image | HIGH |
HIGH |
| Gemini 3 Flash | MINIMAL, LOW, MEDIUM, HIGH |
HIGH |
Gemini 2.5 ומודלים קודמים
במודלים של Gemini 2.5 ומודלים קודמים, מגדירים את החשיבה באמצעות הפרמטר thinking_budget. הפרמטר הזה מגדיר מגבלה רכה על מספר הטוקנים שהמודל יכול להשתמש בהם במהלך חשיבה פנימית.
המסוף
-
עוברים אל Agent Studio ובוחרים באפשרות חדש > צ'אט.
- בחלונית Model settings (הגדרות המודל), בוחרים מודל נתמך מהתפריט Model (מודל).
- בבורר תקציב החשיבה, בוחרים באפשרות ידני ומשתמשים בפס ההזזה כדי לשנות את מגבלת הטוקנים.
Python
התקנה
pip install --upgrade google-genai
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
התקנה
npm install @google/genai
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
כאן מוסבר איך להתקין או לעדכן את Go.
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
כאן מוסבר איך להתקין או לעדכן את Java.
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
אם לא מציינים תקציב, המודל מגדיר את תקציב הטוקנים באופן דינמי עד 8,192 טוקנים. כדי להפעיל באופן מפורש את התקצוב הדינמי ב-API, מגדירים את thinking_budget ל--1.
מודלים שנתמכים על ידי תקציבי חשיבה
בטבלה הבאה מפורטים המגבלות המינימליות, המקסימליות ומגבלות ברירת המחדל של טוקנים לכל מודל:
| דגם | מספר טוקנים מינימלי | מספר הטוקנים המקסימלי | ברירת מחדל |
|---|---|---|---|
| Gemini 2.5 Flash | 1 | 24,576 | אוטומטי (עד 8,192 טוקנים) |
| Gemini 2.5 Pro | 128 | 32,768 | אוטומטי (עד 8,192 טוקנים) |
| Gemini 2.5 Flash-Lite | 512 | 24,576 | אוטומטי (עד 8,192 טוקנים) |
השבתת החשיבה
אפשר להשבית את ההעמקה ב-Gemini 2.5 Flash וב-Gemini 2.5 Flash-Lite על ידי הגדרת thinking_budget ל-0. למרות שהתוכן של שלב החשיבה לא מוחזר בתשובה, יכול להיות שהטקסט שנוצר עדיין יציג פלט בסגנון של נימוקים.
אי אפשר להשבית את התהליך של Gemini 2.5 Pro.
צפייה בסיכומי המחשבות
סיכומי מחשבות מציגים את שלבי הביניים של הנימוקים לצד התשובה הסופית של המודל. יש תמיכה בסיכומי מחשבות במודלים של Gemini 2.5 ואילך.
המסוף
סיכומי המחשבות מופעלים כברירת מחדל ב-Agent Studio. כדי לראות את שלבי הנימוק המסוכמים, מרחיבים את החלונית Thoughts.
Python
התקנה
pip install --upgrade google-genai
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
התקנה
npm install @google/genai
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
כאן מוסבר איך להתקין או לעדכן את Go.
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
כאן מוסבר איך להתקין או לעדכן את Java.
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
יכול להיות שתגובה תחזיר חתימת מחשבה בלי טקסט של סיכום המחשבה במקרים הבאים:
- בקשות עם מורכבות נמוכה: הבקשה דרשה מספר מינימלי של שלבי נימוק.
- סיכומים מושבתים: לא התבקשו סיכומים או שהם הושבתו.
- מוֹדָלִיוֹת שאינן טקסט: חשיבה רציונלית על מודאליות מסוימות (כמו ניתוח תמונות) עשויה שלא להפיק סיכומי טקסט.
האפליקציה צריכה לטפל בשדות ריקים או חסרים של סיכום המחשבה בצורה חלקה, תוך שמירה על חתימות המחשבה הנלוות.
חתימות של מחשבות
חתימות מחשבה הן ייצוגים מוצפנים של מצב החשיבה הרציונלית הפנימית של המודל. הם שומרים על ההקשר בשיחות רב-שלביות, במיוחד כשמשתמשים בקריאה להפעלת פונקציות.
כדי לשמור על הקשר של החשיבה הרציונלית לאורך אינטראקציות רב-שלביות, צריך להעביר את חתימות המחשבה שהוחזרו בתשובות קודמות בחזרה לבקשות הבאות, ללא קשר לרמת החשיבה שהוגדרה.
אם אתם משתמשים ב-Google Gen AI SDK הרשמי של Google (Python, Node.js, Go או Java), חתימות המחשבה מנוהלות באופן אוטומטי כשמשתמשים בסשנים רגילים של צ'אט או כשמוסיפים אובייקטים של תשובות מלאות להיסטוריית ההודעות.
דוגמאות, דרישות ודפוסי הטמעה מפורטים במאמר בנושא חתימות של מחשבות.
תמחור
החיוב הוא על טוקנים שנוצרו במהלך תהליך החשיבה. במודלים שבהם החשיבה מופעלת כברירת מחדל, כמו Gemini 3 Pro ו-Gemini 2.5 Pro, אסימוני החשיבה האלה כלולים בשימוש שחויב.
פרטים מלאים על התעריפים זמינים במחירון.
המאמרים הבאים
חתימות של מחשבות
איך שומרים על מצב החשיבה הרציונלית של Gemini במהלך שיחות רב-שלביות ושיחות עם כמה תורות, באמצעות חתימות מחשבה.
מדריך לכתיבת פרומפטים שמעודדים חשיבה
כדאי לעיין בטכניקות של הנדסת פרומפטים ובשיטות מומלצות שמותאמות למודלים של Gemini Thinking.