בדף הזה מוצגים פרמטרים אופציונליים של דגימה שאפשר להגדיר בבקשה למודל. הפרמטרים שזמינים לכל מודל עשויים להיות שונים. מידע נוסף מופיע במאמרי העזרה.
פרמטרים של דגימת אסימונים
הפרמטרים בקטע הזה משפיעים על האופן שבו המודל בוחר את הטוקן הבא מהאוצר המילים שלו. שינוי הפרמטרים האלה מאפשר לשלוט באקראיות ובמגוון של הטקסט שנוצר.
Top-P
הפרמטר Top-P משנה את האופן שבו המודל בוחר אסימונים לפלט. הטוקנים נבחרים מהסבירים ביותר לסבירים פחות, עד שסכום ההסתברויות שלהם שווה לערך של Top-P. לדוגמה, אם לאסימונים A, B ו-C יש הסתברות של 0.3, 0.2 ו-0.1, והערך של Top-P הוא 0.5, המודל יבחר באסימון A או באסימון B כאסימון הבא באמצעות רמת אקראיות, ויפסול את אסימון C כמועמד.
כדי לקבל תשובות פחות אקראיות, מציינים ערך נמוך יותר, וכדי לקבל תשובות יותר אקראיות, מציינים ערך גבוה יותר.
מידע נוסף זמין במאמרtopP.
טמפרטורה
רמת האקראיות משמשת לדגימה במהלך תהליך יצירת תשובות, שמתרחש כשמחילים את הפרמטרים topP ו-topK. הטמפרטורה שולטת במידת האקראיות בבחירת האסימון.
טמפרטורות נמוכות טובות להנחיות שדורשות תשובה פחות פתוחה או יצירתית, ואילו טמפרטורות גבוהות יכולות להוביל לתוצאות יותר מגוונות או יצירתיות. רמת אקראיות של 0
פירושה שהטוקנים עם ההסתברות הכי גבוהה תמיד נבחרים. במקרה כזה, התשובות להנחיה נתונה הן ברובן דטרמיניסטיות, אבל עדיין יכולות להיות וריאציות קלות.
אם המודל מחזיר תשובה כללית מדי או קצרה מדי, או אם המודל מחזיר תשובת ברירת מחדל, נסו להגדיל את רמת האקראיות. אם המודל נכנס ליצירה אינסופית, יכול להיות שהעלאת רמת האקראיות ל-0.1 לפחות תביא לתוצאות טובות יותר.
1.0 הוא ערך ההתחלה המומלץ לרמת אקראיות.
טמפרטורות נמוכות מובילות לתוצאות צפויות (אבל לא דטרמיניסטיות לחלוטין). מידע נוסף זמין במאמר temperature.
פרמטרים של עצירה
הפרמטרים בקטע הזה מאפשרים לכם לשלוט באופן מדויק באורך ובתוכן של הפלט שנוצר על ידי המודל, על ידי הגדרת תנאים שבהם תהליך היצירה צריך להיפסק.
מספר מקסימלי של טוקנים בפלט
מגדירים את maxOutputTokens כדי להגביל את מספר הטוקנים שנוצרים בתשובה. אסימון הוא בערך ארבעה תווים, כך ש-100 אסימונים מתאימים בערך ל-60-80 מילים. כדי להגביל את אורך התשובה, מגדירים ערך נמוך.
הפסקת רצפים
מגדירים מחרוזות ב-stopSequences כדי להנחות את המודל להפסיק ליצור טקסט אם אחת מהמחרוזות מופיעה בתשובה. אם מחרוזת מופיעה כמה פעמים בתשובה, התשובה תיחתך במקום שבו המחרוזת מופיעה בפעם הראשונה. המחרוזות הן תלויות אותיות רישיות (case-sensitive).
פרמטרים של ענישה על טוקנים
הפרמטרים בקטע הזה מאפשרים לכם לשלוט בהסתברות ליצירת טוקנים על סמך התדירות והנוכחות שלהם בפלט.
קנס על תדירות
ערכים חיוביים מענישים טוקנים שמופיעים שוב ושוב בטקסט שנוצר, ומקטינים את ההסתברות לחזרה על תוכן. הערך המינימלי הוא -2.0. הערך המקסימלי הוא עד 2.0, לא כולל.
מידע נוסף זמין במאמר frequencyPenalty בGenerationConfigמאמרי העזרה.
קנס על נוכחות
ערכים חיוביים מענישים טוקנים שכבר מופיעים בטקסט שנוצר, ומגדילים את הסיכוי ליצירת תוכן מגוון יותר. הערך המינימלי הוא -2.0. הערך המקסימלי הוא עד 2.0, לא כולל.
מידע נוסף זמין במאמר presencePenalty בGenerationConfigמאמרי העזרה.
פרמטרים מתקדמים
אפשר להשתמש בפרמטרים האלה כדי לקבל מידע נוסף על הטוקנים בתשובה או כדי לשלוט במידת השונות של התשובה.
מקור
כשמגדירים ערך ספציפי ל-seed, המודל עושה כמיטב יכולתו כדי לספק את אותה תשובה לבקשות חוזרות. אין ערובה לפלט דטרמיניסטי.
בנוסף, שינוי של הגדרות המודל או הפרמטרים, כמו רמת האקראיות, יכול לגרום לשינויים בתגובה גם כשמשתמשים באותו ערך התחלתי. כברירת מחדל, נעשה שימוש בערך אקראי של seed.
מידע נוסף זמין במאמר seed.
דוגמה
הנה דוגמה לשימוש בפרמטרים כדי לשפר את התשובה של המודל.
Python
התקנה
pip install --upgrade google-genai
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Go
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Node.js
התקנה
npm install @google/genai
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
Java
כך מתקינים או מעדכנים את Java.
מידע נוסף מופיע ב מאמרי העזרה בנושא SDK.
מגדירים משתני סביבה כדי להשתמש ב-Google Gen AI SDK עם Vertex AI:
# Replace the `GOOGLE_CLOUD_PROJECT` and `GOOGLE_CLOUD_LOCATION` values # with appropriate values for your project. export GOOGLE_CLOUD_PROJECT=GOOGLE_CLOUD_PROJECT export GOOGLE_CLOUD_LOCATION=global export GOOGLE_GENAI_USE_ENTERPRISE=True
המאמרים הבאים
- מידע על שיטות מומלצות לאתיקה של בינה מלאכותית ועל מסנני הבטיחות של Agent Platform
- מידע על הוראות מערכת בנושא בטיחות
- מידע נוסף על מעקב אחר ניצול לרעה
- מידע נוסף על אתיקה של בינה מלאכותית