ארכיטקטורה
תרשים שמציג אפליקציה שמשתמשת ב-Model Armor כדי להגן על מודל LLM ועל משתמש. השלבים הבאים מסבירים את זרימת הנתונים:
- אתם מזינים הנחיה לאפליקציה.
- התכונה Model Armor בודקת את הפרומפט הנכנס כדי לזהות תוכן רגיש פוטנציאלי.
- הפרומפט (או פרומפט שעבר סניטציה) נשלח למודל שפה גדול (LLM).
- מודל ה-LLM יוצר תשובה.
- Model Armor בודק את התשובה שנוצרה כדי לזהות תוכן רגיש פוטנציאלי.
- התשובה (או תשובה שעברה סניטציה) נשלחת אליכם. Model Armor שולח תיאור מפורט של מסננים שהופעלו ומסננים שלא הופעלו בתגובה.
מסנני הגנה מוגברת על המודל מסננים גם קלט (הנחיות) וגם פלט (תשובות) כדי למנוע חשיפה של מודל ה-LLM לתוכן זדוני או רגיש, או יצירה של תוכן כזה.
דרישות רשת
כדי לגשת לנקודות קצה אזוריות של הגנה מוגברת על המודל מתוך רשת VPC, צריך ליצור נקודת קצה של Private Service Connect לממשקי ה-API של הגנה מוגברת על המודל. הפעולה הזו נדרשת כדי למנוע שגיאות בתעודה כשניגשים לנקודות קצה אזוריות באמצעות גישה פרטית ל-Google או VPC Service Controls. מידע נוסף זמין במאמרים פתרון בעיות בהגנה מוגברת על המודל ומידע על גישה לנקודות קצה אזוריות דרך נקודות קצה של Private Service Connect.
תרחישים לדוגמה
ל-הגנה מוגברת על המודל יש כמה תרחישי שימוש בתחומים של אבטחה, מהימנות, בטיחות ואתיקה של בינה מלאכותית, כולל:
- מצמצמים את הסיכון לדליפת קניין רוחני (IP) רגיש ופרטים אישיים מזהים (PII) בהנחיות או בתשובות של מודלים גדולים של שפה (LLM).
- הגנה מפני החדרה של פרומפטים ומתקפות פריצה, כדי למנוע מגורמים זדוניים לתמרן מערכות AI ולבצע פעולות לא מכוונות.
- סריקת טקסט בקובצי PDF לאיתור תוכן רגיש או זדוני.
- כך תוכלו למנוע מצ'אטבוט להמליץ על פתרונות של מתחרים, ולשמור על שלמות המותג ועל נאמנות הלקוחות.
- סינון פוסטים ברשתות החברתיות שנוצרו על ידי אפליקציות AI ומכילים מסרים מזיקים, כמו תוכן מסוכן או תוכן שמכיל דברי שטנה.
תבניות של הגנה מוגברת על המודל
תבניות של הגנה מוגברת על המודל מאפשרות לכם להגדיר איך הגנה מוגברת על המודל מסננת פרומפטים ותשובות. הם פועלים כקבוצות של מסננים וערכי סף מותאמים אישית לרמות שונות של מהימנות בנושא בטיחות ואבטחה, וכך מאפשרים לכם לשלוט בתוכן שמסומן.
הסף מייצג רמות מהימנות – עד כמה Model Armor בטוח שההנחיה או התגובה כוללות תוכן פוגע. לדוגמה, אפשר ליצור תבנית שמסננת הנחיות לתוכן שמלא בשנאה עם סף של HIGH, כלומר, Model Armor מדווח על רמת ודאות גבוהה שההנחיה מכילה תוכן שמלא בשנאה. LOW_AND_ABOVE סף
מציין כל רמת סמך (LOW, MEDIUM ו-HIGH) לגבי הטענה הזו.
מידע נוסף זמין במאמר בנושא תבניות הגנה מוגברת על המודל.
רמות הוודאות של Model Armor
אתם יכולים להגדיר רמות מהימנות לקטגוריות של בטיחות AI אחראי (תוכן מיני בוטה, מסוכן, הטרדה ודברי שטנה), זיהוי של החדרת הנחיות ופריצת דרך, והגנה על מידע אישי רגיש (כולל רלוונטיות לנושא).
ברמות מהימנות שתומכות בספי פירוט, Model Armor מפרש אותן באופן הבא:
- גבוה: זיהוי תוכן עם סבירות גבוהה להפרה.
- בינוני ומעלה: זיהוי תוכן עם סבירות בינונית או גבוהה להפרה.
- נמוכה ומעלה: מזהה תוכן עם סבירות נמוכה, בינונית או גבוהה להפרה.
ההגדרה 'רגישות הסינון' קובעת את קצב הזיהוי. סף נמוך יותר מזהה יותר אירועים, אבל עלול להגדיל את התדירות של תוצאות חיוביות כוזבות.
| רמת מהימנות | סבירות לזיהוי | סיכון לתוצאה חיובית שגויה | תרחיש שימוש מומלץ |
|---|---|---|---|
| גבוהה | מסמנת תוכן רק אם יש ודאות גבוהה להפרה. | נמוכה מאוד | סביבות ייצור שבהן העדיפות היא לאפשר למשתמשים אינטראקציות ללא הפרעות. |
| בינונית ומעלה | מסמנת תוכן ברמת סמך מאוזנת. | בינוני | אפליקציות ארגוניות רגילות. היא מציעה איזון בין הגנה חזקה לבין שיעורי חיוביים כוזבים סבירים. מתאים לבדיקת בטיחות כללית של תוכן. |
| נמוך ומעלה | הכלי מסמן כל תוכן שיש בו אפילו רמז קל להפרה. | גבוהה | צריך להשתמש באפשרות הזו בזהירות. יכול להתאים לקטגוריות עם סיכון גבוה כמו החדרה פרומפטים וזיהוי פריצה, שבהן מניעת תוצאות שליליות שגויות היא קריטית, גם אם יש סיכון לקבלת תוצאות חיוביות שגויות. לא מומלץ להשתמש בהן בקטגוריות כלליות של תוכן בנושא אתיקה של בינה מלאכותית, כי יש סיכון גבוה לחסימה של תוכן לא מזיק. |
שיקולים ושיטות מומלצות
- הפרדה בין תבניות: הגדרת תבניות נפרדות של Model Armor להנחיות למשתמשים ולתשובות של המודל. לנתוני הקלט של המשתמשים ולפלט של המודל יש פרופילי סיכון ומטרות שונים:
- תבנית קלט: מתמקדת במניעת קלט זדוני, הזרקת הנחיות, ניסיונות לפריצת המודל והעלאת מידע אישי ורגיש.
- תבנית פלט: מתמקדת במניעת דליפה של מידע אישי רגיש מהמודל, ביצירת תוכן מזיק או תוכן שלא תואם למותג, או בהחזרת כתובות URL זדוניות. הפרדת התבניות מאפשרת לכם שליטה מפורטת יותר, מעקב טוב יותר אחרי בלוקים וכוונון קל יותר.
- השפעה של תוצאות חיוביות מוטעות: תוצאות חיוביות מוטעות עלולות לפגוע בחוויית המשתמש, כי הן גורמות לחסימה שגויה של הנחיות או תשובות לגיטימיות. ההגדרה
Low and above, למרות שהיא מקיפה, עלולה לגרום לנפח גדול של תוצאות חיוביות כוזבות באפליקציות AI. - התאמה ספציפית לקטגוריה: רמת הסינון האופטימלית תלויה בקטגוריה של הנזק שאתם מנסים למנוע. לדוגמה, כדי למזער את התוצאות החיוביות הכוזבות כשמדובר בהחדרת הנחיה, בזיהוי פריצה ובבטיחות כללית של תוכן (דברי שטנה, הטרדה, תוכן מסוכן), כדאי להתחיל עם
HighאוMedium and above. - בדיקות חוזרות: תמיד כדאי לבדוק את הגדרות המסננים באמצעות מערך נתונים מייצג של הנחיות ותשובות, כולל דוגמאות טובות ורעות מוכרות. קובעים קו בסיס לתוצאות חיוביות כוזבות ומשנים את הרמות בהתאם.
- מעקב: חשוב לעקוב באופן רציף אחרי ביצועי המסנן בסביבת הייצור כדי לזהות התנהגות חסימה לא צפויה או עלייה פתאומית בתוצאות חיוביות שגויות.
- משוב משתמשים: צריך לספק מנגנון שבאמצעותו המשתמשים יכולים לדווח על מקרים שבהם תוכן נחסם בטעות. המשוב הזה חשוב מאוד כדי לשפר את רמות הסינון.
אסטרטגיית הגדרה לדוגמה
- פריסה ראשונית:
- הגדרת מסננים כלליים של אתיקה של בינה מלאכותית (דברי שטנה והטרדה) לערך
High. - מגדירים את המסננים של החדרה פרומפטים וזיהוי פריצה ל-
Medium. ביישומים כמו Gemini Enterprise, כדאי להגדיר את ערך הסף ל-Highכדי למנוע תוצאות חיוביות שגויות. - משתמשים בתבנית מתקדמת של Sensitive Data Protection כדי להגדיר את סוגי המידע הנדרשים לתרחיש השימוש; Sensitive Data Protection בסיסי מספק סוגי מידע מוגבלים, בעיקר לאזור ארה"ב.
- הגדרת מסננים כלליים של אתיקה של בינה מלאכותית (דברי שטנה והטרדה) לערך
- בדיקות ואימות:
- כדאי לבדוק ביסודיות באמצעות קבוצה של שאילתות בטוחות ידועות כדי לוודא שהן לא נחסמות.
- הערכת שיעור התוצאות החיוביות הכוזבות בתנועת משתמשים טיפוסית.
- התאמה:
- אם אתם ממשיכים לראות נפח גבוה של תוצאות חיוביות כוזבות, כדאי לשנות את ערך הסף ל-
High. - אם נראה שההגנה מפני קטגוריה מסוימת לא מספיקה, כדאי לשקול בזהירות להוריד את ערך הסף רק עבור הקטגוריה הזו, אחרי בדיקה יסודית.
- אם אתם ממשיכים לראות נפח גבוה של תוצאות חיוביות כוזבות, כדאי לשנות את ערך הסף ל-
אם תבחרו בקפידה את רמות הסינון על סמך הסיכון הספציפי והסבילות לתוצאות חיוביות כוזבות בכל קטגוריה, תוכלו לשפר את היעילות של הגנה מוגברת על המודל. כדי לדווח על תוצאות חיוביות כוזבות ותוצאות שליליות כוזבות, צריך לפנות אל Cloud Customer Care.
מסננים של Model Armor
הגנה מוגברת על המודל מציעה מגוון מסננים שיעזרו לכם לספק מודלים בטוחים ומאובטחים של AI. אלה קטגוריות המסננים שזמינות:
מסנן בטיחות לאתיקה של בינה מלאכותית
אתם יכולים לסנן הנחיות ותשובות ברמות הסמך שצוינו בקטגוריות הבאות:
| קטגוריה | הגדרה |
|---|---|
| דברי שטנה | תגובות שליליות או פוגעניות שמכוונות לזהות ו/או למאפיינים מוגנים. |
| הטרדה | תגובות מאיימות, מפחידות, בריוניות או פוגעות שמכוונות לאדם אחר. |
| תוכן מיני בוטה | מכיל התייחסויות למעשים מיניים או לתוכן מגונה אחר. |
| תוכן בעל רמיזות מיניות1 | כולל רמיזות מיניות או תוכן מגונה אחר. |
| תוכן מסוכן | קידום או מתן גישה למוצרים, שירותים ופעילויות מזיקים. |
| אלימות1 | מכיל התייחסויות לתוכן אלים. |
| חומר שמתאר התעללות מינית בילדים | האפליקציה מכילה התייחסויות לתוכן שמתאר התעללות מינית בילדים (CSAM). המסנן הזה מופעל כברירת מחדל ואי אפשר להשבית אותו. |
1המסננים של תוכן בעל אופי מיני ושל אלימות זמינים רק בתבניות של Model Armor ולא בהגדרות של הרצפה.
החדרת פרומפטים וזיהוי של פריצת דרך
החדרת פרומפטים היא נקודת חולשה באבטחה שבה תוקפים יוצרים פקודות מיוחדות בקלט הטקסט (הפרומפט) כדי להטעות מודל AI. כך ה-AI יכול להתעלם מההוראות הרגילות שלו, לחשוף מידע רגיש או לבצע פעולות שהוא לא נועד לבצע.
פריצה בהקשר של מודלים של LLM מתייחסת לפעולה של עקיפת פרוטוקולי האבטחה וההנחיות האתיות שמוטמעים במודל. כך מודל ה-LLM יכול ליצור תשובות שהוא תוכנן במקור להימנע מהן, כמו תוכן מזיק, לא אתי ומסוכן.
כשהאפשרות 'זיהוי של החדרת פרומפטים ופריצה' מופעלת, הגנה מוגברת על המודל סורק את ההנחיות והתשובות כדי לזהות תוכן זדוני. אם היא מזוהה, Model Armor חוסם את ההנחיה או את התשובה.
Sensitive Data Protection
Sensitive Data Protection הוא שירות שעוזר לכם לגלות, לסווג ולבטל את הזיהוי של מידע אישי רגיש. Google Cloud Sensitive Data Protection יכול לזהות רכיבים רגישים, הקשר ומסמכים כדי לעזור לכם לצמצם את הסיכון לדליפת נתונים שנכנסים לעומסי עבודה של AI ויוצאים מהם. אתם יכולים להשתמש ב-Sensitive Data Protection ישירות ב-Model Armor כדי לשנות, להמיר לטוקנים ולצנזר רכיבים רגישים, תוך שמירה על ההקשר הלא רגיש. הגנה מוגברת על המודל יכול לקבל תבניות בדיקה קיימות, שפועלות כתוכניות ליצירת תרשימים כדי לייעל את תהליך הסריקה והזיהוי של מידע אישי רגיש שספציפי לעסק ולדרישות התאימות שלכם. כך מובטחת עקביות ופעולה הדדית בין עומסי עבודה אחרים שמשתמשים ב-Sensitive Data Protection.
ב-Model Armor יש שני מצבים להגדרת Sensitive Data Protection:
הגדרה בסיסית: במצב הזה, מגדירים את Sensitive Data Protection על ידי ציון סוגי המידע האישי הרגיש שרוצים לסרוק. המצב הזה תומך בקטגוריות הבאות:
- מספר כרטיס אשראי
- מספר ביטוח לאומי בארה"ב (SSN)
- מספר חשבון במוסד פיננסי
- מספר זיהוי לצורכי מס (ITIN) בארה"ב
- Google Cloud פרטי כניסה
- Google Cloud מפתח API
ההגדרה הבסיסית תומכת רק בפעולות בדיקה ולא תומכת בשימוש בתבניות של Sensitive Data Protection. מידע נוסף זמין במאמר בנושא הגדרה בסיסית של Sensitive Data Protection.
הגדרה מתקדמת: במצב הזה יש יותר גמישות ואפשרויות התאמה אישית באמצעות תבניות של Sensitive Data Protection. תבניות של Sensitive Data Protection הן הגדרות מוגדרות מראש שמאפשרות לכם לציין כללי זיהוי מפורטים יותר וטכניקות להסרת פרטים מזהים. ההגדרה המתקדמת תומכת גם בפעולות של בדיקה וגם בפעולות של הסרת פרטים מזהים. מידע נוסף זמין במאמר בנושא הגדרה מתקדמת של Sensitive Data Protection.
רמות המהימנות של Sensitive Data Protection פועלות בצורה שונה מרמות המהימנות של מסננים אחרים. מידע נוסף על רמות הביטחון של Sensitive Data Protection זמין במאמר הסתברות להתאמה של Sensitive Data Protection. מידע נוסף על Sensitive Data Protection באופן כללי זמין במאמר סקירה כללית של Sensitive Data Protection.
זיהוי כתובות URL זדוניות
כתובות URL זדוניות מוסוות לעיתים קרובות כדי להיראות לגיטימיות, מה שהופך אותן לכלי יעיל למתקפות פישינג, להפצת תוכנות זדוניות ולאיומים אחרים באינטרנט. לדוגמה, אם קובץ PDF מכיל כתובת URL זדונית מוטמעת, אפשר להשתמש בו כדי לפגוע במערכות במורד הזרם שמבצעות עיבוד של פלט מ-LLM.
כשזיהוי כתובות URL זדוניות מופעל, הגנה מוגברת על המודל סורק כתובות URL כדי לזהות אם הן זדוניות. כך תוכלו לפעול ולמנוע החזרה של כתובות URL זדוניות.
הגדרת סוג האכיפה
האכיפה מגדירה מה קורה אחרי זיהוי הפרה. כדי להגדיר איך Model Armor מטפל בזיהויים, צריך להגדיר את סוג האכיפה. Model Armor מציע את סוגי האכיפה הבאים:
- בדיקה בלבד: במצב הזה, Model Armor מנתח את התוכן בהתאם למדיניות האבטחה והבטיחות שהוגדרה. אם נמצאת הפרה, הפרטים נרשמים ביומן ב-Cloud Logging לצורך מעקב וניתוח. עם זאת, היא לא מונעת את העיבוד של הבקשה או התגובה על ידי השירות המשולב. האפשרות הזו שימושית לבדיקת מדיניות חדשה, להבנת שיעורי ההפרות הפוטנציאליים ולביצוע ביקורת בלי להשפיע על התנועה בזמן אמת. כדי להפיק ערך מהמצב הזה, צריך להפעיל את Cloud Logging.
- בדיקה וחסימה: במצב הזה יש הגנה פעילה. כש-Model Armor מזהה הפרה, הוא לא רק רושם את האירוע ביומן, אלא גם מונע את המשך התהליך של התוכן המפיר. לדוגמה, הנחיה שלא עומדת בדרישות נחסמת לפני שהיא מגיעה למודל, או שתגובה לא בטוחה של מודל נעצרת לפני שהיא נשלחת למשתמש.
הבחירה בסוג האכיפה היא קריטית להתנהגות של השילוב של Model Armor ולרמת ההגנה שהוא מספק. בדרך כלל אפשר להגדיר את ההגדרה הזו בתבניות של הגנה מוגברת על המודל ובהגדרות אבטחה מינימליות, וכך לאפשר רמות שונות של אכיפה לתרחישי שימוש שונים ולשירותים משולבים. מידע נוסף זמין במאמרים בנושא הגדרת סוג האכיפה לתבניות והגדרת סוג האכיפה להגדרות אבטחה מינימליות.
כך פועל כל מצב:
| מצב | תפקיד | השפעה | תרחיש שימוש |
|---|---|---|---|
Inspect only |
כש-Model Armor מזהה הפרה פוטנציאלית של מדיניות (לדוגמה, תוכן שסונן על ידי מסנני AI אחראי, מידע אישי רגיש פוטנציאלי, ניסיון חשוד להחדרת הנחיה), הוא רושם את אירוע הזיהוי ב-Cloud Logging. עם זאת, ההגדרה הזו לא מונעת את שליחת ההנחיה ל-LLM או את החזרת התשובה של ה-LLM אליכם. | האינטראקציה עם אפליקציית ה-AI נמשכת ללא חסימה או שינוי גלויים על ידי Model Armor ברגע הזיהוי. תקבלו תשובה כאילו הבדיקה לא הובילה לחסימה. | בדיקה והתאמה של מדיניות: ארגון שמטמיע סוכן AI חדש עשוי לרצות להבין את הסוגים והתדירות של הנחיות או תשובות שעלולות להיות בעייתיות, בלי לשבש את הפעילות של המשתמשים הראשונים. הם מגדירים גלאים במצב מעקב אחרי איומים חדשים: צוותי אבטחה יכולים להשתמש במצב הזה כדי לעקוב אחרי ניסיונות חדשים להחדרת פרומפטים או חשיפה לא צפויה של מידע אישי רגיש, בלי לפגוע בפונקציונליות של האפליקציה. ביקורת תאימות: רישום ביומן של כל ההפרות הפוטנציאליות, גם אם הן לא נחסמו, יכול לספק נתונים חשובים לדיווח על תאימות ולהערכת סיכונים. |
Inspect and block |
זהו מצב האכיפה הפעיל. כש-Model Armor מזהה הפרה של מדיניות על סמך הגלאים שהוגדרו והערכים שלהם, הוא מתעד את האירוע ומספק פסיקה לחסימת הבקשה. השירות שקורא לנקודת השילוב או לנקודת אכיפת המדיניות (PEP) אחראי לחסימת העיבוד הנוסף.
|
אם נמצאה הפרה, הבקשה תידחה או שלא תקבלו את התגובה מ-LLM. קיבלתם הודעה מהאפליקציה שמציינת שלא ניתן לעבד את הבקשה. ההודעה הספציפית תלויה באופן שבו אפליקציית הלקוח מתוכננת לטפל בהכרעת חסימה מ-Model Armor. |
מניעת תוכן פוגעני:
Sensitive Data Protection:
הפסקת הזרקת פרומפטים וזיהוי פריצה:
חסימת כתובות URL לא בטוחות:
אכיפה של נושאים מותאמים אישית:
|
מומלץ להתחיל עם Inspect only כדי להבין את שיעורי החסימה הפוטנציאליים ואת היעילות בתרחיש השימוש הספציפי שלכם. אחרי ניתוח היומנים ושינוי ההגדרות, אפשר לעבור לInspect and block כדי להפעיל את ההגנה.
כדי להשתמש ביעילות ב-Inspect only ולקבל תובנות חשובות, צריך להפעיל את Cloud Logging. אם Cloud Logging לא מופעל, Inspect only לא יניב מידע שימושי.
גישה ליומנים דרך Cloud Logging. מסננים לפי שם השירות modelarmor.googleapis.com. מחפשים רשומות שקשורות לפעולות שהפעלתם בתבנית. מידע נוסף זמין במאמר צפייה ביומנים באמצעות Logs Explorer.
הגדרות אבטחה מינימליות של Model Armor
תבניות הגנה מוגברת על המודל מספקות גמישות לאפליקציות ספציפיות, אבל ארגונים צריכים לעיתים קרובות להגדיר רמת הגנה בסיסית לכל אפליקציות ה-AI שלהם. כדי לקבוע את קו הבסיס הזה, משתמשים בהגדרות של Model Armor floor. הם מגדירים דרישות מינימליות לכל התבניות שנוצרו ברמת הפרויקט בהיררכיית המשאבים של Google Cloud .
מידע נוסף מופיע במאמר הגדרות של רמת ההגנה של Model Armor.
שפות
מסנני הגנה מוגברת על המודל תומכים בניקוי הנחיות ותשובות בכמה שפות.
- מסנן Sensitive Data Protection תומך באנגלית ובשפות אחרות, בהתאם לinfoTypes שבחרתם.
המסננים אתיקה של בינה מלאכותית ו-החדרת פרומפטים וזיהוי פריצת Jailbreak נבדקים בשפות הבאות:
- סינית (מנדרינית)
- אנגלית
- צרפתית
- גרמנית
- איטלקית
- יפנית
- קוריאנית
- פורטוגזית
- ספרדית
המסננים האלה יכולים לפעול בשפות רבות אחרות, אבל איכות התוצאות עשויה להשתנות. קודי השפות מפורטים במאמר שפות נתמכות.
יש שתי דרכים להפעיל זיהוי של כמה שפות:
הפעלה בכל בקשה: כדי לקבל שליטה מפורטת, מפעילים את זיהוי השפה בכל בקשה בנפרד כשמבצעים סניטציה של הנחיית משתמש ומבצעים סניטציה של תגובת מודל.
הפעלה חד-פעמית: אם אתם מעדיפים הגדרה פשוטה יותר, אתם יכולים להפעיל זיהוי של כמה שפות כהגדרה חד-פעמית ברמת תבנית הגנה מוגברת על המודל באמצעות API בארכיטקטורת REST. מידע נוסף זמין במאמר יצירת תבנית Model Armor.
בדיקת מסמכים
טקסט במסמכים יכול לכלול תוכן זדוני ורגיש. הגנה מוגברת על המודל יכול לסרוק את סוגי המסמכים הבאים כדי לזהות בעיות בטיחות, ניסיונות להחדרת פרומפטים ופריצה, מידע אישי רגיש וכתובות URL זדוניות:
- קובצי PDF
- CSV
- קובצי טקסט: TXT
- מסמכי Microsoft Word: DOCX, DOCM, DOTX, DOTM
- שקפים של Microsoft PowerPoint: PPTX, PPTM, POTX, POTM, POT
- גיליונות Microsoft Excel: XLSX, XLSM, XLTX, XLTM
סינון תמונות
Model Armor סורק תמונות שמופיעות בפרומפטים ובתשובות כדי להגן על אפליקציות AI גנרטיבי מפני סיכונים שמוטמעים בתמונות. הגנה מוגברת על המודל סורקת תמונות באמצעות השיטות הבאות:
- סריקה ויזואלית: סינון התוכן הוויזואלי בתמונות בלבד באמצעות מסנן Sensitive Data Protection מתקדם.
- זיהוי תווים אופטי (OCR): סורק את הטקסט בתמונות.
כשמשתמשים בהגנה מוגברת על המודל כדי לסרוק תמונות, חשוב להביא בחשבון את המגבלות הבאות:
- התמונות של מסכי Model Armor יכולות להיות רק בפורמטים JPEG, PNG ו-BMP.
- כל תמונה צריכה להיות בגודל של עד 4MB.
- הגנה מוגברת על המודל לא סורקת תמונות שמוטמעות בקבצים.
- אם משתמשים בשיטות
SanitizeUserPromptו-SanitizeModelResponse, המערכת הגנה מוגברת על המודל לא בודקת תמונות שמצורפות לטקסט בהנחיות ובתשובות. - הגנה מוגברת על המודל בודק רק תמונה אחת בכל בקשה. אם משתמשים בשיטות
SanitizeUserPromptו-SanitizeModelResponse, לא אפשרי לבדוק כמה תמונות בו-זמנית. - סינון תמונות נתמך רק באזורים מרובים
usו-eu. אם שולחים פרומפט שמכיל תמונה לנקודת קצה אזורית שבה הגנה מוגברת על המודל לא תומך בסינון תמונות, השדהinvocation_resultבתשובה מצייןFAILURE.
מידע נוסף זמין במאמר בנושא ניקוי הנחיות שמכילות תמונות.
טיפול בנתונים ואחסון שלהם
ההגנה המוגברת על המודל מתוכננת בהתאם לעקרונות של פרטיות והגבלה על איסוף המידע. Model Armor לא שומר את התוכן של האינטראקציות שלכם עם AI, אלא אם אתם מגדירים ומפעילים במפורש רישום ביומן של הפלטפורמה, וכך אתם שולטים בשמירת הנתונים. בקטע הזה מוסבר איך Model Armor מטפל בנתונים שלכם:
- עיבוד ללא שמירת מצב וסילוק תוכן: Model Armor פועל כשירות ללא שמירת מצב, ומעבד את כל הפרומפטים והתשובות של המודלים בזיכרון בלבד. הוא לא מתעד, לא שומר ולא משמר באופן קבוע תוכן כלשהו שמנותח במהלך הפעולה הרגילה שלו. כל הנתונים נמחקים באופן מיידי לאחר השלמת הניתוח.
- רישום ביומן בשליטת הלקוח: הנסיבות היחידות שבהן נשמרים נתונים שקשורים לתוכן שעובר עיבוד הן באמצעות Cloud Logging. אם תבחרו להפעיל את Cloud Logging בשירות הגנה מוגברת על המודל, פרטי האירועים – שעשויים לכלול מטא-נתונים או קטעי תוכן מנותח בהתאם להגדרות – יישלחו ליעד Cloud Logging שציינתם. ההיקף של הנתונים שנרשמים ביומן והשמירה שלהם נקבעים לפי ההגדרה של Cloud Logging.
- אחסון מאובטח והצפנה: כל הנתונים שמטופלים על ידי Model Armor מוגנים באמצעות הצפנה לפי תקנים מקובלים בתעשייה. זה כולל נתונים במעבר באמצעות TLS 1.2 ומעלה, וכל נתון שנמצא לזמן קצר בזיכרון במהלך הניתוח.
- מיקום נתונים אזורי: העיבוד ב-Model Armor לא מתבצע לפי מצב, אבל השירות תומך באמצעי בקרה קפדניים למיקום נתונים. כך מוודאים שכל העיבוד הזמני מתבצע רק בגבולות הגיאוגרפיים שהגדרתם, כמו
USאוEU. - עיבוד סלקטיבי: כדי להבטיח יעילות תפעולית ותאימות אזורית, Model Armor מעביר ומעבד רק נתונים של מסננים פעילים. אם מסנן ספציפי מושבת (לדוגמה, בגלל זמינות אזורית או העדפת משתמש), לא נשלחים נתונים לשירות הבסיסי שמשויך למסנן הזה, והשירות לא מעבד את הנתונים.
- תקני תאימות גלובליים: כחלק מהסביבה העסקית של Google Cloud Google, ההגנה המוגברת על המודל נהנית מבסיס של אבטחה קפדנית. התשתית עוברת ביקורות עצמאיות באופן קבוע כדי לשמור על אישורים, כולל SOC 1/2/3 ו-ISO/IEC 27001.
תמחור
אפשר לרכוש את Model Armor כשירות עצמאי או כחלק משולב מ-Security Command Center. למידע על מחירים אפשר לעיין במאמרים הבאים:
טוקנים
מודלים של AI גנרטיבי מפרקים טקסט ונתונים אחרים ליחידות שנקראות טוקנים. ב-Model Armor נעשה שימוש במספר הכולל של הטוקנים בהנחיות ובתשובות של AI למטרות תמחור. הגנה מוגברת על המודל מגבילה את מספר הטוקנים שמעובדים בכל הנחיה ותשובה. למידע על מגבלות האסימונים, אפשר לעיין במאמר בנושא מגבלות האסימונים.
המאמרים הבאים
- מידע נוסף על תבניות Model Armor
- מידע נוסף על הגדרות של רמת ההגנה של Model Armor
- מידע נוסף על נקודות קצה של Model Armor
- ניקוי פרומפטים ותשובות.
- מידע נוסף על רישום ביומן של ביקורת Model Armor
- פתרון בעיות ב-Model Armor