הסבר על תוצאות של תחזיות ממודלים לזיהוי אובייקטים בתמונות

אחרי שמבקשים תחזית, Gemini Enterprise Agent Platform מחזירה תוצאות על סמך היעד של המודל. תשובות חיזוי של AutoML לזיהוי אובייקטים בתמונות מחזירות את כל האובייקטים שנמצאו בתמונה. לכל אובייקט שנמצא יש הערה (תווית ותיבת תוחמת מנורמלת) עם ציון רמת הביטחון המתאימה. התיבה התוחמת נכתבת כך:

"bboxes": [ [xMin, xMax, yMin, yMax], ...]

כאשר xMin, xMax הם ערכי ה-x המינימליים והמקסימליים, ו- yMin, yMax הם ערכי ה-y המינימליים והמקסימליים בהתאמה.

דוגמה לפלט של חיזוי באצווה

תשובות של חיזויים באיתור אובייקטים בתמונות ב-AutoML באצווה מאוחסנות כקבצים בפורמט JSON Lines בדלי Cloud Storage. כל שורה בקובץ JSON Lines מכילה את כל האובייקטים שנמצאו בקובץ תמונה יחיד. לכל אובייקט שנמצא יש הערה (תווית ותיבת תוחמת מנורמלת) עם ציון רמת הביטחון התואמת.

חשוב: תיבות תוחמות מוגדרות כך:

"bboxes": [ [xMin, xMax, yMin, yMax], ...]

כאשר xMin ו-xMax הם ערכי ה-x המינימלי והמקסימלי, ו- yMin ו-yMax הם ערכי ה-y המינימלי והמקסימלי, בהתאמה.

{
  "instance": {"content": "gs://bucket/image.jpg", "mimeType": "image/jpeg"},
  "prediction": {
    "ids": [1, 2],
    "displayNames": ["cat", "dog"],
    "bboxes":  [
      [0.1, 0.2, 0.3, 0.4],
      [0.2, 0.3, 0.4, 0.5]
    ],
    "confidences": [0.7, 0.5]
  }
}