ניהול טבלאות, תצוגות חומריות ואינדקסים של ScaNN
בהתאם לעומס העבודה, אתם יכולים להוסיף עמודות באופן ידני למאגר העמודות, או להסיר ממנו חלק מהעמודות של טבלה או של תצוגה חומרית, או את כולן. הערכת השאילתות מתבצעת באופן אוטומטי באמצעות הנתונים העמודתיים המאוחסנים כדי לענות על השאילתות.
באופן דומה, אפשר להוסיף ידנית אינדקס ScaNN למנוע מבוסס-עמודות כדי להאיץ את החיפוש הווקטורי. כך אפשר לבצע חיפושים יעילים של השכן הקרוב ביותר במערכי נתונים גדולים של הטבעות וקטוריות.
כשבוחרים אילו טבלאות, תצוגות חומריות ועמודות להוסיף למאגר העמודות, צריך לקחת בחשבון גם את הגודל של מאגר העמודות וגם את הצורה של עומס העבודה. מומלץ לבחור טבלאות גדולות או תצוגות שנסרקות לעיתים קרובות. בטבלאות או בתצוגות האלה, צריך לזהות אינדקסים גדולים לא ייחודיים שמשמשים את עומס העבודה של OLAP. אפשר להוסיף את העמודות של האינדקסים האלה למאגר העמודות, ואולי להסיר את האינדקסים. כך אפשר לבטל את עלות הביצועים שמשויכת לתחזוקה שלהם במופע הראשי.
כדי לנהל את התוכן של מנוע מבוסס-עמודות, אפשר להשתמש באחת מהשיטות הבאות:
- ניהול תוכן של מאגר עמודות באמצעות עדכון של דגלים במסד הנתונים
- ניהול תוכן של מאגר עמודות באמצעות פונקציות SQL
במאמר אילו נתונים אפשר להוסיף לעמודה store מוסבר אילו סוגי נתונים ומקורות נתונים אפשר להוסיף כשמוסיפים טבלאות, עמודות ותצוגות חומריות למאגר העמודות.
עדכון תוכן של מאגר עמודות באמצעות עדכון של דגלים במסד הנתונים
אפשר לנהל את התוכן של מאגר העמודות באופן ידני על ידי עדכון של google_columnar_engine.relations דגל מסד הנתונים. לדגל יש ערך יחיד שמציין את כל מקורות הנתונים של מאגר העמודות. במהלך ההפעלה מחדש, העמודות שצוינו בדגל הזה מאוכלסות אוטומטית במאגר העמודות.
אפשר להשתמש בדגל הזה יחד עם הפיכה אוטומטית של נתונים לעמודות. אם יש מודולים של זיכרון במנוע העמודות אחרי מילוי העמודות שצוינו באמצעות הדגל google_columnar_engine.relations, המערכת מוסיפה עוד עמודות למאגר העמודות לפי הצורך.
מידע נוסף על הגדרת דגלים של מסד נתונים זמין במאמר הגדרת דגלים של מסד נתונים ב-AlloyDB Omni.
הוספת עמודות באמצעות דגלים
כדי להוסיף עמודות למאגר העמודות, מגדירים את הדגל google_columnar_engine.relations. מגדירים את הערך שלו כרשימת פריטים מופרדת בפסיקים, כשכל פריט מציין רשימה של עמודות שרוצים לכלול מטבלה ספציפית, בפורמט הבא:
DATABASE_NAME.SCHEMA_NAME.TABLE_NAME(COLUMN_LIST)
מחליפים את מה שכתוב בשדות הבאים:
DATABASE_NAME: מסד הנתונים שמכיל את העמודות שרוצים להוסיף למאגר העמודות.
SCHEMA_NAME: הסכימה שמזהה את הטבלאות או את התצוגות החומריות שרוצים להוסיף למאגר העמודות, לדוגמה
public.TABLE_NAME: הטבלה או התצוגה החומרית שמכילות את העמודות שרוצים להוסיף למאגר העמודות.
COLUMN_LIST: רשימה מופרדת בפסיקים של העמודות שרוצים להוסיף למאגר העמודות.
כדי להוסיף את כל העמודות של טבלה או תצוגה חומרית, משמיטים את רשימת העמודות:
DATABASE_NAME.SCHEMA_NAME.TABLE_NAME
תחביר SQL כשמשתמשים ב-google_columnar_engine.relations
בדוגמה הבאה מוצג שימוש בפקודה ALTER SYSTEM כדי להוסיף שתי עמודות בסכימה public למאגר העמודות.
ALTER SYSTEM SET google_columnar_engine.relations='DATABASE_NAME.public.TABLE_NAME(COLUMN_1,COLUMN_2)';הסרת עמודות באמצעות דגלים
כדי להסיר עמודות ממאגר העמודות, מגדירים ערך חדש לדגל google_columnar_engine.relations שמתואר בקטע הקודם, ומשמיטים את העמודות שרוצים להסיר.
כדי להסיר את כל העמודות ממאגר העמודות, מבטלים את ההגדרה של הדגל google_columnar_engine.relations.
מידע נוסף על הגדרת דגלים של מסד נתונים זמין במאמר הגדרת דגלים של מסד נתונים ב-AlloyDB Omni.
ניהול תוכן של מאגר עמודות באמצעות פונקציות SQL
אפשר לנהל את התוכן של מאגר העמודות באופן ידני באמצעות פונקציות SQL.
הערכת דרישות השטח לאחסון עמודות
מריצים את פונקציית ה-SQL google_columnar_engine_estimate כדי להעריך את כמות השטח הכוללת שנדרשת ליחס במנוע מבוסס-עמודות.
לקוח psql
SELECT google_columnar_engine_estimate(
relation => 'TABLE_NAME',
columns => 'COLUMN_LIST'
);
-
מחליפים את מה שכתוב בשדות הבאים:
-
TABLE_NAME: מחרוזת שמכילה את השם של הטבלה או התצוגה החומרית. אם הטבלה או התצוגה נמצאות בסכימה שאינה public, מציינים את שם הסכימה, נקודה ואת שם הטבלה או התצוגה. לדוגמה,'myschema.mytable'. -
COLUMN_LIST: מחרוזת שמכילה רשימה מופרדת בפסיקים של שמות העמודות שרוצים להוסיף. הרשימה תלוית-אותיות רישיות. אם רוצים להוסיף את כל העמודות בטבלה או בתצוגה החומרית לחנות העמודות, משמיטים את הפרמטר הזה.
הוספת עמודות באמצעות פונקציות SQL
מריצים את פונקציית ה-SQL google_columnar_engine_add כדי להוסיף עמודות למאגר העמודות.
השיטה הזו מוסיפה את העמודות שצוינו למאגר העמודות ומנהלת את העמודות רק בצומת המקושר. העמודות החדשות לא נשמרות בחנות אחרי הפעלה מחדש של המופע.
השיטה הזו לא משנה את הדגל של מסד הנתונים google_columnar_engine.relations. הפיכה אוטומטית של נתונים לעמודות לא מתייחסת לעמודות שנוספו באמצעות פונקציית ה-SQL הזו.
לקוח psql
SELECT google_columnar_engine_add(
relation => 'TABLE_NAME',
columns => 'COLUMN_LIST'
);
-
מחליפים את מה שכתוב בשדות הבאים:
- 'TABLE_NAME': מחרוזת שמכילה את שם הטבלה או התצוגה החומרית. אם הטבלה או התצוגה נמצאות בסכימה שאינה
public, מציינים את שם הסכימה, נקודה ואת שם הטבלה או התצוגה. לדוגמה:'myschema.mytable'. - 'COLUMN_LIST': מחרוזת שמכילה רשימה של שמות העמודות שרוצים להוסיף, מופרדים בפסיקים, תוך הבחנה בין אותיות רישיות לאותיות קטנות. אם רוצים להוסיף את כל העמודות בטבלה או בתצוגה החומרית למאגר העמודות, משמיטים את הפרמטר הזה.
הסרת עמודות באמצעות פונקציות SQL
מריצים את פונקציית ה-SQL google_columnar_engine_drop באופן הבא:
לקוח psql
SELECT google_columnar_engine_drop(
relation => 'TABLE_NAME',
columns => 'COLUMN_LIST'
);
- 'TABLE_NAME': מחרוזת שמכילה את שם הטבלה או התצוגה החומרית. אם הטבלה או התצוגה נמצאות בסכימה שאינה
public, מציינים את שם הסכימה, נקודה ואת שם הטבלה או התצוגה. לדוגמה:'myschema.mytable'. - 'COLUMN_LIST': מחרוזת שמכילה רשימה של שמות העמודות שרוצים להוסיף, מופרדים בפסיקים, תוך הבחנה בין אותיות רישיות לאותיות קטנות. אם רוצים להוסיף את כל העמודות בטבלה או בתצוגה החומרית למאגר העמודות, משמיטים את הפרמטר הזה.
אפשר להשתמש בפונקציה google_columnar_engine_drop כדי להסיר עמודות שנוספו על ידי עריכת הדגל google_columnar_engine.relations של מסד הנתונים. עם זאת, כשעושים את זה, העמודות האלה מתווספות חזרה למאגר העמודות כשהמופע מופעל מחדש.
ניהול אינדקסים של ScaNN במנוע מבוסס-עמודות
כדי להאיץ את החיפוש הווקטורי, אפשר לטעון אינדקסים של ScaNN למטמון האינדקס של המנוע מבוסס-העמודות.
הוספה, הסרה ואימות של אינדקסים של ScaNN באמצעות פונקציות SQL
אתם יכולים להוסיף, להסיר ולאמת ידנית אינדקסים של ScaNN ממטמון האינדקס באמצעות פונקציות SQL. הוספת אינדקס למטמון יכולה להאיץ שאילתות של חיפוש וקטורים.
הוספת אינדקס ScaNN
כדי להוסיף אינדקס ספציפי למטמון האינדקס של מנוע העמודות, משתמשים בפונקציית ה-SQL הבאה:
SELECT google_columnar_engine_add_index(index => 'SCANN_INDEX_NAME');
מחליפים את SCANN_INDEX_NAME בשם של אינדקס ScaNN שרוצים להוסיף למטמון האינדקס של מנוע העמודות.
הסרה של אינדקס ScaNN
כדי להסיר אינדקס ScaNN ספציפי ממנוע מבוסס-עמודות, משתמשים בפונקציית ה-SQL הבאה:
SELECT google_columnar_engine_drop_index(index => 'SCANN_INDEX_NAME');
מחליפים את SCANN_INDEX_NAME בשם של אינדקס ScaNN שרוצים להסיר.
אימות השימוש במנוע העמודות
כדי לבדוק אם הסריקות של אינדקס הווקטורים משתמשות במנוע העמודות, מריצים את הפקודה EXPLAIN ANALYZE עם האפשרות COLUMNAR_ENGINE:
EXPLAIN (ANALYZE TRUE, SCANN TRUE, COSTS FALSE, TIMING FALSE, SUMMARY FALSE, VERBOSE FALSE, COLUMNAR_ENGINE TRUE)
SELECT * FROM t ORDER BY val <=> '[0.5,0.5,0.5,0.5]' LIMIT 100;
הפקודה מחזירה תוכנית שאילתה שדומה לזו:
Index Scan using t_ix3 on t t_1 (actual rows=100 loops=1)
Order By: (val <=> '[0.5,0.5,0.5,0.5]'::vector)
Limit: 100
ScaNN Info: (... columnar engine nodes hit=6...)
Columnar Engine ScaNN Info: (index found=true)
הנוכחות של columnar engine nodes hit ושל Columnar Engine ScaNN Info: (index found=true) בפלט מאשרת שהמנוע מבוסס-העמודות משמש לשאילתה.