במסמך הזה מוסבר על התחביר של חיפוש ב-Knowledge Catalog.
בעזרת Knowledge Catalog תוכלו לגלות את הנתונים של הארגון, לקטלג אותם באופן מרכזי, לנהל אותם ולהבין אותם. כדי למצוא ביעילות נכסי נתונים ספציפיים ב-Data Catalog, אפשר להשתמש בשאילתות חיפוש מתקדמות. התחביר של שאילתות חיפוש כולל:
- חיפוש פשוט: איך מוצאים נכסי נתונים באמצעות מונח חיפוש יחיד.
- פסוקיות תנאי: איך לחדד את החיפוש באמצעות שדות מטא-נתונים ספציפיים כמו שם, מיקום או תיאור.
- חיפוש לפי מאפיינים: איך לחפש רשומות על סמך המטא-נתונים העסקיים והטכניים שמצורפים אליהן.
- אופרטורים לוגיים: איך משלבים כמה קריטריונים לחיפוש באמצעות AND ו-OR כדי ליצור שאילתות מורכבות. ההבנה של התחביר הזה מאפשרת לכם לאתר במהירות את הנתונים שאתם צריכים.
לפני שמתחילים
הסבר על קבוצות של רשומות, רשומות, קישורי רשומות, היבטים, סוגי רשומות, סוגי קישורי רשומות וסוגי היבטים ב-Knowledge Catalog. מידע נוסף על ניהול מטא-נתונים ב-Knowledge Catalog
Knowledge Catalog מציע חיפוש שמבוסס על AI כדי להבין שאילתות בשפה טבעית ומשמעות סמנטית. הוא מאפשר לכם למצוא משאבים באמצעות שפה יומיומית, בלי שתצטרכו להשתמש בתחביר מורכב, וגם תומך בהתאמה למילות מפתח ובמסננים.
שימוש בחיפוש בטקסט חופשי
אתם יכולים למצוא נכסים על ידי הזנת מונח או ביטוי ללא תחביר ספציפי. Knowledge Catalog מבצע חיפוש רחב על ידי התאמת השאילתה שלכם לכמה שדות מטא-נתונים, כולל:
- שם, שם מוצג או תיאור של משאב
- סוג המשאב
- מזהה פרויקט
- תיאור כללי
- שם העמודה (או שם העמודה המקוננת) בסכימה של משאב
- תיאור עמודה
- שם מוגדר במלואו
- אנשי קשר
- היבטים
שימוש בתחביר של שאילתות
כדי לבצע חיפושים מדויקים יותר, אפשר ליצור שאילתה באמצעות תחביר ספציפי, כולל מסננים, אופרטורים לוגיים וחיפושים של היבטים.
פסוקיות תנאי כשירות
אפשר להוסיף תנאי למאפיין על ידי הוספת מפתח לפניו שמגביל את ההתאמה לקטע ספציפי של מטא-נתונים:
- סימן שווה (
=) מגביל את החיפוש להתאמה מדויקת. - נקודתיים (
:) אחרי המפתח מתאימות את התנאי למחרוזת משנה או לטוקן בתוך הערך בתוצאות החיפוש.
תהליך הטוקניזציה מפצל את זרם הטקסט לסדרה של טוקנים, כאשר כל טוקן בדרך כלל תואם למילה אחת.
לדוגמה:
-
name:fooבוחר משאבים עם שמות שמכילים את מחרוזת המשנהfoo, כמו foo1ו-barfoo. -
description:fooבוחר משאבים עם הטוקןfooבתיאור, כמוbarו-foo. -
location=foomatches resources in a specified location withfooas the location name.
ההתנהגות של המאפיינים הבולטים האלה עשויה להשתנות מעט בין מצבי החיפוש, כפי שמפורט בקטעים הבאים.
מילות המפתח של התנאי type, system, location ו-description, וחיפוש לפי מאפיין (לא כולל has) תומכים רק במאפיין ההתאמה המדויקת (=), ולא במאפיין המחרוזת המשנית (:). לדוגמה, type=foo.
חיפוש ב-Knowledge Catalog תומך במגדירי החיפוש הבאים:
| מגדיר | תיאור |
|---|---|
name:x |
התאמה ל-x כמחרוזת משנה של מזהה המשאב או השם המוצג של המשאב. |
displayname:x |
התאמה של x כמחרוזת משנה של השם המוצג של המשאב. |
column:x |
המחרוזת x תואמת למחרוזת משנה של שם העמודה (או של שם העמודה המקוננת) בסכימה של המשאב. |
description:x |
התאמות x כטוקן בתיאור המשאב. |
labels:bar |
הפונקציה מחזירה התאמה למשאבי BigQuery שיש להם תווית (עם ערך כלשהו) ומפתח התווית מכיל את המחרוזת bar. |
labels=bar |
הפונקציה מחזירה התאמה למשאבי BigQuery שיש להם תווית (עם ערך כלשהו) ומפתח התווית שווה ל-bar כמחרוזת. |
labels.bar:x |
המחרוזת x תואמת למחרוזת משנה בערך של תווית עם המפתח bar שמצורפת למשאב BigQuery. |
labels.foo=bar |
התנאי תואם למשאבי BigQuery שבהם המפתח שווה ל-foo וערך המפתח שווה ל-bar. |
type=TYPE |
התאמה למשאבים מסוג רשומה ספציפי או לכינוי הסוג שלה. |
projectid:bar |
התאמה למשאבים בתוך פרויקטים של Google Cloud שמזהה הפרויקט שלהם מכיל את המחרוזת bar. |
parent:x |
המחרוזת x תואמת למחרוזת משנה בנתיב ההיררכי של משאב. |
system=SYSTEM |
התאמה של משאבים ממערכת שצוינה. |
location=LOCATION |
הפונקציה מחפשת משאבים במיקום שצוין עם שם מדויק.
לדוגמה, נכסי BigQuery Omni תומכים במאפיין הזה באמצעות שם המיקום של BigQuery Omni.
לדוגמה,
|
createtime |
חיפוש משאבים שנוצרו בטווח תאריכים או שעות מסוים, לפני או אחרי תאריך או שעה מסוימים. לדוגמה:
הפורמט של חותמת הזמן: כל חותמות הזמן צריכות להיות בפורמט GMT. אין תמיכה באזורי זמן. יש תמיכה בחותמות זמן חלקיות, במפרידי תאריכים עם מקף ( לדוגמה:
|
updatetime |
חיפוש משאבים שעודכנו בטווח תאריכים או שעות מסוים, לפני או אחרי תאריך או שעה מסוימים. לדוגמה:
הפורמט של חותמת הזמן: כל חותמות הזמן צריכות להיות בפורמט GMT. אין תמיכה באזורי זמן. יש תמיכה בחותמות זמן חלקיות, במפרידי תאריכים עם מקף ( לדוגמה:
|
חיפוש לפי היבט
אפשר להשתמש בתחביר של שאילתות כדי לחפש רשומות לפי ההיבטים שצורפו אליהן.
התאמת מחרוזת המשנה מנסה להתאים למספר מוגבל של היבטים. אם לא הצלחתם למצוא את הרשומה באמצעות קטע מהנתיב, השתמשו בנתיב המלא כדי לצמצם את החיפוש ולהגדיל את ההחזרה.
| מגדיר | תיאור |
|---|---|
aspect:xאו has:x |
המחרוזת x מופיעה כרצף משנה בנתיב המלא של סוג ההיבט של היבט שמצורף לרשומה, בפורמט
projectid.location.ASPECT_TYPE_ID |
aspect=xאו has=x |
התאמה ל-x בתור הנתיב המלא לסוג ההיבט של היבט שמצורף לרשומה, בפורמט projectid.location.ASPECT_TYPE_ID |
x |
חיפוש ערכים של שדות מאפיינים. התאמה ל-
אפשר לחפש רק בשדות ברמה העליונה של ההיבט. |
אופרטורים לוגיים
שאילתה יכולה לכלול כמה פרדיקטים עם אופרטורים לוגיים.
- אם לא מציינים אופרטור, המערכת מניחה שמשתמשים באופרטור הלוגי
AND. לדוגמה, הפקודהfoo barמחזירה מקורות מידע שתואמים גם לפרדיקטfooוגם לפרדיקטbar. - יש תמיכה באופרטורים הלוגיים
ANDו-OR. לדוגמה,foo OR bar. - אפשר לשלול פסוקית באמצעות הקידומת
-(מקף) אוNOT. לדוגמה,-name:fooמחזירה משאבים עם שמות שלא תואמים לפרדיקטfoo.
תחביר מקוצר
יש גם תחביר מקוצר לחיפוש, שבו משתמשים ב-| (קו אנכי) לאופרטורים OR וב-, (פסיק) לאופרטורים AND.
לדוגמה, כדי לחפש רשומות באחד מתוך כמה פרויקטים באמצעות האופרטור OR, אפשר להשתמש בתחביר המקוצר הבא:
projectid:(id1|id2|id3|id4)
אותו חיפוש ללא שימוש בתחביר מקוצר נראה כך:
projectid:id1 OR projectid:id2 OR projectid:id3 OR projectid:id4
כדי לחפש רשומות עם שמות עמודות תואמים, משתמשים ב:
- AND:
column:(name1,name2,name3) - OR:
column:(name1|name2|name3)
התחביר המקוצר הזה פועל עבור הפרדיקטים המוסמכים, למעט label בחיפוש מילות מפתח.
חיפוש לפי מילות מפתח בלבד
Knowledge Catalog מספק מצב חיפוש של מילות מפתח בלבד לצורך תאימות לדורות קודמים, ומצב החיפוש הרגיל תומך בהתאמה סמנטית ובהתאמה למילות מפתח. מומלץ להשתמש במצב חיפוש רגיל, אלא אם נדרש חיפוש של מילות מפתח בלבד לצורך תאימות לאחור.
בטבלה הבאה מפורטים ההבדלים העיקריים במאפייני ההתאמה שצריך לקחת בחשבון כשמשתמשים בחיפוש לפי מילות מפתח בלבד.
| מגדיר | ההבדלים העיקריים |
|---|---|
name:x |
ההתאמה ל-x היא רק כמחרוזת משנה של מזהה המשאב. |
label qualifiers |
משתמש בקידומת
|
orgid=number |
התאמה למשאבים ב Google Cloud ארגון עם
ערך המזהה המדויק של number, נתמך רק בחיפוש
של מילות מפתח בלבד. |
fully_qualified_name |
תומך ב-fully_qualified_name:x (התאמה למחרוזת משנה)
וב-fully_qualified_name=x (התאמה מדויקת) (נתמך
רק בחיפוש של מילות מפתח בלבד). |
createtime וגם updatetime |
תומך רק בתאריך מדויק (:) ובהשוואה בסיסית
(<, >). לא תומך במסנני זמן יחסיים (כמו -30d או -1d) או באופרטורים להשוואה כמו <=, >=, =, => ו-=<. |
| הגבלה של התאמה מדויקת | מפתחות החיזוי type, system,
location ו-orgid תומכים רק בהתאמה מדויקת (=), ולא בהתאמה של מחרוזת משנה (:). |
חיפוש היבטים לחיפוש מילות מפתח בלבד
בטבלה הבאה מסוכמים ההבדלים העיקריים בחיפוש לפי היבט שצריך לקחת בחשבון כשמשתמשים בחיפוש לפי מילת מפתח בלבד.
| אלמנט חיפוש של היבט | ההבדלים העיקריים |
|---|---|
| קידומת של מגדיר | תמיכה בערכים aspect: ו-aspect=. אין תמיכה ב-has: או ב-has=. |
| תחביר לחיפוש ערכים בשדה מאפיין | כשמחפשים ערכים של שדות מאפיינים, צריך להשתמש בתחילית aspect: (הפורמט: aspect:x OPERATOR value, למשל aspect:employee-info.is-enrolled=true או aspect:employee=true). |
| אופרטורים של שדות מחרוזת | שדות מחרוזת תומכים בהתאמה מדויקת (=) ובהתאמה למחרוזת משנה (:). |
| קיצורים של סוגי היבטים במערכת | אין תמיכה בקיצורי דרך של סוגי היבטים במערכת, כמו
ASPECT_TYPE_ID.FIELD_NAME או
dataplex-types...). |