תחביר החיפוש ב-Knowledge Catalog

במסמך הזה מוסבר על התחביר של חיפוש ב-Knowledge Catalog.

בעזרת Knowledge Catalog תוכלו לגלות את הנתונים של הארגון, לקטלג אותם באופן מרכזי, לנהל אותם ולהבין אותם. כדי למצוא ביעילות נכסי נתונים ספציפיים ב-Data Catalog, אפשר להשתמש בשאילתות חיפוש מתקדמות. התחביר של שאילתות חיפוש כולל:

  • חיפוש פשוט: איך מוצאים נכסי נתונים באמצעות מונח חיפוש יחיד.
  • פסוקיות תנאי: איך לחדד את החיפוש באמצעות שדות מטא-נתונים ספציפיים כמו שם, מיקום או תיאור.
  • חיפוש לפי מאפיינים: איך לחפש רשומות על סמך המטא-נתונים העסקיים והטכניים שמצורפים אליהן.
  • אופרטורים לוגיים: איך משלבים כמה קריטריונים לחיפוש באמצעות AND ו-OR כדי ליצור שאילתות מורכבות. ההבנה של התחביר הזה מאפשרת לכם לאתר במהירות את הנתונים שאתם צריכים.

לפני שמתחילים

הסבר על קבוצות של רשומות, רשומות, קישורי רשומות, היבטים, סוגי רשומות, סוגי קישורי רשומות וסוגי היבטים ב-Knowledge Catalog. מידע נוסף על ניהול מטא-נתונים ב-Knowledge Catalog

Knowledge Catalog מציע חיפוש שמבוסס על AI כדי להבין שאילתות בשפה טבעית ומשמעות סמנטית. הוא מאפשר לכם למצוא משאבים באמצעות שפה יומיומית, בלי שתצטרכו להשתמש בתחביר מורכב, וגם תומך בהתאמה למילות מפתח ובמסננים.

אתם יכולים למצוא נכסים על ידי הזנת מונח או ביטוי ללא תחביר ספציפי. Knowledge Catalog מבצע חיפוש רחב על ידי התאמת השאילתה שלכם לכמה שדות מטא-נתונים, כולל:

  • שם, שם מוצג או תיאור של משאב
  • סוג המשאב
  • מזהה פרויקט
  • תיאור כללי
  • שם העמודה (או שם העמודה המקוננת) בסכימה של משאב
  • תיאור עמודה
  • שם מוגדר במלואו
  • אנשי קשר
  • היבטים

שימוש בתחביר של שאילתות

כדי לבצע חיפושים מדויקים יותר, אפשר ליצור שאילתה באמצעות תחביר ספציפי, כולל מסננים, אופרטורים לוגיים וחיפושים של היבטים.

פסוקיות תנאי כשירות

אפשר להוסיף תנאי למאפיין על ידי הוספת מפתח לפניו שמגביל את ההתאמה לקטע ספציפי של מטא-נתונים:

  • סימן שווה (=) מגביל את החיפוש להתאמה מדויקת.
  • נקודתיים (:) אחרי המפתח מתאימות את התנאי למחרוזת משנה או לטוקן בתוך הערך בתוצאות החיפוש.

תהליך הטוקניזציה מפצל את זרם הטקסט לסדרה של טוקנים, כאשר כל טוקן בדרך כלל תואם למילה אחת.

לדוגמה:

  • name:foo בוחר משאבים עם שמות שמכילים את מחרוזת המשנה foo, כמו ‫foo1 ו-barfoo.
  • description:foo בוחר משאבים עם הטוקן foo בתיאור, כמו bar ו-foo.
  • location=foo matches resources in a specified location with foo as the location name.

ההתנהגות של המאפיינים הבולטים האלה עשויה להשתנות מעט בין מצבי החיפוש, כפי שמפורט בקטעים הבאים.

מילות המפתח של התנאי type, system, location ו-description, וחיפוש לפי מאפיין (לא כולל has) תומכים רק במאפיין ההתאמה המדויקת (=), ולא במאפיין המחרוזת המשנית (:). לדוגמה, type=foo.

חיפוש ב-Knowledge Catalog תומך במגדירי החיפוש הבאים:

מגדיר תיאור
name:x התאמה ל-x כמחרוזת משנה של מזהה המשאב או השם המוצג של המשאב.
displayname:x התאמה של x כמחרוזת משנה של השם המוצג של המשאב.
column:x המחרוזת x תואמת למחרוזת משנה של שם העמודה (או של שם העמודה המקוננת) בסכימה של המשאב.
description:x התאמות x כטוקן בתיאור המשאב.
labels:bar הפונקציה מחזירה התאמה למשאבי BigQuery שיש להם תווית (עם ערך כלשהו) ומפתח התווית מכיל את המחרוזת bar.
labels=bar הפונקציה מחזירה התאמה למשאבי BigQuery שיש להם תווית (עם ערך כלשהו) ומפתח התווית שווה ל-bar כמחרוזת.
labels.bar:x המחרוזת x תואמת למחרוזת משנה בערך של תווית עם המפתח bar שמצורפת למשאב BigQuery.
labels.foo=bar התנאי תואם למשאבי BigQuery שבהם המפתח שווה ל-foo וערך המפתח שווה ל-bar.
type=TYPE התאמה למשאבים מסוג רשומה ספציפי או לכינוי הסוג שלה.
projectid:bar התאמה למשאבים בתוך פרויקטים של Google Cloud שמזהה הפרויקט שלהם מכיל את המחרוזת bar.
parent:x המחרוזת x תואמת למחרוזת משנה בנתיב ההיררכי של משאב.
system=SYSTEM התאמה של משאבים ממערכת שצוינה.
location=LOCATION

הפונקציה מחפשת משאבים במיקום שצוין עם שם מדויק. לדוגמה, location=us-central1 תואם לנכסים שמארחים באיווה.

נכסי BigQuery Omni תומכים במאפיין הזה באמצעות שם המיקום של BigQuery Omni. לדוגמה, ‫location=aws-us-east-1 תואם לנכסי BigQuery Omni בצפון וירג'יניה.

createtime

חיפוש משאבים שנוצרו בטווח תאריכים או שעות מסוים, לפני או אחרי תאריך או שעה מסוימים.

לדוגמה:

  • createtime:2019-01-01 תואם לכל המשאבים שנוצרו בתאריך 2019-01-01.
  • createtime<2019-02 matches all resources created before 2019-02-01T00:00:00.
  • createtime>2019-02 מתאים לכל המשאבים שנוצרו אחרי 2019-02-01T00:00:00.
  • createtime>-30d תואם לכל המשאבים שנוצרו ב-30 הימים האחרונים.
  • createtime<=-30d תואם לכל המשאבים שנוצרו לפני 30 ימים או יותר.
  • createtime<=-1d תואם לכל המשאבים שנוצרו ביום הקודם.

הפורמט של חותמת הזמן: YYYY-MM-DDThh:mm:ss

כל חותמות הזמן צריכות להיות בפורמט GMT. אין תמיכה באזורי זמן. יש תמיכה בחותמות זמן חלקיות, במפרידי תאריכים עם מקף (-) ובמפרידי תאריכים עם לוכסן (/).

לדוגמה:

  • 2010-10-22T05:36:24
  • 2010-10-22T05:36
  • 2010-10-22T05
  • 2010-10-22
  • 2010-10
  • 2010
  • 2010/10/22
updatetime

חיפוש משאבים שעודכנו בטווח תאריכים או שעות מסוים, לפני או אחרי תאריך או שעה מסוימים.

לדוגמה:

  • updatetime:2019-01-01 תואם לכל המשאבים שעודכנו ב-1 בינואר 2019.
  • updatetime<2019-02 matches all resources updated before 2019-02-01T00:00:00.
  • updatetime>2019-02 matches all resources updated after 2019-02-01T00:00:00.
  • updatetime>-30d תואם לכל המשאבים שעודכנו ב-30 הימים האחרונים.
  • updatetime<-30d matches all resources updated 30 days ago or earlier.
  • updatetime=-1d matches all resources updated on the previous day.
  • updatetime>=-30d תואם לכל המשאבים שעודכנו ב-30 הימים האחרונים.
  • updatetime<=-30d matches all resources updated 30 days ago or earlier.

הפורמט של חותמת הזמן: YYYY-MM-DDThh:mm:ss

כל חותמות הזמן צריכות להיות בפורמט GMT. אין תמיכה באזורי זמן. יש תמיכה בחותמות זמן חלקיות, במפרידי תאריכים עם מקף (-) ובמפרידי תאריכים עם לוכסן (/).

לדוגמה:

  • 2010-10-22T05:36:24
  • 2010-10-22T05:36
  • 2010-10-22T05
  • 2010-10-22
  • 2010-10
  • 2010
  • 2010/10/22

אפשר להשתמש בתחביר של שאילתות כדי לחפש רשומות לפי ההיבטים שצורפו אליהן.

התאמת מחרוזת המשנה מנסה להתאים למספר מוגבל של היבטים. אם לא הצלחתם למצוא את הרשומה באמצעות קטע מהנתיב, השתמשו בנתיב המלא כדי לצמצם את החיפוש ולהגדיל את ההחזרה.

מגדיר תיאור
aspect:x
או
has:x
המחרוזת x מופיעה כרצף משנה בנתיב המלא של סוג ההיבט של היבט שמצורף לרשומה, בפורמט projectid.location.ASPECT_TYPE_ID
aspect=x
או
has=x
התאמה ל-x בתור הנתיב המלא לסוג ההיבט של היבט שמצורף לרשומה, בפורמט projectid.location.ASPECT_TYPE_ID
x
OPERATOR
value

חיפוש ערכים של שדות מאפיינים. התאמה ל-x כמחרוזת משנה של הנתיב המלא לסוג ההיבט ולשם השדה של היבט שמצורף לרשומה, בפורמטים הבאים:

  • התחביר של סוגי היבטים של המערכת:

    • ASPECT_TYPE_ID.FIELD_NAME
    • dataplex-types.ASPECT_TYPE_ID.FIELD_NAME
    • dataplex-types.LOCATION.ASPECT_TYPE_ID.FIELD_NAME

    לדוגמה, השאילתות הבאות מתאימות לרשומות שבהן הערך של השדה type בהיבט bigquery-dataset הוא default:

    • bigquery-dataset.type=default
    • dataplex-types.bigquery-dataset.type=default
    • dataplex-types.global.bigquery-dataset.type=default
  • תחביר של סוגי היבטים בהתאמה אישית:

    • אם הנכס נוצר באזור הגלובלי: PROJECT_ID.ASPECT_TYPE_ID.FIELD_NAME
    • אם ההיבט נוצר באזור מסוים: PROJECT_ID.REGION.ASPECT_TYPE_ID.FIELD_NAME

    לדוגמה, השאילתות הבאות תואמות לרשומות שבהן הערך של השדה is-enrolled בהיבט employee-info הוא true.

    • example-project.us-central1.employee-info.is-enrolled=true
    • example-project.employee-info.is-enrolled=true

    רשימת האופרטורים הנתמכים תלויה בסוג השדה בהיבט, באופן הבא:

    • מחרוזת: = (התאמה מדויקת)
    • כל סוגי המספרים: =, :, <, >, <=, >=, =>, =<
    • Enum: =
    • Datetime: כמו במספרים, אבל הערכים להשוואה מטופלים כערכי תאריך ושעה במקום כמספרים
    • בוליאני: =

אפשר לחפש רק בשדות ברמה העליונה של ההיבט.

אופרטורים לוגיים

שאילתה יכולה לכלול כמה פרדיקטים עם אופרטורים לוגיים.

  • אם לא מציינים אופרטור, המערכת מניחה שמשתמשים באופרטור הלוגי AND. לדוגמה, הפקודה foo bar מחזירה מקורות מידע שתואמים גם לפרדיקט foo וגם לפרדיקט bar.
  • יש תמיכה באופרטורים הלוגיים AND ו-OR. לדוגמה, foo OR bar.
  • אפשר לשלול פסוקית באמצעות הקידומת - (מקף) או NOT. לדוגמה, -name:foo מחזירה משאבים עם שמות שלא תואמים לפרדיקט foo.

תחביר מקוצר

יש גם תחביר מקוצר לחיפוש, שבו משתמשים ב-| (קו אנכי) לאופרטורים OR וב-, (פסיק) לאופרטורים AND.

לדוגמה, כדי לחפש רשומות באחד מתוך כמה פרויקטים באמצעות האופרטור OR, אפשר להשתמש בתחביר המקוצר הבא:

projectid:(id1|id2|id3|id4)

אותו חיפוש ללא שימוש בתחביר מקוצר נראה כך:

projectid:id1 OR projectid:id2 OR projectid:id3 OR projectid:id4

כדי לחפש רשומות עם שמות עמודות תואמים, משתמשים ב:

  • AND: column:(name1,name2,name3)
  • OR: column:(name1|name2|name3)

התחביר המקוצר הזה פועל עבור הפרדיקטים המוסמכים, למעט label בחיפוש מילות מפתח.

Knowledge Catalog מספק מצב חיפוש של מילות מפתח בלבד לצורך תאימות לדורות קודמים, ומצב החיפוש הרגיל תומך בהתאמה סמנטית ובהתאמה למילות מפתח. מומלץ להשתמש במצב חיפוש רגיל, אלא אם נדרש חיפוש של מילות מפתח בלבד לצורך תאימות לאחור.

בטבלה הבאה מפורטים ההבדלים העיקריים במאפייני ההתאמה שצריך לקחת בחשבון כשמשתמשים בחיפוש לפי מילות מפתח בלבד.

מגדיר ההבדלים העיקריים
name:x ההתאמה ל-x היא רק כמחרוזת משנה של מזהה המשאב.
label qualifiers

משתמש בקידומת label במקום בקידומת labels. הפורמטים הנתמכים של התחביר כוללים:

  • label:bar
  • label=bar
  • label:bar:x
  • label=foo:bar
  • label.foo=bar
  • label.foo
orgid=number התאמה למשאבים ב Google Cloud ארגון עם ערך המזהה המדויק של number, נתמך רק בחיפוש של מילות מפתח בלבד.
fully_qualified_name תומך ב-fully_qualified_name:x (התאמה למחרוזת משנה) וב-fully_qualified_name=x (התאמה מדויקת) (נתמך רק בחיפוש של מילות מפתח בלבד).
createtime וגם updatetime תומך רק בתאריך מדויק (:) ובהשוואה בסיסית (<, >). לא תומך במסנני זמן יחסיים (כמו -30d או -1d) או באופרטורים להשוואה כמו <=,‏ >=,‏ =,‏ => ו-=<.
הגבלה של התאמה מדויקת מפתחות החיזוי type, system, location ו-orgid תומכים רק בהתאמה מדויקת (=), ולא בהתאמה של מחרוזת משנה (:).

חיפוש היבטים לחיפוש מילות מפתח בלבד

בטבלה הבאה מסוכמים ההבדלים העיקריים בחיפוש לפי היבט שצריך לקחת בחשבון כשמשתמשים בחיפוש לפי מילת מפתח בלבד.

אלמנט חיפוש של היבט ההבדלים העיקריים
קידומת של מגדיר תמיכה בערכים aspect: ו-aspect=. אין תמיכה ב-has: או ב-has=.
תחביר לחיפוש ערכים בשדה מאפיין כשמחפשים ערכים של שדות מאפיינים, צריך להשתמש בתחילית aspect: (הפורמט: aspect:x OPERATOR value, למשל aspect:employee-info.is-enrolled=true או aspect:employee=true).
אופרטורים של שדות מחרוזת שדות מחרוזת תומכים בהתאמה מדויקת (=) ובהתאמה למחרוזת משנה (:).
קיצורים של סוגי היבטים במערכת אין תמיכה בקיצורי דרך של סוגי היבטים במערכת, כמו ASPECT_TYPE_ID.FIELD_NAME או dataplex-types...).

המאמרים הבאים