Suche in Knowledge Catalog

Mit der Knowledge Catalog-Suche (ehemals Dataplex Universal Catalog) können Sie Ressourcen in Ihrer Organisation mithilfe von Suchanfragen in natürlicher Sprache mit semantischem Abgleich, Keywords und strukturierten Prädikaten finden.

Anwendungsfälle

In der folgenden Liste werden häufige Anwendungsfälle für die Suche mit Beschreibungen und Beispielabfragen beschrieben:

  • Gezielte Suche nach Assets: Suchen Sie nach einem bestimmten Asset, indem Sie nach Keywords suchen, die sich auf den Asset-Namen, die Spalten oder die Beschreibung beziehen.

    Beispielabfragen

    • retail_transactions_2026
    • customer_id
    • column:customer_id
  • Umfassende Datenerkennung: Identifizieren Sie relevante Assets in Ihrer Organisation mit offenen Suchanfragen in natürlicher Sprache oder mit Keywords.

    Beispielabfragen

    • quarterly financial reports
    • ad campaign click through rates tables
    • server health metrics
    • audit logs system=bigquery
  • Abruf von Assets für Workflows: Listen Sie Assets in einem bestimmten Container wie einem Projekt oder mit bestimmten Eigenschaften wie Typ oder System auf. Dieser Ansatz wird häufig für programmatische und agentische Workflows verwendet.

    Beispielabfragen

    • type=table projectid:banking-prod aspect:classification.tier=PII
    • system=spanner projectid:inventory-service (parent=marketing_analytics OR parent=finance_analytics)

Funktionsweise

Bei der Suche wird automatisch der gesamte Kontext für Daten-Assets indexiert, die in Knowledge Catalog verwaltet werden. Der Support umfasst

  • Metadaten, die automatisch aus Google Cloud Datenquellen wie BigQuery und Cloud SQL aufgenommen werden
  • Kontext für Ressourcen, die Sie über Connectors und Integrationen aufnehmen
  • Zusätzlicher Kontext, den Sie für Ressourcen erstellen, z. B. zur Darstellung des geschäftlichen Kontexts oder zur Beschreibung der Datensemantik. Der Kontext kann auch in Form von Aspekten erfasst oder mit geschäftlichen Begriffen verknüpft werden.

Bei der Verarbeitung Ihrer Abfrage wird eine Kombination aus semantischem Abgleich und Keyword-Abgleich angewendet. In der folgenden Tabelle werden die Abfragetypen beschrieben, die Sie mit der Knowledge Catalog-Suche verwenden können, zusammen mit Beschreibungen und Beispielabfragen:

Abfragetyp Nutzung Beispiele
Einzelnes Keyword Für genaue Übereinstimmungen und Teilstring-Übereinstimmungen in Metadatenelementen wie Asset-Name, Beschreibung und Schema. prd_fin_invoices_fct_v02
Teilweise Keywords und tokenisierte Fragmente Gibt Übereinstimmungen mit Teilstrings im Metadateninhalt zurück und findet Ressourcen auch bei abgekürzten Begriffen, getrennten Wörtern oder Namensvariationen. fin transactions 2026 (entspricht prd_fin_transactions_fy2026_raw)
Suchanfragen in natürlicher Sprache Verwendet den semantischen Abgleich, ohne dass genaue Übereinstimmungen mit Namen oder Spalten erforderlich sind. customer churn prediction features
Strukturierte Prädikate Kombiniert Freitextabfragen mit expliziten Prädikatfiltern, um die Suchergebnisse einzugrenzen. audit logs system=bigquery
Erweiterte Syntax Für eine präzise Suche, die auf einen bestimmten Bereich eingegrenzt ist. Die erweiterte Syntax wird am häufigsten in agentischen und programmatischen Anwendungsfällen verwendet. Weitere Informationen finden Sie unter Suchsyntax. (system:bigquery OR system:spanner) AND column:credit_card_number aspect:classification.tier=PII -projectid:sandbox-project

Sie haben folgende Möglichkeiten, auf die Suche in Knowledge Catalog zuzugreifen:

Suchbereich

Die Suchergebnisse in Knowledge Catalog berücksichtigen die Berechtigungen, die Sie für die entsprechenden Ressourcen in Quellsystemen haben.

Wenn Sie beispielsweise BigQuery-Metadaten-Lesezugriff auf ein Objekt haben, wird dieses Objekt in Ihren Knowledge Catalog-Suchergebnissen angezeigt. Wenn Sie Zugriff auf eine BigQuery-Tabelle, aber nicht auf das Dataset haben, das diese Tabelle enthält, wird die Tabelle trotzdem in der Knowledge Catalog-Suche wie erwartet angezeigt.

Standardmäßig ist die Suche auf Ihre Organisation beschränkt. Die Ergebnisse enthalten nur Ressourcen aus derselben Organisation wie das Projekt, in dem Sie suchen.

Die Suchergebnisse enthalten nur Ressourcen, die zum selben VPC Service Controls-Perimeter gehören wie das Projekt, unter dem die Suche ausgeführt wird. Wenn Sie die Google Cloud Console verwenden, ist dies das Projekt, das in der Console ausgewählt ist.

Wenn Sie den Bereich Ihrer Suchergebnisse über die Ressourcen im VPC Service Controls-Perimeter Ihres Projekts hinaus erweitern möchten, verwenden Sie VPC Service Controls-Regeln für ein- und ausgehenden Traffic. Diese Regeln erleichtern den privaten und effizienten Datenaustausch in Ihrer Organisation. Sie können Regeln für ein- und ausgehenden Traffic über die Google Cloud Console oder über JSON- oder YAML-Dateien konfigurieren. Sehen Sie sich das folgende YAML Beispiel an und lesen Sie die VPC Service Controls-Dokumentation , um die Regel an Ihre spezifischen Anforderungen anzupassen.

egressPolicies:
  - egressFrom:
      identityType: ANY_USER_ACCOUNT
    egressTo:
      # Specify which resources should be present in the search results. In this example,
      # BigQuery.
      operations:
      - methodSelectors:
        - method: '*'
        serviceName: bigquery.googleapis.com
      # Specify project ids under which the search is performed.
      resources:
      - projects/SEARCH_PROJECT_ID
ingressPolicies:
  - ingressFrom:
      identityType: ANY_USER_ACCOUNT
      sources:
      - accessLevel: '*'
    ingressTo:
      # Specify which resources should be present in the search results. In this example,
      # BigQuery.
      operations:
      - methodSelectors:
        - method: '*'
        serviceName: bigquery.googleapis.com
      # Specify project ids to expose in search results.
      resources:
      - projects/INGRESS_PROJECT_ID

Weitere Informationen zu den IAM-Rollen (Identity and Access Management), die Sie für die Knowledge Catalog-Suche benötigen, finden Sie unter IAM-Rollen für Knowledge Catalog.

Suchergebnisse mit VPC Service Controls nach Umgebung isolieren

Wenn Sie Knowledge Catalog-Suchergebnisse zwischen Umgebungen wie Entwicklung, Test und Produktion isolieren möchten, konfigurieren Sie separate VPC Service Controls-Perimeter für jede Umgebung. Weisen Sie sowohl die Projekte mit den Daten-Assets als auch die Projekte, die für die Suche verwendet werden, dem Perimeter der entsprechenden Umgebung zu. Bei Suchanfragen, die von einem Projekt innerhalb eines bestimmten Perimeters ausgeführt werden, werden nur Ergebnisse für Assets zurückgegeben, die sich innerhalb desselben Perimeters befinden.

Einschränkungen der Trefferquote bei der Suche

Knowledge Catalog-Suchabfragen garantieren keine vollständige Trefferquote. Das bedeutet, dass die Suche möglicherweise keine Ergebnisse zurückgibt, die Ihrer Abfrage entsprechen. Außerdem können die zurückgegebenen (und nicht zurückgegebenen) Ergebnisse variieren, wenn Sie Suchabfragen wiederholen.

Wenn Sie alle Knowledge Catalog-Metadaten abfragen möchten, können Sie die Metadaten nach Cloud Storage exportieren und dann in BigQuery abfragen. Weitere Informationen finden Sie unter Metadaten exportieren.

Nächste Schritte