Ce document explique comment créer un ensemble de données BigQuery associé dans un bucket de journaux. Vous pouvez ensuite utiliser les services BigQuery tels que BigQuery Studio, Data Studio et l'API BigQuery pour interroger l'ensemble de données associé. Un ensemble de données BigQuery associé est un ensemble de données BigQuery en lecture seule qui sert de pointeur vers votre bucket de journaux. Il vous permet d'utiliser les services BigQuery pour interroger vos données de journaux sans dupliquer les données ni payer de stockage distinct dans BigQuery.
Vous ne pouvez pas créer d'ensemble de données associé à BigQuery pour une vue Analytics.
Si vous ne connaissez pas l'analyse de l'observabilité, consultez la présentation de l'analyse de l'observabilité.
Quand avez-vous besoin d'un ensemble de données associé ?
Vous n'avez pas besoin d'un ensemble de données BigQuery associé lorsque vous souhaitez interroger vos données de journaux, ou vos données de journaux et de trace. Dans ce cas, vous pouvez utiliser la page Observability Analytics. Vous pouvez également enregistrer et partager vos requêtes, et les enregistrer dans un tableau de bord personnalisé. Pour savoir comment interroger vos données de trace, consultez Interroger et analyser des traces.
Vous avez besoin d'un ensemble de données BigQuery associé lorsque vous souhaitez effectuer l'une des opérations suivantes :
- Joignez les données des entrée de journal à d'autres ensembles de données BigQuery.
- Interrogez les données de journaux d'un autre service, comme BigQuery Studio ou Data Studio.
- Créez une règle d'alerte qui surveille le résultat d'une requête SQL. Pour en savoir plus, consultez Surveiller les résultats de vos requêtes SQL avec une règle d'alerte.
Un ensemble de données BigQuery associé à un bucket de journaux permet à BigQuery de lire les données du bucket de journaux.
Correspondance entre les buckets et les vues de journaux et les objets BigQuery
Lorsque vous créez un ensemble de données BigQuery associé pour un bucket de journaux, un nouvel ensemble de données devient disponible dans BigQuery. Vous spécifiez le nom de l'ensemble de données associé lors du processus d'association. Toutes les vues de journaux du bucket de journaux sont automatiquement mappées aux vues virtuelles de l'ensemble de données. Le nom d'une vue virtuelle est identique à celui de la vue de journal correspondante.
Par exemple, supposons que le projet my_project comporte un bucket de journaux nommé example et que ce bucket de journaux comporte une vue de journaux nommée _AllLogs. Si vous créez un ensemble de données associé pour ce bucket de journaux avec le nom my_dataset, la page Explorateur de BigQuery affiche une entrée my_project.
Un enfant de l'entrée my_project est un ensemble de données nommé my_dataset, et cet ensemble de données liste une vue virtuelle nommée _AllLogs.
Implications du contrôle des accès lors de l'utilisation d'ensembles de données associés
Lorsqu'un principal interroge une vue sur un ensemble de données BigQuery associé, cette requête s'exécute via la couche d'autorisation BigQuery, et non via la couche d'autorisation Cloud Logging. Par conséquent, les rôles et autorisations BigQuery accordés au compte principal sur l'ensemble de données associé déterminent s'il peut interroger l'ensemble de données.
Vous ne pouvez pas limiter un principal à une vue virtuelle spécifique dans un ensemble de données associé. Lorsqu'un principal a obtenu l'accès à l'ensemble de données associé, il peut interroger chaque vue de cet ensemble de données.
Actions système qui se produisent lorsque vous créez un ensemble de données associé
Lorsque vous créez un ensemble de données associé, vous lancez une opération de longue durée. Plusieurs actions se produisent lors de cette opération :
- Les journaux d'audit enregistrent la demande de création d'un lien et la fin de l'opération.
Lorsque le compte de service Monitoring n'existe pas, Google Cloud Observability le crée.
Pour créer ce compte de service, vous devez activer l'API Cloud Monitoring.
Google Cloud Observability nécessite un compte de service avant de pouvoir créer un ensemble de données associé. Si nécessaire, un compte de service est créé :
Compte de service Cloud Observability : requis pour un lien vers un ensemble de données d'observabilité.
Compte de service Cloud Logging : requis pour un lien vers un bucket de journaux.
Un journal d'audit enregistre la demande du gestionnaire d'agents de service visant à accorder au compte de service Monitoring le rôle IAM Agent de service Monitoring.
Avant de commencer
-
In the Google Cloud console, on the project selector page, select or create a Google Cloud project.
Roles required to select or create a project
- Select a project: Selecting a project doesn't require a specific IAM role—you can select any project that you've been granted a role on.
-
Create a project: To create a project, you need the Project Creator role
(
roles/resourcemanager.projectCreator), which contains theresourcemanager.projects.createpermission. Learn how to grant roles.
-
Verify that billing is enabled for your Google Cloud project.
-
Pour obtenir les autorisations nécessaires pour créer un ensemble de données associé, demandez à votre administrateur de vous accorder le rôle IAM Rédacteur de configuration des journaux (
roles/logging.configWriter) sur votre projet. Pour en savoir plus sur l'attribution de rôles, consultez Gérer l'accès aux projets, aux dossiers et aux organisations.Vous pouvez également obtenir les autorisations requises avec des rôles personnalisés ou d'autres rôles prédéfinis.
Assurez-vous que votre bucket de journaux a été mis à niveau pour utiliser Observability Analytics :
-
Dans la console Google Cloud , accédez à la page Stockage des journaux :
Accéder à la page Stockage des journaux
Si vous utilisez la barre de recherche pour trouver cette page, sélectionnez le résultat dont le sous-titre est Logging.
- Si le bucket de journaux affiche Mettre à niveau, cliquez sur Mettre à niveau et remplissez la boîte de dialogue.
-
Créer un ensemble de données BigQuery associé
Si vous souhaitez utiliser les fonctionnalités de BigQuery pour analyser vos données de journaux, mettez à niveau un bucket de journaux pour utiliser Observability Analytics, puis créez un ensemble de données associé. Avec cette configuration, Logging stocke vos données de journaux, mais BigQuery peut les lire.
Console Google Cloud
Pour créer un lien vers un ensemble de données BigQuery pour un bucket de journaux existant, procédez comme suit :
-
Dans la console Google Cloud , accédez à la page Stockage des journaux :
Accéder à la page Stockage des journaux
Si vous utilisez la barre de recherche pour trouver cette page, sélectionnez le résultat dont le sous-titre est Logging.
Localisez le bucket de journaux et vérifiez que la colonne Analyse de journaux disponible affiche Ouvrir.
Si la colonne affiche Mettre à niveau, cela signifie que le bucket de journaux n'a pas été mis à niveau pour utiliser Observability Analytics. Configurer Observability Analytics :
- Cliquez sur Mettre à niveau.
- Cliquez sur Confirmer dans la boîte de dialogue.
Une fois la mise à niveau terminée, passez à l'étape suivante.
Sur le bucket de journaux, cliquez sur Plusmore_vert, puis sur Modifier le bucket.
La boîte de dialogue Modifier le bucket de journaux s'ouvre.
Sélectionnez Créer un ensemble de données BigQuery associé à ce bucket, puis saisissez le nom du nouvel ensemble de données.
Le nom de l'ensemble de données doit être unique pour chaque Google Cloud projet. Si vous saisissez le nom d'un ensemble de données existant, l'erreur suivante s'affiche :
Dataset name must be unique in the selected region.Cliquez sur OK, puis sur Mettre à jour le bucket.
Une fois que Logging affiche le nom de l'ensemble de données associé sur la page Stockage des journaux, BigQuery peut mettre plusieurs minutes à reconnaître l'ensemble de données.
gcloud
Pour créer un ensemble de données associé à un bucket de journaux mis à niveau pour utiliser Observability Analytics, exécutez la commande gcloud logging links create :
gcloud logging links create LINK_ID --bucket=BUCKET_ID --location=LOCATION
Le LINK_ID que vous fournissez est utilisé comme nom de l'ensemble de données BigQuery. La valeur de ce champ doit être unique pour votre projet Google Cloud .
La commande links create est asynchrone. La réponse d'une méthode asynchrone est un objet Operation, qui contient des informations sur la progression de la méthode. Une fois la méthode terminée, l'objet Operation contient l'état. Pour en savoir plus, consultez Méthodes d'API asynchrones.
L'exécution de la commande links create prend plusieurs minutes.
Par exemple, la commande suivante crée un ensemble de données associé nommé mylink pour le bucket de journaux nommé my-bucket :
gcloud logging links create mylink --bucket=my-bucket --location=global
Le nom de l'ensemble de données doit être unique pour chaque Google Cloud projet. Si vous essayez de créer un ensemble de données portant le même nom qu'un ensemble de données existant, l'erreur suivante s'affiche :
BigQuery dataset with name "LINK_ID" already exists.
Si vous essayez de créer un ensemble de données associé pour un bucket de journaux qui n'a pas été mis à niveau pour utiliser l'analyse de l'observabilité, l'erreur suivante s'affiche :
A link can only be created for an analytics-enabled bucket.
REST
Pour créer un ensemble de données BigQuery associé à un bucket de journaux existant qui a été mis à niveau pour utiliser Observability Analytics, appelez la méthode asynchrone projects.locations.buckets.links.create de l'API Cloud Logging.
Préparez les arguments de la méthode comme suit :
- Créez le corps de la requête pour la commande
create. Le corps de la requête est mis en forme en tant qu'objetLink. - Pour le paramètre de requête de la commande, utilisez
linkId=LINK_ID. Le LINK_ID que vous fournissez est utilisé comme nom de l'ensemble de données BigQuery. La valeur de ce champ doit être unique pour votre projet Google Cloud .
La réponse aux méthodes asynchrones est un objet Operation. Cet objet contient des informations sur la progression de la méthode. Une fois la méthode terminée, l'objet Operation contient l'état. Pour en savoir plus, consultez Méthodes d'API asynchrones.
L'exécution de la méthode links.create prend plusieurs minutes.
Le nom de l'ensemble de données doit être unique pour chaque Google Cloud projet. Si vous essayez de créer un ensemble de données portant le même nom qu'un ensemble de données existant, l'erreur suivante s'affiche :
BigQuery dataset with name "LINK_ID" already exists.
Si vous essayez de créer un ensemble de données associé pour un bucket de journaux qui n'a pas été mis à niveau pour utiliser l'analyse de l'observabilité, l'erreur suivante s'affiche :
A link can only be created for an analytics-enabled bucket.