本文档介绍了如何创建连接到 BigQuery 数据的数据存储区。您可以将此数据存储区关联到 Gemini Enterprise 应用,以允许智能体分析您的数据。
如需使用 Gemini Enterprise 数据存储区连接到 BigQuery 数据,您可以使用以下模式之一:
- 联合查询(推荐)[预览版]:连接到 BigQuery 数据,无需因复制和移动数据而产生出站费用。联合查询会将您的查询直接发送到 BigQuery,以查询您的身份有权通过 Identity and Access Management (IAM) 访问的所有数据集和表,这对于分析查询来说更高效。由于查询是使用您的凭据运行的,因此 BigQuery IAM 权限(包括行级安全性)保持不变。当您使用联合查询模式时,Gemini Enterprise 应用的助理标签页上会自动启用 Knowledge Catalog,以便为智能体提供工具来搜索用户有权访问的数据并查找上下文。
- 数据注入:将数据从特定的 BigQuery 表复制到 Gemini Enterprise 数据存储区。必须刷新数据才能反映 BigQuery 表中的更改。此模式会产生将数据移至新位置的出站流量费用,并且现有 IAM 权限不会复制到数据存储区。
准备工作
如需在 Gemini Enterprise 中创建 BigQuery 数据存储区,您必须拥有 Gemini Enterprise Admin (roles/discoveryengine.agentspaceAdmin) 或 Discovery Engine Admin (roles/discoveryengine.admin) 角色。如需了解详情,请参阅向管理员授予权限。
如果您的项目受 VPC Service Controls 边界保护或启用了组织政策强制执行,请确保您的组织政策允许连接器:
- 将
bigquery_mcp添加到discoveryengine.managed.allowedDataSources受管理的限制(限制数据连接器允许的数据源)中的allowedDataSources参数。如需了解详情,请参阅受管理的政策限制概览和配置允许的数据源。
此外,请为计划使用的连接器模式配置所需的 BigQuery IAM 权限:
联合查询
联合查询模式使用 BigQuery MCP 服务器。由于不同的 MCP 工具(操作)需要不同的权限,因此所需的 IAM 权限取决于您使用的工具。如需了解详情,请参阅 BigQuery MCP 文档中的必需的角色。
以下是用户通过连接器查询或执行操作时最常应用的 IAM 角色:
- 在执行查询的 BigQuery Google Cloud 项目(计算项目或结算项目)中拥有 BigQuery Job User (
roles/bigquery.jobUser) 角色,以便用户能够运行查询作业。 - 在存储数据的 BigQuery Google Cloud 项目(存储项目)中,为用户授予 BigQuery Data Viewer (
roles/bigquery.dataViewer) 角色,以便用户能够通过查询或 BigQuery 元数据工具(例如get_table_info)访问数据。 如果启用了写入操作,请改为授予 BigQuery Data Editor (roles/bigquery.dataEditor) 角色。 - MCP Tool User (
roles/mcp.toolUser) 对 BigQuery 存储 Google Cloud 项目和计算Google Cloud 项目都具有相应权限。
数据注入
如需从与您要创建的 Gemini Enterprise 数据存储区所在的 Google Cloud 项目不同的源 Google Cloud 项目注入数据,请在源 BigQuery 项目中向 service-PROJECT_NUMBER@gcp-sa-discoveryengine. 服务账号(其中 PROJECT_NUMBER 是包含 Gemini Enterprise 数据存储区的Google Cloud 项目的项目编号)授予以下 IAM 角色:
创建 BigQuery 数据存储区
如需创建将 BigQuery 中的数据关联到 Gemini Enterprise 的数据存储区,请按以下步骤操作:
在 Google Cloud 控制台中,前往 Gemini Enterprise 页面。
前往数据存储区页面。
点击创建数据存储区。
在来源页面上,为数据存储区选择数据源。在选择数据源搜索字段中搜索“BigQuery”,或在第一方数据源列表中找到 BigQuery。选择添加数据源。
在数据页面上,选择连接器模式,以确定如何连接到数据。根据您选择的模式,选择以下任一标签页,查看更多说明。
联合查询
数据注入
- 选择数据注入。
- 确定要导入的数据类型。在导入数据之前,请查阅准备数据以进行注入。
- 如果您要导入结构化数据,请从采用您自己的架构的 BigQuery 表或包含元数据的 BigQuery 表中进行选择。如果使用自己的架构,系统会在导入期间自动检测您的架构。如果使用元数据,您必须在导入期间定义 Google 指定的架构。
- 如果您要导入需要专门处理的数据,请从专业数据导入下的选项中进行选择。
在同步频率下,选择您希望从 BigQuery 表中导入数据的频率。数据存储区创建后,此选项便无法更改。
- 选择一次可进行单次导入。
- 选择定期以设置周期性导入时间表。
选择要导入的数据表。在 BigQuery 路径字段中,点击浏览,选择您已准备好进行注入的表,然后点击选择。或者,您也可以直接在 BigQuery 路径字段中输入表位置。
点击继续。
创建数据存储区后,您可以前往数据存储区页面,然后点击数据存储区名称,在其数据页面上查看相关详情,以检查数据注入状态。当活动标签页上的“状态”列从正在进行更改为导入已完成时,表示注入已完成。
注入过程可能需要几分钟到几小时才能完成,具体取决于数据的大小。
在配置页面上,配置数据存储区设置。
- 数据连接器的位置:选择一个区域来存储数据存储区的元数据。创建数据存储区后,便无法更改位置。如需了解有关多区域位置的重要信息,请参阅 Gemini Enterprise 位置。
- 数据连接器名称:在数据连接器名称字段中,为数据连接器输入名称。数据连接器创建后,您无法更改其名称。输入名称后,系统会为数据连接器生成一个唯一的 ID。(可选)在标记(可选)字段中,为数据连接器输入一个标记,该标记将作为连接器在所有版本中的稳定标识符。
- Sensitive Data Protection 政策:为数据存储区选择一项 Sensitive Data Protection 政策。格式应如下所示:
projects/{project}/locations/{location}/contentPolicies/{policy}。您可以稍后修改此设置。
点击创建。
现在,您可以将数据存储区附加到 Gemini Enterprise 应用了。在联合查询模式下,当用户通过附加的应用运行查询时,查询会产生 BigQuery 计算费用;在数据注入模式下,即使在数据存储区附加到应用之前,导入数据也会产生 BigQuery 和 Gemini Enterprise 索引编制费用。如需详细了解这些费用,请参阅 Gemini Enterprise 定价。
后续步骤
如需将数据存储区关联到应用,请按照创建 Gemini Enterprise 应用中的步骤创建应用并选择数据存储区。
了解 Knowledge Catalog 如何与 Data Cloud 连接器(在您使用联合查询模式时自动启用)配合使用,帮助代理搜索用户有权访问的数据并查找组织上下文。
如需在 BigQuery 中构建具有经过验证的查询的限定范围代理,请参阅将 BigQuery 数据代理发布到 Gemini Enterprise。