本文档介绍了如何访问 Gemini Enterprise 应用生成的指标。这些指标可帮助您了解应用的性能和运行状况。
您可以使用 Metrics Explorer 查看指标遥测数据,也可以使用代理的可观测性 标签页直接在各个代理中查看。
主要概念
本部分介绍了与 Gemini Enterprise 中的可观测性相关的主要概念。
| 概念 | 说明 |
|---|---|
| 指标 | 指标是系统随时间收集的数值测量结果。这些 测量结果代表系统的性能、资源利用率或 行为。工程师使用指标来监控系统运行状况, 识别趋势和触发提醒。 |
| 代理范围的指标 | 用于衡量单个代理活动的指标,例如其 会话数、对话回合数和工具调用次数。这些指标列在 Gemini Enterprise Agent 资源类型下,并且 仅当为该代理启用启用 OpenTelemetry 跟踪记录和 日志的插桩 可观测性设置时才会收集。 |
| 应用范围的指标 | 用于衡量应用的所有流量(而不是单个 代理的流量)的指标,例如请求数和端到端延迟时间。这些指标列在 Gemini Enterprise Engine 资源类型下,其中 Engine 是 Gemini Enterprise 应用的 API 名称,并且无论可观测性设置如何,都会收集这些指标。 |
准备工作
请确保您已备好:
Gemini Enterprise Admin 角色或 Google Cloud 控制台 Gemini Enterprise User 角色。
现有的 Gemini Enterprise Web 应用。如需了解如何创建新 应用,请参阅创建应用。
如需访问 Metrics Explorer,您必须拥有 Monitoring Viewer 角色 (
roles/monitoring.viewer)。启用启用 OpenTelemetry 跟踪记录和日志的插桩 可观测性设置。根据代理类型,您可以在应用级配置(对于核心助理 代理)或代理的配置 标签页内(对于 Agent Designer 员工制作的代理和 Deep Research 代理)启用此设置。如需了解详情,请参阅 管理可观测性设置。 此设置是代理范围的指标所必需的。应用范围的指标列在 Gemini Enterprise Engine 资源类型下,无需此设置即可收集。
数据保留
Gemini Enterprise 应用生成的指标存储在
您的 Google Cloud 项目的 Cloud Monitoring 中,其保留期限由
Cloud Monitoring 决定。Gemini Enterprise 指标在
discoveryengine.googleapis.com/ 前缀下发布,该前缀属于 "all other
Google Cloud metrics" 层级,默认保留 6 周。超出保留期限的数据会自动删除。如需了解权威
且最新的保留期限值,请参阅
Cloud Monitoring 配额和限制文档中的
数据保留。
在 Metrics Explorer 中访问指标
如需访问指标,请按以下步骤操作:
在 Google Cloud 控制台中,前往 Metrics Explorer 页面。
选择创建 Gemini Enterprise 应用的 Google Cloud 项目。
点击选择一个指标 以打开搜索栏。
在搜索栏中,查找以下指标:
指标名称 说明 Gemini Enterprise Agent - Gemini Enterprise Agent 会话数 Gemini Enterprise Agent 处理的会话数。 Gemini Enterprise Agent - Gemini Enterprise Agent 工具数 Gemini Enterprise Agent 调用工具的次数。 Gemini Enterprise Agent - Gemini Enterprise Agent 回合数 Gemini Enterprise Agent 会话中的对话回合数。 Gemini Enterprise Agent - Gemini Enterprise Agent 总 延迟时间 Gemini Enterprise Agent 响应的总延迟时间。 Gemini Enterprise Agent - Gemini Enterprise Agent 工具总 延迟时间 Gemini Enterprise Agent 中工具执行产生的总延迟时间。 Gemini Enterprise DataConnector - Gemini Enterprise DataConnector 请求数 向 Gemini Enterprise 数据 连接器(在 Google Cloud 控制台中也称为数据存储区)发出的请求总数。 Gemini Enterprise DataConnector - Gemini Enterprise DataConnector 请求延迟时间 (Beta 版)向 Gemini Enterprise 数据 连接器(在控制台中也称为数据存储区 Google Cloud )发出的请求的延迟时间(以毫秒为单位)。 Gemini Enterprise Engine - Gemini Enterprise Engine 请求数 您的 Gemini Enterprise 应用收到的请求总数,包括应用的所有流量,而不是单个代理的流量。按 API 方法、规范 gRPC 响应代码、响应代码类、查询类型和模型细分。 Gemini Enterprise Engine - Gemini Enterprise Engine 请求总 延迟时间 Gemini Enterprise 应用的端到端请求延迟时间分布。为每个请求记录,包括返回错误的请求。 Gemini Enterprise Engine - Gemini Enterprise Engine 首次 回答延迟时间 接收请求和 流式传输第一个回答令牌之间的延迟时间分布。仅针对生成至少一个回答令牌的请求记录。 Gemini Enterprise Engine - Gemini Enterprise Engine 首次 令牌延迟时间 接收请求和 流式传输第一个令牌之间的延迟时间分布,无论该令牌是模型思考过程的一部分还是最终答案。仅针对 生成至少一个流式传输令牌的请求记录。 选择要探索的指标,然后点击应用 。
您可以选择设置其他标签过滤条件、汇总元素并调整时间范围。

访问代理的指标
您还可以在 Google Cloud 控制台中代理的可观测性 标签页上,直接查看各个代理的运营、工具专用和会话指标信息中心。
如需访问代理的指标,请执行以下操作:
- 在 Google Cloud 控制台中,前往您的应用,然后点击 Agents。
- 选择要检查的代理,然后点击可观测性 标签页。
可观测性 标签页提供关键运营遥测数据,分为概览 和工具 两种视图。
指标概览
此视图提供了一个信息中心,用于汇总标准会话和代理健康数据,包括:
- 会话数:用户会话总数。
- 每次会话的平均时长:会话期间经过的平均时间。
- 代理调用次数:代理被调用的总次数。
- 代理延迟时间:不同时间和特定指标的延迟时间。
- 代理流量:入站请求量。
- 代理错误率:代理调用失败的百分比。

工具指标
此视图专门关注与代理关联的工具的使用情况和延迟时间,包括:
- 调用总数:工具执行请求数。
- 按工具统计的 P95 延迟时间:按工具分类的执行延迟时间第 95 百分位数。
- 按工具统计的调用次数:不同工具的调用总数。
- 按工具统计的错误率:按工具统计的执行失败率。
- “未调用工具”比例 :互动未触发任何工具执行的比例。
后续步骤
- 使用 Gemini Enterprise 指标创建信息中心。如需了解详情, 请参阅创建和管理自定义信息中心。
- 在指标超过阈值时创建提醒。如需了解详情,请参阅 创建指标阈值提醒政策
- 如需关闭 Metrics Explorer 跟踪,请参阅 关闭可观测性设置。