OpenAI 模型

在 Gemini Enterprise Agent Platform 上,OpenAI 模型可以托管式 API 和自行部署的模型两种形式供您使用。您可以流式传输回答,以降低最终用户对延迟时间的感知度。流式回答使用服务器发送的事件 (SSE) 来逐步流式传输回答。

gpt-oss 120B

OpenAI gpt-oss 120B 是一款拥有 1200 亿参数的开源权重语言模型,根据 Apache 2.0 许可发布。它尤其适合用于推理和函数调用应用场景。该模型专为在消费级硬件上进行部署而优化。

120B 模型在核心推理基准方面与 OpenAI o4-mini 几乎相当,同时可在单个 80GB GPU 上运行。

前往 gpt-oss 120B 模型卡片

gpt-oss 20B

OpenAI gpt-oss 20B 是一款拥有 200 亿参数的开源权重语言模型,根据 Apache 2.0 许可发布。它尤其适合用于推理和函数调用应用场景。该模型专为在消费级硬件上进行部署而优化。

在通用基准测试中,这款 200 亿参数模型的表现与 OpenAI o3-mini 相当,并且可在拥有 16GB 内存的边缘设备上运行,因此非常适合无需昂贵基础设施的设备端应用场景、本地推理或快速迭代。

前往 gpt-oss 20B 模型卡片

使用 OpenAI 模型

对于受管理的模型,您可以使用 curl 命令通过以下模型名称向 Gemini Enterprise Agent Platform 端点发送请求:

  • 对于 gpt-oss 120B,请使用 gpt-oss-120b-maas
  • 对于 gpt-oss 20B,请使用 gpt-oss-20b-maas

如需了解如何对 OpenAI 模型进行流式调用和非流式调用,请参阅调用开放模型 API

如需使用自行部署的 Gemini Enterprise Agent Platform 模型,请执行以下操作:

  1. 前往 Model Garden 控制台
  2. 找到相关的 Gemini Enterprise Agent Platform 模型。
  3. 点击启用,然后填写提供的表单,以获取必要的商业用途许可。

如需详细了解如何部署和使用合作伙伴模型,请参阅 部署合作伙伴模型并发出预测请求

OpenAI 模型区域可用性

OpenAI 模型可在以下区域使用:

模型 区域
gpt-oss 120B
  • global
gpt-oss 20B
  • us-central1

后续步骤

了解如何调用开放模型 API