MiniMax 模型

MiniMax 模型可在 Gemini Enterprise Agent Platform 上作为受管理的 API 和自行部署的模型使用。您可以流式传输回答,以降低最终用户对延迟时间的感知度。流式回答使用服务器发送的事件 (SSE) 来逐步流式传输回答。

受管理的 MiniMax 模型

MiniMax 模型以 API 形式提供全代管式无服务器模型。如需使用 Agent Platform 上的 MiniMax 模型,请直接向 Agent Platform API 端点发送请求。使用 MiniMax 模型作为托管式 API 时,无需预配或管理基础设施。

MiniMax 提供了以下模型,可在 Gemini Enterprise Agent Platform 中使用。如需访问 MiniMax 模型,请前往其 Model Garden 模型卡片。

MiniMax M2

MiniMax M2 是 MiniMax 的一款模型,专为智能体和代码相关任务而设计。它专为端到端开发工作流程而打造,在规划和执行复杂的工具调用任务方面具有强大的能力。该模型经过优化,可在性能、费用和推理速度之间取得平衡。

前往 MiniMax M2 模型卡片

使用 MiniMax 模型

对于受管理的模型,您可以使用 curl 命令通过以下模型名称向 Gemini Enterprise Agent Platform 端点发送请求:

  • 对于 MiniMax M2,请使用 minimax-m2-maas

如需了解如何对 MiniMax 模型进行流式和非流式调用,请参阅调用开放模型 API

如需使用自行部署的 Gemini Enterprise Agent Platform 模型,请执行以下操作:

  1. 前往 Model Garden 控制台
  2. 找到相关的 Gemini Enterprise Agent Platform 模型。
  3. 点击启用,然后填写提供的表单,以获取必要的商业用途许可。

如需详细了解如何部署和使用合作伙伴模型,请参阅 部署合作伙伴模型并发出预测请求

MiniMax 模型区域可用性

MiniMax 模型可在以下区域使用:

模型 区域
MiniMax M2
  • global

后续步骤

了解如何调用开放模型 API