Google 会使用 AI 技术将内容翻译成您偏好的语言。AI 翻译可能包含错误。
生成播客(API 方法)
使用集合让一切井井有条
根据您的偏好保存内容并对其进行分类。
Gemini Enterprise 提供了一项 API,可让您根据源文档生成播客。其输出与最终用户可以在笔记本中生成的播客非常相似。
通过 API 生成播客非常适合批量作业,例如您可能有数十或数百份书籍、文章或课程,并且希望为每份文档生成一个播客。
Podcast API 是一个独立 API。也就是说,您不需要 Gemini Notebook Enterprise 笔记本、Gemini Enterprise 许可或数据存储区。您只需要一个已启用的 Google Cloud 项目和“Podcast API User”角色。
该 API 的输入是一个 context 元素的数组。这是生成播客所依据的素材。输入可以采用文本、图片、音频和视频的形式。上下文数组的总内容必须少于 10 万个 token。
如需查看支持的类型列表,请参阅本页面上有关 Gemini 2.5 Flash 的图片、文档、视频和音频的技术规范。
输出
该 API 的输出是采用 MP3 格式的播客。
准备工作
在使用该 API 生成播客之前,您必须具备:
根据上下文输入生成播客
使用以下命令通过调用 podcast 方法生成播客。
输入是一个多媒体对象数组,例如文本、图片以及音频和视频片段。
REST
如需生成和导出播客,请执行以下操作:
运行以下 curl 命令:
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
"https://discoveryengine.googleapis.com/v1/projects/PROJECT_ID/locations/global/podcasts" \
-d '{
"podcastConfig": {
"focus": "FOCUS",
"length": "LENGTH",
"languageCode": "LANGUAGE_CODE"
},
"contexts": [
{
"text": "TEXT_CONTENT"
},
{
"inlineData": {
"mimeType": "MIME_TYPE",
"data": "BASE64_ENCODED_DATA"
}
}
],
"title": "PODCAST_TITLE",
"description": "PODCAST_DESCRIPTION"
}'
替换以下内容:
PROJECT_ID:您的项目的 ID。
FOCUS:一个提示,可用于建议播客的重点。
LENGTH:有两个选项:
SHORT(通常 4-5 分钟)
STANDARD(通常约 10 分钟,但如果数据集较小,则可能更短)
LANGUAGE_CODE:可选。指定播客的语言代码。使用 BCP47 定义的语言标记。如果未提供语言代码,则播客将以英语生成。
TEXT_CONTENT:要包含的文本内容。
inlineData:用于非文本媒体的对象。
MIME_TYPE:Blob 数据的 MIME 类型(例如“image/png”)。
BASE64_ENCODED_DATA:媒体数据的 base64 编码原始字节。
PODCAST_TITLE:播客的标题。此信息可供内部使用,您也可以选择向最终用户显示。
PODCAST_DESCRIPTION:播客的说明。此信息可供内部使用,您也可以选择向最终用户显示。
命令和结果示例
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
"https://discoveryengine.googleapis.com/v1/projects/my-project-123/locations/global/podcasts" \
-d '{
"podcastConfig": {
"focus": "Can you talk about how to find a job in Google?",
"length": "SHORT"
},
"contexts": [
{
"text": "Breaking into Google is a highly competitive endeavor, attracting millions of applicants globally due to its reputation as a top employer, its innovative work, and comprehensive perks. Success hinges on a multi-faceted approach, starting with meticulously tailored online applications that incorporate job description keywords for ATS and showcasing Googlyness—a blend of curiosity, collaborative spirit, and leadership potential. The rigorous, multi-stage interview process involves recruiter screens, behavioral interviews (often using the STAR method), and for technical roles, demanding coding challenges and system design questions that assess not just correct answers but also problem-solving thought processes and communication skills. Networking for referrals and informational interviews can significantly boost visibility, but ultimately, thorough preparation through mock interviews and platforms like LeetCode, combined with patience and resilience through the often lengthy process, are paramount for navigating this challenging but rewarding path."
},
{
"inlineData": {
"mimeType": "image/png",
"data": "iVBORw0KGgoAAAANSUhEUgAAAAEAAAABCAQAAAC1HAwCAAAAC0lEQVR42mNkYAAAAAYAAjCB0C8AAAAASUVORK5CYII="
}
}
],
"title": "Find a job at Google ",
"description": "This podcast is based on a plain text document and an image that describe various aspects of getting a job at Google."
}'
{
"name": "projects/123456/locations/global/operations/create-podcast-54321"
}
生成播客需要几分钟时间。
记下操作名称;您需要它才能在第 4 步下载播客。在上面的示例中,操作名称为 projects/123456/locations/global/operations/create-podcast-54321。
可选。轮询播客创建操作的状态。请参阅获取长时间运行的操作的详细信息。
在操作完成后,运行以下 curl 命令下载播客:
curl -v \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
"https://discoveryengine.googleapis.com/v1/OPERATION_NAME:download?alt=media" \
--output FILENAME.mp3 -L
替换以下内容:
OPERATION_NAME:您在第 2 步中记下的操作的名称。
FILENAME:播客的文件名。
此命令会将播客作为一个 MP3 文件下载到您的本地目录中。
命令和结果示例
curl -v \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
"https://discoveryengine.googleapis.com/v1/projects/123456/locations/global/operations/create-podcast-54321:download?alt=media" \
--output my-podcast.mp3 -L
% Total % Received % Xferd Average Speed Time Time Time Current
Dload Upload Total Spent Left Speed
0 0 0 0 0 0 0 0 --:--:-- --:--:-- --:--:-- 0* Host discoveryengine.googleapis.com:443 was resolved.
...
{ [42044 bytes data]
100 14.3M 100 14.3M 0 0 10.9M 0 0:00:01 0:00:01 --:--:-- 29.7M
* Connection #0 to host discoveryengine.googleapis.com left intact
合规性
Podcast API 不符合 Gemini Enterprise 的客户管理的加密密钥 (CMEK) 要求。
如未另行说明,那么本页面中的内容已根据知识共享署名 4.0 许可获得了许可,并且代码示例已根据 Apache 2.0 许可获得了许可。有关详情,请参阅 Google 开发者网站政策。Java 是 Oracle 和/或其关联公司的注册商标。
最后更新时间 (UTC):2026-07-18。
[null,null,["最后更新时间 (UTC):2026-07-18。"],[],[]]