您可以使用语音复制功能,通过简短的音频样本复制说话者的语音、语调、语速和音色。Gemini 3.8 Flash TTS (gemini-3.8-flash-tts) 和 Gemini 3.8 Flash-Lite TTS (gemini-3.8-flash-lite-tts) 均支持语音复刻。
如需复制声音,您需要将说话者的参考录音 (source_audio) 和同一说话者朗读同意声明的录音 (consent_audio) 发送到 Voices API。该服务会验证用户同意情况,并返回复制的语音的标识符。然后,您可以在 generateContent 或 streamGenerateContent 请求中的 speechConfig.voiceConfig.voice 中传递该标识符,而无需再次上传音频。
存储模式
创建复制语音时,store 字段会选择以下两种存储模式之一:
- 存储的语音 (
store: true):Google 会将复制的语音存储在您的项目中,并在id字段中返回语音 ID (voice_...)。您可以使用 Voices API 列出、获取和删除已存储的语音。 - 语音复制密钥 (
store: false):Google 不会存储复制的语音。该服务会在key字段中返回加密的语音复刻密钥 (voicekey_...),您的应用会存储该密钥。如果您的工作负载要求 Google 不保留语音个人资料,请使用此模式。
| 存储模式 | 标识符 | 管理 | 失效时间 |
|---|---|---|---|
存储的语音 (store: true) |
voice_... |
Voices API list、get 和 delete 方法 |
上次使用后 1 年 |
语音复刻密钥 (store: false) |
voicekey_... |
由您的应用存储。Google 不会保留密钥。 | 创建后 7 天 |
使用已存储的声音生成语音会重新开始计算一年的保留期限,因此您经常使用的声音不会过期。如果请求使用的语音复刻密钥已过期,则会失败并显示 INVALID_ARGUMENT 错误;如果请求使用的已删除或已过期的存储语音失败,则会失败并显示 NOT_FOUND 错误。如需继续使用复制的声音,请在复制的声音过期前重新创建。
准备工作
完成 Gemini TTS 页面上的准备工作中的步骤。Voices API 可通过 v1beta1 API 版本在 global 位置使用。
音频和用户意见征求要求
每次请求创建复制的语音时,都需要同一位成年发言人的两段录音:
- 参考音频 (
source_audio):10 到 30 秒的干净自然语音,来自您想要复制其声音的讲话人。较长的样本通常会产生更好的结果。 同意音频 (
consent_audio):同一位发言者逐字逐句朗读其语言的同意声明的录音。如需查看声明,请参阅支持的语言和意见征求声明。用英语表示,该声明为:“本人是此语音的所有者,并已同意通过使用 Google Cloud 来创建本人语音的合成模型。”
两段录音都必须是 WAV 文件,采用 16 位小端字节序线性 PCM、单声道,采样率为 24 kHz。
如果同意记录与同意声明不一致,或者音频不符合使用准则,则 create 请求会失败,并返回描述问题的 INVALID_ARGUMENT 错误。
创建存储的复制语音
在请求中设置以下字段:
store:true。voice.type:VOICE_TYPE_REPLICATED。voice.display_name:可选。语音的名称。voice.replicated.source_audio和voice.replicated.consent_audio:以 base64 编码的参考录音和同意录音,每项录音的mime_type都设置为audio/wav。
不设置 voice.model。如果请求同时设置了模型和 store: true,则会失败并显示 INVALID_ARGUMENT 错误。
响应会在 id 字段中返回语音 ID。
Python
import base64
from google import genai
client = genai.Client(enterprise=True, project="PROJECT_ID", location="global")
with open("SOURCE_AUDIO_PATH", "rb") as f:
source_b64 = base64.b64encode(f.read()).decode("utf-8")
with open("CONSENT_AUDIO_PATH", "rb") as f:
consent_b64 = base64.b64encode(f.read()).decode("utf-8")
replicated_voice = client.voices.create(
store=True,
voice={
"type": "VOICE_TYPE_REPLICATED",
"display_name": "Custom replicated speaker",
"replicated": {
"source_audio": {"mime_type": "audio/wav", "data": source_b64},
"consent_audio": {"mime_type": "audio/wav", "data": consent_b64},
},
},
timeout=60,
)
# The voice ID starts with "voice_".
print(f"Created voice ID: {replicated_voice.id}")
REST
SOURCE_B64=$(base64 -w 0 SOURCE_AUDIO_PATH)
CONSENT_B64=$(base64 -w 0 CONSENT_AUDIO_PATH)
cat > request.json <<EOF
{
"store": true,
"voice": {
"type": "VOICE_TYPE_REPLICATED",
"displayName": "Custom replicated speaker",
"replicated": {
"sourceAudio": {"mimeType": "audio/wav", "data": "${SOURCE_B64}"},
"consentAudio": {"mimeType": "audio/wav", "data": "${CONSENT_B64}"}
}
}
}
EOF
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://aiplatform.googleapis.com/v1beta1/projects/PROJECT_ID/locations/global/voices \
-d @request.json | jq -r '.id'
替换以下内容:
- PROJECT_ID:您的 Google Cloud 项目 ID。
- SOURCE_AUDIO_PATH:参考 WAV 文件的路径。
- CONSENT_AUDIO_PATH:同意声明 WAV 文件的路径。
如需列出、获取或删除存储的复制声音,请使用与设计的声音相同的方法。如需了解详情,请参阅管理已存储的声音。
创建语音复刻密钥
在请求中设置以下字段:
store:false。voice.type:VOICE_TYPE_REPLICATED。voice.model:必填。用于创建密钥的 Gemini 3.8 TTS 模型,例如gemini-3.8-flash-tts。该密钥适用于两种 Gemini 3.8 TTS 模型。voice.replicated.source_audio和voice.replicated.consent_audio:以 base64 编码的参考录音和同意录音,每项录音的mime_type都设置为audio/wav。
响应会在 key 字段中返回语音复刻密钥。
Python
import base64
from google import genai
client = genai.Client(enterprise=True, project="PROJECT_ID", location="global")
with open("SOURCE_AUDIO_PATH", "rb") as f:
source_b64 = base64.b64encode(f.read()).decode("utf-8")
with open("CONSENT_AUDIO_PATH", "rb") as f:
consent_b64 = base64.b64encode(f.read()).decode("utf-8")
replicated_voice = client.voices.create(
store=False,
voice={
"model": "gemini-3.8-flash-tts",
"type": "VOICE_TYPE_REPLICATED",
"replicated": {
"source_audio": {"mime_type": "audio/wav", "data": source_b64},
"consent_audio": {"mime_type": "audio/wav", "data": consent_b64},
},
},
timeout=60,
)
# Store the key in your application. It starts with "voicekey_".
voice_key = replicated_voice.key
REST
SOURCE_B64=$(base64 -w 0 SOURCE_AUDIO_PATH)
CONSENT_B64=$(base64 -w 0 CONSENT_AUDIO_PATH)
cat > request.json <<EOF
{
"store": false,
"voice": {
"model": "gemini-3.8-flash-tts",
"type": "VOICE_TYPE_REPLICATED",
"replicated": {
"sourceAudio": {"mimeType": "audio/wav", "data": "${SOURCE_B64}"},
"consentAudio": {"mimeType": "audio/wav", "data": "${CONSENT_B64}"}
}
}
}
EOF
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://aiplatform.googleapis.com/v1beta1/projects/PROJECT_ID/locations/global/voices \
-d @request.json | jq -r '.key'
使用复制的语音生成语音
在 speechConfig.voiceConfig.voice 中传递语音 ID 或语音复刻密钥:
Python
from google import genai
client = genai.Client(enterprise=True, project="PROJECT_ID", location="global")
response = client.models.generate_content(
model="gemini-3.8-flash-tts",
contents=[{
"role": "user",
"parts": [{
"text": "Hello! This audio was generated with a replicated voice.",
"speech_metadata": {"style": "warm and conversational"},
}],
}],
config={
"response_modalities": ["AUDIO"],
"speech_config": {"voice_config": {"voice": "VOICE"}},
},
)
# The SDK has already decoded the base64 audio, so inline_data.data is a
# complete WAV file by default.
with open("replicated_voice.wav", "wb") as f:
f.write(response.candidates[0].content.parts[0].inline_data.data)
REST
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/global/publishers/google/models/gemini-3.8-flash-tts:generateContent \
-d '{
"contents": [{
"role": "user",
"parts": [{
"text": "Hello! This audio was generated with a replicated voice.",
"speechMetadata": {"style": "warm and conversational"}
}]
}],
"generationConfig": {
"responseModalities": ["AUDIO"],
"speechConfig": {
"voiceConfig": {"voice": "VOICE"}
}
}
}' | jq -r '.candidates[0].content.parts[0].inlineData.data' | base64 --decode > replicated_voice.wav
将 VOICE 替换为 create 方法返回的语音 ID (voice_...) 或语音复制密钥 (voicekey_...)。
语音创建请求受每项目每分钟配额的限制。如果您超出此限制,create 方法会返回 RESOURCE_EXHAUSTED 错误。如需了解详情,请参阅配额和系统限制。
支持的语言和意见征求声明
Voices API 会将 consent_audio 的转写内容与同意声明进行匹配,以验证同意情况。发言者必须逐字逐句地朗读相应语言的声明:
| 语言 | BCP-47 代码 | 意见声明 |
|---|---|---|
| 南非荷兰语 | af |
Ek is die eienaar van hierdie stem en het ingestem tot die skep van 'n sintetiese model van my stem deur die gebruik van Google Cloud. |
| 阿尔巴尼亚语 | sq |
Unë jam pronari i këtij zëri dhe kam dhënë pëlqimin për krijimin e një modeli sintetik të zërit tim përmes përdorimit të Google Cloud. |
| 阿姆哈拉语 | am |
我是此声音的所有者,并且我同意使用 Google Cloud 创建我的声音的 AI 模型。 |
| 阿拉伯语 | ar |
أنا صاحب هذا الصوت وقد وافقت على إنشاء نموذج اصطناعي لصوتي باستخدام خدمة جوجل كلاود. |
| 亚美尼亚语 | hy |
Ես այս ձայնի սեփականատերն եմ և համաձայնություն եմ տվել Google Cloud-ի միջոցով իմ ձայնի սինթետիկ մոդելի ստեղծմանը։ |
| 阿塞拜疆语 | az |
Mən bu səsin sahibiyəm və Google Cloud vasitəsilə səsimin sintetik modelinin yaradılmasına razılıq vermişəm. |
| 孟加拉语 | bn |
আমি এই কণ্ঠস্বরের মালিক এবং গুগল ক্লাউড ব্যবহারের মাধ্যমে আমার কণ্ঠস্বরের একটি কৃত্রিম মডেল তৈরিতে সম্মতি দিয়েছি। |
| 巴斯克语 | eu |
Ahots honen jabea naiz eta nire ahotsaren eredu sintetiko bat sortzeko baimena eman dut Google Cloud erabiliz. |
| 白俄罗斯语 | be |
Я з'яўляюся ўладальнікам гэтага голасу і даў згоду на стварэнне сінтэтычнай мадэлі майго голасу з дапамогай Google Cloud |
| 保加利亚语 | bg |
Аз съм собственикът на този глас и съм дал съгласието си за създаването на синтетичен модел на моя глас чрез използването на Google Cloud. |
| 缅甸语 | my |
ကျွန်ုပ်သည် ဤအသံ၏ပိုင်ရှင်ဖြစ်ပြီး Google Cloud ကိုအသုံးပြုခြင်းဖြင့် ကျွန်ုပ်၏အသံ၏ ပေါင်းစပ်ပုံစံတစ်ခု ဖန်တီးရန် သဘောတူပါသည်။ |
| 加泰罗尼亚语 | ca |
Sóc el propietari d'aquesta veu i he donat el meu consentiment per a la creació d'un model sintètic de la meva veu mitjançant l'ús de Google Cloud. |
| 宿务语 | ceb |
Ako ang tag-iya niining tingog ug miuyon sa paghimo og sintetikong modelo sa akong tingog pinaagi sa paggamit sa Google Cloud. |
| 中文、普通话 | cmn |
我是这段声音的所有者,并已同意通过 Google Cloud 创建我的声音合成模型。 |
| 克罗地亚语 | hr |
Vlasnik sam ovog glasa i pristao sam na izradu sintetičkog modela mog glasa putem Google Clouda. |
| 捷克语 | cs |
Jsem vlastníkem tohoto hlasu a souhlasil(a) jsem s vytvořením syntetického modelu mého hlasu pomocí služby Google Cloud. |
| 丹麦语 | da |
Jeg ejer denne stemme og har givet samtykke til oprettelsen af en syntetisk model af min stemme ved hjælp af Google Cloud. |
| 荷兰语 | nl |
Ik ben de eigenaar van deze stem en heb toestemming gegeven voor het creëren van een synthetisch model van mijn stem via Google Cloud. |
| 英语 | en |
本人是此语音的所有者,并已同意通过使用 Google Cloud 来创建本人语音的合成模型 |
| 爱沙尼亚语 | et |
Olen selle hääle omanik ja olen andnud nõusoleku oma hääle sünteetilise mudeli loomiseks Google Cloudi abil. |
| 菲律宾语 | fil |
Ako ang may-ari ng boses na ito at pumayag sa paglikha ng isang sintetikong modelo ng aking boses sa pamamagitan ng paggamit ng Google Cloud. |
| 芬兰语 | fi |
Olen tämän äänen omistaja ja olen antanut suostumukseni synteettisen ääneni mallintamiseen Google Cloudin avulla. |
| 法语 | fr |
Je suis propriétaire de cette voix et j'ai consenti à la création d'un modèle synthétique de ma voix grâce à l'utilisation de Google Cloud. |
| 加利西亚语 | gl |
Son o propietario desta voz e dei o meu consentimento para a creación dun modelo sintético da miña voz mediante o uso de Google Cloud. |
| 格鲁吉亚语 | ka |
მე ვარ ამ ხმის მფლობელი და დავთანხმდი ჩემი ხმის სინთეზური მოდელის შექმნას Google Cloud-ის გამოყენებით. |
| 德语 | de |
Ich bin der Inhaber dieser Stimme und habe der Erstellung eines synthetischen Modells meiner Stimme mithilfe von Google Cloud zugestimmt. |
| 希腊语 | el |
Είμαι ο κάτοχος αυτής της φωνής και έχω συναινέσει στη δημιουργία ενός συνθετικού μοντέλου της φωνής μου μέσω της χρήσης του Google Cloud. |
| 古吉拉特语 | gu |
હું આ અવાજનો માલિક છું અને ગૂગલ ક્લાઉડના ઉપયોગ દ્વારા મારા અવાજનું સિન્થેટિક મોડેલ બનાવવા માટે સંમતિ આપી છે. |
| 海地克里奥尔语 | ht |
Mwen se pwopriyetè vwa sa a epi mwen bay konsantman pou kreyasyon yon modèl sentetik vwa mwen atravè itilizasyon Google Cloud. |
| 希伯来语 | he |
אני הבעלים של קול זה והסכמתי ליצירת מודל סינתטי של קולי באמצעות Google Cloud. |
| 印地语 | hi |
मैं इस आवाज का स्वामी हूं और मैंने Google क्लाउड के उपयोग के माध्यम से अपनी आवाज का कृत्रिम मॉडल बनाने की सहमति दी है। |
| 匈牙利语 | hu |
Én vagyok a hang tulajdonosa, és hozzájárultam ahhoz, hogy a Google Cloud segítségével szintetikus modellt készítsenek a hangomról. |
| 冰岛语 | is |
Ég er eigandi þessarar raddar og hef samþykkt að búið sé til tilbúið líkan af rödd minni með því að nota Google Cloud. |
| 印度尼西亚语 | id |
Saya adalah pemilik suara ini dan telah menyetujui pembuatan model sintetis suara saya melalui penggunaan Google Cloud. |
| 意大利语 | it |
Sono il proprietario di questa voce e ho acconsentito alla creazione di un modello sintetico della mia voce tramite l'utilizzo di Google Cloud. |
| 日语 | ja |
私はこの音声の所有者であり、Google Cloud を利用して私の音声の合成モデルを作成することに同意しました。 |
| 爪哇语 | jv |
Aku sing nduwèni swara iki lan wis sarujuk kanggo nggawé model sintetis swaraku liwat panggunaan Google Cloud. |
| 卡纳达语 | kn |
ನಾನು ಈ ಧ್ವನಿಯ ಮಾಲೀಕ ಮತ್ತು Google Cloud ಬಳಕೆಯ ಮೂಲಕ ನನ್ನ ಧ್ವನಿಯ ಸಂಶ್ಲೇಷಿತ ಮಾದರಿಯನ್ನು ರಚಿಸಲು ಸಮ್ಮತಿಸಿದ್ದೇನೆ. |
| 韩语 | ko |
저는 이 음성의 소유자이며, Google Cloud를 사용하여 제 음성의 합성 모델을 생성하는 데 동의했습니다. |
| 老挝语 | lo |
ຂ້ອຍເປັນເຈົ້າຂອງສຽງນີ້ ແລະ ໄດ້ຍິນຍອມໃຫ້ສ້າງຮູບແບບສັງເຄາະສຽງຂອງຂ້ອຍຜ່ານການນຳໃຊ້ Google Cloud |
| 拉丁语 | la |
Huius vocis dominus sum et consensi sum ad creandum exemplar syntheticum vocis meae per usum Google Cloud. |
| 拉脱维亚语 | lv |
Esmu šīs balss īpašnieks un esmu piekritis sintētiska manas balss modeļa izveidei, izmantojot Google Cloud. |
| 立陶宛语 | lt |
Esu šio balso savininkas ir sutikau, kad naudojant „Google Cloud“ būtų sukurtas sintetinis mano balso modelis. |
| 卢森堡语 | lb |
Ech sinn de Besëtzer vun dëser Stëmm an hunn der Erstellung vun engem synthetesche Modell vu menger Stëmm mat Hëllef vu Google Cloud zougestëmmt. |
| 马其顿语 | mk |
Јас сум сопственик на овој глас и се согласив за создавање синтетички модел на мојот глас преку користење на Google Cloud. |
| 马尔加什语 | mg |
Izaho no tompon'ity feo ity ary nanaiky ny hamorona modely sentetika amin'ny feoko amin'ny alàlan'ny fampiasana ny Google Cloud. |
| 马来人 | ms |
Saya pemilik suara ini dan telah bersetuju untuk penciptaan model sintetik suara saya melalui penggunaan Google Cloud. |
| 马拉雅拉姆语 | ml |
ഈ ശബ്ദത്തിന്റെ ഉടമ ഞാനാണ്, Google ക്ലൗഡ് ഉപയോഗിച്ച് എന്റെ ശബ്ദത്തിന്റെ ഒരു സിന്തറ്റിക് മോഡൽ സൃഷ്ടിക്കാൻ ഞാൻ സമ്മതം നൽകിയിട്ടുണ്ട്. |
| 马拉地语 | mr |
मी या आवाजाचा मालक आहे आणि गूगल क्लाउडचा वापर करून माझ्या आवाजाचे कृत्रिम मॉडेल तयार करण्यास मी संमती दिली आहे. |
| 蒙古语 | mn |
Би энэ дуу хоолойны эзэмшигч бөгөөд Google Cloud ашиглан өөрийн дуу хоолойны синтетик загварыг бүтээхийг зөвшөөрсөн. |
| 尼泊尔语 | ne |
म यो आवाजको मालिक हुँ र गुगल क्लाउडको प्रयोग मार्फत मेरो आवाजको सिंथेटिक मोडेल सिर्जना गर्न सहमति दिएको छु। |
| 挪威语(博克马尔语) | nb |
Jeg eier denne stemmen og har samtykket til at det opprettes en syntetisk modell av stemmen min ved bruk av Google Cloud. |
| 奥里亚语 | or |
ମୁଁ ଏହି ଭଏସ୍ର ମାଲିକ ଏବଂ Google Cloud ବ୍ୟବହାର ମାଧ୍ୟମରେ ମୋ ଭଏସ୍ର ଏକ ସିନ୍ଥେଟିକ୍ ମଡେଲ୍ ତିଆରି କରିବାକୁ ସମ୍ମତି ଦେଇଛି। |
| 普什图语 | ps |
زه د دې غږ مالک یم او د ګوګل کلاوډ په کارولو سره مې د خپل غږ د مصنوعي ماډل جوړولو ته رضایت ورکړی دی. |
| 波斯语 | fa |
من مالک این صدا هستم و با ایجاد یک مدل مصنوعی از صدایم از طریق استفاده از Google Cloud موافقت کردهام. |
| 波兰语 | pl |
Jestem właścicielem tego głosu i wyraziłem zgodę na utworzenie syntetycznego modelu mojego głosu za pomocą Google Cloud |
| 葡萄牙语 | pt |
Eu sou o proprietário desta voz e consinto com a criação de um modelo sintético da minha voz através do uso do Google Cloud. |
| 旁遮普语 | pa |
ਮੈਂ ਇਸ ਆਵਾਜ਼ ਦਾ ਮਾਲਕ ਹਾਂ ਅਤੇ ਗੂਗਲ ਕਲਾਉਡ ਦੀ ਵਰਤੋਂ ਰਾਹੀਂ ਆਪਣੀ ਆਵਾਜ਼ ਦੇ ਇੱਕ ਸਿੰਥੈਟਿਕ ਮਾਡਲ ਨੂੰ ਬਣਾਉਣ ਲਈ ਸਹਿਮਤੀ ਦਿੱਤੀ ਹੈ। |
| 罗马尼亚语 | ro |
Sunt proprietarul acestei voci și am consimțit la crearea unui model sintetic al vocii mele prin utilizarea Google Cloud. |
| 俄语 | ru |
Я являюсь владельцем этого голоса и дал согласие на создание синтетической модели моего голоса с использованием Google Cloud. |
| 塞尔维亚语 | sr |
Ја сам власник овог гласа и пристао/ла сам на креирање синтетичког модела мог гласа коришћењем Google Cloud-а |
| 信德语 | sd |
مان هن آواز جو مالڪ آهيان ۽ گوگل ڪلائوڊ جي استعمال ذريعي پنهنجي آواز جي هڪ مصنوعي ماڊل جي تخليق تي رضامندي ڏني آهي. |
| 僧伽罗文 | si |
මම මෙම හඬෙහි හිමිකරු වන අතර Google Cloud භාවිතය හරහා මගේ හඬෙහි කෘතිම ආකෘතියක් නිර්මාණය කිරීමට කැමැත්ත පළ කර ඇත්තෙමි. |
| 斯洛伐克语 | sk |
Som vlastníkom tohto hlasu a súhlasil/a som s vytvorením syntetického modelu môjho hlasu pomocou služby Google Cloud. |
| 斯洛维尼亚语 | sl |
Sem lastnik tega glasu in sem privolil v ustvarjanje sintetičnega modela mojega glasu z uporabo storitve Google Cloud. |
| 西班牙语 | es |
Soy el propietario de esta voz y he consentido la creación de un modelo sintético de mi voz mediante el uso de Google Cloud. |
| 斯瓦希里语 | sw |
Mimi ndiye mmiliki wa sauti hii na nimekubali kuundwa kwa modeli ya sauti yangu iliyotengenezwa kwa njia ya Google Cloud. |
| 瑞典语 | sv |
Jag äger den här rösten och har samtyckt till att en syntetisk modell av min röst skapas med hjälp av Google Cloud. |
| 泰米尔语 | ta |
இந்தக் குரலின் உரிமையாளர் நானே, மேலும் கூகிள் கிளவுடைப் பயன்படுத்தி எனது குரலின் செயற்கை மாதிரியை உருவாக்குவதற்கும் நான் ஒப்புதல் அளித்துள்ளேன். |
| 泰卢固语 | te |
ఈ స్వరానికి నేను యజమానిని మరియు గూగుల్ క్లౌడ్ను ఉపయోగించి నా స్వరం యొక్క కృత్రిమ నమూనాను రూపొందించడానికి నేను సమ్మతించాను. |
| 泰语 | th |
ฉันเป็นเจ้าของ这段音频,并且同意 Google Cloud 使用我的声音创建合成声音模型 |
| 土耳其语 | tr |
Bu sesin sahibi benim ve Google Cloud kullanılarak sesimin sentetik bir modelinin oluşturulmasına izin verdim. |
| 乌克兰语 | uk |
Я є власником цього голосу та дав згоду на створення синтетичної моделі мого голосу за допомогою Google Cloud |
| 乌尔都语 | ur |
میں اس آواز کا مالک ہوں اور میں نے گوگل کلاؤڈ کے استعمال کے ذریعے اپنی آواز کا مصنوعی ماڈل بنانے پر رضامندی دی ہے۔ |
| 越南语 | vi |
Tôi là chủ sở hữu giọng nói này và đã đồng ý cho phép tạo ra một mô hình tổng hợp giọng nói của mình thông qua việc sử dụng Google Cloud. |
最佳做法
- 在安静的环境中录制:尽可能减少回声、背景噪声、音乐和重叠的声音。输出质量取决于
source_audio的质量。 - 匹配录制条件:使用同一麦克风在同一房间内录制
source_audio和consent_audio,以便成功进行说话人验证。 - 转换为所需格式:在对录制内容进行编码之前,请将其重新采样为 24 kHz、单声道、16 位 PCM WAV。
- 语音复刻规划:语音复刻密钥的有效期为 7 天,存储的语音在上次使用后一年过期。保留来源和同意声明录音,或保留收集这些录音的流程,以便在录音过期之前再次创建声音。
后续步骤
- 使用语音设计功能,根据文字说明创建自定义语音。
- 如需了解回合级样式、内嵌标记和多说话者对话,请参阅使用 Gemini TTS 生成语音。