割り当ての正確な見積もりは、各 API への秒間クエリ数(QPS)に基づいています。以降のセクションでは、各 Agent Assist 機能で使用される API の割り当てについて説明します。
プロジェクトの種類
次の割り当て表には、コンシューマー プロジェクトとリソース プロジェクトの 2 種類のプロジェクトが記載されています。この 2 種類のプロジェクトの定義については、複数のプロジェクトの使用に関するドキュメントをご覧ください。
音声文字変換
この機能は、テレフォニー統合または gRPC 統合のいずれかを使用します。それぞれに異なる API 割り当てがあります。
テレフォニー統合
テレフォニー統合で使用される API については、Dialogflow の割り当てをご覧ください。
gRPC 統合
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
AnalyzeContentOperationsPerMinutePerProject |
300 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent/StreamingAnalyzeContent リクエスト。割り当ては Dialogflow と Agent Assist で共有されます。 |
ConcurrentBidiStreamingSessionsPerProjectPerRegion |
50 件の同時リクエスト | リージョン(グローバル トラフィックは us-central1 リージョンでカウントされます) |
コンシューマー プロジェクト(テレフォニー SipRec 統合のリソース プロジェクト) | リージョンごとの同時双方向ストリーミング セッション数。 |
Chirp モデルによる音声文字変換
| 割り当て名 | デフォルト値 | リージョン | リソース プロジェクトまたはコンシューマー プロジェクトの課金 | 説明 |
|---|---|---|---|---|
SttV2StreamingRequestsPerMinutePerResourceTypePerRegion |
1 分あたり 20 件のリクエスト | リージョン(グローバル トラフィックは us-central1 リージョンでカウントされます)。 |
コンシューマー プロジェクト(テレフォニー SipRec 統合のリソース プロジェクト) | リソースタイプごとに STT V2 に送信された新しい StreamingRecognize リクエストの数。 |
感情分析
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
AnalyzeSentimentOperationsPerVersion |
300 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent または StreamingAnalyzeContent を介した感情分析リクエスト。 |
AnalyzeSentimentOperationsPerVersionPerRegion |
300 リクエスト/分 | リージョン | コンシューマー プロジェクト | AnalyzeContent または StreamingAnalyzeContent を介した感情分析リクエスト。 |
AnalyzeSentimentOperationsPerMinutePerProject |
300 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent または StreamingAnalyzeContent を介した感情分析リクエスト。 |
AnalyzeSentimentOperationsPerMinutePerProjectPerRegion |
300 リクエスト/分 | リージョン | コンシューマー プロジェクト | AnalyzeContent または StreamingAnalyzeContent を介した感情分析リクエスト。 |
独自の支援機能を構築する
この機能では、次の AI モデルを使用します。
- text-bison@001(デフォルトの上限は 0)
- text-bison@002
- text-bison-32k@002
- gemini-1.0-pro
- gemini-1.5-pro
- gemini-1.5-pro-001
- gemini-1.5-flash-001
- gemini-1.5-flash-002
- gemini-2.0-flash-001
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
GeneratorSuggestionOperationsPerMinutePerModelType |
10 リクエスト/分 | グローバル | コンシューマー プロジェクト | モデルタイプごとの生成候補オペレーション。 |
GeneratorSuggestionOperationsPerMinutePerModelTypePerRegion |
10 リクエスト/分 | リージョン | コンシューマー プロジェクト | モデルタイプとリージョンごとの生成候補オペレーション。 |
スマート リプライ
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
SmartReplyBaselineModelOperationsPerMinutePerProject |
120 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent または SuggestSmartReplies を介してスマート リプライ ベースライン モデル リクエストを取得します。 |
SmartReplyBaselineV2ModelOperationsPerMinutePerProject |
60 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent または SuggestSmartReplies を介してスマート リプライ ベースライン V2 モデル リクエストを取得します。 |
SmartReplyBaselineV2ModelOperationsPerMinutePerProjectPerRegion |
60 リクエスト/分 | リージョン | コンシューマー プロジェクト | AnalyzeContent または SuggestSmartReplies を介してスマート リプライ ベースライン V2 モデル リクエストを取得します。 |
生成スマート リプライ
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
SmartReplyBaselineModelOperationsPerMinutePerProject |
120 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent または SuggestSmartReplies を介してスマート リプライ ベースライン モデル リクエストを取得します。 |
SmartReplyBaselineV2ModelOperationsPerMinutePerProject |
60 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent または SuggestSmartReplies を介してスマート リプライ ベースライン V2 モデル リクエストを取得します。 |
SmartReplyBaselineV2ModelOperationsPerMinutePerProjectPerRegion |
60 リクエスト/分 | リージョン | コンシューマー プロジェクト | AnalyzeContent または SuggestSmartReplies を介してスマート リプライ ベースライン V2 モデル リクエストを取得します。 |
要約
AI 生成の要約では、次のモデルが使用されます。
- summarization-1.0
- summarization-2.0
- summarization-2.1
- summarization-3.0
- summarization-3.1
- summarization-4.0
- summarization-5.0
次の表に、各バージョンの要約で使用される割り当てタイプとモデルを示します。
要約バージョン |
割り当てタイプ |
バックエンド モデル |
|---|---|---|
Generator 5.0 |
生成ツールベース |
事前トレーニング済みの Gemini-2.5-flash |
Generator 4.0 |
生成ツールベース |
事前トレーニング済みの Gemini-2.0-flash-001 |
Generator 3.1 |
生成ツールベース |
Lora-tuned gemini-1.5-flash-001 |
Generator 3.0 |
生成ツールベース |
Lora チューニング済み gemini-1.0-pro-002 |
Generator 2.1 |
生成ツールベース |
Lora チューニング済み text-bison-32k@002 |
Generator 2.0 |
生成ツールベース |
Lora チューニング済み text-bison-32k@002 |
Generator 1.0 |
生成ツールベース |
Lora チューニング済み text-bison@001 |
ベースライン v2 |
ベースライン v2 モデル |
text-bison |
ベースライン v1 |
非ジェネレータベース |
LongT5 モデル |
Custom 2.0 |
非ジェネレータベース |
LongT5 モデル |
前の表の割り当てタイプは、要約で使用される API の次の割り当てリストに反映されます。
割り当てタイプ |
割り当て上限名 |
デフォルト値 |
リージョン |
リソース/コンシューマー プロジェクトの課金 |
説明 |
|---|---|---|---|---|---|
生成ツールベース |
GeneratorSuggestionOperationsPerMinutePerModelTypePerRegion |
10 リクエスト/分 |
地域 |
コンシューマー プロジェクト |
モデルタイプとリージョンごとの生成候補オペレーション |
生成ツールベース |
GeneratorSuggestionOperationsPerMinutePerModelType |
10 リクエスト/分 |
グローバル |
コンシューマー プロジェクト |
モデルタイプごとの生成候補オペレーション |
生成ツールベース |
SuggestConversationSummaryOperationsPerMinutePerProject |
60 リクエスト/分 |
グローバル |
リソース プロジェクト |
会話の要約オペレーションを提案する |
非ジェネレータベース |
SuggestConversationSummaryOperationsPerMinutePerProjectPerRegion |
0 ~ 2 リクエスト/分 |
地域 |
リソース プロジェクト |
各リージョンで会話の要約のオペレーションを提案する |
ベースライン v2 モデル |
SuggestSummaryV2BaselineOperationsPerMinutePerProject |
120 リクエスト/分 |
グローバル |
リソース プロジェクト |
会話の概要の提案 V2 ベースラインのポーリング リクエスト |
ベースライン v2 モデル |
SuggestSummaryV2BaselineOperationsPerMinutePerProjectPerRegion |
60 リクエスト/分 |
地域 |
リソース プロジェクト |
各リージョンにおける Conversation Summary Suggestion V2 ベースラインのポーリング リクエスト数 |
要約の自動評価
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
ConcurrentSummarizationEvaluationsPerProject |
1 プロジェクトあたり 1 件のリクエスト | コンシューマー プロジェクト | 自動評価リクエスト |
追加の同時実行割り当てが必要な場合は、 Google Cloud コンソールからリクエストを送信してください。この機能では、プロジェクトごとに最大 4 つの同時割り当てをサポートできます。
生成ナレッジ支援サービス
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
SearchKnowledgeRequestsPerMinutePerProject |
60 リクエスト/分 | グローバル | コンシューマー プロジェクト | SearchKnowledge リクエスト。 |
SearchKnowledgeRequestsPerMinutePerProjectPerRegion |
30 リクエスト/分 | リージョン | コンシューマー プロジェクト | 各リージョンの SearchKnowledge リクエスト。 |
プロアクティブ生成ナレッジ支援サービス V1
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
SuggestKnowledgeAssistOperationsPerMinutePerProject |
60 リクエスト/分 | グローバル | リソース プロジェクト | AnalyzeContent または SuggestKnowledgeAssist を介した KnowledgeAssist リクエスト。 |
SuggestKnowledgeAssistOperationsPerMinutePerProjectPerRegion |
30 リクエスト/分 | リージョン | リソース プロジェクト | 各リージョンの AnalyzeContent または SuggestKnowledgeAssist を介した KnowledgeAssist リクエスト。 |
SuggestKnowledgeAssistOpsPerMinutePerProjectPerMultiRegion |
30 リクエスト/分 | MultiRegional | リソース プロジェクト | AnalyzeContent または SuggestKnowledgeAssist を介して、米国や EU などのマルチリージョン エンドポイントに送信される KnowledgeAssist リクエスト。 |
プロアクティブ生成ナレッジ支援サービス V2
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
KnowledgeAssistOpsPerMinutePerProjectPerVersion |
30 リクエスト/分 | グローバル | リソース プロジェクト | リクエストがグローバル ロケーション エンドポイントに送信された場合、特定のモデル バージョンの KnowledgeAssist リクエスト。 |
KnowledgeAssistOpsPerMinutePerProjectPerVersionPerRegion |
30 リクエスト/分 | リージョン | リソース プロジェクト | us-central1 や europe-west1 など、単一の特定の Google Cloud リージョンに送信される KnowledgeAssist リクエスト。 |
KnowledgeAssistOpsPerMinutePerProjectPerVersionPerMultiRegion |
30 リクエスト/分 | MultiRegional | リソース プロジェクト | US や EU などのマルチリージョン エンドポイントに送信される KnowledgeAssist リクエスト。 |
AI コーチ(LLM)
この機能は agent-coaching-2.5 AI モデルを使用します。
| 割り当て上限名 | デフォルト値 | リージョン | リソース プロジェクトまたはコンシューマー プロジェクトの課金 | 説明 |
|---|---|---|---|---|
GeneratorSuggestionOperationsPerMinutePerModelType |
1 分あたり 60 回のリクエスト | グローバル | コンシューマー プロジェクト | モデルタイプごとの生成候補オペレーション。 |
GeneratorSuggestionOperationsPerMinutePerModelTypePerRegion |
1 分あたり 60 回のリクエスト | リージョン | コンシューマー プロジェクト | モデルタイプとリージョンごとの生成候補オペレーション。 |
その他の API 割り当て
| 割り当て上限名 | デフォルト値 | リージョン | 課金リソース/コンシューマー プロジェクト | 説明 |
|---|---|---|---|---|
ConversationOperationsPerMinutePerProject |
300 リクエスト/分 | グローバル | コンシューマー プロジェクト | AnalyzeContent と StreamingAnalyzeContent 以外の会話リクエスト(CreateConversation、CompleteConversation など)。割り当ては Dialogflow と Agent Assist で共有されます。 |
MessagePollingOperationsPerMinutePerProject |
1,200 リクエスト / 分 | グローバル | コンシューマー プロジェクト | ListMessages リクエスト。割り当ては Dialogflow と Agent Assist で共有されます。 |
AnswerRecordOperationsPerMinutePerProject |
300 リクエスト / 分 | グローバル | コンシューマー プロジェクト | AnswerRecord リクエスト。 |
Gemini Transcribe Live
| 割り当て上限名 | 指標名 | デフォルトの上限 | スコープ | 説明 |
|---|---|---|---|---|
GeminiAsrConcurrentStreamsPerProject |
`dialogflow.googleapis.com/gemini_asr_concurrent_streams` | 10 個の同時ストリーム | グローバル | Gemini ASR モデルを使用する同時ストリームの最大数。 |
GeminiAsrConcurrentStreamsPerProjectPerRegion |
`dialogflow.googleapis.com/gemini_asr_concurrent_streams_per_region` | 10 個の同時ストリーム | リージョン | 各リージョンで Gemini ASR モデルを使用する同時ストリームの最大数。 |
GeminiAsrConcurrentStreamsPerProjectPerMultiRegion |
`dialogflow.googleapis.com/gemini_asr_concurrent_streams_per_multi_region` | 10 個の同時ストリーム | マルチリージョン | 各マルチリージョン(米国、EU など)で Gemini ASR モデルを使用する同時ストリームの最大数。 |
次のステップ
- 割り当ての増加をリクエストする方法については、割り当てページをご覧ください。
- リクエスト送信後に、Google から詳細について確認させていただく場合があります。リクエストの承認または却下の結果については、追ってお知らせいたします。