Gemini Embedding 2 ist das Modell von Google zur Generierung von Einbettungen, das sich ideal für komplexe Abruf- und Analyseaufgaben eignet.
Gemini Embedding 2 akzeptiert multimodale Eingaben, um 3.072-dimensionale Vektoren zu generieren. Das Modell akzeptiert Bilder, Text, Dokumente, Audio und Video als Eingaben und ordnet die generierten Vektoren semantisch einem einheitlichen semantischen Raum zu. So können Sie beispielsweise nach einem Bild anhand einer Textbeschreibung suchen.
Gemini Embedding 2 bietet mehrere Funktionen zur Optimierung der Qualität und Flexibilität von Einbettungen:
Benutzerdefinierte Aufgabenanweisungen:Wenn Sie Aufgabenanweisungen angeben (z. B.
task:code retrievalodertask:search result), werden die Einbettungen für die beabsichtigten Beziehungen optimiert und Sie erhalten genauere Ergebnisse für das jeweilige Ziel.Anpassbare Ergebnisgröße:Das Modell generiert standardmäßig einen 3.072-dimensionalen Gleitkommavektor. Sie können jedoch eine kleinere dimensionale Ausgabe abrufen, indem Sie den Parameter
output_dimensionalityangeben.Document OCR:OCR aus Dokumenteingaben lesen.
Audio-Track-Extraktion:Audiotracks aus Videoeingaben extrahieren und mit Videoframes verschachteln.
Weitere Informationen zur Verwendung von Gemini Embedding 2 finden Sie unter Multimodale Einbettungen abrufen.
In Agent Studio ausprobieren Beispiel-App bereitstellen
| Modell-ID | gemini-embedding-2 |
|
|---|---|---|
| Betriebsarten |
|
|
| Token limits | Maximale Anzahl von Eingabetokens | 8.192 |
| Maximale Ausgabetokens | – | |
| Ausgabedimensionen | Bis zu 3.072 (mit MRL-Unterstützung) | |
| Maximale Sequenzlänge | 8.192 Tokens | |
| Nutzungsoptionen |
|
|
| Technische Spezifikationen | Text |
|
| Bild |
|
|
| Video |
|
|
| Audio |
|
|
| Unterstützte Regionen |
|
|
| Wissensstichtag | November 2025 | |
| Versionen |
|
|
| Preise | Weitere Informationen finden Sie unter Preise. | |