Gemini Embedding 2

Gemini Embedding 2 ist das Modell von Google zur Generierung von Einbettungen, das sich ideal für komplexe Abruf- und Analyseaufgaben eignet.

Gemini Embedding 2 akzeptiert multimodale Eingaben, um 3.072-dimensionale Vektoren zu generieren. Das Modell akzeptiert Bilder, Text, Dokumente, Audio und Video als Eingaben und ordnet die generierten Vektoren semantisch einem einheitlichen semantischen Raum zu. So können Sie beispielsweise nach einem Bild anhand einer Textbeschreibung suchen.

Gemini Embedding 2 bietet mehrere Funktionen zur Optimierung der Qualität und Flexibilität von Einbettungen:

  • Benutzerdefinierte Aufgabenanweisungen:Wenn Sie Aufgabenanweisungen angeben (z. B. task:code retrieval oder task:search result), werden die Einbettungen für die beabsichtigten Beziehungen optimiert und Sie erhalten genauere Ergebnisse für das jeweilige Ziel.

  • Anpassbare Ergebnisgröße:Das Modell generiert standardmäßig einen 3.072-dimensionalen Gleitkommavektor. Sie können jedoch eine kleinere dimensionale Ausgabe abrufen, indem Sie den Parameter output_dimensionality angeben.

  • Document OCR:OCR aus Dokumenteingaben lesen.

  • Audio-Track-Extraktion:Audiotracks aus Videoeingaben extrahieren und mit Videoframes verschachteln.

Weitere Informationen zur Verwendung von Gemini Embedding 2 finden Sie unter Multimodale Einbettungen abrufen.

In Agent Studio ausprobieren Beispiel-App bereitstellen

Hinweis: Für „Beispiel-App bereitstellen“ ist ein Google Cloud-Projekt mit aktivierter Abrechnung und aktivierter Agent Platform API erforderlich.
Modell-ID gemini-embedding-2
Betriebsarten
Text Nur Eingabe
Bild Nur Eingabe
Audio Nur Eingabe
Video Nur Eingabe
Einbettungen Nur Ausgabe
Token limits Maximale Anzahl von Eingabetokens 8.192
Maximale Ausgabetokens
Ausgabedimensionen Bis zu 3.072 (mit MRL-Unterstützung)
Maximale Sequenzlänge 8.192 Tokens
Nutzungsoptionen
Technische Spezifikationen Text
  • Maximale Eingabetokens: 8.192
  • Maximale Anzahl von Dateien pro Prompt: 1
  • Maximale Anzahl von Seiten pro Datei (für PDF): 6
  • Maximale Dateigröße pro Datei: –
  • OCR für gescannte PDFs: Wird nicht standardmäßig verwendet
  • Unterstützte MIME-Typen:
    text/plain, application/pdf
Bild
  • Maximale Anzahl von Bildern pro Prompt: 6
  • Maximale Dateigröße pro Datei für Inline-Daten oder direkte Uploads über die Console: Kein Limit
  • Maximale Dateigröße pro Datei aus Google Cloud Storage: Keine Beschränkung
  • Maximale Anzahl von Ausgabebildern pro Prompt: Nicht zutreffend
  • Unterstützte MIME-Typen:
    image/png, image/jpeg, image/webp, image/bmp, image/heic, image/heif, image/avif
Video
  • Maximale Videolänge (mit Audio): 80 Sekunden
  • Maximale Videolänge (ohne Audio): 120 Sekunden
  • Maximale Anzahl von Videos pro Prompt: 1
  • Unterstützte MIME-Typen:
    video/mpeg, video/mp4
Audio
  • Maximale Audiolänge pro Prompt: 180 Sekunden
  • Maximale Anzahl von Audiodateien pro Prompt: 1
  • Unterstützte MIME-Typen:
    audio/mp3, audio/wav
Unterstützte Regionen

Modellverfügbarkeit

  • Global: global
  • USA (mehrere Regionen): us
  • Europa (multiregional): eu
Wissensstichtag November 2025
Versionen
  • gemini-embedding-2
    • Einführungsphase: GA
    • Veröffentlichungsdatum: 22. April 2026
  • gemini-embedding-2-preview
    • Startphase: Öffentliche Vorschau
    • Veröffentlichungsdatum: 10. März 2026
Preise Weitere Informationen finden Sie unter Preise.