Zum Hauptinhalt springen
Cloud / Google Cloud / Produkte / Gemini-Modelle: Foundation Models über die Gemini API

Gemini-Modelle: Foundation Models über die Gemini API

Gemini-Modelle: Googles Foundation Models mit langem Kontext und Multimodalität über Gemini API und Agent Platform, auch in EU-Regionen.

AI/ML
Preismodell Pay-per-use (Tokens), zusätzlich Batch, Context Caching und Provisioned Throughput
Verfügbarkeit Globale und EU-Endpunkte (u.a. europe-west3 Frankfurt, europe-west4 Niederlande)
Datensouveränität EU-Regionen und EU-Data-Residency-Endpunkte verfügbar
Zuverlässigkeit SLA gemäß Anbieter (siehe offizielle SLA-Seite) SLA

Die Gemini-Modelle sind Googles Foundation-Model-Familie für Entwickler und Unternehmen, die Sprach- und Multimodal-Modelle in eigene Anwendungen und Produkte integrieren wollen. Der Zugriff erfolgt über die Gemini API oder über die Gemini Enterprise Agent Platform (der frühere Vertex-AI-Dienst), die zusätzliche Enterprise-Governance, Regionssteuerung und Anbindung an den restlichen Google-Cloud-Stack bietet. Das ist ein anderer Zugangsweg als Gemini in Google Workspace, das Endnutzer-Features wie Gmail-Zusammenfassungen oder Docs-Assistenten adressiert.

Die Gemini-Modellfamilie

Die Modellfamilie deckt unterschiedliche Anforderungen ab: leistungsstarke Pro-Varianten für komplexe Reasoning-Aufgaben, Code-Generierung und analytische Fragestellungen, ausgewogene Flash-Varianten für hohen Durchsatz sowie besonders kostengünstige Flash-Lite-Varianten für latenzkritische, hochvolumige Workloads. Google entwickelt die Modellfamilie kontinuierlich weiter; ältere Generationen werden nach Ankündigung abgekündigt, sodass bestehende Integrationen regelmäßig auf aktuelle Versionen migriert werden sollten.

Die Modelldokumentation der Gemini Enterprise Agent Platform führt aktuell unter anderem:

  • Pro: Gemini 3.1 Pro, Gemini 3 Pro Image, Gemini 2.5 Pro
  • Flash: Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini Omni 1.1 Flash, Gemini Omni Flash, Gemini 3.1 Flash Image, Gemini 3 Flash, Gemini 2.5 Flash
  • Flash-Lite: Gemini 3.5 Flash-Lite, Gemini 3.1 Flash-Lite, Gemini 3.1 Flash-Lite Image, Gemini 2.5 Flash-Lite
  • Spezialmodelle: Gemini 3.5 Transcribe, Gemini Embedding 2, Gemini Robotics ER 2
  • Generative Medien: Veo 3.1, Veo 3 und Veo 2 für Video, Lyria 3 und Lyria 2 für Musik

Zusätzlich stehen über den Model Garden Partner- und Open-Modelle bereit, etwa Claude, Llama, Mistral, DeepSeek und Qwen. Da Google die Liste laufend anpasst, ist die offizielle Modelldokumentation maßgeblich.

Alle aktuellen Modelle sind nativ multimodal und verarbeiten Text, Bild, Audio, Video und PDF im selben Kontextfenster. Die leistungsstärksten Varianten bieten ein Kontextfenster von bis zu 1 Million Tokens, sodass sehr lange Dokumente, große Codebasen oder umfangreiche Transkripte in einer einzigen Anfrage verarbeitet werden können. Viele Modelle unterstützen zudem einen steuerbaren Thinking- bzw. Reasoning-Modus, um Antwortqualität, Latenz und Kosten auszubalancieren.

Kernfunktionen

  • Aktuelle Modellfamilie: Mehrere Generationen und Größenklassen (Pro, Flash, Flash-Lite), alle nativ multimodal über eine einheitliche API.
  • Langer Kontext und Thinking-Modus: Bis zu 1 Million Tokens Kontext bei den leistungsstärksten Modellen sowie ein steuerbarer Reasoning-Modus für die Balance aus Qualität, Latenz und Kosten.
  • Grounding und Tools: Grounding mit Google Search für aktuelle Webinformationen, Grounding auf eigene Daten, Function Calling und strukturierte JSON-Ausgabe für produktionsreife Integrationen.
  • Anpassung: Supervised Fine-Tuning für ausgewählte Modelle, um Gemini auf eigene Daten und Aufgaben anzupassen.
  • Kostenoptimierung: Batch-Verarbeitung für asynchrone Jobs, Context Caching für wiederkehrende lange Kontexte und Provisioned Throughput für planbaren, reservierten Durchsatz.
  • Enterprise-Governance: EU-Endpunkte und EU-Data-Residency, Verschlüsselung in Übertragung und Speicherung sowie die Zusage, dass Kundendaten über die Enterprise-Zugänge nicht zum Training der Modelle genutzt werden.

Typische Anwendungsfälle

Text- und Codegenerierung: Anwendungen erzeugen Inhalte, Zusammenfassungen oder Quellcode und nutzen das große Kontextfenster, um umfangreichen Eingabekontext einzubeziehen.

Multimodale Analyse: Modelle verarbeiten Text, Bild, Audio, Video und PDF gemeinsam, etwa zur Auswertung von Dokumenten, zur Extraktion strukturierter Daten oder zur Beschreibung von Medien.

Gegroundete Assistenten: Über Grounding mit Google Search oder eigene Datenquellen liefern Assistenten aktuelle und nachvollziehbare Antworten und reduzieren Halluzinationen bei zeitkritischen Themen.

Fachspezifische Modelle: Per Fine-Tuning passen Unternehmen Gemini an eigene Terminologie, Formate und Aufgaben an und betreiben die Modelle in EU-Regionen.

Vorteile

  • Einheitliche API für eine aktuelle, nativ multimodale Modellfamilie von kostengünstig (Flash-Lite) bis leistungsstark (Pro).
  • Langes Kontextfenster von bis zu 1 Million Tokens und steuerbarer Thinking-Modus für anspruchsvolle Reasoning-Aufgaben.
  • EU-Endpunkte und EU-Data-Residency sowie die Zusage, dass Kundendaten über die Enterprise-Zugänge nicht zum Modelltraining verwendet werden.
  • Kostenkontrolle über Batch, Context Caching und Provisioned Throughput sowie enge Integration in den übrigen Google-Cloud-Stack.

Integration mit innFactory

Als zertifizierter Google Cloud Partner unterstützt innFactory bei der Integration von Gemini-Modellen in Ihre Anwendungen: API-Anbindung, Prompt-Engineering, Grounding- und Fine-Tuning-Projekte, Modellauswahl und Migration sowie Architektur-Beratung für produktionsreife, EU-konforme Deployments.

Kontaktieren Sie uns für eine technische Beratung zu den Gemini-Modellen.

Typische Anwendungsfälle

Text- und Codegenerierung
Multimodale Analyse (Text, Bild, Video, Audio, PDF)
Grounding mit Google Search und eigenen Daten
Fine-Tuning auf eigenen Daten

Häufig gestellte Fragen

Was sind die Gemini-Modelle und wie greife ich darauf zu?

Die Gemini-Modelle sind Googles Foundation-Model-Familie für Text, Bild, Audio, Video und Code. Der programmatische Zugriff erfolgt über die Gemini API sowie über die Gemini Enterprise Agent Platform (vormals Vertex AI), die zusätzlich Enterprise-Governance, Regionssteuerung und Model Garden mit Drittanbietermodellen bietet. Das ist ein anderer Zugangsweg als Gemini in Google Workspace, das Endnutzer-Features wie Gmail-Zusammenfassungen adressiert.

Welche Gemini-Modelle sind aktuell verfügbar?

Die Modelldokumentation der Gemini Enterprise Agent Platform führt derzeit unter anderem Gemini 3.1 Pro und Gemini 3 Pro Image, die Flash-Modelle Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash und Gemini Omni 1.1 Flash, die Flash-Lite-Modelle Gemini 3.5 Flash-Lite und Gemini 3.1 Flash-Lite sowie die Spezialmodelle Gemini 3.5 Transcribe, Gemini Embedding 2 und Gemini Robotics ER 2. Ältere Generationen wie Gemini 2.5 Pro und Gemini 2.5 Flash bleiben zunächst verfügbar und werden nach Ankündigung abgekündigt. Die jeweils aktuelle Liste inklusive Stilllegungsterminen nennt die offizielle Modelldokumentation.

Werden meine Daten zum Training der Gemini-Modelle genutzt?

Im Rahmen der Google-Cloud-Datenschutzzusage werden Kundendaten über die Enterprise-Zugänge standardmäßig nicht zum Training der Foundation Models verwendet: weder Prompts noch Antworten noch Trainingsdaten für Adapter-Modelle. Die Foundation Models bleiben eingefroren und verarbeiten Eingaben nur, um die jeweilige Ausgabe zu erzeugen.

Sind Gemini-Modelle in der EU verfügbar?

Ja. Modelle lassen sich über EU-Endpunkte betreiben, unter anderem in Regionen wie europe-west3 (Frankfurt) und europe-west4 (Niederlande). Für strenge Anforderungen stehen EU-Data-Residency-Endpunkte zur Verfügung, die Verarbeitung und Speicherung innerhalb der EU-Geografie halten. Die Modellverfügbarkeit unterscheidet sich je Region, daher empfiehlt sich vorab ein Abgleich mit der Regionsübersicht.

Wie werden die Gemini-Modelle abgerechnet?

Die Abrechnung erfolgt tokenbasiert (pay-per-use), getrennt nach Eingabe- und Ausgabe-Tokens und je nach Modell und Modalität. Für Kostenoptimierung gibt es Batch-Verarbeitung für asynchrone Jobs, Context Caching für wiederkehrende lange Kontexte sowie Provisioned Throughput für planbaren, reservierten Durchsatz. Die jeweils aktuellen Preise nennt die offizielle Pricing-Seite.

Hinweis: Alle Produktinformationen auf dieser Seite wurden sorgfältig zusammengestellt, sind jedoch ohne Gewähr und können veraltet oder unvollständig sein. Cloud-Services entwickeln sich schnell weiter — Funktionen, Preise, SLAs und Verfügbarkeit ändern sich laufend. Verbindliche und aktuelle Informationen finden Sie ausschließlich auf der offiziellen Produktseite von Google Cloud (offizielle Dokumentation). Diese Seite stellt kein Angebot von Google Cloud dar.

Google Cloud Partner

innFactory ist zertifizierter Google Cloud Partner. Wir bieten Beratung, Implementierung und Managed Services.

Google Cloud Partner

Ähnliche Produkte anderer Cloud-Anbieter

Andere Cloud-Anbieter bieten vergleichbare Services in dieser Kategorie. Als Multi-Cloud Partner helfen wir bei der richtigen Wahl.

STACKIT

STACKIT AI Model Experiments: Managed MLflow

STACKIT AI Model Experiments: Managed MLflow für Experiment-Tracking, LLM-Tracing und EU-AI-Act-Audit-Trail aus …

Preismodell Public Preview: Dienst kostenlos, nur …
Vergleichen →
STACKIT

STACKIT AI Model Serving: Souveräne LLMs

STACKIT AI Model Serving: Open-Weight-LLMs wie Llama, Qwen und GPT-OSS DSGVO-konform aus deutschen Rechenzentren, …

Preismodell Pay-as-you-go pro Token (Input/Output)
SLA Betrieb auf der datensouveränen STACKIT Cloud
Vergleichen →
STACKIT

STACKIT Dremio - Souveränes Data Lakehouse

STACKIT Dremio: verwaltetes Data-Lakehouse basierend auf Dremio für SQL-Abfragen ohne Datenbewegung. DSGVO-konform, …

Preismodell Öffentliche Preview; einheitliche …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite); Dienst befindet sich in der Public Preview
Vergleichen →
STACKIT

STACKIT Intake - Daten-Ingestion für das Data Lakehouse

STACKIT Intake: verwaltete Dateneingabe über das Kafka-Protokoll direkt in Apache-Iceberg-Tabellen für das STACKIT Data …

Preismodell Kapazitätsbasiert; Kapazität wird über …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
STACKIT

STACKIT Notebooks - Managed JupyterHub

STACKIT Notebooks: verwaltetes JupyterHub/JupyterLab für Data Science und ML in deutschen und österreichischen …

Preismodell Pay-per-use (Compute-Ressourcen der …
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →
STACKIT

STACKIT Workflows - Managed Apache Airflow

STACKIT Workflows ist ein verwalteter Workflow-Orchestrierungsdienst auf Basis von Apache Airflow für Datenpipelines und …

Preismodell Pay-per-use
SLA SLA gemäß Anbieter (siehe offizielle SLA-Seite)
Vergleichen →

99 vergleichbare Produkte bei anderen Cloud-Anbietern gefunden.

Bereit, mit Gemini-Modelle: Foundation Models über die Gemini API zu starten?

Unsere zertifizierten Google Cloud Experten helfen bei Architektur, Integration und Optimierung.

Beratung vereinbaren