Zurück zum Glossar

Begriff

Gemini 3 Flash

Gemini 3 Flash ist Googles schnelles, günstiges Thinking-Modell vom 17. Dezember 2025 — Pro-nahe Reasoning-Leistung bei 1 Mio. Token Kontext, ausgelegt auf agentische Workflows und Coding.

Gemini 3 Flash — ausführlicher erklärt

Google veröffentlichte Gemini 3 Flash am 17. Dezember 2025 als schnelle, kostengünstige Variante der Gemini-3-Generation. Innerhalb der Gemini-Familie ist Flash die Effizienz-Klasse: Sie liegt unter dem Spitzenmodell Gemini 3 Pro, zielt aber auf hohen Durchsatz zu niedrigem Preis. Gemini 3 Flash ist ein Thinking-Modell — es kann vor der Antwort explizit Rechenschritte durchlaufen — und ist auf agentische Workflows, mehrstufige Chats und Coding-Unterstützung ausgelegt. Google hebt verbesserte visuelle und räumliche Reasoning-Fähigkeiten sowie agentisches Coding hervor.

Laut Google liefert Gemini 3 Flash Pro-nahe Reasoning-Leistung rund dreimal schneller als Gemini 2.5 Pro und verbraucht dabei etwa 30 % weniger Tokens.

Beispiel / Praxisbezug

Die Eckdaten: Kontextfenster von 1.048.576 Tokens, maximale Ausgabe 65.536 Tokens. Preis 0,50 USD je 1 Mio. Input-Tokens und 3 USD je 1 Mio. Output-Tokens; Cache-Reads und Bild-Input sind günstiger, Websuche wird separat abgerechnet. Der Zugang ist proprietär über die Gemini-API und die Google-AI-Plattformen. Das große Kontextfenster und der niedrige Token-Preis machen Flash besonders geeignet für hochvolumige Aufgaben — etwa das Verarbeiten langer Dokumente, RAG-Pipelines oder Agenten, die viele Modellaufrufe pro Durchlauf benötigen.

Abgrenzung

Gemini 3 Flash ist nicht Googles leistungsfähigstes Modell — für maximale Qualität steht Gemini 3 Pro bereit. Flash tauscht einen Teil der Spitzenleistung gegen Geschwindigkeit und Kosten und ist damit das Arbeitspferd für skalierende Produktionslasten. Innerhalb der Flash-Linie ist die 3er-Version der Nachfolger der 2.5-Flash-Generation.

Alle Beiträge im Überblick:Gemini Flash