Begriff
Gemma 3n
Offenes, mobil-first ausgelegtes KI-Modell von Google, als Preview im Mai 2025 und voll ab 26. Juni 2025 verfügbar. Multimodal (Text, Bild, Audio, Video), auf Geräte-Betrieb optimiert; offene Gewichte in den Größen E2B und E4B.
Gemma 3n — ausführlicher erklärt
Gemma 3n gehört zur offenen Gemma-Modellfamilie von Google und ist speziell auf den Betrieb direkt auf Endgeräten (on-device) ausgelegt. Google stellte das Modell zunächst im Mai 2025 als Preview vor; die vollständige Veröffentlichung folgte am 26. Juni 2025. Anders als proprietäre Cloud-Modelle stehen die Gewichte offen zur Verfügung und lassen sich lokal ausführen.
Gemma 3n ist multimodal: Es verarbeitet Text, Bilder, Audio und Video als Eingabe und gibt Text aus. Verfügbar ist es in zwei Größen, E2B und E4B. Das „E” steht für „Effective” (effektive Parameter): Die tatsächlichen Parameterzahlen liegen bei rund 5 bzw. 8 Milliarden, dank Speicheroptimierungen benötigen die Modelle im Betrieb aber nur den Speicherbedarf von etwa 2 bzw. 4 Milliarden Parametern. Damit bringt Gemma 3n multimodale Fähigkeiten, wie sie zuvor Cloud-Frontier-Modellen vorbehalten waren, auf mobile und Edge-Hardware.
Zum Start unterstützte ein breites Ökosystem das Modell, darunter Hugging Face, llama.cpp, Ollama, LM Studio, MLX, NVIDIA und vLLM.
Beispiel / Praxisbezug
Der on-device-Fokus macht Gemma 3n interessant, wo Daten das Gerät nicht verlassen sollen oder keine stabile Internetverbindung besteht: Sprach- und Bildverarbeitung direkt auf dem Smartphone, Offline-Assistenten oder datenschutzsensible Anwendungen. Weil die Gewichte offen sind, lässt sich das Modell frei feinabstimmen und in eigene Apps integrieren — ohne API-Kosten pro Anfrage.
Für kleinere Teams heißt das: multimodale KI-Funktionen prototypisch lokal testen, ohne von einem kostenpflichtigen Cloud-Anbieter abhängig zu sein.
Abgrenzung zu ähnlichen Begriffen
Gemma ist Googles offene Modellfamilie und damit von den proprietären, cloud-basierten Gemini-Modellen zu unterscheiden. Innerhalb von Gemma steht das Kürzel „3n” für die mobil-first-, on-device-optimierte Variante der dritten Generation; daneben existieren reguläre Gemma-3-Modelle in verschiedenen Größen. Die Größenangaben E2B/E4B bezeichnen den effektiven Speicherbedarf, nicht die reale Parameterzahl.