Google hat Gemma 3n als erste Vorschau eines offenen Modells vorgestellt, das auf eine neue mobile-first Architektur für On-Device-KI aufbaut. Die Architektur wurde laut Google in enger Zusammenarbeit mit Qualcomm Technologies, MediaTek und Samsung System LSI entwickelt und ist auf schnelle multimodale Verarbeitung direkt auf Geräten wie Smartphones, Tablets und Laptops ausgelegt.
Gemma 3n ist das erste offene Modell auf dieser gemeinsamen Architektur. Dieselbe Grundlage treibt nach Angaben des Unternehmens auch die nächste Generation von Gemini Nano an, die später im Jahr für verschiedene Funktionen in Google-Apps und im On-Device-Ökosystem verfügbar werden soll. Mit Gemma 3n können Entwickler diese technische Basis bereits in einer frühen Preview erproben, die auch für künftige Plattformen wie Android und Chrome vorgesehen ist.
Ein zentrales technisches Element ist eine Google-DeepMind-Entwicklung namens Per-Layer Embeddings (PLE), die den RAM-Bedarf deutlich senken soll. Obwohl die rohe Parameterzahl bei 5B und 8B liegt, soll sich das Modell mit einem Speicher-Overhead ausführen lassen, der laut Google eher einem 2B- beziehungsweise 4B-Modell entspricht. Daraus ergibt sich ein dynamischer Speicherbedarf von 2 GB und 3 GB, wodurch größere Modelle auf Mobilgeräten laufen oder per Live-Streaming aus der Cloud genutzt werden können.
Google beschreibt Gemma 3n als für schnelle KI-Erlebnisse mit kleinem Footprint entwickelt, die lokal ausgeführt werden. Genannt werden multimodale Anwendungen mit Audio-, Bild-, Video- und Texteingaben, die privat auf dem Gerät verarbeitet werden können. Zudem hebt das Unternehmen Audio-Anwendungen wie Echtzeit-Sprachtranskription, Übersetzung und sprachgesteuerte Interaktionen hervor.
Zur verantwortungsvollen Entwicklung heißt es, Gemma 3n habe wie andere Gemma-Modelle Sicherheitsbewertungen, Data Governance und ein Fine-Tuning zur Ausrichtung an den eigenen Sicherheitsrichtlinien durchlaufen. Google beschreibt den Umgang mit offenen Modellen als fortlaufenden Prozess der Risikobewertung und Anpassung an veränderte Rahmenbedingungen.
Die Vorschau ist ab sofort verfügbar. Google ordnet Gemma 3n als nächsten Schritt ein, um den Zugang zu effizienter KI breiter zu öffnen, und kündigt an, die Technologie schrittweise bereitzustellen.
