GoogleWatchBlog

Gemini Nano Banana 2.1: Google startet neue Version des KI-Bildgenerators – bringt jetzt mehr Konsistenz

» Web-Version «

Google legt wieder bei der medialen Gemini-KI nach und hat jetzt das neue KI-Modell Gemini Nano Banana 2.1 veröffentlicht. Die neue Version des KI-Bildgenerators soll es den Nutzern jetzt noch leichter machen, das gewünschte Bild zu erstellen, soll bei gleichem Aufwand die Kosten senken und noch dazu die Konsistenz einzelner Objekte und Charaktere über einen langen Zeitraum aufrechterhalten. Der Startschuss erfolgt jetzt für alle Nutzer.


Der KI-Bildgenerator Gemini Nano Banana erfreut sich seit langer Zeit großer Beliebtheit und dürfte für viele längst zum festen Bestandteil der Bildbearbeitung oder auch Bildgenerierung geworden sein. Die zweite Generation hat schon viele Monate auf dem Buckel, wurde erst vor einigen Monaten durch eine Lite-Version ergänzt und erhält jetzt einen Nachfolger mit dezenten Verbesserungen. Es ist noch kein 3er-Release mit großen Sprüngen, sondern eher Verbesserungen im Detail.

Das neue Gemini Nano Banana 2.1 basiert jetzt auf Gemini 3.6 Flash und verspricht laut Google eine höhere Bildqualität, mehr Realismus, eine exaktere Umsetzung der Prompts (Prompt-Treue) sowie ein besseres Textrendering. Trotz der Verbesserungen bleibt die schnelle Generierungsgeschwindigkeit der Flash-Modellreihe erhalten und soll daher nicht unter den Optimierungen leiden. In internen Benchmarks soll es sogar die Vorgängermodelle schlagen, auch wenn das ältere Pro-Modell vorerst für besonders komplexe Aufgaben bestehen bleibt.

Mit Nano Banana 2.1 können jetzt bis zu 14 Referenzbilder verarbeitet werden. Dabei lassen sich bis zu vier Figuren und zehn Objekte konsistent über mehrere Bearbeitungsschritte hinweg darstellen. Außerdem hat das KI-Modell jetzt Zugriff auf die Google-Websuche und Bildersuche, um noch mehr Objekte integrieren zu können. Zu guter Letzt verspricht man ein verbessertes Reasoning, das sich in drei Stufen für logisches Schlussfolgern konfigurieren lässt.




Für die Ausgabe der Bilder hat man ebenfalls am Modell geschraubt und bietet verschiedene Auflösungen und Abmessungen: Bilder können in 1K, 2K oder 4K generiert werden. Zudem wurden extrem breite Panoramaformate und die gezielte Bearbeitung einzelner Bildbereiche verbessert. Das Modell hat laut Google noch leichte Probleme mit sehr kleinem Text in 1K-Auflösung, längeren Textpassagen und einer manchmal nicht perfekten Figurenkonsistenz, doch diese wird man wohl mit dem nächsten Major-Release in den Griff bekommen.

Gleichzeitig mit diesen Verbesserungen soll der Preis sinken: Der Preis pro Million Output-Tokens sinkt von 60 auf 30 US-Dollar. Bilder in 1K und 2K sind etwa 50 Prozent günstiger geworden (ca. 3,36 bzw. 5,04 US-Cent pro Bild). 4K-Bilder sind rund 25 Prozent günstiger. Da die Preise für Eingaben und Textausgaben (inklusive der neuen Reasoning-Tokens) gestiegen sind, halbieren sich die Gesamtkosten für Entwickler dennoch nicht zwangsläufig.

Dass man jetzt noch eine 2.1-Version herausbringt und nicht rund um den baldigen Schwung von Gemini 4 auf Nano Banana 3 geht, zeigt, dass man intern derzeit auf die Bremse tritt. Daher ist auch nicht zu erwarten, dass wir zeitnah die dritte Generation erhalten werden.

» Android Auto: Google zieht Millionen Smartphones den Stecker – Nutzung in Kürze nur ab Android 11 aufwärts

Letzte Aktualisierung am 2.10.2026 / Bilder von der Amazon Product Advertising API / Affiliate Links, vielen Dank für eure Unterstützung! Als Amazon-Partner verdiene ich an qualifizierten Verkäufen.


Keine Google-News mehr verpassen:
GoogleWatchBlog bei Google News abonnieren | Jetzt den GoogleWatchBlog-Newsletter abonnieren