Kurz gesagt: Google ersetzt Nano Banana 2 durch Nano Banana 2.1. Das auf Gemini 3.6 Flash basierende Bildmodell soll bessere Bildqualität, höhere Prompt-Treue und stabilere Bearbeitungen liefern. Gleichzeitig sinken die Kosten für 1K- und 2K-Bilder in der Gemini API um rund 50 Prozent.
Google entwickelt seine KI-Bildgenerierung weiter und verbindet beim neuen Nano Banana 2.1 höhere Qualität mit niedrigeren Preisen. Doch wie deutlich fallen die Verbesserungen gegenüber dem Vorgänger tatsächlich aus?
Nano Banana 2.1 basiert auf Gemini 3.6 Flash. Nach Angaben von Google wurden unter anderem Bildqualität und Realismus, die Umsetzung von Prompts, das Rendern von Text sowie die Konsistenz von Figuren über mehrere Bearbeitungsschritte hinweg verbessert. Dabei soll die für die Flash-Reihe typische Generierungsgeschwindigkeit erhalten bleiben.
Das Modell kann bis zu 14 Referenzbilder verarbeiten. Laut Google lassen sich damit bis zu vier Figuren konsistent darstellen und die Wiedergabetreue von bis zu zehn Objekten bewahren. Hinzu kommen drei konfigurierbare Reasoning-Stufen sowie der Zugriff auf die Google-Web- und Bildsuche.
Bilder können mit 1K, 2K oder 4K Auflösung erzeugt werden. Verbesserungen verspricht Google außerdem bei gezielten Veränderungen einzelner Bildbereiche und bei besonders breiten Panoramaformaten.
Bessere Ergebnisse – mit weiterhin bestehenden Grenzen
In Googles eigenen Benchmarks liegt Nano Banana 2.1 bei den aufgeführten Text-zu-Bild- und Bildbearbeitungsaufgaben vor Nano Banana 2 und Nano Banana Pro. Letzteres bleibt jedoch weiterhin als Premium-Modell für besonders komplexe visuelle Aufgaben im Angebot.
Vollständig gelöst sind bestehende Schwächen nicht. Google nennt weiterhin Probleme bei kleinem Text in 1K-Auflösung und bei längeren Textpassagen. Auch die Konsistenz von Figuren gelingt nicht in jedem Fall perfekt.
Rund 50 Prozent niedrigere Bildkosten bei 1K und 2K
Deutlich verändert hat Google die Preisstruktur für die Bildausgabe über die Gemini API. Im Standardtarif werden für Nano Banana 2.1 30 US-Dollar pro Million Output-Tokens berechnet. Beim Vorgängermodell waren es 60 US-Dollar.
Ein 1K-Bild kostet damit rund 3,36 statt 6,7 US-Cent. Bei 2K sinkt der Preis von etwa 10,1 auf 5,04 US-Cent. In beiden Fällen entspricht das einer Reduzierung um ungefähr 50 Prozent.
Bei 4K fällt der Unterschied geringer aus: Hier kostet ein Bild rund 11,3 statt 15,1 US-Cent, was einer Ersparnis von etwa 25 Prozent entspricht. Grund dafür ist, dass Nano Banana 2.1 für 4K-Bilder mehr Tokens berechnet als sein Vorgänger.
Die niedrigeren Bildpreise bedeuten allerdings nicht automatisch halbierte Gesamtkosten. Eingaben und Textausgaben werden teurer, darunter auch Tokens, die für das Reasoning verwendet werden.
Nano Banana 2.1 steht unter anderem in der Gemini-App, Google AI Studio, der Gemini API, AI Mode, Google Ads, Flow und Stitch zur Verfügung. Google hat Nano Banana 2 bereits abgekündigt und empfiehlt Version 2.1 als Nachfolger. Ein konkretes Abschaltdatum für das ältere Modell wurde bislang nicht genannt.
Für Unternehmen und Anwender, die KI-Bilder regelmäßig über Googles Plattformen oder die Gemini API erzeugen, können insbesondere die niedrigeren Kosten bei 1K und 2K interessant sein. Gleichzeitig bleibt bei der Kalkulation wichtig, nicht nur den reinen Bildpreis, sondern die gesamten API-Kosten einzubeziehen.
Weitere Entwicklungen rund um generative KI, Bildmodelle und deren praktische Nutzung ordnet der Newsletter „Beratung-KI“ regelmäßig kompakt und praxisnah ein.
Effizienz durch Innovation: Teile der textlichen und visuellen Ausgestaltung dieser Seite wurden durch generative KI-Systeme unterstützt.
