# Nano Banana 2.1: Daten, Funktionen und offene Fragen

> Nano Banana 2.1 ist laut Google-Cloud-Dokumentation ein Modell für multimodale Bildgenerierung und -bearbeitung mit einem Gleichgewicht aus Preis und Leistung. Es trägt die Modell-ID „gemini-nano-banana-2.1“ und wird auf der Gemini Enterprise Agent Platform geführt. Zu Veröffentlichungsdatum, Preis und Unterschied zu Nano Banana 2 nennt Google bislang nichts.

Veröffentlicht: 06.10.2026 · Kategorie: Künstliche Intelligenz · Adresse: https://www.heisenberg-it.de/blog/nano-banana-2-1-google-bildmodell

## Das Wichtigste in Kürze

- Die Modell-ID lautet gemini-nano-banana-2.1; Text und Bild sind Ein- und Ausgabe, Video nur Eingabe.
- Das Kontextfenster umfasst 131.072 Token, die maximale Ausgabe 32.768 Token, pro Prompt sind bis zu 14 Bilder erlaubt.
- Function Calling, Structured Output, Tuning und Code Execution werden nicht unterstützt.
- Preis, Veröffentlichungsdatum, Status, Regionen und Unterschied zu Nano Banana 2 sind offen.
- Daten und Preise von Nano Banana 2 lassen sich nicht automatisch auf 2.1 übertragen.

## Was ist Nano Banana 2.1?

Nano Banana 2.1 ist ein Bildmodell von Google, das laut Google-Cloud-Dokumentation für multimodale Bildgenerierung und -bearbeitung optimiert ist und Preis und Leistung ausbalancieren soll [1]. Es wird auf der Gemini Enterprise Agent Platform geführt, der Google-Cloud-Plattform, in deren Dokumentation die Modellseite steht [1].

> **Definition:** „Nano Banana“ ist der Marketingname der Gemini-Bildmodelle. Nano Banana 2 heißt offiziell Gemini 3.1 Flash Image [2].

Im Navigationsmenü der Dokumentation steht 2.1 in der Gruppe „Image“. Dort finden sich auch Nano Banana 2, Nano Banana 2 Lite, Nano Banana Pro und das erste Nano Banana [1].

## Was ist neu gegenüber Nano Banana 2?

Das ist derzeit offen: Google hat bislang weder eine Ankündigung noch Release Notes zu 2.1 veröffentlicht. Auch Veröffentlichungsdatum und Status (allgemein verfügbar oder Vorschau) nennt die Modellseite nicht [1].

Zum Vorgänger gibt es mehr Angaben. Google stellte Nano Banana 2 am 26.02.2026 vor. Es verbindet laut Google Fähigkeiten des Pro-Modells mit dem Tempo der Flash-Reihe [3]. Diese Angaben beschreiben nur den Vorgänger und sagen nichts über Änderungen in 2.1.

## Modell-ID, Modalitäten und Limits

Die Modell-ID lautet `gemini-nano-banana-2.1` [1]. Text und Bild sind als Ein- und Ausgabe möglich, Video nur als Eingabe. Audio wird nicht unterstützt [1].

| Merkmal | Angabe laut Google-Cloud-Doku [1] |
|---|---|
| Kontextfenster | 131.072 Token |
| Maximale Ausgabe | 32.768 Token |
| Bilder pro Prompt | bis zu 14 |
| Eingabegröße | bis 500 MB |
| Datei bei Direkt-Upload (inline) | maximal 7 MB |
| Datei aus Google Cloud Storage | maximal 30 MB |

Zur Zahl der Ausgabebilder pro Prompt, zu unterstützten Auflösungen und Seitenverhältnissen macht die Modellseite keine Angaben.

> **Gut zu wissen:** Wer größere Dateien als 7 MB verarbeitet, muss sie laut Doku aus Google Cloud Storage laden. Dort gilt ein Limit von 30 MB pro Datei [1].

## Was kann das Modell, und was fehlt?

Das Modell erzeugt und bearbeitet Bilder, auch mehrstufig, und kann Text und Bild gemischt ausgeben („Interleaved“). Die Bildgenerierung funktioniert laut Doku auch mit Videoeingabe [1]. Eine Videoausgabe gibt es nicht.

Unterstützt werden laut Dokumentation [1]:

- Thinking (Zwischenschritte vor der Antwort), Systemanweisungen und Token zählen
- implizites Context Caching (automatisches Zwischenspeichern wiederkehrender Eingaben)
- Grounding mit Google Search und Bildersuche (Antworten werden an Suchergebnisse gebunden)
- C2PA Content Credentials (Herkunftsangaben in der Bilddatei)
- Virtual Try-on (virtuelles Anprobieren)

Nicht unterstützt werden Function Calling, Code Execution, Structured Output, Tuning, RAG Engine, Chat Completions, URL Context und die Gemini Live API [1]. Die Interactions API, ein Preview-Feature, wird ebenfalls nicht unterstützt [1].

> **Achtung:** Ohne Function Calling und Structured Output lässt sich das Modell nicht direkt als Werkzeug in Agenten-Abläufe einbinden, die feste Datenformate erwarten. Das sollten Entwickler vor einer Planung prüfen [1].

## Was kostet Nano Banana 2.1?

Einen Preis für Nano Banana 2.1 nennt die Modellseite nicht. Als Nutzungsarten führt sie Standard-PayGo (Abrechnung nach Verbrauch), Provisioned Throughput (reservierte Kapazität) und Batch-Inferenz (gebündelte Verarbeitung) auf. Fixed Quota wird nicht unterstützt [1].

Zum Vorgänger berichtet The Decoder unter Verweis auf einen Google-Leitfaden Preise je Bild: Nano Banana 2 kostet 0,045 USD (0,5K), 0,067 USD (1K), 0,101 USD (2K) und 0,151 USD (4K). Nano Banana Pro liegt bei 0,134 USD (1K und 2K) und 0,240 USD (4K). Die Batch-API gibt 50 % Rabatt [4].

> **Achtung:** Diese Preise gelten für Nano Banana 2 und Pro, nicht automatisch für 2.1. Verbindlich ist die aktuelle Preisseite von Google Cloud.

## Wie unterscheidet es sich von Nano Banana 2, Lite und Pro?

Sicher ist nur der Menüeintrag: Die Modellseite führt die Modelle nebeneinander [1]. Einen direkten Vergleich zu 2.1 hat Google nicht veröffentlicht.

Nano Banana 2 bietet Auflösungen von 512 px bis 4K und extreme Seitenverhältnisse wie 4:1 und 1:4 [5]. Ob 2.1 das ebenfalls kann, ist offen. Zum Verhältnis von 2.1 zu Nano Banana 2 Lite fehlen Details. Nano Banana Pro ist je Bild teurer als Nano Banana 2 [4].

## Für wen kommt es infrage?

Entwickler auf Google Cloud können das Modell über die Modell-ID ansprechen, wenn Text-zu-Bild, Bildbearbeitung und Grounding genügen. Für strukturierte Ausgaben oder Werkzeugaufrufe fehlen die Funktionen [1].

Unternehmen, die schon Google Cloud nutzen, finden das Modell in ihrer Plattform-Dokumentation. Wer Modelle vergleicht, sollte Qualität und Tempo selbst testen, denn Google nennt für 2.1 keine Messwerte.

## Ist es in der EU und für Unternehmen nutzbar?

Das Modell läuft auf einer Google-Cloud-Plattform und damit in einem Unternehmenskontext [1]. Welche Regionen unterstützt werden und wie der Datenstandort in der EU geregelt ist, nennt die Modellseite nicht. Klären Sie das vor dem Einsatz mit Google, vor allem bei personenbezogenen Bildern.

Für die Kennzeichnung KI-erzeugter Bilder nennt die Doku C2PA Content Credentials [1]. Google nutzt zudem SynthID für KI-Bilder seiner Modelle [3]. Ob und wie SynthID bei 2.1 greift, ist offen.

## Grenzen: Was sich noch nicht sagen lässt

Folgende Punkte sind offen:

- Veröffentlichungsdatum und Status (GA oder Preview)
- Preis pro Bild oder Token
- Regionen und Datenstandort
- Verfügbarkeit in der Gemini-App und der Gemini API
- Auflösungen, Seitenverhältnisse und maximale Ausgabebilder pro Prompt
- Qualität und Geschwindigkeit im unabhängigen Test

Angaben von Google zu Leistung sind Herstellerangaben. Zu Benchmarks für 2.1 nennt Google nichts. Wer weitere aktuelle Google-Modelle einordnen will, findet Hintergründe in [Gemini 4 Argon im Überblick](/blog/gemini-4-argon-googles-antwort-auf-gpt-astra).

Stand: Oktober 2026.

## Fazit

Nano Banana 2.1 ist ein technisch beschriebenes Bildmodell auf der Cloud-Plattform von Google, mit klaren Limits und einer Liste fehlender Funktionen. Für Preis, Neuerungen und Qualität sind eine Ankündigung von Google oder die Preisseite abzuwarten. Daten von Nano Banana 2 sollten nicht auf 2.1 übertragen werden.

## Häufige Fragen

### Wie lautet die Modell-ID von Nano Banana 2.1?

Die Modell-ID lautet gemini-nano-banana-2.1. So führt sie die Google-Cloud-Dokumentation auf der Gemini Enterprise Agent Platform [1]. Die ID gilt nur für diese Version. Nano Banana 2, Nano Banana 2 Lite und Nano Banana Pro haben eigene Einträge im Menü der Dokumentation, mit jeweils eigenen Modellseiten.

### Unterstützt Nano Banana 2.1 Function Calling oder Structured Output?

Nein, beides wird laut Google-Cloud-Dokumentation nicht unterstützt [1]. Das Gleiche gilt für Code Execution, Tuning, RAG Engine, Chat Completions, URL Context und die Gemini Live API. Unterstützt werden dagegen Systemanweisungen, Thinking, Context Caching und Grounding mit Google Search sowie mit Bildersuche. Für Agenten mit festen Datenformaten ist das eine relevante Einschränkung.

### Kann man Nano Banana 2.1 feinabstimmen (Tuning)?

Nein, Tuning wird laut Google-Cloud-Dokumentation nicht unterstützt [1]. Das Modell lässt sich also nicht mit eigenen Daten nachtrainieren. Möglich sind laut Doku Systemanweisungen und Context Caching, mit denen sich das Verhalten über den Prompt steuern lässt. Ein eigenes Training oder eine RAG Engine werden nicht angeboten.

### Wie viele Bilder lassen sich pro Prompt als Eingabe verwenden?

Pro Prompt sind bis zu 14 Bilder erlaubt [1]. Bei Direkt-Upload oder Inline-Daten gilt ein Limit von 7 MB pro Datei, aus Google Cloud Storage sind es 30 MB. Die gesamte Eingabegröße darf bis zu 500 MB betragen. Wie viele Ausgabebilder pro Prompt möglich sind, ist offen.

### Gibt es einen Batch-Rabatt für Nano Banana 2.1?

Dazu nennt Google bislang nichts. Die Doku führt Batch-Inferenz als unterstützte Nutzungsart auf, aber keinen Preis oder Rabatt für 2.1 [1]. Für Nano Banana 2 berichtet The Decoder von 50 % Rabatt bei der Batch-API [4]. Auf 2.1 lässt sich das nicht übertragen. Maßgeblich ist die aktuelle Preisseite von Google Cloud.

### Kann Nano Banana 2.1 Videos erzeugen?

Nein, Video wird nur als Eingabe unterstützt, nicht als Ausgabe [1]. Das Modell gibt Text und Bild aus. Die Doku nennt außerdem Bildgenerierung aus Videoeingabe. Audio wird weder als Ein- noch als Ausgabe unterstützt. Für Videoerzeugung ist Nano Banana 2.1 laut Doku also nicht gedacht.

## Quellen

1. [Gemini Nano Banana 2.1](https://docs.cloud.google.com/gemini-enterprise-agent-platform/models/gemini/nano-banana-2-1) – Google Cloud, 2026
2. [Google's Nano Banana 2 promises Flash speeds with Pro results](https://thenewstack.io/nano-banana-2/) – The New Stack
3. [Nano Banana 2: Google's latest AI image generation model](https://blog.google/innovation-and-ai/technology/ai/nano-banana-2/) – Google, 26.02.2026
4. [Bildgenerierung mit Nano Banana: Google erklärt die Unterschiede der drei Modelle](https://the-decoder.de/bildgenerierung-mit-nano-banana-google-erklaert-die-unterschiede-der-drei-modelle/) – The Decoder
5. [Google's Nano Banana 2 brings Pro-level image generation to Flash speeds at up to 40% lower API cost](https://the-decoder.com/googles-nano-banana-2-brings-pro-level-image-generation-to-flash-speeds-at-up-to-40-lower-api-cost/) – The Decoder

Mit KI-Unterstützung recherchiert und geschrieben, fachlich geprüft von Hannes Ftuni am 06.10.2026. Herausgeber: Heisenberg IT GmbH, Bochum.
