Google DeepMind veröffentlicht Nano Banana 2 Lite und Gemini Omni Flash für Entwickler
Google/DeepMind
Google DeepMind
Google DeepMind hat Nano Banana 2 Lite vorgestellt, das schnellste und kostengünstigste Bildgenerierungsmodell, das in 4 Sekunden zu einem Preis von 0,034 US-Dollar pro 1.000 Bildern arbeitet, zusammen mit Gemini Omni Flash für textbasierte Videogenerierung und -bearbeitung, verfügbar für 0,10 US-Dollar pro Sekunde Video. Beide Modelle sind jetzt in Google AI Studio, der Gemini API und auf den Verbraucherplattformen von Google zugänglich.
Google DeepMind hat die Veröffentlichung von zwei neuen KI-Modellen angekündigt: Nano Banana 2 Lite und Gemini Omni Flash. Nano Banana 2 Lite ist das schnellste und kosteneffizienteste Bildgenerierungsmodell der Nano-Banana-Familie, das in der Lage ist, aus einer Textbeschreibung in 4 Sekunden ein Bild zu erzeugen, bei Kosten von 0,034 US-Dollar pro 1.000 Bilder. Es wurde für Szenarien entwickelt, in denen Geschwindigkeit und niedrige Kosten entscheidend sind, und wird als Ersatz für das vorherige Nano-Banana-Modell (gemini-2.5-flash-image) empfohlen. Das Modell ist bereits in Google AI Studio, der Gemini API, der Gemini Enterprise Agent Platform sowie auf Google-Verbraucheroberflächen wie dem KI-Modus in der Suche, der Gemini-App, NotebookLM, Google Fotos, Stitch, Google Flow und Google Ads verfügbar. Gemini Omni Flash hingegen ist ein Modell zur Generierung und Bearbeitung von Videos aus Text, Bildern und Video, das auf der Google I/O vorgestellt wurde. Es unterstützt dialogbasierte Videobearbeitung, multimodale Referenzen und Text-zu-Aktion-Synchronisation. Der Preis beträgt 0,10 US-Dollar pro Sekunde Video, was dem Preis von Veo 3.1 Fast entspricht. Zu den Einschränkungen gehören die Generierung von Videos mit einer maximalen Länge von 10 Sekunden, die fehlende Unterstützung von Audioreferenzen und Szenenerweiterungen in der API sowie Einschränkungen hinsichtlich der Konsistenz der Charaktere bei Szenenwechseln. Beide Modelle verwenden SynthID-Wasserzeichen zur Sicherheit. Entwickler können die Modelle kombinieren, um komplexe Multimedia-Anwendungen zu erstellen, beispielsweise indem sie in Nano Banana 2 Lite ein Bild generieren und dieses dann mit Gemini Omni Flash in ein Video animieren.
Quelle: Google DeepMind —
Original
