INDIEN / LONDON (IT BOLTWISE) – Google bündelt mit „Gemini Omni“ ein neues KI-Modell, das Videoinhalte über Text- und Multimodal-Eingaben konversationell erzeugen und ändern soll. In einer geschlossenen Beta-Phase können Nutzer damit direkt in der Gemini-Oberfläche sowie in YouTube Create arbeiten. Für Entwickler und Unternehmen stellt Google Cloud zudem Gemini Omni Flash im öffentlichen Preview bereit – abgerechnet wird mit zehn Cent pro Sekunde generiertem Video. Ergänzend rückt der Konzern die plattformübergreifende Video-Infrastruktur über „Google Flow“ in den Fokus.

Die wichtigste Änderung an Googles KI-Video-Offensive wirkt auf den ersten Blick unspektakulär, ist aber für Workflows entscheidend: Anstatt Videobearbeitung als klassisches Schnitt- oder Compositing-Projekt zu behandeln, setzt das Unternehmen auf dialogbasierte Eingaben direkt in der eigenen Nutzeroberfläche. Mit „Gemini Omni“ sollen Nutzer in einer geschlossenen Beta-Phase Videoinhalte per Text- und Multimodal-Eingaben generieren und modifizieren können – und zwar sowohl in der Gemini-Oberfläche als auch in YouTube Create. Das Ziel ist klar: kreative Entscheidungen sollen nicht mehr ausschließlich über Timeline, Effekte-Menüs und spezialisierte Tools getroffen werden, sondern auch über sprachlich formulierte Änderungswünsche.
Technisch wird das Modell damit zu einer Art Interaktionsschicht zwischen Inhaltserzeugung und Bearbeitung, die Kontext aus der jeweiligen Anfrage ableitet. Google Cloud ergänzt dies für Entwickler und Unternehmen durch „Gemini Omni Flash“, das im öffentlichen Preview verfügbar ist. Die Abrechnung erfolgt über Sekunden generierten Videos: zehn Cent pro Sekunde. In derselben Modellfamilie erreicht laut Ankündigung außerdem „Nano Banana 2 Lite“ die allgemeine Verfügbarkeit; das System soll Bilder in vier Sekunden erzeugen und sich als kosteneffizienter Einstieg positionieren. Für die Frage der digitalen Herkunft setzt Google bei beiden Modellen auf C2PA- und SynthID-Wasserzeichen – also Mechanismen, die nachvollziehbar machen sollen, woher ein synthetischer Inhalt stammt und ob er verändert wurde.
Die nächste Ebene ist „Google Flow“, eine eigene Plattform, die Googles Videofunktionen bündelt und damit auch die Integrationsfrage für Unternehmen adressiert. Statt einzelne Modelle losgelöst anzubieten, verweist der Konzern auf Bausteine wie „Veo 3.1“, das Audio sowie mehrere Seitenverhältnisse unterstützen soll, und auf „Imagen 4“. Das Abrechnungsmodell unterscheidet kostenlose und Profi-Stufen über Credits: Die kostenlose Stufe startet mit 100 Start-Credits und 50 täglichen Erneuerungen, Profi-Stufen erhalten monatlich 1.000 beziehungsweise 25.000 Credits. Für Teams mit planbaren Produktionszyklen ist das relevant, weil es die Kosten nicht auf einzelne Abrufe, sondern auf ein Budgetsystem herunterbricht, das sich eher in interne Freigaben und Kapazitätsplanung einfügen lässt.
Parallel zur technischen Freigabe spielt Google die Markteinführung über gezielte Kommunikation aus. Für die Erschließung nicht-metropolitaner Märkte startet das Unternehmen in Indien eine Kampagne mit Schauspieler Shah Rukh Khan und Texter Prasoon Joshi; entwickelt mit McCann India und Nirvana Films. Der Fokus liegt auf mehrsprachiger Interaktion und auf „praktischen KI-Anwendungen“ statt auf abstrakter Technologie. In einem zentralen Werbespot wird Gemini Live so inszeniert, dass es eine Frau beim Kathak-Tanztraining unterstützt und daraus eine Einkommensquelle macht. Flankiert wird das durch Außenwerbung in Metropolen wie Mumbai; die Botschaft zielt damit auf traditionelle Händler und Kreative, die KI als verständlichen Assistenten begreifen sollen – nicht als rein technische Spielerei.
Für die Werbewirtschaft kommt eine weitere Dimension hinzu, weil Google seine Demand-Gen-Tools mit Gemini-Funktionen in den Markt trägt. Laut den Angaben aus dem zweiten Quartal 2026 verzeichneten Direct-to-Consumer-Marken 18 bis 34 Prozent niedrigere Akquisitionskosten als mit konkurrierenden Social-Media-Werbeplattformen. Einige Beauty- und Einzelhandelsmarken hätten daraufhin bis zu 20 Prozent ihrer Social-Media-Budgets in Googles KI-gesteuerte Werbekanäle umgeschichtet. Inhaltlich passt das zu Googles Strategie, KI nicht nur als Produktionswerkzeug zu positionieren, sondern auch als Beschleuniger für Performance-Marketing – also entlang des gesamten Pfads von der Kreation bis zur Kampagnenoptimierung.
Damit steigt aber auch der Aufwand, neue Systeme sauber zu dokumentieren und in Qualitätsprozesse einzubetten. Der Text ordnet außerdem an, dass viele KI-Anwendungen unter spezifische Risikoklassen fallen und deshalb genaue Dokumentation sowie Qualitätssicherung erfordern – und verweist auf einen Überblick zum EU AI Act mit Pflichten, Fristen und Risikoklassen. Für Unternehmen heißt das in der Praxis: Wer KI-gestützte Video- oder Werbeinhalte in Produkte und Prozesse übernimmt, muss stärker als bisher nachweisen können, wie Modelle eingesetzt werden, welche Daten und Eingaben eine Rolle spielen und wie man die Einhaltung interner Qualitätskriterien überprüft. Gerade bei dialogbasierter Videobearbeitung ist die Abgrenzung wichtig: Nicht jede kreative Änderung ist automatisch „harmlos“, und nicht jede Anwendung lässt sich ohne Prüfpfade in bestehende Governance-Strukturen integrieren.
Auch die Produktlandschaft rund um die Video- und KI-Modelle erweitert sich spürbar. Neben der Modellfamilie taucht „Pixel Drop“ mit „Screen Reactions for Creators“ auf sowie Tools zur Musikgenerierung aus Ideen; einige Funktionen sollen zunächst Pixel-Geräte mit Android 17 QPR1 Beta 4 betreffen. Auf der Notiz- und Wissensseite erlaubt „NotebookLM“ zudem die dynamische Integration neuer Quellen während laufender Sitzungen und die Synthese von Dokumenten in interaktive Audio-Diskussionen. Ergänzende Wünsche von Power-Usern reichen von plattformübergreifenden Notizbuch-Verweisen bis zu feineren Kontrollen über Audio-Zusammenfassungen. Und weil Google die Enterprise-Schiene über „Gemini Enterprise Agent Platform“ besetzt, zeigen Integrationen wie beim Kommunikationsunternehmen Weave: Dort wird ein KI-Rezeptionsagent genannt, während zugleich Wachstum im zweiten Quartal im Text mit 15,5 Prozent auf 67,5 Millionen Dollar beziffert wird. Flankiert wird das Ökosystem laut Ankündigung auch durch Open-Source-Werkzeuge wie „OmniRoute“ als KI-Gateway sowie „Open Design“ für lokale Design- und Prototyping-Aufgaben, die Gemini-Modelle adressieren sollen.
💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!
- ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
- IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
- 【MEHR LEBEN FÜR DEINEN SCHREIBTISCH】 Lerne Eilik kennen – deinen kleinen Roboter-Freund mit Persönlichkeit. Mit liebevollen Animationen, ausdrucksstarken Reaktionen und spielerischen Interaktionen bringt Eilik mehr Freude in deinen Alltag. Ob auf dem Schreibtisch, im Büro oder am Nachttisch – Eilik wird schnell zu einem vertrauten Begleiter für besondere Momente.
- 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
- V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.
- Die besten Bücher rund um KI & Robotik!

- Die besten KI-News kostenlos per eMail erhalten!
- Zur Startseite von IT BOLTWISE® für aktuelle KI-News!
- IT BOLTWISE® kostenlos auf Patreon unterstützen!
- Aktuelle KI-Jobs auf StepStone finden und bewerben!
- Künstliche Intelligenz: Dem Menschen überlegen – wie KI uns rettet und bedroht | Der Neurowissenschaftler, Psychiater und SPIEGEL-Bestsellerautor von »Digitale Demenz«
Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "Gemini Omni: Google bringt KI-Videobearbeitung per Dialog in Profi-Tools" für unsere Leser?


#Sophos
Es werden alle Kommentare moderiert!
Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.
Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.
Du willst nichts verpassen?
Du möchtest über ähnliche News und Beiträge wie "Gemini Omni: Google bringt KI-Videobearbeitung per Dialog in Profi-Tools" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »Gemini Omni: Google bringt KI-Videobearbeitung per Dialog in Profi-Tools« bei Google Deutschland suchen, bei Bing oder Google News!