Google stellt Gemini Omni 1.1 Flash für Videogenerierung und -bearbeitung vor

LinkGoogleAnkündigung

Google ersetzt das bisherige Modell Gemini Veo 3.1 in der Gemini App durch Gemini Omni 1.1 Flash. Das multimodale Modell ermöglicht es, Videos von bis zu 10 Sekunden Länge inklusive nativem Audio über dialogbasierte Chat-Prompts zu generieren und schrittweise zu editieren.

Das Wichtigste

  1. Gemini Omni 1.1 Flash löst Veo 3.1 in der Gemini App als Standardmodell für Videos ab.
  2. Erstellung von 10-sekündigen Clips mit nativer Audioausgabe basierend auf Text, bis zu fünf Fotoreferenzen oder Video-Inputs.
  3. Mehrstufige Bearbeitung via Chat-Prompt: Szenen verlängern, Personen oder Kleidung austauschen, Beleuchtung anpassen und Bildstabilisierung.
  4. Optionaler KI-Avatar bildet Aussehen und Stimme des Nutzers nach, um wiederholte Foto-Uploads zu vermeiden.
  5. Kennzeichnung aller generierten Videos durch unsichtbare SynthID-Wasserzeichen inklusive Verifikationsfunktion im Chat.
  6. Nutzung erfordert ein kostenpflichtiges Google AI-Abonnement sowie ein Mindestalter von 18 Jahren.

Warum das relevant ist

Die direkte Verzahnung von Bild-, Audio- und Videogenerierung in einer textbasierten Chat-Schnittstelle senkt die Einstiegshürde für KI-gestützte Videoproduktion erheblich. Gleichzeitig standardisiert Google die Content-Verifikation über integrierte SynthID-Wasserzeichen.

Einordnung

Mit Gemini Omni vereinheitlicht Google seine multimodalen Fähigkeiten unter der Gemini-Kernmarke und beendet den separaten Betrieb von Veo in der Gemini App. Technisch hervorzuheben ist die Kombination aus nativer Audiogenerierung, Szenenverlängerung ('Extend Scene') und konsistenter Bildmodifikation über mehrere Zwischenschritte hinweg. Die Funktion, persönliche KI-Avatare anzulegen, zielt primär auf Creator ab, während SynthID regulatorischen Anforderungen an Kennzeichnungspflichten für synthetische Medien gerecht werden soll.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Artikel:Google AI for Developers

    Videogenerierung und -bearbeitung mit Gemini Omni Flash

    Google dokumentiert die Integration von Gemini Omni Flash (gemini-omni-1.1-flash) in die Gemini API. Das multimodale Modell verarbeitet Text, Bild, Audio sowie Video und erlaubt Text-to-Video- sowie Image-to-Video-Generierung inklusive Ton.

    KI & AI· Sammlung

  • Artikel:Anish Nangia, Alisa Fortin

    Google DeepMind stellt Gemini Omni 1.1 Flash für generative Video-Workflows vor

    Google hat Gemini Omni 1.1 Flash veröffentlicht. Das Modell bringt erweiterte Steuerungsfunktionen für generative Videoerstellung, darunter Szenenverlängerungen bis zu 40 Sekunden, Keyframe-Interpolation, kostengünstige 360p-Entwürfe und 4K-Upscaling.

    KI & AI· Ankündigung

  • Link:Google

    Google Flow: KI-Kreativstudio für Video, Bild und eigene Werkzeuge

    Google stellt mit Google Flow ein KI-gestütztes Kreativstudio vor, das Bild- und Videogenerierung mit dialogbasiertem Editing und individuell erstellbaren Tools bündelt. Die Plattform setzt auf Modelle wie Gemini Omni, Veo 3.1 und Nano Banana und deckt Workflows von der Planung über die Erstellung bis zur Feinabstimmung ab.

    KI & AI· Tool

  • Artikel:Tulsee Doshi

    Google stellt Gemini 3 Flash vor

    Google hat Gemini 3 Flash veröffentlicht. Das Modell kombiniert hohe Verarbeitungsgeschwindigkeit und niedrige Kosten mit der Denk- und Argumentationsleistung der Gemini-3-Reihe.

    KI & AI· Ankündigung

  • Link:Google DeepMind

    Google DeepMind veröffentlicht Gemini 3.8 Flash für agentenbasierte Workflows

    Google DeepMind hat Gemini 3.8 Flash vorgestellt, das auf komplexe agentenbasierte Aufgaben und Softwareentwicklung bei niedriger Latenz ausgelegt ist. Das multimodale Modell verarbeitet Eingaben wie Text, Audio, Bild, Video und PDF mit einem Kontextfenster von einer Million Tokens.

    KI & AI· Ankündigung

  • Artikel:Tulsee Doshi

    Google stellt Gemini 3.7 Flash vor

    Google hat Gemini 3.7 Flash veröffentlicht, ein für Programmierung und Agenten optimiertes Arbeitsmodell. Die Veröffentlichung erfolgt drei Wochen nach Version 3.6 Flash und bietet verbesserte Benchmark-Werte, optimierte Werkzeugnutzung sowie einen halbierten Einführungspreis.

    KI & AI· Ankündigung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.