Google DeepMind stellt Gemini Omni 1.1 Flash für generative Video-Workflows vor

ArtikelAnish Nangia, Alisa FortinAnkündigung

Google hat Gemini Omni 1.1 Flash veröffentlicht. Das Modell bringt erweiterte Steuerungsfunktionen für generative Videoerstellung, darunter Szenenverlängerungen bis zu 40 Sekunden, Keyframe-Interpolation, kostengünstige 360p-Entwürfe und 4K-Upscaling.

Das Wichtigste

  1. Szenenverlängerung: Das Modell berücksichtigt bis zu 10 Sekunden Vorlaufkontext (vorher 1 Sekunde) und verlängert Clips in 10-Sekunden-Schritten auf bis zu 40 Sekunden Gesamtdauer.
  2. Start- und End-Frames: Durch Angabe von Anfangs- und Endbildern lassen sich kontinuierliche Übergänge und gezielte Kamerabewegungen generieren.
  3. Schnellere Drafts in 360p: Niedrig aufgelöste Vorschauen rendern laut Google bis zu 60 Prozent schneller und kosten ein Drittel im Vergleich zur 720p-Auflösung.
  4. 4K-Upscaling: Fertige Videos können für professionelle Anforderungen in 1080p oder 4K ausgegeben werden.
  5. Video-Referenzen als Input: Bis zu drei Sekunden Videomaterial können als Referenz für visuelle Konsistenz und Charakterbewegungen übergeben werden.
  6. Verfügbarkeit: Zugriff besteht über das Google AI Studio sowie die Gemini Enterprise Agent Platform API.

Warum das relevant ist

Generative Videos litten bisher oft unter fehlender zeitlicher Konsistenz und unberechenbaren Kameraschnitten. Die Kombination aus Start-/Endbild-Steuerung, längerem Kontext und preiswerten Preview-Rendern adressiert konkrete Pain Points in professionellen Produktionspipelines.

Einordnung

Mit Omni 1.1 Flash fokussiert sich Google auf steuerbare Workflows statt reiner One-Shot-Prompt-Generierung. Frühe Integrationen in Werkzeuge wie Adobe Firefly und Figma Weave zeigen, dass die API gezielt für Entwickler kreativer Software und iteratives Arbeiten optimiert wurde.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:Google

    Google stellt Gemini Omni 1.1 Flash für Videogenerierung und -bearbeitung vor

    Google ersetzt das bisherige Modell Gemini Veo 3.1 in der Gemini App durch Gemini Omni 1.1 Flash. Das multimodale Modell ermöglicht es, Videos von bis zu 10 Sekunden Länge inklusive nativem Audio über dialogbasierte Chat-Prompts zu generieren und schrittweise zu editieren.

    KI & AI· Ankündigung

  • Artikel:Google AI for Developers

    Videogenerierung und -bearbeitung mit Gemini Omni Flash

    Google dokumentiert die Integration von Gemini Omni Flash (gemini-omni-1.1-flash) in die Gemini API. Das multimodale Modell verarbeitet Text, Bild, Audio sowie Video und erlaubt Text-to-Video- sowie Image-to-Video-Generierung inklusive Ton.

    KI & AI· Sammlung

  • Link:Google DeepMind

    Google DeepMind veröffentlicht Gemini 3.8 Flash für agentenbasierte Workflows

    Google DeepMind hat Gemini 3.8 Flash vorgestellt, das auf komplexe agentenbasierte Aufgaben und Softwareentwicklung bei niedriger Latenz ausgelegt ist. Das multimodale Modell verarbeitet Eingaben wie Text, Audio, Bild, Video und PDF mit einem Kontextfenster von einer Million Tokens.

    KI & AI· Ankündigung

  • Artikel:Tulsee Doshi

    Google stellt Gemini 3.7 Flash vor

    Google hat Gemini 3.7 Flash veröffentlicht, ein für Programmierung und Agenten optimiertes Arbeitsmodell. Die Veröffentlichung erfolgt drei Wochen nach Version 3.6 Flash und bietet verbesserte Benchmark-Werte, optimierte Werkzeugnutzung sowie einen halbierten Einführungspreis.

    KI & AI· Ankündigung

  • Artikel:Tulsee Doshi

    Google stellt Gemini 3 Flash vor

    Google hat Gemini 3 Flash veröffentlicht. Das Modell kombiniert hohe Verarbeitungsgeschwindigkeit und niedrige Kosten mit der Denk- und Argumentationsleistung der Gemini-3-Reihe.

    KI & AI· Ankündigung

  • Artikel:Koray Kavukcuoglu, Jeff Dean, Oriol Vinyals, Noam Shazeer

    Google stellt Gemini 3.5 Flash vor: Fokus auf Agenten und Coding

    Google hat mit Gemini 3.5 eine neue Modellfamilie vorgestellt, die komplexe Agenten-Workflows und Coding-Aufgaben bewältigen soll. Den Start macht Gemini 3.5 Flash, das Frontier-Leistung mit hoher Geschwindigkeit kombiniert und viermal schneller bei der Token-Ausgabe als vergleichbare Spitzenmodelle sein soll. Zeitgleich kündigte Google das anstehende Gemini 3.5 Pro sowie den persönlichen 24/7-Assistenten Gemini Spark an.

    KI & AI· Ankündigung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.