VEED Fabric 1.0 auf fal: Bild-zu-Video-Modell für sprechende Charaktere

ArtikelTeam falAnkündigung

VEED hat Fabric 1.0 auf der Plattform fal veröffentlicht. Das Modell animiert beliebige Bilder anhand einer Audiodatei oder eines Text-Prompts zu sprechenden Videos inklusive Lippen-, Körper- und Kopfbewegungen.

Das Wichtigste

  1. Fabric 1.0 ist ein Image- und Audio-to-Video-Modell auf Basis eines Diffusion Transformers (DiT).
  2. Das Audio steuert Lippen-, Kopf-, Hand- und Körperbewegungen synchron zum Sprechrhythmus.
  3. Unterstützt werden beliebige Ausgangsbilder wie Fotos, Illustrationen, 3D-Renditions oder Cartoons statt fixer Vorlagen-Avatare.
  4. Technische Spezifikationen: Bild- und Audiodatei unter 10 MB, maximale Videolänge 1 Minute bei 25 FPS in 480p oder 720p.
  5. Die Berechnungszeit liegt bei etwa 1,5 Minuten (480p) beziehungsweise 5 Minuten (720p) für 10 Sekunden Video.
  6. Für Entwickler steht eine API bereit, um Videoproduktionen programmatisch zu automatisieren.

Warum das relevant ist

Viele Talking-Head-Tools beschränken sich auf vorgegebene Stock-Avatare. Fabric 1.0 ermöglicht es Unternehmen und Entwicklern, beliebige Charaktere oder Produktbilder flexibel per API zu animieren, was automatisierte Video-Workflows und A/B-Tests vereinfacht.

Einordnung

Das Modell nutzt das Startbild sowohl für das Framing als auch für das Style-Conditioning, während die Tonspur die Sequenzgenerierung lenkt. Zwar bietet das Modell hohe Flexibilität bei Formaten und Stilen, die Renderzeiten von bis zu 5 Minuten für 10 Sekunden in 720p erfordern jedoch asynchrone Pipelines bei der Einbindung in Webanwendungen.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:veed.io

    VEED integriert führende KI-Videomodelle in seinen Editor

    Die browserbasierte Videoplattform VEED bindet verschiedene generative KI-Modelle wie Veo 3.1, Kling O1, Hailuo und OpenAI Sora direkt in ihre Bearbeitungsumgebung ein. Nutzer können Videos aus Prompts, Skripten oder Bildern generieren und anschließend mit Untertiteln, Voiceovers und Branding verfeinern.

    KI & AI· Tool

  • Link:Tavus

    Tavus: Plattform für interaktive Video-KI-Agenten („PALs“)

    Tavus stellt mit „PALs“ interaktive Video-KI-Agenten vor, die in Echtzeit sehen, hören und emotional reagieren können. Die Plattform kombiniert Basiskodelle für Rendering, multimodale Wahrnehmung und Dialogführung mit Entwickler-APIs und No-Code-Tools.

    KI & AI· Tool

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.