DeepSeek veröffentlicht experimentelles Modell DeepSeek-V4-Flash-Vision-Exp

ArtikelDeepSeekAnkündigung

DeepSeek hat das multimodale Modell DeepSeek-V4-Flash-Vision-Exp über seine API freigegeben. Es behält die Text- und Reasoning-Fähigkeiten von DeepSeek-V4-Flash bei, erweitert diese jedoch um Bildverarbeitung. Gleichzeitig startet eine kostenlose Files API für wiederverwendbare Uploads.

Das Wichtigste

  1. DeepSeek-V4-Flash-Vision-Exp erreicht laut Anbieter bei rein textbasierten Aufgaben, Agenten und logischem Denken das Niveau von DeepSeek-V4-Flash.
  2. Auf multimodalen Agenten-Benchmarks rückt die Leistung laut DeepSeek nahe an Opus-4.8 heran.
  3. Bilder werden mit maximal 384 Tokens veranschlagt und zu den Konditionen von V4-Flash abgerechnet.
  4. Unterstützt werden Chat Completions, Messages und Responses mit kombiniertem Text- und Bild-Input per Base64, externer URL oder Files API.
  5. Die neu gestartete Files API ist kostenlos und erlaubt es, Bilder einmalig hochzuladen und per file_id über mehrere Anfragen hinweg wiederzuverwenden.
  6. DeepSeek Harness 0.1.1 bietet direkte Unterstützung für das neue Modell.

Warum das relevant ist

Multimodale Fähigkeiten sind für moderne KI-Agenten unverzichtbar, wenn Workflows visuelle Schnittstellen, Dokumente oder Diagramme einbeziehen. Durch die Beschränkung auf maximal 384 Tokens pro Bild und die kostenlose Files API lassen sich visuelle Agenten-Workflows bandbreitenschonend und kostengünstig implementieren.

Einordnung

Mit DeepSeek-V4-Flash-Vision-Exp zielt DeepSeek vor allem auf den Einsatz in Agenten-Frameworks ab, bei denen Werkzeugnutzung und Bildverständnis kombiniert werden. Die Abrechnung von Bildern mit maximal 384 Tokens hält die Betriebskosten planbar. Die zeitgleiche Einführung der Files API löst zudem ein praktisches Problem bei Multi-Turn-Interaktionen oder agentischen Schleifen: Bilder müssen nicht bei jedem Request erneut übertragen werden, was Latenz und Bandbreite spart.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Artikel:DeepSeek

    DeepSeek API Changelog: Release von V4-Flash-Vision-Exp und GA von V4-Pro

    Das Änderungsprotokoll der DeepSeek-API dokumentiert den Release des multimodalen Modells DeepSeek-V4-Flash-Vision-Exp sowie das GA-Update von DeepSeek-V4-Pro. Die V4-Modellfamilie bringt native Unterstützung für das OpenAI-Responses-API-Format, konfigurierbare Denkmodi und ein Peak-/Off-Peak-Preismodell.

    KI & AI· Ankündigung

  • Artikel:api-docs.deepseek.com

    DeepSeek API: Kompatibilität mit OpenAI und Anthropic sowie neue Modelle

    Die Quick-Start-Dokumentation der DeepSeek-API beschreibt den Einstieg über OpenAI- und Anthropic-kompatible Schnittstellen. Neben aktualisierten V4-Modellen und einer experimentellen Vision-Variante wird die Integration in gängige Entwicklerwerkzeuge und Coding-Assistenten vorgestellt.

    KI & AI· Sammlung

  • Artikel:DeepSeek AI

    DeepSeek veröffentlicht DeepSeek-V4 Preview als Open Source mit 1M Kontext

    DeepSeek hat die Preview-Version von DeepSeek-V4 als Open Source freigegeben. Die Modellreihe umfasst die Varianten DeepSeek-V4-Pro und DeepSeek-V4-Flash, bietet standardmäßig ein Kontextfenster von einer Million Tokens und bringt neue Architekturen zur Rechenzeit- und Speicheroptimierung mit.

    KI & AI· Ankündigung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.