DeepSeek veröffentlicht DeepSeek-V4 Preview als Open Source mit 1M Kontext

ArtikelDeepSeek AIAnkündigung

DeepSeek hat die Preview-Version von DeepSeek-V4 als Open Source freigegeben. Die Modellreihe umfasst die Varianten DeepSeek-V4-Pro und DeepSeek-V4-Flash, bietet standardmäßig ein Kontextfenster von einer Million Tokens und bringt neue Architekturen zur Rechenzeit- und Speicheroptimierung mit.

Das Wichtigste

  1. DeepSeek-V4-Pro besitzt 1,6 Billionen Gesamtparameter (49 Milliarden aktiv) und zielt auf Spitzenwerte bei Coding- und Reasoning-Benchmarks ab.
  2. DeepSeek-V4-Flash nutzt 284 Milliarden Gesamtparameter (13 Milliarden aktiv) für schnelle und kostengünstige Inferenz bei einfacheren Agenten-Aufgaben.
  3. Neuartige Attention-Mechanismen (Token-wise Compression und DeepSeek Sparse Attention) ermöglichen ein 1M-Token-Kontextfenster bei stark reduzierten Rechenkosten.
  4. Die Modelle sind für Coding-Agenten optimiert und unterstützen Integrationen wie Claude Code, OpenClaw und OpenCode.
  5. Die API unterstützt OpenAI- und Anthropic-Schnittstellen sowie Thinking- und Non-Thinking-Modi; alte Endpunkte (deepseek-chat, deepseek-reasoner) laufen am 24. Juli 2026 aus.

Warum das relevant ist

DeepSeek setzt mit frei zugänglichen Gewichten und extrem großen Kontextfenstern von 1 Million Tokens die proprietären Modellanbieter unter Preis- und Leistungsdruck. Entwickler erhalten leistungsfähige Open-Source-Modelle für Coding-Agenten, die sich direkt über kompatible API-Schnittstellen anbinden lassen.

Einordnung

Mit der V4-Reihe kombiniert DeepSeek eine Mixture-of-Experts-Architektur mit Sparse-Attention-Verfahren, um lange Kontexte im Betrieb bezahlbar zu halten. Bemerkenswert ist die native Kompatibilität zu gängigen API-Formaten anderer Anbieter und die Ausrichtung auf Agenten-Workflows. Die schrittweise Ablösung älterer Modelle zeigt eine rasche Konsolidierung des Portfolios auf V4-Flash und V4-Pro.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:deepseek-ai

    DeepSeek veröffentlicht DeepSeek-V4-Pro-DSpark mit spekulativer Dekodierung

    DeepSeek hat die Modelldokumentation und Gewichte für DeepSeek-V4-Pro-DSpark auf Hugging Face bereitgestellt. Es handelt sich um das MoE-Modell DeepSeek-V4-Pro mit einem integrierten Modul für spekulative Dekodierung (DSpark) zur Beschleunigung der Inferenz.

    KI & AI· Sammlung

  • Artikel:DeepSeek

    DeepSeek API Changelog: Release von V4-Flash-Vision-Exp und GA von V4-Pro

    Das Änderungsprotokoll der DeepSeek-API dokumentiert den Release des multimodalen Modells DeepSeek-V4-Flash-Vision-Exp sowie das GA-Update von DeepSeek-V4-Pro. Die V4-Modellfamilie bringt native Unterstützung für das OpenAI-Responses-API-Format, konfigurierbare Denkmodi und ein Peak-/Off-Peak-Preismodell.

    KI & AI· Ankündigung

  • Link:Tencent Hy Team

    Tencent veröffentlicht MoE-Modell Hy4-preview unter Apache-2.0-Lizenz

    Das Tencent Hy Team hat Hy4-preview als quelloffenes Mixture-of-Experts-Modell (MoE) mit 770 Milliarden Gesamtparametern und 49 Milliarden aktiven Parametern pro Token vorgestellt. Das Flaggschiff-Modell bietet ein Kontextfenster von 1 Million Tokens und wurde für Aufgaben in Softwareentwicklung, Büroarbeit und wissenschaftlicher Forschung optimiert.

    KI & AI· Ankündigung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.