dots3-note preview: Open-Weight MoE-Modell mit 280B Parametern und 512K Kontext

Repositorystudio-dots-ai/dots3-note-prevAnkündigung

Dots Studio hat mit dots3-note preview das erste Open-Weight-Modell der dots3-Reihe veröffentlicht. Die Mixture-of-Experts-Architektur kombiniert 280 Milliarden Gesamtparameter mit 16 Milliarden aktivierten Parametern und unterstützt multimodale Eingaben sowie bis zu 512.000 Kontext-Token.

Das Wichtigste

  1. Mixture-of-Experts (MoE) Architektur mit 280 Milliarden Gesamtparametern und 16 Milliarden aktivierten Parametern pro Inferenzschritt.
  2. Unterstützung multimodaler Eingaben (Text, Bild, Video, Audio) mit reiner Textausgabe.
  3. Kontextlänge von bis zu 512K Token.
  4. Optimiert für logisches Schlussfolgern, Tool-Nutzung, mehrstufige Agenten-Workflows sowie interaktive Exploration und Speicheranpassung.
  5. Verfügbar unter der Apache-2.0-Lizenz mit Integrationen für Hugging Face Transformers, vLLM und SGLang.

Warum das relevant ist

Große MoE-Modelle mit schlanker Aktivierungsgröße (16B) und sehr langem Kontextfenster (512K) bieten eine ressourceneffiziente Basis für komplexe Agenten-Workflows und multimodale Analyseaufgaben, die bisher proprietären Modellen vorbehalten waren.

Einordnung

Das Projekt adressiert den Bedarf an quelloffenen, hochleistungsfähigen Basismodellen für multimodale Workflows und Agentenarchitekturen. Durch die MoE-Struktur hält dots3-note den Rechenaufwand während der Inferenz trotz 280B Parametern überschaubar. Technisch bindet das Team gängige Inferenz-Frameworks wie vLLM und SGLang sowie die Transformers-Bibliothek ein. Die Zielgruppe umfasst KI-Forscher, Entwickler von Agenten-Systemen und Unternehmen, die On-Premises- oder Self-Hosted-LLMs mit langen Kontexten betreiben möchten. Der Reifegrad ist als Preview einzustufen: Das Modell und Gewichte sind unter Apache 2.0 via Hugging Face zugänglich, der ausführliche Forschungsbericht steht laut Dokumentation jedoch noch aus.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:Qwen

    Qwen3.8-27B: Multimodales 27B-Modell mit Hybrid-Architektur und Denkmodus

    Das Qwen-Team hat mit Qwen3.8-27B ein kompaktes, dichtes Vision-Language-Modell unter der Apache-2.0-Lizenz veröffentlicht. Das 27-Milliarden-Parameter-Modell kombiniert Gated DeltaNet mit regulärer Attention, versteht Bilder sowie Videos und bietet flexible Steuerungsmöglichkeiten für Denkprozesse.

    KI & AI· Sammlung

  • Link:Xiaomi MiMo Team

    Xiaomi veröffentlicht MiMo-V2.5-Pro als Open-Source-Modell

    Xiaomi hat MiMo-V2.5-Pro vorgestellt, ein quelloffenes Mixture-of-Experts-Modell mit 1,02 Billionen Parametern und 42 Milliarden aktiven Parametern. Das Modell bietet ein Kontextfenster von bis zu 1 Million Tokens und zielt speziell auf komplexe Agenten-Workflows und langanhaltende Software-Engineering-Aufgaben ab.

    KI & AI· Ankündigung

  • Link:Z.ai

    Z.ai veröffentlicht GLM-5.3-Flash als multimodales Open-Source-Modell

    Z.ai hat mit GLM-5.3-Flash das erste nativ multimodale Modell der GLM-5-Reihe unter MIT-Lizenz auf Hugging Face bereitgestellt. Mit 320 Milliarden Gesamtparametern und 18 Milliarden aktiven Parametern zielt das Modell auf hohe Effizienz bei Programmier- und Agenten-Workloads ab.

    KI & AI· Tool

  • Repository:PipeNetwork/kimi-k3-mlx

    kimi-k3-mlx: Portierung des 2,78-Billionen-Parameter-MoE-Modells für Apple Silicon

    kimi-k3-mlx portiert Moonshots multimodales Kimi-K3-MoE-Modell (2,78 Billionen Parameter) auf Apples MLX-Framework. Da das Modell selbst im komprimierten Zustand zu groß für handelsübliche Apple-Silicon-Rechner ist, liefert das Projekt neben den Modell- und Vision-Wrappern einen Streaming-Konverter sowie Werkzeuge zum Pruning von Experten.

    337SternePython

    KI & AI· Tool

  • Link:ornith-ai

    Ornith-1.5-397B: Open-Source-MoE-Modell mit Fokus auf Coding und Reasoning

    ornith-ai hat das multimodale Mixture-of-Experts-Modell Ornith-1.5-397B unter MIT-Lizenz veröffentlicht. Das 397 Milliarden Parameter schwere Modell setzt auf kontinuierliche Selbstverbesserung und erzielt in Programmier- und Reasoning-Benchmarks Ergebnisse auf dem Niveau führender proprietärer Modelle.

    KI & AI· Sammlung

  • Artikel:Thinking Machines Lab

    Thinking Machines Lab stellt Open-Weights-Modell Inkling vor

    Thinking Machines Lab hat Inkling veröffentlicht, ein multimodales Mixture-of-Experts-Modell mit 975 Milliarden Gesamtparametern (41 Milliarden aktiv) und 1 Million Token Kontext. Es ist vor allem als vielseitige Open-Weights-Basis für Fine-Tuning über die eigene Plattform Tinker gedacht.

    KI & AI· Ankündigung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.