Z.ai veröffentlicht GLM-5.3-Flash als multimodales Open-Source-Modell

LinkZ.aiTool

Z.ai hat mit GLM-5.3-Flash das erste nativ multimodale Modell der GLM-5-Reihe unter MIT-Lizenz auf Hugging Face bereitgestellt. Mit 320 Milliarden Gesamtparametern und 18 Milliarden aktiven Parametern zielt das Modell auf hohe Effizienz bei Programmier- und Agenten-Workloads ab.

Das Wichtigste

  1. 320 Milliarden Gesamtparameter bei lediglich 18 Milliarden aktiven Parametern pro Inferenzschritt.
  2. Hybrid-Architektur aus Sparse- und Linear-Attention zur Senkung von Serving-Kosten bei langen Kontexten, kombiniert mit Manifold-Constrained Hyper-Connections (mHC).
  3. Vortraining erfolgte auf einem multimodalen Datensatz mit 30 Billionen Token.
  4. Unterstützung für Inferenz-Frameworks wie vLLM, SGLang, Transformers, Unsloth, TokenSpeed und KTransformers.
  5. Steuerung des Denkbudgets über den Parameter reasoning_effort (Optionen: low, high, max; Standard ist max) sowie Steuerung via clear_thinking für Chat-Szenarien.
  6. Veröffentlichung unter freier MIT-Lizenz inklusive Modellgewichten im Safetensors-Format (FP8, BF16, F32).

Warum das relevant ist

Große Mixture-of-Experts- und Hybrid-Attention-Architekturen ermöglichen es, sehr leistungsfähige multimodale Modelle lokal oder in eigener Infrastruktur zu betreiben, ohne die hohen Betriebskosten dichter Modelle tragen zu müssen. Durch die MIT-Lizenz ist der Einsatz auch im Unternehmens- und Entwicklungsumfeld uneingeschränkt möglich.

Einordnung

Z.ai positioniert GLM-5.3-Flash als kostengünstige Alternative zu proprietären Modellen und gibt an, bei Coding- sowie Agenten-Benchmarks an Claude Opus 4.8 heranzureichen. Die Architektur fokussiert sich technisch stark auf Inferenzoptimierung: Durch lineare und sparse Aufmerksamkeitsmechanismen sollen extrem lange Kontexte handhabbar bleiben, während das Denkbudget über Inferenz-Parameter feinjustiert werden kann.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Artikel:docs.z.ai

    Z.AI veroeffentlicht GLM-5.3-Flash mit nativer Multimodalitaet

    Z.AI hat GLM-5.3-Flash vorgestellt, das erste nativ multimodale Modell der GLM-5-Reihe. Mit 320 Milliarden Parametern (18 Milliarden aktiviert) kombiniert das Modell Sparse- und Linear-Attention, um Rechenaufwand und KV-Cache massiv zu senken.

    KI & AI· Ankündigung

  • Link:Z.ai

    Z.ai veröffentlicht GLM-5.2 mit 1M-Kontext und MIT-Lizenz

    Z.ai hat das Flaggschiff-Modell GLM-5.2 auf Hugging Face unter der freien MIT-Lizenz bereitgestellt. Das Modell zielt auf komplexe Coding- und Agentic-Workflows ab und bietet ein stabiles Kontextfenster von einer Million Tokens. Durch Architekturverbesserungen wie IndexShare und einen optimierten MTP-Layer wurden Rechenaufwand gesenkt und Inferenzzeiten verkürzt.

    KI & AI· Sammlung

  • Link:Z.ai

    Z.ai veröffentlicht GLM-5.1 mit Fokus auf Agentic Engineering

    Z.ai hat auf Hugging Face das Modell GLM-5.1 unter MIT-Lizenz bereitgestellt. Das MoE-Modell mit 754 Milliarden Parametern zielt auf anspruchsvolle Programmier- und Agenten-Workflows ab und soll über lange Sessions hinweg stabil arbeiten.

    KI & AI· Sammlung

  • Artikel:Jonas Reeve

    Z.ai stellt GLM-5.3 vor: Leistungszuwächse beim Coden und ungeplante Exploit-Fähigkeiten

    Z.ai hat GLM-5.3 veröffentlicht. Das Modell nutzt dieselbe Basis wie GLM-5.2 und bezieht alle Leistungssteigerungen aus skaliertem Post-Training in realistischen Arbeitsumgebungen. Neben Fortschritten beim Coden zeigte das Modell unerwartet starke Fähigkeiten bei der Verkettung mehrstufiger Exploits in der Cybersicherheit.

    KI & AI· News

  • Link:Qwen

    Qwen3.8-27B: Multimodales 27B-Modell mit Hybrid-Architektur und Denkmodus

    Das Qwen-Team hat mit Qwen3.8-27B ein kompaktes, dichtes Vision-Language-Modell unter der Apache-2.0-Lizenz veröffentlicht. Das 27-Milliarden-Parameter-Modell kombiniert Gated DeltaNet mit regulärer Attention, versteht Bilder sowie Videos und bietet flexible Steuerungsmöglichkeiten für Denkprozesse.

    KI & AI· Sammlung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.