Z.ai veröffentlicht GLM-5.2 mit 1M-Kontext und MIT-Lizenz

LinkZ.aiSammlung

Z.ai hat das Flaggschiff-Modell GLM-5.2 auf Hugging Face unter der freien MIT-Lizenz bereitgestellt. Das Modell zielt auf komplexe Coding- und Agentic-Workflows ab und bietet ein stabiles Kontextfenster von einer Million Tokens. Durch Architekturverbesserungen wie IndexShare und einen optimierten MTP-Layer wurden Rechenaufwand gesenkt und Inferenzzeiten verkürzt.

Das Wichtigste

  1. Stabiles 1M-Token-Kontextfenster für Aufgaben mit langem Zeithorizont und umfangreichen Codebasen.
  2. Architektur-Innovation IndexShare teilt Indexer über vier Sparse-Attention-Schichten und senkt FLOPs pro Token bei 1M Kontext um das 2,9-Fache.
  3. Optimierte MTP-Ebene steigert die Akzeptanzlänge beim spekulativen Decoding um bis zu 20 Prozent.
  4. Flexible Denk-Intensitätsstufen ermöglichen die Balance zwischen Antwortlatenz und Ausführungsqualität.
  5. Veröffentlichung unter uneingeschränkter MIT-Lizenz ohne regionale Beschränkungen.
  6. Breite Serving-Unterstützung ab Release für vLLM, SGLang, Unsloth, Transformers und Huawei Ascend NPUs.

Warum das relevant ist

Für europäische Entwickler und Unternehmen ist die Verfügbarkeit eines leistungsfähigen Modells für 1M Tokens unter einer echten MIT-Lizenz hochrelevant. Es ermöglicht das lokale Hosting und den datenschutzkonformen Betrieb komplexer Softwareentwicklungs- und Agenten-Pipelines auf eigener Infrastruktur, ohne Abhängigkeit von proprietären US-Cloud-APIs.

Einordnung

GLM-5.2 positioniert sich laut den veröffentlichten Benchmarks direkt gegen Spitzenmodelle wie Claude Opus 4.8, GPT-5.5 und Qwen3.7-Max, insbesondere in Benchmarks wie SWE-bench Pro (62,1), FrontierSWE und MCP-Atlas. Bemerkenswert ist die architektonische Effizienzsteigerung bei langen Kontexten: Die Reduktion der Berechnungen durch IndexShare adressiert das Kernproblem hoher Inferenzkosten bei 1M Tokens. Durch die offene Lizenzierung und native Integration in gängige Inferenz-Frameworks wie vLLM und SGLang lässt sich das Modell unmittelbar in produktive Workflows integrieren.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:Z.ai

    Z.ai veröffentlicht GLM-5.1 mit Fokus auf Agentic Engineering

    Z.ai hat auf Hugging Face das Modell GLM-5.1 unter MIT-Lizenz bereitgestellt. Das MoE-Modell mit 754 Milliarden Parametern zielt auf anspruchsvolle Programmier- und Agenten-Workflows ab und soll über lange Sessions hinweg stabil arbeiten.

    KI & AI· Sammlung

  • Link:Z.ai

    Z.ai veröffentlicht GLM-5.3-Flash als multimodales Open-Source-Modell

    Z.ai hat mit GLM-5.3-Flash das erste nativ multimodale Modell der GLM-5-Reihe unter MIT-Lizenz auf Hugging Face bereitgestellt. Mit 320 Milliarden Gesamtparametern und 18 Milliarden aktiven Parametern zielt das Modell auf hohe Effizienz bei Programmier- und Agenten-Workloads ab.

    KI & AI· Tool

  • Artikel:docs.z.ai

    Z.AI veroeffentlicht GLM-5.3-Flash mit nativer Multimodalitaet

    Z.AI hat GLM-5.3-Flash vorgestellt, das erste nativ multimodale Modell der GLM-5-Reihe. Mit 320 Milliarden Parametern (18 Milliarden aktiviert) kombiniert das Modell Sparse- und Linear-Attention, um Rechenaufwand und KV-Cache massiv zu senken.

    KI & AI· Ankündigung

  • Artikel:Jonas Reeve

    Z.ai stellt GLM-5.3 vor: Leistungszuwächse beim Coden und ungeplante Exploit-Fähigkeiten

    Z.ai hat GLM-5.3 veröffentlicht. Das Modell nutzt dieselbe Basis wie GLM-5.2 und bezieht alle Leistungssteigerungen aus skaliertem Post-Training in realistischen Arbeitsumgebungen. Neben Fortschritten beim Coden zeigte das Modell unerwartet starke Fähigkeiten bei der Verkettung mehrstufiger Exploits in der Cybersicherheit.

    KI & AI· News

  • Link:Xiaomi MiMo Team

    Xiaomi veröffentlicht MiMo-V2.5-Pro als Open-Source-Modell

    Xiaomi hat MiMo-V2.5-Pro vorgestellt, ein quelloffenes Mixture-of-Experts-Modell mit 1,02 Billionen Parametern und 42 Milliarden aktiven Parametern. Das Modell bietet ein Kontextfenster von bis zu 1 Million Tokens und zielt speziell auf komplexe Agenten-Workflows und langanhaltende Software-Engineering-Aufgaben ab.

    KI & AI· Ankündigung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.