Qwythos-27B-v1: Unzensiertes Open-Weight-Modell mit 1M Kontext und nativer Tool-Nutzung

LinkEmpero AISammlung

Empero AI veröffentlicht Qwythos-27B-v1, ein vollständiges Open-Weight-Reasoning-Modell auf Basis von Qwen3.5-27B. Der Checkpoint behält Multi-Token-Prediction (MTP), Vision-Fähigkeiten und ein auf über 1 Million Token erweitertes Kontextfenster bei und wurde gezielt für Terminal- und Agenten-Workflows optimiert.

Das Wichtigste

  1. Basiert auf Qwen3.5-27B mit hybridem Gated-DeltaNet-Design und 1.048.576 Token Kontext via YaRN (Faktor 4.0).
  2. Vollständiges Fine-Tuning über SFT, DPO und ESFT vor Reinforcement Learning; eine Version 2 mit RL ist geplant.
  3. Der native MTP-Head und der Vision-Tower blieben ohne Kürzungen vollständig erhalten.
  4. Perplexität in Terminal- und Tool-Sitzungen sinkt gegenüber dem Basismodell von 356,6 auf 2,76.
  5. Natives Function-Calling nach Qwen3.5-Spezifikation und First-Person-Reasoning über <think>-Tags.
  6. Bewusst unzensiert für technische Forschung, Cybersecurity und biomedizinische Fragestellungen unter Apache-2.0-Lizenz.

Warum das relevant ist

Viele Community-Fine-Tunes von 27B-Modellen entfernen rechenintensive Bestandteile wie MTP oder Bildverarbeitung, um das Training zu vereinfachen. Qwythos-27B zeigt, wie sich ein vollwertiges multimodales Modell für Shell-Interaktionen und komplexe Agenten-Workflows ohne funktionale Abstriche bereitstellen lässt.

Einordnung

Empero AI optimiert das Modell gezielt für Terminal-Sessions und Tool-Nutzung. Die deutliche Senkung der Perplexität in Shell-Umgebungen und das integrierte Qwen3.5-Tool-Schema ermöglichen den direkten Einsatz in Frameworks wie vLLM oder SGLang ohne zusätzliche Wrapper. Da das Modell für den technischen Einsatz unzensiert ist und auch sensible Cybersecurity- und Biomedizin-Fragen detailliert beantwortet, müssen Betreiber entsprechende Prüf- und Schutzmechanismen auf Applikationsebene implementieren.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:Qwen

    Qwen3.8-27B: Multimodales 27B-Modell mit Hybrid-Architektur und Denkmodus

    Das Qwen-Team hat mit Qwen3.8-27B ein kompaktes, dichtes Vision-Language-Modell unter der Apache-2.0-Lizenz veröffentlicht. Das 27-Milliarden-Parameter-Modell kombiniert Gated DeltaNet mit regulärer Attention, versteht Bilder sowie Videos und bietet flexible Steuerungsmöglichkeiten für Denkprozesse.

    KI & AI· Sammlung

  • Link:Unsloth AI

    Unsloth veröffentlicht Qwen3.6-27B-MTP im GGUF-Format

    Unsloth AI stellt mit Qwen3.6-27B-MTP-GGUF quantisierte Versionen des ersten Open-Weight-Modells aus der Qwen3.6-Reihe bereit. Das multimodale 27-Milliarden-Parameter-Modell nutzt Multi-Token Prediction (MTP) für schnellere Inferenz und bringt Verbesserungen bei Agentic Coding sowie Tool Calling mit.

    KI & AI· Sammlung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.