Qwen3.8-27B-Abliterated-MLX: Multimodales Modell ohne Standard-Refusals für Apple Silicon

LinkPocketAiHubSammlung

PocketAiHub hat eine inoffizielle Reihe von MLX-Konvertierungen des multimodalen Modells Qwen3.8-27B veröffentlicht. Durch 'Abliteration' wurde das antrainierte Verweigerungsverhalten (Refusals) modifiziert. Das Repository bietet Quantisierungen von 2-Bit AWQ bis BF16 speziell für Apple Silicon.

Das Wichtigste

  1. Basiert auf Qwen/Qwen3.8-27B und wurde vom PocketAI Model Lab für das MLX-Framework (Apple Silicon) portiert.
  2. Verfügbar in den Varianten 2-Bit AWQ (experimentell), 4-Bit, 6-Bit, 8-Bit sowie unquantisiertem BF16; Vision-Tower verbleiben in BF16.
  3. Abliteration entfernt systematisch Verweigerungsvektoren (Quelle Layer 53, Ziel-Layer 24–63, 80 modifizierte Residual-Matrizen).
  4. In Tests verweigerten die Varianten keine der 100 schädlichen Prompts (0/100 Refusals).
  5. Die Varianten ab 4-Bit bestanden alle Qualitäts- und nativen Tool-Call-Tests, während die experimentelle 2-Bit-Version bei Tool-Calls und Video-Verständnis scheiterte.
  6. Getestet auf einem Apple M5 Max mit 128 GB Speicher; die 4-Bit-Version erreicht dort 33,2 Tokens/s bei der Generierung.

Warum das relevant ist

Für Forschung, Red-Teaming und unzensierte lokale KI-Workflows auf Macs bietet das Release eine standardisierte MLX-Implementierung eines 27B-Vision-Language-Modells. Gleichzeitig betont der Autor ausdrücklich die Sicherheitsrisiken, da ohne Refusals potenziell schädliche oder fehlerhafte Ausgaben ungefiltert erzeugt werden.

Einordnung

PocketAiHub dokumentiert die Modifikationen und Benchmarks transparent, einschließlich der Grenzen: Die Refusal-Tests prüfen lediglich frühe Standardabsagen, keine vollständige inhaltliche Korrektheit. Bemerkenswert ist der Leistungsabfall der 2-Bit-AWQ-Quantisierung, während 4-Bit und 6-Bit einen stabilen Kompromiss aus VRAM-Bedarf und vollständiger Tool-Use-Funktionalität bieten.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • X-Post:Trevor Wood

    Qwen3.8-27B Abliterated für Apple Silicon via MLX veröffentlicht

    Trevor Wood und das PocketAI Model Lab haben optimierte MLX-Versionen des Modells Qwen3.8-27B für Apple Silicon veröffentlicht. Bei diesen Varianten wurden die antrainierten Verweigerungsmechanismen („Abliteration“) entfernt, und sie stehen in Quantisierungen von 2-Bit bis BF16 zur Verfügung.

    3198Lesezeichen199.030Aufrufe

    KI & AI· Ankündigung

  • Link:OrcaRouter

    OrcaRouter veröffentlicht abliterierte FP8-Version von Qwen3.8-27B

    OrcaRouter hat eine modifizierte FP8-Version des multimodalen Modells Qwen3.8-27B auf Hugging Face bereitgestellt. Durch gezielte Abliteration wurde die interne Verweigerungsrichtung entfernt, um das Modell für Red-Teaming und Sicherheitsforschung ohne Schutzfilter nutzbar zu machen.

    KI & AI· Tool

  • Link:Qwen

    Qwen3.8-27B: Multimodales 27B-Modell mit Hybrid-Architektur und Denkmodus

    Das Qwen-Team hat mit Qwen3.8-27B ein kompaktes, dichtes Vision-Language-Modell unter der Apache-2.0-Lizenz veröffentlicht. Das 27-Milliarden-Parameter-Modell kombiniert Gated DeltaNet mit regulärer Attention, versteht Bilder sowie Videos und bietet flexible Steuerungsmöglichkeiten für Denkprozesse.

    KI & AI· Sammlung

  • Link:Empero AI

    Qwythos-27B-v1: Unzensiertes Open-Weight-Modell mit 1M Kontext und nativer Tool-Nutzung

    Empero AI veröffentlicht Qwythos-27B-v1, ein vollständiges Open-Weight-Reasoning-Modell auf Basis von Qwen3.5-27B. Der Checkpoint behält Multi-Token-Prediction (MTP), Vision-Fähigkeiten und ein auf über 1 Million Token erweitertes Kontextfenster bei und wurde gezielt für Terminal- und Agenten-Workflows optimiert.

    KI & AI· Sammlung

  • Link:Unsloth AI

    Unsloth veröffentlicht Qwen3.6-27B-MTP im GGUF-Format

    Unsloth AI stellt mit Qwen3.6-27B-MTP-GGUF quantisierte Versionen des ersten Open-Weight-Modells aus der Qwen3.6-Reihe bereit. Das multimodale 27-Milliarden-Parameter-Modell nutzt Multi-Token Prediction (MTP) für schnellere Inferenz und bringt Verbesserungen bei Agentic Coding sowie Tool Calling mit.

    KI & AI· Sammlung

  • Link:Unsloth AI

    Unsloth veröffentlicht Dynamic-V3.0-GGUF-Quantisierungen für Qwen3.8-27B

    Unsloth AI hat quantisierte GGUF-Versionen des neuen Modells Qwen3.8-27B unter der Apache-2.0-Lizenz bereitgestellt. Die Quantisierungen nutzen das neue Verfahren Dynamic V3.0, das gegenüber anderen Anbietern eine höhere Genauigkeit bei gleicher Dateigröße erzielen soll. Qwen3.8-27B ist ein 27 Milliarden Parameter starkes Vision-Language-Modell mit nativer Bild- und Videoverarbeitung, hybridem DeltaNet- und Attention-Aufbau sowie flexibler Steuerung von Denkprozessen.

    KI & AI· Tool

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.