OrcaRouter veröffentlicht abliterierte FP8-Version von Qwen3.8-27B

LinkOrcaRouterTool

OrcaRouter hat eine modifizierte FP8-Version des multimodalen Modells Qwen3.8-27B auf Hugging Face bereitgestellt. Durch gezielte Abliteration wurde die interne Verweigerungsrichtung entfernt, um das Modell für Red-Teaming und Sicherheitsforschung ohne Schutzfilter nutzbar zu machen.

Das Wichtigste

  1. Basiert auf Qwen/Qwen3.8-27B mit hybrider Gated-DeltaNet-Architektur, 262.144 Token Kontextfenster und nativer Bildverarbeitung.
  2. Entfernung der Sicherheitsverweigerungen basiert auf dem Ansatz von Arditi et al. (2024) durch Orthogonalisierung des Verweigerungsvektors in 131 Gewichtsmatrizen.
  3. Verwendet Block-FP8-Quantisierung (E4M3 mit 128×128 Blockgröße), identisch zum offiziellen FP8-Schema von Qwen.
  4. Erhält den MTP-Head für spekulatives Decoding sowie den unveränderten Vision-Tower.
  5. Sicherheits-Benchmarks zeigen einen Einbruch der Verweigerungsrate von 64–99 % beim Basismodell auf 0–6 % in Tests wie AdvBench und HarmBench.
  6. Nur für kontrollierte Forschungsumgebungen, Red-Teaming und Interpretierbarkeitsanalysen unter Apache-2.0-Lizenz freigegeben.

Warum das relevant ist

Das Modell demonstriert die technische Umsetzbarkeit von Abliteration bei hybriden Aufmerksamkeitsarchitekturen und spekulativem Decoding in Verbindung mit FP8-Quantisierung. Für Sicherheitsprüfungen und Red-Teaming liefert es eine Benchmark-Referenz, verdeutlicht jedoch zugleich das Risiko, dass standardmäßige Sicherheitsbeschränkungen in Open-Weight-Modellen nachträglich fast vollständig neutralisiert werden können.

Einordnung

Die Implementierung zeigt, wie präzise Representation Engineering in modernen LLMs greift: Die Modifikation beschränkt sich rein auf das Herausrechnen eines einzelnen Richtungsvektors aus den Residuen, während das Sprach- und Bildverständnis intakt bleibt. Da das Quantisierungsschema exakt dem offiziellen Qwen-FP8-Build entspricht, lässt sich das Modell nahtlos in Inferenz-Engines wie vLLM oder SGLang einbinden. OrcaRouter warnt explizit davor, das Modell ohne nachgelagerte Schutzschichten im Produktiveinsatz für Endnutzer bereitzustellen.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • X-Post:Samuel Cardillo

    OrcaRouter veröffentlicht unzensierte Modellgewichte für Qwen3.8 27B FP8

    Samuel Cardillo verweist auf die Veröffentlichung unzensierter Modellgewichte für Qwen3.8 27B FP8 durch OrcaRouter und merkt an, Anthropic werde darüber verärgert sein. Die Gewichte wurden laut OrcaRouter speziell für Sicherheitsforschung und KI-Red-Teaming bereitgestellt.

    604Lesezeichen227.895Aufrufe

    KI & AI· Meinung

  • Link:Qwen

    Qwen3.8-27B: Multimodales 27B-Modell mit Hybrid-Architektur und Denkmodus

    Das Qwen-Team hat mit Qwen3.8-27B ein kompaktes, dichtes Vision-Language-Modell unter der Apache-2.0-Lizenz veröffentlicht. Das 27-Milliarden-Parameter-Modell kombiniert Gated DeltaNet mit regulärer Attention, versteht Bilder sowie Videos und bietet flexible Steuerungsmöglichkeiten für Denkprozesse.

    KI & AI· Sammlung

  • X-Post:Trevor Wood

    Qwen3.8-27B Abliterated für Apple Silicon via MLX veröffentlicht

    Trevor Wood und das PocketAI Model Lab haben optimierte MLX-Versionen des Modells Qwen3.8-27B für Apple Silicon veröffentlicht. Bei diesen Varianten wurden die antrainierten Verweigerungsmechanismen („Abliteration“) entfernt, und sie stehen in Quantisierungen von 2-Bit bis BF16 zur Verfügung.

    3198Lesezeichen199.030Aufrufe

    KI & AI· Ankündigung

  • Link:Empero AI

    Qwythos-27B-v1: Unzensiertes Open-Weight-Modell mit 1M Kontext und nativer Tool-Nutzung

    Empero AI veröffentlicht Qwythos-27B-v1, ein vollständiges Open-Weight-Reasoning-Modell auf Basis von Qwen3.5-27B. Der Checkpoint behält Multi-Token-Prediction (MTP), Vision-Fähigkeiten und ein auf über 1 Million Token erweitertes Kontextfenster bei und wurde gezielt für Terminal- und Agenten-Workflows optimiert.

    KI & AI· Sammlung

  • Link:Unsloth AI

    Unsloth veröffentlicht Dynamic-V3.0-GGUF-Quantisierungen für Qwen3.8-27B

    Unsloth AI hat quantisierte GGUF-Versionen des neuen Modells Qwen3.8-27B unter der Apache-2.0-Lizenz bereitgestellt. Die Quantisierungen nutzen das neue Verfahren Dynamic V3.0, das gegenüber anderen Anbietern eine höhere Genauigkeit bei gleicher Dateigröße erzielen soll. Qwen3.8-27B ist ein 27 Milliarden Parameter starkes Vision-Language-Modell mit nativer Bild- und Videoverarbeitung, hybridem DeltaNet- und Attention-Aufbau sowie flexibler Steuerung von Denkprozessen.

    KI & AI· Tool

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.