xAI veröffentlicht Grok 4.1

ArtikelxAIAnkündigung

xAI hat das Modell Grok 4.1 für grok.com, die Plattform X sowie die mobilen Apps freigegeben. Neben Verbesserungen bei Tonalität, Empathie und kreativen Texten führt das Modell laut Anbieter die LMArena-Rangliste an.

Das Wichtigste

  1. Verfügbarkeit auf grok.com, X, iOS und Android im Auto-Modus sowie manuell als Grok 4.1 wählbar.
  2. Optimierung nicht-verifizierbarer Belohnungssignale (Stil, Hilfsbereitschaft, Alignment) durch den Einsatz von Reasoning-Modellen als automatisierte Reward-Modelle im Reinforcement Learning.
  3. In einem zweiwöchigen Blindtest im Live-Betrieb erzielte Grok 4.1 eine Nutzerpräferenz von 64,78 Prozent gegenüber dem Vorgänger.
  4. In der LMArena Text Arena belegt Grok 4.1 Thinking mit 1483 Elo Platz 1, die Non-Thinking-Variante erreicht mit 1465 Elo Platz 2.
  5. Reduzierte Halluzinationsrate bei informationsbezogenen Suchanfragen und verbesserte Ergebnisse in Benchmarks wie EQ-Bench3 und Creative Writing v3.

Warum das relevant ist

Die Modellaktualisierung zeigt, wie Frontier-Reasoning-Modelle zunehmend als automatisierte Bewerter im RL-Training eingesetzt werden, um weiche Faktoren wie Tonalität und Gesprächsführung messbar zu optimieren.

Einordnung

xAI zielt mit Grok 4.1 auf die Schwachstellen reiner Logikmodelle ab: Umgangston, situatives Einfühlungsvermögen und Faktenstabilität bei Websuchen. Bemerkenswert an den präsentierten Benchmarks ist das Abschneiden der Non-Thinking-Variante in der LMArena, die ohne zusätzliche Denk-Tokens vor den Reasoning-Konfigurationen anderer Anbieter platziert ist. Ob sich die gemessenen Labor- und Arena-Werte im produktiven Arbeitsalltag bestätigen, hängt vor allem von der Robustheit gegen Halluzinationen bei komplexen Fachabfragen ab.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Artikel:x.ai

    SpaceXAI stellt Grok 4.6 vor

    SpaceXAI hat Grok 4.6 veröffentlicht. Das Modell fokussiert sich auf langlebige Agenten sowie interaktive und visuelle Aufgaben und ist ab sofort via API, Cursor und Grok Build verfügbar.

    KI & AI· Ankündigung

  • Artikel:xAI

    xAI stellt Grok 4.20 Multi-Agent Beta vor

    xAI hat das Modell Grok 4.20 Multi-Agent Beta veröffentlicht. Mehrere Agenten arbeiten darin parallel zusammen, um komplexe Rechercheaufgaben durchzuführen.

    KI & AI· Ankündigung

  • Artikel:SpaceXAI

    SpaceXAI stellt Grok Bot vor

    SpaceXAI hat Grok Bot angekündigt, eine Plattform für dauerhaft aktive KI-Agenten, die wie Teammitglieder agieren. Die Bots laufen auf eigenen Cloud-Instanzen, nutzen bestehende Tools und Anwendungen ohne zwingende API-Anbindung und arbeiten rund um die Uhr eigenständig oder im Verbund.

    KI & AI· Ankündigung

  • Artikel:Anthropic

    Anthropic stellt Claude Opus 4.1 vor

    Anthropic hat Claude Opus 4.1 veröffentlicht. Das Modell bringt Verbesserungen bei agentischen Aufgaben, Softwareentwicklung und Reasoning bei unveränderten Preisen.

    KI & AI· Ankündigung

  • Link:Z.ai

    Z.ai veröffentlicht GLM-5.1 mit Fokus auf Agentic Engineering

    Z.ai hat auf Hugging Face das Modell GLM-5.1 unter MIT-Lizenz bereitgestellt. Das MoE-Modell mit 754 Milliarden Parametern zielt auf anspruchsvolle Programmier- und Agenten-Workflows ab und soll über lange Sessions hinweg stabil arbeiten.

    KI & AI· Sammlung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.