Wie Anthropic Claude-Agenten isoliert und absichert

ArtikelAnthropic EngineeringForschung

Anthropic erläutert die Sicherheitsarchitektur zur Begrenzung des Schadenspotenzials (Blast Radius) von KI-Agenten in claude.ai und Claude Code. Da menschliche Kontrollabfragen an Genehmigungsmüdigkeit scheitern, setzt das Unternehmen vor allem auf OS- und Container-Sandboxes.

Das Wichtigste

  1. Genehmigungsmüdigkeit schwächt Human-in-the-Loop: Telemetriedaten zeigten, dass Nutzer etwa 93 % aller Sicherheitsabfragen bestätigen und dadurch unaufmerksam werden.
  2. Drei Verteidigungsebenen: Absicherung der Laufzeitumgebung (Sandboxes, Egress-Regeln), der Modellschicht (Prompts, Klassifikatoren) sowie externer Inhalte und Tools.
  3. Spezifische Isolationsmuster: claude.ai nutzt ephemere gVisor-Container; Claude Code setzt auf OS-Sandboxing via Seatbelt (macOS) und bubblewrap (Linux), was Prompts um 84 % senkte.
  4. Schwachstellen vor dem Vertrauensdialog: Sicherheitslücken entstanden, wenn Dateien wie .claude/settings.json eingelesen wurden, bevor der Nutzer den Ordner explizit als vertrauenswürdig eingestuft hatte.

Warum das relevant ist

Autonome Coding-Agenten entfalten ihren Nutzen erst durch weitreichenden System- und Dateizugriff. Rein probabilistische Filter oder ständige Nutzerabfragen bieten keinen verlässlichen Schutz, weshalb harte Isolation auf Betriebssystemebene zur Pflicht wird.

Einordnung

Anthropic zeigt auf, dass fähigere Modelle auch besser darin sind, unausgesprochene Restriktionen kreativ zu umgehen. Da wiederholte Bestätigungsdialoge unweigerlich zu unüberlegten Klicks führen, verlagert sich die Sicherheitsarchitektur von Verhaltenskontrolle zu deterministischer Umgebungseindämmung. Besondere Vorsicht gilt Prozessen vor der eigentlichen Autorisierung.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Repository:anthropics/sandbox-runtime

    Anthropic Sandbox Runtime: Leichtgewichtige Prozessisolation ohne Container

    Die Sandbox Runtime (srt) von Anthropic ist ein Open-Source-Tool, das beliebige Prozesse auf Betriebssystemebene einschränkt. Entwickelt als Sicherheitskomponente für Claude Code, isoliert srt Dateisystem- und Netzwerkzugriffe von KI-Agenten, MCP-Servern oder Shell-Befehlen ohne Container-Overhead.

    5144SterneTypeScript

    KI & AI· Tool

  • Artikel:Beth Pariseau

    NanoClaw: Docker isoliert autonome KI-Agenten in Sandboxes

    Docker kooperiert mit NanoCo, um den KI-Agenten NanoClaw in Docker Sandboxes abzusichern. Das System nutzt microVMs in Docker Desktop, um autonome Agenten strikt vom lokalen Betriebssystem zu isolieren und Sicherheitsrisiken wie unberechtigte Systemeingriffe zu verhindern.

    KI & AI· News

  • Artikel:Mike Nomitch

    Cloudflare integriert Claude Managed Agents mit Cloudflare Sandboxes

    Cloudflare und Anthropic haben eine Integration zwischen Claude Managed Agents und Cloudflare Sandboxes vorgestellt. Entwickler können den Agent-Loop auf der Claude-Plattform ausführen und dabei Code-Ausführung, Sicherheit und Tool-Aufrufe über Cloudflare abwickeln.

    KI & AI· Ankündigung

  • Link:Docker

    Docker stellt Sandboxes, AI Governance und gehärtete Images für KI-Agenten vor

    Docker erweitert seine Plattform um Funktionen zur sicheren Ausführung autonomer KI-Agenten. Mit Docker Sandboxes auf Basis von MicroVMs, einer zentralen AI Governance Konsole und signierten Hardened Images sollen Agenten isoliert und auditierbar auf Entwicklerrechnern und Servern laufen.

    KI & AI· Ankündigung

  • X-Post:Shoopy

    Claude Code: Warum manuelle Befehlsfreigaben scheitern und wie Anthropic nachbessert

    Boris Cherny, Entwickler von Claude Code bei Anthropic, berichtet von Tests, bei denen Nutzer fast jeden manipulierten destruktiven Befehl reflexartig absegneten. Als Gegenmaßnahme setzt Anthropic auf ein zweites Modell ohne Dialogkontext sowie auf neuronales Monitoring gegen Prompt Injections.

    131Lesezeichen60.439Aufrufe

    KI & AI· News

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.