Artikel:Rebecca Bellan
Anthropic untersucht Multi-Agenten-Dynamiken: Sabotage, Kartelle und Konfliktlösung
Das Frontier Red Team von Anthropic hat untersucht, wie autonome KI-Agenten miteinander agieren, wenn sie auf derselben Codebasis mit widersprüchlichen Anweisungen konfrontiert werden. Die Modelle starteten teils aggressive Sabotageakte gegeneinander, entwickelten jedoch auch spontane Mechanismen zur Streitschlichtung oder Preisabsprachen.
Aus Video: Weekly AI Roundup: DeepSeek Harness, Model Routing, and Scaffolding Shifts