AutoDesign: Meta-Harness-Optimierung für agentisches Design

ArtikelYaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, Xiaotong LiForschung

Forschende stellen mit AutoDesign ein Framework vor, das multimodale Inhalte wie wissenschaftliche Arbeiten autonom in strukturierte Medien wie Konferenzposter überführt. Ein Meta-Harness-Optimierer leitet einen Code-Agenten dazu an, die Test- und Ausführungsumgebung anhand von Rollout-Feedback iterativ zu verbessern.

Das Wichtigste

  1. AutoDesign nutzt einen Meta-Harness-Optimierer zur rekursiven Selbstverbesserung eines Code-Agenten anhand von Feedback-Schleifen.
  2. Zur Evaluierung wurde der Benchmark PosterBench mit 100 wissenschaftlichen Arbeiten aus fünf Fachrichtungen sowie der Teilsatz PosterBench-mini erstellt.
  3. Im PosterBench Main Track erreicht das System 78,32 Punkte und übertrifft das kommerzielle System Claude Design um 7,45 Punkte.
  4. Der Einsatz des gelernten DesignHarness steigert die durchschnittliche Leistung über sieben Modellkonfigurationen hinweg von 54,99 auf 67,39 Punkte (+12,4 %).
  5. In einem autonomen Durchlauf führt das System innerhalb von 40 Minuten 253 Tool-Aufrufe und 11 Bearbeitungsrunden für unter 3 US-Dollar aus.
  6. Eine verblindete Nutzerstudie bescheinigt den erstellten Postern durchschnittliche Konferenzqualität und die höchste Nutzerpräferenz im Vergleich.

Warum das relevant ist

Die automatische Gestaltung komplexer visueller Medien erfordert langes schrittweises Planen und Verfeinern. AutoDesign zeigt, wie Agenten durch dynamische Optimierung ihres Ausführungsrahmens (Harness) und strukturierte Tool-Nutzung praxistaugliche Designaufgaben autonom und kostengünstig bewältigen können.

Einordnung

Das Papier demonstriert einen Paradigmenwechsel von statischen Agenten-Setups hin zu adaptiven Harness-Systemen. Indem der Optimierer die Werkzeuge und Rahmenbedingungen auf Basis von Ausführungsergebnissen rekursiv verfeinert, lassen sich signifikante Qualitätssteigerungen ohne manuelle Eingriffe erzielen. Die Kombination aus geringen Ausführungskosten (unter 3 Dollar) und solider Konferenzqualität verdeutlicht das wirtschaftliche Potenzial für automatisierte Medien- und Dokumentenerstellung.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Link:Yaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, Xiaotong Li

    AutoDesign: Meta-Harness-Optimierung für agentenbasiertes Design

    Forschende stellen mit AutoDesign ein Framework vor, das multimodale Inhalte durch autonome Code-Agenten in strukturierte Medienformate wie Konferenzposter überführt. Über einen Meta-Harness-Optimizer verbessert das System sein Harness iterativ anhand von Feedback und übertrifft dabei kommerzielle Lösungen.

    KI & AI· Forschung

  • Artikel:Jiaqi Liu et al.

    AutoResearchClaw: Multi-Agenten-Forschung mit iterativer Selbstkorrektur und Human-in-the-Loop

    Ein Forschungsteam um Jiaqi Liu stellt AutoResearchClaw vor, eine autonome Forschungspipeline auf Basis kooperierender Agenten. Das System bricht mit linearen Ausführungsmodellen und setzt auf iterative Fehlerkorrektur, überprüfbare Resultate sowie anpassbare menschliche Eingriffe. Im Benchmark ARC-Bench schlägt es vergleichbare Ansätze wie AI Scientist v2 deutlich.

    KI & AI· Forschung

  • Artikel:Shuai Shao, Kangning Zhang, Qingyao Li, Shijian Wang, Hao Wang, Wenxiang Jiao, Yuan Lu, Yi Guo, Weiwen Liu, Weinan Zhang

    Harness-R1: Automatisierte Laufzeit-Optimierung für KI-Agenten anhand von Fehlertrajektorien

    Ein Forschungsteam stellt Harness-R1 vor, eine Methode zur gezielten Anpassung der Software-Laufzeitumgebung (Harness) von LLM-Agenten. Statt nur Modellgewichte anzupassen, lernt ein separater 9B-Agent per Reinforcement Learning, fehlerhafte Ausführungsspuren zu analysieren und validierte Code-Patches für Kontextaufbereitung, Tool-Vermittlung und Aktionsvalidierung zu generieren.

    KI & AI· Forschung

  • Artikel:Mehdi Allahyari

    Harness Engineering: Warum die Umgebung wichtiger ist als das LLM-Modell

    Nach Prompt- und Context-Engineering bildet Harness Engineering die dritte Phase im Bau autonomer KI-Systeme. Mehdi Allahyari beschreibt die Software-Infrastruktur um das Sprachmodell als entscheidenden Erfolgsfaktor für Zuverlässigkeit und Selbstkorrektur.

    KI & AI· Sammlung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.