RTK: Rust-basierter CLI-Proxy zur Reduzierung von LLM-Tokens

Repositoryrtk-ai/rtkTool

RTK (Rust Token Killer) ist ein CLI-Proxy, der Ausgaben von Shell-Befehlen filtert und komprimiert, bevor sie an den Kontext eines LLM-Agenten übergeben werden. Das Tool liegt als einzelnes Rust-Binary ohne externe Abhängigkeiten vor und soll das Token-Volumen von Terminal-Ausgaben um 60 bis 90 Prozent senken.

Das Wichtigste

  1. Filtert Terminal-Outputs von über 100 Befehlen mit einer Latenz von unter 10 ms.
  2. Optimiert Befehle wie git, ls, grep, docker sowie Test-Runner (npm, cargo, pytest, go test), indem etwa nur Fehler oder komprimierte Strukturen übergeben werden.
  3. Ersparnisse beziehen sich auf den Bash-Output und bedeuten nicht automatisch 90 Prozent geringere Gesamtkosten, da Prompts und Konversationsverläufe unverändert bleiben.
  4. Entwickelt als eigenständiges Rust-Binary unter Apache-2.0-Lizenz ohne Laufzeitabhängigkeiten.

Warum das relevant ist

Bei agentenbasierten Programmier-Workflows (Agentic Coding) füllen repetitive oder seitenlange Terminal-Ausgaben schnell das Kontextfenster und treiben die API-Kosten in die Höhe. Ein vorgeschalteter Proxy reduziert unnötiges Rauschen, spart Input-Tokens und schont den Kontextspeicher.

Einordnung

Das Projekt zielt gezielt auf Entwickler, die Coding-Agenten wie Claude Code im Terminal einsetzen. Mit über 78.000 Sternen, Homebrew-Distribution und mehrsprachiger Dokumentation weist das Repository eine sehr hohe Verbreitung und Reife auf. Die Macher betonen transparent, dass sich die prozentualen Einsparungen auf die Befehlsausgaben beziehen und nicht auf die gesamte API-Rechnung.

Gefunden in

Zusammenfassung von KI erstellt (Gemini 3.8 Flash, 27. September 2026). Sie kann Fehler enthalten – maßgeblich ist die Originalquelle.

Inhaltlich ähnlich, ermittelt über die KI-Suche.

  • Repository:decolua/9router

    9Router: Lokaler Proxy und Token-Sparer für KI-Coding-Tools

    9Router ist ein quelloffener KI-Router, der Coding-Assistenten wie Claude Code, Cursor oder Cline über eine lokale Proxy-Schnittstelle mit mehr als 40 Providern verbindet. Das Tool komprimiert Tool-Ergebnisse, um 20 bis 40 Prozent an Token einzusparen, und schaltet bei Ratenlimits oder Fehlern automatisch auf alternative oder kostenfreie Anbieter um.

    27.131SterneJavaScript

    KI & AI· Tool

  • Repository:JuliusBrussee/caveman

    Caveman: Token-Reduktion für Coding-Agents durch extrem knappe Antworten

    Caveman ist ein Open-Source-Tool und Prompting-Skill, das die Wortfülle von KI-Programmierassistenten eliminiert. Indem Modelle knappe Antworten im Telegrammstil („Caveman“-Stil) liefern, senkt das Projekt den Token-Verbrauch bei Ausgaben um bis zu 65 Prozent, ohne Code-Qualität oder technische Anweisungen zu beeinträchtigen.

    103.726SterneGo

    KI & AI· Tool

  • Repository:headroomlabs-ai/headroom

    Headroom: Lokale Kontext-Kompression für KI-Agenten und RAG

    Headroom ist ein Open-Source-Tool, das Tool-Outputs, Logs, RAG-Chunks und Dateien komprimiert, bevor sie an ein Large Language Model gesendet werden. Die Kompression läuft lokal auf der eigenen Maschine und reduziert den Token-Verbrauch bei Coding-Agenten um 20 Prozent und bei JSON um bis zu 95 Prozent.

    68.977SternePython

    KI & AI· Tool

  • Repository:getagentseal/codeburn

    CodeBurn: Lokales Tracking von Token-Verbrauch und Kosten für KI-Coding-Tools

    CodeBurn ist ein quelloffenes, lokal laufendes Tool zur Überwachung von Token-Verbrauch und Ausgaben bei KI-Coding-Assistenten. Die Anwendung aggregiert Daten aus über 37 verschiedenen Tools und Agenten und schlüsselt Kosten nach Modell, Projekt und Aufgabe auf.

    10.802SterneTypeScript

    KI & AI· Tool

  • Repository:troopdegen/mucho-texto

    mucho-texto: Strukturierte Ergebnis-Kompaktheit für Coding-Agents

    mucho-texto ist ein Prompt- und Skill-Werkzeug für Coding-Assistenten wie Claude Code, Cursor und agentische AGENTS.md-Workflows. Es verhindert ausufernde Berichte nach erledigten Aufgaben, indem es Ergebnisse in vier feste Kategorien unterteilt und eine vollständige Dokumentation in einer dauerhaften Datei zur Pflicht macht.

    Shell

    KI & AI· Tool

  • Artikel:Alex Rios

    Token-Ersparnis durch knappe Agenten-Sprache

    Alex Rios thematisiert Methoden zur Kostensenkung bei KI-Coding-Agenten wie Claude Code oder Cursor. Ein Ansatz verspricht 75 Prozent Ersparnis, indem der Assistent grammatikalische Füllwörter und Höflichkeiten weglässt und stark verkürzt antwortet.

    KI & AI· Meinung

Lassen Sie uns über Ihr Projekt sprechen

Standorte

  • Mattersburg
    Johann Nepomuk Bergerstraße 7/2/14
    7210 Mattersburg, Austria
  • Wien
    Ungargasse 64-66/3/404
    1030 Wien, Austria

Dieser Inhalt wurde teilweise mithilfe von KI erstellt.