VTCode: Ein Rust TUI-Coding-Agent, der Kontext durch AST-Level-Chunking aggressiv kürzt

✍️ OpenClawRadar📅 Veröffentlicht: 27. Mai 2026🔗 Source
VTCode: Ein Rust TUI-Coding-Agent, der Kontext durch AST-Level-Chunking aggressiv kürzt
Ad

VTCode ist ein Open-Source Rust TUI Coding Agent, der einen anderen Ansatz für das Kontextmanagement verfolgt: Anstatt das gesamte Verzeichnis in jeden Prompt zu übernehmen, kürzt er den Kontext mithilfe von AST-Level-Chunking aggressiv. Entwickelt mit Fokus auf Token-Effizienz und Sicherheit, nutzt es ripgrep und ast-grep, um nur strukturell relevante Code-Chunks zu extrahieren und die Prompt-Größe bei Refaktorierungsaufgaben drastisch zu reduzieren.

Kernfunktionen

  • AST-Level-Kontextextraktion: Nutzt ripgrep + ast-grep, um nur relevante Code-Chunks an das Modell zu senden und so den Tokenverbrauch zu senken.
  • Explizite Token-Budget-Überwachung: Der Agent überwacht und verwaltet die Token-Nutzung, um Kontextüberläufe zu verhindern.
  • Sandboxing für Befehlsausführung: macOS Seatbelt + Linux Landlock + seccomp + tree-sitter-bash-Validierung für jeden modellgenerierten Befehl. Der Agent bleibt im Arbeitsbereich.
  • Benutzerdefinierte OpenAI-kompatible Anbieter: Einfach jeden Drittanbieter-Endpunkt mit einem Konfigurationsblock einbinden.
Ad

Ausführung mit DeepSeek V4 Flash

Der Autor hat VTCode mit DeepSeek V4 Flash über den Atlas Cloud Endpunkt für geringere Latenz während Stoßzeiten gekoppelt. Die Konfiguration ist einfach:

[agent]
provider = "atlas"
default_model = "deepseek-ai/deepseek-v4-flash"

[[custom_providers]] name = "atlas" base_url = "https://api.atlascloud.ai/v1" api_key_env = "ATLAS_API_KEY" model = "deepseek-ai/deepseek-v4-flash"

Der Agent unterstützt nativ OpenAI-kompatible Anbieter, also funktioniert jeder ähnliche Host – der Autor hat Atlas nur verwendet, weil er bereits einen Schlüssel hatte.

Für wen es geeignet ist

Entwickler, die einen schlanken, kontextbewussten TUI Agent für Programmieraufgaben suchen, ohne Tokens für irrelevante Dateien zu verschwenden oder sich um die Befehlssicherheit sorgen zu müssen.

📖 Vollständige Quelle lesen: r/LocalLLaMA

Ad

👀 Siehe auch

KI-Klaue: Serverless-Brücke verbindet Alexa mit lokaler OpenClaw mit dualer Auslieferung
Werkzeuge

KI-Klaue: Serverless-Brücke verbindet Alexa mit lokaler OpenClaw mit dualer Auslieferung

AI Claw ist eine Python AWS Lambda-Pipeline, die Amazon Echo-Lautsprecher mit lokalen OpenClaw-Instanzen verbindet und Amazons 8-Sekunden-Timeout umgeht, indem sie eine Fire-and-Forget-Architektur mit dualer Zustellung an Telegram und native Echo-Audioausgabe verwendet.

OpenClawRadar
ReasonDB: Open-Source-Dokumentendatenbank mit LLM-gesteuerter Baumnavigation anstelle von Vektorsuche
Werkzeuge

ReasonDB: Open-Source-Dokumentendatenbank mit LLM-gesteuerter Baumnavigation anstelle von Vektorsuche

ReasonDB ist eine Open-Source-Dokumentendatenbank, die die Dokumentenstruktur als Hierarchie erhält und anstelle der Vektorsuche LLM-gesteuerte Baumtraversierung für die Abfrage verwendet. Sie nutzt BM25 für die anfängliche Suche, tree-grep für die Strukturfilterung und Beam-Search-Traversierung, bei der das LLM etwa 25 Knoten von Millionen besucht.

OpenClawRadar
CostClaw: Kostenloses lokales Kostenverfolgungs-Dashboard für OpenClaw-Agenten
Werkzeuge

CostClaw: Kostenloses lokales Kostenverfolgungs-Dashboard für OpenClaw-Agenten

CostClaw ist ein kostenloses, lokales Plugin, das jeden LLM-Aufruf über die nativen Hooks von OpenClaw erfasst und ein Dashboard bereitstellt, das Modellaufschlüsselungen, Kosten pro Sitzung und stündliche Ausgabencharts anzeigt. Der Entwickler entdeckte, dass sein Heartbeat-Agent rund um die Uhr alle 3 Minuten Claude Sonnet ausführte, was 60 US-Dollar pro Monat kostete. Durch den Wechsel zu Haiku konnten die Kosten um etwa 65 % gesenkt werden.

OpenClawRadar
Lokale semantische Suche für KI-Gespräche mit fastembed und LanceDB
Werkzeuge

Lokale semantische Suche für KI-Gespräche mit fastembed und LanceDB

Ein Entwickler hat 368K KI-Konversationsnachrichten lokal mit fastembed für CPU-basierte Embeddings und LanceDB als serverlosen Vektorspeicher indiziert und dabei eine p50-Suchlatenz von 12ms ohne API-Schlüssel erreicht.

OpenClawRadar