Deblank: Tool zur Entfernung von Code-Formatierung für LLM-Token-Reduzierung

Was Deblank macht
Deblank ist ein Vorverarbeitungstool, das Code-Formatierung (Einrückungen, Leerzeichen, Zeilenumbrüche) entfernt, bevor Code an LLMs gesendet wird, mit einem Nachverarbeitungsschritt zur Wiederherstellung der Lesbarkeit. Die Transformation ist bidirektional und AST-sicher.
Leistungsergebnisse
In Evaluierungen über mehrere Modelle hinweg (DeepSeek-V3, Claude, Gemini usw.):
- ~30 % Token-Reduktion für Sprachen wie Java und C++
- ~9 % Token-Reduktion für Python
- Vernachlässigbare Auswirkungen auf die Pass@1-Genauigkeit für Code-Vervollständigung
- Durchschnittliche Latenz: ~76 ms
Unterstützte Sprachen und Funktionen
- Python, Java, C/C++, C#, JavaScript/TypeScript und Go
- Verarbeitet unvollständige Code-Schnipsel recht gut
- Nützlich für Fill-in-the-Middle-Workflows
Erste Schritte
Das Projekt ist Open-Source mit diesen Ressourcen:
- GitHub: https://github.com/anpl-code/Deblank
- Paper: https://arxiv.org/abs/2508.13666
- Docker:
docker pull zhangcen456/deblank:latest
Diese Art der Token-Optimierung kann besonders nützlich sein, wenn mit kontextbeschränkten LLMs gearbeitet wird oder große Codebasen verarbeitet werden, obwohl die Auswirkungen je nach Sprache aufgrund unterschiedlicher Formatierungskonventionen variieren.
📖 Read the full source: r/LocalLLaMA
👀 Siehe auch

Agentlint: GitHub-App, die Widersprüche in CLAUDE.md und defekte Verweise bei jedem PR erkennt.
Agentlint ist eine GitHub-App, die bei jedem PR Ihre gesamte Agent-Regeloberfläche (CLAUDE.md, AGENTS.md, Skills, Hooks) prüft und Inline-Kommentare zu Widersprüchen, ungültigen Pfaden und nicht unterstützten Harness-Funktionen postet. Kostenlos für öffentliche Repos.

Open-Source-Claude-Code-Fähigkeit /unzuck kuratiert Social-Media-Feeds in Dashboards
Eine kostenlose, quelloffene Claude Code-Fähigkeit namens /unzuck scannt parallel Feeds von Hacker News, Reddit, LinkedIn, YouTube, Twitter/X, Instagram und Facebook mithilfe von Browser-Automatisierung, bewertet Beiträge anhand von Nutzerinteressenprofilen und erstellt interaktive HTML-Dashboards.

NLA wandelt die internen Aktivierungen von Gemma 3 in lesbaren Text für jedes Token um
Anthropic veröffentlichte Natural Language Autoencoders (NLA), die den internen Zustand eines Modells in Text dekodieren. Gepaart mit Gemma 3 erklärt der Auto Verbalizer, was das Modell bei jedem generierten Token „dachte". Gewichte gibt es auf Hugging Face; eine Demo auf Neuronpedia.
Spine Swarm: Multi-Agenten-KI-System auf visueller Leinwand für Nicht-Programmier-Projekte
Spine Swarm ist ein Multi-Agenten-System, das auf einer unendlichen visuellen Leinwand arbeitet, um komplexe Nicht-Codierungsprojekte wie Wettbewerbsanalysen, Finanzmodellierung, SEO-Audits, Pitch Decks und interaktive Prototypen abzuschließen. Das System verwendet Blöcke als Abstraktionen über KI-Modellen, die verbunden werden können, um Kontext zwischen verschiedenen Modelltypen weiterzugeben.