Infracost reduziert Claude-Token-Nutzung um 79% durch Neugestaltung der CLI für KI-Agenten

Infracost, ein CLI-Tool, das Cloud-Infrastrukturkosten aus Terraform, CloudFormation und CDK schätzt, hat seine Ausgabe für KI-Codierungsagenten wie Claude Code und Cursor neu gestaltet. Das Ergebnis: bis zu 79% weniger Ausgabetokens und 67% niedrigere API-Kosten im Vergleich zu einer reinen Claude-Baseline. Die Neugestaltung basiert auf zwei Techniken: Predicate Pushdown ins CLI und ein token-effizientes Ausgabeformat.
Benchmark-Details
- 16 Fragen über eine 3-Projekt-Terraform-Fixtur mit 1.171 Ressourcen
- Modell: Claude Opus, 5 Wiederholungen pro Frage
- Baseline: reines Claude mit Bash- und Read-Tools, ohne geladene Fähigkeiten
- Verglichen mit Infracost-Fähigkeit mit
--llm-Ausgabeflag
Wichtigste Ergebnisse
| Metrik | Reines Claude | Mit Infracost-Fähigkeit (--llm) | Änderung |
|---|---|---|---|
| Richtige Antworten | 5 / 11 (45%) | 11 / 11 (100%) | +6 |
| Gesamtkosten (USD) | 16,41 $ | 9,63 $ | -41% |
| Ausgabetokens | 207.017 | 81.697 | -61% |
| Echtzeit | 50 Min | 50 Min | gleich |
Ein Beispiel: Die Frage „zähle unterschiedliche Ressourcen, die gegen die Tagging-Richtlinie verstoßen, dedupliziert über Projekte hinweg" kostete mit reinem Claude 3,51 $ und erreichte das 25-Turn-Limit, ohne eine Antwort zu liefern. Mit dem neu gestalteten CLI kostete dieselbe Frage 0,25 $ und lieferte die richtige Antwort.
Technischer Ansatz
- Predicate Pushdown: Anstatt den Agenten JSON durch
jqzu pipen oder Python-Parser schreiben zu lassen, akzeptiert das CLI Filterflags (z. B.--tag-policy) und lagert die Berechnung an das Tool selbst aus. Dies reduziert die Anzahl der Turns und den Tokenverbrauch. - Token-effizientes Ausgabeformat: Das
--llm-Flag gibt ein kompaktes, agentenfreundliches Format zurück, anstatt ausführlicher, für Menschen lesbarer Tabellen oder vollständigem JSON. Dies allein trägt zu einem erheblichen Teil der Reduzierung bei.
Benchmark-Harness-Fallstricke
Infracost hat die Einrichtung seines Harness als Open Source veröffentlicht, um anderen zu helfen, Fehler zu vermeiden:
- Sandbox-
HOMEfür Baseline-Läufe, um versehentliches Laden von Fähigkeiten zu vermeiden TMPDIRauf ein projektspezifisches Verzeichnis setzen, um macOS-ACL-Probleme zu umgehen- Das Test-Binary zu
PATHhinzufügen, anstatt sich auf die Systeminstallation zu verlassen - 5+ Wiederholungen pro Zelle aufgrund von 20-30% Token-Varianz verwenden
- Zellen, die das Turn-Limit erreicht haben, erneut ausführen (
--rerun-failed) und neu bewerten, wenn sich der Verifizierer ändert (--rescore)
Wenn Sie ein CLI betreiben, das KI-Agenten als Subprozess aufrufen, sind dieselben beiden Maßnahmen – Predicate Pushdown und ein dediziertes Agenten-Ausgabeformat – wahrscheinlich anwendbar. Die Neugestaltung hat auch das für Menschen gedachte CLI verbessert, obwohl sich der Artikel auf den Agentenweg konzentriert.
📖 Vollständige Quelle lesen: HN AI Agents
👀 Siehe auch

Fennara: Godot Plugin + MCP für KI-Agenten mit iterativer Rückkopplungsschleife
Fennara ist ein Godot-Plugin und MCP-Server, der KI-Agenten Skriptdiagnosen, Szenenvalidierung, Laufzeitfehler, Knoteninformationen, Screenshots und semantische Suchergebnisse nach jeder Änderung liefert – und so eine engere Rückkopplungsschleife als Einmalbefehle ermöglicht.

TrustLog Dynamics: Python-Daemon nutzt Bond-Mathematik, um unerwünschte KI-Agenten zu stoppen
TrustLog Dynamics ist ein Python-Daemon, der API-Kosten von KI-Agenten in Echtzeit überwacht und Prozesse mithilfe zweier quantitativer Finanzmethoden beendet: Konvexitätserkennung für beschleunigende Kosten und Nullvarianz-Erkennung für mechanische Schleifen.

Feynman: Open-Source-Forschungsagent mit Tool zur Überprüfung von Papier-Codebasen
Feynman ist ein Open-Source-Forschungsagent-CLI, der vier Subagenten parallel einsetzt, um Forschungsfragen zu beantworten, und ein einzigartiges Audit-Tool enthält, das Behauptungen in wissenschaftlichen Arbeiten mit tatsächlichen Codebasen vergleicht. Es bietet Ein-Kommando-Installation, MIT-Lizenz und läuft auf pi für die Agentenlaufzeit mit alphaxiv für die Papiersuche.

Quiver: Eine GUI zur Verwaltung und Synchronisierung von Claude Code Skills
Quiver ist ein kostenloses, quelloffenes GUI-Tool, das eine Weboberfläche zur Verwaltung von Claude Code Skills bietet. Es ermöglicht Benutzern, lokale Skills und Marketplace-Plugins zu durchsuchen, SKILL.md-Dateien zu bearbeiten, über Git zu synchronisieren und Skills ohne Terminal zu installieren.