Agent IA intégré dans le shell : Extension de tampon terminal et de superposition

Le développeur u/zoomaaron a publié un projet sur r/LocalLLaMA qui intègre un agent IA directement dans le shell. L'agent surveille toute la sortie du terminal, éliminant ainsi le besoin de copier-coller manuellement les messages d'erreur vers un agent de codage séparé. Une nouvelle extension ajoute une superposition flottante qui lit le terminal et tape des commandes — utile pour les installations interactives ou les sessions SSH sans configuration à distance.
Fonctionnalités clés
- L'agent a une visibilité complète sur l'historique et l'état du shell
- Deux extensions :
overlay-agentpour l'affichage flottant,terminal-bufferpour envoyer des frappes - Fonctionne avec des modèles locaux (ex. LLaMA, Mistral) et des LLM cloud
- Sous licence MIT — entièrement open source
- La fonctionnalité de superposition est expérimentale (dans le dossier d'exemples)
Configuration
Pointez votre agent de codage vers la documentation du projet pour configurer les deux extensions. L'auteur note que le projet est encore en développement, donc attendez-vous à d'éventuels dysfonctionnements.
Les cas d'utilisation incluent : la gestion des invites d'installation interactives, l'assistance via SSH sans rien installer sur l'hôte distant, et l'expérimentation générale d'automatisation du terminal.
📖 Read the full source: r/LocalLLaMA
👀 See Also

Codebook Lossless LLM Compression : Réduction de 10 à 25 % de la RAM grâce au Bitwise Packing
Le code de preuve de concept d'un développeur démontre une compression LLM sans perte en regroupant les poids fp16 en blocs, obtenant une réduction de 10 à 25 % de la RAM au prix d'une vitesse d'inférence approximativement divisée par deux. L'approche identifie que la plupart des modèles n'utilisent que 12 à 13 bits de valeurs uniques malgré la représentation sur 16 bits du fp16.

Ory Lumen : Plugin de recherche sémantique locale open source pour Claude Code
Ory Lumen est un plugin Claude Code qui indexe les bases de code en utilisant Ollama avec un modèle d'incorporation de code et SQLite-vec pour la recherche sémantique, résolvant les problèmes de performance de Claude Code avec les grandes bases de code. L'outil est gratuit, fonctionne uniquement en local et inclut un banc d'essai de type SWE pour des résultats reproductibles.

SkillOpt : Optimisation des fichiers de compétences Markdown en tant que paramètres entraînables pour les agents IA
SkillOpt formalise le processus ad hoc d'édition de fichiers markdown de compétences pour les agents de codage IA, en utilisant des modèles de pointe pour proposer des modifications limitées validées par des ensembles de validation. Les meilleures compétences convergent avec 1 à 4 modifications acceptées parmi de nombreuses propositions, et se transfèrent entre modèles comme Codex vers Claude Code.

NerfGuard : un classifieur qui oriente les demandes de codage vers des modèles moins chers, réduisant les coûts de 3 fois
NerfGuard utilise un classifieur rapide pour acheminer les requêtes des agents de codage vers le modèle et la profondeur de raisonnement les moins chers, permettant ainsi une utilisation 3x supérieure pour le même budget. Inclut des optimisations de tokens.