Codeset améliore les agents de codage avec un contexte spécifique au dépôt provenant de l'historique git.

✍️ OpenClawRadar📅 Publié: April 17, 2026🔗 Source
Codeset améliore les agents de codage avec un contexte spécifique au dépôt provenant de l'historique git.
Ad

Ce que fait Codeset

Codeset exécute un pipeline sur votre historique git et génère des fichiers qui résident directement dans votre dépôt. Ces fichiers incluent : les bugs passés par fichier avec leurs causes racines, les pièges connus, les relations de co-changement et les listes de contrôle de tests. L'agent de codage lit ces fichiers dans le cadre de sa fenêtre de contexte normale. Pas de RAG, pas de base de données vectorielle au moment de la requête, pas d'infrastructure d'exécution requise—juste des fichiers statiques que votre agent récupère comme n'importe quel autre fichier du dépôt.

Ad

Résultats de référence

L'équipe a testé Codeset avec deux références :

  • codeset-gym-python (150 tâches, même sous-ensemble que l'évaluation Claude) : 60,7 % → 66 % (+5,3 points de pourcentage)
  • SWE-Bench Pro (400 tâches échantillonnées aléatoirement) : 56,5 % → 58,5 % (+2 points de pourcentage)

Cela montre une amélioration constante sur les deux références, avec des gains plus faibles sur SWE-Bench Pro par rapport à codeset-gym. La référence codeset-gym est publique avec la liste complète des tâches et des vérificateurs disponibles pour la vérification de la méthodologie.

Tarification et disponibilité

Codeset coûte 5 $ par dépôt, paiement unique. Utilisez le code CODESETLAUNCH pour un essai gratuit. Les artefacts d'évaluation complets sont disponibles sur https://github.com/codeset-ai/codeset-release-evals.

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Forge : un IDE basé sur Claude avec vérification automatisée et ADN de projet
Tools

Forge : un IDE basé sur Claude avec vérification automatisée et ADN de projet

Forge est un IDE basé sur Claude construit sur VS Code qui exécute automatiquement la vérification des types, les tests, les contrôles de couverture et la validation des imports avant d'afficher le code. Il inclut des boucles d'auto-réparation pour les échecs de vérification et construit un ADN de projet des modèles de votre base de code.

OpenClawRadar
Jan-Code-4B : Un modèle léger optimisé pour le code, destiné au développement local
Tools

Jan-Code-4B : Un modèle léger optimisé pour le code, destiné au développement local

L'équipe Jan a publié Jan-Code-4B, un modèle de 4 milliards de paramètres optimisé pour le code, basé sur Jan-v3-4B-base-instruct. Conçu comme un remplacement direct pour Haiku dans Claude Code, il offre une assistance améliorée pour le codage tout en fonctionnant localement.

OpenClawRadar
OpenClaw PARA Compétence Organise Automatiquement les Fichiers en Utilisant la Méthode de Tiago Forte.
Tools

OpenClaw PARA Compétence Organise Automatiquement les Fichiers en Utilisant la Méthode de Tiago Forte.

Un développeur a créé une compétence OpenClaw qui applique la méthode PARA (Projets, Domaines, Ressources, Archives) pour l'organisation automatique des fichiers, déplaçant les fichiers d'un répertoire racine désordonné vers des dossiers structurés.

OpenClawRadar
🦀
Tools

Enquête sur les serveurs de mémoire Markdown locaux pour agents IA : Mem0, Hindsight, Zep et le nouveau venu Engram

Un utilisateur a testé ~20 systèmes de mémoire pour agents locaux stockant les souvenirs sous forme de fichiers modifiables. Engram (par Obsidian68) était le seul à répondre à toutes les exigences : entièrement local, stockage Markdown, déduplication intelligente, décroissance de l'importance, et serveur autonome.

OpenClawRadar