civStation : Harnais VLM Open-Source pour le Contrôle en Langage Naturel de Civilization VI

✍️ OpenClawRadar📅 Publié: April 13, 2026🔗 Source
civStation : Harnais VLM Open-Source pour le Contrôle en Langage Naturel de Civilization VI
Ad

Ce que fait civStation

civStation est une pile informatique open-source et contrôlable, ainsi qu'un harnais VLM, conçu spécifiquement pour Civilization VI. Au lieu de traiter le jeu comme un problème d'automatisation d'interface utilisateur de bas niveau, le projet se concentre sur le contrôle au niveau stratégique. Vous pouvez donner des entrées en langage naturel comme "étendez-vous vers l'est", "concentrez-vous sur l'économie ce tour-ci", ou "visez une victoire scientifique", et le système traduit cette intention en actions réelles dans le jeu.

Architecture et boucle principales

Le système implémente une boucle complète : observation de l'écran → interprétation stratégique → planification d'actions → exécution → surcharge humaine. Cela déplace l'interface du niveau de l'exécution directe vers l'expression d'intention et la délégation contrôlable. L'objectif n'était pas seulement de créer un agent qui joue à Civ6, mais de construire une boucle où le modèle peut observer l'écran du jeu, interpréter une stratégie de haut niveau, planifier des actions, les exécuter via la souris et le clavier, et être interrompu ou guidé en direct par un humain dans la boucle (HitL) ou par MCP.

Fonctionnalités et capacités actuelles

  • Observation en direct du bureau
  • Interaction réelle avec l'interface utilisateur sur la machine hôte
  • Interface de contrôle en temps d'exécution
  • Contrôle humain dans la boucle
  • Extensibilité MCP/compétences
  • Contrôle par langage naturel ou vocal
Ad

Questions de recherche et motivation

Le créateur explore plusieurs questions : Où devrait se situer la frontière entre la stratégie et l'exécution ? Jusqu'où un agent informatique peut-il être contrôlable avant que la boucle ne devienne trop lente ou fragile ? Cette approche a-t-elle du sens uniquement pour les jeux, ou aussi pour des flux de travail bureautiques plus larges ?

La motivation vient de l'observation que la plupart des démonstrations d'utilisation informatique se concentrent sur "regarder le modèle cliquer", tandis que civStation vise quelque chose de plus proche d'un environnement d'exécution contrôlable où vous pouvez opérer au niveau de la stratégie plutôt que de l'interaction brute avec l'interface utilisateur. Une autre motivation était de tester si la voix et le langage naturel, combinés à l'utilisation informatique, pourraient ouvrir une couche d'interaction différente où le joueur se comporte davantage comme un stratège donnant des directives plutôt que d'exécuter directement des actions.

Dépôt et disponibilité

Le projet est disponible à l'adresse : https://github.com/NomaDamas/civStation.git

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

Le test de codage Pacman passé par Qwen 3.6 27B F16, mais échec des quantifications 8 bits — Leçons clés sur les modèles et le décodage spéculatif MTP
Tools

Le test de codage Pacman passé par Qwen 3.6 27B F16, mais échec des quantifications 8 bits — Leçons clés sur les modèles et le décodage spéculatif MTP

Un utilisateur a réalisé une seule tentative pour créer un clone de Pacman avec Qwen 3.6 27B F16 — deux des trois tentatives ont donné des jeux quasi parfaits. Les versions 8 bits ont échoué complètement. Notes détaillées sur l'optimisation du template de chat et les gains de vitesse grâce au décodage spéculatif MTP.

OpenClawRadar
graphify-ts : Un serveur MCP local réduit les tokens de revue de PR de Claude Code de 63K à 8,7K
Tools

graphify-ts : Un serveur MCP local réduit les tokens de revue de PR de Claude Code de 63K à 8,7K

graphify-ts construit un graphe de connaissances local de votre codebase en utilisant l'AST de tree-sitter + les communautés Louvain + BM25 + un réordonnancement ONNX optionnel, et l'expose via MCP stdio. Dans les tests en production, il a réduit les tokens d'entrée de 2,6x et la latence de 2,8x pour les requêtes de code, et a réduit les prompts de revue de PR de 63K à 8,7K tokens.

OpenClawRadar
Construction et test d'un serveur MCP dans Claude Desktop : Architecture et enseignements
Tools

Construction et test d'un serveur MCP dans Claude Desktop : Architecture et enseignements

Un développeur partage son expérience de construction et de test d'un serveur MCP dans Claude Desktop, détaillant sa configuration d'architecture et les leçons pratiques apprises sur les schémas d'outils, le débogage et les limitations.

OpenClawRadar
Le goulot d'étranglement dans les agents IA parallèles : la file d'attente d'approbation humaine
Tools

Le goulot d'étranglement dans les agents IA parallèles : la file d'attente d'approbation humaine

Un développeur exécutant des agents Claude Code en parallèle décrit le « bottleself » — le point où le parallélisme cesse d'augmenter la production et commence à créer un backlog d'approbations humaines. Sa solution : un planificateur qui décompose les objectifs en sous-tâches, lance des agents, et n'interrompt que pour les décisions non résolues.

OpenClawRadar