civStation: Civilization VI 자연어 제어를 위한 오픈소스 VLM 하네스

✍️ OpenClawRadar📅 게시일: April 13, 2026🔗 Source
civStation: Civilization VI 자연어 제어를 위한 오픈소스 VLM 하네스
Ad

civStation의 기능

civStation은 Civilization VI를 위해 특별히 제작된 오픈소스, 제어 가능한 컴퓨터 사용 스택 및 VLM 하네스입니다. 이 프로젝트는 게임을 저수준 UI 자동화 문제로 취급하기보다 전략 수준의 제어에 중점을 둡니다. "동쪽으로 확장하라", "이번 턴에는 경제에 집중하라", "과학 승리를 목표로 하라"와 같은 자연어 입력을 제공하면 시스템은 해당 의도를 실제 게임 내 동작으로 변환합니다.

핵심 아키텍처와 루프

시스템은 완전한 루프를 구현합니다: 화면 관찰 → 전략 해석 → 행동 계획 → 실행 → 인간 개입. 이는 인터페이스를 직접 실행에서 의도 표현과 제어 가능한 위임으로 상향 이동시킵니다. 목표는 단순히 에이전트가 Civ6를 플레이하게 하는 것이 아니라, 모델이 게임 화면을 관찰하고 고급 전략을 해석하며 행동을 계획하고 마우스와 키보드를 통해 실행하며 인간 개입(HitL) 또는 MCP를 통해 실시간으로 중단되거나 안내받을 수 있는 루프를 구축하는 것이었습니다.

현재 기능과 능력

  • 실시간 데스크톱 관찰
  • 호스트 머신에서의 실제 UI 상호작용
  • 런타임 제어 인터페이스
  • 인간 개입 제어
  • MCP/기능 확장성
  • 자연어 또는 음성 기반 제어
Ad

연구 질문과 동기

창작자는 여러 질문을 탐구하고 있습니다: 전략과 실행 사이의 경계는 어디에 있어야 하는가? 루프가 너무 느리거나 취약해지기 전에 컴퓨터 사용 에이전트를 얼마나 제어할 수 있는가? 이 접근 방식은 게임에만 의미가 있는가, 아니면 더 넓은 데스크톱 워크플로에도 적용 가능한가?

동기는 대부분의 컴퓨터 사용 데모가 "모델이 클릭하는 것을 지켜보는" 데 집중하는 반면, civStation은 원시 UI 상호작용 대신 전략 수준에서 작동할 수 있는 제어 가능한 런타임에 더 가까운 것을 목표로 한다는 관찰에서 비롯되었습니다. 또 다른 동기는 음성과 자연어를 컴퓨터 사용과 결합하여 플레이어가 직접 행동을 실행하기보다 지시를 내리는 전략가처럼 행동하는 다른 상호작용 계층을 열 수 있는지 테스트하는 것이었습니다.

저장소와 이용 가능성

프로젝트는 다음에서 이용 가능합니다: https://github.com/NomaDamas/civStation.git

📖 Read the full source: r/LocalLLaMA

Ad

👀 See Also

클로드 코드 원격 제어: 어느 기기에서나 로컬 세션 계속하기
Tools

클로드 코드 원격 제어: 어느 기기에서나 로컬 세션 계속하기

Claude Code 원격 제어를 사용하면 로컬 Claude Code 세션을 휴대폰이나 브라우저와 같은 다른 기기에서 계속할 수 있으며, 모든 작업은 사용자의 컴퓨터에서 계속 실행됩니다. Pro 및 Max 플랜에서 연구용 미리보기로 제공되며, 인증 및 작업 공간 신뢰 설정이 필요합니다.

OpenClawRadar
OpenClaw 사용자가 ChatGPT 에이전트 워크플로우 행동을 개선하기 위해 'feelslikeclaude' 스킬을 생성합니다
Tools

OpenClaw 사용자가 ChatGPT 에이전트 워크플로우 행동을 개선하기 위해 'feelslikeclaude' 스킬을 생성합니다

한 개발자가 OpenClaw 설정을 Claude에서 ChatGPT로 전환한 후 핵심 차이가 글쓰기 스타일이 아닌 워크플로우 행동에 있음을 발견했습니다. 그들은 ChatGPT의 실행 습관을 개선하기 위해 'feelslikeclaude'라는 clawhub 스킬을 만들었습니다.

OpenClawRadar
유니버설 CLAUDE.md는 벤치마크에서 Claude 출력 토큰을 63% 감소시킵니다
Tools

유니버설 CLAUDE.md는 벤치마크에서 Claude 출력 토큰을 63% 감소시킵니다

한 개발자가 기술적 정확성을 유지하면서 Claude 응답의 토큰 사용량을 크게 줄이는 범용 CLAUDE.md 파일을 공개했습니다. 이 도구는 Claude가 Reddit 스레드, GitHub 이슈, 프롬프트 엔지니어링 연구를 조사하는 단일 세션 동안 Claude의 도움으로 완전히 구축되었습니다.

OpenClawRadar
다중 에이전트 토론 접근법이 LLM 추론 품질을 향상시킵니다
Tools

다중 에이전트 토론 접근법이 LLM 추론 품질을 향상시킵니다

한 개발자가 CyrcloAI를 사용하여 다중 에이전트 토론 방식을 실험했습니다. 이 방식에서는 분석가, 비평가, 종합자 등 다양한 역할을 맡은 AI 에이전트들이 최종 답변을 내놓기 전에 서로의 응답을 비판하며, 더 구조화되고 신중한 결과물을 만들어냈습니다.

OpenClawRadar