Ante:一款离线运行的单二进制编码代理

✍️ OpenClawRadar📅 게시일: August 11, 2026🔗 Source
Ante:一款离线运行的单二进制编码代理
Ad

Ante는 터미널에서 작동하는 자체 포함 코딩 에이전트입니다. Antigma Labs의 단일 ~15MB Rust 바이너리로, 런타임 의존성이 전혀 없습니다. Claude Code나 Codex처럼 작동하지만, 그들의 의존성 체인이나 모델 제약이 없습니다. 로컬 GGUF 모델로 완전히 오프라인에서 실행할 수 있습니다.

주요 기능

  • 단일 바이너리: Grep과 git이 내장된 순수 Rust로 작성되어 단일 프로세스로 실행되며 외부 도구가 필요 없습니다.
  • 기본 오프라인: 고정되고 관리되는 llama.cpp 빌드를 사용합니다. GGUF 파일을 지정하면 전체 루프가 로컬에서 실행됩니다. API 키, 계정, 인터넷이 필요 없습니다.
  • 낮은 리소스 사용: 20개의 병렬 Docker 작업에서 Ante는 Claude Code에 비해 최대 메모리 약 7배, 평균 CPU 약 9배, 디스크 I/O 약 5배 적게 사용합니다.
  • 지속적인 벤치마킹: 공식 리더보드 제약 조건에서 Terminal-Bench 2.1을 실행합니다. 최신 전체 실행: 오픈 가중치 DeepSeek V4 Flash 0731로 82.7% (368/445 시도, Ante 0.preview.71, 약 $68 추론 비용).

빠른 설치

한 줄로 설치:

curl -fsSL https://ante.run/install.sh | bash

특정 릴리스 채널 설치:

curl -fsSL https://ante.run/install.sh | bash -s -- nightly

PATH에 있는 디렉토리에 설치:

curl -fsSL https://ante.run/install.sh | ANTE_INSTALL_DIR=/usr/local/bin bash
Ad

사용 모드

  • 대화형 TUI: ante — 터미널에서의 일상 작업
  • 헤드리스: ante -p "..." — 일회성 작업, 스크립트, CI
  • 서버: ante serve — JSONL 프로토콜을 통한 에디터 플러그인 및 통합
  • 게이트웨이: ante gateway — Slack 또는 Discord 봇으로 실행

오프라인 모드 예시

ante --offline-model ~/.ante/models/Qwen3.5-9B-Q4_K_M.gguf \
  -p "src/main.rs에 오류 처리 추가"

텔레메트리 및 소스

텔레메트리는 ANTE_TELEMETRY=off로 거부할 수 있습니다. 재생성할 수 있는 익명 설치 레이블만 전송합니다. 코어 하네스는 현재 사전 빌드 바이너리로 제공됩니다. 저장소에는 문서, 프로토콜, SDK, 평가 파이프라인이 있지만, 소스 공개를 계획 중입니다.

📖 전체 소스 보기: HN AI Agents

Ad

👀 See Also

OpenClaw Memory-Core용 외부 리랭커 플러그인: 오래된 GPU 재활용하기
Tools

OpenClaw Memory-Core용 외부 리랭커 플러그인: 오래된 GPU 재활용하기

OpenClaw용 플러그인이 공개되어 memory-core가 기본 QMD 대신 외부 재순위화를 사용할 수 있게 되었습니다. CPU 성능이 제한된 시스템에서 성능을 개선합니다.

OpenClawRadar
SMELT 컴파일러는 OpenClaw 작업 공간 토큰 사용량을 최대 95%까지 절감합니다.
Tools

SMELT 컴파일러는 OpenClaw 작업 공간 토큰 사용량을 최대 95%까지 절감합니다.

SMELT는 OpenClaw 작업공간 마크다운 파일을 더 밀도 높은 런타임 형태로 컴파일하여 AI 모델에 관련 콘텐츠만 전송합니다. 벤치마크 결과, 쿼리당 토큰 사용량이 76.1%에서 95.5%까지 감소했으며, USER.md 및 SOUR.md와 같은 정적 파일을 매 메시지마다 재처리하는 것을 방지합니다.

OpenClawRadar
릴레이: OpenClaw AI 에이전트를 위한 오픈소스 제어 플레인
Tools

릴레이: OpenClaw AI 에이전트를 위한 오픈소스 제어 플레인

Relay는 Claude Cowork과 유사한 워크플로우를 OpenClaw에 제공하는 Electron 데스크톱 앱으로, 사용자가 선택한 LLM 모델과 함께 사용자 인프라에서 실행되며 승인 게이트와 내보내기 가능한 감사 추적을 포함한 내장 거버넌스 기능을 갖추고 있습니다.

OpenClawRadar
비용 효율적인 Claude 대체를 위한 오픈소스 AI 모델 스택
Tools

비용 효율적인 Claude 대체를 위한 오픈소스 AI 모델 스택

레딧 사용자가 Llama 3.3 70b와 DeepSeek R1 32b 같은 오픈소스 모델을 로컬에서 실행하는 실용적인 AI 모델 스택을 공유하며, 90%의 작업을 무료 모델로 라우팅하여 월간 AI 비용을 £60 이상에서 £3 미만으로 줄였다고 밝혔습니다.

OpenClawRadar