TextGen (text-generation-webui)가 포터블 빌드로 네이티브 데스크톱 앱이 되다
TextGen(구 text-generation-webui, oobabooga로도 알려짐)이 네이티브 데스크톱 앱 버전을 출시했습니다. 2022년 12월부터 개발 중인 이 프로젝트는 이제 휴대용 빌드를 제공합니다. 다운로드하고 압축을 푼 다음 textgen을 더블클릭하기만 하면 됩니다. 설치나 추출된 폴더 외부의 파일이 필요 없습니다. 모든 채팅 기록과 설정은 번들로 제공되는 user_data 폴더에 저장됩니다.
주요 기능
- 프라이버시: 외부 요청이 전혀 없습니다. LM Studio와 달리 OS, CPU, 앱 버전, 백엔드 선택 등에 대한 정보를 외부로 전송하지 않습니다.
- ik_llama.cpp 빌드: LM Studio와 Ollama가 사용하는 일반 llama.cpp보다 더 나은 정확도를 위해 IQ4_KS, IQ5_KS와 같은 맞춤형 양자화 타입을 제공합니다.
- 내장 웹 검색:
ddgsPython 라이브러리를 사용합니다. 두 가지 모드:web_search도구를 호출하는 도구 호출 모드(Qwen 3.6 및 Gemma 4에서 작동) 또는 검색 결과를 텍스트 첨부 파일로 가져오는 체크박스 모드. - 도구 호출: 단일 파일 .py 도구(쉬운 사용자 정의 함수), HTTP MCP 서버, stdio MCP 서버를 지원합니다. 도구 호출 전에 승인/거부 확인을 요구하는 옵션도 있습니다. 가이드 보기.
- 커스텀 캐릭터: 지시 수행 대화와 함께 캐주얼 채팅을 위한 캐릭터를 만들 수 있습니다.
- API 호환성: OpenAI 및 Anthropic 스펙과 호환되는 API. Claude Code와 함께 사용 가능:
ANTHROPIC_BASE_URL=http://127.0.0.1:5000 claude. - PDF 추출: 정확한 텍스트 추출을 위해 PyMuPDF를 사용합니다.
- 웹 페이지 가져오기:
trafilatura를 사용하여 탐색/보일러플레이트를 제거, 에이전트 루프에서 토큰을 절약합니다. - Jinja2 템플릿: Python Jinja2를 통해 채팅 템플릿을 렌더링하여 llama.cpp의 C++ jinja 재구현에서 발생하는 충돌을 방지합니다.
사용 가능한 빌드
CUDA, Vulkan, CPU 전용, Mac(Apple Silicon 및 Intel), ROCm. 모두 휴대용입니다.
라이선스: AGPLv3. 소스: https://github.com/oobabooga/textgen
📖 전체 글 읽기: r/LocalLLaMA
👀 See Also
클로드가 완료되면 풍선이 터지는: whisper.cpp를 활용한 물리적 에이전트 UI
말하는 대로 부풀어 오르는 풍선이 화면을 떠다니며 Claude Code 에이전트를 실행합니다. 음성 인식은 로컬 whisper.cpp로 처리되며, 에이전트는 기존 Claude Code 로그인을 사용합니다. 오픈 소스입니다.

마에스트로 v1.5.0은 다중 에이전트 오케스트레이션을 위한 Claude Code 지원을 추가합니다.
오픈소스 멀티에이전트 오케스트레이션 플랫폼인 Maestro v1.5.0이 이제 Gemini CLI 외에도 Claude Code에서 네이티브 플러그인으로 실행됩니다. 이 업데이트에는 심화된 설계 계획, 42단계 오케스트레이션 백본, 에이전트 역량 강화, 보안 강화가 포함됩니다.

API 간 상호작용 탐구: 자동화에 대한 심층 분석
레딧(Reddit)에서 최근 논의된 API 간 전화 통화에 관한 내용은 Postman과 Twilio 같은 도구를 활용한 실질적인 구현 방법과 잠재적인 문제점에 초점을 맞추고 있습니다.

넥서스: 오픈클로를 위한 오픈 소스 에이전트 조정 레이어
NEXUS는 OpenClaw 위에 구축된 조정 계층으로, AI 에이전트들이 서로를 발견하고, 작업을 위임하며, 소액 결제를 처리할 수 있도록 합니다. 여기에는 에이전트 레지스트리, 역량 기반 발견 기능, 신뢰 점수 시스템이 포함되며, Google의 A2A 프로토콜과 Anthropic의 MCP를 사용합니다.